﻿# Next Token Weekly #003 阅读文字稿

本期主理人：歸藏、向阳乔木、橘子、杨攀。

> 本稿由用户完成全文文字修改；人物与时间锚点来自腾讯会议转写，尚未逐句听校。

[阅读网页版](https://nexttoken.tv/weekly/003/transcript)

## 01 / 节目片头

**片头解说：**

大家好，欢迎来到 Next Token｜词元之外。Next Token｜词元之外是一档关注 AI 技术、产品与现实影响的视频播客，同时提供音频版。旗舰栏目 Next Token Weekly，由杨攀、歸藏、橘子和向阳乔木每周圆桌对谈，分享观察、实践与不同判断。不只预测下一个词元。

## 02 / 四位主理人开场

**歸藏：**

大家好，欢迎大家来到 Next Token 第三期的录制，我是歸藏。

**向阳乔木：**

大家好，我是向阳乔木。

**橘子：**

大家好，我是橘子。

**杨攀：**

大家好，我是杨攀。

## 03 / Jev：不聊天，做结构化判断

**歸藏：**

我们这就开始我们的这周的 Next Token，首先我们看一下，还是按照我们之前的来跟着上周的新闻聊，聊到哪儿算哪。第一个是我觉得上周最火的新新模型，也就是 TypeSafe AI 的 Jev 模型。它跟现在的大语言模型不太一样，它的优势比较明显，你可以当它一个通用的分类器，然后它能它输出的不是我们现在大语言模型输出的。聊天或者是一段一段的话，它只输出一些类似于程序上的一些结果，比如说他，你让他选几个东西，他给你一个选择，你让他打一个分，他给你一个对应的分数，他给你一个是非的判断错。所以说它的速度就非常快，同时可以并行去处理，成本也非常低。他们现在官方是输入价格是 $0.042/MTok，输出免费，成本完成一些批量的任务，成本就低的很多。大家都看过，用没用，反正不知道，反正大家都应该看过！你们有什么想法吗？

**橘子：**

对，我对，我是刚刚用了一下，我让他去从我那个 Cola 里面去查看了我的 300 多条记忆，让他去打个分儿，看哪些觉得比较重要，值得留下来哪些可以舍弃掉。他大概给我觉得那些琐事的东西能删掉一半，他比较喜欢抽象的东西，然后他给我整理了大概 18 条比较重要的。对，还挺有意思的。

**歸藏：**

感觉对大语言模型或者是对 Agent 很多东西上都有提效，我看了还有一个案例是他去让模型帮他挑 Skill。因为它装的 Skill 比较多，原来可能跳的就很慢，然后占用透明很多，然后现在他就直接让模型去调，然后直接就瞬间就能返回结果。

## 04 / 微信好友标签与高频判断

**杨攀：**

我这有个案例，我不是之前把自己的微信相关的资料导出来了嘛，然后我这里边有 1 万个好友，我之前做功能，让他读我跟我好友的聊天记录，看我们共同的群，然后给这些人打标签，我自己有 20 多个标签，都是比如说，这是 CTO，这是创始人，这是做什么什么的，我之前试过用我本地的 27B 或者 35B 的小模型来干这个事情，第一个就是干的特别慢，第二个其实也挺不准的，我现在试的就是让他帮我去做打标签的工作。然后我给他提了方案，我说你你做完之后给我个枚举什么的，他说不要这么做，他这我用 GPT-6 来做，GPT-6 说你这样，你把你的每一个标签让他算一遍。然后算这个标签是 yes or no 它不是三种模式，一个是 yes no，

**歸藏：**

选择题。

**杨攀：**

一个，是枚举，一个概率，然后他说让我去做，把每个标签，让返回一个 yes no，因为标签是个多选嘛，它你要是直接让它多选，它是做不到，这是一个场景，还有一个场景，我之前不是好友加满了，一直有个功能，让大模型建议我删谁，我觉得又是一个海量的数据的问题，就这个 Jev 其实特别适合，海量高频的场景。因为之前昨天有人说一些场景，我觉得，他们说中间能省 Token，但在很多场景，现在大家使的案例都是说。比如说我有 1% 的地方，我再优化个 90%，你只获得了 0.9% 的优化。如果你把不用到一个海量高频的地方，进的收益不够高，然后我就是让他把我的 1 万个好友都跑一遍，然后给他一些规则，然后让他告诉我。建议删除谁，返回也是个概率，另外还有一个就是让他把我每天的那个，聊天沟通的内容都扫一遍，我一天大概可能跟几十、一百个人聊过天，然后把这里边的。谁跟我聊天完了以后有，比如有 TODO 有 highlight，然后让他帮我返回过来滤出来，我这个现在还在跑，跑一部分出来了，我目前看的速度和结果还行，回头我会跟另外一个小尺寸模型再做个对比，回头可以出数据。

**向阳乔木：**

我说一下。

**橘子：**

这个 1 万个， 1 万个，它要跑多久大概？

**杨攀：**

我这还没跑完，1 万个就是因为因为它可以并发的调，

**橘子：**

对。

**杨攀：**

其实很快的，你不用一个串行调，对，它本本身每个单独调用就是，就不考虑网络情况下，考虑的情况就几 100 毫秒差不多，就这个水平，你就开并发。反正我也没有依赖顺序。

**向阳乔木：**

对，我看到以后，我就直接申请了，没想到还挺快，第二天就给过了当时，当时我试的时候没想到特别好的使用场景，只是把它调通了，今天我看网上有些人的案例，我觉得还挺有意思的，比如说有人做了。大模型版的 Ctrl+F？

## 05 / 语义搜索与数据库查询

**向阳乔木：**

Ctrl+F 我们都知道是精准匹配的，我要搜某个词，然后来查页面上或者查内容里边这个关键词是精准匹配的，他用做成了相当于是大模型的模糊匹配，你说高兴它假如不是精准匹配，它也能找到类似意思的内容。还有人，就把 GPT 做成了，数据库查询的函数，比如说我想知道，今天，谁没有来公司类似的数据库里面记录，它能直接返回。以前的话你可能是需要查数据库查比较多表。我感觉它应用场景也挺有意思的，但是目前我看，

**杨攀：**

这相当于是有泛化能力的函数！

**向阳乔木：**

对！

**歸藏：**

对通用的分类器。

**向阳乔木：**

然后我感觉现在特别能跑通，大家可能还在探索，大家直观上觉得能跑通的 Computer Use 这个肯定是可以加速的。因为他就是读那些 DOM 树来判断要点哪些地方，其他的话我感觉大家也有一些疑虑，比如说模型，因为构架都没有公开，智能水平也没有很好的 Benchmark。说他有没有可能判断错误？然后你让他做这么多，判断的时候，他给的结果到底准不准？然后大家是有些疑虑的，我观察到是这些。

## 06 / “没有幻觉”不等于判断正确

**杨攀：**

对，他这里边就是宣传过程中有一个点，他说这个没有幻觉，他里边有点偷换概念，他是说我们，我们正常用小模型来去做，比如你让它输出个强类型的结果，输出一个 JSON 的话，它是有可能输出错误格式的，那个程序本身你做 Harness 的时候需要去做保护，比如让它重试什么的，它目前是说我，我确定返回的结果肯定是不用重试的，中间准确率对错，还不好说，现在不也有很多人在去做 Benchmark 去对比嘛，对，我觉得还有看到一点。社区上好多人说，你没什么的，我们能复现，反正我看到目前社区里边复现出来的好像，没有比更好的，无论是质量，速度方面，原来说能复现的好像就最后都被别人给戳穿了。但是另外一方面，我觉得就是可能开源复刻也很快吧。

**向阳乔木：**

今天已经有 6 个项目了，我看看了一个，别人说有 6 个开源项目，都是复刻这。

**杨攀：**

但好多好像都不太行！

**向阳乔木：**

比如说。

**橘子：**

模型，这个模型还是挺看智商的，它好像有一个简单的 Benchmark，是好像差不多 Sol 的水平，记不清了，

**杨攀：**

能到 Sol 的水平，

**橘子：**

是 Terra 和 Sol 之间吧，它还是挺智能的。

**杨攀：**

不过这样的话，你像 OpenAI、Anthropic 这模式探索通了，他们在系统里也可以自己搞这么一个小模型，来去做这个事情！

**橘子：**

对，应该很好训！

**杨攀：**

对。

**歸藏：**

他们说会开源，他们当时说是后面会开源，

**杨攀：**

会开源吗？

**歸藏：**

说会，我记得好像他们创始人提了一嘴，他们自己也写了一下局限性。他说这是，第一个多跳推理和复杂指代能力较弱，现在我们 Thinking 模型擅长的那部分都比较差，你比如说这个东西，你需要让他得到结果，他需要绕两步，他需要思考两步，绕一下绕几层关系得出的结论，他就不太行。

**向阳乔木：**

系统 1 嘛，直觉，直接给答案。

**歸藏：**

对，

**杨攀：**

对，

**歸藏：**

然后。

**杨攀：**

所以，所以它跟其他大语言模型配合起来，挺好，

**歸藏：**

对，互补的嘛，然后老问题嘛，数值计算计数和日期处理不可靠嘛，还是写程序去做，

**向阳乔木：**

还得调工具！

**歸藏：**

对调工具，然后是倾向于理解字面意思，他无法理解隐喻，刚才你说的高兴，他是能理解的，但是一旦有一些复杂的隐喻，他是无法理解的，稍微复杂一点，估计就无法理解。

**杨攀：**

你们有没有发现，大家在考虑这些问题的时候，又有点回到，大家记得 23 年，大家让大模型算算术题，然后让数数？今天好像没有人拿 SOTA 模型干这个事儿了，今天新出这么一个小模型，大家然后刚才说，这个不行，那个不行，你的用例适不适合它，你硬拿一个不适合它定位的用例来去做这事，

**歸藏：**

这是他们自己写的，

**杨攀：**

对。

**歸藏：**

他们自己测试过程中觉得有问题的部分，还有一个什么上下文的问题无关的，上下文准确率会降低。就是你如果你前置过滤掉和清洗掉你，你要去让它判断的数据，它可能准确率会高一点，我觉得他还是刚才说的问题，他准确率和他。幻觉问题还是有的，只不过他们说的是不是我们想的那种幻觉，

**杨攀：**

对。

**歸藏：**

然后对齐，或者是提示词注入的风险比较大，估计这方面他们就没做，没做这部分。太多的处理。

**杨攀：**

对，我有个问题，就是这个模型本身功能也比较简单，你说他们，他们一直做下去。壁垒是啥？这么一个东西在上面还能做啥？我反正我没有，我没有想好，

**歸藏：**

我觉得多模态是非常重要的东西，

**杨攀：**

对。同意！

**歸藏：**

在数据检索和，我们现在很多东西都是通过检索和识别，就它输入的多样性和准确性，输出的准确性，我觉得都挺重要的，尤其是如果你能解决音频，视频和图像，非常耗 Token，非常耗时间的快速的匹配和处理，前景挺大的。

**杨攀：**

你的意思引入多模态，下一步后边，

**歸藏：**

对。

**杨攀：**

对，你说想起来，我这周一直脑中萦绕一个东西，借梁文锋之前的什么文字稿，说什么我们就不做多模态，觉得语言模型就很厉害，流出来现在其实都打脸了。

**歸藏：**

不做不行，不做没人用钱还是要挣的。

**杨攀：**

对。

**向阳乔木：**

我还看一个演示是说通过语音来操控电脑上各种软件，你还没说完，它就给你打开了，比如说打开记事本，你还在说着，然后它就打开，响应速度非常快，我是一直没搞懂它是怎么把它转化成比如说驱动软件驱动界面的。

**杨攀：**

就这里边，这里边是两个模型，配合了一个 realtime 的，

**歸藏：**

对。

**杨攀：**

一个相当于是 Computer Use 它只是加速 Computer Use，就 realtime 操作电脑这个事一直有。

**歸藏：**

所有的那些任务都是跟可能是跟程序和跟大语言模型或者跟其他模型配合。

**橘子：**

就它 Computer Use 本质上是说在一个有限集合里，按钮，一共那么多按钮去点哪个，就变成一个这样的转换就行了。模型支持 255 个选项，就是对开放式的那种集合来说，它就做的不好。他们有一个爱好者网站，收集了各种用法叫 Jevable，里面有一个演示，大家都知道有一个动画类型叫 Live2D，Live2D 就是你需要，有参数，这个参数去定义一个角色的动作表情，这个模型就可以根据一句话，比如说你笑，它就立即生成一堆参数，让 Live2D 的角色有动作。

**杨攀：**

好快，网站，

**橘子：**

对，

**杨攀：**

看见了 Jevable.com！

**橘子：**

然后，我还让这个模型判断了一下这个网站里最有价值的 10 个应用。他就判断出来，

**杨攀：**

太赞了。

**橘子：**

他说第一个最有价值的是帮它设置阈值。这个模型不是有个阈值，1~10 分还是 1~3 分，你把数据丢给这个模型，让它自己去跑一个阈值，再来判断就很准。

**杨攀：**

你说玩《魔法门》是不是这种？这种游戏叫什么，走宫格的，就那么几个选项，

**歸藏：**

战旗。

**杨攀：**

对，

**橘子：**

俄罗斯方块对他第二个选择就是俄罗斯方块输是实时概率，

**杨攀：**

这太合适了。

**橘子：**

然后能玩 66 行，都没死。反正刚刚开始有嘛，我理解这个模型肯定问题挺多的，包括它官方说没有经过 RLHF，就不会有那些偏见。有些问题，比如说你问它可能一些，涉及到不同，什么敏感一点问题，他可能会也很难说，不知道就也会遇到这种问题。

**歸藏：**

他都必须给你个答案。

**杨攀：**

Okay。

**橘子：**

对，所以。

**杨攀：**

橘子推荐的网站叫 Jevable.com，对吧？Jevable.com。

**橘子：**

对，他把 Lovable 换成了 Jevable。

**杨攀：**

大家回去可以体验一下的。

## 07 / 用模型过滤隐性广告

**歸藏：**

还有一个案例，有人做了一个我们刷推或者刷微博时屏蔽隐性广告的工具。显性的广告，你直接屏蔽 AD 开头的标不就行了吗？它能够实时地在你刷的时候把广告屏蔽掉，每次把一条推文直接输入给它，等加载的那一刻，它就给你屏蔽掉。还有一个是根据字幕屏蔽那种软广。尤其是我们国内非常饱受困扰，没有强制要求把广告标注在画面上，所以很多时候你猝不及防，就得自己跳，它会直接给你一个选项，

**橘子：**

你给它一篇文章，它还能把里边 AI slop 的词挑出来。感觉它是一个大模型可以用到的很快速的小工具，我觉得它那个定位很好，你就把它当成一个 System One Model 来用。

**杨攀：**

对，我觉得刚才乔木说的它就是一个有泛化能力的函数，

**橘子：**

是的。smart if else。

**杨攀：**

因为之前你看，要么我们拥有一个模型，要么拥有一个程序。它是把程序中的一些环节换成模型，所以昨天有人说它叫关节模型，我觉得比喻还挺有意思的。

**歸藏：**

还挺有意思的。

**向阳乔木：**

大家为什么这么狂热地追这个模型，好多时候是拼命给它找场景来用。我不知道它的引爆点是什么，或者击中了大家什么想法。除了快之外，我觉得快非常重要，那其他？

**歸藏：**

我觉得就是一个事情，

**杨攀：**

便宜。

**歸藏：**

一旦被卷进来以后，很多人自然而然就会有从众心理，就会去弄。另一个是概念确实比较新颖，AI 领域已经很久没有大家能理解、又是新的、还能很快上手的东西。再一个是它的速度很快，速度快了以后你就很容易做案例。这个东西有传播优势，你们很容易做出那种让所有人惊讶的案例来，案例的传播会更加剧前面从众心理的问题。

**向阳乔木：**

同意！

**歸藏：**

这俩数据放那儿他就。

**杨攀：**

快 100 倍便宜 100 倍，这就是 1 万倍！

**橘子：**

他还加了一个概念，因为他之前是 GPT 的作者。他就说这个模型可能具有 AGI 的可能性。他的宣传视频？

**歸藏：**

每次一看他那视频。

**橘子：**

他就想为什么要做模型。

**向阳乔木：**

靠这三种类型就达到 AGI 吗？

**橘子：**

你现在有一本小说，《银河系漫游指南》那个 42 嘛，42 就是终极答案，其实可以的。

**歸藏：**

42。

**杨攀：**

你看他的网站上写的 193.6 倍快，然后 444.6 倍便宜。

**橘子：**

你只要把它能转化成问题，

**杨攀：**

对。

**橘子：**

比如说，该加息该降息给它一个 0-1-2，它能挑出来一个数字。

## 08 / 把新模型接入现有 Agent

**杨攀：**

我是这样的，我是直接用我的 GPT-6 就说我说那个 TypeSafe AI 新发一个模型，你先给模型做一个功课，你自己先去读理解一下，因为不是最新知识嘛，完了我说你把它写一个文档，放在一个项目里，我就在这个项目里就开始干活了。我就开始跟他讨论场景，让他做什么模型，原型，就这样就直接让 GPT-6 干。

**歸藏：**

主要还是它非常依赖其他的东西，自己干活的场景非常有限。一旦你把它跟现在的 Agent 模型组装起来，它这个模型融入到 Agent 里其实还是比较复杂的，因为它本身的请求类型和方式都跟现在的大语言模型格格不入。你要是想把它添加到现在的 AI 体系里，还是有点麻烦，所以很多时候大家都是做一些新的网站、小工具，没有办法快速融入到 AI 那里。

**杨攀：**

我们就看看它真正的开源复刻多长时间能出来，看我们第几期节目的时候它能出来。

**橘子：**

它不开源也能复刻，其实原理就是 next token，就很简单，我觉得，比较，作者他比较相信的点说。这东西不需要经过语言的对齐，没有受到人的影响。

**歸藏：**

比较客观。

**橘子：**

相对来说比较客观的一个概率模型。

**歸藏：**

还有一个案例比较有意思，有人给它画了格，可能是一个 24×24 或者 30×30 的格，让它并行预测每一个像素应该填什么颜色，然后实现类似于 Stable Diffusion 或者 Diffusion 模型那种画图。其实真能画点挺像样的东西，我觉得也代表另一种可能性。

**杨攀：**

说明智能的本质都是一样，

**橘子：**

对，你给他，

**杨攀：**

都是概率。

**橘子：**

你给它 26 个字母，让它选，它是能说话的。最关键还是智能程度。

**歸藏：**

我说话有点磕巴。还有一个是什么？

**杨攀：**

刚才橘子说了很多东西，我估计很多人都没有认真看过它的官网。橘子说很多东西都在官网上，官网信息量好大。

**橘子：**

就是那官方视频他我看两遍，他讲的挺清楚的，因为你训一个 GPT-6 其实是需要一个，

**歸藏：**

还有一个文档。

**橘子：**

比如说 5T 以上参数需要多少张卡，像这个模型可能就很小。

**歸藏：**

确实。

**向阳乔木：**

作者不是 InstructGPT 还有 GPT-4 的核心贡献者吗？感觉是有点东西的。

**橘子：**

对。

**歸藏：**

这两天出来的模型参数都比较小。我看了一下，是 Devin 自己训了一个 0.5B 的，就 Devin。

**橘子：**

对，

**歸藏：**

它训了一个 0.5B 的，是 Qwen 2.5-0.5B 改的，然后 CUA 就是。

**橘子：**

成了。

**向阳乔木：**

Qwen 改的吗？

**杨攀：**

我都不相信这些，就无论用什么我都不相信现在拿小模型直接 LoRA 什么这些。

**歸藏：**

对，我觉得它肯定是预训练阶段就不一样，不可能说它纯粹靠大语言模型，通过训练来完成事情，

**橘子：**

它也讲了，

**歸藏：**

他们说，主要在数据上，他们所有的工作最核心的可能都在数据上！

**橘子：**

大语言模型来做，需要限定它按照格式输出才行。你一旦加这个东西，大语言模型智能就下降了。

**歸藏：**

关于大家还有什么想说的吗？

**杨攀：**

已经聊了聊挺长时间了！

## 09 / 多模态：音视频为什么要一起理解

**歸藏：**

行，我们看这周其他新闻。还是从模型、硬件和其他一些东西来看。模型上，Qwen 发了一个 Qwen 3.8-Omni-Flash，一个全模态模型，支持原生的音视频理解、推理和工具。能力上接近这边的 3.8 Flash，100 万上下文，比上一代的视频输出成本降低了 89%。感觉是参考了或者怎么样，就类似我们上周说过的。这边 3.8 Flash 的视频理解的降低成本降低的那套东西？

**杨攀：**

这种 Omni 模型到底用来干啥？

**歸藏：**

我觉得核心是在于，比如说自动化的广告，视频，广告自动化的图片的创建，还有涉及到，比如说那种类似短剧视频的编排非常依赖这种模型。尤其是关于柿子！

**杨攀：**

它跟纯视频模型，因为它的每一个功能，我们都可以单独找到一个模型，

**歸藏：**

对。

**杨攀：**

那它做成一个 Omni 模型的目的是啥？

**歸藏：**

因为它不能单独找到了模型，

**杨攀：**

就我。

**歸藏：**

没办法综合理解。你知道，作为一个短剧或者故事片，音频、视频、每一帧转场都是一个整体。你分开理解，全部转成文字标记，再输入给一个智能比较高的模型处理，丢失的信息就非常多。在标注层面，也就是理解层面可能就非常差，等于用了也等于没有，会给出一个很平庸的结果。

**杨攀：**

有人跟我说，它用来做标注可能会好很多。

**歸藏：**

标注也不一定只是标注，因为你如果做图像视频类的 Agent，你就很需要这个模型。

**橘子：**

就复刻爆款视频嘛，就很适合。

**杨攀：**

但它声视频又不是个 SOTA 的声视频模型。

**歸藏：**

它不能生成视频，

**橘子：**

不能生成吧，

**歸藏：**

它只能理解。

**橘子：**

这是理解。

**歸藏：**

它只能理解。

**杨攀：**

还是理解拆爆款视频，不就是打标注吗？

**橘子：**

便宜的理解模型对用处没有那么多，

**歸藏：**

你可以这么理解。

**橘子：**

有些场景还是挺省钱，

**歸藏：**

必须需要。

**向阳乔木：**

很赚钱的场景，尤其是广告，

**橘子：**

对。

**向阳乔木：**

我们原来在 TikTok 他们做广告的时候，创作者最痛苦的事情就是怎么改爆款视频，然后整个团队想做的事情也是怎么帮大家快速的复刻爆款视频。这个东西在很有商业价值，

## 10 / 量化与本地小模型

**歸藏：**

所以 Gemini 到现在一直是大家很需要的，在这个领域几乎是没有办法打败的模型。第二个是，一家公司微调了一下 Qwen 27B，做了一个三值量化，体积比全精度的 Qwen 27B 小了 9 倍，只有 5.6 GB。他说保留了 98.2% 的综合性能，尤其在多模态和长程任务调用上比之前还强，可以在单张 5090 上本地运行。这个还是挺重要的，因为 5090 的问题就是显存太低，之前 27B 根本没办法塞进去。你要是多张的话，那就扯淡嘛。单张 5090，而且 5090 的性能在这部分推理上，我觉得有时候比苹果的 MLX 优化要强。本地任务挺需要的，那这样的 32 GB Mac Studio 其实也能跑。

**杨攀：**

小尺寸的模型，模型用英伟达的这些卡其实是效率还是很好的，

**歸藏：**

更高的。

**杨攀：**

对，它主要因为内存小一个，

**歸藏：**

谢谢你。

**杨攀：**

带宽低一点，对，所以它算力强，

**歸藏：**

对，毕竟 CUDA 优势在那儿。第二个是 MiMo 的直播，挺有意思的，传播挺大的，

**杨攀：**

罗福莉是零零后吗？只有九零后，零零后才能干出这种事来，

**歸藏：**

零零后吧，还得是年轻人，

**杨攀：**

对！

**歸藏：**

他们在直播 MiMo V2.6 的强化学习，训练过程就是一个看板，里边有所有的指标和金额，每个模型现在消耗多少钱、成本是多少，还一直在扩充指标和数据。这个对于训练团队来说还是挺有价值的。

**杨攀：**

东西也没啥信息量，看别人烧钱看着爽，然后有传播效果，你看看不出个 123 来。

**橘子：**

他那个，有一点的，它至少说这个东西，是能看到完整进步的东西，而不是只是 Benchmark。如果你只是最后那个 Benchmark 可能就是，比较中间可能掺水，但它这个这样连续的过程就可能就相对来说比较可信一些。

**歸藏：**

还有一个他们上面有个滚动的看板，有一个文字，他会告诉你什么时候我们要终止训练，什么时候重新训练，然后上次训练因为什么原因出了问题，然后我们现在下一次训练要改什么，我觉得挺有意义，挺有意思的。直播确实是花钱速度很高，

**杨攀：**

也是首创的？

**歸藏：**

以前大家对模型训练真的很花钱没有什么概念。你看它每一秒都跳 20~30 美元的时候，就会发现真的很花钱，而且只是算力成本，不包括人员这些乱七八糟的。

**杨攀：**

换一个角度说不是 SOTA 模型，就只能靠营销顶上了。

**歸藏：**

接下来是一个之前他们就有吧，我叫不上他的名字，他发了一个叫箭头？是这意思吧？

**杨攀：**

Arrow？

## 11 / SVG、图标与设计工作流

**歸藏：**

Arrow 2，一个画 SVG 的模型，非常强。可以找一下它的演示，画鹈鹕骑自行车，比现在所有模型画得强 1 万倍，细节巨多。你就看着它一笔一笔把羽毛勾勒得很细，自行车的轮子也非常夸张。这部分我觉得一直有很多模型没搞好。画图标，就是画我们正常界面上的这些 SVG 图标，其实 GPT-6 或者其他模型都画不太好。画图标对设计师来说也是一件非常痛苦的事儿，你要在 Figma 里画一个非常小的方格，几十像素乘几十像素，然后拿着钢笔画贝塞尔曲线，或者用一些基础形状进行切割和布尔运算。熟练工会画得很快，但擅长画图标的人非常少，很难搞，可能 20 个图标要画一天。

**杨攀：**

你看 Astra 不是画 3D 比较强，这个就相当于是画 2D 的，

**歸藏：**

对。

**杨攀：**

这种东西我觉得很快，SOTA 模型就把这个能力就直接训过去了，还有，

**歸藏：**

是可以。

**杨攀：**

还有，以一个模型的形态提供，很少有人会为了干这事单独配个模型。我觉得最好的形式是提供一个 MCP 之类的。

**歸藏：**

我觉得还好，它可以打包成 MCP，比如刚才，

**杨攀：**

对。

**歸藏：**

Jev 他们也有什么 prompt，让你去提供你的模型怎么去调，

**杨攀：**

对。

**歸藏：**

所以他们，对于设计领域的一些就最近不是出了很多 AI 设计或者想取代 Figma 的设计软件，然后他们对需求还是挺大的，由于它参数也不太大，训的成本可能也不是很高，可能还是有一点商业价值。

**杨攀：**

你看我之前不是跟你说，你 PPT Skill 里边就缺图，全是文字嘛。有这个东西配合就那就神了，

**歸藏：**

是有图的，它会调一些图标库之类的，但是画一些更丰富的就比较麻烦，

**杨攀：**

对，

**歸藏：**

有就更确实。

**杨攀：**

如果配了 MCP 是不是，就牛逼了，

**歸藏：**

对，这很爽！

**向阳乔木：**

还有它是矢量的，

**杨攀：**

对。

**向阳乔木：**

我觉得矢量的非常重要，就尤其出版印刷。

**歸藏：**

对，你怎么放大？

**向阳乔木：**

比如说我们原来写书的时候，

**歸藏：**

没事。

**向阳乔木：**

你要配图嘛，用图片生成肯定是不靠谱的。类似于之前有个网站叫 Napkin，Napkin 是纸巾的意思，它就是把选中文本转成矢量图，版式也非常有限。如果这种模型能广泛应用，我觉得在出版印刷行业还是很有想象空间的。

**歸藏：**

还有大屏幕展示。

**杨攀：**

OS 可以配上？

**橘子：**

就感觉 Astra 这个模型估计也是用了 Astra 的数据。Astra 自己有一些能力，你给一张照片，它能用代码画出来一个线条版，还挺像的。我感觉 Astra 在加速，接下来会让很多比较沉的模型变得非常快，因为造数据变得很容易。

**歸藏：**

我觉得。

## 12 / 用 GPT-6 Astra 造数据、训练小模型

**杨攀：**

这是我这周看到的，Astra 给了我们一个新的套利空间，拿 Astra 去创造一些新东西。比如拿 Astra 去微调特定领域的小模型，今天的 Astra 跟 Fable 已经具备这个能力了。原来需要一个专业搞算法、搞训练的人才能自己调个小模型，现在有 Astra 帮助，你给它提需求，它把训练模型所需要的数据、整个基础设施全搭好，然后帮你从 0~1 训完就可以了！

**歸藏：**

今天不是说出了很多类似的 GPT 模型，我觉得很多都是拿 Astra 直接跑了一天跑出来！

**橘子：**

DeepSeek 那个 4.1 Flash 是不是也是 Astra 系的算子？

**杨攀：**

对，然后智谱会说是用自己的 5.5 写的？然后 DeepSeek 哥们儿的文章说是 GPT 写的？

**橘子：**

对，因为他们在知乎上说嘛，算子已经是 Astra 就可以写出来了。

**杨攀：**

对，这个就是自己左脚踩右脚！

**向阳乔木：**

那这是什么标准来判断？我只有 Astra 和 Fable 5 才能达到吗？国产模型有没有，就现在能力是不是也能自己迭代自己？

**歸藏：**

那天唐杰不是说在朝这个方向努力吗？

**杨攀：**

对！

**向阳乔木：**

有没有一个节点永远超不过，

**杨攀：**

这也是个拐点。

**向阳乔木：**

因为之前也聊过，如果有一个海外特别大的，牛逼的模型，然后他自己研究自己迭代，改进自己的话，其他家可能就是追不上了。

**歸藏：**

我觉得可能会有个奇点。我们之前经常说那个时间，它一旦到了，比如在整个训练过程中达到 80% 的自给率，可能就会一瞬间突飞猛进，再也追不上了。

**杨攀：**

我觉得基点可能已经到了，

**歸藏：**

但是。

**杨攀：**

我们不知道而已，

**歸藏：**

我已经放对。

**橘子：**

差不多。

**杨攀：**

大家注意一个时间，到今年 12 月，ChatGPT 就发布 5 年了。之前有个说法，ChatGPT 发布 5 年就 AGI，我是信的。

**歸藏：**

现在追求的是对 ASI。然后是。你说。

**橘子：**

你看 DeepSeek 的内部人已经开始担心失业了，其实已经到了。我觉得这周他的文章也爆了，大家也能看到，有点像一场战斗中，一个士兵已经没事可以做了。

**杨攀：**

对，所以很快大家认知就会变一下，说这些技术，工程，都不是什么壁垒，大家原来聊的说你自己现在今天你手里有什么或做什么，无论是个人还是公司是壁垒，大家聊之前聊的还是比较少的，小范围内聊，我觉得接下来很快就变成一个每个人每个公司都要面对的问题。

**歸藏：**

刚好聊到他很火的问题，我觉得最火的是最后一段关于，

**橘子：**

希特勒？

**歸藏：**

关于共产主义赛博风格 2077 寡头垄断？

**杨攀：**

问对，问问一下。概率。

**歸藏：**

可以把这文章给这了，给一个最后的问题来给。

**杨攀：**

对我，我觉得，都有可能这两种情况。

**歸藏：**

大家都不知道！特别搞笑的是，还有对是由人决定的！

**橘子：**

它最后可能不是由技术决定的，东西跟技术可能没关系，

**杨攀：**

也是个掷色子嘛？

**橘子：**

最后是看对看大家怎么决策。

**歸藏：**

关于很有问题的，上周不是大家一直在聊，上周那三个就是 Sam、Dario 和马斯克在聊这个减速，就一直这还显像达成共识了。

**橘子：**

对。

**杨攀：**

哈哈。

**橘子：**

大家都同意减速！

**歸藏：**

对，结果晚上特朗普发了条推川子发了条推，

**橘子：**

对。

**歸藏：**

第二天 Sam 赶紧解释，我们不是这个意思。

**杨攀：**

就马上要推新模型。

**歸藏：**

对，

**橘子：**

不是，马斯克很虚伪，

**歸藏：**

马上线。

**橘子：**

一边说我们 agree 一边说我们 4.8 要完爆，

**歸藏：**

上线对 2.5 界，

**橘子：**

你们这不可能停的。

**歸藏：**

结果这周一，这周一在 All-In 什么会上？穿的给黄仁勋打电话。快给我放。

**橘子：**

老黄。搞双簧火爆全网小后那篇都已经过千了，曝光了。

**歸藏：**

接下来是阶跃发了三个语音模型，包括实时交互的 StepAudio 3 Realtime、StepAudio 3 ASR Max，还有完整的音频内容生成。

## 13 / 实时语音与 Computer Use

**杨攀：**

感觉这一周 Realtime 模型发了好多，大家都往这个赛道挤，我觉得也到这了。另外一边包括 Computer Use 也差不多了，通过语音交互方式操作电脑的场景越来越多。这里边的 ASR 模型我自己已经试过了，因为咱们做播客要转文字，我都是自己在本地搭环境。我测完以后觉得比之前我这儿 SOTA 的千问 ASR 要好，主要是识别专有词汇的能力更强了一些，处理口语也有提升。我觉得语音模型上还有好多低垂果实，好多优秀人才都去搞语言模型了，没有人关心这块，稍微投入一点儿还能提升挺大。

**歸藏：**

后边就是谷歌，谷歌也发了语音模型。它是跟着 Gemini 更新的，Gemini 更新 3.8 Flash，它的语音模型就更新到 3.8 Flash。一个 Live、一个 Thinking，是两个吧，一个用来实时对话，另一个用来进行比较深入的复杂任务。边推理边说话它在边推理的时候边能跟你对话，然后推理结果出来，然后继续很自然的就跟你回到推理结果去。

**杨攀：**

但是不得不说，我觉得相当长一段时期内，大家引入实时交互模型的还是特别少。很多例子其实是在手机端，手机本身包括苹果都受操作系统限制，你想干什么也比较难，一般都是在应用内部搞的。

**歸藏：**

不方便。

**杨攀：**

我觉得下一个很重要的爆点，可能是 Realtime 模型加上 Computer Use 的能力，进一步彻底解放我们。咱们开始之前，我不是在群里发了一个视频，纯口语操作整个电脑的所有内容，彻底解放双手。我觉得这方面的大规模应用可能马上就来了。说到这儿还有，一会儿说硬件要说，说豆包手机，一会儿再说。

**歸藏：**

模型就差不多没了。还有一个，之前跟 OpenAI 合作的机器人公司发了一个 Helix 2.5。

**橘子：**

Figure 吗。

## 14 / 具身智能与零样本任务

**歸藏：**

Figure 发了一个 Helix 2.5 的机器人模型，主要是提升机器人的零样本任务成功率，像整理房间、叠毛巾、铺床，把这些任务的零样本成功率从 9% 提到 56%。感觉具身智能这块进度还是非常慢，尤其是在脑子这部分。

**橘子：**

对，他那个视频演示还行，视频演示我看了看的时候有一点点吓人的开始就是他在地上捡袜子，主要是中国的，他的机器人都是在遥控了，对，他慢慢的在捡东西，然后还挺有意思。

**歸藏：**

所以说回来刚才那个 Jev 其实我觉得这方面非常重要，他其实控制机器人的问题在于它脑子有了以后，它没办法快速的反应到肢体上和声音上，

**橘子：**

对。对的对。

**歸藏：**

有了这个东西以后，它能够对关节的一些参数进行实时调整。比如液压或者电助力的转向角度、力量，

**橘子：**

对！

**歸藏：**

输出的功率，到多少实时的调整？

**橘子：**

对。

**杨攀：**

这周不还说 Astra 对具身也有很大提升吗？你看这周两个东西，Astra 加 Jev，相当于把具身那些人都快干残了。

**歸藏：**

对，但我觉得是好事吧，

**橘子：**

对。

**歸藏：**

是好事，因为以前具身的那些模型根本看不到希望，进度非常慢。

**杨攀：**

进一步说明就是搜它的基模，其实对你把别的都碾死对。

**歸藏：**

非常重要，对！还有一个最近我，

**橘子：**

是所以，

**歸藏：**

你说？

**橘子：**

对具身来说感觉还是蛮重要的，因为大家一直在等这个智能。确实之前没想到，他们一直都是好多模型、好多公司自己在选，最后其实是 OpenAI 来帮他们解决。他们卖的还是硬件，不影响，除非 OpenAI 也在做自己的机器人。

**歸藏：**

之前不是跟他们合作，

**杨攀：**

好像我看到个新闻，

**歸藏：**

后来不合作了吗？

**橘子：**

很合理。

**杨攀：**

我好像看到新闻说 OpenAI 也在搞具身，因为你换个角度想是这样的，基模公司，它要进一步再提升模型能力肯定是一个领域，一个领域数据的去吃，原来谁看得上去做 3D，谁看得上去做 Computer Use 这个 OpenAI 都靠这些能力提升，都靠这些领域，又把能力再往上拉，然后有的时候甚至你都分不清楚是模型的，智能在拉，它的能力在拉，这两个有时候已经分不清楚了。反正他就是越来越强，

**歸藏：**

对，我还有那个？

**杨攀：**

所以接下来 OpenAI、Anthropic 肯定会继续找数据、找领域，一个个吃，没有它不吃的。

**歸藏：**

我还有一个案例，刚才方老师写了一个非常简陋的辅助驾驶算法。他建模给一辆车，车根据当前路况，比如红绿灯之类的快速判断。我觉得也非常重要，它给辅助驾驶开了一条新的路径。辅助驾驶需要很快地判断，同时又需要非常高的智能，以前这两者在他们看来不太好融合。这个又要求支持多模态，一旦支持多模态，我觉得可能会有非常大的进展。

**向阳乔木：**

都还是 Jev 吧？

**橘子：**

我觉得 Jev 是把 Transformer、Token 这些技术转换到另一个维度，还挺有创意的。

## 15 / Vibe Coding 把硬盘用满之后

**歸藏：**

刚才那个乔木说了一个问题，模型讨论完了，刚好讨论问题，模型能力越来越强，以后大家 Vibe Coding 越来越多。硬盘不够用，很多人都有这个问题，因为本来内存就很贵，然后我们本来有，有小而美的应用来占内存，所以本来就已经捉襟见肘了，再加上 Vibe Coding 以后。AI 给你疯狂生产内容，然后疯狂开 Worktree，很多人确实不够用。我之前那个电脑是 512 GB，我感觉怎么可能用不完？Vibe Coding 能力上来以后天天清理，最后就换了 2 TB 的。现在这台 2 TB 的电脑买了三个月，我刚才一看，1 TB 就没了。

**杨攀：**

我 1 TB 都开始要删内容了。

**向阳乔木：**

我昨天彻底重装了，我忍不了。

**橘子：**

我还好，最近搞了一个自己的清理。我原来这台老电脑是 512 GB，快满了，后来清理完，现在还是 200 GB。我发现有三个东西，

**杨攀：**

也是不够！

**橘子：**

你的终端每次装包，安装包和各种包都留着。一个是 Chrome，包括浏览器，Agent 用 Chrome 会有巨大的缓存，有 60 GB 以上。飞书，凡是自带浏览器的应用，你都让 Agent 跑一下，比微信还占空间。有缓存，那个很好删，直接把缓存清了就行。

**歸藏：**

有很多时候没用。也不会去查东西？我看了一下，

**杨攀：**

我最近都开始采购硬盘了，

**歸藏：**

我主要，你说。

**杨攀：**

外部存储、NAS 什么的，我都开始补充了。

**歸藏：**

我也整了。我们这种做内容的，很多时候是视频，我看了一下，原始视频的录制规格都很大，录个 10 来分钟、20 分钟，20 GB、30 GB 就没了。这些东西都是底稿，你说删也不行，不删也不是，只能过段时间再说。

**杨攀：**

然后我那天想起一个老古董，我们家后来还买过一个外置 DVD 刻录机，现在还有。我翻出来想，有一些冷存储是不是都刻成盘，后来一查，DVD 才 6.9 GB。

**歸藏：**

现在有那种大的，我记得我之前看影视飓风，他们也是用 CD 去存数据。

**杨攀：**

一个 DVD 才 6.9 GB，你现在一个硬盘就几 TB，我们录这一个播客，DVD 都不够。

**歸藏：**

塞满了对。

**向阳乔木：**

比如说你用 NAS 是怎么解决？

**杨攀：**

今天。

**向阳乔木：**

比如 NAS，那你网也得很快吧，不然它会有延迟吧。

**歸藏：**

不用，NAS 跟你是在局域网。

**杨攀：**

也有局域网？

**橘子：**

内网，乱找。

**歸藏：**

你不行就插个雷电 5，接到 NAS 上。

**向阳乔木：**

我看有人说买 Mac Mini 的时候有一个万兆网卡选项，当时没选，后来很后悔。所以以后感觉标配网卡得万兆，硬盘越大越好，至少 1 TB 都不够用。我看很多留言回复说，1 TB 也不够用。我那个 512 GB 快满的时候每天清，清烦了，就给 Astra 下一个命令，说我要恢复 100 GB 以上。它挨个目录给我找，最后确实也能清到，但几乎把各种常用软件都快删完了。我想也没必要，干脆彻底重装。

**杨攀：**

我的最大的是微信，

**橘子：**

对说。

**杨攀：**

然后另外还有啥，还有 Claude 有一个 VM 超级大，如果你要是开发 iOS 的话，还有 iOS 镜像超级大。

**歸藏：**

我刚才看见了，四个系统加起来又是 50 GB。iPad 一个、iOS 一个，然后 iOS 和 iPad 分别装最高、最低和中间三个系统做测试，加起来有四五十 GB 吧。

**橘子：**

所以，

**向阳乔木：**

记得哈。

**歸藏：**

Xcode 本身也大。

**橘子：**

就是一堆人期待用折叠屏扣顶折叠屏 256G 起要高定 2 万起。

**歸藏：**

1T

**杨攀：**

我觉得这个时代照这么说你说便宜的冷存储网络上的冷存储有没有用，不知道是不是生意。

**歸藏：**

不是说那个字节在做硬盘吗？做云服务就做硬盘，做云做网盘，企业网盘 Agent 使用的企业网盘，

**杨攀：**

对。

**歸藏：**

有火山在做。

**杨攀：**

那是一种意思。比如我家里不买 NAS，或者我有 NAS，但 NAS 是本地热存储，我不用做 RAID。然后网上有一个便宜的冷存储。什么叫冷存储？我想要的时候不能马上下载，只能看存了什么文件、文件名。比如我要取这个卷，就发一个 request，它在 24 小时之内让我能够存取，这叫冷存储。其实也可以做成服务，我不知道是不是太小众了。

**歸藏：**

确实。

**橘子：**

24 小时我觉得现在人等不了，

**歸藏：**

我觉得核心。

**橘子：**

现在人只要 24 秒。

**杨攀：**

这那是热存储，是冷存，

**橘子：**

不是用户不关心，

**杨攀：**

因为不是，

**橘子：**

你就没有用户需求了。

**杨攀：**

因为价格差 10 倍，比如一个月 68 块的网盘，现在让你 6 块 8，一样的容量？

**歸藏：**

网盘核心的大头不是流量费用吗？你这样也能降低流量费用，因为存取次数少，流量自然就少了。它有可能下载，

**杨攀：**

对这。

**歸藏：**

有可能一下下载非常大的东西，可能很贵。

**向阳乔木：**

不是说存储股票一直涨，原来是因为建机房。我感觉 C 端用户的硬盘也慢慢不够用了。

**歸藏：**

对。

**杨攀：**

硬盘是另外一种了，它跟内存还不一样。SSD 还不一样！

**向阳乔木：**

你说存储它不是指这个 SSD 这种存储？

**杨攀：**

你看内存，然后 SSD 然后就是硬盘？我今天看新闻说长鑫也要开始搞那个对搞 NAND 闪存了，

**向阳乔木：**

对很。

**歸藏：**

都不够。不好，擅长。

**杨攀：**

因为我觉得这块以后可能也是大收入。你想，我们进入数字时代二三十年，前 10 年、20 年产生了多少需要存档的数字成果和作品？可能每隔几年，我们需要存档的容量就翻 10 倍。今年一年我们几位产生的数字内容，可能就是过去几年的总和。以后肯定还有存储需求。在家里买 NAS 也很贵，硬盘可能会坏，还得做备份。要备份就得买两块盘，价格相当于 double 了。所以刚才说的，如果能有一个地方帮我做一份便宜的云存储，比如一年付几十块钱存几个 TB，我觉得愿意。现在我的苹果订阅是 2 TB 套餐，全家 2 TB 一个月 68 块钱，已经快满了。下一个版本我可能一个月就要花 200 多，去买额外几 TB 了。

**歸藏：**

刚刚还有一个新闻是他把 Apple TV 啥的会员也整到那个 iCloud 里，

**杨攀：**

对。

**歸藏：**

还有 iCloud，里边有 AI 的 Token。

**杨攀：**

在中国不行吧？

**歸藏：**

中国不行，中国欧盟都不行。

**杨攀：**

对。

## 16 / 用代码做宣传片和配乐

**歸藏：**

刚才还有一个没说。这周我让 GPT-6 给我做软件宣传视频，它做的音乐，我还以为是从某个开源音乐素材网站找的。后来做了两个，发现每个音乐都不一样，还都能跟视频内容卡上点。我问音乐怎么做的，它说用 Python 做的。我听不出来是 Python 做的。以前让 AI 做电子音乐会非常单调，几个音一直重复，或者几个鼓随便整理一下；它这个是跟着整个视频节奏走的。我一直以为是从音乐素材网站下载的人家开源的音乐，其实是它拿 Python 写的。

**橘子：**

我看到有人专门测了这个能力，尤其是 Astra。

**歸藏：**

很厉害。

**橘子：**

Astra 能力比 Sol 大幅增加，

**歸藏：**

对。

**橘子：**

它写音乐是先写成乐谱，然后用 MIDI 转成音乐。

**歸藏：**

对。对。

**橘子：**

就很好听，跟人写的没有区别。

**杨攀：**

看那，大家想跟我们上周聊的另外一个很像了，上周我们不是说 Astra 搞 3D 就直接能画画？其实是一个道理的，

**橘子：**

对。

**杨攀：**

就相当于它用 Blender 建 3D 模型去生成图片、视频，用 Python 和 MIDI 生成音乐，是一个道理，直接把原生的音乐、图片、视频生成模型干掉。

**歸藏：**

我觉得不至于干掉，但是现在不至于干掉，

**橘子：**

对。

**歸藏：**

它们还是各有优势。问题是它现在的能力越来越可怕了。你可以看到 Claude 每次发功能都是 Claude 自己做的视频，最近那些视频越来越丰富。我相信发功能的人一定没有在这上面花太多心力，但是视频已经越做越好。Astra 也是这样，那天我让它基于我的代码库试着做了一下，做得非常好。刚才说的音乐也是它做的，组件是已有的。

**杨攀：**

智能水平的绝对提升会导致它什么都能做。原来我们专门在某个领域为完成某个任务做的模型或基础设施，SOTA 模型随着综合智能水平提升都能吃掉。对。

**橘子：**

对，这个就是他自己学的，肯定不是训数据的应用东西，因为这个东西价值太低了，没有人去给他准备数据，

**歸藏：**

它肯定是自己泛化出来的。

**橘子：**

就自己给把震动突破了。

**杨攀：**

你要说到这，你看它又能操作 MIDI，最基础肯定能操作了，那我比如说，西游记叫什么云宫迅音，可以让他做一个自己版本的云宫迅音？

**向阳乔木：**

对。

**歸藏：**

对，电子音乐，它可以混音，

**杨攀：**

对，对，

**歸藏：**

给你混嘛，

**杨攀：**

对，对，完全可以，

**向阳乔木：**

是纯数字的。

**杨攀：**

把历史上那些好听的曲子都重新编曲改一遍。

**橘子：**

对，他可以一边给你放音乐，一边给你画画面，自己从代码层面去做到了一个实时视频的效果。但是它速度还比较慢，

**杨攀：**

等等下次一个月 Token 烧不完的时候，留下来做一个 demo。

**歸藏：**

试试。相当于整个视频。

**向阳乔木：**

之前我看有一个 Vibe Coding 的朋友叫小耳，他就是让模型，然后基于某个字符的向量空间位置，让它生成动态音效，然后出来效果就特别炫。其实是可以用这种方式来做各种视觉效果的，音乐和字符的映射，

**歸藏：**

最近我频繁刷到一类视频，用 SVG 和动效配上音乐做画面。你应该看到过很多那种创意网站，比如随着音乐草在生长。草其实是 SVG 化的，是一个贝塞尔曲线动画，也是基于一句话生成。比如一个帆船，完全通过一个一镜到底的 SVG，一条条线画出来、长出来，周围再用那些线画出波浪。帆船在动，随着风在飘，全是这种东西。

**杨攀：**

其实你看新时代就有新时代艺术家了，他用新时代的技术去做各种艺术表现。

**歸藏：**

表达对的。

**杨攀：**

对，表达对。

**歸藏：**

我们继续吧，继续，硬件层面是第一个事，他为什么把发布的也算硬件？英伟达发布了 Rust 的 CUDA 版本？以前的话，

**杨攀：**

对。

**歸藏：**

他以前的话他只能从就他用不了这个，他只能从原来的去用，现在的话直接重写了一遍，重写了一个 CUDA，然后它本身效率很高嘛，很多人都开始用写了。

**杨攀：**

我跟你说，从这个角度，英伟达现在是挺恐惧的，SOTA 模型很快就会把英伟达的 CUDA 壁垒拆光。

**歸藏：**

你复刻一个 CUDA 也没有那么难了嘛，

**杨攀：**

我记得咱们第一期的时候不就聊过 AMD？其实现在开始用 Fable 写自己的整个驱动套件，最近这一周 DeepSeek 跟智谱也都开始用模型做推理加速，英伟达这个壁垒守不了多长时间了。黄仁勋清醒，也很清楚这事情。

**歸藏：**

所以他才不让那三巨头继续压制其他开源模型的发展，因为他们能搞，其他家搞不了，差距越来越大。然后是火山引擎发布了车载 AI 助手豆包座舱助手，主要功能是手车互联。可以在豆包 App 里远程控车查车况，把行程推到手机。车控导航，辅助驾驶等整个所有车的功能都可以用豆包去执行，现在先是跟荣威家越 07 合作的，然后上汽奥迪也加，

**杨攀：**

这肯定都是软件比较热的，弱的这几家车厂嘛，对，

**歸藏：**

但是说实话，现在 AI 能力和手车互联的能力都不强，智能座舱这部分，我觉得在车上的进度是远远落后于。手机肯定是远远落后于电脑的，它能做的事儿在车上是更远远落后于手机的。

**向阳乔木：**

你知道吗？那个 Brad 强他就是在上汽做跟豆包的项目。

**杨攀：**

知道。

**橘子：**

你看豆包手机其实卖的很好。你不知道吗？

**杨攀：**

不知道，不是有很多吐槽，

**橘子：**

没有。

**杨攀：**

这也不能用，那也不能用吗？

**橘子：**

卖的很爆！

**歸藏：**

那没办法，

**向阳乔木：**

但问题是。

**歸藏：**

对，

**向阳乔木：**

对。

**歸藏：**

不是豆包的问题？

**橘子：**

我觉得只有你科技圈可能觉得这个东西这也不好用，那也不好用，大众有 AI，然后营销就直接卖爆了。

**歸藏：**

能有很多场景？

**橘子：**

座舱也是，你看之前那些车企里边比较重视的小米、理想，他们自己做得也没那么好，小米可能还好点，其他几家都弱得不行。

**杨攀：**

你看原来发的豆包手机第一版不是说这也能干，

**橘子：**

还挺大的。

**杨攀：**

那也不干，不是很快被应用都封了吗？这一版其实那个字节特别节制，他没有取得授权的 App，他也自己主动也不操作，

**橘子：**

这个不重要。你想，当时就跟淘宝屏蔽微信一样，然后拼多多就来了，现在跟淘宝分庭抗礼。淘宝屏蔽了豆包手机，但抖音现在有购物、有团购、有外卖，什么都有，闭环了。

**歸藏：**

你说我！

**杨攀：**

你的意思这些不开放，然后字节的豆包手机能自由的用 AI 访问自己的业务做智能辅助和自动化，所以字节又把大家干死了。

**橘子：**

我觉得以手机的销量来说。感觉意思。

**杨攀：**

什么销量？你知道它的数据吗？

**橘子：**

你看一下新闻！

**歸藏：**

主要是什么？一个是它不贵，手机整体中规中矩，所有配置都是够用的配置。它的价格我看是 6,500？

**橘子：**

你看销售额是 1 秒突破 1 亿元。然后预约量是 37 万台。很火爆的。

**歸藏：**

这应该是努比亚、中兴这几年最好的战绩了。

**橘子：**

中兴这个都没有人买的牌子，因为加了 AI 就这么火爆，大众是非常狂热的！

**歸藏：**

价格我觉得是合适的，就它没有 AI 溢价，它就是一个正常手机的价格，

**橘子：**

对。对。

**向阳乔木：**

小米不是也有一些 AI 能力吗？那歸藏之前也给我演示过，豆包手机比它是更全局，更底层，所以就不一样嘛，体验完全不一样的。

**歸藏：**

我觉得没有太多完全更底层或者不能做的事儿，更多的是概念传达和演示方式。那天我推荐你去看陈抱一的视频，他出了一个小米澎湃 OS 4 的演示，展示系统如何跟整个人车家和万物互联。你看到那个东西，会发现自己不会用手机。下面评论都是雷总该让你去讲，他别讲了，你讲了半天讲那些数没有用，我觉得是传达问题。

**橘子：**

你想你如果小米去做这些应用的联通，它更连不上，小米也没有抖音的那些团购，

**歸藏：**

自己的应用对！

**橘子：**

外卖什么的，它最后就是拼服务，让你通过简单交互享受到所有服务，自己又完成了这些服务的全部布局。能跟它打的可能也就腾讯、阿里，但那两家比较慢。

**歸藏：**

自己主要是占了内容，消费内容消费很重要。

**橘子：**

对是。

**歸藏：**

好，刚好下一个豆包手机助手消费版，我觉得后面，

**橘子：**

收费。

**杨攀：**

这不聊过了吗对，

**向阳乔木：**

聊完了吗。

**歸藏：**

我对，

**杨攀：**

这不聊过了吗？

**歸藏：**

我觉得后面是对它是个东别的东西，他发手机，他把手机助手拆出来了。AI 不行的，不只有，中心或者是其他家，那些可能看到以后也会去进行一些合作，他把拆成服务了。

**杨攀：**

那不是华为模式嘛，问界模式嘛？

**橘子：**

对，

**歸藏：**

不然会限流，

**橘子：**

跳过。

**杨攀：**

这咋了。

**歸藏：**

然后完事儿聊，

**橘子：**

不要提那个名字？

**向阳乔木：**

不要对。

## 17 / 语音输入产品与实时反馈

**歸藏：**

完事儿聊，不要提关键词，不然炸评论就完了。后面是其他东西，第一个是腾讯也出了一个 AI 输入法，我觉得这个东西跟微信输入法打架。

**橘子：**

腾讯我不是微信，我一直也是微信。

**歸藏：**

不是微信，

**杨攀：**

代码？

**歸藏：**

他像 Typeless 吧，

**杨攀：**

对。

**歸藏：**

它不是输入法嘛，它是个软件嘛对就 Chatterfly。

**杨攀：**

对。

**向阳乔木：**

不是 Chatterfly 吗？

**杨攀：**

Chatterfly，它就是跟 Typeless 竞争的。然后网易有道的叫什么叭哥也是。

**歸藏：**

我就他自己发了一个。

**杨攀：**

叭哥我装了一下，然后就卸了。我想了一下，它又不比 Typeless 简单很多，又不如微信智能语音输入法。我现在用微信输入法，又不是内置的，我觉得不至于留三个。要么留一个输入法、一个 Typeless 类的，两个品类各留一个就完了。我试了一下，也没有什么惊艳的效果。还有一点我很受不了，语音的时候它不实时显示我说的东西，比如说 2 分钟、3 分钟什么也看不到，然后一次出来，这让我感受很不好。

**歸藏：**

Typeless 也是这样？

**橘子：**

Typeless 不是这样吗？

**杨攀：**

反正我已经很少用它了。

**橘子：**

Typeless 还涨价了，

**杨攀：**

我现在主要用。

**橘子：**

降低了免费 Token。

**杨攀：**

我只要微信语音输入法有了专有词库功能，别的什么也不用！

**橘子：**

然后微信做了一个长按输入。

**歸藏：**

我是非常依赖 Typeless。

**橘子：**

大家都说特别好用。

**歸藏：**

对，

**杨攀：**

它应该也有吧。

**歸藏：**

交互好，没问题。那是它不在里边吗？

**杨攀：**

腾讯新出的 Chatterfly 可以往里加一个 Skill。你说完一段语音，它可以用特定 Skill 处理，我觉得算是个创新吧。

**向阳乔木：**

闪电说很早就做了。

**歸藏：**

早早就有。

**杨攀：**

但是某种角度，什么闪电说，

**向阳乔木：**

虽然说很早就做了，

**杨攀：**

但是某种角度，

**向阳乔木：**

但是做复杂了，

**杨攀：**

某种角度对他要把产品做复杂了，

**橘子：**

其实，

**杨攀：**

对。

**橘子：**

反而不合时宜了。现在的趋势是做简单，之前那些 Prompt 模板什么的都在简化。

**杨攀：**

对。

**歸藏：**

核心问题是，它的 Skill 本质上还是提示词。你也不能操作电脑，不能执行工具。作为一个语音输入法，它也执行不了工具，本身还是提示词。提示词润色东西，大家怎么说？懂的都懂！是 Claude Code 终于支持了这个 AGENTS.md 我之前一直维护很多套，

**向阳乔木：**

太不容易了。太倔了。

**歸藏：**

除了 AGENTS.md 再维护一个 Claude.md，我两边还得一起改。

**杨攀：**

他还有没支持的 Agent Skills，

**歸藏：**

Agent Skills 还没支持，下一步希望把这个处理掉，不然现在还是痛苦。

**杨攀：**

他还没支持？对。这我跟你说侧面反映什么，侧面反映就是他，他已经不觉得自己很强势了，已经被 OpenAI 打得很狼狈了。

**橘子：**

对，就他 OpenRouter 调用量不是第一次输给 OpenAI 吗？

**歸藏：**

OpenAI 有补贴，

**杨攀：**

OpenAI 的卡应该比它多。

**橘子：**

是疯狂补贴，疯狂打折。

**歸藏：**

多多了，

**橘子：**

对，但是这次它，

**歸藏：**

多多了。

**橘子：**

能超过，其实还是靠 GPT-6 Astra。Astra 在 OpenAI 其实没有折扣，这还挺厉害的。

**歸藏：**

还有 Codex 本身的体验，它有各种问题，但相较于其他桌面端实在是强 1 万倍，我觉得。

**杨攀：**

对，还有 Computer Use 太强了，

**歸藏：**

对内置浏览器！

**杨攀：**

我这两天不是也在用智谱 ZCode 跟 GLM 吗？

**向阳乔木：**

对。

**杨攀：**

这两天完成一个任务，我原来知道 ZCode 有 Computer Use，后来用了一下，发现比 Codex 差很远。

**橘子：**

已经 Codex 现在已经是实际的王者了，

**歸藏：**

在 Computer Use 上已经一骑绝尘了。

**杨攀：**

它已经真正变成了我的操作入口。我现在好多事儿都不自己打开网站或者软件了。

**歸藏：**

对操作系统嘛，

**杨攀：**

好多都是直接。

**歸藏：**

你现在把。

**杨攀：**

对，

**歸藏：**

给它全铺开，就只用它，完全没有任何问题用电脑。

**杨攀：**

通过它发号施令。

**向阳乔木：**

所以我之前是用 OpenCode 类似的路由中转，把其他模型全接到 Codex 里面用。大家真是懒得切换多个模型、多个 Harness，用惯一个就行。

**杨攀：**

你说这点又对应我上周说的，模型跟自家 Agent 越来越互相依赖。模型不好，Agent 推不动；Agent 不行，模型也不好推。对。

**歸藏：**

接下来又是一个 Codex 的新闻，Codex 的内置浏览器支持 Chrome 插件，这下更完蛋了，

**向阳乔木：**

我今天试了一下，我发现好牛逼，

**杨攀：**

太狠了。

**歸藏：**

对！

**向阳乔木：**

它能把 Cookie、历史记录、插件全都装上去，基本上是一个完整的浏览器了。我上次还说要不要找一个第三方浏览器。

**歸藏：**

对。

**向阳乔木：**

比如说 ego (lite) 或者是 Tabbit 类似，

**橘子：**

干没了。

**向阳乔木：**

现在想想好像没必要了，都快，

**杨攀：**

对。

**歸藏：**

以前它登录网页可能比较费劲，现在给它装个 1Password 就行。我的 1Password 现在都是授权，不会出现明文密码，直接授权密钥，它点一下就登录，非常安全。包括我的信用卡也存在 1Password 里，想要支付什么的，直接给它授权，它也能帮你填写。

**杨攀：**

我之前长期用 Safari，因为我有选择恐惧，Chrome 插件太多，Safari 没什么插件，我就彻底不用。用 Safari 的一个重要原因，是它跟 Keychain 绑定在一起，用户密码什么的我都存在苹果的 Keychain 里。现在它拆成了一个 Keychain、一个 Passwords。原来 Chrome 调不了苹果系统的 Keychain，现在 Chrome 已经能直接调苹果操作系统钥匙串里的所有密码和账户了。我觉得除开 1Password 的功能之外，基本体验，Chrome 自己已经能搞得定。

**歸藏：**

对，他自己也有这种东西。

**杨攀：**

还说明一点，Codex 团队之前对于把浏览器吃进来这件事很坚定，这是之前决策的一个落地。我还一直在想另外一个问题，大家有没有觉得，Codex 内置浏览器的模式下，屏幕尺寸也不合适了？我觉得需要更宽一点的带鱼屏。

**歸藏：**

宽点儿对。

**杨攀：**

留一个 16:9 的浏览器，在左边或者右边加一个聊天和会话列表的空间。我最近一直想买一个 5K 带鱼屏。

**歸藏：**

是挺合适，你分屏也好分，

**杨攀：**

对。

**歸藏：**

你现在 16:9 这样分屏其实挺费劲的，怎么分都不太合适，尤其是看网页的时候难受，

**杨攀：**

这样既能得到原来 16:9 的浏览器体验，又能用上 Agent。

**橘子：**

还说微信最近更新把浏览器放右边了。

**向阳乔木：**

太恶心了。

**橘子：**

被人骂死了？

**杨攀：**

微信更新太牛了，我觉得跟 Codex 其实是一模一样的，你发现，

**橘子：**

但是体验太差了，

**向阳乔木：**

但逻辑不对。

**杨攀：**

左边会话列表中间聊天，

**橘子：**

体验太差了！

**杨攀：**

然后右边是浏览器对。

**橘子：**

对，但他没有 AI，所以就。

**歸藏：**

也很差。很难用。

**向阳乔木：**

我提前准备着的吧！

**橘子：**

对。

**杨攀：**

别的。你别着急，

**橘子：**

对，

**杨攀：**

你别着急，就大家都要往一块儿走的，

**向阳乔木：**

但是比如说朋友圈一点，它那儿出来了，然后左边又有一个提醒让你点。你还没习惯这种反应，就觉得好像没变化，很诡异。

**歸藏：**

对，搞不明白。

**向阳乔木：**

你用了时间不？

**橘子：**

他没做好。

**歸藏：**

对，

**杨攀：**

反正我用了一段时间了，

**橘子：**

他没有做标签。

**杨攀：**

我觉得太爽了。

**向阳乔木：**

那可能你屏幕宽吧，我感觉又占地方又感觉来回拆就有时候合在一起，有时候不小心又拆开。

**橘子：**

主要是微信自己已经占了 3/4 了。

**歸藏：**

它的浏览器不出现时，你根本不知道会在哪儿出现。一会儿在侧边浏览器，一会儿又出来一个独立浏览器。

**向阳乔木：**

对，就没有预期！

**歸藏：**

对。

**杨攀：**

我知道你们遇到啥问题了，有一个设置，默认是用外部浏览器打开，用内部浏览器打开？

**歸藏：**

我不是？

**杨攀：**

我最早都是用外部浏览器，后来遇到你们这些问题，就改成默认用微信内部浏览器打开网页了，就没有你们说的体验割裂了。

**向阳乔木：**

他不是问题。

**歸藏：**

它是独立的微信内部浏览器窗口，你右边开了一个侧边栏的浏览器窗口。

**杨攀：**

对。

**歸藏：**

看看打开了一个，比如说公众号，

**杨攀：**

对。

**歸藏：**

你再点开一个公众号，它出来的不是默认浏览器，是它微信内置浏览器的一个单独窗口。

**杨攀：**

我知道。他就把它覆盖了，对。

## 18 / Codex 多账号与工作空间

**歸藏：**

没覆盖，现在是两套逻辑共存，你不知道什么时候出哪个。我今天下午整理信息时遇到好几回。继续下一个，Codex 的内置插件支持登录多个账号。比如你连了 Notion 或者 Twitter MCP，现在 Notion 或者 GitHub 插件支持切换，可以绑多个账号。比如公司用 Notion，你自己也用 Notion，想把公司和自己的 Notion 都登录上去，让它读这些内容，现在都能读，一次可以读多个账号的内容。

**杨攀：**

不也就是 Chrome 的功能吗？

**歸藏：**

这个插件是 MCP 那边的，跟浏览器没关系。连接器本身支持多账号登录。

**向阳乔木：**

它的账号体系还有感觉设计还挺合理的，你看它本身它多个 OpenAI 账号也能来回切？它其他连接其他时候也是多个能组合，感觉多对多关系？

**歸藏：**

这些东西你不是说想不到，而是说他做的太快了，其他的 Agent 还在搞那些基础的东西的时候，他已经开始深入到这些非常细微的东西里边了。然后是。

**橘子：**

它这个就是跟模型一起迭代模型环境，所以这个地方基本上已经是一个自我加速状态。

**杨攀：**

要吃掉浏览器这个事已经没啥好说的，我觉得就是像 Anthropic 在这方面反应太慢了。

**歸藏：**

他们的工程能力太差了。

**橘子：**

那 Anthropic 不是现在转去做生命科学了吗？

**歸藏：**

有反派朝着大反派的形象。

**向阳乔木：**

我比较好奇，早些年的 AI 浏览器好像都没剩了。比如现在我用 Chrome，会偶尔问一下 Gemini，频次也非常低。原来第二浏览器打的点，似乎就是你可以有 AI 助手，现在这种形态好像越来越少了。

**杨攀：**

对，你说得对。

**向阳乔木：**

不知。

**杨攀：**

就是两条路线，你看，Chrome 往自己里边加 Gemini。它是浏览器里加。Agent 现在 Codex 说我是 Agent 里加浏览器，看谁赢，那肯定是 Codex 这个路线赢。

**歸藏：**

我觉得 Codex 现在差的是标签页和项目的管理，就是浏览器标签页和项目同时管理，形成一个联动状态。这个是需要的。它的标签页类似于 Dia，Dia 之前的设计师和交互设计师不是在 OpenAI 了吗？之前做 Atlas，现在估计做浏览器，他们一定能想到这事儿。

**向阳乔木：**

对！

**歸藏：**

后面一定会做项目，左侧聊天项目跟浏览器标签页的联动的管理。你像如果是，我可能都不用浏览器，我也不用 Chrome。因为你所有的上下文真正的统一了。

**橘子：**

最后我们用浏览器用来看视频，

**向阳乔木：**

我靠我感觉可。

**橘子：**

别的情况下也用不着。

**歸藏：**

我很多时候用来刷推，包括看文章。

**橘子：**

对，就消费嘛，你除了消费。

**歸藏：**

比如 Gemini，我很少用 Mac App，能用网页就不用 App。

**向阳乔木：**

Codex 要吃掉一切的感觉，吃掉一大堆软件，他只需要把 Codex 搞好就行了。

**杨攀：**

Codex 现在就是操作系统里最强的 Agent 了。唯一我觉得现在比它领先的，是从另外一个维度领先的，

**歸藏：**

是一个界面？

**杨攀：**

还是我一直这几期坚持要说的 Grok Bot 还有 Meta 的那个不也起来了吗？

**歸藏：**

OK。 下一个新闻 Grok Bot。

**杨攀：**

那一个 Muse，还有叫什么，Instinct？

**橘子：**

Instinct

**杨攀：**

我不知道那个怎么回事，也挺火的。

**橘子：**

现在硅谷那边就是在吹这个概念，personal Agent。今天晚上？

**杨攀：**

那我觉得一定会走到这一步的，我坚信！

## 19 / 常驻 Agent 与多平台内容分发

**歸藏：**

下一个就是 Grok Bot！

**向阳乔木：**

要有个用例。我前几天在杭州见了 Tw93，问他怎么用 Grok Bot。他说让 Grok Bot 帮他自动做多平台的营销推广，推广他的 Mole 清理软件。因为他有一台独立电脑一直运行，定时访问欧洲、美国的一些小众论坛，再交给 Grok 判断论坛调性。比如有些论坛特别喜欢独立开发者讲故事，有些喜欢知识性、干货分享。它会根据调性，同时判断大家摸鱼的时间来发帖子。他只需要提供内容。

**杨攀：**

不就干掉了很多营销 AI 营销公司吗？

**向阳乔木：**

是的。

**歸藏：**

对。

**杨攀：**

对，用它也是用 Browser Use、Computer Use 这类的？这不就是交付结果吗？

**橘子：**

对。

**歸藏：**

他那个模板上的分享。

**橘子：**

对，做成服务的话，我觉得很多人愿意买的，

**歸藏：**

而且 Grok Bot 那个模板还能分享你那套东西可以直接分享到他那个商城里去，别人在用。

**向阳乔木：**

我就拥有了相当于独立推广软件的能力，比 Skill 要强大得多！

**橘子：**

而且 Grok 的英文能力还挺强的。

**杨攀：**

开始交付结果！

**橘子：**

它写的东西人味儿比较好。

**歸藏：**

然后。

**橘子：**

正好。

**杨攀：**

我接下来把我们的网站的增长的任务交给他了。你看乔木就不等你了，你看让向阳乔木干就行了，

**向阳乔木：**

哈哈，

**歸藏：**

在国内可能水土不服。什么都登不上。

**向阳乔木：**

然后都是，

**橘子：**

对。

**向阳乔木：**

就小红书先拦你一刀。

**杨攀：**

不需要国内，国内没有 Internet。

**橘子：**

你可以翻译成英语，去国外参。

**歸藏：**

没有互联网是？

## 20 / Coding 与 Office：两种工作模式

**杨攀：**

就我们聊的过程中，ZCode 刚刚有一个新的版本升级，它已经支持 Coding Mode 和 Office Mode。Coding Mode 和 Office Mode 是一个写代码的工具，也开始相当于 CodeBuddy 变 WorkBuddy。

**歸藏：**

刚才提的，我觉得可以试一下，尝试把 Codex 里的浏览器当主力浏览器用一段时间。

**杨攀：**

好，我跟你一起试，我也有兴趣。

**歸藏：**

下一个是 Grok Bot 支持的语音就是语音对话能力，我觉得对于低成本 Agent 来说，低使用成本 Agent 来说还挺重要的。下一个是 Claude Code，就刚才说了，Claude Code 推出了 Projects 测试版，一次对话的话，它自动把工作，就它就没有对话的聊天的。一个聊天的概念，只有项目的概念就是你一启动一个项目以后你所有的聊天都会在一起，然后你不用自己切聊天，它会自己拆线程，然后去在云端运行，然后在不同的对话之间传递上下文。你离开电脑，它也能在云端继续跑，感觉他们在朝着 Grok Bot 走。

**杨攀：**

太复杂了，感觉！

**歸藏：**

但是，服务有点太多，你都不知道去对。

**杨攀：**

不知道咋用了，这概念太复杂了。

**歸藏：**

对。对。

**杨攀：**

对你，

**歸藏：**

他每次都。

**杨攀：**

你要么就原生在云端，

**歸藏：**

拆一个。

**杨攀：**

要么就原生在本地，

**歸藏：**

要不你就拆一个 App 出来，单独做 Claude 客户端。我觉得已经没办法了。

**杨攀：**

好久没更新了。

**歸藏：**

没办法。

**杨攀：**

感觉你好久没怎么大变化了。

**歸藏：**

然后它这次是把 Cowork，

**橘子：**

感觉他们好像已经放弃治疗了。

**歸藏：**

对，

**杨攀：**

是不知道为啥？

**歸藏：**

还有一个是把 Code、Cowork 和 Claude Chat 合到一起了，就学 Codex。就之前 Codex 学他嘛，像他学 Codex 就是 ChatGPT 那部分 ChatGPT 和 ChatGPT Work 在一个里边。

**杨攀：**

对。

**歸藏：**

云端处理。

**向阳乔木：**

没必要分，

**橘子：**

对，

**向阳乔木：**

我觉得没必要分。

**橘子：**

所以这是个大趋势，越来越简单。真正能理解什么 Work、Code 这些东西的人很少。

**歸藏：**

就不需要分这些任务，不要按任务把界面分成不同入口，让人去切换。

**杨攀：**

对话会话，

**橘子：**

对。对，对话！

**杨攀：**

就像刚才说的，原来微信左边的会话列表是人和群，现在都是 Agent。

**歸藏：**

现在是聊天和项目。

**杨攀：**

对。

## 21 / 云端 Mac 与 Agent 执行环境

**歸藏：**

还有一个是 Devin 现在支持 macOS 虚拟机。他们自己买了一堆 Mac Mini，给你提供整机服务。你可以在他们的虚拟机里，像 Grok Bot 一样，

**向阳乔木：**

那挺有意思的，

**歸藏：**

原来的虚拟机是 Linux，他们现在的机器是 Mac，所以很多 AI 任务会更加顺畅。你也能像 Grok Bot 一样打开远程桌面，操控里边的软件。

**向阳乔木：**

再给你配一个 Mac Mini。

**杨攀：**

这个生意之前一直有，美国好多公司做的就是租一个 Mac 环境。

**歸藏：**

对，他们现在是整合在一起了嘛。

**杨攀：**

对。

## 22 / 企业数据与日志边界

**歸藏：**

然后是英伟达之类的美国头部公司，因为担心 Anthropic 6 月引入滚动 30 天使用日志的功能。它会保存你的聊天记录和信息，无论你是 B 端公司还是 C 端用户。都无法退出，它会滚动 30 天保留你的对话。加上前几天的报告，他们都禁止员工使用 Fable 5，或者说禁止员工使用 Fable 模型。

**杨攀：**

Anthropic 不就是相当于自己向全天下人公布，我可以随意存取任何公司的内容，然后我还会讲出来。

**歸藏：**

对，

**杨攀：**

那谁敢用？

**歸藏：**

我只要认为你不安全，你就玩吧，我就那啥。最后一个是苹果发了新的 Siri AI，没啥人讨论，

**杨攀：**

还没用上！

**橘子：**

好像没什么事。

**歸藏：**

有点拉胯。

**橘子：**

没什么水花吧。

**杨攀：**

还没用上，我反正昨天把所有的系统都升级到 27 了，

**向阳乔木：**

也好看了很多，

**杨攀：**

那时候还。

**向阳乔木：**

我看感觉这个确实 Liquid Glass 刚出的时候就觉得，感觉像灾难一样，设计语言现在看多了，

**歸藏：**

说起来了。

**向阳乔木：**

然后它加上一些补丁，然后也感觉也 ok。

**杨攀：**

它可以调透明度，模糊程度。

**歸藏：**

模糊程度越高，它的可读性越强。调到最高就是原来的磨砂玻璃。

**向阳乔木：**

对，我调高了一点。

**杨攀：**

我用的默认的中值！

**歸藏：**

所有新闻就没了。后面还有一些东西，刚才说到刘胜与的文章，传得挺多的，包括在推特上，我看也有很多人在刷。

**杨攀：**

你想，DeepSeek 小天才，然后还踩 Anthropic，这本身就已经是热点了。

**歸藏：**

踩流量密码？

**杨攀：**

这三个流量密码叠加在一起。平时大家见过哪个 DeepSeek 员工出来写文章？之前见都没见过，逮着了赶紧传。

**歸藏：**

是任何东西都能活。

**杨攀：**

对，心理上拉近一下，你转发一篇文章，心理上拉近一下，跟 DeepSeek 的距离。

**橘子：**

我觉得还不止，他自己也让人有一种共鸣，一个这么天才的算法工程师，

**歸藏：**

就最顶尖的那部分。

**橘子：**

都感觉要被取代了，共鸣是非常强的。

**歸藏：**

而他出来这么说是大家是认的，或者说大家是认同的！

**向阳乔木：**

DeepSeek 的他工程实力是不是很强，

**歸藏：**

然后。

**向阳乔木：**

因为听朋友说，他经常跟 DeepSeek 里边的朋友聊。他们评价 Claude Code，就觉得这哪有什么工程能力，Harness 写得太差了，他们会这样认为。

**杨攀：**

因为 DeepSeek 团队本身的背景，他们之前就做量化，比其他模型算法团队的工程能力要强。你看 DeepSeek 一路走来，都是在工程上相对于其他模型公司多投入了一点，然后就取得了相对同行的巨大提升。

**歸藏：**

对，你这 4.1？

**杨攀：**

对。

**歸藏：**

推理速度和成本和价格。

**杨攀：**

我们这周遇到的是靠头部模型，

**歸藏：**

确实很离谱。

**杨攀：**

把这事儿又抹平了，

**歸藏：**

对是，然后对最后有个文字。

**杨攀：**

还是这个问题，接下来我们大家的价值是什么？我觉得这不是一个悲观的问题，而是我们要思考，找到自己新的位置和价值。

**歸藏：**

对你要做什么是。

**杨攀：**

总会有的。刚才说艺术都能帮我们做，说音乐那段的时候，就会有新时代能驾驭技术的艺术家。

**歸藏：**

现在已经很多了，做表达的、做抽象的，包括做内容、做商业内容的，我觉得这波人已经相当明确了。

**向阳乔木：**

我觉得从短剧行业的发展来说，我觉得非常乐观，它传递出来人，只要有很好的表达工具是可以非常有想象力，创造出原来完全不一样的东西的。

**杨攀：**

对，你看原来你要做这个东西，你要有想象力，然后你要能写本子，然后你要能做视频，你要能剪片子，现在就是 AI 帮你把后边的都弄完了，只要你有想象力，你愿意动手，你就今天就可以做个片子。对，不是说美国人在磕中国人做的美剧吗？这俩人完全没有去过美国，然后做美剧，在美国火。

## 23 / AI 剧与内容生产

**歸藏：**

确实，最近每周都会有新的爆火的连续美剧、AI 剧，包括一些新的 AI IP，数据也非常好。它不是短期的，你点进去看，会发现整个数据非常稳定。有的可能不是特别火，但一直有人看。既然稳定，就能有一定的变现能力，或者其他方式。

**杨攀：**

再说一点，这周不是有平陆运河的社会新闻吗？我看到一个现象，这一批平陆运河的短视频和中视频质量都好高，款款都是精品，不管谁家出的。这里边有各种形式，有标准的大片形式，比如星球研究所那种，还有各个大号自己做的。一方面是剪辑能力、素材能力、故事能力，还有一些 AI 版，比如把平陆运河做成像哪吒一样的动画风格、AI 短剧，效果都非常好。通过这个事件，我的一个感受是，我们整个社会创造内容的能力和规模，跟半年前已经完全不同。

**歸藏：**

对，又回到问题，消费内容的时间是有限的，

**杨攀：**

是的。

**歸藏：**

嘿更绝，

## 24 / AI 参与研发与人的监督

**杨攀：**

要卷增长和拿结果，因为创造已经对人人都满级了。

**歸藏：**

最后一个是前沿 AI 实验室发布了一个 AI 发展速度指标，反正指标有三个。第一个是 AI 参与自身研发的程度，我们一直说 ASI 自动化趋势指数。它把公司内的研发按人类工作分类，评估自动化水平。2026 年 8 月，它说 Claude 尚未在任何环节完成自主运动，但是在 26% 的研发工作中扮演主导角色，处于 AI 协作级以上的水平超过九成。第二项是衡量对 AI 智能体的监督能力，就是他们安全那套东西。第三个衡量算力如何分配，尤其是 AI 研究投入的算力比例。他们说投入了 6% 的算力，约 12% 的 AI 研发驱动算力应用于安全工作。感觉他们除了第一个以外，

**杨攀：**

好他们感觉他们说话已经没有人信了。

**歸藏：**

第二个和第三个又回到以前那套叙事了，又开始恐吓了。

**杨攀：**

我们不聊了。

**歸藏：**

第一个还是挺有意思的。好。

**杨攀：**

今天要不就到这儿。

**歸藏：**

到这儿，今天 10 点。

**杨攀：**

这是我们第一期录播。

**向阳乔木：**

去在线录制？

**歸藏：**

线上录制。

**杨攀：**

在线录制，好。

**向阳乔木：**

对。

**杨攀：**

那就再见吧！

**歸藏：**

你不等 60 秒吗？

**橘子：**

你好。

**杨攀：**

不是，先跟大家说声再见。好，再见。

**歸藏：**

大家拜拜。

**杨攀：**

那下期见，拜拜！

**橘子：**

拜拜。

**向阳乔木：**

拜拜。

**歸藏：**

下次见！

## 相关资料

### 品牌

- [Next Token｜词元之外](https://nexttoken.tv/wiki/brands/next-token)
- [TypeSafe AI](https://nexttoken.tv/wiki/brands/typesafe-ai)
- [OpenAI](https://nexttoken.tv/wiki/brands/openai)
- [Anthropic](https://nexttoken.tv/wiki/brands/anthropic)
- [苹果](https://nexttoken.tv/wiki/brands/apple)
- [英伟达](https://nexttoken.tv/wiki/brands/nvidia)
- [DeepSeek](https://nexttoken.tv/wiki/brands/deepseek)
- [智谱](https://nexttoken.tv/wiki/brands/zhipu)
- [All-In](https://nexttoken.tv/wiki/brands/all-in)
- [阶跃](https://nexttoken.tv/wiki/brands/stepfun)
- [谷歌](https://nexttoken.tv/wiki/brands/google)
- [Figure](https://nexttoken.tv/wiki/brands/figure)
- [字节](https://nexttoken.tv/wiki/brands/bytedance)
- [火山](https://nexttoken.tv/wiki/brands/volcengine)
- [长鑫](https://nexttoken.tv/wiki/brands/cxmt)
- [AMD](https://nexttoken.tv/wiki/brands/amd)
- [上汽](https://nexttoken.tv/wiki/brands/saic-motor)
- [小米](https://nexttoken.tv/wiki/brands/xiaomi)
- [理想](https://nexttoken.tv/wiki/brands/li-auto)
- [努比亚](https://nexttoken.tv/wiki/brands/nubia)
- [中兴](https://nexttoken.tv/wiki/brands/zte)
- [腾讯](https://nexttoken.tv/wiki/brands/tencent)
- [阿里](https://nexttoken.tv/wiki/brands/alibaba)
- [华为](https://nexttoken.tv/wiki/brands/huawei)
- [网易有道](https://nexttoken.tv/wiki/brands/netease-youdao)
- [Meta](https://nexttoken.tv/wiki/brands/meta)

### 产品

- [Jev](https://nexttoken.tv/wiki/products/jev)
- [Cola](https://nexttoken.tv/wiki/products/colaos)
- [微信](https://nexttoken.tv/wiki/products/wechat)
- [GPT-6](https://nexttoken.tv/wiki/products/gpt)
- [Jevable](https://nexttoken.tv/wiki/products/jevable)
- [Live2D](https://nexttoken.tv/wiki/products/live2d)
- [魔法门](https://nexttoken.tv/wiki/products/heroes-of-might-and-magic)
- [俄罗斯方块](https://nexttoken.tv/wiki/products/tetris)
- [Lovable](https://nexttoken.tv/wiki/products/lovable)
- [刷推](https://nexttoken.tv/wiki/products/x)
- [微博](https://nexttoken.tv/wiki/products/weibo)
- [银河系漫游指南](https://nexttoken.tv/wiki/products/hitchhikers-guide-to-the-galaxy)
- [Stable Diffusion](https://nexttoken.tv/wiki/products/stable-diffusion)
- [Devin](https://nexttoken.tv/wiki/products/devin)
- [Qwen](https://nexttoken.tv/wiki/products/qwen)
- [TikTok](https://nexttoken.tv/wiki/products/tiktok)
- [Gemini](https://nexttoken.tv/wiki/products/gemini)
- [Mac Studio](https://nexttoken.tv/wiki/products/mac-studio)
- [MiMo](https://nexttoken.tv/wiki/products/mimo)
- [Arrow](https://nexttoken.tv/wiki/products/arrow)
- [Figma](https://nexttoken.tv/wiki/products/figma)
- [Napkin](https://nexttoken.tv/wiki/products/napkin)
- [Fable](https://nexttoken.tv/wiki/products/claude)
- [ChatGPT](https://nexttoken.tv/wiki/products/chatgpt)
- [StepAudio 3 Realtime](https://nexttoken.tv/wiki/products/step-audio)
- [豆包](https://nexttoken.tv/wiki/products/doubao)
- [Helix 2.5](https://nexttoken.tv/wiki/products/helix)
- [Chrome](https://nexttoken.tv/wiki/products/chrome)
- [飞书](https://nexttoken.tv/wiki/products/feishu)
- [Mac Mini](https://nexttoken.tv/wiki/products/mac-mini)
- [iOS](https://nexttoken.tv/wiki/products/ios)
- [iPad](https://nexttoken.tv/wiki/products/ipad)
- [Xcode](https://nexttoken.tv/wiki/products/xcode)
- [Apple TV](https://nexttoken.tv/wiki/products/apple-tv)
- [iCloud](https://nexttoken.tv/wiki/products/icloud)
- [Blender](https://nexttoken.tv/wiki/products/blender)
- [淘宝](https://nexttoken.tv/wiki/products/taobao)
- [拼多多](https://nexttoken.tv/wiki/products/pinduoduo)
- [抖音](https://nexttoken.tv/wiki/products/douyin)
- [小米澎湃 OS 4](https://nexttoken.tv/wiki/products/hyperos)
- [微信输入法](https://nexttoken.tv/wiki/products/wechat-input-method)
- [Typeless](https://nexttoken.tv/wiki/products/typeless)
- [Chatterfly](https://nexttoken.tv/wiki/products/chatterfly)
- [叭哥](https://nexttoken.tv/wiki/products/bug-say)
- [闪电说](https://nexttoken.tv/wiki/products/shandianshuo)
- [Claude Code](https://nexttoken.tv/wiki/products/claude-code)
- [OpenRouter](https://nexttoken.tv/wiki/products/openrouter)
- [Codex](https://nexttoken.tv/wiki/products/codex)
- [ZCode](https://nexttoken.tv/wiki/products/zcode)
- [GLM](https://nexttoken.tv/wiki/products/glm)
- [OpenCode](https://nexttoken.tv/wiki/products/opencode)
- [ego (lite)](https://nexttoken.tv/wiki/products/ego-lite)
- [Tabbit](https://nexttoken.tv/wiki/products/tabbit)
- [1Password](https://nexttoken.tv/wiki/products/1password)
- [Safari](https://nexttoken.tv/wiki/products/safari)
- [Notion](https://nexttoken.tv/wiki/products/notion)
- [GitHub](https://nexttoken.tv/wiki/products/github)
- [Dia](https://nexttoken.tv/wiki/products/dia)
- [Atlas](https://nexttoken.tv/wiki/products/atlas)
- [Grok Bot](https://nexttoken.tv/wiki/products/grok-bot)
- [Muse](https://nexttoken.tv/wiki/products/muse)
- [Instinct](https://nexttoken.tv/wiki/products/instinct)
- [Mole](https://nexttoken.tv/wiki/products/mole)
- [Grok](https://nexttoken.tv/wiki/products/grok)
- [小红书](https://nexttoken.tv/wiki/products/xiaohongshu)
- [CodeBuddy](https://nexttoken.tv/wiki/products/codebuddy)
- [WorkBuddy](https://nexttoken.tv/wiki/products/workbuddy)
- [Cowork](https://nexttoken.tv/wiki/products/claude-cowork)
- [ChatGPT Work](https://nexttoken.tv/wiki/products/chatgpt-work)
- [macOS](https://nexttoken.tv/wiki/products/macos)
- [Linux](https://nexttoken.tv/wiki/products/linux)
- [Siri AI](https://nexttoken.tv/wiki/products/siri)

### 人物

- [罗福莉](https://nexttoken.tv/wiki/people/luo-fuli)
- [唐杰](https://nexttoken.tv/wiki/people/tang-jie)
- [Sam](https://nexttoken.tv/wiki/people/sam-altman)
- [Dario](https://nexttoken.tv/wiki/people/dario-amodei)
- [马斯克](https://nexttoken.tv/wiki/people/elon-musk)
- [特朗普](https://nexttoken.tv/wiki/people/donald-trump)
- [黄仁勋](https://nexttoken.tv/wiki/people/jensen-huang)
- [Brad 强](https://nexttoken.tv/wiki/people/brad-qiang)
- [陈抱一](https://nexttoken.tv/wiki/people/chen-baoyi)
- [Tw93](https://nexttoken.tv/wiki/people/tw93)
- [刘胜与](https://nexttoken.tv/wiki/people/liu-shengyu)
