节目片头
大家好,欢迎来到 Next Token|词元之外。Next Token|词元之外是一档关注 AI 技术、产品与现实影响的视频播客,同时提供音频版。旗舰栏目 Next Token Weekly,由杨攀、歸藏、橘子和向阳乔木每周圆桌对谈,分享观察、实践与不同判断。不只预测下一个词元。¶
上海开场:本周模型、Agent 与硬件
GPT-6 Astra:从 3D 建模聊起
那先说一下上周,可能大家都用过的模型,GPT-6 Astra,要不从歸藏你来点评一下你自己的使用感受。¶
每次都歸藏开始是吧?¶
行,就上周 Astra 主要玩 3D 和建模,因为上周上第一期我们也聊过问题,模型的能力的测评,如何让 C 端用户感知这事儿,现在已经很难受了,它的各种 Benchmark 呀,还有你看 GPT-6 很好几个 Benchmark 都 99% 都一百。所以大家就会越来越卷 3D,卷那些做 3D 的,因为它最直观就是很复杂,大家都能感知到它复杂,同时也能感知到它结果。因为每次之前呢,你看他们用什么画鹈鹕骑自行车,骑的越骑越花了,已经不满足于 SVG 和动画了,开始弄 3D 的和各种其他场景的。它自然而然的,我觉得不知道是不是有意的,它对 3D 的强化,导致它。我觉得是有意的,大家的案例都是玩 Blender,一上线对吧,确实很厉害。¶
也是很有意思的,大家。¶
搞了一下,我还发了一个 3D 小游戏,我说用了 3%(Plan),很多人不相信,小红书下面全是质疑,疯狂质疑,但我看了一下,我确实,是 3%,来我又把那个。Roguelike 小游戏扩展成类似于。吸血鬼幸存者那种无限的地图,就它一直刷怪,你一直升级,就选择升级的项目和武器。又多了 2%,总共花了 5% 的 200 美元的额度。就刚才跟黄宇讨论,我觉得很多时候是,我也看了很多人找我问,微信上找我问,我说他说为什么我就。我就我消耗了,我把我 200 美元额度我一星期就消耗完了,做出来的东西也不符合我的要求。我消耗了,我把我 200 美元额度一星期就消耗完了。我就合计就是很多人对东西没有概念,一个是要求太多,我看他还用那个。prompt 模板,你是一个啥对吧?那你看咱们就现在很随意,就没写。¶
那已经是上个时代的玩法了。¶
写太多了。还有一个是他对于还是有要有一点儿工程的一个理念了。比如说他想做一个什么呢?一个星球,他想让他把星球上的建模都建出来。就它就是其实游戏是通过工程化的方式实现的,比如说星空什么的,它是外面是一个星球,进去的时候是过载动画完了以后加载当前的一个区域,它是有边界的,它等于是一个完整的星球,加上里边有五六个场景,组成的一个那种游戏的场景,他以为是真的是一个星球的那种面积的建模,所以 AI 就不可能给它建出来,说我们人也,对我们人也不可能,对他也不理解事情,所以很多时候就是这些问题导致的,过度消耗很。¶
那就没讲清楚,是不是?¶
Blender 与代码:给模型合适的工具
那样其实 Token 效率非常高。¶
所以为什么用的很少,最为什么大家最近用就是我做游戏的游戏引擎用的 Godot Engine,也它也有类似的东西,所以它也是,你做完了,它自己一开就有了,就没有一个操作界面的过程。¶
你看就是我上次在博客里讲的,就接下来的软件,其实你要为 Agent 的调用的极致效率最大化做一套基建,这边再给人就是看交互,看内容,再做一套界面,就把都综合起来。¶
MCP。¶
但我觉得,所以我觉得方法是对的,它没有去绑定在一个 AI 里边。你花钱我才给你让用,让你用别的 AI。¶
我觉得我不是还有我自己那 Agent 嘛,也在迭代,用了 GPT-6。我觉得跟 Fable 我觉得没有,差距,没有感觉到有明显差距,或者说在这个。能力水平下差距不大,反正他干的活都一样,出的 bug 也比较少。他能够审出以前 5.6 拉的那些问题来,其实是差不多的。但是,在多模态和 3D 上,我觉得是一个新的就很大的一个机会,非常大的一个机会,可能会造成我们接下来的 AI 内容生产的河流。就比如说我们之前我前上周不是说,就 AI 视频和 AI Vibe Coding 两拨人是干各的。没完全没有交集的。但是现在我觉得它是一个很好的一个桥梁,让 Vibe Coding 跟 AI 视频和 3D 就是连到一起去。¶
我发现其实我们用户的模型吧,没有那么热衷,因为它比较贵。¶
会,就是和。¶
太贵了,还是太贵了。¶
但是没。¶
卷差不多了。¶
基本上其实你看 DeepSeek Flash 新出也很好。而且,刚刚歸藏说的点特别重要,现在的模型它做一件事情,它方法可能是我们不知道的,但反而更好的。我以前我在开发我 ColaMD 嘛,一个 Markdown 编译器,用之前的模型它都会自己启动一个 Electron 版本来测试。但是用 DeepSeek Flash 它启动的东西就跟别的不一样,它有时候不启动不给我看,自己就测完了。我也不知道它怎么测的,但是就还挺神奇的,我就觉得就是这些方法我也不懂,但是它。就能完成我的要求。哪怕是一个这么小的模型,还挺神奇的。¶
我们如何用 Agent 制作和发布播客
因为我们这正好是播客录制那天发的 Astra。所以我们播客整个第一期的发布,包括我们做的网站,我是全用 Astra,来做的。我的一个体会就是,虽然它很贵,但是其实它很省 Token,它效率非常高。其实是某种程度上又帮我换来了时间。同样一个级别的任务,比如我之前默认用的是 5.6 Sol 的 high,那,要想好久,完成任务。我现在用的 Astra 的 medium,它就对,直接做。这里还有个小细节,大家,如果用 Codex 的话你在设用什么模型的时候有一个模式叫 Default 就是你不选,你会看到它底下几个档它是这么走的它是 Sol 的 Sol 的 medium,就到了 Sol 的 high,到了 Astra 的 medium 它是连着的。¶
怎么理解呢?¶
它是 Sol 有两档,Sol 的两档下一档就是 Astra 它是把 Sol、Astra,前面的 Terra。前面的 Luna 它把它放在一个档位上。也说 Astra 它的定位应该是 Astra 的 medium 是跟 Sol high 其实是一个定位的。它默认没有 Sol high,反正我的感觉就是用下来以后就是。话非他话非常少,但是干活干得非常快。而且效果非常好。还有就是我觉得 Computer Use 简直就是对工作效率提升太大了。因为我们原来其实大家想想,我们原来一直就锁被锁死在了写代码事儿上,任何写代码之外的事情,你全是人要再去点什么的。这样的话你就一直是 Human in the Loop,就我们所有耽误的时间全在人操作上,包括我们现在现场录播课,我启动了一个录音的软件我完全。不会用。我现在的用法就是跟 Codex 说,帮我启动录音,他去点鼠标去把做了。所以我就特别同意橘子刚才说的,就这一代它帮我们把整个计算机里边的所有东西都如果全能完成操作的话,大家换个角度想想。不是那台电脑跟 Codex Agent 它是一体的,它是怎么讲,有自己的运行空间,能完成人类原来在电脑上完成所有功能,就剩下就一个事了,你跟它说你想干啥,¶
就事就全解决了。所以我觉得这是一,这一步是一个就是巨大的一个进步。¶
所以他们说他们觉得就这一件。¶
从操作电脑角度来说,已经是 AGI 了,他的操作电脑水平已经远超过我们了。从操作电脑角度来说,已经是 AGI 了,它的。¶
包括我们的博客也是。¶
我们播客是全平台上架,因为我之前个人,因为我负责的发第一期播客,我之前个人这几个平台,小宇宙、B 站、Spotify、Apple Podcast,YouTube 我全没用过。这几个平台全部都是 Codex 自己发布的,我甚至都没去研究过这些平台的功能,我只提需求就行了,我只负责把握准备素材的事情就可以了。我们开始节目之前就聊天的时候说,这里有一个点。今天这个 Codex 会 Computer Use 之后,其实我们存在了一个新的套利空间。大家想想之前我们的套利空间是编程,写文章对吧?今天新的套利空间是什么?原来比如说我 1 个人要维护 5 个播客平台,我是要花大量时间的,今天我可能就一句话它就搞定了。就里边大家想想,还原来有什么你自己手工操作特别麻烦的事儿,各种各样的事儿,包括我们网站原来想把功能做的特别复杂,你做不了的。今天我们全能就是做足够多的深度和广度,这里边其实是又一个新的套利空间出来。¶
特别是我们网站 Transcript,带着我们的 ID,效果,其实很多 SaaS 软件可能做了一年,有些某些软件做了一年的 VIP,都没有功能。我们 2 天就完了。¶
大家一定要去上我们的网站看看,叫 nexttoken.tv,¶
我们 2 天就做完了。¶
上边其实是我们的一个实验场,我觉得。¶
一个实验场我觉得,把一个博客是吧,一个平台到一个。¶
把一个播客是吧,一个平台到底。¶
这应该是我觉得呈现一个博客信息量最好的平台没有之一,各种标签,各种,你在文本里面看到任何关键词都可以点击到一个标签下面,就其他所有的博客,任何一个平台都没有做这件事情,白做了十年。¶
可以把我们收购。¶
也操作不了。¶
所以他对外宣传也是他强化的就是 3D 和 Computer Use。但为啥他 Computer Use 能做这么好,其他家感觉差的有点远呢?是啥原因呢?¶
买了 2 万,2 万台。¶
2 万台吧。¶
2 万台。¶
Coding 之后,Computer Use 也是一个通用能力。¶
就等不及大家针对 Agent 做改造了,说不行我就让它能用以前的软件。¶
不可能等,我觉得,太慢了。¶
但是我觉得这是双向奔赴的,就刚才我们前面也提到了,有很多软件也在自己在去适配,对我觉得这 2 条路并行来走。¶
年度会员。¶
他应该是这几个剪辑软件里最新的,就他的时长是最少的,也不好说。¶
也不好,你这个。¶
Astra 会用电脑,就算 AGI 了吗?
看定义吧,我觉得某种程度上,某种程度反正是我现在能,我能很多做的事儿,他能做的事儿我做不了,他是比我强的。¶
那按标准,那很早就 AI 了。¶
他更往前一步,我觉得他比 90% 的白领,线上工作的,依赖线上电脑工作的这些人。的能力是要强非常多的,就不管。¶
所以我觉得核心审查就是,你如果抵制说 AI 的低质内容,你应该针对内容去审查,¶
你不要针对动作。¶
而不是应该针对发备方发布方式。比如说你我四个活人录的视频,你就因为我用自动发布了,你就把我限流了,我觉得是一个非常离谱的逻辑。¶
5.1 没有人用。¶
好 都没有人愿意比了。¶
对没有。¶
没有人愿意比了。¶
但其实大家能感知到的说最近有一些写作方面。一个是 Gemini 3.8 Flash 还不错。另外就 Fable 5.1 可能是就是 Claude 中间就是有一堆模型都不太行,5.1 的写作是明显很好,可能是他家最好的模型现在。¶
有一点大家可以关注一下,做 Benchmark,现在不是 Benchmark 泛滥了吗?各种各样的,而且各个模型肯定都是在打榜,有针对性做。有一个,突然想不起名字来了,就有一个 Benchmark,他是,发了 2.0、3.0、4.0。我忘了名字叫啥,也是编程,coding 还是什么。¶
那干嘛呢?¶
那说明就是出题真实力。¶
真实力,就不管你。出什么题。¶
好像 Terminal-Bench 吧。哎,对对。¶
写作体验:不同模型各有所长
DeepSeek Flash 与 Harness 的使用体验
但是我还是要强烈安利一下就是 DeepSeek Flash。跟 DeepSeek Harness 配合在一起。¶
我们接着就聊 DeepSeek Harness 的。¶
如果你想简在中文世界,检索信息,用 DeepSeek Flash 和 DeepSeek Harness。就我用到的就是完全是就是天花板级的,你用别的什么,包括我们前面说的海外模型,海外的什么工具都不行。就我的一个感受就是它可以几乎把中文世界所有能找的都能给你找出来,深度和广度都非常。¶
你用了什么案例让你觉得下判断?¶
就好多,我查各种数据,查各种。¶
为什么一定要配合他那他 Harness 呢?¶
我不知道,反正就是我觉得组合就很好。¶
那接下来我们就提到 DeepSeek 了,DeepSeek V4.1 Flash。我第一感受是看推上好多人反映说快,真快。¶
速度变快之后,人的判断更重要了吗
Harness 更新太快,插件和工作流如何跟上
听你们说完以后,我昨天特意下了一个。Harness,更新了一番,因为它刚出来的时候就装了,但是它老更新,我发现之前装的好多插件多半都不能用了。大家也知道,它是用为了,还是它为了训模型用的,出东西。它和的模型和 Harness 组合特别牛逼,我记得歸藏之前也自己做过,给它做一个 GUI,你的感受,你评价模型,和他的组合。¶
组合确实牛逼,但核心的就是它迭代太快了,它一天发十几个版本,导致你的插件就是。¶
跟不上。¶
就它那套设计你是很牛逼,但问题是你动老动那些东西,就它一更新就动插件的核,¶
怎么了?¶
底层的核心,导致所有插件都不能用,我插件你就得一直跟着它适配成本就非常高,¶
个歸藏的核心,导致。¶
尤其是一旦做 GUI 的话,GUI 你挪个地方你就 GUI 就废了,你挪个地方你就废了,或者说一些核心的逻辑。或者说一些核心的。¶
所以只能做 MCP 或者 CLI。¶
所以你看官方也没有推 GUI 嘛。¶
那没法做。¶
没法做。¶
对没法做。¶
没关系,就很早期的。¶
发行版。¶
你等发行版。¶
你是极客,你想折腾,那你就跟着官方走。¶
怎么说?¶
我今天还特意跑了一下,用它 Harness 跑,他下面展示有 Token 速率,还有缓存率,我看缓存率是 99.5%。¶
是的,这是百分之。¶
经常会出现,之前之,之前经常是 100%。¶
四舍五入经常就 100% 了。¶
因为别的家的模型一般到九十以上就不错了,甚至有的模型整到七八十。所以它成本还是很牛逼,而且这一代它又优化了 KV Cache 技术,优化了 4 倍,它那模型参数不是大了 1 倍,所以它价格就是相当于降了 50%。¶
我靠,黑科技真多。¶
4.1 Flash,我看激活参数只剩 8B 了。¶
它还能动态调整 system prompt,但是不影响缓存。¶
我靠,这是什么做的。¶
我没看论文呢还。¶
KV Cache 他们应该也发了一个论文,我看谁,马东锡已经看完了。¶
马东锡,他比喻还挺好的,类比还挺好的。¶
能力够用之后,测试与交付成为瓶颈
我们社区的反馈是,模型太快了,以前没觉得快很重要,现在觉得快 10 倍,特么太重要了。¶
没有。¶
他几他打折也比他贵,Flash 降价了,降了 50% 呢。¶
而且 Flash 模型,它还有一些独立的思考能力,它是不谄媚的。昨天我跟他聊,一些东西,他喷了我一顿,说你说的不对,我就纠正了半天,我说我这样写比较好,他说我还是坚持我的论点,但我可以帮你写。¶
就重新做个对齐。¶
有人说你快了以后。那你无形之中它消耗就变多了。有人说它强力用这个。用的 DeepSeek V4.1 的话,1 天能花 200 块钱人民币。用的 DeepSeek V4 4.1 的话,1 天能。¶
那其实生产率它也提升了。¶
但我觉得有可能会造成一些浪费吧,可能他觉得,有可能他你没反应过来,你停没停的时候他已经完事了,他走向了一个完全不同的方向。¶
这都是阻碍,你知道吗?¶
这些都是旧势力。¶
你知道开发只要 10 分钟,你发版要半小时,我都懒得发版。¶
我得发要 1 小时,因为我的跨平台每个都要过公证。¶
我不打包了,你自己弄吧。¶
模型路由与稳定性:用户到底在购买什么
还有他们负责人崔天意说,他要把旧的 V4 Pro,路由到 V4.1 Flash,这种一般是属于。什么考虑呢?来又为什么撤回了呢?¶
不对了。¶
这一波就是很多网友其实吐槽的是说,我的原来提示词都写好了,你的模型换完了以后表现行为不一样。我 25 年其实是蛮站这个观点的。但我说实话,我 26 年我不完全同意观点。因为我觉得总的来说,提示词在我们产品里今天占的比例其实是我觉得。影响的比例是越来越小的。¶
好多都内化到模型里了。¶
是都内化模型里了,这是第一点。第二点就是他们后来不是也是听取了群众的意见。大家想象一下,25 年的 DeepSeek 是不可能听我们的任何用户反馈的。就 DeepSeek 说。你们就我们提供的产品。你们顺手用就好了。我们的目标是 AGI 对吧?我们就往前走我们的,顺便让你们用一用。但是今天 DeepSeek 就是又开始听用户和市场声音,其实明显的一个信号,他们必须要做一个商业化的公司。就必须是对普通大众和企业提供商业化服务的,一点一点的全都得改过来。也说明,包括它要上市,它值这么几百亿美金的估值,你走到这一步了,你变成了一个公众服务,你做的任何一个小事情,影响范围都更,的范围都更大了,所以他必须去做事情。¶
但我觉得性质不太一样,它这次是说把另一个模型 ID 强行路由到其他模型,和以前说我更新一下,是完全不一样的性质。性质不一样,但结果其实是一样。而且它很短暂,它过几天 4.1 就上了,它 4.1 上之后又会路由回来。那你说这一个礼拜你能你它在那卡吗?¶
那我再告诉你细节,昨天晚上发现发生的,DeepSeek 模型名字,原来正常应该叫 DeepSeek V4 Flash 是吧?它没有 V4 了,它叫 DeepSeek Flash。¶
一过期,一发就 out。没有黑色。¶
就以后你会发现就 DeepSeek 会有两个系列,它还会走到那条路上的,一个叫 DeepSeek Flash,一个 DeepSeek Pro。它去掉版本号的,它以后还是我觉得还是会这样,还是会滚动升级。咱们上周不是聊过吗?各家模型现在都开始滚动了,Qwen 也往前滚动,Doubao Seed 也要往前滚,¶
滚动很正常,因为它现在大部分成本在后训练,一直会训练。对它不应该租,因为你两个模型首先你的定价也不一样。那你这边你是 to B 服务,有你有 1 万家公司在用你的模型,他们怎么跟你一起调定价,很麻烦的,而且调完三四天又调回来。很烦。¶
不挣不了,第三方延迟是官方 100 倍。还存率是官方的 90%。¶
就在我把它免费用还是打折用,近乎免费。¶
近乎免费,x0.03 位的消耗。¶
Grok Bot / Muse:为什么 Agent 需要云电脑
回来了,一切都回来了。¶
攀哥说特别想聊聊你说说。¶
上周我觉得话题没展开,但是我过了这一周,我觉得共识更强烈了。它处在一个由非共识到共识的转折的边缘是什么呢?大家知道 Grok Bot 的本质是什么?本质就是还是,给你分配了一个云端的电脑。它很多任务在电脑上去完成了,当然通过你那些授权什么的,该装软件。大家想想,我们最早用 ChatGPT 是只能。对话,后来出了 Manus 开始就出了 Agent,Agent 可以写代码,在我本机去运行一段代码来完成任务。再下一步呢,是就是走到我们今天,它有了 1 台电脑,它不只是能够运行代码,它可以有自己的环境,装自己的软件,来完成任务,甚至就打开网站还是什么。我觉得马上就走到下一步,包括刚才说的 Meta 的 Muse。还有其实我们国内的豆包工作,其实也是云端给了 1 台电脑的。我们前面花了这么长时间聊 Astra 的 Computer Use。说是 AGI 的那层窗户纸。其实大家想想,如果这是 AGI 的那层窗户纸的话。那我们接下来 Agent 如果没有自己一个云端电脑。那它跟有云端电脑的 Agent 呢,它其实差这一代呢。但反过来呢,其实极大地增加了厂商的成本,早期的时候,大家我觉得为了抢用户就是免费送一送,但是后边有电脑跟没电脑的 Agent 呢,¶
其实从定价上其实也会有差距。¶
买它会。¶
好多问题,好几个了。¶
所以我还是要强调我的主张,我是建议大家都一定要去用一下有云端电脑的 Agent。我觉得用过的人跟没用过的人对这儿的认知,其实又是有一代的差异。而且我自己后边我会非常激进的去尝试一下方向。当然如果你不愿意把自己的一些东西放云端电脑上,其实还有别的选择。好像 Cursor 也出了一个跟 Grok Bot 类似的对标的一个版本的,它是面向企业的,它有个功能是可以把你自己的电脑托管成 Agent 的所谓控制的主机。总之这边理念就是你接下来我们要做的事情,一定要给你的 Agent 一个完整的、属于它的运行环境。在这种情况下给它分任务。它能完成的事情跟我们原来用一个 Claude Code。用一个 Codex 会差异非常大。¶
应该也是要往这方向。¶
是因为他们有云端的助手。他们是第一个吗?¶
之前卖那么贵不就是。¶
这判断还是挺厉害的。¶
Agent API:还需要自己维护一套 Harness 吗
偏 to B 一点吧,是不是?¶
你看它原来它没有 SDK,相当于它是对外的这种 Agent 一个调用的方式吗?其实大家现在用本地的,比如说它的 CLI,我整合到我自己的软件里面也都很好用。它开发东西是什么用途?Agent 是 API。¶
没仔细看过东西。¶
就大家知道 Claude Code 其实开了一个开,就本身原来 Claude Code 有一个应该叫 Claude Code Server 吧。介于 GUI、CLI,还有另外一个,CLI 和 GUI 背后,其实运行的也是靠,Claude 的 Codex,我口误了,Codex Server,就其实它相当于把,OpenAI 官方的 Agent 的 Harness 给你完全打包好了。相当于就是你任何一个团队或公司,你用它这套东西,你有一个现成的 Agent 的 Harness。你就直接就是,调 Agent 的 Harness 去完成 Agent 自己可以做的所有的事情的闭环,去做,其实你看上半年不是每个公司、每个团队都在撸自己的 Agent Harness 吗?就大家有没有发现,其实下半年开始慢慢东西我觉得要收敛了。一个收敛方向是像 OpenAI 这种发这种 Agent API,还有就是 DeepSeek Harness 其实也是一个,DeepSeek Harness 发出来,如果它稳定下来,在市场上会有共识的。也说有相当多的公司团队。会基于他的基础上再去做二次开发。¶
现在大家都,我觉得大家都是是一个壳,大家都只需要壳,核心的比如说那个 loop 循环那部分肯定是没人去写的,因为你肯定没有他们搞得好,还有那些模型适配的什么很难。所以我之前的选择是做个壳,只适配,比如说 Claude Code,对吧?那时候大家共识就是 Claude Code 嘛,但后来其实这部分任务它承担了很多就是 Agent 的套利的活动。哪个框架或者哪个渠道更便宜,它能力更好,那么你就得适配哪一个,所以你就看现在这些壳就出现一个什么问题,它所有都适配了,Cursor 也有,Grok 也有,Claude Code 也有。就但是就出现一个什么问题呢?这些不同的适配之间,你就会有非常多冗余的东西。因为很多东西都是你需要,你原来只需要管 Claude Code 这部分,比如说 Agent SDK,很多东西做得很好了,你就只管 UI,真的只管 UI 什么都不管。但后面的话,你会发现你得做一个 runtime 路由器,你得把用户输入的东西,路由到不同的 CLI 上,Agent 框架下,那时候你要做的东西多了,这些 Agent 的框架呢,它很多都只支持自己的 API 格式,比如说 Codex 支持 OpenAI 那套,Code 就是 Anthropic 那套,而 Cursor 什么都支持,¶
但是呢,又得重新做。¶
Cherry Studio 是不是就做了工作?¶
也是类似的,就他还会很火,因为他人很火。所以这部分东西我觉得你越做工作越多。越来越多,你又不可能说只适配一个,因为比如今天 Claude Code 不行了,大家都嘲讽他 A 畜什么的,可能过几天他又卡了,他又折腾起来了,他那个额度又多了,那你又得用。¶
所以我刚才说的就是意思,因为它越绑的越来越死,导致你的适配成本越来越高了。因为明显你要做,比如说你要让 Codex 或者 Claude Code 支持,各种各样的 Coding Plan,事情是最恶心的,因为各家都不一样。还有的就是也不是他故意做成那样,他就是在这方面不上心,在,比如在分发上,在 API 上,在返回的一些数据上他不上心,所以你就得费心去适配这些东西。还有刚才说的不同的 Agent 之间的切换,和模型的切换,还有那个。你的产品一定要有些独特的功能吧,也不是说我只能我就切了 Codex 了,切了 Codex,Codex 啥样我就啥样,完全没有变化,不可能的,你总会有一些历史债务在那儿,你要做还要做一些另外的适配。所以我觉得目前来看,这类型的产品会越来越难搞,会越来越难受。¶
那还有一点,Agent 的 Harness,原来我最简单的时候搭一个 loop 就跑起来了,现在会变得越来越复杂,往里边加的功能,这里边。¶
越来越复杂,就导致说东西复杂到一定程度,它要被封装起来,¶
看要出 V2 了。¶
你自己从零开始再去搭,其实已经过了这个阶段了。¶
封装起来。你开始再去搭,其实已经过阶段了。趋势是什么趋势?¶
Agent 服务会成为新的云基础设施吗
Agent Harness。¶
你也不用,不要以模型方式来调了,你就直接以服务来调就好了。¶
是因为过去一年大家把 Agent 当成产品来做了,其实 Agent 不是一个产品,是个技术。到后面的话,其实一个产品,比如说我们去看一些海外的这些个人 Agent 最近很火,他们其实都不告诉你什么模型了,对用户来说都一样,所以他就我只提供我的特殊的服务,背后那套 Agent 你不用管,你都不知道这是个 Agent,你不需要知道,这才是真正的产品化。¶
前两天我跟一个 Agent,就 AI 应用开发者聊天,我们就一起感叹,说整个上半年,大家都干了些啥?所有人其实都在做 Agent Harness,今天发现都没啥用,都白做了,都白折腾了。¶
都在学习吧,其实这是个学习。¶
这是个过程了,这是个过程。¶
几百个人是吧?¶
哇,几百个回复,歸藏也都回了。¶
每个人都做过一个,今天全给模型公司做实验了。¶
每个人都做过一个,类似套壳那种 Agent。¶
但就是大家一起在往前走的一个过程,那些所有做过 Harness 的人,他们可以加入 DeepSeek Harness,不是招 150 人吗?2 到 10 年工作经验,赶紧去。¶
因为大家的 Agent 其实能力上都差不多,你要发模型你肯定要补贴,那你补贴你肯定补贴自己的 Agent 上是比较合适的,因为你能做很多工作,包括刚才说的 DeepSeek Harness 的缓存的问题,还有他们自己的缓存问题,所以感觉现在确实是这样。¶
你看它这功能就是什么连接邮箱、日历、购物支付、健康,大家都可以做。¶
哪个没有。¶
没有。¶
垂直应用的价值:数据、接口与上下文
平台内 AI 助手:入口简单,体验才完整
所以其实你看软件已经没什么价值了,Agent 其实本身是个技术也没什么价值,有价值的最后还是服务,只有服务永远都有价值。¶
服务数据,接口和数据就是你说的服务。¶
你说的服务对吧?服务,都得到服务。¶
不稳定。¶
我说那你们为什么不做个 App 或者网站?他说,用户就是喜欢在联系列表,离不开列表。¶
所以很多人其实回到问题,就很多人其实不需要工作,没有工作,也不需要,真的没有用。¶
不需要一直折腾。¶
而且需要工作的人会越来越少的。不需要。¶
我也老用,我查游戏攻略经常。¶
对一样的,咱这儿一样的。¶
但是数据源不一样。¶
主要是图文能那啥,视频号很多东西不转不好转。¶
太准了,这你就不用看了,笔记图文都不用看了,自己把自己干掉。¶
比例非常重要。¶
关键平台特别敏感。稍微一有点自动化动作就给你封了。我们感觉 Agent 也聊差不多了,其实特别。其实还挺重要的,iPhone 出了那个 iPhone Duo。¶
对发布会原来我都是熬夜经常会熬夜看的,这一次好像也没有太关注。¶
这次我是看了,我之前是不熬夜,这次我特意看了一下。¶
iPhone Duo 发布:折叠屏与交互的新问题
都有几千万的播放吧。¶
所以你怎么看这个。¶
我们管叫 UX Porn。¶
就你看那每次说 iOS 更新,觉得就是时尚雕花对吧,每次更新点什么玻璃效果,面多了加水,水多了加面,玻璃加多了再调模糊点,模糊加多了再把玻璃调回来点。但是你看做到一旦做到说,比如说他要真做新东西了,他就开智了。iPhone Duo 上面的交互优化和一些新的适配的设计,非常的天才。¶
怎么说?¶
没有人考虑那些事儿。¶
没有人。永远都是很生硬地转一下,有一个白边,甚至还得闪一下,所以在这块就没人去管,还有适配。的问题,很多人适配什么呢?就国产很多,我们就说他适配一股脑的扔给厂商。你就按我比例重新改你 UI 吧,或者说你就或者我跟你合作,常见的那些 App,我去通过一些利益交换,通过一些方式,让你去用人力给我去适配一下。还是一种非常生硬的适配方式,他也他自己系统其实。但主要是我们对系统控制的问题。也做的很少,但是你看 iPhone 适配它就,但是它适配难度也高,它适配的东西也比较多,但它适配的成本是显而易见的,我觉得是比较低的,因为它考虑了整个界面的方式。他把就是天才设计,他把上面的把儿和下面把儿都放在右边,¶
不同折叠形态是吧?¶
三个图标做到一起了。¶
Wi-Fi 电量和信号的动画也很火。¶
动画也是上 1,000 万播放。¶
你如果光看图标,就会觉得很迷茫,这什么东西,怎么一个圈里边套个 Wi-Fi,下边还有四个点。但是当你看到动画那一刻起,你立刻就理解了,你不用看第二遍,你看第一遍你就能理解那三个图标到底什么意思,它就那个。电池变成一条线,围在 Wi-Fi 外面,下面的信号变成四个点,到那 Wi-Fi 的下面。¶
而且它的圆角刚好跟外边圆角是对上的,它的右上角,它能对上。¶
所以你刚才说词儿太对了,在交互设计 Porn。¶
真的是东西,你看着就很爽。¶
界面标准与长期一致性为什么重要
知道怎么做了是吧?¶
现在大家终于可以。¶
所以伟大的公司定义标准,就是这个意思是吧?¶
主要是你还能跟进标准。¶
哎呀,橘子太会吹了。¶
整个时代的一个介绍。¶
有希望成功的是吧?¶
真的是这样的。¶
我本来觉得 iPhone Air 挺好,这屏幕又大,手感超棒,我还想等二代呢,估计 iPhone 就出来以后,估计也就不会出了。¶
你说它特别薄是吧?¶
而且有说法说 iPhone Air 它做那么薄,也是给 Duo 提前做一些技术探索。¶
是的,去年确实好多人说,确实是这样。¶
这次也没提。¶
没有 memory 的东西。¶
是还在三年之前。¶
还在 2023 年之前的感觉。¶
但它毕竟还是消费电子公司,它并不是 AI 模型公司。¶
就他也不会轻易下手。¶
就根号二东西,定义标准,以后所有的执行都是标准。¶
根号二,那本,必须是根号二。但是你不觉得因为歸藏说问题,因为就这么多要适配,其实大家现在做软件都越来越潦草了,有没有发现?没有人去认真打磨精品了,因为社会节奏变得越来越快,原来我们会花一年两年时间去精修一个软件的交互,现在好像,也不适配无所谓了,厂商都无所谓了,的无所谓了。¶
现在,只有一家公司在做这件事情,就是谜底时钟。¶
那经常我用着国产软件,经常有点不到的情况,下不了单。¶
是我用一些国产银行的软件,返回不了,返回。¶
不只是国产银行,那些头部超级应用也经常是。我下不了单,我这么重要的,支付不了,不行。经常一个星期都修不了。¶
手表、录音与个人上下文
对手表 AI 是真的还是不错的。¶
我觉得就很多做录音笔录音卡的公司瑟瑟发抖。¶
它是个总结,只是有总结,没有,原文。¶
他不能逐字。¶
隐私保护。¶
他东西是本地处理的,本地把本地转录,而且它有一个特别好功能,你有一句话没听清楚,¶
你摁一下可以回放 15 秒,那 15 秒的所有的文本都给你写出来。比如说你去一个餐厅点餐,服务员给你说了 15 秒的话,你听不懂,你一摁,文本都出来了,你就可以后面可能有翻译什么的。¶
我一直觉得,录音这件事情,慢慢会成为社会默认的规则。现在我还要问你可不可以录一下,或者我录的时候别人表示不舒服,¶
录音可不可以?¶
那慢慢一定会往前推进。另外一个角度,你看人现在每天大家几乎所有人都 ADHD 了,因为你要处理的信息太多了,人的记忆怎么讲,某种记忆力会退化。越来越多的会依赖于这些电子设备帮我们做一些事情。我的 Apple Watch 已经好多代没有换过了,这次我打算可能因为这个去换一换、试一试。¶
5 秒,间隔 5 秒。¶
对 60 倍。¶
1 天一直在采集,非常,他应该,他不是说他们跟医院带。的东西比,精度已经差不多了。¶
那次官网还用就是骑行什么的,游泳什么都做广告。¶
家不是哪家,他说他统计 AI 分析的结果非常好,他就按结果去照做,他的整个深度睡眠时间都有大幅改善,我觉得这。种手表上收集的这种健康类数据还没有真正被好挖掘。¶
健康数据与日常记录:有用与隐私的边界
我现在只跑一个定时任务,ChatGPT Work 健康。因为我每次力量训练的时候,都会有一个文本记录。因为,我教练会记,他是一个就是那种我之前讲过事儿,他是那个。教练会记,他是一个就是那种我之前讲过这事,他是在我影响下用完用的比较多,他现在都就是 Agent 化了,我直接从那儿拉一个我的力量训练的结果,我的日常的有氧的一些结果全在 Apple Watch 上,包括力量训练消耗了多少,其实他也能看见。他就每个星期,睡眠很重要,每个星期他就会给一个报告,就看你关注的那几个指标,重点关注那几个指标有没有变化,比如说之前我老觉得自己的有鼻炎,是鼻炎的问题,头疼,后来发现不是鼻炎的问题。是颈椎的问题,是我坐的时间长我就会头疼,而不是说我鼻子有鼻炎就会头疼,所以他发现了很多类似的问题。就整个状态就是你个人的状态会变好,因为医生是不可能去看你那么多数据,¶
这么细。¶
去给你看那么多,而且医生他很多医生他不是通才,他也得查。所以在这些生活方式上,而且你说说白了你没病,你只是有一些不舒服,那你不值得去看医生也不会去管你这部分,但是每次的改变都是非常大的。因为刚才你说过阿福东西,我觉得这种生活类的 Agent 和上下文会越来越重要。工作确实是不是一个很重要的。¶
我们有个用户,他有个病得了十年了,看各种医生都没给他看出来。¶
我们有是他有适应。¶
就 AI 加健康。¶
但歸藏刚才其实说的闭环是,其实个人的数据,还是个人的 context。¶
的 context。¶
就我们就是逐步在扩大自己各种各样的 context,越多,AI 能帮上我们的就越多。¶
每半年换一个是吗?¶
没有,只要五百多块钱,还挺值的。¶
各家都不共享数据,都没有 API。¶
小院儿高墙都是。¶
但命运可能是一样的。¶
那以后更新也简单了,是不是。¶
我昨天听到一个播客说我们大厂内部赛马已经就是阶段性的告一段落了,开始跟竞争对手外部开战了,说后边这个。战场空间还很大。¶
而且国内大家比较统一。国内大家都不做 Coding,就上限太低了。¶
已经卷完了。1,000 万程序员没了。¶
1,000 万程序员,1 亿办公,对吧?¶
说到音乐我试了一下,我觉得好像音质上没什么大的变化。¶
V6 还是有问题,还是音质上还是有那个。¶
但要解决的不是编辑问题吗?¶
他解决的是他加了一个 Agent,是可以跟 Agent 有关联的,是啥呢?¶
是啥呢?¶
原来我们正常用 AI 生成音乐,你可能让它随机生成一首,或者是给它歌词生成一首,生成完以后改了以后,你必须自己编辑,或者到他 Studio 里编辑。¶
音乐与图像编辑:可控修改的进步与局限
他版本升级以后呢,加了一个 Agent,他 Studio 里边是可以用自然语言编辑的。¶
他音乐没有人跟他卷,所以他就慢慢走就好了。他已经是 SOTA 了吧,他跟 Midjourney 一样。¶
他不着急。¶
而且是必须开最高版会员才有这功能,才有 Agent。¶
他不着急。¶
但是你要提到,其实 GPT Image 2.5 也是,就版本也是其实是编辑能力增强。¶
Midjourney 2.5 也是。¶
大家身边人试了以后说,好像看不出任何区别。¶
它是这样的,它是。¶
其实没什么区别。¶
GPT Image 2.5 是可以做到就是绝对的,稳定,你不动的东西完全不动,一点都不动。之前不是有拿一个参考图,生成 1 个人,连续生成十多张,你会发现人都是会有轻微偏移的。¶
轻微偏移的,从这个版本开始。¶
从版本开始,你要说改你连续改十一版本,那别的东西一个像素都不带动的。¶
但他还是老问题,人是不动,别的东西伪影和破碎感会越来越强,越来越黄,老问题没有改,所以还是不能用。¶
会画一遍,很强。¶
美学上还是差,就美学上,对。¶
因为现在 3D 嘛,3D 图片的生成会更好。¶
它有个演示很好玩,让它画立方体,每一次编辑,立方体挪动多少角度,他原来你看那立方体在乱晃,因为他你在一个轴上移动,按理说他不会乱晃,¶
主要角度。¶
因为它你在一个轴上移动,按理说它不会乱晃,新的它是正常,它连起来,¶
但是它不能乱晃。¶
新的他是正常的。比如说连续编辑 60 次,你看起来像个视频,没动的。¶
它具备了一个说能预测下一帧能力,对它可以做视频了。¶
那不就能做视频吗?¶
因为它本来就能做视频,只是它不愿意做。¶
还有一个是我上周不是做了个 Skill 嘛,做图片 Skill,就做海报就是把旅行照片换成海报,之后就把想把这些东西就是他们都联系,¶
设计 Agent 为什么也需要执行环境
让我上到那些设计 Agent 上,那些设计 Agent,反正大家都知道那些。我发现就是这两边非常的就是我们常说用户的隔离在这种 Agent 上,垂类 Agent 的隔离依然。存在,很多 Agent 在上在设计 Agent 上它无法编码,它完全没有,它接的模型有编码能力,但是在它的 Agent 上完全没有编码能力。¶
就不让它编程自己处理了。¶
无法编程,比如说我其实用到了非常多的方式来保证它的效果。在排版的时候对吧,我要先写一个 HTML,HTML 只负责排版,文字的网格。¶
你想说的是,就有些 Agent 没有给你 runtime。¶
他限制了呢,他主动限制了编程能力,问题是你的。¶
安全吗?都不是为了安全,是它没做。这东西最基础的,你作为一个 Agent 的 loop。¶
都不是。没有给他环境。¶
无论你是在线的还是本地的,你有你编程是最基本的,他就不让你编程,他不让模型去编程。¶
我那里边有一堆参考图。¶
但是不是我们进展太快了,对于很多企业来说。¶
但是说我们进难。¶
prompt 加 AI,他们都认为这种最古老的、都不是 Agent 的方式解决了大部分问题。¶
to B 或者是一些传统企业,我觉得是就是可以被又回到问题了,是可以被原谅的或者怎么样,它速度是正常的。但是你作为 AI 公司,我觉得是不能被原谅的,包括我提示词里有很多图片提示词,就它会用到就是最终产物会用到四张图片,一段提一个提示词可能有一两千字吧,四张图片分别来自于原图,用前端生成的排版图,前端生成完了再截图,还有一张参考图,还有一个三张图片。是三张图片,这三张图片分别的来源是不同的,在排版参考就是参考图上,需要文件系统,我传上去发现图片能传,传上去了,Skill 也能传。我传上去发现图片能传,传上去了,Skill 也能传,打包上传去了,它调不了图片,就它知,我问它,你看你能看到文件夹下有参考图吗?它能看到,我说你调,我调不了。¶
你知道为啥吗?说你 Skill 其实是为 Claude Code 和 Codex 做的。¶
没有,长期记忆。¶
临时的是吗?对临时的。¶
每次你都不是一个,对临时的,每次都拉起来是另一个,而且不同的进程,不同的对话,拉起的。虚拟机也是不同的,所以你的上下文,没有持久化。¶
没有持久化。¶
临时环境与常驻电脑的区别
语音输入:准确率之外的使用摩擦
输入法现在大家还用语音输入法吗?¶
用。¶
用哪家?¶
我明白你的意思。¶
时候你就想卸载它,就不是说不想用它。¶
我就只想用语音,你连续打错四次的时候,你就想先把它卸了,你非常痛苦,你就非常愤怒。¶
输入法手感太重要了。¶
如果解决了,那他这次不可能就不用了。但你就很奇怪,你说这种基本功能为什么大厂做不出。¶
我不知道是成本原因,还是迭代速度太慢了。¶
那就是,那就管理或者是内容审查的问题。¶
肯定不是成本原因。¶
或者他觉得主力可能先做语音输入吧。¶
跳转是非常致命的,人是很难接受这种东西的。¶
长按鼠标出现,这么牛逼。¶
你在输入框里边儿,直接长按鼠标就可以输入了,就不用任何输入法。¶
好像很符合直觉,交互。¶
很符合直觉,但有点儿烦,那句话一直出现,说长按鼠标。有点儿烦,那句话一直出现,说长按鼠标。¶
还可以。¶
可以,我试试。¶
但其实都没有什么本质差异,大家都很不错。¶
就转写这方面大家都弄得不错的。¶
模型真的变笨了吗:体验、路由与评测
我个人比较感兴趣这个话题。因为我原来一直没搞清楚说。为什么一个模型刚上线时候就特别牛逼特别聪明。过了一段时间以后呢就会。变笨,大家都说降智了,经常遇到这种降智的,我说是怎么回事?是对于模型厂商来说,我理解,他肯定是要降本增效,用的人多了是不是要优化?那具体是怎么优化怎么做的?我在 X 上发了条帖子,评论最多点赞最多的这哥们儿给了四个手段,我不知道他是不是研究员。他说一般常见就是他给你路由到一个小模型,这是一种手段。你的如果问题非常简单,他就用特别简单模型给你处理。但是标准呢。也不是谁来定的,你觉得很重要问题,他给你路由到小模型,可能质量就变差了。第二个呢,他说有一个值叫 Juice 值,它能调控,也是社区逆向 GPT 发现的。比如说它刚上线 5.5,刚上线的时候呢,它好像就是值七百多。过了一段时间以后呢,它把它调到 120 多,低了 6 倍,所以它思考 Token,他思考 Token 就变少,所以就变笨了。还有说是提前别思考了,直接输出,这也会影响它结果。还有就是,你知道多 Token 预测,它会有多路的答案,它会调整概率,让小模型结果作为选中,它自己节省算力。我不知道从专业角度或者从。¶
我说说吧,其实我觉得,就有点阴谋论。我觉得有点阴谋论。首先就两个角度吧,第一是我个人,我其实很少有这种感受。如果你就是心里没有对厂商就是上来预设他就有原罪,我没有预设,我就很少有感受。我从厂商的角度说一下,这样的,反正我了解的绝大多数厂商哈,内部对于模型能,就内部对于模型能力的 eval,就评估,都是很严肃认真的。包括说我为了节省成本做量化,我要去做 eval,我要去做评估,偏离多少,稳定不稳定,这些事儿,大家都很严肃认真的。就大家对于自己的模型对外的口碑品牌,我觉得还是很严肃的,不会拿成本或速度质量去换。换口碑什么的。但是呢,另外一个角度是,就整个大模型行业,因为迭代非常快,就因为一个模型可能周期可能就一两个月,或者几个月,¶
或者会。¶
但是因为国内的感知会非常明显,国内很容易被降智。¶
我的账号都一直比较健康,反正我没有遇到,对我就说这几点吧。¶
用户的感知是真实的,比如说 Opus 4.6,其实是官方先降智的,当时亚马逊版本一直到现在都没有降智,就它比较贵,但是一直 AWS API 一直是很好效果,那官方在 Claude Code 版,其实降智很明显。面他们就方向也不往这走了。¶
我还是站厂商吧,我觉得有可能确实是 bug。¶
不是,不重要,它线下来说,其实是基本上就社区口碑现在比 Benchmark 准。不是不重要,它现象来说。¶
看大家真实使用。¶
我就是一周左右看大家的反馈,一个是就是主观的表达。还有一个就更客观的,利用率,adoption,看有没有人用,就没人用就甭说了。¶
我觉得他改也是因为口碑实在太差。¶
其实是我觉得这也说明一点吧,就说我们还在一个非常早期的阶段。模型稳定提供,延迟比较低,能用智商比较到位。你仔细去看今天的模型就很少。¶
就模型,一个模型生命周期就那么长时间,就干嘛花那么多心,就那么长?¶
还是我们上次说的,斩杀线之内的都没有意义。¶
对用户来说确实这么样,他们,自己可能有点儿。¶
Mistral、Kimi 与模型产品的不同选择
欧洲主权大模型。¶
我觉得他存在价值完全是欧洲需要一个,他有多好不重要。¶
都需要一个,它有多好不重。¶
其实现在是全世界就只有中国美国有能力做事,欧洲也就是对,不定欧洲那蒸馏谁的呢。¶
微调就可以了,他能力也不行。¶
那肯定不是。¶
各家都出了 Flash 模型,所以是要出个 Flash 模型的,¶
但是很奇怪的就是结果它不叫 Flash,按说正。¶
它不可能做成 Flash,它 1T 的,它怎么做 Flash。¶
不是 Flash 命名也很奇怪,到底是根据什么来命名的?为什么最近出了都是叫各种 Flash 模型。而且都是多模态的。¶
Flash 是最早是说快,这之前还说什么 Turbo 对吧,什么对,¶
Flash 是最早是说快,这什么 Turbo 对吧?¶
但是后来我觉得现在就变成了小尺寸旗舰。¶
Pro,Flash。¶
这怎么说?他最大的发明什么意思?¶
但是参数就是实际现在定位就是参数小。¶
它也不小。¶
那为啥都是因为新架构的原因使得变强吗?¶
新架构,500B,对,你像 500B 能到 300 Token 每秒。¶
我觉得跟后训练能力提升有关系,而且你会发现,中间周期非常短,你会发现突然就是大家突然就都掌握了很强的后训练技术。¶
那是为啥?¶
圈子里没有秘密,一家突破了,大家都是同学朋友,平时天天在一块儿吃。¶
大家周末一个 party 就全部都有了。¶
尺寸去做后训练好做吧。¶
不过中国是不是被逼出了很多黑科技,因为看。¶
你说这点我觉得特别同意,中国现在反倒因为算力不够,就逼出黑科技来。结果发现反向领先了。¶
但整体比如从模型角度来说,是不是还是落后个 4 到 6 个月,但是从一些比如前后训练的一些技术上。¶
而且这两家已经进入了拐点。用模型的智能训练模型。¶
对 ASI。¶
我们还没越过呢。¶
那不现在不都在这么说吗?¶
模型训练模型,因为很早之前不大家都在这么说吗?¶
所以从角度我觉得还挺吓人的,比如美国比你早的过奇点。¶
那就追不上了,这种是。¶
这其实挺吓人的。¶
就一旦过去就没有,机会了。¶
发表一大堆言论。¶
1.5 亿曝光¶
的发展是吧?¶
我是 23 年线下分享的时候,我的最后一页就是这么写的,因为我个人信仰就是 23 年就开始信仰五年之内 AGI 嘛,这是我的信仰。¶
五年之内 AGI 嘛,这是我的信仰。¶
我 PPT 最后一页就是接下来五年就珍惜和自己身边爱的人在一起的时光。因为五年之后会发生什么?就有两种可能,一种就是更美好了,一种就。没法描述了。¶
大家都以为是报告。¶
它推演了一下未来 5 年,AI 对世界 GDP 的影响。它说最乐观的情况可能是 GDP,sorry,GDP 会提升 30% 左右。但是白领的工资。是没啥变化的,只提升了 0.5%,蓝领的工资提升 30%,资本那一侧的收益率提升 80%。¶
那不跟现在一样吗?¶
资本只需要它和 AI 和机器人结合,不需要人,它就可以自己增长。¶
其实这两年也是,这两年就收益最大全都让资本拿走了。¶
我们的 GDP 什么的,全世界都在增长,但是生活上没什么变化。还有一个变化是什么呢?¶
从代码到实物:3D 打印带来的创作空间
不会操作。¶
以前是口喷创造数字世界里的作品,现在是口喷在物理世界里创造作品。¶
你有 3D 打印机就可以自己打个擎天柱了。¶
但我不知道他还原怎么样,反正至少模型看着还可以。¶
这个 Bar 就有,你打一个。¶
待会打一个。¶
可以一会儿试一下。¶
对这部分能做的事儿还挺多的,而且材料上的最近突破也比较大,所以越来越。¶
慢是有好处的吧,太快也不好。你看办公东西,它可能再过两年就没有办公东西了。¶
没有办不需要办公,办什么公,没有人需要办公。咱这机器人最近。¶
机器人怎么了?¶
基本就是代表一个阶段性的高潮吧。挤挤泡沫。¶
看看有没有其他补充。还有没有其他补充。¶
没有了吧,没有了,就这吧。¶
没有了吧,差不多。¶
就聊到这儿吧,已经饿了。¶
聊到这儿了,您饿了。¶
差不多吧,饿了。¶
聊的没有了吧,聊的。¶
感谢一下我们场地方。¶
上海 AGI Bar 致谢与收尾
感谢上海 AGI Bar,因为现在我们在上海 AGI Bar 录,北京也有,希望 AGI Bar 发展越来越好,全国都可以录,随便去哪都可以录。那今天 Next Token|词元之外第二期录制。Next Token|词元之外,第二期录制就到这儿为止,感谢大家的参与,谢谢。¶