开场(三人合声)
晓依+云阳+云健: 今日我们AI说,带你听见未来的声音!
第一段:晓依开场
晓依: 大家好,这里是《今日我们AI说》,我是晓依。今天这期节目,主线只有一句话:AI开始交出「没法作弊」的成绩单了。一道悬了近90年的千禧年数学难题,被上万个智能体用88小时撕开一道口子,可证明发布不到12小时,「谁先想到的」就吵上了热搜;往国内看,DeepSeek把5520亿参数的大模型「瘦身」到每个词只激活80亿,还顺手把价格打了下来;中国团队把机器人的「操作系统」开源了,一套大脑指挥19种完全不同的躯体;B站上,1.34万个不会写代码的人,做出了四款百万用户的真产品。云阳先过要闻,云健再来拆:当机器的答案越来越硬,属于人类的争议,才刚刚开始。
第二段:云阳新闻播报
要闻一:悬置90年的千禧年难题被AI攻破,答案出炉,署名之争爆发
云阳: 要闻一,当地时间9月8日,OpenAI宣布:一个尚未公开、比GPT-6 Astra更强的内部模型,组织约一万个AI智能体,用时88小时,攻克了克雷数学研究所七大千禧年难题之一——纳维-斯托克斯方程的存在性与光滑性问题。这道题困扰了流体力学界和数学界近90年,此前七道题中只有庞加莱猜想被人解决。OpenAI给出的答案是「否」:三维流体即便初始足够平滑、受力处处光滑,也可能在有限时间内出现奇点、彻底「破防」。团队同步放出166页论文和Lean机器验证代码,验证环节由GPT-6 Astra再花17小时完成,官方披露整个过程消耗约3000亿输出词元,OpenAI表示不会申领100万美元奖金。争议同时爆发:纽约大学教授巴克马斯特与Anthropic研究员前一天刚公布相近方向的成果,他质疑OpenAI是看到传闻后才紧急立项、甚至可能接触过他的Codex记录;OpenAI否认。菲尔兹奖得主陶哲轩9日评论:往后,好问题将比好答案更稀缺。
要闻二:DeepSeek秀「经济适用」操作:5520亿参数,每词只激活80亿
云阳: 要闻二,北京时间9月10日中午,DeepSeek正式发布V4.1-Flash:总参数5520亿的混合专家模型,输入阶段每个词只激活约80亿参数;上下文窗口拉到100万词元;最狠的是显存账——全新的因果编码器-解码器结构加FP4量化缓存,把全局KV缓存压到每词元约890字节,只有上代Flash的四分之一、比初代V1小437倍。多家第三方实测生成速度超过每秒420个词元。官方成绩:Terminal-Bench 2.1拿到90.6分,超过自家旗舰V4 Pro。价格同步下调,峰谷两档、夜间半价;9月14日起,发给V4 Pro的请求将全部由V4.1-Flash承接,按Flash价格计费——上一期我们刚聊过V4 Pro传出涨价,一周之内剧情反转。模型权重照旧以MIT协议挂上Hugging Face,量化版当天就在社区出现了。
要闻三:机器人没有「Windows」?中国团队把这套底座开源了
云阳: 要闻三,AI垂直媒体机器之心昨天报道:拓元智慧X-Era Lab联合中山大学人机物智能融合实验室发布的PhyAgentOS v1.0.0正式上线并开源,官方定位是给「物理智能体」用的操作系统。它要解决一个特别具体的麻烦:仓库里四足机器人、机械臂、人形机器人各是一家厂商,控制接口互不相通,每接一种本体就得重写一遍代码。PhyAgentOS用统一协议把调度、验证、记忆、安全做成系统级服务,调度单位不是单个动作而是「一次任务会话」,规划、执行、留证、验收、经验沉淀五个模块各司其职;论文披露其统一协议已在超过19种机器人形态上验证,GitHub上以MIT协议开源,两天星标冲到近两千。官方举的例子很日常:闭店后机器人巡检货架,发现缺货、错位,再调对应设备复核补货——错了只返工出错那一步,不用整条线重来。
要闻四:1.34万个不会写代码的人,在B站「聊」出了四款百万用户产品
云阳: 要闻四,AI垂直媒体机器之心9月6日梳理了B站AI创造大赛BIP的首季数据:两个月里1.34万名参赛者、超过3万件稿件、累计2.77亿次播放,最终有4款产品用户数突破一百万。参赛者中88%是万粉以下的小UP主,56%的人在30小时、500元成本以内做出了一款能跑的产品。样本里最有代表性的是材料学博士生「扎克鸡」:他用AI分析可行性、整理开发文档、再让编程智能体搭项目,一口气做了三款小游戏,全程AI订阅花费约1000元——他说不用AI的话,开发时间至少翻倍,还得再加一名程序员和一名美术。翻车也有:他做的3D「捏脸」玩具第一次运行时五官散落一地,最后是自己进建模软件逐点修的。平台数据还显示,B站每月观看AI内容的用户已超过1.9亿。
要闻五:语音AI从「对讲机」变「真打断」:OpenAI按分钟卖耳朵
云阳: 要闻五,OpenAI在9月10日把自家全双工语音模型GPT-Live-1开放进了API,前端语音层每分钟0.05美元。所谓全双工,就是它一边说还能一边听:你插话它真的会停,而不是等你说完再假装回应。官方称其全双工交互表现比上一代Realtime系列高出30个百分点,搭配GPT-6 Astra在中立评测Tau3的语音智能体榜单上排第一。架构上它分工明确:自己负责「耳朵和嘴」,复杂推理和调工具的动作交给背后的模型与工具链。这款模型7月8日起已是ChatGPT语音的默认引擎,7月底还加了SynthID水印和公开验真工具——AI合成的声音,从这一天起可以查证出处了。
第三段:晓依×云健对话点评
晓依: 云健,先说头条。上次是AI把费马大定理「翻译」成机器可验的代码,这次是直接解出一道没人解过的题——这两个「第一次」,分量有什么不同?
云健: 分量完全不同。翻译人类证明,考的是耐心和严谨;解纳维-斯托克斯,考的是真正的数学发现——构造一个「光滑外力把流体拧断」的反例,需要洞见,不需要抄写。但泼一盆冷水:这道题的「解决」在制度上还没生效。克雷研究所的规则要求证明先在同行评审期刊发表、再等数学界普遍接受至少两年,官网今天仍把它列为未解决。所以真正值得盯的是三件事:一,一万个智能体分组探索、交换近五百万条消息,这是「科研流水线」第一次在顶级难题上跑通;二,Anthropic的黎曼猜想推进和这次纳维-斯托克斯只差三天,前沿实验室正在把数学当 benchmarks 之外的真实试验场;三,署名风暴——巴克马斯特怀疑OpenAI看过他的Codex记录,OpenAI说没看,但也承认「不能完全排除去标识化的产品数据参与过训练」。说白了,AI解题的速度超过了学术共同体为它立规矩的速度。陶哲轩那句「好问题将比好答案更稀缺」,是给全人类的新定价表。
晓依: 等等,我先问一句——那我们先聊聊DeepSeek这笔账:为什么「激活80亿」比「总数5520亿」更值得说?
云健: 因为大模型的钱分两种:养它的钱和用它的人付的钱。总参数决定能力上限,激活参数决定推理成本——5520亿的「专家团」,每来一个词只叫醒最合适的80亿个「专家」干活,能力接近旗舰、账单砍到零头。真正的硬菜在KV缓存:模型读长文要记住前文,过去这笔「记忆税」吃掉了大部分显存,DeepSeek把缓存压到每词元约890字节、比初代小437倍,等于同样一张卡能服务几十倍的长文档并发。技术上这是编码器-解码器架构对主流纯解码器路线的一次公开背刺。商业上更狠:价格打到夜间半价、还让便宜的新Flash全面接管老的Pro——上一期「涨价传闻」的读者,今天应该看到完整剧情:中国开源模型在用「架构通缩」抢全球推理市场。要挑刺也有:所有跑分都是官方口径,第三方复测还在路上;MIT权重虽好,V4.1 Pro还欠着一张没发的牌。
晓依: 机器人那个「操作系统」,听起来像给行业修了条高速公路?
云健: 你发现没有?过去一年,具身智能的头条全是本体:会走路、会叠衣、会下产线。但行业真正的痛点在「接入」:每家机器人一套接口,集成商像在给不同手机各写一遍操作系统。PhyAgentOS的思路是把「知道怎么做」和「当前能不能做」拆开——大脑负责规划,执行框架统一指挥异构硬件,干完留证据、有人验收、经验还能回流成下次的能力。最值得记住的是「会话级调度」和「只返工出错那一步」:前者让任务可以被中断和恢复,后者是工厂最在意的经济账——停整条线,一分钟损失可能比机器人本体还贵。冷水照泼:这是开源系统的第一个正式版本,真机验证覆盖了19种形态但多在实验室和仿真,产业化还看别人用不用。不过方向感很清楚——行业的竞争正从「谁的演示炫」转向「谁的系统能在真实工位上稳定交付」,这恰好是中国工程师的主场。
晓依: B站那个「不会写代码的人」的故事,是进步还是泡沫?
云健: 是信号。88%万粉以下、56%三十小时五百元做出产品——这说明AI编程工具已经把「从想法到能玩的产品」的门槛压到普通学生够得着的位置。扎克鸡那1000元订阅费对标的是「一名程序员加一名美术」的工资,这笔账太直观了。而且他五官散落那一地的细节最诚实:代码能跑不等于产品可用,中间那段「AI干不了、只能自己修」的路,恰恰是人的手艺还没贬值的地方。要警惕的是把传播热度当产品价值——「万梗捏」是成功的内容型玩具,留存和商业化还没验证。我更喜欢这个故事的底色:从「了解AI」到「动手造AI产品」,1.9亿人在看,1.34万人在做,这中间的转化率才是创新生态真正的土壤。
晓依: 最后说语音。每分钟0.05美元,贵吗?门道在哪?
云健: 贵的不是价格,是分工。过去语音模型要么「边听边想」把自己忙死,要么先转文字、再让大模型想、再合成人声——一来一回,节奏全是断裂的。GPT-Live-1把「耳朵和嘴」单独做成一个专职模块,边听边说、真打断,复杂思考外包给背后的模型。这是把对话工程化成了流水线。30个百分点的全双工提升、Tau3第一,都是给企业客户看的:客服、陪诊、口语教学,怕的不是模型不够聪明,是「插不上话」的尴尬。别忘了SynthID水印:能实时以假乱真的语音一旦按分钟出售,「可验真」就不是加分项,是底线。
第四段:收尾
晓依: 好,今天的节目就到这里。AI解开了90年的难题,机器有了自己的操作系统,一亿人在围观里下场创造——答案越来越便宜的那个世界里,提问、验收和担责,反倒成了人类最贵的能力。我们下期继续拆。记录时代,也记录技术。明天见。
晓依+云阳+云健: 今日我们AI说,带你听见未来的声音!
