开场(三人合声)
晓依+云阳+云健: 今日我们AI说,带你听见未来的声音!
第一段:晓依开场
晓依: 大家好,这里是《今日我们AI说》,我是晓依。今天这期节目,主角是一连串的「拆开」和「分开」。一位参与发明ChatGPT的研究者,从语言模型里拆了出来——他新发布的模型一个字都不写,只做决策;字节跳动把AI制药业务从大厂里拆出去,独立拿下2.9亿美元融资;蚂蚁把一个会「边说边听」的全双工模型静悄悄放上开源社区,发布会、API、定价,全部分开了;地平线早年孵化的芯片公司融到4亿美元,而造机器人「大脑」的初创说,这个行业最缺的不是身体,是脑子。身体在量产,脑子还在等它自己的时刻——先请云阳过一遍要闻,再请云健逐条拆解。
第二段:云阳新闻播报
要闻一:ChatGPT联合发明人拆出「不说话」的模型:一个字不写,专替软件做决定
云阳: 要闻一,9月15日,初创公司TypeSafe AI发布了一个叫Jev的模型,创始人迪奥戈·阿尔梅达曾在OpenAI从事指令微调研究、参与做出RLHF——也就是用人类反馈训练模型「好好听话」的那套方法,本人常被业内称作ChatGPT的联合发明人之一。美国科技媒体TechCrunch在18日的报道里说,开发者对这个产品的热情到了把公司API挤瘫的地步。Jev怪在哪?它不生成文本。你喂给它程序状态和一组「类型化的问题」——比如这张工单归哪个部门、紧急度打几分——它一次性返回每个选项的概率。公司管这叫「系统一模型」,借的是诺贝尔经济学奖得主卡尼曼的说法:人类有快直觉(系统一)和慢思考(系统二),大模型练的是慢思考的聊天功夫,而软件里海量的小决定,要的是快、稳、便宜。训练方法叫RLCD——校准决策强化学习:RLHF优化的是「人爱听」,RLCD优化的是「报出的概率要诚实」——模型说八成把握,十次里就得对八次。官方称同类任务上它比对标模型快20到200倍、便宜40到400倍(官方口径,待第三方复测),架构和训练细节尚未公开。
要闻二:字节把AI制药「放单飞」:首轮融资2.9亿美元,第一款药还没进人体
云阳: 要闻二,9月16日,据路透社援引知情人士报道,字节跳动把内部AI制药业务拆分成独立公司「新生探途」(Anew Labs),完成拆分后首轮外部融资2.9亿美元,投后估值约15亿美元,红杉中国、IDG资本、五源资本等入股,字节保留56%股份、仍是控股股东。新浪科技援引报道称公司7月刚在上海成立,核心团队约50人。技术家底是团队2021年起攒下的:分子结构预测模型Protenix已迭代到第二代,还有蛋白结合剂设计工具PXDesign。进度最快的管线是一款IL-17小分子抑制剂——IL-17是一类和银屑病等自身免疫病相关的蛋白靶点——公司称这是全球首个覆盖整个IL-17家族的「全谱」小分子抑制剂(公司口径),目前处于IND申报准备阶段,也就是还在为新药临床试验申请备材料,一步都还没进人体。9月17日,公司又发布了把结构预测、分子设计和实验反馈串在一起的AnewDDE技术报告。
要闻三:给机器人造芯片的公司融了4亿美元:芯片卖了800万片,脑子从哪来还没答案
云阳: 要闻三,9月17日,地瓜机器人宣布完成4亿美元C轮融资,未来资产领投,美团战投与合肥国投等地方国资跟投,高瓴创投、五源资本等老股东加码,电子工程专辑与多家财经媒体报道了此事。这家公司的来历值得交代一句:它是从地平线机器人事业部拆分出来的,2024年初独立运作。官方口径显示,其旭日系列芯片累计出货突破800万片;面向具身智能的大算力芯片旭日S600,发布半年被20多家客户采用,包括自变量机器人、优必选、北京人形机器人创新中心等。我们9月16日那期讲过第1500万颗征程芯片装上一汽-大众——车载智驾这条线拼的是车规与十年寿命;机器人这条线,芯片这一环正在补上量产拼图,但下一段新闻会告诉你,真正卡脖子的是另一样东西。
要闻四:蚂蚁静悄悄开源一个「边说边听」的模型:不发发布会,只放权重
云阳: 要闻四,9月12日,一篇署名蚂蚁集团InclusionAI实验室与清华合作的技术报告挂上arXiv:Realtime-Venus,两个各9B参数的模型,一个管音视频、一个管纯语音。核心能力是「全双工」——模型一边说话,耳朵一边不关门:你说「嗯」表示在听,它不停;你真打断,它让出话头;你中途改口,它会修改还没说出口的后半句。另一特点是「异步委托」:前台对话继续,后台任务框架去跑查资料、调工具的重活,跑完把结果接回正在进行的对话里。论文报告它在八项视频理解基准中六项拿到在线模型最高分(作者自测,未经第三方复现),模型以Apache 2.0协议把权重放上Hugging Face。有意思的是它没带的东西:没有发布会、没有API、没有定价。这是蚂蚁的Venus系第二次「仓库先行、公告后补」——8月底GUI智能体模型UI-Venus-2-9B也是这么悄悄上线的。9月12日那期我们聊过OpenAI把全双工语音按分钟卖,这条是同一赛道的中国开源选手。
要闻五:「机器人大脑」的ChatGPT时刻会在2027年年中吗?一家中国初创的首席科学家画了时间表
云阳: 要闻五,路透社18日在北京专访了自变量机器人的联合创始人兼首席科学家、清华大学助理教授高阳,他给出的判断是:人形机器人的「大脑」——决定机器聪明程度的基础模型——最快可能在2027年年中迎来类似GPT-3.0那样的能力拐点,卡点不在硬件,在训练数据不够。他说中国机器人硬件已经能跑、能跳、翻跟头,「大脑确实是整个机器人栈里最弱的一环」。他给的路线是:未来一到两年是工业应用的初始窗口,两年后能看到机器人在商业服务场景做简单活,进家庭则至少还要再等八年,拧瓶盖这类精细动作和没见过的任务仍会难住机器。公司称其机器人在结构化客厅环境的简单任务上成功率已达90%(官方口径,待第三方复测);自变量成立两年来融资超6.7亿美元,估值约200亿元人民币,几十台轮式人形机器人已进宁德时代和京东的产线。还有个反直觉的细节:与许多同行押仿真不同,这家公司主要靠真实世界的数据训练——全国约一千名采集员穿戴设备在家里、工厂里重复日常动作,他们发现动作五花八门的「脏数据」比精修过的标准动作更能让模型长进。身体越来越便宜,脑子越来越金贵。9月14日那期我们讲过优必选万台级人形工厂投产、整机两年降价七成——那边的产线刚开足马力,这边的首席科学家说,最弱的环节还不在产线上。
第三段:晓依×云健对话点评
晓依: 云健,先拆那个不写字的模型。一个大模型连一句话都不说,怎么反而让开发者挤破了门?
云健: 因为它解决的是企业软件里最烦人的一类活:调用、判断、分岔。你用聊天模型做决策,流程是发一段提示、收一段文本、解析、校验、失败了重试——「JSON解析失败」是每个后端工程师的噩梦。Jev这类模型把文本生成整个砍掉,输出天生就是合法的、带概率的结构,50%把握它就明说50%,你可以定「低于八成转人工」这种规矩。说白了,它赌的不是「更聪明」,是「可嵌进代码」。要泼的冷水也清楚:对比基准是公司自己搭的,参照答案取的是两家旗舰模型的平均输出,考纲和判卷都在人家手里,六成分数先别当行业结论。
晓依: 那从Jev回到制药。字节控股56%、估值15亿美元,第一款药却连人体试验的门还没进——这笔钱到底在买什么?
云健: 买的是把「算出来的分子」推进到「身体里有效的药」的那段最贵、最九死一生的路。AI把靶点筛选、分子设计这一段提速了,但行业账本没变:一款新药平均十年、十几亿美元,越往后淘汰越狠。拆分独立、大厂控股、医药资本进场,这个结构是给长周期业务配的氧气瓶——药没收入,钱要先续上。所以这轮融资的看点不是估值,是两年内IL-17那条管线能不能拿到临床许可:模型的分数可以自报,人体的数据不行。
晓依: 芯片卖到800万片,融资4亿美元,机器人这条供应链是不是已经稳了?
云健: 云阳在播报里那句「卡脖子的是另一样东西」就是答案。你发现没有?三条新闻摆在一起正好是机器人产业的一张解剖图:地瓜管「小脑和神经」——让机器在本地跑得动;优必选的工厂管「身体」——万台级、价格腰斩再腰斩;而高阳说「大脑」还要等。端侧芯片拼的是车规式苦功,十年寿命、百万分之一缺陷率,这条路中国厂商走通了;数据这条路还没人走通。
晓依: 高阳说大脑的瓶颈是训练数据,具体缺的是什么数据?
云健: 缺的不是网上那种图文,是「机器人真手真脚干活、还带着失败」的记录。语言模型有整个互联网当教材,机器人只有各家实验室几万条遥操作轨迹,量级差几个数量级;而且成功轨迹只教「怎么做对」,失败轨迹才教「什么会错」,后者更稀缺。这也是为什么上一条新闻里的仿真平台、为什么各家把「数据回流」写进融资用途——现在行业的共识是,谁先把真实场景的数据飞轮转起来,谁才有资格谈2027年那个时刻。时间表嘛,业内画饼居多,听方向就好。
晓依: 最后说蚂蚁这个连发布会都不开的开源。不公告、不定价,是低调还是留后手?
云健: 讲真,两种读法都成立,但仓库本身的信息量比公告大。全双工这件事,OpenAI走的是按分钟收费的API路线,蚂蚁把9B权重按Apache 2.0扔进社区——同一个能力,两种生意。对个人开发者,能在本地跑一个「你插话真会停」的语音模型,这在过去只有巨头云端有;对蚂蚁,先立技术名声、商业形态看后面,也符合它这一年「论文和仓库先走」的习惯。值得盯的是第三方复测:论文自测的六项第一,得有人拿同一套题在外面重跑一遍才算数。
第四段:收尾
晓依: 好,今天的节目就到这里。一位ChatGPT的缔造者把模型拆到「一个字都不写」,换来了可嵌进软件的确定性;字节把制药拆出去单飞,让算法去接受人体的复检;蚂蚁不发公告先放权重,把全双工语音卷进开源竞争;地瓜把芯片卖到800万片,而行业说大脑还缺数据。拆开,是为了各自跑更快。记录时代,也记录技术。明天见。
晓依+云阳+云健: 今日我们AI说,带你听见未来的声音!
