这期有个产品教训特别值得记。声音克隆现在已经是常规功能,但把它放进一个随身陪伴设备里就变得很怪——评测者说:我不懂普通话,也不懂马来语,却听到自己的声音在说普通话和马来语。
有报道称 xAI 未来会花掉约 47 亿美元,每月约 10 亿,主要用于建数据中心,以及升级此前那个在极短时间内建成的集群。
有个数字当时看着有点奇怪:升级要花 20 亿,其中光一套冷水循环系统就要 20 亿。新一轮融资之后,xAI 的薪资据说涨了四倍。这些数字后来陆续有辟谣,但量级本身反映了那个阶段的烧钱节奏。
有个研究思路很绕但结论有用:把模型推理过程中的概率分布,直接当作强化学习的奖励信号,用它来做持续的自我训练——所谓 RLIF(来自内部反馈的强化学习)。
听起来像左脚踩右脚——用你自己来训你自己。但结论确实有效。
合理的解释是:模型在预训练时已经学到了非常多的知识,只是这些知识需要被「暴露」出来。自我确定性、自我一致性这类方法就是暴露手段——知识本来就在,只是没被调用到下游任务上。
Claude 4 发布时强调它能连续工作好几个小时。第一反应是纳闷:我们自己搭的 agent 不也能一直跑吗,让它跑到天荒地老都行。
但这个疑问本身问错了。关键不是「能跑多久」,而是「跑那么久之后产出是否还有效」——绝大多数 agent 跑着跑着就偏了、就散了,时长不等于有效工作时长。
一篇长评把问题说得很具体。第一是过热:号称可穿戴,实际用十几分钟就烫;后续几次软件更新有所缓解,续航也好了一点。
第二是功能形同虚设:它有语音认证和个人认证,还配了激光摄像头——要用另一只手在光斑上写解锁码。评测者说了半天,结论是「我对这个功能有兴趣,但我始终没能把它激活。」
第三条最值得记:它能克隆你的声音。这功能本身已经很常规——说几句话就能学会你的说话风格。
但把它放进一个整天挂在你身上、随时跟你说话的陪伴设备里,就非常怪。评测者的原话是:更怪的是,我不懂普通话,也不懂马来语,却听到自己的声音在说普通话和马来语。
做陪伴类产品,「它是另一个存在」这件事本身可能就是产品的一部分——把它变成你自己,反而破坏了陪伴。