DeepMind新任掌门坦白差距——并绘制重返前沿的路线图
Korey Carmichael Kabkuchoglu在Hassabis转任董事长后正式掌舵DeepMind。他在首次采访中毫不避讳地承认Google的模型落后于前沿水平,并押注于智能体工作流与统一的研产组织来缩小这一差距。
坦诚的第一步
科雷·卡迈克尔·卡布库奥卢没有丝毫退缩。
自接替戴米斯·哈萨比斯(Demis Hassabis)担任谷歌DeepMind日常运营负责人以来,他在首次采访中直面这一棘手现实并直言不讳。“市场对当前模型质量略逊于前沿水平的评估是公正的批评,“他在谷歌Release Notes YouTube频道说道。
这句话本身就值得密切关注。按照科技CEO的标准套路,一位刚完成交接的领导要么推诿,要么用空洞的信心来加码。卡布库奥卢两者都没做。他接受了这个前提,并在此基础上构建了整个战略表述。
“除了站上前沿巅峰,我们没有其他重要目标,“他说,“每一个决策、每一项研究优先事项、每一笔资源分配都只为实现这一目标。”
这种直白在一家过去两年一直努力应对与OpenAI乃至Anthropic之间日益扩大的认知差距的公司中显得非同寻常。这也表明卡布库奥卢——他从内部主导了谷歌TPU开发和长期AI投资——深知向前推进的唯一可信道路始于诚实面对自身的处境。
组织结构调整带来了什么
领导层的变动比头衔更重要。哈萨比斯转任董事长并非退休;他仍然是DeepMind的公众面孔和战略舵手。但卡布库奥卢现在坐在了运营机器的中心——他是决定哪些研究转化为产品、哪些产品反哺研究的那个人。
正是这种结构性变化,使得卡布库奥卢在这篇采访中花大量时间将Gemini 3.0之后的重组描述为一个已经完成转型的战略调整,而非进行中的工作。研究与产品已整合到同一个DeepMind架构之下。原先发表论文的研究实验室与负责产品发布的团队之间的旧有隔阂已被基本瓦解。
据称,由此产生的是一种此前不存在的反馈循环:用户与Gemini的互动现在直接流向AGI研究优先事项,而研究突破则能更快进入生产环节,因为两大职能之间不再存在组织壁垒。卡布库奥卢将其称为建立在谷歌生态系统之上的"数据飞轮”——这个听起来像企业黑话的短语,实际上描述的是一个具体可感的现实:搜索、YouTube、Gmail、Workspace和Android每天数十亿次互动所产生的训练信号,是OpenAI和Anthropic根本无法在同一规模上复制的。
押注代理智能
采访中或许最具分量的战略信号,是卡布库奥卢对DeepMind下一次突破来自何处的定位。
他将Gemini 3.0引发的范式转变描述为:单纯在一个模型上推高基准分数已不再是制胜之道。前沿正在转向他所谓的"代理式工作流”——系统不仅能回答问题,还能执行多步软件工程任务,并与用户协同完成高层级工作。
“随着AI代理开发过程中积累的研究成果和技术基础设施开始汇聚,动能正在加速,“他说。
这直接回应了当前的竞争格局。OpenAI在2024和2025年致力于构建GPT-5以及日益增强的代理能力。Anthropic则采取更为谨慎的路径推进Claude的发展。谷歌的应对策略是押注下一个有意义的飞跃并非来自扩展单一大型模型,而是通过构建能够将多种能力组合成自主、迭代工作流的系统来实现。
这也比单纯的规模扩张更具防御性。每个竞争对手都能购买GPU。但很少有公司拥有将代理式研究转化为复利优势的集成栈——芯片、云、模型、分发渠道和用户行为数据。
Gemini 4:谷歌最具雄心的项目
在产品方面,卡布库奥卢确认Gemini 4的预训练正按计划推进,并将其描述为"谷歌历史上最具雄心的项目”。他说,内部测试结果"令人鼓舞”。
这个词——“令人鼓舞"而非革命性或突破性的——值得关注。这是经过精心校准的表达。谷歌在释放信心的同时没有过度承诺,这与该行业常见的哗众取宠式发布形成了不同的修辞姿态。
采访还透露,谷歌正在双线并行:Gemini 4作为旗舰级研究推进,同时优化Flash模型系列以实现高效、低延迟部署。战略意图很明确——用Gemini 4抢占前沿,同时用Flash级模型扩大可触达市场,直接在成本和速度上展开竞争。
这符合谷歌的历史模式:主宰研究巅峰,然后通过基础设施和消费者触达实现变现。问题在于,差距是否已经拉大到这一套路无法像过去那样有效运作。
重新定义AGI
卡布库奥卢最具哲学意味的言论关乎AGI本身。他拒绝认为单一基准测试将宣告到来的那一刻。
“没有单一的权威测试或基准能够判定AGI是否已经实现,“他说,“AGI不是一个在某个时间点就能跨越的阈值。它是一个过程——用户能够信赖的协作智能的持续提升,用于应对高层级研究和日常问题。”
这是战略框架的选择,而不只是哲学思辨。如果AGI是一个由用户信任和任务完成度定义的移动靶,而非排行榜上的分数,那么谷歌的分布式生态将成为优势而非劣势。OpenAI可以赢下基准测试,谷歌则可以赢得数十亿用户在真实世界任务完成上的持续积累——前提是产品质量能跟上这一宣称。
谁赢谁输,接下来会发生什么
这一立场的即时赢家是谷歌的投资者。他们目睹DeepMind的相对地位不断下滑,而OpenAI缩小了差距,Anthropic则占据了可靠的中间地带。卡布库奥卢的诚实打破了谷歌在质量上领先的幻象,代之以一场至少让他们重回竞争的叙事。
输家是那些假设领导层变动只是象征性安排的人。卡布库奥卢现在掌握了前沿能力的盈亏责任,他的采访清楚地表明,他以紧迫感而非制度性谨慎来对待这一职责。
接下来会发生什么取决于三件事:Gemini 4的"令人鼓舞"的内部结果能否转化为外部可验证的性能;代理式工作流的押注是否能带来能力的跨越式提升而非渐进式改进;以及研究-产品飞轮是否真的能产生足够快的数据优势,来弥补可能已经相当大的差距。
这次采访本身就是一次战术上的精彩操作——承认差距建立了可信度,描绘清晰的前进路径保持了势头,将AGI重新定义为过程而非终点则为谷歌争取了执行的时间和空间。执行能否兑现,是任何新闻采访都无法回答的问题。