谷歌 DeepMind 新领导层打破了沉默。 Koray Kavukcuoglu 在 8 月份 Demis Hassabis 下台后接管了该实验室,周三他在 The Information 的 AI Agenda Live Summit 上首次以 Google DeepMind 负责人的身份出现在媒体面前,并确认该公司的下一个旗舰模型 Gemini 4 正处于后期训练的早期阶段,即基础模型经过完善以使其表现可靠的阶段。
Kavukcuoglu 在峰会上发表讲话时表示,他希望比今年年底“早得多”发布 Gemini 4。根据 The Decoder 的一份报告,他表示:“我们的目的是 [...] 尽快 [...] 发布早期的训练后输出,因为我们看到了结果并且感到很兴奋。”随后将进行快速迭代,谷歌仍在致力于保障措施和安全测试。 更多相关背景,请参阅我们的AI新闻。
工程师已经在内部使用 Gemini 4
该模型不仅仅是一个实验室实验。 Kavukcuoglu 透露,谷歌工程师已经在内部使用 Gemini 4 作为公司的编码工具 Antigravity,这是一个早期信号,表明该模型的代理编码功能已经足够在谷歌内部的生产工作流程中发挥作用。
Gemini 4将是谷歌继去年底推出Gemini 3之后的首款新旗舰机型。此后,该公司在二月份发布了 Gemini 3.1 更新以及一系列更小、更便宜的 Flash 型号。
Gemini 3.5 Pro 的失败笼罩在发布上
Gemini 4 的预备阶段承载着已消失的前任的包袱。首席执行官 Sundar Pichai 在 5 月份的 Google I/O 大会上宣布 Gemini 3.5 Pro 将于 6 月份发布,但该型号从未上市。据英国《金融时报》报道,该项目错过了三个最后期限。
Kavukcuoglu没有透露Gemini 3.5 Pro是否已被正式取消,但承认谷歌“稍微后退了一步”。 “对我们来说,重要的是最大限度地提高当时的学习速度,”他解释道。
这次暂停让谷歌付出了代价。与此同时,竞争对手也取得了进展:Anthropic 在春季发布了 Mythos/Fable 系列,并于本月与 Opus 系列一起进行了更新,而 OpenAI 自 9 月初以来一直在推出 GPT-6 模型。根据 The Decoder 的评估,所有这些模型的能力都比谷歌当前的顶级模型要强大得多。
卡武克措格鲁说他并不担心。他形容自己“百分百自信”,并对他的“极其强大的团队”表示信任。 “在我看来,我们肯定永远处于前沿,”他说。
谷歌之前已经迎头赶上。 Gemini 3 是一次飞跃,据报道 OpenAI 宣布了“红色代码”,直到 GPT-5.2 才再次拉平。 Gemini 4 能否重复这一壮举仍然是一个悬而未决的问题。
AGI“不是正确的对话”
与时间线一样具有启发意义的是新任首席执行官对 AGI 的评价,AGI 是 DeepMind 十多年来的目标。卡武克措格鲁说:“谈论我们是否实现了通用人工智能并不是正确的话题。” “对话更多的是关于我们是否能够构建我们可以信任的智能代理?”
对于一个实验室来说,这是一个引人注目的转变,而就在几周前,该实验室的联合创始人还显得非常不同。哈萨比斯在辞去首席执行官职务时在告别备忘录中写道:“我一生都在为通用人工智能而努力,现在,像你们中的许多人一样,我觉得它已经近在咫尺。”哈萨比斯现在担任该部门的主席并担任 Alphabet 的首席科学家,而前公司首席技术官 Kavukcuoglu 则负责日常运营。
重组是深入的。据 The Decoder 报道,Gemini 的所有开发工作都将转移到湾区,远离赋予 DeepMind 身份的伦敦总部。 “DeepMind 作为独立演员的时代已经结束,”谷歌前高管告诉卫报。英国《金融时报》报道称,高管们对哈萨比斯忽视商业需求感到沮丧,并以他公开发布 AlphaFold 的决定为例。
芯片连接
该模型工作满足了谷歌不断增长的硬件野心。该公司今年开始直接向客户销售 TPU,使其与 Nvidia 的竞争更加激烈。 Kavukcuoglu 表示,新模型向硬件工程师展示了如何设计“未来两代或三代”芯片,这是一个将谷歌模型路线图与其数据中心经济直接联系起来的反馈循环。
目前,DeepMind 新领导层传达的信息很简单:少谈论 AGI 里程碑,多谈论出货量。 Gemini 4 是否如承诺的那样比年底“早得多”到来,将是对重组后的实验室能否按照竞争对手设定的速度前进的第一个真正考验。
---
掌握AI最新动态获取最新的AI新闻、分析和突破——尽在一处。
阅读更多AI新闻 →