轮到谷歌踩油门了!Gemini 4泄漏、TPU上天、工程师因「太快」辞职

栏目:互联网 | 来源:量子位 | 2026-09-26 21:38

田晏林 发自 凹非寺
量子位 | 公众号 QbitAI

Gemini 4这两天,真的快被社媒漏成筛子了。

新检查点、新作品、新对比图,一茬接一茬往外冒。

就在刚刚,Lumina又放出了一组挺有节目效果的测试:

同一道「鹈鹕骑自行车」,Gemini 4 Pro前后两个检查点,直接画出了两种完全不同的风格。

Checkpoint 1走的是鲜艳卡通风;Checkpoint 2则明显更克制,像一张机械结构草图。

两个检查点放在一起,已经能明显看出后训练留下的痕迹:线条、结构、细节处理都在变。模型能力已经肉眼可见地往前蹿了一截。

而这,已经数不清是Arena里,冒出的第几个疑似Gemini 4 Pro的新检查点了。

社区这边还在疯狂扒细节,谷歌自己也不藏了。

本周,谷歌DeepMind新掌门Koray Kavukcuoglu首次对媒体确认:Gemini 4已经进入后训练早期。

图源Information

而且他的目标,是尽快发。

我们看到了效果,感到非常兴奋,接下来还会继续以快速迭代的方式推进工作。

好家伙。合着一轮轮冒出的checkpoint是给Gemini 4提前热场呢?

反正听Koray的语气,主打一个:能早发,绝不晚发。

而且这次提速的,还不只是模型。谷歌还准备把TPU芯片送上太空。

新项目即将启动原型测试,连AI算力基础设施都开始往地球之外伸。

Gemini 4,进入冲刺阶段

大家这么盯着Gemini 4,也不奇怪。

毕竟从上一代旗舰模型Gemini 3走到现在,谷歌中间没少折腾。

原本按计划,今年6月应该先等来Gemini 3.5 Pro。谷歌CEO劈柴哥甚至在5月I/O开发者大会上提前预告过。

结果,没发。

中间虽然陆续更新了Gemini 3.1和几款Flash型号,但3.5 Pro一直没有正式亮相。

Koray这次也解释,团队中途选择「稍微暂缓一下」,先把精力放到Flash系列。

而现在,节奏明显又变了。

Koray明确说,要在尽可能短的时间内,实现最大的学习速度。

听话听音。这几乎把谷歌现在的打法挑明了。

虽然没有明确说谷歌是否正式取消了Gemini 3.5 Pro项目,但可以肯定的是,团队已经将全部注意力转向Gemini 4。

Gemini 3.5 Pro可以先放一放,但Gemini 4的训练、测试、反馈和再迭代,必须尽快一轮接一轮跑起来。

为此,谷歌已经开始同步搭建Gemini 4的内部安全保障和测试流程。目前这套机制已经先在内部AI编码工具上跑起来了。

这时候再看最近Arena里冒出来的疑似Gemini 4检查点,就更有意思了。

Lumina最新放出的「鹈鹕骑自行车」,大家的讨论中心已经从「哪个检查点更好」,变成了「Gemini 4到底追到哪一步了?」

有人直接喊出:Gemini is back in the game,认为如果这些检查点真实,谷歌正在快速缩小与OpenAI /Anthropic的差距。

也有人觉得它现在无法和GPT-6 SOL正面硬刚,和Anthropic今年春季推出、近期又完成升级的Mythos系列相比,也谈不上占尽优势。

面对质疑,Koray倒是相当有自信。

我对这个团队充满信心。我们肯定会一直处于前沿位置。

今年8月,哈萨比斯卸下Google DeepMind日常管理工作后,Koray正式接手这块业务,同时继续担任谷歌首席AI架构师。

Gemini接下来怎么跑、跑多快,Koray就是现在最关键的拍板人之一。

反正人家的话已经放这儿了,接下来就看Gemini 4自己能不能接住吧。

挑战英伟达,TPU首次上太空

如果只看Gemini 4,很容易以为谷歌这轮只是模型团队又开始加速。

其实更夸张的是,连算力都开始同步踩油门了。

Koray最近明确提到,DeepMind的前沿模型研发,现在也在直接「反哺」谷歌自己的硬件业务。

以前,TPU主要藏在Google Cloud后面,客户买的是云服务。但现在,谷歌开始直接卖TPU芯片了!

目标相当明确,挑战英伟达。

而且模型团队和芯片团队之间,也开始越绑越紧。

DeepMind做下一代模型时产生的新需求,会提前反馈给硬件工程师,让他们规划未来两到三代TPU。

模型:兄弟,我下一轮又准备吃✕✕算力了。
芯片:收到,现在开始造。

谷歌正与美国商业卫星公司Planet合作,计划通过SpaceX猎鹰9号发射原型卫星,其中将搭载4颗TPU,测试其在轨运行能力。

项目名叫「Project Suncatcher」。

想法也非常谷歌:既然地面AI数据中心又吃电、又占地、还需要大量水冷,那能不能干脆把一部分机器学习基础设施,搬到太阳能更充足的轨道上?

不过目前还只是第一步。

太空里没法像地面数据中心那样靠空气对流散热,芯片连续高负载运行会很快碰到热管理问题。

按照方案,芯片在太空中大约可以运行15分钟,之后就需要关闭以冷却。

所以这次更像是在验证一件事:TPU到底能不能先在轨道上活下来、跑起来。

至于真正把几十颗卫星用激光连成网络,变成「太空AI数据中心」,那还是后话。

别人还在抢数据中心机房,谷歌已经开始琢磨天上的地皮了。

然而就在谷歌上下都在喊加速的时候,团队有人撂挑子不干了。

前Mozilla工程师、后来加入DeepMind的Robert O’Callahan,昨天宣布辞职。

理由竟不是嫌弃谷歌AI发展太慢,而是「太快了」?

Robert不直接训练模型,而是负责的是硬件芯片设计工具。

但做着做着,他发现这些工具会加快下一代AI芯片设计,进一步降低AI的成本和延迟。

在他看来,这意味着,人工智能将变得更加便宜、高效,从而更加普及,也更加强大。

Robert和DeepMind的同事们聊过AI风险,几乎所有人都对此深感担忧,只是很多人没有公开表达。

而且,Koray并没有停下来的意思,甚至觉得「还得再快」。

Robert起初也没想直接走人,毕竟薪酬颇丰。他只想换去一个完全不加速AI的工程岗位。

但受限于自己所在地区和岗位选择,这条路最后也没走通。

One more thing

检查点狂冒、TPU上天、工程师离职。这些事放在这一周看,多少有点黑色幽默。

想当初,Gemini 3的表现曾让OpenAI进入「红色警戒」,但谷歌自己随后却在旗舰节奏上慢了半拍。

如今,Koray带队,选择重新加速,并把学习速度拉到最大。并且,不是某一个产品线提速,模型、芯片、组织节奏,全都开始往前压。

谷歌:确实等不起了。

[1]https://x.com/LuminaBench/status/2103523411645362667

[2]https://x.com/maxt3chno/status/2103597397691523088

[3]https://www.theinformation.com/articles/google-nears-release-flagship-gemini-4-ai-model?rc=zbvmxs

[4]https://x.com/Google/status/2103229008343126519

[5]https://x.com/rocallahan/status/2103368176369324093

了解更多

猜你想看

← 返回首页