田晏林 发自 凹非寺
量子位 | 公众号 QbitAI
Gemini 4这两天,真的快被社媒漏成筛子了。
新检查点、新作品、新对比图,一茬接一茬往外冒。
就在刚刚,Lumina又放出了一组挺有节目效果的测试:
同一道「鹈鹕骑自行车」,Gemini 4 Pro前后两个检查点,直接画出了两种完全不同的风格。
![]()
Checkpoint 1走的是鲜艳卡通风;Checkpoint 2则明显更克制,像一张机械结构草图。
两个检查点放在一起,已经能明显看出后训练留下的痕迹:线条、结构、细节处理都在变。模型能力已经肉眼可见地往前蹿了一截。
而这,已经数不清是Arena里,冒出的第几个疑似Gemini 4 Pro的新检查点了。
社区这边还在疯狂扒细节,谷歌自己也不藏了。
本周,谷歌DeepMind新掌门Koray Kavukcuoglu首次对媒体确认:Gemini 4已经进入后训练早期。
![]()
图源Information
而且他的目标,是尽快发。
我们看到了效果,感到非常兴奋,接下来还会继续以快速迭代的方式推进工作。
好家伙。合着一轮轮冒出的checkpoint是给Gemini 4提前热场呢?
反正听Koray的语气,主打一个:能早发,绝不晚发。
而且这次提速的,还不只是模型。谷歌还准备把TPU芯片送上太空。
新项目即将启动原型测试,连AI算力基础设施都开始往地球之外伸。
Gemini 4,进入冲刺阶段
大家这么盯着Gemini 4,也不奇怪。
毕竟从上一代旗舰模型Gemini 3走到现在,谷歌中间没少折腾。
原本按计划,今年6月应该先等来Gemini 3.5 Pro。谷歌CEO劈柴哥甚至在5月I/O开发者大会上提前预告过。
结果,没发。
![]()
中间虽然陆续更新了Gemini 3.1和几款Flash型号,但3.5 Pro一直没有正式亮相。
Koray这次也解释,团队中途选择「稍微暂缓一下」,先把精力放到Flash系列。
而现在,节奏明显又变了。
Koray明确说,要在尽可能短的时间内,实现最大的学习速度。
听话听音。这几乎把谷歌现在的打法挑明了。
虽然没有明确说谷歌是否正式取消了Gemini 3.5 Pro项目,但可以肯定的是,团队已经将全部注意力转向Gemini 4。
Gemini 3.5 Pro可以先放一放,但Gemini 4的训练、测试、反馈和再迭代,必须尽快一轮接一轮跑起来。
![]()
为此,谷歌已经开始同步搭建Gemini 4的内部安全保障和测试流程。目前这套机制已经先在内部AI编码工具上跑起来了。
这时候再看最近Arena里冒出来的疑似Gemini 4检查点,就更有意思了。
Lumina最新放出的「鹈鹕骑自行车」,大家的讨论中心已经从「哪个检查点更好」,变成了「Gemini 4到底追到哪一步了?」
![]()
有人直接喊出:Gemini is back in the game,认为如果这些检查点真实,谷歌正在快速缩小与OpenAI /Anthropic的差距。
![]()
也有人觉得它现在无法和GPT-6 SOL正面硬刚,和Anthropic今年春季推出、近期又完成升级的Mythos系列相比,也谈不上占尽优势。
![]()
面对质疑,Koray倒是相当有自信。
我对这个团队充满信心。我们肯定会一直处于前沿位置。
今年8月,哈萨比斯卸下Google DeepMind日常管理工作后,Koray正式接手这块业务,同时继续担任谷歌首席AI架构师。
Gemini接下来怎么跑、跑多快,Koray就是现在最关键的拍板人之一。
反正人家的话已经放这儿了,接下来就看Gemini 4自己能不能接住吧。
挑战英伟达,TPU首次上太空
如果只看Gemini 4,很容易以为谷歌这轮只是模型团队又开始加速。
其实更夸张的是,连算力都开始同步踩油门了。
Koray最近明确提到,DeepMind的前沿模型研发,现在也在直接「反哺」谷歌自己的硬件业务。
以前,TPU主要藏在Google Cloud后面,客户买的是云服务。但现在,谷歌开始直接卖TPU芯片了!
目标相当明确,挑战英伟达。
![]()
而且模型团队和芯片团队之间,也开始越绑越紧。
DeepMind做下一代模型时产生的新需求,会提前反馈给硬件工程师,让他们规划未来两到三代TPU。
模型:兄弟,我下一轮又准备吃✕✕算力了。
芯片:收到,现在开始造。
谷歌正与美国商业卫星公司Planet合作,计划通过SpaceX猎鹰9号发射原型卫星,其中将搭载4颗TPU,测试其在轨运行能力。
项目名叫「Project Suncatcher」。
想法也非常谷歌:既然地面AI数据中心又吃电、又占地、还需要大量水冷,那能不能干脆把一部分机器学习基础设施,搬到太阳能更充足的轨道上?
不过目前还只是第一步。
太空里没法像地面数据中心那样靠空气对流散热,芯片连续高负载运行会很快碰到热管理问题。
按照方案,芯片在太空中大约可以运行15分钟,之后就需要关闭以冷却。
所以这次更像是在验证一件事:TPU到底能不能先在轨道上活下来、跑起来。
至于真正把几十颗卫星用激光连成网络,变成「太空AI数据中心」,那还是后话。
![]()
别人还在抢数据中心机房,谷歌已经开始琢磨天上的地皮了。
然而就在谷歌上下都在喊加速的时候,团队有人撂挑子不干了。
前Mozilla工程师、后来加入DeepMind的Robert O’Callahan,昨天宣布辞职。
![]()
理由竟不是嫌弃谷歌AI发展太慢,而是「太快了」?
Robert不直接训练模型,而是负责的是硬件芯片设计工具。
但做着做着,他发现这些工具会加快下一代AI芯片设计,进一步降低AI的成本和延迟。
在他看来,这意味着,人工智能将变得更加便宜、高效,从而更加普及,也更加强大。
Robert和DeepMind的同事们聊过AI风险,几乎所有人都对此深感担忧,只是很多人没有公开表达。
而且,Koray并没有停下来的意思,甚至觉得「还得再快」。
Robert起初也没想直接走人,毕竟薪酬颇丰。他只想换去一个完全不加速AI的工程岗位。
但受限于自己所在地区和岗位选择,这条路最后也没走通。
One more thing
检查点狂冒、TPU上天、工程师离职。这些事放在这一周看,多少有点黑色幽默。
想当初,Gemini 3的表现曾让OpenAI进入「红色警戒」,但谷歌自己随后却在旗舰节奏上慢了半拍。
如今,Koray带队,选择重新加速,并把学习速度拉到最大。并且,不是某一个产品线提速,模型、芯片、组织节奏,全都开始往前压。
谷歌:确实等不起了。
[1]https://x.com/LuminaBench/status/2103523411645362667
[2]https://x.com/maxt3chno/status/2103597397691523088
[3]https://www.theinformation.com/articles/google-nears-release-flagship-gemini-4-ai-model?rc=zbvmxs
[4]https://x.com/Google/status/2103229008343126519
[5]https://x.com/rocallahan/status/2103368176369324093
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.