轮到谷歌踩油门了,Gemini 4泄漏、TPU上天、工程师因“太快”辞职
Gemini 4这几天在社交媒体上几乎被泄露得毫无保留。
新的检查点、新的作品、新的对比图,接连不断地涌现。
就在不久前,Lumina又公布了一组颇具看点的测试结果:
面对同一道「鹈鹕骑自行车」的指令,Gemini 4 Pro的两个不同检查点,生成了两种截然不同的画风。

第一个检查点偏向鲜艳的卡通风格;第二个则明显更为内敛,类似于一张机械结构的草图。
将两个检查点并列对比,后训练带来的变化已清晰可见:线条、结构、细节处理都在逐步优化。模型的能力显然又向前迈进了一大步。
而这,已经记不清是Arena中出现的第几个疑似Gemini 4 Pro的新检查点了。
社区这边还在疯狂挖掘细节,谷歌自己也并不遮掩。
本周,谷歌DeepMind的新任掌门人Koray Kavukcuoglu首次向媒体确认:Gemini 4已进入后训练早期阶段。

△
而且他的目标是尽快发布。
我们已经看到了成效,感到非常振奋,接下来将继续以快速迭代的方式推进工作。
原来如此。那一轮又一轮涌现的检查点,是在为Gemini 4提前预热?
从Koray的语气判断,他的策略很明确:能早发,绝不拖延。
而这次加速的,远不止模型本身。谷歌还计划将TPU芯片发射到太空。
新项目即将启动原型测试,AI算力基础设施也开始向地球之外延伸。
Gemini 4,进入冲刺阶段
外界如此关注Gemini 4,并不令人意外。
毕竟从上一代旗舰模型Gemini 3发展至今,谷歌经历了不少波折。
按照原计划,今年6月本应率先推出Gemini 3.5 Pro。谷歌CEO劈柴哥甚至在5月的I/O开发者大会上提前透露过这一消息。
结果,并未发布。

虽然中间陆续更新了Gemini 3.1和几款Flash型号,但3.5 Pro始终未正式亮相。
Koray这次也解释,团队中途选择「稍微放缓了一下」,将重心先放在Flash系列上。
而现在,节奏明显发生了变化。
Koray明确表示,要在尽可能短的时间内,实现最大的学习速度。
这句话几乎揭示了谷歌当前的策略。
虽然没有明确说明谷歌是否正式取消了Gemini 3.5 Pro项目,但可以肯定的是,团队已将全部精力转向Gemini 4。
Gemini 3.5 Pro可以暂时搁置,但Gemini 4的训练、测试、反馈和再迭代,必须尽快一轮接一轮地推进。

为此,谷歌已经开始同步搭建Gemini 4的内部安全保障和测试流程。目前这套机制已在内部AI编码工具上先行运行。
此时再看Arena中最近冒出的疑似Gemini 4检查点,就更加耐人寻味了。
针对Lumina最新发布的「鹈鹕骑自行车」,大家的讨论焦点已从「哪个检查点更好」,转变为「Gemini 4到底进展到了哪一步?」

有人直接宣称:Gemini is back in the game,认为如果这些检查点属实,谷歌正在迅速缩小与OpenAI/Anthropic之间的差距。

也有人认为它目前还无法与GPT-6 SOL正面抗衡,与Anthropic今年春季推出、近期又完成升级的Mythos系列相比,也谈不上占据明显优势。

面对质疑,Koray显得相当自信。
我对这个团队充满信心。我们肯定会始终处于前沿位置。
今年8月,哈萨比斯卸任Google DeepMind日常管理工作后,Koray正式接管这块业务,同时继续担任谷歌首席AI架构师。
Gemini接下来的发展方向和速度,Koray是当前最关键的决定者之一。
反正他的话已经摆在这里,接下来就看Gemini 4能否兑现了。
挑战英伟达,TPU首次上太空
如果只关注Gemini 4,很容易以为谷歌这轮只是模型团队在加速。
实际上更令人瞩目的是,连算力也开始同步提速了。
Koray最近明确提到,DeepMind的前沿模型研发,现在也在直接「反哺」谷歌自己的硬件业务。
以往,TPU主要隐藏在Google Cloud背后,客户购买的是云服务。但现在,谷歌开始直接销售TPU芯片了!
目标非常明确,挑战英伟达。

而且,模型团队与芯片团队之间的协作也日益紧密。
DeepMind在开发下一代模型时产生的新需求,会提前反馈给硬件工程师,以便他们规划未来两到三代的TPU。
模型:兄弟,我下一轮又准备消耗✕✕算力了。芯片:收到,现在开始造。
谷歌正与美国商业卫星公司Planet合作,计划通过SpaceX猎鹰9号发射原型卫星,其中将搭载4颗TPU,测试其在轨运行能力。
该项目名为「Project Suncatcher」。
想法也非常谷歌:既然地面AI数据中心既耗电、又占地、还需要大量水冷,那能否将一部分机器学习基础设施,搬到太阳能更充足的轨道上?
不过目前这还只是第一步。
在太空中,无法像地面数据中心那样依靠空气对流散热,芯片连续高负载运行会很快面临热管理问题。
根据方案,芯片在太空中大约可运行15分钟,之后需要关闭以冷却。
因此,这次更像是在验证一件事:TPU能否先在轨道上存活并运行起来。
至于真正将几十颗卫星通过激光连接成网络,变成「太空AI数据中心」,那是更长远的事情。

别人还在抢占数据中心机房,谷歌已经开始盘算天上的空间了。
然而,就在谷歌上下都在喊加速的时候,团队中有人选择退出。
前Mozilla工程师、后来加入DeepMind的Robert O’Callahan,昨日宣布辞职。

理由并非嫌弃谷歌AI发展太慢,而是「太快了」?
Robert不直接训练模型,而是负责硬件芯片设计工具。
但工作中他发现,这些工具会加速下一代AI芯片的设计,进一步降低AI的成本和延迟。
在他看来,这意味着人工智能将变得更加便宜、高效,从而更加普及,也更加强大。
Robert曾与DeepMind的同事讨论过AI风险,几乎所有人都对此深感担忧,只是许多人没有公开表达。
而且,Koray并没有停下来的意思,甚至觉得「还得再快」。
Robert起初并未打算直接离职,毕竟薪酬优厚。他只想换到一个完全不加速AI的工程岗位。
但由于所在地区和岗位选择的限制,这条路最终未能走通。
One more thing
检查点不断涌现、TPU被送上太空、工程师选择离职。这些事集中在一周内发生,多少带点黑色幽默。
回想当初,Gemini 3的表现曾让OpenAI进入「红色警戒」,但谷歌随后在旗舰节奏上慢了半拍。
如今,Koray带队,选择重新加速,并将学习速度调到最大。而且,这不是某个产品线的单独提速,而是模型、芯片、组织节奏全面向前推进。
谷歌:确实等不起了。
本文来自微信公众号“量子位”,作者:关注前沿科技,36氪经授权发布。用户可通过中欧体育APP下载获取更多相关信息。