Gemini 4這兩天,真的快被社媒漏成篩子了。
新檢查點、新作品、新對比圖,一茬接一茬往外冒。
就在剛剛,Lumina又放出了一組挺有節目效果的測試:
同一道「鵜鶘騎自行車」,Gemini 4 Pro前後兩個檢查點,直接畫出了兩種完全不同的風格。
Checkpoint 1走的是鮮豔卡通风;Checkpoint 2則明顯更克制,像一張機械結構草圖。
兩個檢查點放在一起,已經能明顯看出後訓練留下的痕跡:線條、結構、細節處理都在變。模型能力已經肉眼可見地往前躥了一截。
而這,已經數不清是Arena裡,冒出的第幾個疑似Gemini 4 Pro的新檢查點了。
社區這邊還在瘋狂扒細節,谷歌自己也不藏了。
本週,谷歌DeepMind新掌門Koray Kavukcuoglu首次對媒體確認:Gemini 4已經進入後訓練早期。
△
而且他的目標,是盡快發。
我們看到了效果,感到非常興奮,接下來還會繼續以快速迭代的方式推進工作。
好傢伙。合著一輪輪冒出的checkpoint是給Gemini 4提前熱場呢?
反正聽Koray的語氣,主打一個:能早發,絕不晚發。
而且這次提速的,還不只是模型。谷歌還準備把TPU晶片送上太空。
新項目即將啟動原型測試,連AI算力基礎設施都開始往地球之外伸。
Gemini 4,進入衝刺階段
大家這麼盯著Gemini 4,也不奇怪。
畢竟從上一代旗艦模型Gemini 3走到現在,谷歌中間沒少折騰。
原本按計劃,今年6月應該先等來Gemini 3.5 Pro。谷歌CEO劈柴哥甚至在5月I/O開發者大會上提前預告過。
結果,沒發。
中間雖然陸續更新了Gemini 3.1和幾款Flash型號,但3.5 Pro一直沒有正式亮相。
Koray這次也解釋,團隊中途選擇「稍微暫緩一下」,先把精力放到Flash系列。
而現在,節奏明顯又變了。
Koray明確說,要在盡可能短的時間內,實現最大的學習速度。
聽話聽音。這幾乎把谷歌現在的打法挑明了。
雖然沒有明確說谷歌是否正式取消了Gemini 3.5 Pro項目,但可以肯定的是,團隊已經將全部注意力轉向Gemini 4。
Gemini 3.5 Pro可以先放一放,但Gemini 4的訓練、測試、反饋和再迭代,必須盡快一輪接一輪跑起來。
為此,谷歌已經開始同步搭建Gemini 4的內部安全保障和測試流程。目前這套機制已經先在內部AI編碼工具上跑起來了。
這時候再看最近Arena裡冒出來的疑似Gemini 4檢查點,就更有意思了。
Lumina最新放出的「鵜鶘騎自行車」,大家的討論中心已經從「哪個檢查點更好」,變成了「Gemini 4到底追到哪一步了?」
有人直接喊出:Gemini is back in the game,認為如果這些檢查點真實,谷歌正在快速縮小與OpenAI /Anthropic的差距。
也有人覺得它現在無法和GPT-6 SOL正面硬剛,和Anthropic今年春季推出、近期又完成升級的Mythos系列相比,也談不上佔盡優勢。
面對質疑,Koray倒是相當有自信。
我對這個團隊充滿信心。我們肯定會一直處於前沿位置。
今年8月,哈薩比斯卸下Google DeepMind日常管理工作後,Koray正式接手這塊業務,同時繼續擔任谷歌首席AI架構師。
Gemini接下來怎麼跑、跑多快,Koray就是現在最關鍵的拍板人之一。
反正人家的話已經放這兒了,接下來就看Gemini 4自己能不能接住吧。
挑戰英偉達,TPU首次上太空
如果只看Gemini 4,很容易以為谷歌這輪只是模型團隊又開始加速。
其實更誇張的是,連算力都開始同步踩油門了。
Koray最近明確提到,DeepMind的前沿模型研發,現在也在直接「反哺」谷歌自己的硬件業務。
以前,TPU主要藏在Google Cloud後面,客戶買的是雲服務。但現在,谷歌開始直接賣TPU芯片了!
目標相當明確,挑戰英偉達。
而且模型團隊和芯片團隊之間,也開始越綁越緊。
DeepMind做下一代模型時產生的新需求,會提前反饋給硬件工程師,讓他們規劃未來兩到三代TPU。
模型:兄弟,我下一輪又準備吃✕✕算力了。芯片:收到,現在開始造。
谷歌正與美國商業衛星公司Planet合作,計劃通過SpaceX獵鷹9號發射原型衛星,其中將搭載4顆TPU,測試其在軌運行能力。
項目名叫「Project Suncatcher」。
想法也非常谷歌:既然地面AI數據中心又吃電、又佔地、還需要大量水冷,那能不能乾脆把一部分機器學習基礎設施,搬到太陽能更充足的軌道上?
不過目前還只是第一步。
太空裡沒法像地面數據中心那樣靠空氣對流散熱,芯片連續高負載運行會很快碰到熱管理問題。
按照方案,芯片在太空中大約可以運行15分鐘,之後就需要關閉以冷卻。
所以這次更像是在驗證一件事:TPU到底能不能先在軌道上活下來、跑起來。
至於真正把幾十顆衛星用激光連成網絡,變成「太空AI數據中心」,那還是後話。
別人還在搶數據中心機房,谷歌已經開始琢磨天上的地皮了。
然而就在谷歌上下都在喊加速的時候,團隊有人撂挑子不幹了。
前Mozilla工程師、後來加入DeepMind的Robert O’Callahan,昨天宣布辭職。
理由竟不是嫌棄谷歌AI發展太慢,而是「太快了」?
Robert不直接訓練模型,而是負責的是硬體晶片設計工具。
但做著做著,他發現這些工具會加快下一代AI晶片設計,進一步降低AI的成本和延遲。
在他看來,這意味著,人工智慧將變得更加便宜、高效,從而更加普及,也更加強大。
Robert和DeepMind的同事們聊過AI風險,幾乎所有人都對此深感擔憂,只是很多人沒有公開表達。
而且,Koray並沒有停下來的意思,甚至覺得「還得再快」。
Robert起初也沒想直接走人,畢竟薪酬頗豐。他只想換去一個完全不加速AI的工程崗位。
但受限於自己所在地區和崗位選擇,這條路最後也沒走通。
One more thing
檢查點狂冒、TPU上天、工程師離職。這些事放在這一週看,多少有點黑色幽默。
想當初,Gemini 3的表現曾讓OpenAI進入「紅色警戒」,但谷歌自己隨後卻在旗艦節奏上慢了半拍。
如今,Koray帶隊,選擇重新加速,並把學習速度拉到最大。並且,不是某一個產品線提速,模型、晶片、組織節奏,全都開始往前壓。
谷歌:確實等不起了。
本文來自微信公眾號「量子位」,作者:關注前沿科技
















