在缺乏旗艦產品十個月後,Google 確認 Gemini 4 目標在年底前推出
目錄
你可能想知道
1. Gemini 4 能否在競爭對手進一步領先之前,縮小與 OpenAI 的 GPT-6 以及 Anthropic 的 Mythos 之間的效能差距?
2. Google 會優先交付一個精緻的旗艦產品,還是偏好更快的較小模型迭代以重奪動量?
主要議題
Google 已近十個月未推出新的旗艦大型語言模型,這段空檔恰逢競爭對手迅速進展。在此期間,OpenAI 發佈了 GPT-6,Anthropic 推出了 Mythos 系列,兩者在多項表現上均明顯超越 Google 於 2025 年 11 月發佈的 Gemini 3。面對外在壓力與內部領導層變動,Google DeepMind 的新任主管 Koray Kavukcuoglu 已公開確認 Gemini 4 已進入後訓練階段——這是核心模型訓練之後的最後階段,專注於微調、對齊與人類回饋校準。他表示該模型已在 Google 的工程平台 Antigravity 上進行內部試驗,目標是讓 Gemini 4 在 2026 年底之前大幅提前可用。
過去十個月以 Google 的領導層重整與 DeepMind 的策略轉向為特徵。2026 年 8 月初,Demis Hassabis 退居 DeepMind 的日常營運,轉任 Google DeepMind 董事會主席與 Alphabet 的首席科學家,專注於長期的 AGI 相關工作與像 Isomorphic Labs 這類計畫。擁有 13 年 DeepMind 經驗的 Koray Kavukcuoglu 升任資深副總裁,負責監管 Gemini 模型開發、前沿 AI 研究與 Gemini App 團隊,並直接向 Sundar Pichai 匯報。Hassabis 公開表達對 Kavukcuoglu 及其團隊的信心,並對 Gemini 4 的進展表示期待。
儘管領導層給予保證,Google 在中間版本的發佈上仍面臨延遲。特別是 Gemini 3.5 Pro 在 Sundar Pichai 於 2026 年 5 月的 I/O 宣布後,曾多次承諾發佈;6 月、7 月與 8 月的目標皆未達成,該模型尚未出現。Kavukcuoglu 解釋團隊做出了一個刻意的戰術決定,選擇「退一步」,將資源重新分配給能更快部署的較小 Flash 模型。其理由務實:優化能快速訓練與迭代的模型,以向使用者交付有用改進,而不是繼續大量投入需長時間打磨的龐大旗艦。
這項策略選擇也解釋了為何 Kavukcuoglu 強調對 Gemini 4 採取不同作法:優先快速取得早期後訓練結果,然後進行快速的增量更新。他將內部結果描述為有希望,並表示團隊計劃持續高速迭代。這反映出業界日益明顯的取捨:是發佈單一高度打磨的重大模型,還是透過較小、更靈活的模型與頻繁版本發布來持續提供增益。
公開評論也質疑 Google 是否仍沿著以 AGI 為中心的軌跡前進——或公司是否需要轉向更以產品交付為核心的姿態。Kavukcuoglu 有意改寫這場辯論,主張核心議題不是「我們是否已建構 AGI?」,而是「我們能否建構值得信賴的智能代理?」換句話說,優先事項是創造可被客戶採用的可靠、有用系統,而非將所有溝通圍繞長期的 AGI 里程碑。
Google 公佈的營運指標顯示持續大量使用:Antigravity 報告指出 每週 240 萬以上活躍用戶,且 Google 的模型 API 據稱處理約 每分鐘 2200 億個標記。這些指標強調 Google 的平台足跡與使用者基礎仍然龐大。然而,立即的戰術挑戰是缺乏一個能在效能基準與重大功能上直接與 GPT-6 與 Mythos 競爭的新旗艦模型。在 Gemini 4 尚未發布之前,公眾對 Google 速度與競爭地位的看法仍將被競爭對手的發佈與錯過期限的敘事所左右。
也應把此情勢放在背景中理解:前沿的軟體與模型開發常涉及優先順序調整、實驗性繞道與重新校準的時間表。Google 將精力轉向 Flash 模型是風險緩解與機會把握的舉措——若能在旗艦獲得充分對齊與安全測試的同時帶來實質產品改進,此舉或能獲得回報。儘管如此,延遲旗艦發表對市場的影響是真實存在的:客戶、夥伴與研究社群不僅以內部指標衡量領導地位,也以可見、可消費的基準與廣泛可得的模型來評斷。
從技術生命週期來看,進入後訓練意味著 Gemini 4 已完成耗費大量運算的預訓練階段,現在進行強化學習(來自人類回饋)、提示調整與安全約束實作等精緻化步驟。這些任務對模型品質與可信度至關重要,但可能揭露需要額外迭代的細節。Kavukcuoglu 表示 Gemini 4 正在 Antigravity 中接受測試,暗示 Google 正在執行端到端的開發者與實際工作流程,以在更廣泛發布前驗證模型行為、延遲表現與與平台功能的整合。
總結來說,Google 正試圖在兩項相互競爭的必要事項間取得平衡:交付一個能在可信度上與 GPT-6 與 Mythos 競爭的旗艦模型,並維持能在近期內讓使用者持續參與的改進節奏。Gemini 4 已進入後訓練並在內部測試的確認,代表有進展,但時機與模型在真實世界的比較表現將決定 Google 是否能成功恢復其旗艦動能。對觀察者而言,關鍵問題仍是 Google 是否能足夠快速地出貨以改變市場敘事,以及所發布的模型是否能符合競爭對手最新版本所抬高的標準。
重點洞見表
| 面向 | 描述 |
|---|---|
| 當前狀態 | Gemini 4 正處於後訓練並在 Antigravity 上進行內部試驗。 |
| 目標時程 | Google 目標在 2026 年底之前顯著提前發布 Gemini 4。 |
| 策略轉變 | 資源暫時轉向更快速、較小的 Flash 模型以交付短期成效。 |
| 競爭情境 | OpenAI 的 GPT-6 與 Anthropic 的 Mythos 目前領先於 Gemini 3;Gemini 4 必須縮小該差距。 |
| 平台健康 | Antigravity 報告 每週 240 萬活躍用戶;API 流量約 ~ 每分鐘 2200 億標記。 |
| 領導層 | Koray Kavukcuoglu 現負責 DeepMind 營運;Demis Hassabis 專注於 AGI 與長期科學角色。 |
之後...
未來數月將對 Google 的 AI 敘事具決定性。如果 Gemini 4 迅速出貨並提供具有競爭力的表現,Google 能重新塑造外界認知並恢復其旗艦可信度。相反地,若進一步延遲或模型未能匹配競爭對手,可能延續 Google 在當前競爭週期中落後的印象。除了即時基準測試之外,更廣泛的問題在於 Google 如何在長期研究目標(如 AGI)與當前的商業與產品需求間取得平衡。交付值得信賴、對齊良好且使用者願意採用的模型,很可能在短期內是最明確的成功訊號。
對於利害關係人——客戶、夥伴與開發者——觀察發佈節奏、基準測試結果與整合品質將至關重要。Google 龐大的使用者基礎與平台指標提供了強大基礎,但若能及時推出 Gemini 4 並展現明顯的效能與安全改進,將是重獲旗艦型模型領導地位的最直接途徑。
最後編輯時間:2026/9/28
