Google 推 Gemini 4 旗艦模型 Argon,瞄準 OpenAI Astra、Anthropic Opus

Google 週三(30 日)發表 Gemini 4 世代的旗艦 AI 模型「Argon」。Google 發言人表示,Argon 是公司迄今效能最強的模型,在關鍵的程式設計與資安基準測試上,表現可與 OpenAI 的 Astra、Anthropic 的 Opus 等頂尖模型相提並論。 Google 表示,Argon 現階段只提供給特定資安合作夥伴使用,並參與川普政府推動的自願性機制,讓政府能在模型公開發布前取得存取權限。不過根據官方說法,提供給受信任的資安防禦者和 Google 內部團隊的 Argon 版本,不會加上資安防護機制(without cyber guardrails),讓他們能使用完整能力。 Google 雖沒有說明 Argon 何時正式上市,但已公布推出時的優惠價是每 100 萬個輸入 token 收費 2 美元、輸出 token 10 美元,快取輸入 token 則比一般輸入價格低 95%。 優惠期結束後,價格將調為輸入 token 4 美元、輸出 token 20 美元。 根據發言人說法,Argon 的模型規模比 Google 過去的進階「Pro」系列更大。不過從 Google 新聞稿中自行公布的成績來看,Argon 的表現有勝有負:它在數項產業基準測試上超越 Astra 和 Opus,但在部分指標上仍然落後,新聞稿列出的四項程式設計相關測試中,就有兩項沒有勝出。 Argon 另一項明顯變化,是大幅提高單次輸出的長度上限。Google 將模型的輸出 token 上限從先前的 64K 提升至 100 萬 tokens,希望讓模型能在單次工作流程中持續處理更長、更複雜的任務。 Google 表示,Argon 已經投入公司內部使用,其中包括協助把大型 C/C++ 程式碼庫遷移到 Rust,規模最大的是 Fuchsia 作業系統的 Zircon kernel,程式碼超過 80 萬行。由於這些系統相當關鍵,相關改寫仍須經過自動與人工稽核、模擬測試後,才會正式上線。 以 Google 開源影片解碼器 libgav1 為例,Argon agents 在既有 Rust 版本的基礎上,取代約 3.2 萬行 SIMD 程式碼,最後做出兼顧記憶體安全的解碼器,執行速度是原本 Rust 版本的 2.7 倍,輸出的影片結果完全相同。 Argon 問世前,Google 的模型時程已經延宕數月。Google 發言人證實,執行長 Sundar Pichai 原先表示將於 6 月推出的 Gemini 3.5 Pro,已經取消推出計畫。 這段期間,Google 改組旗下 DeepMind AI 實驗室,創辦人暨執行長 Demis Hassabis 卸下原職,多名 Gemini 模型的領導者也相繼離開公司。 模型遲遲無法推出,讓 Google 被 Anthropic 和 OpenAI 拉開距離,兩家對手在同一段時間內持續更新旗下頂級模型。 Pichai 在 7 月曾公開反駁 Google 在 AI 競賽中失去優勢的說法,但 Google 近幾個月的對外訊息已明顯轉向,從強調 Gemini 的尖端能力,改為凸顯相較競爭對手的成本優勢。 核稿編輯:Mia