Google發表Gemini 4 Argon,輸出上限增至100萬個Token
站內可閱讀至 (台北時間)

Google周三(9/30)發表新一代AI模型Gemini 4 Argon,主攻複雜、長時間工作流程,輸出上限達100萬個Token,較先前Gemini模型的6.4萬個Token大幅提高。目前Argon先透過Fairwind Program提供給一批受信任的資安防禦人員測試,之後才會逐步擴大開放。
Google的Gemini模型依用途提供不同型號,包括主打速度與成本的Flash,以及即時語音互動的Live等系列,近期產品主要集中在Gemini 3.8世代。此次Google不僅將版本推進至Gemini 4,也首次採用Argon作為模型名稱,成為Gemini家族的全新型號。
Argon定位為可長時間進行深度推理的前沿模型,主要鎖定軟體工程、企業知識工作及網路安全防禦等複雜任務。Gemini模型的輸出Token上限也涵蓋模型使用的思考Token,因此輸出上限愈高,模型可用於推理及產生內容的空間也愈大。Argon的100萬個Token輸出上限是先前Gemini模型6.4萬個Token的逾15倍。Google表示,這讓模型能在單一執行軌跡中產生數十萬個Token並持續深入推理,以處理更複雜、需要較長工作流程的任務。
Google已將Argon投入內部實際工作,包括程式除錯、演算法設計及大規模程式碼遷移。Argon代理人目前正協助將Google內部C/C++程式碼轉換成Rust,規模從數萬行的核心函式庫,到超過80萬行的Fuchsia Zircon核心。
在libgav1影片解碼器專案中,Argon重新處理3.2萬行SIMD程式碼,產生的Rust版本執行速度是原有Rust版本的2.7倍。另一組Argon代理人則分析Google資料中心的遙測資料並進行記憶體最佳化,目前已釋放超過300TiB記憶體,估計最終可節省500TiB至1PiB。
網路安全也是Argon此次強化的重點。Google表示,Argon可自主尋找、驗證及修補軟體漏洞,在CWE-bench v1漏洞修補測試取得68%的成績。資安業者Wiz亦使用Argon協助尋找重要公共基礎設施的安全問題,並曾發現一項醫療軟體重大漏洞,可能影響全球使用該軟體的醫院並暴露敏感個資。
由於Argon具備較強的網路安全能力,Google目前採取分階段開放方式,並持續強化防止濫用、提示詞注入、模型失準及沙箱環境等安全措施。未來將逐步開放給開發者、企業及一般消費者,初期將先提供給付費API客戶及Google AI Ultra訂戶。Argon推出時的API價格為每百萬輸入Token 2美元、輸出Token 10美元,快取輸入Token價格則比一般輸入Token低95%。