Google推出新一代前沿模型Gemini 4 Argon,強化長任務處理與企業自動化能力
針對軟體工程、金融法律及網路安全防禦優化,輸出Token上限提升至100萬
Quick Look
Google推出Gemini 4 Argon模型,專注於複雜多步驟工作流程。該模型將輸出Token上限提升至100萬,並已應用於Google內部程式碼遷移、記憶體最佳化及網路安全漏洞修補,目前透過Fairwind計畫開放測試。
AI-generated summary
Why It Matters
Gemini 4 Argon是Google新推出的前沿模型,旨在處理複雜、長時間且多步驟的工作流程。該模型已在Google內部用於程式開發與記憶體最佳化。
Google今(1)日宣布推出新一代前沿模型Gemini 4 Argon,主打處理複雜、長時間且多步驟的工作流程,應用涵蓋軟體工程、金融與法律等企業知識工作,以及網路安全防禦。目前Google先透過Fairwind計畫開放給受信任的網路安全防禦專家測試,未來將逐步擴大至開發者、企業與消費者。
Gemini 4 Argon一大升級,在於大幅提高模型可處理長任務的能力,Google將輸出Token上限從原本6.4萬大幅增至100萬,讓模型能在單次任務中進行更長時間的推理,並完成更複雜的多步驟工作。
Argon目前已投入Google內部工作流程。Google表示,數千名員工在專業程式開發、深度研究及寫作等任務中使用Argon,其中在資料中心記憶體最佳化方面,Argon代理可自主分析系統效能並套用改善方案,全面部署後,已釋放超過 300 TiB 的記憶體,預估整體可節省約 500 TiB 至 1 PiB 的記憶體容量。
Argon代理程式也被用來將Google內部C/C++程式碼庫遷移至Rust,涵蓋數萬行程式碼的核心函式庫,甚至包括超過80萬行程式碼的Fuchsia Zircon核心。以影片解碼開源軟體libgav1為例,Argon處理約3.2萬行SIMD程式碼後,新版本執行速度較原有Rust版本提升2.7倍,並逼近高度最佳化的C++版本。
除了程式開發,Google也將Argon瞄準金融、法律、稅務與企業自動化等專業工作。在評估真實世界長期軟體工程任務的DeepSWE v1.1測試中,Argon取得77.9%;Zapier的AutomationBench則取得51.3%。在長影片理解LVBench測試中,得分達91.7%。
網路安全則是Argon另一項主打能力,Google表示,Argon能自主尋找、驗證並修補軟體漏洞,資安業者Wiz已透過「Scan for Good」計畫投入測試。Argon曾找出一項可能導致醫療軟體敏感個資外洩的關鍵漏洞;在評估漏洞修補能力的CWE-bench v1測試中,則以68%成績並列最高。
不過,隨著AI代理能執行更長、更複雜的自主任務,Google也同步強化安全措施,包括防止模型遭惡意利用、抵禦提示注入攻擊、監控模型是否偏離使用者原始意圖,以及強化AI代理執行時使用的沙盒環境。
價格方面,Gemini 4 Argon每100萬輸入Token(詞元)收費2美元、每100萬輸出Token收費10美元,快取輸入Token價格則較一般輸入低95%。Google表示,Argon目前採分階段開放,未來將率先提供付費API客戶與Google AI Ultra訂閱者使用。
What to Watch
AI outlook — possibilities, not facts
Gemini 4 Argon將逐步開放給付費API客戶與Google AI Ultra訂閱者使用。
Very likely · Within months
Open Questions
- 何時全面開放給一般企業與消費者使用?
- 未來是否會整合至更多Google Workspace產品中?





