Google 發表 Gemini 4 Argon:主攻網絡防禦與企業工作流程

Google 於 2026 年 9 月 30 日發表新一代前沿模型 Gemini 4 Argon,由 Google DeepMind 高級副總裁暨 Google 首席人工智能架構師 Koray Kavukcuoglu 撰文公布。官方指出,Argon 為長時間、複雜流程而設,可在真實軟件工程、法律與金融等企業知識工作,以及網絡安全防禦上提供前沿表現;由於這類能力需要審慎處理,模型會先透過 Fairwind 計劃向一組受信任的網絡防禦人員推出。[1][2]

以階段方式開放

官方指出,安全地發布此級別的前沿能力需要階段式做法。Google 正參與美國政府自願性質的發布前模型存取程序,同時逐步擴大存取範圍,並會在持續收集早期測試者意見、改進護欄之後,盡快把 Argon 提供給開發者、企業與消費者。[1]

定價方面,官方公布 Argon 會以推廣價推出,每百萬輸入 token 為 2 美元、輸出為 10 美元,快取輸入 token 則為輸入價格的九五折(即減價 95%)。[1]

Google 內部應用

官方指出,Argon 已在 Google 內部工作流程中使用,數千名員工反映它在專門編程任務、深入研究和寫作質素方面表現突出。官方列出三個例子。[1]

其一是量子算法優化:Argon 協助量子運算研究人員優化影響重要應用的子程式時空資源(量子位乘閘數),在其中一個例子中,它在數分鐘內較已發表的基準好 40%。[1]

其二是記憶體效率:一隊 Argon 代理分析全機群的剖析遙測資料,自主找出並套用記憶體優化,在全面推行後釋放超過 300 TiB 記憶體,官方估計總節省可達 500 TiB 至 1 PiB。[1]

其三是大規模程式庫遷移與優化:Argon 代理正在 Google 內部把 C/C++ 程式庫遷移到 Rust,規模由核心程式庫(如 re2、libgav1)的數萬行,到 Fuchsia Zircon 核心的 80 萬行以上;由於涉及關鍵系統,這些大規模改寫在推出到生產環境之前,都要經過嚴謹的自動與人手審計、模擬測試與覆核。[1]

評測表現

官方指出,Argon 在 DeepSWE v1.1 上創下新的先進水平,得分 77.9%;該評測衡量模型在真實、長時間軟件工程任務中的表現。[1]

在衡量金融、編程、法律與稅務工作經濟影響的 Vals Index 上,Argon 是領先模型,官方表示在 Vals Finance Agent v2(多步財務研究)與 Harvey 的法律代理基準(法律研究與草擬)等領域專門評測上亦有類似領先表現。在 Zapier 用以衡量跨核心業務功能端到端執行的 AutomationBench 上,Argon 以 51.3% 排名第一。[1]

官方又指,Argon 在需要視覺理解的知識工作上表現突出,可驅動專業圖表分析、從長影片中辨識細節,並根據一系列文件採取行動;在衡量長影片理解的 LVBench 上,Argon 以 91.7% 達到先進水平。[1]

防禦性網絡安全

官方表示,為了讓網絡防禦者在新的攻擊時代有更好裝備,Argon 在訓練上特別強化防禦性網絡安全能力,並形容它可自主找出、驗證及修補關鍵軟件漏洞。[1]

參考資料

[1] Google 官方部落格 — Gemini 4 Argon: our next era of frontier intelligence(2026 年 9 月 30 日)

[2] Google DeepMind — Fairwind Program

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *

*