Google 官方宣布推出新一代模型 Gemini 4 Argon,該模型在複雜工作流程中提供前沿性能,適用於現實世界的軟件工程、法律和金融等企業知識工作,以及網絡安全防禦。
Gemini 4 Argon 的核心功能與應用
Gemini 4 Argon 模型具備先進的推理能力,專為處理複雜的長期專業任務而設計。該模型的輸入令牌限制達到業界領先的 100 萬個,能夠支持深度的多步驟問題解決。它在編碼、金融研究、法律起草及自主網絡安全漏洞修補等方面表現卓越。
「今天,我們宣布我們的新前沿模型 Gemini 4 Argon,該模型正通過 Fairwind 計劃向一組受信任的網絡防禦者推出。」
Google
強調安全性與測試的重要性
Google 強調,安全地釋放此級別的前沿能力需要分階段進行。公司正在積極參與美國政府的自願預發布模型訪問程序,同時逐步擴大訪問範圍。Google 將繼續收集早期測試者的反饋,以便在向開發者、企業和消費者提供 Argon 之前進行調整。
「我們會在推出 Argon 時,保持對安全性的優先考量,並進行嚴格的測試。」
Google
Gemini 4 Argon 的商業價值與影響
Gemini 4 Argon 在內部工作流程中已經發揮作用,幫助 Google 的工程師提高生產力,並推動工程突破。該模型在 DeepSWE v1.1 的表現達到 77.9%,顯示其在現實世界長期軟件工程任務中的優越性能。此外,Argon 在 Vals Index 上也表現出色,成為金融、編碼、法律和稅務工作的領先模型。
「Argon 在長期視頻理解方面的表現達到 91.7%,顯示其在專業圖表分析及長視頻識別中的能力。」
Google
網絡安全防禦的創新應用
為了更好地裝備網絡防禦者應對新時代的網絡攻擊,Google 將 Gemini 4 Argon 訓練為具備強大網絡安全防禦能力的模型。Argon 能夠自主發現、驗證及修補關鍵軟件漏洞,並在 Wiz 的 Scan for Good 計劃中得到應用,該計劃旨在免費保護關鍵公共基礎設施。
「在 Wiz 的內部黑箱滲透測試基準中,Argon 在發現攻擊面、識別漏洞及生成驗證證據方面的表現超越了以往的模型。」
Google
資料來源:Google 官方公告

