Google 六週內第三度推出 Gemini 3.8 Flash 增設網絡安全專用變體

Google 近日正式發佈 Gemini 3.8 Flash,這是該公司在短短六星期內推出的第三款 Flash 系列模型。與此前版本不同,此次發佈包含兩個變體:面向通用場景的 Gemini 3.8 Flash,以及專攻網絡安全的 Gemini 3.8 Flash Cyber,分別定位為 Google「最聰明的主力工作模型」和「最強網絡安全模型」。

從性能表現來看,Gemini 3.8 Flash 在多項基準測試中展現出超越更大規模模型的能力。在衡量自主解決複雜工程問題能力的 DeepSWE v1.1 測試中,該模型得分 73.7%,略低於 Claude Opus 5 的 74%,但明顯優於 Gemini 3.7 Flash、Claude Sonnet 5、GPT-5.6 Sol 及 GPT-5.6 Terra 等競爭對手。

此外,在 Vals Finance Agent v2 金融分析、Harvey 法律智能體基準、CharXiv Reasoning 資訊綜合、Terminal-bench 2.1 終端編碼以及 LVBench 長影片理解等多項測試中,Gemini 3.8 Flash 同樣領先於上述對手。

Google 表示 Gemini 3.8 Flash 「工作更努力」並解釋定價策略

Google 解釋稱,3.8 Flash 之所以表現更優,是因為該模型「工作更努力」。面對複雜任務時,模型會主動執行額外的推理步驟以提升輸出質素,當然這亦意味着在某些情況下會消耗更多 token。定價方面,Gemini 3.8 Flash 現時處於首發優惠期,輸入 token 價格為每百萬 US$0.75 (約 HK$5),輸出 token 為每百萬 US$3.75 (約 HK$29),其後將上調至 US$1.50 (約 HK$11) 及 US$7.50 (約 HK$58)。

即便如此,其價格仍低於 Claude Opus 5 和 GPT-5.6 Sol 等同類產品。

Gemini 3.8 Flash Cyber 聚焦網絡安全並僅限特定用戶使用

Gemini 3.8 Flash Cyber 則是一款更為特殊的模型,目前僅通過 Google 新設立的 Fairwind 計劃向特定用戶開放,包括可信政府機構、關鍵基礎設施營運商以及軟件維護人員。在 C/C++ 漏洞檢測的行業標準測試中,該模型得分 86.2%,超越前代 Gemini 3.5 Flash Cyber 以及 Mythos 5、GPT-5.5-Cyber 等更大規模的模型。

在覆蓋 20 多種程式語言的真實漏洞發現場景中,其成功率達到 71%,大幅高於 Gemini 3.7 Flash 的 58.9% 和 Gemini 3.5 Flash Cyber 的 46.6%。

該網絡安全模型的另一大亮點在於自動化補丁生成能力。據 Google 公佈的數據,Gemini 3.8 Flash Cyber 為 Chrome 瀏覽器漏洞生成的正確補丁數量,是「規模大得多的最佳商用模型」的 2.6 倍。對於普通用戶而言,雖然不會直接與這一模型互動,但其在防禦端和開發端的改進將間接提升日常使用的技術產品的安全性。

現時,Gemini 3.8 Flash 已向開發者、企業客戶以及 Google AI Pro 和 Ultra 訂閱用戶開放。Gemini 3.8 Flash Cyber 的存取權限則僅限於 Fairwind 計劃成員。

Henderson
Henderson

Henderson 是 TechRitual Hong Kong 科技編輯,專注報導智能手機、消費電子產品、SIM 卡及流動通訊市場。自加入 TechRitual 以來,累計撰寫數千篇科技報導及產品評測,內容同步發佈至 SINA 及 Yahoo Tech 等主要平台。

友情網站:日本語版 / TechNipponThe Base Principle(AI・工程)