AI 企業新模型競爭加劇 Grok 4.6 表現突出 DeepSeek 漲價引發爭議

近期,各大人工智能企業密集發佈新模型。SpaceX 旗下的 xAI 發佈了 Grok 4.6,DeepSeek 推出了 V4 Pro 0813, Google 推出了 Gemini 3.7 Flash,而 OpenAI 則展示了每秒可處理 750 個 token 的 “UltraFast” 極速模式。Grok 評測機構 Artificial Analysis(AA)的分析報告顯示,Grok 4.6 的綜合智能指數達到 61 分,與 GPT-5.6 Sol 並列第三,較前代暴漲 23 分。

不僅如此,其價格保持不變(每百萬 token 輸入 US$2 (約 HK$16)、輸出 US$6 (約 HK$47)),遠低於同分數的 GPT-5.6 Sol。

在智能體任務方面,Grok 4.6 的表現也相當突出。GDPval-AA v2 得分 62% 僅次於 Claude Opus 5,而 τ 3 -Banking 金融測試則與阿里巴巴求文 Max 3.8 並列第一,被認為具有超越單價的結構性成本優勢。AA 智能指數方面,DeepSeek V4 Pro 0813 的 AA 智能指數達 53 分,在評測中排名第七。

其單任務成本僅需 6 美分,在全部 104 個模型中位居第二,是同價位段中最具性價比的選擇。然而,該公司宣佈上調 API 費用,高峯時段的緩存命中輸入費用將激增近 12 倍。業界指出,此舉可能動搖其“低成本實用型 AI”的市場定位。

Grok 4.6 在智能體任務中表現優異

Google 推出的 Gemini 3.7 Flash,AA 智能指數為 56 分。其最大亮點在於輸出速度——每秒可處理 340 個 token,較 GPT 5.6 Tera 快近 3 倍。此外,其較前代的定價便宜一半。OpenAI 為 GPT 5.6 Sol 模型新增了 “UltraFast” 模式,通過與 Cerebras 合作實現每秒 750 個 token 的輸出速度,較標準處理提升最高 14 倍,並宣稱“在保持智能無損的前提下實現高速運算”。

在此次模型競爭中,Anthropic 依然保持沉默。雖然有傳言稱 Fable 5.1 已完成開發,但按照 Anthropic 今年 4 到 8 周的發佈節奏,預計在 8 月下旬至 9 月初可能會有新品面世。

想睇更深入嘅 AI 模型與工程科技報道?
前往 The Base Principle 繁體中文 AI 新聞 →
Henderson
Henderson

Henderson 是 TechRitual Hong Kong 科技編輯,專注報導智能手機、消費電子產品、SIM 卡及流動通訊市場。自加入 TechRitual 以來,累計撰寫數千篇科技報導及產品評測,內容同步發佈至 SINA 及 Yahoo Tech 等主要平台。

友情網站:日本語版 / TechNipponThe Base Principle(AI・工程)