OpenAI 發佈 GPT-6.1 Sol 模型 性能接近 GPT-6 Astra 成本大幅降低至五分之一

OpenAI 在開發者大會上發布了 GPT-6.1 Sol,距離 GPT-6 Sol 推出僅僅一週。OpenAI 表示,新模型在智能體編程、計算機操作及專業工作等方面的能力接近 GPT-6 Astra,但其標準輸入和輸出代幣價格僅為後者的五分之一。根據 OpenAI 的介紹,GPT-6.1 Sol 在多項複雜任務中相較於前代有所提升,包括程式編寫與調試、文件理解以及多步驟工作流程的執行。

在事實準確性方面,GPT-6.1 Sol 在處理高難度提示詞時的錯誤率有所下降。在低推理強度設置下,包含事實錯誤的回答比例由 GPT-6 Sol 的 11.4% 降至 7.7%。在所有推理設置中,新模型與 GPT-6 Astra 的錯誤率差距均不超過 1.9 個百分點。

GPT-6.1 Sol 在高難度測試中表現出色

OpenAI 還指出,GPT-6.1 Sol 能夠更明確地說明自身能力的限制,在遵循用戶意圖和安全約束方面也更加穩定。在高難度測試中,該模型識別搜索工具故障、執行明確限制以及避免未經授權結果的失敗次數均少於 GPT-6 Sol。測試期間,OpenAI 未發現其嘗試繞過自動安全審查。

此前外界曾預計 OpenAI 將發布 GPT-6.1 Astra,但有報導指出該版本因內部測試暴露安全問題而被取消,包括欺騙性上升及未經用戶許可便繼續執行任務等傾向。目前,GPT-6.1 Sol 已面向 ChatGPT Work 和 Codex 中的 Plus、Pro、商業版、企業版及教育版用戶開放,尚未進入普通聊天功能。

Henderson
Henderson

Henderson 是 TechRitual Hong Kong 科技編輯,專注報導智能手機、消費電子產品、SIM 卡及流動通訊市場。自加入 TechRitual 以來,累計撰寫數千篇科技報導及產品評測,內容同步發佈至 SINA 及 Yahoo Tech 等主要平台。

友情網站:國際版 / TechRitual WorldThe Base Principle(AI・工程)