OpenAI 正式發佈 GPT-6 Astra 模型 提升 ChatGPT 與 Codex 能力

OpenAI 正式公佈全新模型 GPT-6 Astra,聲稱其為全球最具智能且對齊程度最高的系統。Astra 整合多年來在預訓練、強化學習及對齊研究方面的大規模投入,於電腦操作、瀏覽器使用、軟體工程、網絡安全、科學研究及專業工作領域均達到業界領先水平。在 FrontierMath Tier 4 基準測試中,Astra 取得 98 分的成績,並已協助解決多個長期懸而未決的數學難題;同時在 ARC-AGI-3 測試取得 99.9 分,在 ExploitBench 取得 100 分的滿分成績。

Astra 在電腦操作方面表現突出,能在使用者於 Mac 或其他桌面裝置工作期間,於背景執行複雜任務。OpenAI 指出,模型結合瞭解決複雜問題所需的智能,以及執行多步驟工作流程並產出完善文件、試算表及簡報的能力。Astra 亦被譽為目前軟體工程領域表現最佳的模型。在 Codex 方面,Astra 引入全新的上下文管理機制,當上下文視窗填滿時能保留並檢索過往對話紀錄,解決傳統壓縮方式可能遺漏修正失敗原因或元件運作細節的問題。

此實驗功能現已開放啟用,未來數週將成為 Astra 的預設選項。

Astra 於網絡安全領域達到關鍵門檻

OpenAI 強調,Astra 在網絡安全能力方面實現重大躍進,符合該公司 Preparedness Framework 框架下所訂定的「關鍵」門檻。基於安全考量,模型將以較緩慢的速度向用戶推出。Astra 今日起率先向部分機構開放,未來數日內將陸續供所有 ChatGPT Plus、Pro、Business 及 Enterprise 用戶使用,並透過 OpenAI API 及 AWS 提供服務。

Astra 的用量計入現有訂閱額度內,用戶及企業另可購買額外點數。Pro、Business 及 Enterprise 方案的用戶更可使用 GPT-6 Astra Pro 版本;企業管理員可為其工作空間啟用 Astra,預設狀態為關閉。

從 GPT-5 至 GPT-6 的演進歷程

GPT-5 於 2025 年 8 月 7 日推出,取代 GPT-4o 及多個推理模型,成為 ChatGPT 的預設模型。其核心特色為自動路由功能,ChatGPT 會根據需求即時回應或啟動深度推理。OpenAI 同時宣稱其事實錯誤較 GPT-4o 有所減少。Apple 於 iOS 26、iPadOS 26 及 macOS Tahoe 26 中採用該模型,ChatGPT 請求透過 Apple Intelligence 處理,包括 Siri 交接、寫作工具及視覺智能等功能,均由 GPT-4o 轉為使用

GPT-5。同年 11 月推出的 GPT-5.1 提供更溫暖自然的回應;12 月因應 Gemini 競爭,內部發出「紅色警報」後加速推出 GPT-5.2,以強化專業工作表現。其後推出的 GPT-5.3 Instant 針對 ChatGPT 被詬病的「尷尬」語氣進行調整,兩日後再發佈配備一百萬 tokens 上下文視窗及內建電腦操作功能的 GPT-5.4 Thinking。

OpenAI 此後陸續推出 GPT-5.4 mini 與 nano 輕量版本、設有限制的 GPT-5.4-Cyber、用於更自主工作的 GPT-5.5、GPT-5.5 Instant,以及 7 月份的 GPT-5.6 Sol、Terra 及 Luna 系列模型。軟體配套方面,OpenAI 於 2 月推出獨立的 Codex Mac 應用程式,作為執行多個編碼代理、審核變更及排程工作的中樞。

7 月時,Codex 實際上取代原有 ChatGPT 桌面應用程式,整合 Chat、Work 及 Codex 功能,原生客戶端則改名為 ChatGPT Classic。OpenAI 表示,最新 GPT-6 模型初期僅供其網絡安全導向的 Daybreak 計劃成員使用,此發佈節奏與上代 GPT-5.6 的安排相若。

Henderson
Henderson

Henderson 是 TechRitual Hong Kong 科技編輯,專注報導智能手機、消費電子產品、SIM 卡及流動通訊市場。自加入 TechRitual 以來,累計撰寫數千篇科技報導及產品評測,內容同步發佈至 SINA 及 Yahoo Tech 等主要平台。

友情網站:日本語版 / TechNipponThe Base Principle(AI・工程)