Google 發佈 Gemini 3.8 Live 及 Gemini 3.8 Live Extended Thinking 以提升 AI 對話體驗

Google 今日宣佈推出 Gemini 3.8 Live 及 Gemini 3.8 Live Extended Thinking,稱之為其「最先進的即時對話模型」。繼 3.1 Flash Live 於三月推出後,這些新模型旨在使與人工智能的對話更具直觀性和智能性。顧名思義,Gemini 3.8 Live Extended Thinking 提供「增強的智能和多步推理」,適用於高複雜度的任務,例如最近推出的 Gmail Live(對話搜索)、Docs Live(草稿生成和編輯)及 Keep Live(筆記創建)。

該模型亦開始在 Gemini Live 上推廣,3.8 Live Extended Thinking 能夠「同時推理和講述」。

該模型為複雜的工作流程提供增強的智能,同時保持連貫的對話流,使用早期的口頭提示,例如「讓我檢查一下……」,以自然地回應提示,並透過即時進度敘述,引導用戶在多步驟的背景任務中逐步完成。就基準測試而言,「在人工分析語音對語音質量指數中,總體排名第一(82.6)」;「在代理任務完成率方面,以 68.6% 的得分領先於 τ-Voice」;「在 Sierra 的 τ-Voice-banking 基準中得分 35.1%」;「具備強大的推理能力,在 Big Bench Audio 中得分 97.7%,同時在與其他前沿模型相比時保持高競爭價格。」

Gemini 3.8 Live 提供增強的對話智能

同時,Gemini 3.8 Live 基本模型提供「具有流暢對話和視覺基礎的對話智能」。該模型能夠近乎即時地處理「視覺輸入」,並在對話持續進行的同時,背景執行工具和 API 調用。用戶可以期待該模型在背景任務完成的同時,能夠「回應請求並持續對話」。此外,它還能夠在對話中檢測並在 97 種支持的語言之間切換。該模型「為擴展和成本效益而設」,並在「語音代理競技場中名列第二」。

Gemini 3.8 Live 將為 AI 模式的 Search Live 體驗提供支持。

Henderson
Henderson

Henderson 是 TechRitual Hong Kong 科技編輯,專注報導智能手機、消費電子產品、SIM 卡及流動通訊市場。自加入 TechRitual 以來,累計撰寫數千篇科技報導及產品評測,內容同步發佈至 SINA 及 Yahoo Tech 等主要平台。

友情網站:日本語版 / TechNipponThe Base Principle(AI・工程)