即時快訊
BCCTaipei「2026優良企業貢獻獎」歡慶十週年 新增永續金融卓越獎 表揚企業永續實踐與社會影響力 從紐西蘭乳品選品到日常飲食提案 好健康 HealthyWay以透明資訊拓展食品版圖 如何讓學古箏走得更長久?中和古箏王朝創辦人從多年教學經驗談起 人工智慧滲入戰場:機器決策失誤,責任誰屬成全球難題 美國總統任期轉換:股市震盪史鑑證長期成長 全球資產管理業者 GCM LLC 結盟 LSH Vensora 搶攻亞太市場 AI代理加速數位勞動轉型 客服與製造業職缺受衝擊 AI 代理程式工具整合複雜,新方案以 TypeScript 與 JSON Schema 統一規範 美國支援泰國小型模組核反應爐可行性研究 強化印太能源安全 美國力促印尼成東協戰略貿易典範 攜手應對軍商兩用技術挑戰
圖/本報AI製圖(示意圖)
科技生活

·6 months ago·林昭衡
#Google#AI模型#Gemini#語音助理#科技創新
圖/本報AI製圖(示意圖)
圖/本報AI製圖(示意圖)
商傳媒|林昭衡/綜合外電報導
摘要

Google 今日發表最新的語音 AI 模型 Gemini 3.1 Flash Live,大幅提升多步驟任務執行與對話品質,在 ComplexFuncBench Audio 基準測試中任務準確率達 90.8%。新模型提供更自然、智慧的互動體驗,並已透過開發者、企業及一般用戶管道推廣,同時將 Search Live 服務擴展至全球逾 200 個國家和地區。

Google 今日宣布推出其最新語音人工智慧模型 Gemini 3.1 Flash Live,並同步對旗下 Gemini Live 和 Search Live 等 AI 應用服務進行重大升級。這款模型在多步驟任務執行及對話品質上實現顯著突破,其中在 ComplexFuncBench Audio 基準測試中,任務準確率更達到 90.8%。

Gemini 3.1 Flash Live 的推出,旨在提供更快、更智慧的回應,並大幅減少過去 AI 語音互動中常見的尷尬停頓。相較於前一代 Gemini 2.5 模型,新模型不僅擁有兩倍的上下文視窗,還能根據語境調整回答長度與語氣,更精準地辨識語音中的情緒(如沮喪與困惑),使其互動體驗更加自然流暢。此外,新模型在偵測聲音細微差別方面也有所提升,例如更準確地判讀語音的音高與節奏,避免生成過於機械化的對話。

Google 正透過三種管道推動 Gemini 3.1 Flash Live 的應用。開發者可透過 Google AI Studio 中的 Gemini Live API 預覽版立即存取,為其應用程式打造語音優先的 AI 代理。企業客戶則可透過 Gemini Enterprise for Customer Experience 整合此模型,以優化顧客服務體驗。據悉,Verizon、LiveKit 和 Home Depot 等企業已在其生產工作流程中測試此模型。

一般使用者則可透過 Search Live 和 Gemini Live 體驗其功能。受惠於 Gemini 3.1 Flash Live 的多語言能力,Google 已將 Search Live 擴展至全球超過 200 個國家和地區,支援所有 Gemini 目前提供的語言。使用者只需在 Google 應用程式的搜尋欄下方點擊「Live」圖示,即可透過語音或鏡頭與 AI 助理進行即時對話,甚至利用 Google Lens 詢問周遭環境資訊。為確保內容透明度,所有由 Gemini 3.1 Flash Live 模型生成的音訊,都將嵌入 SynthID 浮水印,以便識別 AI 生成的內容。

Google 也在今日推出了聊天記錄轉移(Chat Transfer)和記憶體匯入(Memory Import)工具,讓使用者更方便地轉換至 Gemini 平台。開發者目前已可透過 Google AI Studio 預覽版立即開始使用 Gemini 3.1 Flash Live,為未來的語音 AI 應用奠定基礎。