Google週三(3/26)推出最新語音模型Gemini 3.1 Flash Live,並已將它導入語音版聊天機器人Gemini Live及語音搜尋Search Live,同時也宣布把Search Live功能擴展至全球200多個國家與地區。
Gemini 3.1 Flash Live主要強化語音互動的即時性與穩定度。Google指出,新模型在回應速度與語音流暢度上都有提升,讓對話更接近自然語感。在效能評測方面,該模型在衡量多步驟任務處理能力的ComplexFuncBench Audio測試中得分達90.8%,顯示其在語音指令下執行複雜操作的能力較前一代有所提升。
在實際語音情境中,模型的表現也有所改善。在Scale AI的Audio MultiChallenge測試中,Gemini 3.1 Flash Live得分為36.1%,顯示其在面對語音打斷、停頓等情況時,仍能維持指令理解與推理能力。此外,新模型可辨識語速與語調等細節,並可於嘈雜環境中維持語音互動,讓整體使用體驗更穩定。
Google已將該模型導入Gemini Live,讓使用者可透過語音與AI進行連續對話,用於日常查詢、問題解決或創意發想等情境。相較過去語音助理多為單次查詢,Gemini Live可在同一段對話中持續延伸問題,維持交談脈絡。
Google也擴大了Search Live的部署,將語音搜尋功能推向全球200多個國家與地區。Search Live最早於2025年在美國市場推出,當時僅支援英文並屬實驗性質,此次則進一步支援多語言並全面開放,顯示該功能已進入大規模應用階段。
透過Search Live,使用者可直接以語音與搜尋系統進行即時對話,並在同一脈絡中持續提問或補充條件,系統則結合搜尋結果提供回應,改變傳統以關鍵字為主的查詢方式。
Gemini 3.1 Flash Live也整合了SynthID數位浮水印,直接嵌入在模型所生成的音訊中,以利辨識AI生成內容,降低誤用與假訊息風險。
Comments (0)