一龍馬/AI 情報站讀懂消息背後的脈絡
星期五
搜尋

官方稱系統可跨 97 種語言切換並調整唇形與表情,輸出會嵌入 SynthID;目前已納入 Gemini Enterprise,自訂角色則只對獲准企業開放

中文摘要

Google DeepMind 發表 Gemini 3.8 Live with Live Avatar,把即時語音對話與低延遲串流影像結合,讓企業代理能同步接收影音、以虛擬角色回應,並在對話不中斷時於背景呼叫工具。官方稱系統可跨 97 種語言切換並調整唇形與表情,輸出會嵌入 SynthID;目前已納入 Gemini Enterprise,自訂角色則只對獲准企業開放。上述能力與效能均來自官方介紹,現有節錄未提供第三方測試結果。

一龍馬判讀

客服、導覽與企業代理可從純語音介面轉向即時影音互動,但客製角色涉及身分冒用、品牌授權與誤導風險;浮水印的實際可偵測性仍須外部驗證。

原文節錄

Google DeepMind

Live Avatar features native multilingual speech-to-speech synchronization.

取得部分原文 · 不代表內容已獨立查證

查看原文
完整收錄文字與來源

Introducing Gemini 3.8 Live with Live Avatar

收錄日期
2026-09-25
來源
官方 RSS+Hacker News Algolia API
抓取時間
2026/09/25 06:00(台北)
來源資料
官方來源