Google 雙重出擊:Gemini「Call for Me」替你打電話給商家,Live Avatar 畀 AI 一張會說話的臉

  • AI
  • 25 9 月, 2026

人工智能終於走到這一步:它不只是替你搜尋資料,還會親自「拿起電話」替你打給商家。Google 昨日(9 月 24 日)連環出手,一邊在 Pixel 11 上推出「Call for Me」AI 通話功能,讓 Gemini 替用戶致電商家訂位、查存貨、改期;一邊為企業版 Gemini 3.8 Live 帶來「Live Avatar」,讓 AI 擁有一張會對嘴、有表情的即時虛擬面孔。兩項更新同一日發佈,標誌著 Google 正把 Gemini 從「聊天機械人」推向「真正替你辦事的 AI 代理」。

Call for Me:Gemini 替你打電話、聽等候音

「Call for Me」目前以「早期實驗」(early experiment)形式,向美國 Pixel 11 用戶推出。凡已訂閱 Gemini 付費方案並加入 Phone by Google 公開測試的用戶,只要在 Gemini 應用內說一句「幫我打給那間餐廳」,AI 就會以你自己的電話號碼撥出,主動向對方表明自己是 AI 助理,然後自行完成任務:查詢某件貨品有沒有現貨、預約訂位、改約時間——甚至替你聽完那段漫長的等候音樂。

用戶以智能手機通話的情境,代表 Gemini Call for Me 功能
Gemini「Call for Me」讓 AI 替用戶致電商家處理訂位、查詢貨品等日常事務。來源:Wikimedia Commons(CC0)

與去年版本的關鍵分別在於「控制權」:整通電話期間,用戶可透過即時文字記錄(live transcript)看到 AI 與對方的每一句對話,並可隨時一鍵接管通話。這是 Google 繼「Hold for Me」(替你等候)和「Direct My Call」(替你按語音菜單)之後,把手機通話自動化再推前一大步——由「輔助」升級到「代辦」。

Live Avatar:AI 終於有了一張會說話的臉

同日另一頭,Google 為企業客戶正式發佈 Gemini 3.8 Live 的「Live Avatar」功能。它為 AI 的語音對話加上近乎即時生成的視頻面孔:虛擬化身會隨著說話內容對嘴(lip-sync)、做出表情變化,還能在 97 種語言之間即時切換——官方示範中,同一個化身先用英語、再切日語,嘴形與發音依然精準對齊,且不會出現畫質下降或視覺漂移。

人工智能生成的數碼面孔,代表 Gemini Live Avatar 虛擬化身
AI 生成的數碼面孔:Live Avatar 為企業版 Gemini 3.8 Live 帶來會對嘴、有表情的即時虛擬化身。來源:Wikimedia Commons(Public Domain)

Google 提供預設化身庫供企業選擇,也允許機構自訂專屬化身。所有輸出均帶有隱形的 SynthID 數碼浮水印,並設有「尊重身份」(respect identity)的保障措施,防止被挪用於冒充真人。功能即日起在 Gemini Enterprise 開放,距離 Google 公佈 Gemini 3.8 Live 模型(強調近乎即時的視覺輸入處理)僅約一星期。

雙箭頭的戰略意涵:AI 代理大戰全面升級

把兩項更新放在一起看,Google 的意圖相當清晰:ChatGPT 時代的 AI 是「你問它答」,而下一階段的 AI 必須「替你動手」。Call for Me 解決的是 AI 代理最後一哩——現實世界中仍有大量交易必須透過一通電話完成;Live Avatar 則解決信任與臨場感——當 AI 替企業面對客戶時,一張會對嘴的臉能大幅降低溝通的疏離感。

Google 紐約切爾西門市所在的 Google 辦公大樓
Google 同日發佈 AI 通話與虛擬化身兩大功能,全面搶進 AI 代理市場。來源:Wikimedia Commons(CC BY-SA 4.0)

競爭對手也沒閒著:Meta 正為其 Muse AI 代理開發類似的自動通話功能(不過據報部分電話背後可能仍是真人接線);OpenAI 的 Operator、Anthropic 的 Claude 電腦操作功能則走的是螢幕內代理路線。Google 的差異化在於它同時握有手機作業系統(Android/Pixel)、對話模型(Gemini 3.8)與企業通路(Gemini Enterprise),能把「語音—行動—形象」三件事一次打通。

值得留意的隱憂

當然,AI 主動打電話給人類也引發新的疑慮。接線的商家員工未必知道自己正在與 AI 對話(Google 稱 AI 會主動表明身份,但執行細節仍有待觀察);AI 生成面孔技術普及後,視訊詐騙的門檻可能進一步降低——SynthID 浮水印有助溯源,但目前並非所有影片平台都會讀取。此外,功能初期僅限美國 Pixel 11 付費訂閱用戶,何時擴展至其他地區與機型仍是未知數。

結語

從「Hold for Me」到「Call for Me」,從文字聊天到有臉有表情的 Live Avatar,Google 正在把 AI 從手機裡的助理,變成能在現實世界代你出面辦事的分身。對一般用戶而言,擺脫等候音與語音菜單或許已是即時可感的改善;對企業而言,能以 97 種語言即時現身的 AI 客服也不再遙遠。AI 代理大戰的下半場,比拼的將不再只是模型分數,而是誰能真正替用戶「打通那通電話」。


🎬 相關影片

Google雙重出擊:Gemini替你打電話給商家,Live Avatar畀AI一張會說話的臉

Related Posts

  • 24 9 月, 2026
砸10億美元練機械人:Figure Helix 2.5 走進30個陌生家庭,家事成功率暴增6倍

Figure AI 最新一代神經網絡 Helix 2.5 在 30 個從未見過的灣區家庭完成 237 項家事任務,成功率 56%,比無預訓練基線的 9% 暴增 6 倍。鋪床 67%、摺毛巾 62%、收拾玩具僅 40%,執行長 Adcock 稱之為「業界聖杯」的零樣本泛化。背後功臣是 8 月推出的 Index 數據平台,每秒收集約 35 分鐘人類行為影片。同日高通宣布收購機器人軟體公司 PickNik,實體 AI 軍備賽全面升溫。

  • 23 9 月, 2026
90分鐘AI大戰:Opus 5.5 減價40%迎戰 GPT-6 Sol/Luna 半價夾擊

2026年9月22日,Anthropic 搶先90分鐘發佈 Claude Opus 5.5,OpenAI 同日推出半價 GPT-6 Sol 與 Luna 回擊,雙方官網互點對手跑分。本文解析這場AI模型價格戰的技術細節、三級定價陣型與背後的算力、開源壓力及IPO敘事,並提供企業多模型選型建議。