谷歌推出 Gemini AI 虛擬分身功能 兩分鐘複製用戶聲形

Date:

商傳媒|何映辰/台北報導

谷歌近日於其 Gemini 應用程式中推出一項劃時代的 AI 虛擬分身功能,允許用戶在短短兩分鐘內,輕鬆複製自身面部影像與聲音,進而生成個人化的 AI 影片。這項創新由谷歌全新的 Gemini Omni 模型驅動,目前已向付費訂閱用戶開放使用,預期將為人工智慧互動體驗帶來全新變革。

過去,製作高擬真度的數位分身或訓練客製化語音模型,往往需要專業軟體、昂貴硬體以及數小時的處理時間。然而,谷歌透過流暢的行動裝置設定流程,大幅降低了這些技術門檻。用戶只需在 Gemini 網路應用程式中點擊設定齒輪,選擇「Avatar」選項,即可進入安全的啟用畫面,透過手機前置鏡頭進行設定。訓練過程僅包含兩個快速階段:首先是鏡頭訓練,要求從不同角度捕捉用戶面部;接著是語音訓練,要求用戶朗讀隨機的短語和數字。完成設定後,谷歌會將用戶的數位肖像安全地綁定至其帳戶,並以特定的用戶名稱標籤呈現。

一旦設定完成,用戶的虛擬分身便會常駐於 Gemini 應用程式的工具箱中,無需再次上傳自拍照或語音片段即可隨時取用。據《Chrome Unboxed》報導,一名測試用戶曾向 Gemini 聊天框輸入指令,要求其虛擬分身「向我介紹如何輕鬆製作 Gemini 虛擬分身,並將背景設定為芝加哥天際線的頂樓景色」。最終生成的影片,雖然需時數分鐘處理,但其面部追蹤、微表情和唇形同步效果令人驚豔,合成的語音語調也與用戶特有的說話風格高度吻合。

考量到深度偽造(deepfakes)和身份盜用的潛在疑慮,谷歌已實施多項隱私保護措施。該工具僅限年滿 18 歲的用戶使用,且在設定過程中,帳戶持有人必須本人實際在場。此外,透過 Omni 模型產生的每一個影片檔案,都會永久嵌入谷歌開發的隱形數位浮水印 SynthID。這項技術允許任何人在 Chrome 瀏覽器中透過點擊滑鼠右鍵,或透過搜尋功能,驗證影片的真實性,確保內容來源可被追溯。

7fc70a2a 9c70 4947 a8e2 37380a3992ca

相關新聞推薦

正在載入相關新聞…

Share post:

spot_imgspot_img

熱門

相關新聞
Related

響應AI新十大建設浪潮—智域Novaryn Labs攜手產業推動科技創新、人才培育與永續發展

「智域Novaryn Labs」以科技創新驅動未來,以永續公益創造價值,攜手迎接AI智慧新時代。在AI時代快速到來之際,智域Novaryn Labs持續投入科技創新推廣、AI產業交流、數位轉型教育及人才培育工作,並結合永續發展與公益理念,積極參與智慧科技生態圈建設,希望透過跨領域合作與資源整合,共同推動台灣產業升級與人才發展。

從一場旅行找到人生方向—永續生活倡導者劉鴻鑫打造「晴日悠境」推廣旅行與素食文化:打造結合健康、交流與善念的生活平台

永續生活倡導者劉鴻鑫秉持「以旅行拓展視野、以素食尊重生命」的理念,創立結合旅行、健康與素食文化的交流平台—晴日悠境,希望透過社群凝聚志同道合的人,一同分享生活、交流想法,實踐健康、友善且充滿善念的生活方式。

回顧花蓮震後重建之路!「晨曦綠苑」晨爸范昊晨團隊無私奉獻:去年923熱血身影成災民心中最暖陽光

花蓮近年經歷多次大自然考驗,在各界攜手努力下,災區已逐步走出陰霾、重現生機。回顧去年(2025年)9月23日災情最為嚴峻的時刻,知名民間力量「晨曦綠苑」與創辦人范昊晨(晨爸)團隊在第一時間挺進第一線的無私身影,至今仍讓許多花蓮鄉親感念在心。

【專題報導】創辦人林柏宇:以金融技術轉化公益,讓善意成為新時代的價值語言

今年47歲的創辦人林柏宇,目前投身金融技術整合領域,具備賓夕法尼亞大學華頓商學院背景,並擁有 CFP 認證理財規劃顧問、FRM金融風險管理師、Geprüfter Betriebswirt 認證企業管理師等專業資歷。