AnyVoice 聲音複製工具:3 秒樣本把你的聲音做成 AI 配音

AnyVoice 標榜 3 秒聲音樣本就能建立你的 AI 聲音模型,免費層每月 900 秒、單次 120 字元。聲音庫 320 個模型裡精選的是名人聲音,條款與隱私政策裡藏著哪些紅線,註冊前先看完這篇。

用 AI 摘要這篇文章:

如果你最近搜過 AI 語音克隆(voice cloning,台灣比較常叫聲音複製),大概會刷到一個叫 AnyVoice 的網站:首頁掛著「3 秒鐘複製任何聲音」的口號,標榜只要錄 3 秒聲音樣本,就能生出一個屬於你的 AI 聲音模型,之後打字就能讓「自己的聲音」唸稿。

先講結論。用自己的聲音在免費層玩玩,可以,它的入門門檻確實壓得很低。但這個站有兩條紅線你要先知道:第一,它自己的條款把所有授權責任推給用戶,賠償上限卻只有你付過的錢;第二,它的隱私政策對「你上傳的聲音樣本去了哪裡」一個字都沒提。而我實際打開它的聲音庫清點時,發現更微妙的事:條款禁止冒用他人聲音,站方精選推薦的卻是 Elon Musk 和川普的聲音模型。這篇文章把免費額度、聲音庫生態和條款界線一次攤開,你自己判斷要不要註冊。

它做的事情很單純:3 秒樣本換一個你的聲音模型

AnyVoice 目前的網址是 anyvoice.net。如果你照著網路上較舊的介紹文找 aivoicecloning.io,會發現那個網址已經永久轉址到 anyvoice.net,是同一個服務換了門牌。這點值得先記下來,因為網路上流傳的額度數字和用戶數宣稱,可能都停留在換門牌之前,跟現在的站上資訊對不起來。

首頁其實掛著三個功能分頁:文字轉語音、聲音複製、聲音設計。文字轉語音是拿現成聲音唸稿;聲音複製是本篇主角;聲音設計則讓你不交樣本,用文字描述想要什麼樣的聲音去生出一把新聲音,免費層給 5 個聲音設計。多數人是為了第二個分頁來的。

它的核心賣點照首頁說法是「3 秒聲音複製」:上傳或錄一段 3 到 10 秒、單人、乾淨的說話錄音,系統幾秒內建好聲音模型,之後輸入文字就讓這個聲音唸出來,輸出可以下載 MP3 或 WAV。支援的複製語言是中文、英文、日文、韓文四種。站方 FAQ 也老實寫了兩個現階段做不到的事:不能自訂語氣風格(沒辦法指定「悲傷一點」「興奮一點」),也還沒有開放 API。

有個語言數字的落差值得記下來。聲音複製支援四種語言,但站上部分頁面的生成器提供新舊兩版引擎可選,舊版標示 4 種語言附自動降噪,新版標示 85 種語言。也就是說,站方標榜的唸稿語言清單比複製功能長得多,換成「複製你的聲音」就只剩中英日韓。想用自己聲音唸台語或粵語的人,現階段會撞牆。

「3 秒」這個數字要打個折扣看。它是站方宣稱的建模門檻,不是音質保證。複製出來像不像、中文唸得順不順,站方沒有提供任何相似度數字,功能存在與入門門檻則是站上文件明寫的。換句話說,它跟一般文字轉語音工具的差別在於:TTS 是從現成聲音庫挑一把聲音來唸稿,聲音複製是先造一把「你的」聲音,再拿去唸稿。前者像租制服,後者是照你的身形訂做,訂做就得交出你的身形資料,這也是後面兩節的要點。

免費額度的真面目:一次 120 個字元能唸出什麼

免費層的限制比多數人想像的緊。定價頁兩張方案卡的數字如下:

免費方案Pro 方案
價格0 元每月 14.99 美元
單次生成上限120 字元1000 字元
每月音檔額度900 秒(15 分鐘)無限
聲音複製模型數5 個無限
商用授權不允許允許

120 字元是照英文字元計數的口徑,如果照常見的一個中文字算兩個字元的計法,免費層單次大約是 60 個中文字,差不多一則短訊的長度,實際計法要註冊後才會知道。唸一分鐘的稿子要分四五次生成再自己接起來,做影片旁白或配音幾乎一定得升級。900 秒的月額度換算成旁白,大約是 15 分鐘成音檔,試聽幾段有餘,做正事不夠。也要注意商用大門只對付費用戶打開,免費層生成的東西,站方在定價頁與 FAQ 都標明僅限個人與非商業用途,拿去接案或放到營利的頻道,就是在條款允許範圍外使用。

網路上 2025 年中的介紹文寫免費額度是每個月 1200 秒,現在站上明寫 900 秒,比那篇文章寫的少了四分之一。這類閉源服務的額度本來就會浮動,規劃專案時請以當下定價頁為準,不要只採信二手文章的數字。

AnyVoice 定價頁畫面,免費方案標示 Always Free 單次 120 字元,Pro 方案每月 14.99 美元單次 1000 字元Pin
AnyVoice 定價頁:免費層單次 120 字元、每月 900 秒

一個月 14.99 美元在這個品類算中間價位。要付之前值得想清楚兩件事。第一件,服務條款載明訂閱費用原則上不退款,站上雖然另有一份獨立的退款政策頁,但你在付錢那一刻接受的預設就是「這筆錢拿不回來」。第二件,你的用途是不是真的需要「你自己的聲音」。如果只是要一把好聽的聲音唸稿,微軟 Azure 那類現成音源的成本結構完全不同,自架方案甚至能免費拿到清楚授權的聲音,可以看我之前整理的 Azure TTS 自架筆記免費文字轉語音聚合站的額度實查。需要「本人聲音」的場景,例如你自己出鏡的頻道要批次產配音,聲音複製才有不可取代性。

聲音庫打開是另一回事:精選區掛的是 Musk 和川普

到這裡為止,AnyVoice 看起來就是一個規規矩矩的聲音複製服務。聲音庫頁面完整載入後,看到的是另一個生態。

聲音庫共 320 個模型。排在最前面的「精選」區,第一個是 Elon Musk 的聲音模型,顯示被使用 36.9 萬次;第二個是海綿寶寶 SpongeBob SquarePants,24.4 萬次;第三個是 Donald J. Trump,22.5 萬次。往下滑還有 MrBeast、佈道家 Billy Graham、饒舌歌手 2PAC、體育評論員 Peter Drury,以及原神角色。清單裡甚至有一個模型的連結名稱直接叫 elevenlabs-adam,ElevenLabs 正是這個品類裡最有名的商業對手,這個命名是否經過對方授權,頁面上同樣一行說明都沒有。每個模型掛著一個看起來像一般人的上傳者名字,頁面上沒有任何一行字提醒你「用名人聲音需要授權」。

AnyVoice 聲音庫精選區畫面,Elon Musk 聲音模型顯示 36.9 萬次使用,SpongeBob 與川普模型排在後面Pin
AnyVoice 聲音庫精選區:排在最前面的三個模型都是名人與版權角色

也就是說,這個站用「複製你自己的聲音」當正門招牌,側門卻是一整排現成的名人聲音模型,而且這些模型被放在站方精選的位置上引流。點進 Musk 那個模型,它有自己的獨立落地頁,標題寫著「Elon Musk AI Voice Generator」,計數器從 2025 年 4 月底起跳,顯示 36 萬多次使用。

至於「這些名人聲音取得授權了嗎」,頁面上找不到任何說明。免責聲明和授權提醒一概闕如。這不代表每個模型都違法,但代表站方把這個問題完整留給了用戶,下一節會看到條款怎麼寫。

條款把責任全留給你,聲音庫卻自己示範名人聲音

AnyVoice 的服務條款在內容規範第五條寫得很直白:禁止「未經法條要求的權利、授權或同意,複製、模擬或使用他人聲音」,也禁止把生成的音檔偽裝成某人的真實發言,禁止用於詐騙、騷擾、身分冒用。這些限制不分公開或私人用途、不分個人、商業或實驗用途,全部適用。

條款本身寫得不算含糊,問題在於它跟聲音庫的關係。站方一邊把 Musk 和川普的模型放在精選位置,一邊在條款裡要求「使用他人聲音」的你自行取得授權。你照著站方精選的內容用,法律風險是你的;站方展示、推薦、計數,責任條款裡看不到。

條款裡還有兩個一般人容易錯過的句子。一是責任條款:你要就你的內容替平台及其人員做賠償,範圍含律師費,甚至涵蓋你違法使用導致的求償。二是賠償上限:如果平台被判賠,它對你的責任上限是「你付過的費用」。免費用戶的上限就是零。管轄法律則是新加坡,而條款與隱私政策裡都找不到營運公司的註冊名稱,付費前你連對造是誰都不完全清楚。

這不是 AnyVoice 獨有的寫法,閉源 AI 服務的條款多數長這樣。但當服務本體是「複製人聲」這種天生容易被拿去冒充他人的技術,條款把責任完全外包,同時站內示範名人聲音,這個組合就值得你在按下註冊前多想三十秒。

你的聲音樣本去了哪裡,隱私政策沒有答案

聲音複製服務收的東西是「你的聲音」。所以這份隱私政策回答不了三個關鍵問題:樣本保留多久、會不會被拿去訓練模型、刪除帳號時會發生什麼。

答案分別是:沒寫、沒寫、只有半套。

這份隱私政策列舉的資料類型是電子郵件、姓名、電話、IP 位址、裝置識別碼這些制式項目,關於聲音樣本、輸入文字、生成音檔,一個字都沒有出現。保留期限沒有交代,是否用於模型訓練沒有交代,資料跨境傳輸也沒有交代。政策裡唯一跟保存沾上邊的句子,是資料可能暫時留在加密備份裡直到備份輪替或刪除,至於輪替週期多長、涵蓋哪些資料,還是沒有講。對一個靠聲音樣本運轉的服務來說,隱私政策對聲音樣本零記載,這已經超出小瑕疵的等級:文件跟業務對不上。比較之下,同為語音服務的配音平台至少會在條款寫明平台對內容的授權範圍。

帳號刪除倒是有一條明路:設定頁裡的 Danger Zone 有刪除帳號選項,或者寫信給支援信箱,站方會先驗證你的身分再處理。但刪帳號是否連同刪掉已經建好的聲音模型和樣本,文件同樣沒有說。導覽列上另有一頁「生成歷史」,代表你的文字輸入與生成紀錄會留在站內帳號裡,這些紀錄的保存與清除規則,政策一樣沒有著墨。隱私政策也寫明服務不收 13 歲以下用戶。

順帶一提,站上的支援信箱在頁面原始碼裡是用 Cloudflare 的信箱防爬機制遮蔽的,解開後是 [email protected]。這是常見的反垃圾信做法,它是站上少數能對到真實人類的聯繫管道。

想試一次的話,紅線畫在哪裡

整理成可執行的判斷。以下三種人對這個站的答案不同。

想用自己的聲音做個人內容、不營利:免費層就夠你判斷它的中文效果。準備一段 3 到 10 秒乾淨的單人錄音,用手機在安靜房間錄就好,站方 FAQ 也是這樣建議的。重點是把樣本當成「交出去就收不回」的資料看待,因為樣本去向站方沒有承諾任何事。

想商用或需要穩定產線:先確認你願意每月付 14.99 美元,再確認你能接受條款的三個結構:授權責任全在你、平台賠償上限是已付費用、公司主體不透明。它對中文的韻律表現沒有公開測試結果可查,付費前先用免費層把自己的聲音模型建起來聽幾段,再決定。

想用名人或角色的聲音:這條路不建議走。不是因為技術做不到,聲音庫 36 萬次的使用計數說明很多人在用,而是因為用他人聲音生成內容的授權責任在條款裡完全由你承擔,拿去商用幾乎註定落在條款禁止的範圍。想聽明星聲音唸梗圖文字自娛是一回事,發布出去就是另一回事了。

回到一開始的問題:AnyVoice 值不值得用?它把聲音複製的入門門檻壓到 3 秒樣本加免費層,當練習場合格。但它同時經營著一個名人聲音模型庫,用條款把自己摘乾淨,隱私文件對核心資料隻字不提。把它當工具用之前,先把它當一份契約讀完,這份契約對你不算友善。

Sliven 褚崇名
Sliven 褚崇名

每日分享科技新知、免費資源以及 WordPress、虛擬主機相關主題,任何問題歡迎在科技月球下方留言,或是發送 Email 至 [email protected] 與我聯繫。

文章: 1274

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *


Share to...