TechMoon 科技月球
WordPress、SEO 與 AI 工具實測指南
TechMoon 科技月球
WordPress、SEO 與 AI 工具實測指南

ElevenLabs 於 2026 年 9 月 21 日發布 Studio 4.0,把 AI 影片生成、圖片、旁白、音樂、音效與字幕整合到 ElevenCreative 的同一條時間軸,並讓 Studio Agent 先做初剪。免費方案只能生圖片且每日限 3 次,影片生成從每月 6 美元開始,圖片與影片模型全來自第三方供應商,條款對輸出的侵權也不提供補償。
用 AI 摘要這篇文章:
ElevenLabs 在 2026 年 9 月 21 日於官方部落格發布 Studio 4.0,把 ElevenCreative 裡的影片編輯器改版成官方口中的「AI 原生」工作台:用文字描述鏡頭,生成結果直接落在專案時間軸上,旁白、音樂、音效、字幕與圖片全在同一個地方生成與修改,輸出也不必離開編輯器。發布文由 Isaac Aderogba 與 Aneri Amin 署名,產品頁標題也已換上 Studio 4.0。
Seedance 系列除了被平台整合,原生 API 也有自己的工作流設計,像 Seedance 2.5 草稿模式就把試錯成本壓到 480p 價位再出正片。

先講三個會直接影響使用決定的事實。免費方案不能生成影片,只能生圖片,而且每天限 3 次請求;影片生成從每月 6 美元的 Starter 方案開始。圖片與影片的生成模型全部來自第三方供應商,清單裡有 OpenAI 的 Sora 2、Google 的 Veo 3、Kling 3.0 與 Seedance 系列。服務條款還明文寫著:平台對圖片與影片輸出的第三方智慧財產權侵權主張,不提供補償保證。
官方發布文對這次改版的定位寫得很直白:影片製作通常拆在好幾個工具之間,一個生成畫面、一個配旁白、一個做音樂、一個剪輯,Studio 4.0 要把整段流程收進單一專案。描述你缺的鏡頭,它生成後直接放到時間軸上,與旁白、音樂、音效、圖片並排。
這個改動真正的分量在重做的方式。過去某個鏡頭不理想,流程是到生成平台重新產出、下載檔案、再匯入剪輯器替換,接著重新對齊聲音。現在鏡頭在原位重新生成或調整,後面的旁白、音效與字幕不必全部重排。發布文的說法是,因為生成發生在專案裡,迭代才快得起來。
時間軸本身也重建過,官方列出三個針對精度的設計:逐格縮放,把時間軸放大到單一畫格,讓切點與音效落在精確位置;片段吸附,素材自動貼齊鄰近切點,減少留白或重疊;移動素材時保持同步。字幕在這版被當成一般片段處理,一句字幕可以拆開、兩段可以合併、打錯的字直接改,不必重新轉錄整支影片。
播放引擎也重建了。官方宣稱專案變大後,拖曳、定位與預覽在長時間軸與多圖層的情境下仍然流暢。這句話目前只有產品方自己的說法,沒有第三方測試可以對照,需要處理長片的人要自己驗證。
從時間軸看得出這次改版的性質:既有元件的整合。Image & Video 生成服務在 2025 年 11 月 17 日就推出,Studio Agent 在 2026 年 5 月 7 日先行上線,ElevenCreative 的範本功能同年 5 月 13 日跟進。Studio 4.0 做的事,是把生成、代理與範本接到同一條時間軸上。
Studio Agent 是內建在專案裡的對話式協作剪輯助手,官方文件寫明它只在影片專案中提供。使用方式是描述想法,它先問清楚影片長度、調性、結構與轉場,再排出第一版時間軸:放置片段、生成旁白、搜尋聲音、對齊音效與字幕。你可以隨時接手手動剪輯,改完再交給它繼續,官方強調它會尊重你的修改,從你停下的地方接著做。
官方最強調它的逐格分析能力。官方文件說它會對影片建立畫格層級的內容地圖,所以你能下「商標出現時加一個咻聲」這類跟畫面時點有關的指令,音效會被放在精確的視覺時間點,不用手動拖時間軸找位置。
代理有兩種模式,用編輯器頂部的開關切換。Create 模式直接動時間軸,插入片段、生成素材、加上文字疊加、調音訊;Plan 模式只提計畫不動手,先讓你審它的打算再執行。Plan 模式下它仍然可以分析影片、轉錄語音、搜尋素材與聲音模型、起草腳本與場景規劃、計算時間軸的缺口安排,並提供 TikTok、YouTube 與 Instagram 的平台建議。
模型選擇也交給代理。它從 5 個預定義圖片模型與 5 個預定義影片模型中挑選最適合的,這點官方文件寫得清楚,你確認生成前也能換成別的。要注意的是整個 Studio Agent 只有網頁版,沒有 API。
計費方式值得看清:代理對話按五種 token 消耗計量:輸入、輸出、思考、快取讀取與快取寫入,總成本取決於對話裡各項的消耗量,沒有固定的每次互動價格;語音、圖片、音樂、音效與影片生成另外按各服務的標準費率扣點數。換句話說,讓代理多做幾輪初剪,帳單會同時吃掉對話與生成兩層點數。
打開官方的影片生成頁,模型清單一次列出 27 個影片模型:OpenAI Sora 2 與 Sora 2 Pro、Google Veo 3 與 Veo 3 Fast、Veo 3.1 Fast、Kling 2.5、2.6、3.0 與 Kling O3 Pro、Seedance 家族從 1 Pro 到 2.5、Wan 2.5、Minimax H3 與 H3 Max、Gemini Omni Flash 與 1.1、Flux 3 Video、Runway Gen-4.5、LTX 2 Pro、HeyGen Avatar 4、OmniHuman 1.5、Creatify Aurora、Veed Fabric 1.0、Sync 3。圖片這邊是 GPT Image 1.5 與 2、Google Nano Banana 系列、Seedream 4 到 5.0 Pro、FLUX.2 與 FLUX.1 Kontext、Wan 2.5、Topaz Upscale。
清單裡找不到 ElevenLabs 自家的視覺模型。服務條款第一節的寫法是,Image & Video 部分由一或多個第三方模型供應商驅動,你送出的內容可能經這些供應商處理,使用也可能受對方條款與限制約束;供應商可以隨時修改、暫停、限縮或停止服務,ElevenLabs 也可以單方面增刪或替換供應商。
所以這個平台的差異化不在畫質。聲音層才是 ElevenLabs 的本業:發布文與產品頁都寫超過 10,000 種聲音、32 種以上語言,配音、音樂、音效、聲音修正與人聲分離都在自家手裡,影片生成則是聚合別人的模型再接上自己的工作流。這種多模型聚合加固定工作流的產品形態,線上已經有其他選擇,例如同樣以點數計價的 VideoTube AI 影片平台;偏好自己掌控整條流程的人,開源陣營也有把劇本到成片串起來的工作流,像是 Jellyfish 開源 AI 短劇工作流。
地區與部署限制也要留意:部分模型與上傳功能在美國受限,官方文件把原因歸給監理或供應商要求,要逐一查看各模型說明;企業工作區預設全部模型停用,由管理員逐一開啟;走 API 生成需要 Pro 以上方案,API 端的 ByteDance 模型預設停用,要申請才能用。整個 Image & Video 服務在文件裡仍標註為 beta。

輸出格式方面,影片是 MP4(H.264 或 H.265),搭配放大功能可到 4K;圖片是 PNG。放大用的是 Topaz,對嘴型用 Veed 或 OmniHuman 的 lip-sync。
依 9 月 22 日的官方定價頁,ElevenCreative 的月繳方案如下:
| 方案 | 月費 | 每月點數 | 影響使用的關鍵差異 |
|---|---|---|---|
| Free | 免費 | 10,000 | 個人非商業用途、3 個 Studio 專案、只能生圖片(每日 3 次)、匯出帶浮水印 |
| Starter | 6 美元 | 30,000 | 商業授權、圖片與影片生成、20 個 Studio 專案 |
| Creator | 22 美元(首月 11 美元) | 121,000 | 專業聲音複製、可加購點數 |
| Pro | 99 美元 | 600,000 | 192kbps 與 44.1kHz WAV 匯出、API 生成 |
更高階還有每月 299 美元的 Scale(3 個席位、180 萬點數)與 990 美元的 Business(10 個席位、600 萬點數),企業版另議。年繳等於付 10 個月,換算月費 Starter 5 美元、Creator 18.33 美元、Pro 82.50 美元。價格不含稅。

點數在整個產品線共用,Studio 從同一個池子扣。官方定價頁的常見問答列出各服務的約略點數成本:文字轉語音每字元 1 點、語音轉文字每分鐘 330 點、音樂每分鐘 900 點、音效每次 200 點、聲音轉換與人聲分離每分鐘 1,000 點、配音每分鐘 2,000 到 10,000 點(依模式與浮水印)。付費方案的點數可以滾存最多兩個月,上限是月額度的三倍。這代表同一個月裡,旁白配多長、音樂生成幾次、鏡頭重做幾輪,互相搶同一份額度,不能只看「每月 30,000 點」就推算能完成幾支片。想自己算一筆帳的人,可以參考 Voice-Pro 這類本機配音管線的思路,把每個環節的成本拆開記錄。
免費方案還有一個容易漏看的細節:官方文件寫免費方案的影片匯出帶浮水印,付費方案才會去掉。也就是說免費使用者即使匯入自己拍的影片去加工,成品也會帶著浮水印出場。
付費拿到商業使用資格,不等於權利風險歸零。對照 6 月 11 日更新的 Image & Video 條款,有三件事在客戶專案前要先想清楚。
輸入內容會外流給供應商。條款第一節寫明,你送出的資訊可能由第三方供應商處理,以提供 Image & Video 的功能,而供應商名單與條款掌握在 ElevenLabs 手裡,它可以隨時替換。對有保密義務的專案,這代表素材送進生成框之前就要先過一次自己的合規檢查。
侵權責任自己扛。條款第六節的標題就是排除補償:總協議裡 ElevenLabs 對第三方智慧財產權侵權提供的補償,明文不適用於 Image & Video 的使用與其產出。同節還寫,對第三方供應商造成的任何行為、中斷、政策變更或產出,ElevenLabs 不負責任。付費買到的是平台允許的商用資格,不是平台替你擔保輸出內容不踩到別人的權利。

公開共享的授權範圍很大。條款第二節寫,選擇公開分享的作品會授權 ElevenLabs 一份全球、免權利金、可轉讓、可再授權的授權,用途包含經營服務、開發新產品與行銷推廣。產品設定裡有 Disable 開關可以退出再授權,但已經發出去的授權不受影響。另外條款也禁止生成未滿 18 歲人物的肖像與敏感個人資料。實務上,客戶專案至少留四樣紀錄:素材來源、使用的模型、生成日期、當時的方案與條款版本,幾個月後被問到「這個鏡頭哪來的」才答得出來。
官方頁面自己對版本號的口徑並不整齊。產品頁標題已經是 Studio 4.0,但同一頁的次段文案仍寫著「Studio 3.0 把你需要的每個工具結合起來」;影片生成頁把作品帶進 Studio 的段落,用的也是 3.0 的名稱;說明文件的產品頁開頭更是整段在介紹 Studio 3.0。文件更新落後行銷頁,短時間內查資料要自己留意版本。
數字也有出入。產品頁的方案表格把免費方案寫成 5 個 Studio 專案,定價頁寫的卻是 3 個;影片頁寫 5,000 種以上聲音,發布文與產品頁寫超過 10,000 種。遇到不一致時,定價頁與說明文件比行銷頁可靠,但最終仍以帳號內實際看到的上限為準。
還沒被驗證的還有幾項:播放引擎的流暢度只有官方宣稱;實際生成的畫質與穩定度需要實測;模型清單隨時會變,27 個影片模型是 9 月 22 日的快照數字;價格與方案內容也是同一天的狀態,付費前值得再查一次定價頁。
如果你的產出型態是短影音、產品預告、旁白型解說或多語版本,這次改版把生成與剪輯的交接成本拿掉了,值得用一個固定格式實測:連續做三到五支同規格的短片,記錄完成時間、重做次數、點數消耗與人工修正量,再決定要不要把工作流整個搬過來。若工作需要進階調色、複雜合成、外部外掛或特定交付規格,官方文件目前沒有提供這些能力的證據,先別把專業後製的專案押上去。
進入門檻很低。用免費方案就能開 Studio 專案、操作時間軸、試圖片生成(每天 3 次),聲音與字幕流程也能摸到輪廓;要真正生成影片,再從每月 6 美元的 Starter 評估。記住兩條底線:模型全部是第三方的,條款對輸出的侵權不補償;代理初剪的點數消耗是對話加生成兩層相加,多輪迭代前先看一眼餘額。