一個不會拍片、不會剪輯的培訓人員,怎麼用 AI 把講義腳本變成「有虛擬講師講解」的教學影片。獨門重點:先試一小段、人一定要過發音,還有那張臉、那段配樂的授權,發布前一定要確認。
還沒用過 AI?免費版就能試,不用付錢——先看 30 秒新手上路 →
「這份講義能不能做成影片?學員說看文字看不下去。」——你手上只有一疊紙本講義,沒有攝影機、沒有腳架、沒有棚,最要命的是你根本不想入鏡,剪輯軟體打開也是一臉茫然。想做影片,卡在「不會拍、不會剪、不想露臉」這三關。這不是你懶,是這件事以前真的需要一整組人。
好消息是:現在有一種工具叫數位人(AI 生成的虛擬講師——一個不存在的人,用合成的聲音和嘴形,照你給的稿子把話講出來)。你不用出現、不用開口,貼稿子就有一支「有人在講課」的影片。壞消息是:這件事最大的雷不在技術,在版權。
這一題跟「把長文變摘要」那種純文字工作最不一樣的地方是:你做出來的東西是要拿出去給人看、給人聽的,所以除了「唸錯」,還多了一排授權要顧——那張臉、那個聲音、那段背景音樂,只要有一個是「別人的、沒授權的」,你掛上單位名稱對外發布,就可能出事。
AI 在這裡最容易犯兩種錯。第一種是唸錯還很有自信:專有名詞、英文縮寫、你們單位的簡稱、民國年的數字,它常常自作主張唸成別的音,語氣還平到像機器人。第二種不是 AI 主動犯,是你不小心踩的——把某個真人的照片、聲音拿去做「分身」,或從網路隨手抓一首好聽的歌當配樂。這裡先講清楚一條界線,免得你嚇到不敢用:工具內建、標明「可商用」的講師和音樂是安全的(平台已經清好權),真正會出事的是「別人的臉、別人的聲音、來路不明的音樂」。所以重點只有一句:先做一小段試,把發音和素材授權都確認過,再整批做。
🤖 AI 老實說:這段講的就是我。你把講義丟給我做影片,我最可能坑你的地方有兩個。一個是發音——你們單位的縮寫、稿子裡的英文、民國年的數字,我會「很順地」唸成別的音,而且不會停下來提醒你「這個我不確定」。另一個是授權,這裡先把界線講清楚,免得你連能用的都不敢用:工具裡標明「可商用」的內建講師和音樂,平台已經幫你把授權處理好了,放心用。真正會出事的是兩種——你自己上傳某個真人的照片或錄音,叫我做成「他的分身」(這要那個人的書面同意);或者你用免費版偷偷產出對外教材(免費版多半不得商用、或逼你標工具名)。這條界線我不會幫你守,是你的事。所以請這樣用我:稿子先定稿、難唸的字先標好唸法、只用工具內建且標明可商用的講師和音樂,發布前你自己聽一遍、看一遍字幕。你把我綁在這幾條上,我才幫得上忙。
它具體會怎麼坑你?五個做教學影片天天遇到的例子:
| 你稿子裡的東西 | AI(數位人/配音)可能怎樣 | 但其實是… |
|---|---|---|
單位縮寫 CSD、ISO 9001 | 唸成「C、S、D」怪腔,或當英文單字亂唸 | 該唸「中衛」「ISO 九千零一」,得先標好唸法 |
講義裡的 115 年第 3 季 | 唸成「一百一十五年」或跳過 | 是民國 115 年=2026,要嘛標「民國一百一十五年」、要嘛直接改西元 |
| 一句話中英夾雜、或該停頓處 | 一路平調唸到底、斷句斷錯 | 斷錯句會改變語意,語速停頓要人調 |
| 你上傳某個真人的照片/錄音,做成「他的分身」 | 照做,掛上單位名對外發 | 沒有那個人的書面同意就對外=侵權 |
| 覺得太安靜,從網路抓一首好聽的歌當配樂 | 直接放進去 | 那多半有版權,商用會被下架、被求償 |
看出來了嗎?前三列是「唸錯」,後兩列是「動到別人的東西」。唸錯頂多重生一次,用錯授權是會被追究的——這就是為什麼下面每一步,都要先試、再讓人過一遍。順帶提醒:只要用工具內建、標明可商用的講師和音樂,這後兩列的雷你天生就不會踩到。
先看整體怎麼走(這是策略地圖,實際要動手的步驟在下面 tier 卡裡):
同樣一份稿子,看你要做到哪一步,投入差很多。多數人第 1 種就夠了——不想露臉、只想讓學員「有聲音跟著投影片走」,做 AI 配音就好,最省、也最不容易踩肖像的雷。真的想要「畫面裡有一個老師在講」,再上第 2 種數位人。
只想快點生出一支能看的?先看第 1 種(AI 配音)就好;想要虛擬講師露臉再看第 2 種。
最簡單、最不會惹麻煩的做法:不要人臉。把旁白稿用 AI 轉成自然人聲,接上你原本的簡報畫面,就是一支「有老師在講解」的教學影片——沒有真人臉,肖像的雷直接少一半。
怎麼做(跟著點,這才是實際動手步驟):
💰 先講錢,別踩免費版的坑:AI 配音免費版有兩個限制——一是沒有商用授權(產出只能自己練,對外教材可能被要求標工具名、甚至不准商用),二是份量很少(ElevenLabs 免費版一個月約 1 萬字元、約 10 分鐘語音,而且你每重生一段就扣一次額度,難唸字多調幾輪就見底)。所以免費版拿來「試聲音、試風格」剛好,但稿子和唸法要先定到位再開始生,別在試風格階段就把額度耗光。真的要對外發布,升到最低付費方案(ElevenLabs Starter 約 US$5~6/月,含商用權)——但注意這不是無限,Starter 一個月約 3 萬字元/30 分鐘語音,先用總字數估額度(1 萬字≈10 分鐘),多堂課的教材可能要更高方案或分批分月產出。
🔒 傳講義前先想一下:講義裡如果有真實學員名單、成績、電話這種個資,先把那幾欄刪掉或換成代號(A 學員、B 學員)再上傳;不確定公司允不允許把內部教材上傳到雲端 AI,先問過再做。
想要「畫面裡真的有一個老師在講課」,就用數位人工具(例如 HeyGen、Synthesia)。流程一樣白話:貼稿子 → 選一個內建講師 → 選聲音 → 按生成,不用寫任何程式,內建就有多國語言配音和自動字幕。
做完 30 秒試片,你應該會看到:一支影片裡有虛擬講師對嘴講你的稿子、下面自動帶字幕、你能把難唸的字改掉重生那一小段。看到這些,代表風格定了,可以整批做。
但這裡有三件事一定要先知道,不然白做一場:
難唸字的處理跟第 1 種一樣:直接在稿子裡改成「它唸得對的寫法」,比一直重生快。把上面第 1 種那段旁白稿提示詞拿來用即可,它已經幫你標好唸法。
📋 AI 生成要不要標示?——2026 起,很多地方是「規定」不是「禮貌」:從 2026 年 8 月起(歐盟 AI Act 第 50 條 2026-08-02 上路),看起來像真人的 AI 生成影音(數位人、合成配音)要明確揭露「這是 AI 生成」。台灣目前雖沒有一體適用的強制法,但方向一致。最穩的做法:影片片頭或說明欄加一句「本片講師與配音為 AI 生成」,成本一句話,省掉日後爭議。工具本身有沒有自動幫你標記、或有沒有揭露選項,各家不同——發布前自己確認一次(見文末旗標),別假設它幫你標好了。
第一次做請直接跳過這段。這一題老實說用網頁工具就夠了——HeyGen、Synthesia、ElevenLabs 都是打開瀏覽器、貼稿子、按生成,不必接 MCP、更不用碰終端機。真的有「一大批講義要一次處理」再考慮:
做教學影片用 AI,關鍵不是工具多炫,是先試一小段、人一定要過一遍,還有把授權顧好:
你不用是工程師——不會拍、不會剪、不想露臉,也能把一疊講義變成一支學員看得下去的影片;把「先試、人過、顧授權」這三件事守住,它就是幫手,不是麻煩。
Ridgeline · by Lucas