HeyGen 產生的是由 AI 數位人對著鏡頭念出你腳本的影片。官網首頁把這個主張講得很直接:在數分鐘內建立以你本人為主角的擬真 AI 影片,搭配的文案描述的是「由你出演的 AI 影片」以及「不必分身卻能無所不在」。後面那句才是真正的價值:錄製一位真人主講很慢,而且無法在多語言、多版本的更新中規模化複製,數位分身卻可以。
工作流程本身並不複雜。你提供一段腳本,或者一張圖片、一個音訊檔、一份簡報,選定一個數位人形象,系統就會產出該形象講述你內容的影片,嘴型與語音同步。在此基礎上,你還可以複製一個聲音、把成片翻譯成其他語言,或者透過 API 驅動整套流程。
營運實體在服務條款中揭露得很清楚:HeyGen Technology, Inc.,營運地址為洛杉磯 12130 Millennium Drive Suite 300,準據法為加州法,使用者須年滿 18 歲。公司自己發布的募資公告稱,由 Benchmark 領投的 A 輪募資金額為 6000 萬美元,投後估值超過 5 億美元,Thrive Capital、BOND 與 SV Angel 參與投資。同一篇公告稱年度經常性收入在一年多時間內從 100 萬美元成長到 3500 萬美元以上,付費企業客戶超過 4 萬家,並於 2023 年第二季實現獲利——這些是公司自行揭露的數字,而非經獨立稽核的資料。
首頁上廠商自報的規模數據包括 3000 萬使用者、涵蓋 196 個國家、財星 100 大企業中的 85%。請把這些當作行銷口徑,而不是經查核的指標。
關於本條目所指向的位址需要說明一點:登記位址是 app.heygen.com,也就是產品的應用入口。它可以正常存取,與 heygen.com 行銷站屬於同一個產品;本文引用的政策與價格文件都發布在主網域上。
這一節放在前面而不是塞進「限制」裡,原因有兩個:它是這一類工具中最具後果的一件事;而且人們很容易預設「軟體技術上做得到的事,就是自己被允許做的事」——這個預設是錯的。
HeyGen 的內容審核政策寫得毫不含糊:你必須取得被代表個人(政策中稱為「Actor」)的明確同意;除非已經取得明確同意,否則嚴禁建立他人的數位人形象。這不是藏在附則裡的樣板文字,而是針對該產品核心功能的操作性規則。
政策專門點名了公眾人物。它禁止在未獲明確同意的情況下呈現真實個人,其中明確包括名人與公眾人物。「公眾人物的形象反正到處都有,用一下沒關係」——這種直覺在這份條款下是站不住的。
其他被禁止的類別還包括違法、誹謗、露骨色情、暴力、威脅、辱罵、煽動、有害、仇恨、殘忍、缺乏同理心或具有欺騙性的影像,以及看似未滿 18 歲者的形象,還有未經權利人同意使用的受著作權保護圖像。
信任與安全頁把歸屬與責任的劃分講得很明白:你保留自己所建立數位人的完整所有權,但你必須自行確保對任何被使用肖像的個人擁有合法權利與明確同意。該頁面同時承諾回應被呈現者提出的移除請求,審核政策也確認個人可以隨時要求將自己的肖像從服務中移除。
接下來是同樣重要的坦白部分。審核機制的運作方式是:以機器學習掃描工具在內容上傳或產生時偵測可能不被允許的內容,隨後由受過訓練的審核人員進行人工複核,並提供電子郵件申訴管道。但無論是審核政策還是信任與安全頁面,都沒有描述任何在數位人被建立之前查核同意的技術流程。這項義務被明確規定,並透過事後的偵測與下架來執行;它並沒有在事前被擋住。說得實際一點:平台要求你取得同意,但不替你查核同意,這意味著未經許可使用他人肖像的法律風險落在你身上,而不是 HeyGen 身上。這在業界是常見安排,但應當被清楚認識,而不是想當然地略過。
旗艦模型是 Avatar V,官方稱其為 AI 影片領域最擬真的數位人。使用者可以從 500 多個庫存數位分身中挑選,也可以建立自訂分身,自訂分身的數量上限由方案決定。這是產品的核心單元,其品質口碑成敗也繫於此。
內容可以從多個起點出發:文字轉影片、圖片轉影片、音訊轉影片、PPT/PDF 轉影片,以及語音複製、語音導演與手勢控制。其中簡報轉影片這條路徑對企業場景尤其重要——把既有的教育訓練材料變成帶旁白的影片,繞開了「必須找人錄製」這個常見瓶頸。
影片翻譯被當作一級產品呈現,主張一鍵打破語言隔閡,為成片產生另一種語言的版本,數位人的口播隨之調整。對服務多個市場的組織來說,這往往是選擇該產品最有力的單一理由,因為替代方案是每種語言都重錄一遍。
Video Agent 可以從一個提示詞出發,把一個想法推進到成片;AI Studio 則提供用於精修的編輯環境。這兩者反映出產品正從單則片段的產生,轉向端到端的製作工作流程。
面向開發者提供 API,Business 方案增加了 LMS(學習管理系統)整合——這說明企業教育訓練是被正式支援的部署方向,而不是順帶能用的邊緣用途。
行銷與銷售影片是最常見的用途:產品講解、個人化開發信和社群內容,都不需要預約攝影棚。
企業教育訓練與員工賦能可以說是契合度最高的場景,尤其是在材料頻繁變動的情況下。改一段腳本再重新產生,比重新拍攝便宜得多,Business 方案提供的 LMS 整合也印證了這是被支援的路徑。
在地化是槓桿率最高的用途。一支來源影片可以變成多個語言版本而無需重錄,這直接改變了服務國際市場的成本結構。
內部溝通與新人到職也很適合,因為在這類內容裡一致性比電影級製作水準更重要,而出鏡者通常是以員工身分已經同意出鏡的人。
把簡報或 PDF 形式的產品文件轉成帶旁白的影片,鑑於產品本就支援 PPT/PDF 輸入,這也是自然的用法。
反過來說,它不適合需要細膩情感的敘事表達,不適合任何需要真實、未經排練的人類臨場感的場合,也不適合任何涉及未取得同意者的用途。
把同意落到書面並存檔。一旦發生爭議,口頭同意幾乎沒有分量,而平台把這項責任明確壓在了你這一側。
不要以為公眾人物可以隨便用。這是最常見也最傷人的誤解,審核政策對此有明文禁止。
商用之前先核對方案。免費方案的產出僅被授權用於個人、非商業與內部評估目的,因此用免費方案做出來的影片不能合法地投放為廣告。
按點數和時長做預算,而不只看訂閱價格。各方案在點數、單則影片最大時長和自訂數位分身數量上都有差別,長影片或高頻產出會讓你很快撞到升級門檻。
有意識地為讀音做設計。品牌名、技術術語和非英語詞彙是合成語音最容易出錯的地方,先用短片段測一遍。
如果材料敏感,考慮行使退出權。隱私權政策允許你請求將你的輸入排除在模型訓練之外,在上傳涉密素材之前先辦好這件事是值得的。
在需要的場合揭露合成主講人。圍繞 AI 生成肖像的法規預期正在收緊,在廣告和面向大眾的傳播中,主動揭露正日益成為更穩妥的預設做法。
持續產出主講人出鏡影片的行銷與內容團隊是核心受眾,尤其是同一套訊息需要以多種語言存在的時候。
學習與發展(L&D)團隊從「更新成本」和 Business 方案的 LMS 整合中獲益最多。
個人創作者與個人品牌用自訂數位分身來放大自己的存在感——從授權角度看這也是最乾淨的情形,因為被複製的對象就是帳號持有人本人。
跨國企業從影片翻譯中獲益最大,因為替代方案是每個市場都重錄一遍全部素材。
把影片產生能力嵌入自家產品的開發者,則由 API 來服務。
而以下幾類人並不適合:想在未獲許可的情況下使用他人肖像的人;需要真實人類表演與情感張力的製作;指望用免費方案產出做商業發布的使用者;以及保密規定不允許把臉部或聲音資料上傳給第三方服務的組織。
HeyGen 以瀏覽器端應用的形式交付,app.heygen.com 是實際工作入口,heygen.com 承載行銷、價格與政策頁面。產生過程執行在 HeyGen 的基礎設施上,因此本機不需要任何算圖硬體。
開發者 API 把產品能力延伸到介面之外,允許把影片產生嵌入其他系統——這也是對需要以程式化方式大量產出影片的團隊最重要的路徑。
面向企業的平台能力從 Business 方案開始提供,包括 SAML/SSO 與 LMS 整合,Enterprise 方案進一步提供企業級安全與隱私安排。頁尾還提供了安全入口網站、信任與安全頁、內容審核政策與 GDPR 合規文件,這套治理材料比同類工具中大多數產品公開的都要完整。
價格分為個人與企業兩條線,其中最需要關注的限制是點數、單則影片最大時長和自訂數位分身的數量。
免費方案不收費,每月提供 3 則影片,單則上限 1 分鐘,帶浮水印,包含 1 個自訂數位分身以及 500 多個庫存分身。它用於評估確實夠用,但其限制不只體現在實用層面,更體現在法律層面——它的產出不可商用。
個人線上,Creator 每月 29 美元含 600 點數,Pro 每月 49 美元含 1000 點數,是主要的付費選項。Creator 把單則影片時長提升到 30 分鐘並移除浮水印;Pro 增加 4K 匯出。
面向組織的 Business 每月 149 美元含 1500 點數,單則影片最長 60 分鐘,5 個自訂數位分身,並增加 SAML/SSO 與 LMS 整合,額外席次每位 20 美元。Enterprise 為個別報價,並取消影片時長上限。
實務建議是:拿你真實的工作量去套點數與時長限制來建模,而不是只比較標價;同時注意,對於想要多個主講形象的團隊來說,自訂數位分身的數量往往才是真正的約束條件。
Synthesia 是最直接的競品,採用相似的「數位人加腳本」模式,並在企業教育訓練方向上有很強的累積。
D-ID 與 Colossyan 佔據相鄰位置:D-ID 以照片驅動的說話人像見長,Colossyan 則明顯偏向職場學習場景。
Descript 從剪輯一側切入,適合主講人本來就是真人的團隊,它提供的是 AI 輔助而非完全合成。
Runway 及同類生成式影片工具解決的是另一個問題——產生畫面素材,而不是讓一位主講人念稿,因此它們是互補品而非替代品。
而當「真實感」本身就是重點時,直接錄一個真人依然是正確答案。這一點值得明說,而不是預設合成一定是升級。
同意要求是最重要的約束,上文已完整展開;簡短版本是:未經他人明確同意不得建立其數位人形象,公眾人物同樣適用,而平台要求這一點卻並不在事前替你查核。
免費方案的授權條款是個容易踩的坑。付費方案給予你完整權利,但在免費方案下,你取得的只是有限的、非專屬、不可轉讓、可撤銷的授權,且僅限個人、非商業與內部評估用途;此類產出不得出售、再授權、再散布、貨幣化或用於商業活動。把免費方案影片當作行銷素材發布,是違反授權,而不只是「帶個浮水印不好看」而已。
用你的輸入訓練模型是預設狀態。隱私權政策載明 HeyGen 可能使用你提供的輸入來訓練和增強驅動其服務的模型,同時提供依請求退出的管道。鑑於這裡的輸入包含臉部影像與聲音,這條比一般的訓練條款更值得重視。
合成表達存在天花板。數位人形象進步顯著,但細膩的情感表演、臨場的即興反應和真正的交流感依然困難,而且觀眾辨認合成主講人的能力在提高。
成本隨時長與產量上升。點數、時長上限和自訂分身數量都會隨使用量成長而收緊,長影片尤其會比預期更快把你推到更高方案。
第三方驗證方向正面但樣本單薄:Product Hunt 上 4.3 分(滿分 5 分),基於 70 則評價——這個樣本量小到必須連同數量一起引用才誠實。首頁提到超過一千則評價卻未指明平台,本文也無法獨立查證任何企業級評測網站的評分。同樣沒有檢索到主流科技媒體的獨立評測或合規調查,因此本條目中的治理相關表述,依據的是廠商自己公開的政策文本。
最後,揭露規範正在變化。圍繞 AI 生成肖像的標示要求,法規與平台的預期都在持續收緊,今天被允許的做法,明天可能就需要明確揭露。
這一節的分量格外重,因為涉及的資料具有生物特徵性質。
隱私權政策對蒐集範圍寫得很明確:姓名、電子郵件與密碼,付款資訊,以及最關鍵的——臉部影像,還有「影片或相片中的臉部或身體部分」,此外還有你提供的聲音、腳本、圖片與影片。上傳一段自己的影片來建構數位分身,意味著提交臉部與聲音的生物特徵資料,這應當是一個有意識的決定。
訓練用途是「預設開啟、可申請退出」,而不是反過來。政策載明 HeyGen 可能使用你的輸入來訓練與增強驅動其服務的模型,同時規定你可以透過聯絡官方請求退出。權利條款進一步明確列出了拒絕其資訊被用於訓練模型的權利。對於處理機密材料或處理已獲同意的第三方肖像的人來說,正確的操作順序是:先辦好退出,再上傳。
刪除行為有具體規定:帳號刪除後,資料會「在備份中保留 60 天用於災難復原」,隨後自動永久刪除。給出明確的保留期間,比含糊其辭的保證要好。
權利涵蓋存取、刪除、更正與資料可攜,另有撤回同意以及拒絕處理與拒絕行銷的權利,與 GDPR 和 CCPA 的預期一致。次處理者名單未在正文中逐一列出,而是指向獨立的安全入口網站。
整體來看,其治理面——內容審核政策、信任與安全頁、安全入口網站與 GDPR 文件——比同類工具中大多數產品提供的都更充實,這是實打實的加分項,儘管同意查核依然落在使用者一側。
只有在取得對方明確同意的前提下才可以。審核政策要求你必須取得被代表個人的明確同意,並明確規定未獲同意時嚴禁建立他人的數位人形象。這一條同樣適用於同事、客戶和任何其他人。平台不會在建立前查核同意,因此法律責任由你承擔。
未經其同意屬於明令禁止。政策直接點名了名人與公眾人物。某人的形象在網路上隨處可見,並不等於你取得了合成其形象的許可。
付費方案可以——你擁有自己輸入與輸出的全部權利。免費方案不可以:其產出僅被授權用於個人、非商業與內部評估目的,不得出售、再授權、再散布、貨幣化或用於商業活動。在把任何內容用於商業發布之前,先確認你的方案。
免費方案每月 3 則一分鐘的帶浮水印影片。Creator 每月 29 美元,600 點數,單則 30 分鐘;Pro 每月 49 美元,1000 點數,支援 4K 匯出;Business 每月 149 美元,1500 點數,單則 60 分鐘,5 個自訂數位分身,額外席次每位 20 美元;Enterprise 個別報價,且沒有時長上限。
預設情況下可能會。隱私權政策載明輸入可能被用於訓練和增強驅動服務的模型,同時另行賦予你依請求退出、拒絕資訊被用於訓練模型的權利。鑑於輸入包含臉部與聲音資料,在上傳敏感素材之前請考慮先申請退出。
刪除後資料會在備份中保留 60 天用於災難復原,隨後自動永久刪除。政策同時提供存取、刪除、更正與資料可攜等權利。
可以。審核政策規定個人可以隨時要求將其肖像從服務中移除,信任與安全頁也要求使用者回應被呈現者提出的移除請求。
透過兩級流程:機器學習掃描在內容上傳或產生時偵測可能不被允許的內容,隨後由受過訓練的審核人員進行人工複核。審核決定可以透過電子郵件申訴。請注意,這是「建立之後的偵測」,而不是「建立之前的同意查核」。
影片翻譯被呈現為一鍵為成片產生另一語言版本的能力,也是該產品面向國際化團隊最強的差異化點之一。但和所有自動在地化一樣,發布前應由母語流利者複核,尤其要留意慣用語和產品術語。
其企業側的能力相當完整:Business 增加 SAML/SSO 與 LMS 整合,Enterprise 提供企業級安全與隱私,公司還公開了安全入口網站、審核政策、信任與安全頁與 GDPR 文件。採購環節剩下的問題是生物特徵資料與「訓練預設開啟」這一姿態——在部署之前,應當以書面形式把退出安排落實好。