HeyGen 生成的是由 AI 数字人对着镜头念出你脚本的视频。官网首页把这个主张说得很直接:在数分钟内创建以你本人为主角的逼真 AI 视频,配套的文案描述的是「由你出演的 AI 视频」以及「无需分身却能无处不在」。后面那句才是真正的价值所在——录制一位真人主讲很慢,而且无法在多语言、多版本的更新中规模化复制,数字分身却可以。
工作流本身并不复杂。你提供一段脚本,或者一张图片、一个音频文件、一份幻灯片,选定一个数字人形象,系统就会产出该形象讲述你内容的视频,口型与语音同步。在此基础上,你还可以克隆一个声音、把成片翻译成其他语言,或者通过 API 驱动整套流程。
运营实体在服务条款中披露得很清楚:HeyGen Technology, Inc.,运营地址为洛杉矶 12130 Millennium Drive Suite 300,准据法为加利福尼亚州法,用户须年满 18 岁。公司自己发布的融资公告称,由 Benchmark 领投的 A 轮融资金额为 6000 万美元,投后估值超过 5 亿美元,Thrive Capital、BOND 与 SV Angel 参投。同一篇公告称年度经常性收入在一年多时间里从 100 万美元增长到 3500 万美元以上,付费企业客户超过 4 万家,并于 2023 年第二季度实现盈利——这些是公司自己披露的数字,而非经独立审计的数据。
首页上厂商自报的规模数据包括 3000 万用户、覆盖 196 个国家、财富 100 强企业中的 85%。请把这些当作营销口径,而不是经核实的指标。
关于本条目所指向的地址需要说明一点:登记地址是 app.heygen.com,也就是产品的应用入口。它可以正常访问,与 heygen.com 营销站属于同一个产品;本文引用的政策与价格文档都发布在主域名上。
这一节放在前面而不是塞进「限制」里,原因有两个:它是这一类工具中最具后果的一件事;而且人们很容易默认「软件技术上能做到的事,就是自己被允许做的事」——这个默认是错的。
HeyGen 的内容审核政策写得毫不含糊:你必须取得被代表个人(政策中称为「Actor」)的明确同意;除非已经获得明确同意,否则严禁创建他人的数字人形象。这不是藏在附则里的套话,而是针对该产品核心功能的操作性规则。
政策专门点名了公众人物。它禁止在未获明确同意的情况下呈现真实个人,其中明确包括名人与公众人物。「公众人物的形象反正到处都有,用一下没关系」——这种直觉在这份条款下是站不住的。
其他被禁止的类别还包括违法、诽谤、露骨色情、暴力、威胁、辱骂、煽动、有害、仇恨、残忍、缺乏同理心或具有欺骗性的影像,以及看似未满 18 岁者的形象,还有未经权利人同意使用的受版权保护图像。
信任与安全页把归属与责任的划分讲得很明白:你保留自己所创建数字人的完整所有权,但你必须自行确保对任何被使用肖像的个人拥有合法权利与明确同意。该页面同时承诺响应被呈现者提出的移除请求,审核政策也确认个人可以随时要求将自己的肖像从服务中移除。
接下来是同样重要的坦白部分。审核机制运作方式是:以机器学习扫描工具在内容上传或生成时检测可能不被允许的内容,随后由受过训练的审核人员进行人工复核,并提供邮件申诉渠道。但无论是审核政策还是信任与安全页面,都没有描述任何在数字人被创建之前核验同意的技术流程。这项义务被明确规定,并通过事后的检测与下架来执行;它并没有在事前被卡住。说得实际一点:平台要求你取得同意,但不替你核验同意,这意味着未经许可使用他人肖像的法律风险落在你身上,而不是 HeyGen 身上。这在行业里是常见安排,但应当被清楚认识,而不是想当然地略过。
旗舰模型是 Avatar V,官方称其为 AI 视频领域最逼真的数字人。用户可以从 500 多个库存数字分身中挑选,也可以创建自定义分身,自定义分身的数量上限由套餐决定。这是产品的核心单元,其质量口碑成败也系于此。
内容可以从多个起点出发:文本转视频、图片转视频、音频转视频、PPT/PDF 转视频,以及语音克隆、语音导演与手势控制。其中幻灯片转视频这条路径对企业场景尤其重要——把既有培训材料变成带解说的视频,绕开了「必须找人录制」这个常见瓶颈。
视频翻译被作为一级产品呈现,主张一键打破语言壁垒,为成片生成另一种语言的版本,数字人的口播随之适配。对服务多个市场的组织来说,这往往是选择该产品最有力的单一理由,因为替代方案是每种语言都重录一遍。
Video Agent 可以从一个提示词出发,把一个想法推进到成片;AI Studio 则提供用于精修的编辑环境。这两者反映出产品正从单条片段的生成,转向端到端的制作工作流。
面向开发者提供 API,Business 档增加了 LMS(学习管理系统)集成——这说明企业培训是被正式支持的部署方向,而不是顺带能用的边缘用途。
营销与销售视频是最常见的用途:产品讲解、个性化触达和社交媒体内容,都不需要预约录影棚。
企业培训与员工赋能可以说是契合度最高的场景,尤其是在材料频繁变动的情况下。改一段脚本再重新生成,比重新拍摄便宜得多,Business 套餐提供的 LMS 集成也印证了这是被支持的路径。
本地化是杠杆率最高的用途。一条源视频可以变成多个语言版本而无需重录,这直接改变了服务国际市场的成本结构。
内部沟通与新人入职也很适合,因为在这类内容里一致性比电影级制作水准更重要,而出镜者通常是以员工身份已经同意出镜的人。
把幻灯片或 PDF 形式的产品文档转成带解说的视频,鉴于产品本就支持 PPT/PDF 输入,这也是自然的用法。
反过来说,它不适合需要细腻情感的叙事表达,不适合任何需要真实、未经排练的人类临场感的场合,也不适合任何涉及未取得同意者的用途。
把同意落到书面并留档。一旦发生争议,口头同意几乎没有分量,而平台把这项责任明确压在了你这一侧。
不要以为公众人物可以随便用。这是最常见也最伤人的误解,审核政策对此有明文禁止。
商用之前先核对套餐。免费档的产出仅被许可用于个人、非商业与内部评估目的,因此用免费档做出来的视频不能合法地投放为广告。
按积分和时长做预算,而不只看订阅价格。各套餐在积分数、单条视频最大时长和自定义数字分身数量上都有差别,长视频或高频产出会让你很快撞到升级门槛。
有意识地为读音做设计。品牌名、技术术语和非英语词汇是合成语音最容易出错的地方,先用短片段测一遍。
如果材料敏感,考虑行使退出权。隐私政策允许你请求将你的输入排除在模型训练之外,在上传涉密素材之前先办好这件事是值得的。
在需要的场合披露合成主讲人。围绕 AI 生成肖像的监管预期正在收紧,在广告和面向公众的传播中,主动披露正日益成为更稳妥的默认做法。
持续产出主讲人出镜视频的营销与内容团队是核心受众,尤其是同一套信息需要以多种语言存在的时候。
学习与发展(L&D)团队从「更新成本」和 Business 套餐的 LMS 集成中获益最多。
个人创作者与个人品牌用自定义数字分身来放大自己的存在感——从授权角度看这也是最干净的情形,因为被复制的对象就是账号持有人本人。
跨国企业从视频翻译中获益最大,因为替代方案是每个市场都重录一遍全部素材。
把视频生成能力嵌入自家产品的开发者,则由 API 来服务。
而以下几类人并不适合:想在未获许可的情况下使用他人肖像的人;需要真实人类表演与情感张力的制作;指望用免费档产出做商业发布的用户;以及保密规定不允许把面部或声音数据上传给第三方服务的组织。
HeyGen 以浏览器端应用的形式交付,app.heygen.com 是实际工作入口,heygen.com 承载营销、价格与政策页面。生成过程运行在 HeyGen 的基础设施上,因此本地不需要任何渲染硬件。
开发者 API 把产品能力延伸到界面之外,允许把视频生成嵌入其他系统——这也是对需要以程序化方式批量产出视频的团队最重要的路径。
面向企业的平台能力从 Business 档开始提供,包括 SAML/SSO 与 LMS 集成,Enterprise 档进一步提供企业级安全与隐私安排。页脚还提供了安全门户、信任与安全页、内容审核政策与 GDPR 合规文档,这套治理材料比同类工具中大多数产品公开的都要完整。
价格分为个人与企业两条线,其中最需要关注的限制是积分、单条视频最大时长和自定义数字分身的数量。
免费档不收费,每月提供 3 条视频,单条上限 1 分钟,带水印,包含 1 个自定义数字分身以及 500 多个库存分身。它用于评估确实够用,但其限制不只体现在实用层面,更体现在法律层面——它的产出不可商用。
个人线上,Creator 每月 29 美元含 600 积分,Pro 每月 49 美元含 1000 积分,是主要的付费选项。Creator 把单条视频时长提升到 30 分钟并去除水印;Pro 增加 4K 导出。
面向组织的 Business 每月 149 美元含 1500 积分,单条视频最长 60 分钟,5 个自定义数字分身,并增加 SAML/SSO 与 LMS 集成,额外席位每位 20 美元。Enterprise 为单独报价,并取消视频时长上限。
实操建议是:拿你真实的工作量去套积分与时长限制来建模,而不是只比较标价;同时注意,对于想要多个主讲形象的团队来说,自定义数字分身的数量往往才是真正的约束条件。
Synthesia 是最直接的竞品,采用相似的「数字人加脚本」模式,并在企业培训方向上有很强的积累。
D-ID 与 Colossyan 占据相邻位置:D-ID 以照片驱动的说话人像见长,Colossyan 则明显偏向职场学习场景。
Descript 从剪辑一侧切入,适合主讲人本来就是真人的团队,它提供的是 AI 辅助而非完全合成。
Runway 及同类生成式视频工具解决的是另一个问题——生成画面素材,而不是让一位主讲人念稿,因此它们是互补品而非替代品。
而当「真实感」本身就是要点时,直接录一个真人依然是正确答案。这一点值得明说,而不是默认合成一定是升级。
同意要求是最重要的约束,上文已完整展开;简短版本是:未经他人明确同意不得创建其数字人形象,公众人物同样适用,而平台要求这一点却并不在事前替你核验。
免费档的授权条款是个容易踩的坑。付费档给予你完整权利,但在免费档下,你获得的只是有限的、非独占、不可转让、可撤销的许可,且仅限个人、非商业与内部评估用途;此类产出不得出售、再许可、再分发、货币化或用于商业活动。把免费档视频当作营销素材发布,是违反许可,而不只是「带个水印不好看」而已。
用你的输入训练模型是默认状态。隐私政策载明 HeyGen 可能使用你提供的输入来训练和增强驱动其服务的模型,同时提供按请求退出的通道。鉴于这里的输入包含面部影像与声音,这条比一般的训练条款更值得重视。
合成表达存在天花板。数字人形象进步显著,但细腻的情感表演、临场的即兴反应和真正的交流感依然困难,而且观众辨认合成主讲人的能力在提高。
成本随时长与产量上升。积分、时长上限和自定义分身数量都会随使用量增长而收紧,长视频尤其会比预期更快把你推到更高档位。
第三方验证方向正面但样本单薄:Product Hunt 上 4.3 分(满分 5 分),基于 70 条评价——这个样本量小到必须连同数量一起引用才诚实。首页提到超过一千条评价却未指明平台,本文也无法独立核实任何企业级评测网站的评分。同样没有检索到主流科技媒体的独立评测或合规调查,因此本条目中的治理相关表述,依据的是厂商自己公开的政策文本。
最后,披露规范正在变化。围绕 AI 生成肖像的标注要求,监管与平台的预期都在持续收紧,今天被允许的做法,明天可能就需要显式披露。
这一节的分量格外重,因为涉及的数据具有生物特征性质。
隐私政策对采集范围写得很明确:姓名、邮箱与密码,支付信息,以及最关键的——面部影像,还有「视频或照片中的面部或身体部分」,此外还有你提供的声音、脚本、图片与视频。上传一段自己的视频来构建数字分身,意味着提交面部与声音的生物特征数据,这应当是一个有意识的决定。
训练用途是「默认开启、可申请退出」,而不是反过来。政策载明 HeyGen 可能使用你的输入来训练与增强驱动其服务的模型,同时规定你可以通过联系官方请求退出。权利条款进一步明确列出了拒绝其信息被用于训练模型的权利。对于处理机密材料或处理已获同意的第三方肖像的人来说,正确的操作顺序是:先办好退出,再上传。
删除行为有具体规定:账号删除后,数据会「在备份中保留 60 天用于灾难恢复」,随后自动永久删除。给出明确的保留窗口,比含糊其辞的保证要好。
权利覆盖访问、删除、更正与数据可携,另有撤回同意以及拒绝处理与拒绝营销的权利,与 GDPR 和 CCPA 的预期一致。子处理者名单未在正文中逐一列出,而是指向单独的安全门户。
总体来看,其治理面——内容审核政策、信任与安全页、安全门户与 GDPR 文档——比同类工具中大多数产品提供的都更充实,这是实打实的加分项,尽管同意核验依然落在用户一侧。
只有在取得对方明确同意的前提下才可以。审核政策要求你必须取得被代表个人的明确同意,并明确规定未获同意时严禁创建他人的数字人形象。这一条同样适用于同事、客户和任何其他人。平台不会在创建前核验同意,因此法律责任由你承担。
未经其同意属于明令禁止。政策直接点名了名人与公众人物。某人的形象在网上随处可见,并不等于你获得了合成其形象的许可。
付费档可以——你拥有自己输入与输出的全部权利。免费档不可以:其产出仅被许可用于个人、非商业与内部评估目的,不得出售、再许可、再分发、货币化或用于商业活动。在把任何内容用于商业发布之前,先确认你的套餐。
免费档每月 3 条一分钟的带水印视频。Creator 每月 29 美元,600 积分,单条 30 分钟;Pro 每月 49 美元,1000 积分,支持 4K 导出;Business 每月 149 美元,1500 积分,单条 60 分钟,5 个自定义数字分身,额外席位每位 20 美元;Enterprise 单独报价,且没有时长上限。
默认情况下可能会。隐私政策载明输入可能被用于训练和增强驱动服务的模型,同时另行赋予你按请求退出、拒绝信息被用于训练模型的权利。鉴于输入包含面部与声音数据,在上传敏感素材之前请考虑先申请退出。
删除后数据会在备份中保留 60 天用于灾难恢复,随后自动永久删除。政策同时提供访问、删除、更正与数据可携等权利。
可以。审核政策规定个人可以随时要求将其肖像从服务中移除,信任与安全页也要求用户响应被呈现者提出的移除请求。
通过两级流程:机器学习扫描在内容上传或生成时检测可能不被允许的内容,随后由受过训练的审核人员进行人工复核。审核决定可以通过邮件申诉。请注意,这是「创建之后的检测」,而不是「创建之前的同意核验」。
视频翻译被呈现为一键为成片生成另一语言版本的能力,也是该产品面向国际化团队最强的差异化点之一。但和所有自动本地化一样,发布前应由母语流利者复核,尤其要留意习惯用语和产品术语。
其企业侧的能力相当完整:Business 增加 SAML/SSO 与 LMS 集成,Enterprise 提供企业级安全与隐私,公司还公开了安全门户、审核政策、信任与安全页与 GDPR 文档。采购环节剩下的问题是生物特征数据与「训练默认开启」这一姿态——在部署之前,应当以书面形式把退出安排落实好。