一、品牌概述

HeyGen 属于 AI 视频生成赛道中的"数字人"分支。它不追求电影级的场景生成,而是把重心放在"一个人对着镜头讲清一件事"这类内容上:用户提供一段脚本,或上传一段既有口播视频,平台负责生成形象、声音、口型与基础剪辑。对跨境卖家来说,最常用的两项功能是自定义数字人口播和原视频多语言翻译——后者保留原有画面与产品镜头,只替换语音并重新对位嘴型。
官方把自身定位表述为"身份优先(identity-first)的 AI 视频平台",强调保留真人的形象、声音与表达方式,而非批量制造无主体的合成内容。这一取向也决定了它的产品边界:与 Runway、Sora 等通用视频模型是互补关系,而与 Synthesia、D-ID 等数字人平台构成直接竞争。
| 项目 | 内容 |
|---|---|
| 成立时间 | 2020 年(早期名为 Movio,2022 年更名 HeyGen) |
| 创始人 | 徐卓(Joshua Xu,联合创始人兼 CEO,前 Snap 工程负责人)、梁望(Wayne Liang) |
| 公司主体 | HeyGen, Inc. |
| 总部 | 美国加利福尼亚州洛杉矶,另设旧金山、帕洛阿尔托、多伦多办公室 |
| 平台定位 | 生成式 AI 数字人视频与多语言视频翻译平台 |
| 覆盖市场 | 官方披露用户分布于 196 个国家和地区 |
| 关键数据 | 官方披露(2026 年 6 月):ARR 超 2 亿美元,注册用户 3000 万以上,累计生成视频超 1.18 亿条,财富 100 强企业中 85% 有使用 |
| 核心模式 | 订阅制 SaaS + 按量计费 API |
| 官网 | heygen.com |
二、发展历程

2020 年,徐卓与梁望在美国创立公司,最初名为 Movio,定位是营销视频自动化工具;早期投资方包括红杉中国(现红杉资本中国基金体系下的 HongShan)与真格基金。2022 年,公司在洛杉矶设立总部,同年 9 月推出面向 C 端的视频创作产品。
2023 年是转折点。9 月上线的视频翻译功能因"同一个人开口说另一种语言"的演示在社交平台大量传播,把产品从行业工具推向大众认知。同年 11 月,公司完成由 Conviction 领投的 560 万美元融资,当时团队仅 25 人。
2024 年 6 月,Benchmark 领投 6000 万美元融资,公司估值达到 5 亿美元;彼时官方披露客户超过 4 万家、ARR 约 3500 万美元。同年,HeyGen 分别进入《Fast Company》"Next Big Things in Tech"与《Inc.》"Best in Business"榜单。
2025 至 2026 年,产品迭代明显加速。Avatar IV 与 Avatar V 两代数字人模型相继发布,官方称 Avatar V 仅需 15 秒素材即可复现表情与微动作;Video Agent 把"提示词到成片"的流程自动化;面向开发者的 API、MCP 接口和开源项目 HyperFrames 陆续推出。2026 年 6 月 25 日,公司宣布 ARR 突破 2 亿美元,较八个月前翻倍,并表示 2026 年迄今保持现金流盈亏平衡,累计融资约 7400 万美元中仅消耗约 2500 万美元。
三、商业模式

变现以订阅为主,2026 年起主力方案改为积分(credits)制。免费版每月可生成少量 1 分钟以内、带水印的 720p 视频;Creator 方案 29 美元/月,含 600 积分,支持 1080p 导出、声音克隆与去水印;Pro 方案自 49 美元/月起,支持 4K 导出并可按需选择更高积分档位;Business 方案 149 美元/月起(增加席位 20 美元/座),面向团队提供 SSO、互动视频、SCORM 等能力;Enterprise 为定制报价。API 侧在 2026 年 2 月调整为预充值的按量计费。以上价格为官方定价页披露口径,实际以结算时官网为准。
积分制是理解成本的关键,也是第三方评测中投诉最集中的地方:不同功能的扣费速率差异很大,例如上一代数字人视频约 3 积分/分钟,Avatar IV/V 级别约 20 积分/分钟,纯配音约 2 积分/分钟,带唇形同步的完整视频翻译约 5 积分/分钟。用户若按"月费买分钟数"的直觉估算,容易出现预期偏差。
核心模式的支撑点是自研全栈。官方称从模型编排、数字人与语音模型到推理和开发者工具均自建,因此在"单人讲述"这一窄场景上,训练所需数据量与算力显著低于通用视频模型,单位成本也更低。公司公开的两项内部指标——每 1 美元股权融资对应约 2.7 美元 ARR、人均年营收约 150 万美元——正是这套取向的结果。
信任与安全机制主要落在身份环节:创建定制数字人需本人出镜录制授权视频,并朗读指定口令,平台比对面部信息以确认录制者与被复制对象一致;此外配合自动内容过滤与人工审核,对骚扰、虚假信息、政治与色情类内容做拦截。合规资质方面,官方列出 SOC 2 Type II、GDPR、CCPA、DPF 与欧盟 AI 法案相关项。
四、市场规模与全球布局

体量上,官方 2026 年 6 月数据为 3000 万以上用户、196 个国家、1.18 亿条以上视频、ARR 超 2 亿美元。第三方机构对 AI 视频生成市场的份额估算把 HeyGen 列为头部之一,但这类份额数字缺乏统一统计口径,仅可作为量级参考,不宜当作精确结论。
区域强弱较为清晰。北美是营收与企业客户的核心盘,欧洲在企业培训与合规采购上更倾向 Synthesia 一类供应商;亚太与拉美的增长主要来自内容本地化需求,尤其是面向 TikTok、亚马逊、Temu 等平台的多语种商品视频。中国跨境卖家是一类高频使用群体,典型做法是用中文口播原片一键生成英语、西语、葡语等版本,用同一套素材覆盖多市场投放。
生态方面,平台提供 API、MCP 服务与 Zapier、HubSpot 等自动化工具的连接,可将视频生成嵌入营销与 CRM 流程;2026 年开源的 HyperFrames 面向"由 AI 代理编排视频"的方向,进一步把自己定位为视频生成的底层能力层,而非单一编辑器。需要提醒的是,网页端订阅与 API 额度相互独立,同时使用两条链路会产生两份支出。
五、合规与争议
产品安全上,HeyGen 的主要风险来自技术本身的双面性。生成逼真人像视频的能力,既服务于正常营销,也被滥用于诈骗与虚假宣传。已有媒体与安全机构报道称,此类工具生成的内容出现在冒充名人的投资骗局、误导性健康广告等场景中;公司方面则强调不允许制作未获授权的他人形象,并通过自动检测加人工复核拦截。2026 年初还有独立安全团队披露过一起账号被接管事件,涉及会话未及时失效、邮箱变更缺少二次验证等环节,提示用户侧的账号安全同样需要重视。
平台责任的边界在于"验证同意"与"验证权利"是两件事。授权视频只能证明录制者是本人,无法证明其拥有合法的商业使用权。因此,为员工、合作方或代言人制作数字人时,仍应准备书面授权文件,明确用途、期限与范围;平台条款也通常不为用户上传的产品图、商标等素材的侵权后果承担责任。
监管环境正在收紧。中国已发布《人工智能生成合成内容标识办法》,要求对合成内容作出标识;欧盟 AI 法案对深度伪造内容的披露义务自 2026 年起适用;美国联邦层面的肖像与声音保护法案仍在推进过程中,各州规则不一。平台侧,TikTok、Meta、YouTube 已收紧合成媒体政策,政治、医疗、金融等敏感领域的未标注 AI 视频存在限流或下架风险。对跨境经营者而言,"能生成"不等于"可发布",标识、授权与广告披露需要同步处理。
常见问题 FAQ
HeyGen 是哪家公司的产品? 运营主体为美国公司 HeyGen, Inc.,2020 年成立,总部在加利福尼亚州洛杉矶,创始人为徐卓(Joshua Xu)与梁望(Wayne Liang)。
HeyGen 有免费版吗? 有。免费方案不需要信用卡,可生成少量时长 1 分钟以内的 720p 视频,输出带水印,可试用部分数字人与基础功能,适合先验证效果再决定是否付费。
HeyGen 和 Synthesia 该怎么选? 第三方评测的普遍结论是:偏营销、社媒与多语言本地化,HeyGen 在数字人真实度和带唇形同步的视频翻译上更有优势;偏企业培训与合规采购,Synthesia 在 LMS 集成、SCORM 导出与审批流程上更成熟。建议按实际用途试用后再定。
用 HeyGen 做的视频能商用吗? 付费用户通常对自己生成的视频拥有商业使用权,但前提是所用形象、声音与素材本身权利清晰。使用他人形象需另有书面授权,具体以官网条款为准。
跨境电商用它主要做什么? 两类用法最常见:一是把已有的中文口播视频翻译成多语种版本,保留原画面与产品镜头;二是用自定义数字人批量生成商品讲解与种草短视频,用于 TikTok、亚马逊等渠道的多市场投放。
总结
HeyGen 的价值不在于把视频做得更像电影,而在于把"一个人把一件事讲清楚"这件事标准化、可复制、可翻译。它在窄场景上做深自研全栈,因此拿到了少见的增长效率;也因为触及人脸与声音这类高度敏感的要素,它必须在身份验证、内容审核与各地合规要求之间持续投入。对使用者来说,选择它更像一次流程改造:先算清积分与真实产出的关系,再把授权、标识与平台规则放进工作流,工具的效率才会真正变成可持续的产能。