概述
使用 HeyGen 的 Avatar IV 技术,将人物静态图像动画化为唇形同步的说话视频。您可以通过 HeyGen 转换为语音的文本来驱动动画,也可以提供自己的音频让虚拟形象进行唇形同步。输入
输出
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05aDocumentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
Complete documentation for the HeyGenTalkingPhotoNode node in ComfyUI. Learn its inputs, outputs, parameters and usage.
| 参数 | 描述 | 数据类型 | 是否必填 | 取值范围 |
|---|---|---|---|---|
图像 | 要动画化的人物图像。如果大于 2K 将自动缩小。 | IMAGE | 是 | - |
语音 | 通过文本脚本(HeyGen 文本转语音)或您自己的音频驱动虚拟形象。 | COMBO | 是 | "script""audio" |
text | 虚拟形象要说的文本(最多 5000 个字符)。生成的语音必须至少 1 秒长。 | STRING | 是(当 speech 为 “script” 时) | - |
voice | 脚本使用的语音(HeyGen 最受欢迎的语音)。 | COMBO | 是(当 speech 为 “script” 时) | 提供多个选项 |
custom_voice_id | 可选的 HeyGen 语音 ID。设置后将覆盖上面选择的语音。可以使用 HeyGen 库中的任何语音(2000+)。 | STRING | 否 | - |
voice_speed | 语速倍率(默认值:1.0)。 | FLOAT | 否 | 0.5 至 1.5 |
audio | 虚拟形象唇形同步的音频,最长 10 分钟。 | AUDIO | 是(当 speech 为 “audio” 时) | - |
分辨率 | 输出视频分辨率(默认值:“1080p”)。 | COMBO | 否 | "720p""1080p" |
宽高比 | 输出宽高比。‘auto’ 跟随输入图像(默认值:“auto”)。 | COMBO | 否 | "auto""16:9""9:16""1:1""4:5""5:4" |
表现力 | 动画面部和手势的表现力程度(默认值:“low”)。 | COMBO | 否 | "low""medium""high" |
种子 | 不会发送到 HeyGen;更改它以强制重新运行(默认值:42)。 | INT | 否 | 0 至 2147483647 |
| 输出名称 | 描述 | 数据类型 |
|---|---|---|
video | 生成的动画说话照片视频,包含唇形同步的语音。 | VIDEO |
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a