③ 生成参数
艾智视频引擎 · 数字人口播
超经济 · 1 点/秒(2 分钟视频仅约 120 点)· 长音频自动分段拼接
当前引擎适合肩部以上口播,性价比约为传统方案的 10 倍
视频时长 ≈ 音频时长,请上传与目标时长相近的音频(15 秒示例音频仅供快速体验)
选择上方形象后会自动填入配套提示词,可自由修改;留空则由模型按音频内容自动发挥
控制数字人的口型强度、头部动作与眨眼频率,直接作用于视频生成效果
视频时长 ≈ 音频时长;生成由艾智视频引擎在云端完成,1 点/秒超经济。超过 3 分钟自动分段渲染+叠化拼接(与教学视频流水线同款,最长约 30 分钟)。
1. 素材就绪(形象 + 音频)
2. 提交云端生成任务
3. 云端渲染中(艾智视频引擎)
4. 取回成片并永久保存