返回主页
课程中心
工业5.0实训
智能体协作
深度交流
角色对话
情景对话
语音克隆
语音定制
对话配音
语音识别
音频润色
字幕生成
听读坊
音频切分
二维码
情景短片
灵感复刻
对话课堂
图片生成
角色连拍
PPT生成
视频生成
AI口语教练
视频广场
教师定制
我的账户
在线咨询
帮助
答疑
问我
小语同学
未连接
🎧
有问题,直接说
点下方麦克风说话,我会听也会答;
也可以打字问我,回答都会念出来
点我说
女声
免提
点麦克风开始说 · 说话时我会停下来听
系统维护中
AI 相关功能(智能配音、数字人、字幕生成、AI 答疑等)正在进行服务升级,暂时不可用。其他功能正常使用。预计今日内恢复,给您带来不便敬请谅解。
登录以后继续
工业5.0 场景实训视频
一个入口,四步走完:
脚本 → 配音 → 渲染 → 发布
。
本页只做编排,真正的合成/渲染/入库由各后端模块完成,任务状态存在服务器,随时可中断再续。
🎬 视频流水线
📁 我的作品
1
准备讲稿
2
形象与配音
3
视频渲染
4
发布同步
第 1 步 · 准备配音(脚本 + 语音)
本页
只负责视频渲染
。脚本编辑与音频合成统一走
对话配音
页 —— 那边有双角色、参考音频克隆、试听与历史记录。
在这里贴上它给你的一句话即可继续。(也可以直接手写台词,效果一样。)
实训主题
*
配音语言
中文
英语
日语
目标时长档位
约 1 分钟
约 2 分钟
约 3 分钟
约 5 分钟
约 10 分钟
场景脚本
*
逐行对话(
角色名:台词
,无冒号按旁白)或粘贴 JSON 数组(
[{"role":"操作员","text":"台词"}]
)。 最多 2 个说话人,单次上限 100 句 / 20000 字。
解析预览
下一步:数字人与配音
第 2 步 · 成片方式、画面与配音来源
成片方式
*
图片轮播
推荐
选 1~30 张图,按音频时长自动均分轮播,
本地一步合成硬字幕
。
几十秒出片,
不消耗信用点
;不需要口型对齐时用这个。
数字人口播
单张形象照 + 音频 → 云端口型对齐,人物真的会说话。
1 点/秒
;单段最长约 3 分钟,超长自动分段拼接。
轮播画面
*
按点击顺序
依次播放,图上的数字就是它在视频里出现的次序;再点一次可取消。 图片显示时长 = 音频总时长 ÷ 图片张数,自动计算。
正在加载形象…
上传图片
清空重选
查看全部用户的图片(管理员)
配音来源
*
用已合成音频
(推荐)
由本页自动配音
在「对话配音」页完成合成后,把结果里的音频地址粘到下面;
也可以直接从本机选文件上传
, 或从你的配音记录里挑一条。
已合成音频地址
*
选择音频文件
从我的配音记录里选
去「对话配音」页
字幕文件
(图片轮播时推荐填写)
上传 srt / ass / vtt,
图片轮播路线会把它硬烧进画面
(时间轴以你上传的为准,最准)。 留空则由系统自己识别语音生成字幕。
数字人口播
路线下只作配套文件登记、不烧录。
选择字幕文件
清除字幕
字幕字体
(仅图片轮播烧录字幕时生效)
艾智语途 · 字幕效果预览
正在读取字体清单…
字体取自服务器已安装字体,
成片里的字幕就是这里选的样子
。 选「微软雅黑」最稳妥;投大屏或需要更醒目时用
黑体
;语文/人文类课程可用
楷体
或
思源宋体
。
由后端配音师按脚本自动合成(
无参考音频则用默认音色
)。 需要音色克隆或精细控制时,请回到「对话配音」页合成后再用上面的方式引用。
音色描述(可选)
参考音频路径(可选,用于声音克隆)
返回脚本
提交并开始渲染
第 3 步 · 渲染进度
系统按「文案 → 语音 → 剪辑」顺序执行,中途设有确认节点。 每 5 秒自动刷新一次,页面可随时关闭。
① 文案
· 整理实训讲稿
等待中
② 语音
· 准备配音音轨
等待中
③ 剪辑
· 渲染视频
等待中
确认并继续
✅ 渲染完成!可以进入下一步发布,或先预览确认。
返回上一步
下一步:发布同步
第 4 步 · 发布与知识库同步
填写作品信息后发布:成片登记到作品库(
VideoGenWorks
), 讲稿同步到知识库(RAG 检索生效)。发布后可在「我的作品」中查看。
作品标题
*
课程代号
讲师姓名
可见性
私密(仅自己可见)
提交审核(待管理员通过后公开)
讲稿内容(用于知识库同步,可留空)
返回渲染
发布
当前为游客浏览
· 填写与预览不受限,
登录以后才能提交任务