返回主页
深度交流
角色对话
情景对话
语音克隆
语音定制
语音识别
音频润色
字幕生成
音频切分
二维码
情景短片
灵感复刻
图片生成
PPT生成
视频生成
数字人对话
智能体协作
进入课程
视频广场
教师定制
我的账户
帮助
答疑
字幕生成器
音频 + 文稿 → SRT / ASS 双语字幕 · 可直接导入剪映
视频生成
生产线
登录以后继续
1
音频文件
支持 wav / mp3 / m4a。程序按句间静音自动打轴,TTS 合成音频(句间停顿清晰)效果最佳。
选了时长清单 / 参考 SRT 时
无需选音频
:时间轴直接继承清单,「生成字幕」秒级完成。
可选
:SRT 模式下同时上传合成时的同一条音频,「保存修改」时编辑过的字幕会自动吸附到真实语音气口,跨行搬移更精准。
时长清单(.json)/ 参考字幕(.srt),可选
推荐 SRT 模式
:在「语音克隆」合成完成后下载字幕 (.srt) 上传到这里——时间轴
100% 原样继承
(合成时实测踩点,与声音完全对齐),程序只做中文挂载和行长重排,长文本字幕请走此模式。英文文稿以 SRT 内容为准;粘贴中文翻译即可出双语字幕;
再粘贴英文原稿(第 2 步)即启用段落锚点精准同步——中英逐段逐句锚定,30 分钟长文本一次性出稿不漂移,并附逐字覆盖率校验
。
JSON 时长清单模式仍保留(「语音克隆」合成后下载 .json),适合需要按新文稿重排字幕的场景。
高级选项(静音检测阈值)
静音阈值 (dB):
(值越大越灵敏,默认 -45 适合大部分 TTS 音频)
仅当使用「音频文件」+「未提供清单/SRT」时生效。若检测不到语音,请降低阈值(如 -50);若静音过多,请提高阈值(如 -40)。
2
英文文稿(朗读内容)
选择文件
3
中文文稿(字幕翻译,可选)
选择文件
4
字幕样式
语言
双语(英上中下)
仅英文
仅中文
位置
居中(PPT 画面)
居左 2/3(右侧留出主讲人)
起始偏移
秒
行长上限
英 /
中
超长句自动按从句边界(英文优先逗号/连接词,中文优先顿号逗号)拆成多条字幕,保证一行英文一行中文、不压画面。位置样式写入 ASS 文件(烧录/精调用);SRT 只含文字与时间轴,位置在剪映里批量设置。起始偏移用于音频在视频中不是从头开始的情况。
生成字幕
5
下载与预览
「字幕」列可直接点击编辑修改(如调整措辞、删改文字),改完点「保存修改并刷新」即时生效(下载时也会自动应用);保存时会以语音实测时间为基准自动重新对轴——句子移到哪一行,时间就跟着走;上传过音频的任务还会把每行起止
吸附到真实语音气口
(时间列同步刷新),剪映里基本无需再微调。
请先登录
字幕生成器需要登录后使用
登录后自动返回本页面
登录后继续