每一步对应处理进度里的一个时间点,你可以在任意阶段暂停、下载、或继续下一步。
支持视频或音频文件,拖拽或选择上传,无需转码。
自动识别语音生成原始字幕,保留准确的时间轴。
一次生成多语言版本字幕,时间轴自动对齐。
导出SRT/VTT字幕文件,或升级为AI配音生成语音轨。
点击下方区域,查看示例文件的处理结果(正式版支持真实文件上传)。
转录和翻译按额度免费使用;声音克隆与AI配音这类调用成本较高的能力放在专业版。
自动识别视频/音频中的语音,生成带时间轴的字幕文本,支持中英日等多语言原文转录。
一次生成30+种语言的字幕版本,时间轴自动对齐,支持批量导出SRT/VTT格式。
上传一段音频样本,生成专属的克隆音色,用于多语言配音,保留说话者的声线特点。
把翻译后的字幕直接转换为语音轨,支持克隆音色或内置音色,批量生成多语言配音版本。
批量处理多个文件,或通过API接入你自己的内容生产流程,适合团队与MCN使用。
导出通用的SRT / VTT字幕文件,可直接导入剪映、Premiere、Final Cut等主流剪辑软件。
覆盖主流出海市场语言,转录与翻译持续扩充语言列表。
转录效果取决于原始音频质量,清晰人声场景下准确率较高;专业术语、多人重叠对话可能需要少量人工校对。
克隆音色仅用于你上传的内容生成配音,不会被用于其他用户或用途。使用他人声音进行克隆前,请确保你拥有相应授权。
支持主流视频与音频格式上传,导出字幕为通用的SRT / VTT格式,可直接导入剪辑软件。
免费额度每日刷新;如果需要更大用量或声音克隆/配音功能,可以升级到专业版按用量付费。