教程与帮助 / 素材处理
图文教程
提取音频文案
识别视频或音频中的讲话内容,复制文字并导出 TXT 或 SRT。
视频时长的约 0.2 至 1 倍 网页 Windows 客户端 浏览器插件
jx.jikeg.com
语音识别
音频文案
识别结果
这里显示视频中的讲话内容和分段文字。
复制音频文案下载 TXT下载 SRT
带时间轴的文案
图中编号会在下方步骤中逐一说明
操作步骤
1
准备视频或音频
解析作品或上传本地媒体,进入结果页后找到“音频文案”。
2
点击提取音频文案
系统会使用管理员配置的本地模型、腾讯云模型或混合模式。
3
等待后台识别
任务开始后可以离开当前页面,稍后从解析记录返回查看。
4
复制或导出
识别完成后可复制全文、下载 TXT;结果包含时间轴时还可以下载 SRT。
5
校对专有名词
人名、品牌名、方言和嘈杂环境可能产生错别字,发布前建议人工校对。
使用提示
- 大模型通常更适合中英混合、方言、远场或噪声音频,但可能产生额外费用。
- 没有清晰讲话、背景音乐过强或多人重叠说话时,结果可能为空或不准确。
- 重新提取可能消耗新的任务次数;先检查已有文案。