教程与帮助 / 素材处理
图文教程

提取音频文案

识别视频或音频中的讲话内容,复制文字并导出 TXT 或 SRT。

下载 PDF
视频时长的约 0.2 至 1 倍 网页 Windows 客户端 浏览器插件
jx.jikeg.com
语音识别

音频文案

识别已完成
识别结果
这里显示视频中的讲话内容和分段文字。
复制音频文案下载 TXT下载 SRT
带时间轴的文案
12
图中编号会在下方步骤中逐一说明
操作示意图:音频文案任务状态、复制和导出按钮

操作步骤

1

准备视频或音频

解析作品或上传本地媒体,进入结果页后找到“音频文案”。

2

点击提取音频文案

系统会使用管理员配置的本地模型、腾讯云模型或混合模式。

3

等待后台识别

任务开始后可以离开当前页面,稍后从解析记录返回查看。

4

复制或导出

识别完成后可复制全文、下载 TXT;结果包含时间轴时还可以下载 SRT。

5

校对专有名词

人名、品牌名、方言和嘈杂环境可能产生错别字,发布前建议人工校对。

使用提示
  • 大模型通常更适合中英混合、方言、远场或噪声音频,但可能产生额外费用。
  • 没有清晰讲话、背景音乐过强或多人重叠说话时,结果可能为空或不准确。
  • 重新提取可能消耗新的任务次数;先检查已有文案。