视频转录问答

将视频中的语音转写为文本,再建立知识库索引,适合培训或讲解视频的内容检索。

开始前准备

准备一份培训视频、目标知识库和输出卷。先选择自己熟悉的内容,便于核对转写中的专有名词、数字和关键语句。

本模板准备可检索的转录内容,问答在知识库准备完成后进行。它处理视频中的语音,不理解逐帧画面,也不会根据无声画面补写内容。

使用模板

在创建工作流页面选择“从模板开始”,搜索“视频转录问答”并载入画布。

在参数表单中填写以下必填项。

配置

用途

输入视频

选择要处理的视频文件或包含视频文件的数据卷

目标知识库

选择已有知识库或创建新的知识库

Catalog 保存位置

转录分段 ZIP 压缩包保存到 Catalog 的位置

保存参数后发起手动运行,系统先保存当前流程,再提交执行。

完整处理流程

连线表示执行顺序;各步骤通过模板配置的数据绑定取得输入。

视频转录问答

配置转录和分段

配置

默认值与使用方法

输入视频

选择视频文件或包含这些文件的卷,确认处理范围

转录语言

auto;已知主要语言时可选 zhen

降噪

auto;可选 offffmpeg_afftdn,对有噪音的样本比较结果

文本块大小

512 字符

重叠字符数

50,必须大于等于 0 且小于块大小

三级索引

默认开启,Section 大小 5

目标知识库与保存位置

分别接收索引和转录文件

分块设置用于转写后的文字,不是视频文件的时长设置。不要用增大分块的方法修复识别错字;先核对转写,再调整检索上下文。

核对转录、索引和文件

  1. 查看读取结果,确认输入文件和数量。

  2. 对照原视频检查解析节点返回的 documents 与非空 text,核对数字、名称和完整语句。

  3. 检查分段后的上下文与来源信息。

  4. 查看知识库写入数量;三级索引行数不等于文件数。

  5. 打开输出位置中的转录 ZIP,检查保存的记录和来源关系。

  6. 用培训视频中有明确答案的问题验证知识库检索。

本模板将分段后的转录文档写成 ZIP,再保存该文件并登记来源。它与文档知识库模板保存分段前解析文档的方式不同。

示例:整理培训视频

选择一份培训视频,保持默认语言识别和分块设置,选择知识库及输出卷后运行。挑选一段包含关键结论的语音,对照转写结果检查,再检索同一主题。转录准确但上下文不足时,再调整重叠或块大小。

常见问题

现象

检查与处理

名称或数字识别错误

对照原语音,确认主要语言及噪音情况

结果没有正文

检查文件是否包含可识别语音和解析节点输出

检索片段不完整

先确认转录完整,再检查分段与重叠

索引成功但文件没保存

查看后续写出和保存节点状态,重跑前核对已写入索引

多文件只看到了一个结果

检查文件写出节点的完整 file_ids,不要只看主 file_id

继续阅读

最后更新于