# 语音转录问答

将音频语音转写为文本，再切分并写入知识库，供后续总结、检索和问答使用。

## 开始前准备

准备一份会议录音、目标知识库和输出卷。先选择自己熟悉的内容，便于核对转写中的专有名词、数字和关键语句。

本模板准备可检索的转录内容，问答在知识库准备完成后进行。转录质量应对照原录音检查，尤其是背景噪音和多人交谈部分。

## 使用模板

在创建工作流页面选择“从模板开始”，搜索“语音转录问答”并载入画布。

在参数表单中填写以下必填项。

| 配置 | 用途 |
| --- | --- |
| 输入音频 | 选择要处理的音频文件或包含音频文件的数据卷 |
| 目标知识库 | 选择已有知识库或创建新的知识库 |
| Catalog 保存位置 | 转录分段 ZIP 压缩包保存到 Catalog 的位置 |

保存参数后发起手动运行，系统先保存当前流程，再提交执行。

## 完整处理流程

连线表示执行顺序；各步骤通过模板配置的数据绑定取得输入。

![语音转录问答](../images/audio-knowledge-base-flow.svg)

## 配置转录和分段

| 配置 | 默认值与使用方法 |
| --- | --- |
| 输入音频 | 选择音频文件或包含这些文件的卷，确认处理范围 |
| 转录语言 | `auto`；已知主要语言时可选 `zh` 或 `en` |
| 降噪 | `auto`；可选 `off` 或 `ffmpeg_afftdn`，对有噪音的样本比较结果 |
| 文本块大小 | 512 字符 |
| 重叠字符数 | 50，必须大于等于 0 且小于块大小 |
| 三级索引 | 默认开启，Section 大小 5 |
| 目标知识库与保存位置 | 分别接收索引和转录文件 |

分块设置用于转写后的文字，不是音频文件的时长设置。不要用增大分块的方法修复识别错字；先核对转写，再调整检索上下文。

## 核对转录、索引和文件

1. 查看读取结果，确认输入文件和数量。
2. 对照原音频检查解析节点返回的 `documents` 与非空 `text`，核对数字、名称和完整语句。
3. 检查分段后的上下文与来源信息。
4. 查看知识库写入数量；三级索引行数不等于文件数。
5. 打开输出位置中的转录 ZIP，检查保存的记录和来源关系。
6. 用会议录音中有明确答案的问题验证知识库检索。

本模板将**分段后的转录文档**写成 ZIP，再保存该文件并登记来源。它与文档知识库模板保存分段前解析文档的方式不同。

## 示例：整理会议录音

选择一份会议录音，保持默认语言识别和分块设置，选择知识库及输出卷后运行。挑选一段包含关键结论的语音，对照转写结果检查，再检索同一主题。转录准确但上下文不足时，再调整重叠或块大小。

## 常见问题

| 现象 | 检查与处理 |
| --- | --- |
| 名称或数字识别错误 | 对照原语音，确认主要语言及噪音情况 |
| 结果没有正文 | 检查文件是否包含可识别语音和解析节点输出 |
| 检索片段不完整 | 先确认转录完整，再检查分段与重叠 |
| 索引成功但文件没保存 | 查看后续写出和保存节点状态，重跑前核对已写入索引 |
| 多文件只看到了一个结果 | 检查文件写出节点的完整 `file_ids`，不要只看主 `file_id` |

## 继续阅读

- [工作流模板](index.md)
- [运行与调试](../run-debug.md)
