# 使用工作流批量转录音频

MOI 提供音频转录工作流模板，可以将多段音频批量转换为可检索的文本内容。模板会统一处理音频输入、语音识别和转录结果写出，适合把项目会议、客户反馈、访谈录音等资料一次性整理成文本。

本教程使用 3 段中文示例录音，演示如何通过 **语音转录问答** 模板批量完成音频转录。示例资料分别模拟项目周会、客户反馈和产品访谈，方便在同一条工作流中观察不同内容的转录结果。整个操作预计约 15 分钟，实际处理时间取决于音频时长和模型速度。

## 你将完成什么

- 下载并解压 3 段音频示例资料；
- 将多段音频批量导入 Catalog；
- 从系统模板创建音频转录工作流；
- 一次运行工作流，生成对应的转录文本；
- 在 Catalog 中查看和下载转录结果。

## 开始前准备

- 准备一个 MOI 账号，可前往 [MOI 云端登录/注册](https://moi.matrixorigin.cn/)；
- 确认当前工作区可以创建并运行工作流；
- 下载 [音频转录教程样例包](../assets/downloads/moi-audio-transcription-demo.zip)，解压后得到 3 个 MP3 文件。

样例包中的资料均为本教程制作的中文示例录音：

| 文件 | 内容 |
| --- | --- |
| `project-weekly-meeting.mp3` | 项目周会摘要，包含进展、计划和协作事项 |
| `customer-feedback.mp3` | 客户反馈，包含现象、期望和改进建议 |
| `product-interview.mp3` | 产品访谈摘要，包含功能偏好和转录需求 |

## 操作步骤

### 1. 将音频批量导入 Catalog

1. 登录 MOI，在左侧导航的 **数据连接** 中选择 **导入任务**。
2. 点击 **新建导入任务**，选择 **非结构化** 和 **本地上传**。
3. 一次选择解压后的 3 个 MP3 文件。
4. 将目标位置设置为当前工作区 Catalog 下的：

   ```text
   tutorial_data / audio_transcription / source
   ```

   如果目录尚不存在，可以在选择目标位置时依次新建。

5. 其余导入参数保持默认，点击 **创建并开始导入**。
6. 等待导入任务完成，并确认 3 个 MP3 文件已出现在 `source` 数据卷中。

   ```{image} ../assets/images/tutorials/workflow-audio-transcription-upload.png
   :alt: 在本地上传中选择三段 MP3 音频并设置 Catalog 数据源
   ```

   导入任务列表中的状态显示为 **已完成** 后，再继续创建工作流。

   ```{image} ../assets/images/tutorials/workflow-audio-transcription-import-completed.png
   :alt: 音频导入任务列表显示任务已完成
   ```

### 2. 创建音频转录工作流

1. 在左侧导航的 **数据处理** 中选择 **工作流**。
2. 点击 **创建工作流**。
3. 选择 **语音转录问答** 模板，点击 **使用模板**。

   ```{image} ../assets/images/tutorials/workflow-audio-transcription-select-template.png
   :alt: 选择语音转录问答工作流模板
   ```

4. 将工作流名称填写为 `audio_transcription_demo`。

该模板已经包含音频读取、语音转录和结果写出等节点，无需手动搭建处理链路。

### 3. 配置运行参数

1. 打开工作流的运行配置，在模板提供的 **源文件** 或 **数据源** 参数中选择：

   ```text
   tutorial_data / audio_transcription / source
   ```

   ```{image} ../assets/images/tutorials/workflow-audio-transcription-run-config.png
   :alt: 语音转录问答工作流运行配置中的音频数据集
   ```

2. 将文件范围设置为按文件，选中 `project-weekly-meeting.mp3`、`customer-feedback.mp3` 和 `product-interview.mp3`。
3. 在左侧选择 **嵌入并添加到知识库**。在 **目标知识库** 中点击 **新建知识库**，将知识库名称填写为 `audio_transcription_knowledge`，然后完成创建并选中该知识库。

   ```{image} ../assets/images/tutorials/workflow-audio-transcription-knowledge-base.png
   :alt: 在语音转录工作流中选择目标知识库
   ```

4. 在左侧选择 **存至 MOI 卷**，将 **Catalog 保存位置**设置为 `tutorial_data / audio_transcription / output`，用于保存转录分段 ZIP 压缩包。

   ```{image} ../assets/images/tutorials/workflow-audio-transcription-save-catalog.png
   :alt: 设置语音转录结果的 Catalog 保存位置
   ```

5. 计算资源、转录语言及其他配置均保持默认，点击 **确认** 保存运行配置。

### 4. 保存并运行工作流

1. 返回工作流画布，点击 **保存并启用**。
2. 点击 **运行**，确认本次运行包含 3 个音频文件。
3. 在工作流页面右侧找到 **作业** 按钮并点击，在作业列表中等待本次运行完成。

   ```{image} ../assets/images/tutorials/workflow-audio-transcription-job-completed.png
   :alt: 作业列表中 audio_transcription_demo 的运行状态显示为已完成
   ```

工作流会按照同一套转录配置依次处理 3 个音频，并为每个输入文件生成对应的转录结果。

### 5. 在知识库中问答

1. 等待工作流执行完成，并确认目标知识库中的资料处理完成。
2. 在左侧导航进入 **资源中心 > 知识库**，打开 `audio_transcription_knowledge`，点击 **对话**。

   ```{image} ../assets/images/tutorials/workflow-audio-transcription-knowledge-chat-entry.png
   :alt: 在知识库列表中打开 audio_transcription_knowledge 并点击对话
   ```

3. 发送问题，例如：`请总结三段录音中提到的主要问题和待办事项。`
4. 查看知识库返回的回答及引用来源；如需查看原始转录结果，进入 **Catalog** 的 `tutorial_data / audio_transcription / output` 目录，打开或下载对应 ZIP 文件。

   ```{image} ../assets/images/tutorials/workflow-audio-transcription-answer.png
   :alt: 知识库根据三段音频转录内容返回总结和待办事项
   ```

## 教程完成

您已经使用 **语音转录问答** 工作流模板批量处理了 3 段音频，将转录内容写入知识库并完成问答。后续可以替换为自己的会议、访谈或客服录音，沿用同一套工作流配置批量转录和问答。
