使用工作流批量转录音频¶
MOI 提供音频转录工作流模板,可以将多段音频批量转换为可检索的文本内容。模板会统一处理音频输入、语音识别和转录结果写出,适合把项目会议、客户反馈、访谈录音等资料一次性整理成文本。
本教程使用 3 段中文示例录音,演示如何通过 语音转录问答 模板批量完成音频转录。示例资料分别模拟项目周会、客户反馈和产品访谈,方便在同一条工作流中观察不同内容的转录结果。整个操作预计约 15 分钟,实际处理时间取决于音频时长和模型速度。
你将完成什么¶
下载并解压 3 段音频示例资料;
将多段音频批量导入 Catalog;
从系统模板创建音频转录工作流;
一次运行工作流,生成对应的转录文本;
在 Catalog 中查看和下载转录结果。
开始前准备¶
准备一个 MOI 账号,可前往 MOI 云端登录/注册;
确认当前工作区可以创建并运行工作流;
下载 音频转录教程样例包,解压后得到 3 个 MP3 文件。
样例包中的资料均为本教程制作的中文示例录音:
文件 |
内容 |
|---|---|
|
项目周会摘要,包含进展、计划和协作事项 |
|
客户反馈,包含现象、期望和改进建议 |
|
产品访谈摘要,包含功能偏好和转录需求 |
操作步骤¶
1. 将音频批量导入 Catalog¶
登录 MOI,在左侧导航的 数据连接 中选择 导入任务。
点击 新建导入任务,选择 非结构化 和 本地上传。
一次选择解压后的 3 个 MP3 文件。
将目标位置设置为当前工作区 Catalog 下的:
tutorial_data / audio_transcription / source
如果目录尚不存在,可以在选择目标位置时依次新建。
其余导入参数保持默认,点击 创建并开始导入。
等待导入任务完成,并确认 3 个 MP3 文件已出现在
source数据卷中。
导入任务列表中的状态显示为 已完成 后,再继续创建工作流。
2. 创建音频转录工作流¶
在左侧导航的 数据处理 中选择 工作流。
点击 创建工作流。
选择 语音转录问答 模板,点击 使用模板。
将工作流名称填写为
audio_transcription_demo。
该模板已经包含音频读取、语音转录和结果写出等节点,无需手动搭建处理链路。
3. 配置运行参数¶
打开工作流的运行配置,在模板提供的 源文件 或 数据源 参数中选择:
tutorial_data / audio_transcription / source
将文件范围设置为按文件,选中
project-weekly-meeting.mp3、customer-feedback.mp3和product-interview.mp3。在左侧选择 嵌入并添加到知识库。在 目标知识库 中点击 新建知识库,将知识库名称填写为
audio_transcription_knowledge,然后完成创建并选中该知识库。
在左侧选择 存至 MOI 卷,将 Catalog 保存位置设置为
tutorial_data / audio_transcription / output,用于保存转录分段 ZIP 压缩包。
计算资源、转录语言及其他配置均保持默认,点击 确认 保存运行配置。
4. 保存并运行工作流¶
返回工作流画布,点击 保存并启用。
点击 运行,确认本次运行包含 3 个音频文件。
在工作流页面右侧找到 作业 按钮并点击,在作业列表中等待本次运行完成。
工作流会按照同一套转录配置依次处理 3 个音频,并为每个输入文件生成对应的转录结果。
5. 在知识库中问答¶
等待工作流执行完成,并确认目标知识库中的资料处理完成。
在左侧导航进入 资源中心 > 知识库,打开
audio_transcription_knowledge,点击 对话。
发送问题,例如:
请总结三段录音中提到的主要问题和待办事项。查看知识库返回的回答及引用来源;如需查看原始转录结果,进入 Catalog 的
tutorial_data / audio_transcription / output目录,打开或下载对应 ZIP 文件。
教程完成¶
您已经使用 语音转录问答 工作流模板批量处理了 3 段音频,将转录内容写入知识库并完成问答。后续可以替换为自己的会议、访谈或客服录音,沿用同一套工作流配置批量转录和问答。