视频解析

将视频中的语音转写为文档记录和文本,供摘要、提取和保存节点使用。

适用于整理培训视频的口述内容。本节点处理视频中的语音,不提供逐帧画面理解或镜头内容描述。

配置转写

选择已上传的视频文件,或将“读取 MOI 卷”的 sources 输出绑定到本节点。

配置

说明

语种

不确定时选择 auto,由转写服务识别

降噪

配置默认值为 auto,控制转写前的降噪处理

最小静音间隔

默认 0.5 秒,范围 0.1–2 秒;用于确定语音切分点

最大语音时长

默认 30 秒,范围 5–60 秒;控制单个语音片段的时长

静音间隔和最大时长必须在允许范围内,超出范围会导致节点失败。这里的时长控制语音片段,不是整个文件的最大长度。

使用输出

documents 传给后续文档处理节点;需要生成摘要时使用 text;文本为空时不返回该字段。转写片段的内容和元数据通过文档数组传递。

示例:生成培训视频摘要

流程示意:读取 MOI 卷 → 视频解析 → AI 推理 → 存至 MOI 卷。

将解析结果的 text 绑定到 AI 推理提示词,要求模型整理主题和行动项,再保存生成的文本。

继续阅读

最后更新于