视频解析¶
将视频中的语音转写为文档记录和文本,供摘要、提取和保存节点使用。
适用于整理培训视频的口述内容。本节点处理视频中的语音,不提供逐帧画面理解或镜头内容描述。
配置转写¶
选择已上传的视频文件,或将“读取 MOI 卷”的 sources 输出绑定到本节点。
配置 |
说明 |
|---|---|
语种 |
不确定时选择 |
降噪 |
配置默认值为 |
最小静音间隔 |
默认 0.5 秒,范围 0.1–2 秒;用于确定语音切分点 |
最大语音时长 |
默认 30 秒,范围 5–60 秒;控制单个语音片段的时长 |
静音间隔和最大时长必须在允许范围内,超出范围会导致节点失败。这里的时长控制语音片段,不是整个文件的最大长度。
使用输出¶
将 documents 传给后续文档处理节点;需要生成摘要时使用 text;文本为空时不返回该字段。转写片段的内容和元数据通过文档数组传递。
示例:生成培训视频摘要¶
流程示意:读取 MOI 卷 → 视频解析 → AI 推理 → 存至 MOI 卷。
将解析结果的 text 绑定到 AI 推理提示词,要求模型整理主题和行动项,再保存生成的文本。
继续阅读¶
最后更新于