CAD 图纸分割¶
分析图纸页面,识别区域、文字和部件关系,并生成图纸报告或检索单元。
输入图纸 PDF 或图片,识别结果可用于视觉检索、信息提取和索引构建。
配置输入与模式¶
配置 |
说明 |
|---|---|
文件 |
绑定待处理图纸的 Catalog |
LLM 模型 |
选择分析使用的工作区模型 |
视觉模型 |
选择 OCR 与视觉判定使用的模型 |
解析模式 |
配置预填 |
报告模式 |
配置预填 |
CAD 分割服务地址 |
可选自建服务地址;留空使用内置共享服务 |
快速模式对应 retrieval_index。深度模式使用 drawing_report 或 segments。
控制处理预算¶
配置默认值为:最大 Agent 轮数 16、最大工具并发 4、每页最大候选区 64、最大裁剪次数 24、最大精修次数 18、最大视觉判定次数 12。
CV 配置档默认为 cad-default-v1,SAM 配置档默认为 sam2-default-v1,产物级别默认为 review。
drawing_report 模式可将最大 Agent 轮数设为 0,跳过额外 Agent 增强并保留基础结果。
使用输出¶
分割或报告路径可返回 segments、parts、relationships 和 ocr_texts;快速检索路径返回 items 等检索单元。根据所选报告模式读取相应结果。
manifest_file_id 指向结果清单,artifact_files 包含相关产物,status 和 review 用于检查结果状态。继续构建视觉清单时,保留完整结果,特别是 page_sources 与图片引用。
示例:为图纸建立视觉索引¶
流程示意:读取 MOI 卷 → CAD 图纸分割 → 构建文档视觉清单 → 图片嵌入。
选择深度解析和图纸报告模式,将完整 CAD 结果传给视觉清单的 cad_result,再通过清单建立图片索引。