CAD 图纸分割

分析图纸页面,识别区域、文字和部件关系,并生成图纸报告或检索单元。

输入图纸 PDF 或图片,识别结果可用于视觉检索、信息提取和索引构建。

配置输入与模式

配置

说明

文件

绑定待处理图纸的 Catalog file_ids

LLM 模型

选择分析使用的工作区模型

视觉模型

选择 OCR 与视觉判定使用的模型

解析模式

配置预填 deepfast 使用粗粒度检索解析

报告模式

配置预填 drawing_reportsegments 返回分割结果,retrieval_index 面向快速检索

CAD 分割服务地址

可选自建服务地址;留空使用内置共享服务

快速模式对应 retrieval_index。深度模式使用 drawing_reportsegments

控制处理预算

配置默认值为:最大 Agent 轮数 16、最大工具并发 4、每页最大候选区 64、最大裁剪次数 24、最大精修次数 18、最大视觉判定次数 12。

CV 配置档默认为 cad-default-v1,SAM 配置档默认为 sam2-default-v1,产物级别默认为 review

drawing_report 模式可将最大 Agent 轮数设为 0,跳过额外 Agent 增强并保留基础结果。

使用输出

分割或报告路径可返回 segmentspartsrelationshipsocr_texts;快速检索路径返回 items 等检索单元。根据所选报告模式读取相应结果。

manifest_file_id 指向结果清单,artifact_files 包含相关产物,statusreview 用于检查结果状态。继续构建视觉清单时,保留完整结果,特别是 page_sources 与图片引用。

示例:为图纸建立视觉索引

流程示意:读取 MOI 卷 → CAD 图纸分割 → 构建文档视觉清单 → 图片嵌入。

选择深度解析和图纸报告模式,将完整 CAD 结果传给视觉清单的 cad_result,再通过清单建立图片索引。

继续阅读

最后更新于