# 人才简历信息提取

使用[信息提取进表](extraction-to-table.md)，把简历中的指定字段整理为表格。

1. 准备少量简历文件作为输入。
2. 定义需要提取的字段，例如姓名、教育经历和工作经历，并填写字段说明。
3. 配置结果数据库、表名和输出位置。
4. 运行工作流。处理完成后打开结果表，对照原文检查字段，特别是多段教育或工作经历的结构。

提取字段的结构需要与目标表匹配；在字段说明中约定缺失信息的处理方式，并检查对应结果。

只需要结果文件时，可选择[解析信息提取](document-extraction.md)。

## 设计字段结构

先确定目标表需要单条记录还是包含多段经历的结构。姓名可用字符串，教育与工作经历应明确是单个值还是数组，日期采用同一格式。缺失值约定必须与 Schema 类型一致。

字段说明写清提取范围，例如“最高学历”与“全部教育经历”是不同要求，不能仅用一个含糊的“教育”字段代替。

## 选择处理范围

信息提取进表默认汇总输入。一份简历和属于同一人的附件可以共同提取；多位候选人的简历不要直接作为一份汇总结果写入。先验证单份简历，批量处理时再配置逐文件处理及相应保存绑定。

## 检查一份结果

| 内容 | 核对方式 |
| --- | --- |
| 姓名与联系方式 | 与原文逐项比对，确认没有从其它附件误取 |
| 教育与工作经历 | 检查条目数量、日期顺序和嵌套结构 |
| 缺失信息 | 按字段约定保留空值，避免补写 |
| 数据表 | 核对目标数据库、列类型和影响行数 |
| 文件结果 | 检查输出卷，确认可以找到本次结果 |

## 写入失败时

先看提取 JSON 是否符合 Schema，再检查目标表。提取成功不能证明写表成功；表中已有记录也不能证明后续文件保存已经完成。更改表结构或重跑前，检查已写入数据。

[返回工作流模板](index.md)
