人才简历信息提取¶
使用信息提取进表,把简历中的指定字段整理为表格。
准备少量简历文件作为输入。
定义需要提取的字段,例如姓名、教育经历和工作经历,并填写字段说明。
配置结果数据库、表名和输出位置。
运行工作流。处理完成后打开结果表,对照原文检查字段,特别是多段教育或工作经历的结构。
提取字段的结构需要与目标表匹配;在字段说明中约定缺失信息的处理方式,并检查对应结果。
只需要结果文件时,可选择解析信息提取。
设计字段结构¶
先确定目标表需要单条记录还是包含多段经历的结构。姓名可用字符串,教育与工作经历应明确是单个值还是数组,日期采用同一格式。缺失值约定必须与 Schema 类型一致。
字段说明写清提取范围,例如“最高学历”与“全部教育经历”是不同要求,不能仅用一个含糊的“教育”字段代替。
选择处理范围¶
信息提取进表默认汇总输入。一份简历和属于同一人的附件可以共同提取;多位候选人的简历不要直接作为一份汇总结果写入。先验证单份简历,批量处理时再配置逐文件处理及相应保存绑定。
检查一份结果¶
内容 |
核对方式 |
|---|---|
姓名与联系方式 |
与原文逐项比对,确认没有从其它附件误取 |
教育与工作经历 |
检查条目数量、日期顺序和嵌套结构 |
缺失信息 |
按字段约定保留空值,避免补写 |
数据表 |
核对目标数据库、列类型和影响行数 |
文件结果 |
检查输出卷,确认可以找到本次结果 |
写入失败时¶
先看提取 JSON 是否符合 Schema,再检查目标表。提取成功不能证明写表成功;表中已有记录也不能证明后续文件保存已经完成。更改表结构或重跑前,检查已写入数据。
最后更新于