人才简历信息提取

使用信息提取进表,把简历中的指定字段整理为表格。

  1. 准备少量简历文件作为输入。

  2. 定义需要提取的字段,例如姓名、教育经历和工作经历,并填写字段说明。

  3. 配置结果数据库、表名和输出位置。

  4. 运行工作流。处理完成后打开结果表,对照原文检查字段,特别是多段教育或工作经历的结构。

提取字段的结构需要与目标表匹配;在字段说明中约定缺失信息的处理方式,并检查对应结果。

只需要结果文件时,可选择解析信息提取

设计字段结构

先确定目标表需要单条记录还是包含多段经历的结构。姓名可用字符串,教育与工作经历应明确是单个值还是数组,日期采用同一格式。缺失值约定必须与 Schema 类型一致。

字段说明写清提取范围,例如“最高学历”与“全部教育经历”是不同要求,不能仅用一个含糊的“教育”字段代替。

选择处理范围

信息提取进表默认汇总输入。一份简历和属于同一人的附件可以共同提取;多位候选人的简历不要直接作为一份汇总结果写入。先验证单份简历,批量处理时再配置逐文件处理及相应保存绑定。

检查一份结果

内容

核对方式

姓名与联系方式

与原文逐项比对,确认没有从其它附件误取

教育与工作经历

检查条目数量、日期顺序和嵌套结构

缺失信息

按字段约定保留空值,避免补写

数据表

核对目标数据库、列类型和影响行数

文件结果

检查输出卷,确认可以找到本次结果

写入失败时

先看提取 JSON 是否符合 Schema,再检查目标表。提取成功不能证明写表成功;表中已有记录也不能证明后续文件保存已经完成。更改表结构或重跑前,检查已写入数据。

返回工作流模板

最后更新于