1. 项目背景与行业痛点
在智能制造和新能源领域,三一重能作为头部企业每年收到的校招简历数量呈现指数级增长。2023年秋招季,仅研发岗就收到超过2.3万份简历,而HR团队需要在一周内完成首轮筛选。传统人工筛选模式下,平均每份简历的审阅时间不足30秒,且存在三个核心痛点:
- 标准不统一:不同HR对"优秀候选人"的判定存在主观差异,曾有同份简历被不同面试官打出相差40分的极端案例
- 隐性成本高:据统计,每1000份简历筛选需要消耗约200人时,且筛选后进入面试的候选人中有35%因基础条件不符需要重新补录
- 长尾效应:后段简历(投递时间靠后)获得关注的概率比前段简历低47%,容易遗漏潜在人才
需要模型API调用? 免费领10W Token,多模型网关一键接入 Claude、DeepSeek 等主流模型。
2. 技术方案设计思路
2.1 核心算法架构
我们与牛客网合作开发的AI筛选系统采用三级漏斗模型:
code复制[原始简历PDF/Word]
→ [结构化解析层](NLP实体识别+格式转换)
→ [特征提取层](教育背景/项目经历/技能标签化)
→ [智能匹配层](岗位JD向量化+余弦相似度计算)
关键技术选型:
- 使用BERT-Base-Chinese模型进行文本语义理解(准确率92.6%)
- 针对工科简历特有的专利/论文/项目描述,定制了38个专业实体识别标签
- 相似度计算采用组合权重:教育背景(30%)+技术栈匹配度(40%)+项目相关性(30%)
2.2 动态阈值机制
为避免"一刀切"导致人才流失,系统设置了动态评估机制:
- 硬性条件(如学历、专业)采用绝对过滤
- 软性条件(如项目经验)设置弹性区间:
- 核心匹配项:相似度≥75%直接通过
- 潜在匹配项:60-75%进入人工复核队列
- 特殊标记项:识别到"国家级竞赛获奖"等关键信号自动提升权重
3. 系统落地细节
3.1 数据预处理实战
原始简历解析存在诸多挑战,我们总结出以下处理方案:
| 问题类型 | 解决方案 | 准确率提升 |
|---|---|---|
| 非标准格式 | 开发多模态解析引擎(支持PDF/图片/网页表单) | 89%→97% |
| 缩写术语 | 建立领域词库(如"SolidWorks→三维建模软件") | 识别率提高42 |
