大部分民间金融组织未能对接人民银行直接查询征信,但人行征信报告只能让客户自己查询提供。目前客户自查版比较常见,自查版征信是PDF文件,存在征信信息量较大,阅读时间较久,因为不能编辑,想二次加工计算几乎不可能。因此开发了征信报告自动化解析结构化工具,方便金融人员快速、准确阅读征信报告。
- 征信版本多,且布局和信息度不同,增加了查看难度
- 征信报告页数多,信息量大,增加了查看时间
- 征信报告格式大都是PDF,图片格式,无法编辑,增加了二次计算的难度
- 征信报告因具有很高信息价值,但没有结构化入库,无法进行二次利用
- 征信报告存在篡改或造假可能,人工识别难度大,时间久
- 征信报告文件命名不规范,增加了检索难度
- 缩短阅读征信报告时间
- 结构化后公式计算,避免人为出错
- 落库后,方便检索和查询
- 数据沉淀,方便二次开发风控指标和模型
- 实现了用户可视化交互效果,增加了易用性
- Pdf版解析正确率100%,可解析成31张表,400+个字段
- 解析速度约2.5页/秒
- 解析结果可输出excel表,也可输出到数据库,进行二次加工和计算指标
- 目前可以运用到多个场景,比如业务初审快速判断准入、风控核额、数据策略增加风险指标