运营技术支持 / 定制业务程序业务文档
中信登报送数据一致性校验
汇集34张报送表的固定字段,与全流程产品要素表逐笔核对并定位差异。
业务背景
2026年5月,为提高报送数据的一致性与准确性,公司开始在正式报送前开展一致性排查,并向IT部报送相关需求。恒生回复该需求属于个性化模块设计,报价七万元,综合考虑后暂采取自行排查的方式。
需求设计
使用者一次上传列名文件、当期34张报送表和全流程产品要素表,为文件指定对应角色后,点击“开始处理”。程序完成校验后,使用者直接下载差异报告,按产品、数据范围和差异字段查看问题,并将明确的差异项目反馈业务部门整改。
核心业务逻辑
- 确定核对口径。 从列名文件读取产品唯一标识字段和26个数据字段,组成当期固定的27字段核对范围。
- 校验报送表组合。 检查26个数据字段是否被全部覆盖、是否只在一张报送表中出现,以及所有参与合并的报送表是否包含产品唯一标识。无相关字段的文件自动排除;存在缺失、重复或关键字段缺失时停止后续合并,并直接说明问题。
- 校验全流程产品要素表。 判断要素表是否完整包含27个固定字段。存在多余字段时自动清理后继续处理;缺少固定字段时停止比对并生成字段校验结果。
- 形成标准报送数据。 从每张报送表中提取其对应字段,以产品唯一标识进行全量关联,合并为统一的27字段标准报送表。
- 逐笔逐字段核对。 先按产品唯一标识区分双方共有、仅报送表存在和仅要素表存在的数据;对双方共有产品的26个数据字段逐格比较,记录一致行、不一致行、差异字段和差异单元格数量。
- 统一特殊字段口径。 对“期限类型”的编码写法和“预计到期日期/时间”的日期格式先进行含义归一,再判断是否一致,避免把表现形式不同但实际含义相同的数据误判为差异。
- 输出多维结果。 分别生成以报送表和全流程产品要素表为基准的差异报告,并同时提供字段分布校验、标准合并表、整行差异和要素表字段校验结果。差异单元格标红,结果中直接列明校验状态和差异字段。
数据安全与权责边界
- 程序采用纯前端设计,文件上传、数据比对、结果生成和下载实质上均为本地浏览器内部操作,数据不经过服务器,不存在数据外流风险。
- 34张报送表由聂文景使用本人URP报送系统账号,在其账号权限范围内完成导出。全流程产品要素表通过邮件向IT部门申请,由恒生人员从数据库导出,再由IT部门通过邮件反馈。
- 程序输出双基准差异内外表,通过自动生成辅助列、差异字段和标色结果,快速定位缺失或差异内容,最终由人工进行审核研判。
交互与业务价值
| 对比项 | 人工使用 Excel 核对 | 程序核对 |
|---|---|---|
| 操作方式 | 在34张报送表中反复查找、复制或编写公式,再与要素表逐笔核对 | 上传文件、指定角色并点击一次“开始处理” |
| 处理时间 | 一次月度核对通常需要数小时,数据量和差异数量增加时还会继续延长 | 当前数据量约3秒内完成处理 |
| 差错风险 | 可能出现漏行、漏列、复制错位、公式范围错误和筛选遗漏 | 固定规则对全部记录重复执行,避免随机性人工操作差错;输入结构不符合要求时直接停止并提示 |
| 结果查看 | 需要人工标记并继续追查差异所在 | 同时展示一致与不一致记录、差异字段、差异单元格、仅单侧存在的数据及双基准结果 |