运营技术支持 / 通用处理工具业务文档
文件整理
按规则批量识别、重命名和归档文件并支持子文件夹整理。
业务背景
针对大量杂乱无需文档进行系统性自动清理
需求设计
使用者选择待处理文件夹,生成或导入 Excel 参数表配置整理规则,先执行试运行并确认预览结果,再选择批量重命名、归档、文件清单、格式转换或扫描件辅助识别功能。完成后在目标目录查看整理后的文件和结果清单。
核心业务逻辑
- 扫描目标文件夹并生成包含文件名称和规则字段的参数表,支持再次导入已保存的参数配置。
- 根据参数表执行批量重命名,或按文件名中下划线两侧的标识建立归档目录。
- 在正式处理前执行试运行,展示匹配、未匹配和命名结果,确认后再修改文件。
- 对无文字层 PDF 和图片等文件提供辅助识别,并可按识别结果添加扫描件、用印版等标记。
- 文件归档支持按左侧或右侧字段分类,并可继续建立一级子文件夹完成分层整理。
数据安全与权责边界
- 本工作流运作于自研Antonio Toolbox基座,该基座为本地实体程序,无云端设计。
- 本模块为纯本地模块及调用可选项(仅针对无文字层PDF和图片识别阶段),针对可选项,使用人自行判断使用本地模型(需要在本地部署ocr模型,过程复杂),百度API(每月1000免费额度,价格适中,但上云不适用敏感数据),或者人工识别兜底。
- 输入数据的合法来源及输出结果的复核和使用由使用者负责。
交互与业务价值
| 对比项 | 原处理方式 | 程序处理 |
|---|---|---|
| 操作方式 | 人工逐个查看文件、修改名称并建立目录完成分类移动 | 通过参数表配置规则,试运行确认后批量重命名或归档 |
| 处理时间 | 以100个文件估算,人工识别、命名和归档约需50至200分钟 | 不使用辅助识别时,同等数量在5秒以内完成试运行和批量整理 |
| 差错风险 | 重复操作可能出现命名不一致、分类遗漏或文件移动错误 | 正式处理前展示匹配、未匹配和命名结果,由使用者确认后再修改文件 |
| 结果查看 | 人工在多个目录中检查整理结果 | 通过试运行结果、文件清单和整理后的目录结构集中复核 |