档案不缺,缺的是可承受的审核产能
馆藏档案须经鉴定审核之后方可开放利用。当数据量、种类与到期增量同时上涨,而鉴定仍以人工逐件翻阅为主,开放审核就成了整个开放利用链条上最窄的那一段。
轩恩给出的答案是用 AI 把审核产能补上:以自研大模型与档案 OCR为技术底座,从元数据、篇章、句段、字词、图像多维度开展语义鉴定,自动完成分类与标注,并逐条给出敏感原因,让开放审核从人力驱动走向智能辅助。
为国家综合档案馆与党政机关数字档案室,提供可交付的开放审核能力
系统面向馆(室)档案开放审核工作的实际需求,采用跨平台语言开发,搭载自研大模型并以馆内实际数据开展模型训练,把敏感语料数据包接入 AI 算法中台,形成多模态数据管理、智能辅助鉴定与开放审核三大能力,辅助馆内人员开展鉴定审核,提高鉴定的准确性与效率。
面向国家综合档案馆
直面馆藏数据量庞大、种类繁多、到期档案增长快的现实,支撑年度开放审核任务的建立、办理、复审会审与结果输出,让积压的待审核档案能够按计划逐年推进。
面向党政机关数字档案室
把开放意见鉴定前移到归档与移交环节,在电子档案进馆之前自动生成开放意见,并随档案一并封装移交,减少进馆之后的二次鉴定与往复协调。
分层解耦,从基础环境一路收拢到智慧工作台
系统采用 B/S 架构设计,各层级业务与功能设计实现参考国家、行业标准,并以安全策略与管理制度贯穿始终,为开放审核业务提供稳定的运行底座与清晰的职责边界。
档案智能开放审核系统 · 整体架构
算法模型应用
- 目录审核模型(可定制)
- 敏感图像模型(可定制)
- 敏感句子模型(可定制)
- 敏感词模型(可定制)
开放审核工作流程管理
- 创建工作流程
- 环节与节点配置
- 分配人员工作
- 流程部署与调用
角色与权限管理
- 来源单位管理
- 角色管理
- 数据权限管理
- 流程节点主责人
架构与部署
采用 B/S 架构设计,适配信创与非信创通用服务器环境、算力服务器、中间件、数据库与存储等基础软硬件;可采用应用容器引擎 Docker 方式部署,支持集群式系统部署,并适配用户端主流浏览器。
模型与流程
把档案敏感语料形成敏感语料数据包并导入 AI 算法中台,通过自定义建立目录审核模型、敏感图像模型、敏感句模型,为鉴定开放工作流程提供辅助鉴定能力;流程内用户、角色、权限均可配置,形成完整工作流程。
能力输出
系统既可作为独立业务系统部署应用,也可通过接口与数字档案馆系统、数字档案室系统集成对接,以子系统或能力组件的方式对外提供开放审核能力。
架构示意图按系统实际层级关系绘制,界面与配色以实际交付版本为准。
七大核心模块,103 项功能点覆盖开放审核全流程
系统按「数据 → 模型 → 审核」的业务顺序组织功能:先把数据管起来,再把模型训出来,最后把审核跑起来;系统管理与个人中心提供支撑,工作台把任务态势集中呈现。以下按模块给出能力边界,功能点可按需提供对照清单。
功能模块可按独立业务系统整体部署,也可按接口方式与数字档案馆系统、数字档案室系统集成对接 —— 能力输出方式随建设模式灵活选择。
一套产品内核,三种落地路径
同样的数据管理、鉴定模型与开放审核能力,既可以建在馆里,也可以嵌进已有的档案系统,还可以整体交给服务方来跑。
档案馆用户
面向国家综合档案馆的年度开放审核任务,提供两种建设与应用方式。
将档案智能开放审核系统单独建设,或集成在数字档案馆系统内,作为数字档案馆子系统开展建设与应用,与现有的目录、原文、利用等业务系统共用一套用户与权限体系。
由轩恩提供开放审核系统与人工审核服务,采用系统智能鉴定审核 + 人工复审的服务方式,馆内统一协调管理各项工作;机器审核与人工审核完成后成果统一交付馆方,由馆方开展开放档案的 100% 检查与受控档案的抽查;用于数据存储的硬盘、光盘一并不带出馆,统一交由馆方封存处理。
档案室用户
面向党政机关数字档案室的归档与移交场景,把开放审核能力前移到移交之前。
在具备算力服务条件的前提下,将开放审核系统的核心能力整合至电子档案管理系统内,把能力用于电子档案管理系统归档、移交环节中的电子档案开放意见鉴定,自动生成档案开放意见,并将意见统一封装开展进馆移交等工作。
以接口方式调用鉴定算法与模型,不改变原有电子档案管理系统的业务流程与界面习惯,档案人员在原有工作界面上即可完成开放意见的生成与确认。
三条路径共用同一套产品内核 —— 建在馆里、嵌进系统、或整体外包,差别只在部署边界与人力投入,功能与算法能力完全一致。
八步闭环,每一步都有据可查
从建立任务到结果导出,机器辅助与人工审核交替推进,中间任何一环发现疑义都可以驳回重审,整条链路在系统内留下完整台账。
前置工作
开放审核工作
流程示意图按系统实际环节关系绘制,实际节点配置以项目交付方案为准。
七项能力特色,都落到可验证的指标上
从算法指标到部署形态,从内置语料到运行时长,系统的每一项特色都可以在真实环境里被验证,而不是停留在描述层面。
技术先进性
AI CORE采用自研大模型并经过馆内实际数据训练,真正实现语义可解释的档案智能开放审核;自研档案 OCR 算法兼容手写与印刷场景,在自建数据集评估印刷体准确率 99% 以上、手写体准确率 85% 以上。
业务先进性
系统内置几千条敏感词等数据信息,可直接用于各馆档案开放审核工作;内置经学习积累的30 余条档案敏感信息分类,可直接用于各馆开放鉴定工作,精准反馈文件敏感原因。
性能先进性
单服务每天可开展 6000 件以上档案智能鉴定工作(平均每件档案画幅 10 页左右);支持集群式系统部署,分布式部署时支持多节点并行任务处理,支持多 GPU 部署。
灵活性易用性
紧密契合开放审核鉴定业务流程,既满足标准化作业要求,又可按项目建设模式与工作习惯调整流程配置;支持多租户账号,实现租户间数据库级别数据隔离。
功能齐全性
覆盖用户及角色管理、敏感信息管理、模型管理以及开放审核各环节所需的功能管理,全面覆盖开放审核全场景需求。
扩展与可靠性
提供完备的接口平台与标准数据获取接口,可快速与第三方数字档案馆系统集成;支持集群部署与多 GPU 部署,可按业务需要快速扩展;可保持 7×24 小时稳定运行。
系统兼容性
兼容国产信创与通用环境,可与馆内既有服务环境兼容适配,沿用已有的软硬件资源,节省系统建设费用支出。
上述指标为基于自建数据集的评估结果,实际表现与档案类型、画幅质量及算力配置相关,可在方案阶段结合馆藏样本做针对性验证。
让到期档案,该开放的尽快开放
告诉我们馆藏规模、年度开放审核任务量与现有信息化环境,轩恩将提供针对性的建设路径建议与产品演示,也可按需出具功能参数对照材料与开放审核实施方案。
