OnvergeAi 临界AI
OnvergeAi · OnvergeAi

档案检索

面向档案管理部门与综合办公:把档案与历史文件的查找从依赖个人经验变成按主题、时间与文号的可回溯检索,结果附文件名称、文号与存放位置;公开属性判定与查档审批仍由档案部门执行,检索、查看与导出全程留痕。

所属行业:地方政府职能部门 · 场景编号 SC-067 · 证据等级 B

这个场景做什么

把档案与历史文件的查找从依赖个人经验变成按主题、时间与文号的可回溯检索。系统做的是解析、编目辅助、定位与结果清单输出,不做的是判定文件公开属性、批准查档申请、代替档案管理部门的审批职责。检索结果必须附文件名称、文号与存放位置,公开与不公开范围按规定确认;检索、查看与导出行为留痕,以支持内部审计与责任追溯。

历史文件年代久、格式杂(扫描件与油印件占比高,检索依赖人工翻找与经验记忆,档案利用率低)
编目著录工作量大(著录进度慢,新入档材料积压,目录与实物长期不一致)
公开与不公开范围判定专业(判定错误存在责任风险,必须由档案管理员按规范确认)
查档与调阅行为需可追溯(检索与导出无记录则无法回应内部审计与责任追溯)

能力边界

不判定文件公开属性,不批准查档申请,不代替档案管理部门的审批职责;不改变档案原件与既有著录结论;不提供法律与政策效力认定;不向无权限岗位开放超出授权范围的检索与导出。

01

场景分析

这个场景处理的是一条典型链路:梳理范围与权限 → 解析与著录辅助 → 建索引检索 → 确认公开范围 → 利用留痕。前两步决定能不能查得到,后两步决定能不能查得起。

链路环节一:档案范围与权限梳理

逐类登记可检索、仅显示目录、不得进入系统三类范围,明确岗位可见与导出权限。

产出:档案目录与权限清单

链路环节二:解析与著录辅助

对可入库文件做解析并生成著录草稿,标出待核对字段;原件保持只读,不覆盖既有著录结论。

产出:著录草稿

链路环节三:索引与检索

按主题、时间、文号与类别建立索引,文号与年度类查询加强关键字通道。

产出:检索结果清单

链路环节四:公开范围确认

检索结果中可能涉及不公开范围的条目单独标注,交档案管理员按规定确认。

产出:公开范围确认记录

链路环节五:利用与留痕

检索、查看与导出行为留痕;调阅按系统外审批流程执行。

机制:审计记录
02

输入输出与复核

每一步的输入、处理、输出与把关角色都必须明确,否则检索结果无法核验、导出行为无法追溯。

环节输入与处理方式输出与把关角色
主题检索输入:档案目录与可检索全文。处理:混合检索 + 权限过滤。输出:带定位清单 · 使用岗位
文号年度检索输入:文号、年度与保管期限条件。处理:精确匹配优先。输出:命中清单 · 使用岗位
著录辅助输入:件内材料。处理:要素提取与著录草稿生成。输出:著录草稿 · 档案管理员
关联梳理输入:同一事项的多份文件。处理:版本与关联关系梳理。输出:关联清单 · 档案管理员
公开范围提示输入:检索结果与类别规则。处理:按规则标注可能受限条目。输出:提示清单 · 档案管理员
导出与调阅输入:经确认的检索结果。处理:记录导出行为并按审批执行。输出:导出记录 · 档案管理负责人
03

治理保障

本场景的治理规则围绕“范围分治、权限留痕、原件只读、公开确认”四件事。

三类范围分治
可检索、仅目录、禁入系统三类范围逐类登记,禁入材料不参与解析、索引与检索。机制:范围登记
岗位权限与导出审批
账号按岗位最小化授权,导出需审批并留痕,离岗即时回收。机制:权限过滤
原件只读与著录独立
档案原件保持只读,系统生成的著录草稿不直接覆盖既有结论。机制:只读与草稿分离
公开属性按规定判定
公开与不公开范围由档案管理员按规定确认,系统不自行判定。机制:人工确认
审计与备份
记录检索、查看、导出与权限变更行为;审计范围与备份策略按客户制度配置。机制:审计策略
04

价值与衡量方式

收益用可测量的方式描述:查找耗时、定位正确度、著录条目产出与可见范围可交代程度。

查找耗时下降
衡量方式:选取 10—20 次典型查档任务,对比人工翻找与系统辅助后的人工核对耗时,形成基线。口径:同任务耗时对比
定位可核验
衡量方式:在约定测试集上统计结果定位正确(文件名称、文号、存放位置)的比例,未定位项按规则降级。口径:定位正确率(测试集)
著录产出提高
衡量方式:统计单位时间内经人工核对后完成的著录条目数变化。口径:核对后著录条目数
可见范围可交代
衡量方式:检查导出审批与权限变更记录的完整性,越权尝试由审计记录暴露并按流程处理。口径:记录完整性

※ 以上为方法说明与衡量口径,不构成对具体项目效果的承诺;结果受档案年代、扫描件质量与著录规则执行情况影响。

场景的结构化说明

典型任务
按主题、事由或关键词检索历史档案,输出带定位的结果清单:主题检索;按文号、年度与保管期限等条件精确检索,适配编号类查询:文号与年度检索;从件内材料提取标题、事由、成文日期等要素,形成待核对的著录草稿:文件编目与著录辅助;梳理同一事项的多份文件与版本关系,输出关联清单:文件版本与关联梳理;按检索结果提示可能涉及不公开范围的内容,交档案管理员确认:查档范围提示;按主题与部门统计检索与调阅情况,供档案管理参考:利用情况统计
适用前提
区分可进入检索索引的目录与全文、仅可显示目录、不得进入系统的涉密文件(明确可入库与不可入库范围);著录字段、编号规则与保管期限口径由档案管理员提供(档案目录与著录规则已确认);哪类文件不得进入通用检索、哪类需授权后查看,逐类登记(公开属性判定规则明确);明确岗位可检索、可查看、可导出的范围与审批要求(指定检索与导出权限)
推荐部署
纯私有化;知识库本地化 + 外部模型
推荐架构
默认将政务数据、向量库与模型置于授权网络内,管理与审计、备份按客户制度配置。档案目录与可检索全文入库,涉密文件与按规定不得进入系统的材料默认排除;检索按岗位与档案类别做权限过滤,输出附文件定位。若涉及外部模型参与,仅在完成脱敏、审批与合规审查后使用,只发送脱敏后的最小片段并留痕;档案原件保持只读,系统不修改既有著录结论。
数据流与边界
档案录入:档案目录与可检索文件只读入库,涉密与禁入材料默认排除;解析与著录:解析件内材料并生成著录草稿,原件保持只读;权限过滤后检索:按岗位与档案类别过滤,输出附文件名称、文号与存放位置;公开范围确认:可能受限条目单独标注,交档案管理员按规定确认;调阅与利用:在系统外按审批流程调阅,检索与导出行为留痕
交付物
档案目录与权限清单(表格):档案类别、可检索范围、岗位可见范围与导出审批要求;著录字段与规则说明(文档):著录字段、编号规则与待核对标记规则;检索与定位评测记录(报告):测试集构成、命中与定位正确情况、未达项归因;公开范围清单(表格):不得进入通用检索与需授权查看的类别登记;操作规范与复核规则(文档):检索、导出与公开范围确认的责任与留痕要求;配置与验收说明(文档):权限、审计与备份配置口径与可复跑检查项
上线节奏
第 1—2 周:档案范围与权限梳理;第 3—5 周:解析、著录辅助与索引构建;第 6—7 周:检索评测与公开范围确认;第 8 周起:单部门试运行并逐步扩围
人工复核点
著录草稿 / 档案管理员 / 著录要素与原件逐条核对;公开范围与授权查看 / 档案管理员 / 按规定确认公开属性与查看权限;检索结果定位 / 档案管理员 / 使用岗位 / 核对文件名称、文号与存放位置;导出与调阅 / 档案管理负责人 / 导出行为按审批要求确认并留痕;档案销毁与移交 / 档案管理负责人 / 按保管期限与规定程序执行,系统不参与
风险控制
涉密或未公开档案进入通用检索:入库前逐类登记,涉密与按规定不得进入系统的材料默认排除;越权检索与导出:按岗位与档案类别权限过滤,导出需审批并留痕;著录结论被自动改写:系统只生成著录草稿,既有著录结论以档案管理员确认版本为准;公开范围判定不当:通用检索默认不含需授权内容,公开属性由档案管理员按规定确认
合规依据
中华人民共和国档案法:档案的利用与公布按规定办理,不得擅自公布;系统的检索、查看与导出须受权限与审批约束;中华人民共和国个人信息保护法:档案中个人信息的使用遵循最小必要,不超出原处理目的
← 返回地方政府职能部门 估算投入区间 预约 30 分钟需求梳理

先做一次 30 分钟的需求梳理

说出你的行业、数据边界与预算区间,我们在 1 个工作日内给出可验证的下一步。