CASE 01 / BRAND STORE REVIEW RAG AGENT

把门店图纸, 变成审核现场

把企业设计手册接进门店审核:系统先查依据、找问题、整理审核初稿;审核人员从“需确认”项进入最终复核。

> PDF → enterprise RAG → evidence → review → report
Read case
门店审核结果页截图
Result preview 把通过、需确认、依据覆盖和报告入口收在同一个复核界面里。
20+真实门店测试 279条规则已确认 0.0禁用依据命中率

项目解决什么问题

门店审核最费时间的,是找标准、逐页看图纸和整理依据。

审核人员收到门店设计 PDF 后,需要对照品牌手册检查门头、Logo、展陈、灯光、动线、材质、POSM、Cue Card 等内容。传统流程要在手册和图纸之间反复切换:标准分散,几十页图纸容易漏项,审核意见也常缺少对应条款,最后还要重新整理问题、依据和建议。因此,这个项目把查标准、找证据、生成初稿和导出报告自动化,把最终设计判断留给审核人员。

案例一览

企业 RAG 先整理依据,审核人员再判断。

服务品牌西门子门店体系
项目时间2026 年 4-6 月
输入与条件门店设计 PDF + 渠道 / 类型 / 等级
审核对象门头 / 展陈 / 灯光 / 动线 / 材质 / POSM / Cue Card
系统先做解析图纸、激活检查项、查找手册依据、整理审核初稿
人工保留核对设计证据,处理“需确认”项,确认处理建议
交付结果网页结果页 + PDF 报告,列出通过、未通过、需确认
真实门店测试20+ 个真实门店样本,均生成结果页与 PDF

提交一份 PDF,后台完成初审准备。

审核人员先填写渠道、门店类型和等级,再上传设计 PDF。系统约 1 秒返回任务 ID,随后由 MinerU 在后台拆出页面文本、图片和结构,并根据门店条件只激活本店适用的检查项。每个检查项再分别查找手册原文、读取数量和尺寸、识别门头与展陈等视觉对象;系统把手册依据、规则条件和图纸证据合在一起,输出“通过 / 未通过 / 需确认”。任务完成后同时生成网页结果页和 PDF 报告,审核人员从“需确认”项继续复核。

HOW A REVIEW RUN MOVES 从设计 PDF 到可复核报告
01 / INPUT上传设计 PDF门店条件 · 渠道 / 类型 / 等级
02 / PARSE读取图纸内容文本 · 页面图像 · 结构
03 / SCOPE确定检查范围只启用与本店相关的检查项
规则与视觉证据并行补充
A / HANDBOOK检索企业手册企业 RAG · 规则库 · 原文章节
B / VISION识别设计对象门头 · POSM · 展陈 · 灯光 · 动线
合并为逐项结论
04 / CHECK生成审核初稿通过 · 未通过 · 需确认
05 / REVIEW人工复核依据覆盖 · 设计证据
06 / REPORT结果页与 PDF可留档 · 可继续处理
系统先完成可重复的初审准备;依据或置信度不足时,结果保持“需确认”,把判断留给审核人员。

企业 RAG 先整理手册,规则库再激活本店检查项。

项目准备阶段先上传品牌标准设计手册。系统按条款和语义边界切分内容,相邻片段保留 20% 上下文重叠,避免一句标准被截断;这些片段建立成可以回到手册原文的企业 RAG 知识库。与此同时,系统从条款中提取检查对象、数量或尺寸要求和适用条件,形成门店规则库。实际审核时,系统先按渠道、类型和等级激活本店规则,再从知识库找出对应原文,并把这段依据绑定到具体检查项。

HOW THE HANDBOOK BECOMES EVIDENCE 一份企业手册,变成可检索、可激活的审核依据
01 / HANDBOOK 上传标准设计手册 章节 · 条款 · 版本
A / ENTERPRISE RAG 形成企业 RAG 知识库 检索时能回到手册原文
  1. 语义切分按条款和语义边界切成可检索片段
  2. 20% 上下文重叠片段首尾保留上下文,避免标准被切断
  3. 建立检索索引BM25 + Query Expansion + Metadata-aware Rerank
B / RULE LIBRARY 形成门店规则库 把手册条款整理成可执行的检查项
  1. 抽取条款与条件对象 · 数量 / 尺寸 · 适用范围
  2. 绑定门店条件渠道 · 类型 · 等级 · 检查对象
  3. 确认规则版本当前规则库 279 / 279 条已确认
ACTIVATE FOR THIS STORE 按渠道 / 类型 / 等级激活规则 → 绑定具体检查项 再与设计 PDF 的文本、结构和视觉证据合并
企业 RAG 负责找到“手册怎么说”,规则库负责决定“这家店该检查什么”;两者共同给出有出处的审核初稿。

文本规范

从设计手册里找到对应章节和条款,再结合门店条件判断是否适用。

数量与尺寸

把 PDF 中的文字、表格和页面图像放在一起,检查数量、尺寸等可核对信息。

图像样式

识别门头、POSM、Cue Card、展陈、灯光和动线等设计对象,补足文本看不到的部分。

结果交付

把每个检查项的结论、依据、问题和建议整理到网页结果页与 PDF 报告。

检索时,BM25 先从手册片段中找到与检查项相符的原词和数值;Query Expansion 扩展 POSM、Cue Card、门头、展陈、动线等业务表达;Metadata-aware Rerank 根据手册章节、检查类型、门店条件和数值单位重新排序;Evidence Binding 再把选中的手册原文绑定到具体检查项。审核人员不需要理解这些技术名,但可以从结论直接回到依据。

企业 RAG 不只给答案,而是组织一条可追溯的审核任务。

激活检查项后,系统不会用同一种方式处理所有问题。文字规范类先通过企业 RAG 找到手册条款,再结合规则条件判断是否适用;数量和尺寸类同时读取 PDF 中的文字、表格、标注和页面图像;门头、POSM、Cue Card、展陈、灯光和动线等图像样式类会生成视觉识别任务。最后,系统把手册原文、门店条件和设计证据绑定到同一检查项,才输出“通过 / 未通过 / 需确认”,审核人员可以从结果直接回到原文和图纸核对。

HOW A CHECK STAYS TRACEABLE 手册依据与设计证据共同支撑逐项结论
01 / SOURCE手册依据章节 · 条款 · 规则 ID
02 / EVIDENCE设计证据页面图像 · 对象 · 尺寸 / 位置
03 / DECISION逐项结论通过 · 未通过 · 需确认
TRACEABLE CHECK 原文、画面和结论留在同一条检查项里 证据不足时停在“需确认”,不跳过人工复核。
这条绑定关系让审核人员能从结果回到手册章节和设计画面,而不是只看到一个无法解释的状态。
按检查项分流先根据门店渠道、类型、等级和手册章节确定这家店真正需要检查什么。
结论带依据手册条款和设计画面绑定到具体检查项,审核意见可以回到原文和图纸核对。
画面也是证据门头、POSM、Cue Card、展陈、灯光和动线等对象进入同一条审核记录。
不确定就停下解析、检索或视觉识别证据不足时进入“需确认”,由人工补上最后判断。

证据不够时,系统把问题交给人。

PDF 页面解析不完整、企业 RAG 找不到足够手册依据、视觉识别置信度低,或数量和尺寸没有明确证据时,系统不会强行判定通过,也不会把整条任务直接判失败。它会保留已经解析的页面、找到的条款、当前规则条件和缺失原因,把对应检查项标成“需确认”。审核人员打开这一项后,可以沿着手册原文和设计画面继续核对,再补上最终判断。

WHEN CONFIDENCE DROPS 异常不被隐藏,而是进入可解释的复核路径
01 / SIGNAL异常入口解析 · 检索 · 视觉 · 任务状态
02 / GUARDRAIL统一标记需确认不强行通过,也不直接判失败
03 / HANDOFF人工复核从检查项展开依据与设计证据
KEEP EVIDENCE保留已有证据页面图像、结构化内容和来源仍可核对。
KEEP CONTEXT保留任务上下文结果页说明当前进度,不停在无反馈的空状态。
“需确认”是风险边界,也是后续人工判断的入口;系统不把不确定性伪装成自动化结论。

证据不足

手册依据或设计证据不够时,输出需确认项和复核建议。

视觉置信度低

门头、POSM、动线等对象识别不稳定时,保守进入人工复核。

解析不完整

保留页面图像和已解析结构,尽量不中断后续审核。

任务异常

记录任务状态,结果页可解释当前进度,不让审核流程卡死。

结果要能跑通,也要知道哪里容易出错。

整体测评由真实门店链路、完整自动化测试和 RAG 评测三部分组成。20+ 个真实门店样本都走过“上传 PDF → 后台初审 → 结果页 → PDF 报告”的完整链路,门店测试只公开样本数量,不展示具体单店通过项。自动化测试覆盖页面、规则、任务状态和报告生成;RAG 正向评估检查正确条款能否排在前面;hard-negative 评估则加入内容相似但不适用的手册片段,检查系统会不会被错误依据干扰。规则库目前 279 / 279 条已确认,禁用依据 Top-1 命中率保持 0.0。

门店测试:20+ 个真实门店样本 完整链路:结果页 + PDF 报告 规则库:279 / 279 条已确认
813 passed2 subtests passed
20+ 个真实门店样本均完成从上传到结果页与 PDF 报告的完整链路
RAG 正向评估Top-1 / Top-3 / Top-5 / MRR = 1.0
Hard-negative Top-1 = 0.95MRR = 0.975
Forbidden Top-1 hit rate = 0.0无禁用依据命中

公开内容停在结果界面和测试结论;内部手册正文、门店设计源文件、密钥、服务地址和调试字段不会出现在公开内容中。

把查标准和报告整理压缩到后台,人工保留最终判断。

本机真实 PDF 样本测试里,提交后约 1 秒返回任务 ID,审核人员不用停在上传页等待;后台约 4-5 分钟完成 MinerU 解析、检查项激活、企业 RAG 检索、视觉识别、逐项判断和 PDF 报告生成。传统方式需要人工逐页看图、反复翻手册,再整理问题和审核意见,通常是半小时级工作;按人工初审整理约 30 分钟、系统生成初稿约 5 分钟计算,重复性处理时间约减少 80%。项目没有做生产环境 A/B 测试,因此这只是本机样本估算,不是正式上线后的效率承诺。

WHO HANDLES WHAT 系统整理可重复步骤,审核人员保留关键判断
系统前置
解析设计 PDF激活检查项检索与聚合生成结果 / PDF
人工复核
通过 / 未通过 / 需确认核对依据覆盖确认处理建议
这里描述的是职责边界;时间数据来自本机样本,未做生产环境 A/B 测试。
约 1 秒先返回任务 ID,用户不用停在提交页面等待。
约 4-5 分钟后台完成解析、检查项激活、检索、判断和 PDF 报告。
约 80%(估算)按人工约 30 分钟、系统初稿约 5 分钟计算,不是生产 A/B 结果。
人工复核保留“需确认”项、依据覆盖和设计证据仍由审核人员确认。