CASE 01 / BRAND STORE REVIEW RAG AGENT
把门店图纸, 变成审核现场
把企业设计手册接进门店审核:系统先查依据、找问题、整理审核初稿;审核人员从“需确认”项进入最终复核。
PDF → enterprise RAG → evidence → review → report
项目解决什么问题
门店审核最费时间的,是找标准、逐页看图纸和整理依据。
审核人员收到门店设计 PDF 后,需要对照品牌手册检查门头、Logo、展陈、灯光、动线、材质、POSM、Cue Card 等内容。传统流程要在手册和图纸之间反复切换:标准分散,几十页图纸容易漏项,审核意见也常缺少对应条款,最后还要重新整理问题、依据和建议。因此,这个项目把查标准、找证据、生成初稿和导出报告自动化,把最终设计判断留给审核人员。
企业 RAG 先整理依据,审核人员再判断。
提交一份 PDF,后台完成初审准备。
审核人员先填写渠道、门店类型和等级,再上传设计 PDF。系统约 1 秒返回任务 ID,随后由 MinerU 在后台拆出页面文本、图片和结构,并根据门店条件只激活本店适用的检查项。每个检查项再分别查找手册原文、读取数量和尺寸、识别门头与展陈等视觉对象;系统把手册依据、规则条件和图纸证据合在一起,输出“通过 / 未通过 / 需确认”。任务完成后同时生成网页结果页和 PDF 报告,审核人员从“需确认”项继续复核。
企业 RAG 先整理手册,规则库再激活本店检查项。
项目准备阶段先上传品牌标准设计手册。系统按条款和语义边界切分内容,相邻片段保留 20% 上下文重叠,避免一句标准被截断;这些片段建立成可以回到手册原文的企业 RAG 知识库。与此同时,系统从条款中提取检查对象、数量或尺寸要求和适用条件,形成门店规则库。实际审核时,系统先按渠道、类型和等级激活本店规则,再从知识库找出对应原文,并把这段依据绑定到具体检查项。
- 语义切分按条款和语义边界切成可检索片段
- 20% 上下文重叠片段首尾保留上下文,避免标准被切断
- 建立检索索引BM25 + Query Expansion + Metadata-aware Rerank
- 抽取条款与条件对象 · 数量 / 尺寸 · 适用范围
- 绑定门店条件渠道 · 类型 · 等级 · 检查对象
- 确认规则版本当前规则库 279 / 279 条已确认
文本规范
从设计手册里找到对应章节和条款,再结合门店条件判断是否适用。
数量与尺寸
把 PDF 中的文字、表格和页面图像放在一起,检查数量、尺寸等可核对信息。
图像样式
识别门头、POSM、Cue Card、展陈、灯光和动线等设计对象,补足文本看不到的部分。
结果交付
把每个检查项的结论、依据、问题和建议整理到网页结果页与 PDF 报告。
检索时,BM25 先从手册片段中找到与检查项相符的原词和数值;Query Expansion 扩展 POSM、Cue Card、门头、展陈、动线等业务表达;Metadata-aware Rerank 根据手册章节、检查类型、门店条件和数值单位重新排序;Evidence Binding 再把选中的手册原文绑定到具体检查项。审核人员不需要理解这些技术名,但可以从结论直接回到依据。
企业 RAG 不只给答案,而是组织一条可追溯的审核任务。
激活检查项后,系统不会用同一种方式处理所有问题。文字规范类先通过企业 RAG 找到手册条款,再结合规则条件判断是否适用;数量和尺寸类同时读取 PDF 中的文字、表格、标注和页面图像;门头、POSM、Cue Card、展陈、灯光和动线等图像样式类会生成视觉识别任务。最后,系统把手册原文、门店条件和设计证据绑定到同一检查项,才输出“通过 / 未通过 / 需确认”,审核人员可以从结果直接回到原文和图纸核对。
证据不够时,系统把问题交给人。
PDF 页面解析不完整、企业 RAG 找不到足够手册依据、视觉识别置信度低,或数量和尺寸没有明确证据时,系统不会强行判定通过,也不会把整条任务直接判失败。它会保留已经解析的页面、找到的条款、当前规则条件和缺失原因,把对应检查项标成“需确认”。审核人员打开这一项后,可以沿着手册原文和设计画面继续核对,再补上最终判断。
证据不足
手册依据或设计证据不够时,输出需确认项和复核建议。
视觉置信度低
门头、POSM、动线等对象识别不稳定时,保守进入人工复核。
解析不完整
保留页面图像和已解析结构,尽量不中断后续审核。
任务异常
记录任务状态,结果页可解释当前进度,不让审核流程卡死。
结果要能跑通,也要知道哪里容易出错。
整体测评由真实门店链路、完整自动化测试和 RAG 评测三部分组成。20+ 个真实门店样本都走过“上传 PDF → 后台初审 → 结果页 → PDF 报告”的完整链路,门店测试只公开样本数量,不展示具体单店通过项。自动化测试覆盖页面、规则、任务状态和报告生成;RAG 正向评估检查正确条款能否排在前面;hard-negative 评估则加入内容相似但不适用的手册片段,检查系统会不会被错误依据干扰。规则库目前 279 / 279 条已确认,禁用依据 Top-1 命中率保持 0.0。
公开内容停在结果界面和测试结论;内部手册正文、门店设计源文件、密钥、服务地址和调试字段不会出现在公开内容中。
把查标准和报告整理压缩到后台,人工保留最终判断。
本机真实 PDF 样本测试里,提交后约 1 秒返回任务 ID,审核人员不用停在上传页等待;后台约 4-5 分钟完成 MinerU 解析、检查项激活、企业 RAG 检索、视觉识别、逐项判断和 PDF 报告生成。传统方式需要人工逐页看图、反复翻手册,再整理问题和审核意见,通常是半小时级工作;按人工初审整理约 30 分钟、系统生成初稿约 5 分钟计算,重复性处理时间约减少 80%。项目没有做生产环境 A/B 测试,因此这只是本机样本估算,不是正式上线后的效率承诺。