废标雷达投标体检
本机解析 · 文件不出本机

两份文件,一次体检

招标文件 × 我方标书 → 废标风险清单

只出风险疑点,不判废标、不承诺中标。机器判不了的(签章 / 手写 / 扫描件 / 评委裁量)一律降级「须核原件」,回原件由人定。
1

上传招标文件

未上传

拖入文件,或

PDF · DOCX · TXT · MD

2

上传我方标书

未上传

拖入文件,或

可多选 · 多册自动合并

3

体检报告

待比对
两份文件就绪后才能开始
准备中…
口径与边界 · 这套东西怎么实现的五层管线
先说清口径(比功能重要):本工具做的是「与招标文件显性条款是否一致」的机械比对,输出风险疑点清单—— 不判废标、不承诺中标、不预测中标概率。凡机器判不了的(签章、手写、扫描件、评委裁量)一律降级「须核原件」由人核定。 宁多报一条黄灯,不放走一条红灯;但也绝不说「你已废标」。

难点不是做一个三步页面,而是「对比」在工程上根本不存在 —— 两份文档词不同、结构不同、页数不同,直接 diff 毫无意义。 正确做法:先把招标文件收敛成一张受控检查表,再拿这张表去标书里逐条找证据。 即 compare → extract + retrieve + judge

① 解析PDF / DOCX / TXT → 带定位的文本块(页码、段落号)。必须留出处坐标,否则建议指不回原文。同时出页级可读性台账:无文字层的页显式登记「未读到」,不静默漏检。
② 抽取从招标文件抽四类条款:A 资格性否决项B 形式性否决项C 响应性★D 评分项。判据是「否决词 × 强制词 × 材料名 × 数值」多信号叠加,不让模型自由发挥。同一份招标文件被 N 家投标 → 抽一次用 N 次。
③ 检索每条清单项去标书里做三件事:材料族匹配专属证据词同处共现(材料名在、证据词不在 → 不可判「已响应」)、数值 / 等级抽取(60 日 vs 90 日、中级 vs 高级、2 项 vs 3 项)。
④ 判定六态输出:缺失 / 不符 / 须核原件 / 疑点 / 提前提醒 / 已响应。三条正交信号叠加才敢报:长重复 ≥55 字 × 招标 n-gram 命中率 ≥0.5 × 落在响应偏离表区(缺一不报 —— 单条件阈值=误报引擎)。
⑤ 输出结论按「招标原文+出处 → 我方证据+出处 → 判定依据 → 建议动作」四段式,按风险排序。导出报告带 G1–G6 六类出门必备块,页面自带出门自检:报告自己过不了闸,就不当交付物出门。
能力边界(不讲清就是虚假承诺): ① 扫描件 / 图片页无文字层 → 检索不到,「没看出」≠「没有」; ② 签章、手写、骑缝章、公章真伪 → 机器判不了,只能标「须核原件」; ③ 评标委员会裁量范围(方案优劣、报价合理性)→ 本工具不碰; ④ 本工具是网页版原型(前端规则引擎),与项目内 Python 引擎 blind_check.py 非同一实现,判据同源、口径一致; ⑤ 报告不承诺中标、不预测中标概率、不构成投标决策依据。