双层 PDF
扫描件 / Word / 图片转换为国网要求格式的双层 PDF:可搜索、可复制,页面统一为扫描图形态。
- 内置离线 OCR(PP-OCRv4 + ONNX),无需联网
- 支持 PDF / Word / WPS / JPG / PNG / TIFF / WebP / GIF
- DPI 与质量可调,默认 150dpi
压缩包层级过深难以定位文件、体积超限无法上传、扫描件无法检索关键字、 发票需要逐张人工查验、开标后仍需手工核算价格分 —— 标搭子将这些环节分别做成独立工具并集成为一个客户端,用一句话即可调用。
v0.1.0 · 安装即用,不需要配置环境
这些问题轻则浪费时间,重则导致废标。标搭子为每一个环节提供对应的工具。
国网电子招投标平台要求投标文件为可检索的双层 PDF,纯扫描件只有图像层,会被直接判为无效。
Word 直接导出 PDF 时,批注会被渲染进正文,修订痕迹会渲成「删除了: 壹佰万元整」, 相当于把修改前的报价写在文件上;文档属性还会保留作者与公司名称。
国网标书的每层目录名即为完整的「公司名 + 项目名」,按原层级解压必然超过 Windows 的 260 字符上限。
传统压缩软件统一降低画质,正文中的印章与表格会一并模糊。
数十张发票需要在查验平台逐张录入代码与号码,效率低且容易输错。
基准价规则因项目而异(最低价法、平均价法、去高去低、平均价下浮等),现场手工计算耗时且难以复核。
工具以插件形式组织,可随客户端内置,也可从插件市场按需安装。 两类工具进入同一个注册表,界面、检索与任务派发不区分来源。
扫描件 / Word / 图片转换为国网要求格式的双层 PDF:可搜索、可复制,页面统一为扫描图形态。
Word / WPS 文档批量转换 PDF,批注、修订痕迹与文档属性均不会随文件带出。
压缩包可直接打开浏览,无需解压到本地,适用于嵌套过深、路径超长的场景。
按目标体积压缩标书,优先保证正文清晰度,仅对大图做有损处理,避免统一降低画质。
上传发票 PDF 或图片,自动识别发票要素并批量查验真伪,结果可导出。
开标后按评标办法批量计算各家价格分并排名,支持最低价法、平均价法、去高去低平均、平均价下浮等基准价规则。
每个工具都是独立插件,可单独发布与升级;新增能力通常无需重新安装客户端。
以下能力在实现上有较多具体取舍,相关参数与实测数据均直接呈现在软件中,便于自行判断。
让扫描件可被检索,同时保持扫描件的页面形态
采用 Adobe 的标准流程:页面重新渲染为图像 → 重新合成 PDF → 叠加透明文字层。 成品页面统一为扫描图形态,不含矢量对象、嵌入字体与原始文档属性,各页分辨率一致 —— 而一致性正是平台所要求的。
因此所有页面一律重新采样并识别,不做跳过。不支持「已有文字层即跳过」的优化: 一份文件中只要有数页被跳过,产出就不再是统一的扫描件形态。
| 档位 | 每页 | 200% 时的图像层 | 适用 |
|---|---|---|---|
| 96dpi 省体积 | ~38KB | 794px | 每页 40KB 等严格限制,需复核印章清晰度 |
| 150dpi 标准 | ~77KB | 1240px | 常见限制下的平衡点 |
| 200dpi 高清 | ~113KB | 1654px | 平台无体积限制时,与原件几乎无差异 |
| 300dpi | ~197KB | 2480px | ⚠ 超过原件分辨率后无实际收益,多出的像素为插值产生 |
重新采样不可逆,属于需要用户自行权衡的取舍,因此档位交由用户决定。
关键在于默认导出会一并附带的几项信息
转换调用本机安装的 Word / WPS(缺失时回退 LibreOffice), 不自行渲染 —— 标书属于重排版文档,版式一旦错乱即可能废标, 而 Word 导出的版本与用户所见完全一致。
前两项属于可能直接导致废标的问题,并非体验层面的瑕疵,因此正反两个方向都有测试覆盖: 选择「保留原样」时必须确实保留,否则该开关形同虚设。
| 附带信息 | Word 直接导出 | 本工具默认 |
|---|---|---|
| 批注 |
渲染进正文 批注 [ZS1]: 这个价格还要再核一遍,别带出去 |
不输出 |
| 修订痕迹 |
渲成「删除了: 壹佰万元整」 将修改前的原始报价写入文件 |
仅保留最终版 |
| 文档属性 |
作者、公司名随 PDF 一并带出 电子评标会比对元数据 |
清除 |
默认配置即为可直接提交的状态,无需打开设置即可使用。
语义理解在本地完成:一个零依赖的匹配器,离线运行、不产生费用、不联网。 也可选配大模型作为补充,未配置时不影响使用。
在资源管理器中复制文件后,于对话框内按 Ctrl+V(或拖入、点击 📎), 文件会先挂载到输入框,随后说明用途即可。匹配到需要文件的功能时将直接执行, 不会重复弹出上传引导。
仅提供文件而未说明用途时,软件不会自行猜测:按扩展名反查支持该格式的功能, 并询问「希望对这些文件执行什么操作」。
大型企业与涉密项目通常明确要求「投标文件不得上传」。对其它工具而言这是限制, 对标搭子则是设计前提。
OCR、PDF 合成、解压、哈希等处理均在本机执行。在甲方办公场所、评标现场或内网环境下, 无网络亦可正常使用。
敏感大文件一律本地处理,既满足合规要求,也省去了上传等待。 中文企业宽带的实际上行带宽普遍远小于下行,云端处理的耗时反而更长。
解压、OCR、哈希等耗时且可能异常的任务运行在独立工作进程中, 单个任务出现异常不会影响整个客户端。
每个插件包均校验 sha256 摘要与 Ed25519 签名;升级前执行自检,无法运行时自动回滚至上一版本。
每个工具都是一个插件,自行声明元数据、能力与所需权限。 界面、检索与任务派发由宿主统一负责,因此各工具之间不会各自演进。
新增功能通常无需等待客户端发版:插件更新发布至服务端后, 客户端在认证成功时自动同步至最新版本,安装后执行自检,失败则自动回滚。
{
"id": "my-plugin",
"name": "我的工具",
"description": "一句话说明解决什么问题",
"icon": "🛠️",
"keywords": ["关键词"],
"aliases": ["缩写", "pinyin"],
"permissions": ["fs:read"],
"capabilities": [{
"id": "run",
"title": "执行我的功能",
"examples": ["帮我……"],
"executor": "renderer"
}]
}
元数据与实现分离,客户端无需加载插件代码即可建立检索目录。