LocalOCR · 功能说明

把行列、公式与页面位置一起保留下来

当一行文字必须和另一列数字对应时,只把字读出来还不够。结构解析保留表格、公式、区域和阅读顺序,让我能继续整理材料,并按同一页的图像位置核对每一处内容。

当前情况:已有保留表格、公式、区域和阅读顺序的解析功能;行列与关键数字仍需回到原页检查。

项目快照核对于 ;具体测试保留各自日期,页面不实时探测运行状态。

复制 AI 续作说明带着这个项目,交给 AI 接着做

写下接下来想做什么。这里会把你的目标、本页事实和来源整理在一起,复制给 Astra 或 Gemini 后,就不用重新介绍项目了。

整理续作说明

只在当前网页整理,不会发起 AI 任务。

用途与实际影响

这项功能怎样使用

为什么需要它

采购表、双栏文档和公式页容易被普通提字打散。这个模块把结构作为明确结果需求:模型负责还原可见关系,原图负责最终复核,不把一段流畅文本当作表格已经准确恢复。

举个实际例子

我可以说:“把采购订单的商品、型号、数量、单价和金额按行列保留下来。”系统会检查列数、商品与数字对应关系和合计;识别出来的数字仍要回到原图核对,不能直接当成正确业务金额。

最后我会得到什么

拿到可阅读的表格、公式和页面位置,也有供程序处理的结构化文件;商品与金额关系可回原页核对。它不直接生成 Excel,也不能凭识别到印章就判断真假。

正常时

结构与文字一起返回,可以按页和区域核对。

发现问题时

行列、阅读顺序、公式或坐标有误时保留原始输出并回原图检查,不静默改写。

入口不可用或证据不足时

结构模型或输入不支持时返回明确失败;普通提字的结果不能冒充结构解析成功。

从哪里开始

在 LocalOCR 请求中明确说“保留表格行列、公式或区域”,并指定原件。

需要准备什么

  • 有结构的图片或扫描 PDF
  • 需保留的列、公式、印章区域或页码

从开始到拿到结果

  1. 1

    识别哪些关系不能丢

    系统从页面找出表头、行列、公式和区域,再选择能保留这些关系的识别路线。

  2. 2

    逐页还原可见关系

    系统按实际模型解析页面,保存表格块、文字行、顺序和位置。

  3. 3

    回到原页核对

    取得可读和结构文件后核对关键单元格;不把整齐排版当金额正确,也不宣称生成 Excel。