Skip to main content
在数据录入场景下,由于模型能力在客观上仍无法做到100%准确,所以通常还需要有人工对抽取到的结果做二次核对校验,这就需要能将抽取结果快速定位到原文件中的对应位置,以提高核对效率。 TextIn xParse文档抽取API可以输出每个抽取结果的精确坐标信息,您可以参考以下教程获取结果坐标并基于此完成抽取结果的前端可视化工作。

数据结构分析

参考快速启动中的返回结果示例(prompt模式返回节选部分),文档抽取API的返回结果中包含了以下坐标关键信息:
  • position表示相关坐标信息,pages中有页面相关信息。

坐标系统说明

抽取API返回的坐标格式为:[x1, y1, x2, y2, x3, y3, x4, y4] 这表示一个四边形的四个顶点坐标,按顺时针排列:
例如上述返回数据中:

定义坐标提取函数

坐标可视化绘制器

主函数使用示例

  • 确保抽取结果json文件和原始图片在指定路径。
  • 生成的图片为 annotated_extract_result.png 和 legend.png。

输出效果

运行上述代码后,将得到:
  1. 标注后的图片 (annotated_extract_result.png):在原图上绘制彩色边框显示每个抽取字段的位置
  2. 图例文件 (legend.png):显示不同字段对应的颜色
Annotated Extract Result Pn 另外,或许 文档解析:获取坐标并完成前端可视化的教程 也会对您有所帮助。