











所属分类:图像/转换
产品案例页:https://engineering.gugudata.com/products/imagerecognition/document-field-extraction-workbench/
智能文档字段提取工作台面向招投标、采购、合同、财务、审计和资质审核团队,把 PDF、Word、TXT、Markdown 或纯文本中的业务字段解析为经过 Schema 校验的标准 JSON。产品提供原文预览、字段模板、JSON 结果、JSON Tree、证据定位、置信度、失败原因、人工复核和异步任务管理。
截图覆盖文档队列、原始文档预览、JSON Schema 定义、JSON Tree 抽取结果、质量概览、字段级复核、OCR 与执行模式、告警、人工复核队列和多格式导出。它不是只展示一段“智能回答”的聊天页,而是让原始文档、结构定义、JSON 结果和证据链同时可核对的业务工作台。
主要用户包括招投标资料人员、采购运营、合同管理员、财务与审计人员、数据录入团队、企业知识库维护人员和后端集成开发者。
典型场景包括:
顶部导航包括解析工作台、任务中心、字段模板、质量复核和系统设置。左侧文档队列展示文件名、类型、大小、时间和处理状态。
中间左侧保留原始文档预览,并高亮与字段结果对应的证据。中间右侧同时展示 JSON Schema 和 JSON Tree。用户可以在“JSON 结果”和“JSON Tree”之间切换,但原始文档始终保留,不能用格式化结果替代原始资料。
下方质量概览展示字段总数、成功字段、失败字段、成功率和平均置信度。字段级复核表展示字段名、状态、原始值、规范化值、类型、置信度、证据来源和操作。
右侧配置 OCR 模式与执行模式,展示执行进度、告警、待人工复核项和导出入口。低置信度、类型不匹配或歧义字段必须进入复核,不得静默写入下游。
file 与 text 必须二选一,支持 PDF、DOCX、TXT、MD/Markdown 和纯文本;二进制 .doc 先转换后上传。object,支持嵌套对象、数组及常用标量类型。auto、always 和 never,并显示实际文本抽取方式。auto、sync 和 async;大文档与扫描件优先使用异步任务。ocrMode 抽取文本,并按 executionMode 同步处理或创建任务。原始文档预览是复核基准,必须保留页码、缩放、下载和证据高亮。JSON Schema 编辑器显示字段 key、类型、标题、说明、必填约束和嵌套关系。JSON 结果用于复制和接口联调,JSON Tree 用于浏览复杂层级,两者来自同一份结构化结果。
字段表需要完整显示 status、value、normalizedValue、type、confidence、reason 和 evidence。成功率计算为成功字段数除以字段总数,界面不得把低置信度字段自动算作已人工确认。
失败字段按 NOT_FOUND、TYPE_MISMATCH、LOW_CONFIDENCE、AMBIGUOUS、UNSUPPORTED_SCHEMA 和 EXTRACTION_ERROR 分类。页面可以针对不同失败类型提供重试或人工修正,但必须保留原始返回值和修改记录。
| 业务步骤 | 接口名称 | 接口文档 | 请求地址 | 关键入参 | 关键出参 | 传参关系 |
|---|---|---|---|---|---|---|
| 解析文档字段 | AI 文档字段结构化解析 | document-field-extraction | POST https://api.gugudata.com/v1/document-extractions |
file 或 text、schema*、instruction、ocrMode、executionMode |
文档信息、质量统计、values、失败字段、证据、警告或 operationId |
原文与 Schema 一起提交;同步返回结果,异步返回任务信息。 |
| 查询异步任务 | 任务状态查询 | operation 查询接口 | GET https://api.gugudata.com/ai/operations/{operation_id} |
operation_id*、appkey* |
PENDING、RUNNING、SUCCEEDED、FAILED 或 EXPIRED 及最终结果 |
使用解析接口返回的 operationId 轮询,成功后进入相同结果视图。 |
上传文件时使用 multipart/form-data 的 file;调用方已经获得正文时使用 text。两者同时提交或同时为空都应阻止。schema 是 JSON 字符串,顶层 type 必须为 object,properties 的稳定英文 key 直接成为 Data.values 的字段 key。
ocrMode=auto 由服务判断是否需要 OCR;扫描件可用 always,确认存在可复制文本时可用 never。executionMode=auto 由文档大小和处理成本决定同步或异步;异步任务必须保存 requestId、operationId、轮询地址和过期时间。
复核后的值属于产品侧修订结果,必须与接口原始 value、normalizedValue 分开保存。写入下游系统前,应同时检查业务状态码、字段状态、置信度阈值、processedCharCount == charCount、isComplete=true 和人工复核状态。
桌面端需要尽量同时展示原文、Schema/JSON 和字段复核表。较窄窗口可折叠文档队列或配置栏,但不能隐藏原文与证据入口。移动端以任务状态和字段复核为主,复杂 Schema 编辑建议进入桌面模式。
验收时需要确认:原始文档是否保留;JSON 结果和 JSON Tree 是否一致;字段点击能否定位证据;file 与 text 是否二选一;OCR 与执行模式是否正确;总体统计是否与字段表一致;低置信度字段是否进入人工复核;异步任务是否正确处理过期和失败状态。
更多产品案例请访问 GuGuData Engineering 产品案例。
GuGuData Engineering 产品案例页展示基于咕咕数据接口能力构建的数据接入、业务流程和产品原型,帮助团队从真实业务场景出发,快速评估接口组合、调用方式和落地价值。
此内容由惯性聚合(RSS阅读器)自动聚合整理,仅供阅读参考。 原文来自 — 版权归原作者所有。