




文档区域标识支持证据。已配置的 Question(问题)和 Answer(答案)文本属性,在同一标注上记录问题及经过审核的回答。
可选择的 PDF 文本可标注为答案片段,让提取的值关联到确切源文本,而非脱离上下文的转录内容。

DocVQA 是模型回答文档图像相关问题的文档理解任务。标注工作为训练或评估准备问题、答案值及支持答案的源证据。
在证据标注上配置 Question(问题)和 Answer(答案)等文本属性。标注人员标记源区域或受支持的文本片段,并输入项目结构要求的值。
可以。当 PDF 包含可用文本层时,可通过受支持的文本选择将答案锚定于文档。对于没有可选文本的扫描页面,使用视觉证据区域与已配置的答案文本。
适用示例包括能够根据内容回答问题的发票、收据、表单和业务记录。在标注前定义文档范围与问题规则,保持证据要求一致。
编写能够由所提供文档支持答案的问题。对于抽取式示例,确定确切答案值,并标注将其与相邻字段区分开的证据。
可以。视觉区域可框选表单字段或已选选项,并通过问题与答案属性描述示例。审核人员应同时检查文本与可见的选择状态。
此处描述的工作流记录已提供或人工编写的问题及经过审核的答案,不预设自动生成问题、文档推理或答案抽取能力。
审核人员将答案属性与已标注的源区域或文本片段及问题进行对照。错误值、含糊问题或缺失证据的示例可退回返工。
使用共享标注类别、必填属性和清晰的问题编写指南。审核代表性示例,并对不同文档版面应用相同的证据规则。