




在发票和收据字段周围绘制或创建带标签的区域,同时保留其 PDF 页面上下文。
为已标注字段添加文本值和其他预定义属性,使标注同时表达字段的含义与位置。

即标注文档提取模型应识别的字段和区域,例如供应商名称、发票编号、税额和总额。
可以。根据模型训练需求,为抬头字段、总额、表格行和各个明细项目字段定义区域类别。
可以。PDF 文本选择层可根据可选择文本创建视觉标注区域。扫描内容可通过文档视觉工具进行标注。
可以。为每种字段角色使用独立类别或属性,避免将外观相似的数字视为可互换的标签。
发票通常需要供应商信息、发票编号和明细项目。收据更侧重商户、交易日期和总额。共用本体可定义各文档类型所需的字段角色。
收集多种版式的样本,采用相同的字段定义,并对照原始页面审核复杂表格或含义不明确的值。
原生文档工作流支持 PDF 文件。每个 PDF 始终作为一个工作项,团队浏览文档时,标注仍关联到原始页码。
审核人员检查页面区域及标签、处理评论,并通过已配置的工作流修正或拒绝工作结果。共用类别和属性可保持文档标注的一致性。
是的。Unitlab 统一导出格式将文档元数据和页码与标签、属性及支持的关系一并保留,供下游文档 AI 流水线使用。