




为职位字段与要求短语创建连续、不重叠的标签。每个选定范围均忠实于可见文本,并保留有意义的限定词。
在同一页面内,将已标注职位名称连接到原文明示的雇主或地点。添加属性,描述字段角色及经过审核的要求类别。

招聘信息提取标注对模型应识别的信息添加标签,例如职位名称、雇主、地点、技能、经验与薪酬。在 Unitlab 中,这些标签始终锚定到已上传 HTML 页面的可见文本。
可以。为技能、资格与经验定义不同类别,再选择精确的原文片段。当标注指南要求时,应包含明确的经验门槛等有意义的限定内容。
以招聘信息中可见的章节标题和措辞为依据。通过配置的属性,在技能标注上记录“必备”或“优先”。不要指定原文无法支持的要求级别。
可以,前提是招聘信息明确列出这些内容。标注金额或范围及其币种或计薪周期,并记录“远程”或“混合办公”等明确表述。这些是原文标注,不是推测的薪酬估计或工作政策预测。
可以。本体中定义的关系可连接同一 HTML 页面内的文本实体,例如职位名称与明确列出的地点。在接受标签前,应审核关系起点、终点和方向。
遵循项目的缺失值规则,将没有原文依据的事实留空。不要根据雇主名称或其他职位推断薪酬、地点、资格或雇佣类型。
此工作流标注已上传的 .html 或 .htm 招聘页面快照,不会浏览实时招聘网站、提交申请表或自动收集新职位。
使用统一本体,并为片段边界、要求级别和缺失字段提供清晰示例。在渲染后的页面中审核标签,处理上下文评论,将有歧义或错误的样本退回修正。
使用 JSONL 或 Unitlab 统一导出格式等受支持的 HTML 导出格式。将已审核标注接入提取流程时,保留源标识、受支持的文本锚点、实体类别、关系与属性。