




在波形上定义语音片段,并将转写文本填写为标注属性。对照实际录音细化片段的起止边界。
通过结构化属性记录语言、声学条件或转写的不确定性。确保这些标签符合源音频和数据集规范。

即为音频片段准备其中所说的文字,以及所需的上下文标签。Unitlab 支持基于时间的音频标注、转写、结构化属性和审核工作流。
可以。转写文本可关联到带有时间信息的语音标注。标注人员可以调整区间,并对照源录音审核相应文字。
对无法辨识或存在不确定性的语音采用统一约定,并记录相关质量属性。审核人员应在接受转写结果前检查音频。
可以。定义语言属性,并针对数据集中的各语言采用合适的转写指南。分配具备相应专业能力的审核人员验证这些样本。
转写记录说了什么,说话人分离记录每个时间区间对应哪位说话人。当下游语音任务需要时,一个数据集可以同时包含两者。
开始工作前定义共用类别、结构化属性和清晰的标注指南。通过代表性样本和结合上下文的审核,解决语音识别数据集中的标注分歧。
可以。将音频标注流转至审核和返工阶段。审核人员可以检查源数据、修正标签,并在需要进一步处理时退回该数据项。
可以。利用数据集搜索、元数据、标签和可用筛选条件选择相关音频资产。在准备过程中保留对代表性条件和困难样本的可见性。
根据标注任务,以支持的 Audio JSON、RTTM 或 UUEF 格式导出已审核的音频标签。数据集版本有助于团队确认哪些已准备样本属于某次发布。