该数据集专为训练更懂口语表达的AI模型打造,有利于提升西班牙语语音识别的自然交互能力,覆盖多场景真实对话,由多样化人群录制,字准率高。强化对连诵、吞音等特性的标注,合理标点还原西语热情洋溢的韵律节奏,高完整度语句助力模型理解复杂动词变位句式,提升识别鲁棒性。
语种
西班牙语
数据风格
spontaneous
比特率
16bits
声道
1
时长
5000+小时
符合ISO/IEC 27001和ISO/IEC 27701:2019标准认证
音频、文本、图像、音视频多模态数据
涵盖多领域的对话式、朗读式及自发式数据
人机协同高精度标注