最新发布!查看 MagicData 成品数据集
MDT-AE042 中国英语朗读音频数据集

MDT-AE042 中国英语朗读音频数据集

语种

英语

录音环境

室内

数据时长

52小时

录音语料

日常用语、数字串、短语

文件格式

WAV, TXT

语音参数

16 kHz, 16 bits

录音设备

智能手机

适用领域

语音识别(ASR)

数据敏感项

版权所有者

Magic Data

音频样音

没有找到想要的数据?

联系我们

数据集推荐

MDT-AE082 印尼语对话音频数据集—室内

【开源数据】
试听音频

MDT-RJ003 韩语高质量口语式语音数据集

该数据集专为训练更懂口语表达的AI模型打造,有利于提升韩语语音识别的自然交互能力,覆盖多场景真实对话,由多样化人群录制,字准率高。严格标注收音连音变化现象,文本与发音高度对齐。完整句子结构展现口语语序特点,标点设计符合韩语情感表达习惯,强化模型对终结词尾情感意图的捕捉能力。

MDT-AB017 车载噪音音频数据集

【开源数据】
试听音频

智能座舱语音交互黄金标准数据集

当前车内智能语音交互场景越来越多样化:除了传统的智能导航,娱乐、车内设备控制、应急响应、智能客服、虚拟伴驾等其他舱内智能语音交互正越来越多地通过人工智能技术实现。伴随着以数据驱动的人工智能的兴起,我们设立了此总时长为9,697小时的智能座舱语音交互黄金标准数据集,涵盖控制、导航、搜索、问题、任务、数字串等多领域语料,以更好地助力造车新势力及新能源车企打造卓越智能座舱交互体验,赢得更多市场机会。

MDT-AF012 新加坡英语朗读音频数据集—日常用语

试听音频

MDT-AD024 中文唤醒词朗读音频数据集—唤醒词

试听音频

Magic Data 数据优势有哪些?

合规性

符合ISO/IEC 27001和ISO/IEC 27701:2019标准认证

多维度

音频、文本、图像、音视频多模态数据

覆盖性

涵盖多领域的对话式、朗读式及自发式数据

高精度

人机协同高精度标注

TOP
联系我们