最新发布!查看 MagicData 成品数据集
MDT-AE042 中国英语朗读音频数据集

MDT-AE042 中国英语朗读音频数据集

语种

英语

录音环境

室内

数据时长

52小时

录音语料

日常用语、数字串、短语

文件格式

WAV, TXT

语音参数

16 kHz, 16 bits

录音设备

智能手机

适用领域

语音识别(ASR)

数据敏感项

版权所有者

Magic Data

音频样音

没有找到想要的数据?

联系我们

数据集推荐

MDT-AA006 中国英语朗读音频数据集

【开源数据】
试听音频

语音复刻大模型高品质数据集——中文

语音TTS已经走向了AIGC大模型模式,利用大规模高品质训练数据,实现zero-shot的声音复刻正成为越来越火热的技术趋势。零样本语音合成在娱乐产业、通用AI平台及AIGC领域都有广泛的应用场景,包括电影电视配音及解说、有声书、角色配音、虚拟主播、语音导航等。晴数智慧前瞻性地推出“语音复刻大模型高品质数据集”,此数据具备48KHz高采样率,采集人数2万+,环境纯净,内容自然多样,上万小时,是实现零样本语音合成的绝佳数据。特别地,此数据的多样化语料内容能为模型学习协同发音提供助益。
试听音频

MDT-AE072 意大利语朗读音频数据集

【开源数据】
试听音频

MDT-AE041 印地语朗读音频数据集—新闻

试听音频

MDT-AG001 云南对话音频数据集

试听音频

MDT-AF029 意大利语朗读音频数据集

试听音频

Magic Data 数据优势有哪些?

合规性

符合ISO/IEC 27001和ISO/IEC 27701:2019标准认证

多维度

音频、文本、图像、音视频多模态数据

覆盖性

涵盖多领域的对话式、朗读式及自发式数据

高精度

人机协同高精度标注

TOP
联系我们