最新发布!查看 MagicData 成品数据集
语音复刻大模型高品质数据集——东南亚

语音复刻大模型高品质数据集——东南亚

语种

他加禄语-菲律宾,马来语-马来西亚,泰语-泰国

数据风格

对话式&朗读式

音频格式

PCM

采样率

48kHz

比特率

16 bits

声道

1

人数

5,232

时长

2,425

As a new trend of AIGC, zero-shot speech synthesis has wide-ranging applications, including voice assistants, audiobooks, video game character voices, creating podcast, and real-time voice changer, among others. Magic Data has proactively designed and developed the "High-Quality Dataset for Voice Replication," which boasts a 48kHz high sampling rate, tens of thousands of contributors with diverse content, making it an excellent resource for achieving zero-shot speech synthesis.

没有找到想要的数据?

联系我们

数据集推荐

MDT-AE013 中国英语朗读音频数据集

试听音频

智能座舱语音交互黄金标准数据集

当前车内智能语音交互场景越来越多样化:除了传统的智能导航,娱乐、车内设备控制、应急响应、智能客服、虚拟伴驾等其他舱内智能语音交互正越来越多地通过人工智能技术实现。伴随着以数据驱动的人工智能的兴起,我们设立了此总时长为9,697小时的智能座舱语音交互黄金标准数据集,涵盖控制、导航、搜索、问题、任务、数字串等多领域语料,以更好地助力造车新势力及新能源车企打造卓越智能座舱交互体验,赢得更多市场机会。

MDT-AE028 泰语交互朗读音频数据集

试听音频

MDT-AE082 印尼语对话音频数据集—室内

【开源数据】
试听音频

纯净音自然多轮对话数据集——语音大模型

试听音频

MDT-AB012 中文手机对话音频数据集

【开源数据】
试听音频

Magic Data 数据优势有哪些?

合规性

符合ISO/IEC 27001和ISO/IEC 27701:2019标准认证

多维度

音频、文本、图像、音视频多模态数据

覆盖性

涵盖多领域的对话式、朗读式及自发式数据

高精度

人机协同高精度标注

TOP
联系我们