MDT-AI090 副语言信息高质量对话数据集

副语言相比情感，在对话过程中随着不同上下文，时刻发生着不同程度的变化，也就往往更为难以描述。为了能够更好的让大模型学会人类的副语言信息，晴数智慧全新打造了“副语言信息高质量对话数据集”。该数据集由资深产品专家和语音合成顾问联手打造，经过精细设计和专业生产流程，，确保标签体系精准。数据集具备48KHz高采样率，安静环境采集，涵盖不同地区、年龄、性别的人员，实现语音多样化。采集领域多样，覆盖20个领域主题，包括但不限于衣食住行、休闲娱乐、教育培训、健康医疗等。

副语言相比情感，在对话过程中随着不同上下文，时刻发生着不同程度的变化，也就往往更为难以描述。为了能够更好的让大模型学会人类的副语言信息，晴数智慧全新打造了“副语言信息高质量对话数据集”。该数据集由公司的产品资深专家和语音合成资深顾问强强联合，历经精心设计与打磨其标签体系并经过专业数据pipeline生产而成。此数据集具备48KHz高采样率，安静环境采集，筛选来自不同地区、年龄、性别人员录制以确保语音多样化。采集领域多样，覆盖20个领域主题，包括但不限于衣食住行、休闲娱乐、教育培训、健康医疗等。

数据集推荐

MDT-AE033 上海话朗读音频数据集-日常用语

试听音频

MDT-AD017 日语手机朗读数据库

MagicData拥有1500小时日语语料库，本次开源30小时数据集作为测试集。本语料库的录制文本为日常用语。采集方式为手机录音；录音输出为PCM格式。37名来自日本不同区域（如东京、大阪、北海道等）的发言人参与采集。MagicData日语手机朗读数据库（30小时）由MagicData有限公司开发，免费发布供非商业使用。研发制作了朗读、面对面对话、电话对话等多场景下的中文、英文、日语、韩语等数十种语言的语音数据库。该数据库得到了行业的广泛认可。如您想了解更多爱数数据库信息，欢迎您联系我们。

MDT-AD017 日语朗读音频数据集—日常用语

【开源数据】

试听音频

MDT-AE023 泰语朗读音频数据集—日常用语

试听音频

MDT-AE042 中国英语朗读音频数据集

试听音频

MDT-AF021 印尼语对话音频数据集

试听音频

公海贵宾会

MDT-AI090 副语言信息高质量对话数据集

音频样音

没有找到想要的数据？

数据集推荐

MDT-AE033 上海话朗读音频数据集-日常用语

MDT-AD017 日语手机朗读数据库

MDT-AD017 日语朗读音频数据集—日常用语

MDT-AE023 泰语朗读音频数据集—日常用语

MDT-AE042 中国英语朗读音频数据集

MDT-AF021 印尼语对话音频数据集

数据优势有哪些？

合规性

多维度

覆盖性

高精度