MDT-AI090 副语言信息高质量对话数据集

副语言相比情感，在对话过程中随着不同上下文，时刻发生着不同程度的变化，也就往往更为难以描述。为了能够更好的让大模型学会人类的副语言信息，晴数智慧全新打造了“副语言信息高质量对话数据集”。该数据集由资深产品专家和语音合成顾问联手打造，经过精细设计和专业生产流程，，确保标签体系精准。数据集具备48KHz高采样率，安静环境采集，涵盖不同地区、年龄、性别的人员，实现语音多样化。采集领域多样，覆盖20个领域主题，包括但不限于衣食住行、休闲娱乐、教育培训、健康医疗等。

副语言相比情感，在对话过程中随着不同上下文，时刻发生着不同程度的变化，也就往往更为难以描述。为了能够更好的让大模型学会人类的副语言信息，晴数智慧全新打造了“副语言信息高质量对话数据集”。该数据集由公司的产品资深专家和语音合成资深顾问强强联合，历经精心设计与打磨其标签体系并经过专业数据pipeline生产而成。此数据集具备48KHz高采样率，安静环境采集，筛选来自不同地区、年龄、性别人员录制以确保语音多样化。采集领域多样，覆盖20个领域主题，包括但不限于衣食住行、休闲娱乐、教育培训、健康医疗等。

数据集推荐

MDT-AF031 意大利语对话音频数据集

试听音频

MDT-AE042 中国英语朗读音频数据集

试听音频

MDT-AF069 英语对话音频数据集

试听音频

MDT-AD011 俄语朗读音频数据集—日常用语

【开源数据】

试听音频

纯净音自然多轮对话数据集——语音大模型

试听音频

MDT-AD006 中文对话音频数据集

试听音频

J9九游国际

MDT-AI090 副语言信息高质量对话数据集

音频样音

没有找到想要的数据？

数据集推荐

MDT-AF031 意大利语对话音频数据集

MDT-AE042 中国英语朗读音频数据集

MDT-AF069 英语对话音频数据集

MDT-AD011 俄语朗读音频数据集—日常用语

纯净音自然多轮对话数据集——语音大模型

MDT-AD006 中文对话音频数据集

数据优势有哪些？

合规性

多维度

覆盖性

高精度