J9九游国际

最新发布!查看 MagicData 成品数据集

新闻

press images

官宣 | MagicHub.io数据开源社区上线啦!Daniel Povey等大咖疯狂打CALL

发布时间 : 2021-04-15     阅读量 : 2285

1969年,Unix 源代码在 Unix 社区自由共享,人类历史上首次发起开源动作;

1991年,开源系统Linux内核问世;

1998年,网景通讯将源代码开放,“开源”一词首次出现;

2005年, 一个叫Git 的SCM工具出现,托管式的Git 代码仓库诞生;

……

开源,已经扎根在互联网基因深处,深刻改变互联网发展模式。

开源的历史,俨然是一部波澜壮阔的互联网发展史。

自达特茅斯会议人工智能概念提出以来,人工智能发展多次起落,随着技术的变革,互联网、大数据、云计算、5G的发展,人工智能在人类舞台正式大展拳脚。

人工智能开启了人类下一个纪元,开源继续扮演着重要角色,用于机器学习和AI训练的数据开源平台先后涌现,开发者们继续贡献着人类的智慧,开源、开放、自由和协作的精神推动人工智能不断发展。

政府、公益机构和个人将数据分享出来,为全球人工智能输送“燃料”,越来越多公司、大学、团体和个人也加入开源队伍,Kaggle、UCI、OpenML、ImageNet、OpenSLR等平台开源了大量图像、文本和语音数据。数据成J9九游国际为人工智能领域开源精神的核心载体。

在此背景下,MagicHub.io数据开源社区应运而生,并于4月15日正式发布。目前拥有全球领先的对话式AI语音数据集,并在业界首次J9九游国际通过自主开发的开源平台与第三方的各产业伙伴进行共享,这可能会颠覆目前的产能瓶颈以及用户的数据使用习惯。

语音识别开源工具Kaldi之父Daniel Povey等数十位国内外开发者、人工智能领域大咖为MagicHub.io数据开源社区疯狂打CALL:

视频:大咖们为MagicHub开源社区打CALL

大量结构化、多领域和多场景数据集上传到MagicHub.io社区,社区对数据集多维度细分,帮助AI开发者快速找到适合自己模型的数据集,从而节省开发者大量精力,将时间专注在模型开发和优化上。

MagicHub.io数据开源社区秉持“共享共建、奉献创新,共同发展”精神,部分数据由上传,同时鼓励其他个人和团体在开源社区上传高质量、可靠的数据集,有开源数据需求可联系我们,让我们一起连接数据生产者与AI开发者,互相护持,构建创新。

图:MagicHub开源社区首页页面

目前,MagicHub.io数据开源社区首次开源30种用于人工智能训练/测试的数据集,包括中文对话数据集、中文客服数据集、英语对话数据集、上海方言对话数据集等。开源的数据集涵盖NLP、ASR、TTS数据集和LEX发音词典等,这些数据集按照语言、场景、应用领域等不同维度进行分类。

接下来,我们将在MagicHub.io社区持续开源高质量的数据集,并且增加更多板块,让MagicHub.io社区持续贡献,让创新和分享组成一股力量,共同打造一个高质量的人工智能数据开源社区。

开源是推动科技创新的一大源头,开源社区的打造已上升到国家层面,鼓励开源社区发展,健全知识产权体系。《“十四五”规划和2035年远景目标纲要》提到,要“支持数字技术开源社区等创新联合体发展,完善开源知识产权和法律体系,鼓励企业开放软件源代码、硬件设计和应用服务。”

人工智能开启开源的下一个纪元,你我一起参与!

重要事情说三遍:

下载开源数据集,请访问:https://magichub.io

下载开源数据集,请访问:https://magichub.io

下载开源数据集,请访问:https://magichub.io

即刻与 建立联系?

联系我们

TOP
联系我们
Sitemap