数据资源中心
为世界级AI应用程序的团队创建和策划
现成的数据集
我们的高质量授权数据集,以启动您的人工智能项目
我们提供了一个广泛的“现成”数据集目录,拥有超过250个可用数据集,包括超过11,000小时的音频,超过25,000个图像,超过80种语言和多种方言超过870万字。我们的废弃货架数据集旨在有效提高精度,整体性能,并以特定的AI计划需要在规模上快速提供高质量数据集。在我们的产品中,您将在多种数据类型中找到数据集,包括图像,视频,语音,音频和文本。我们正在不断构建新数据集,以满足我们的全球客户群的需求。
了解更多
开源的公共数据集
从我们的数据科学家为您的AL项目策划建议
机器学习和人工智能应用需要大量的数据进行训练。您可以从我们推荐的资源中搜索可访问、修改、重用和共享的开放数据集。使用这些公开可用的数据集来影响AI和ML应用程序的开发,或者如果您想要一个简单的数据集来对一个解决方案进行基准测试,或者在处理一个真实的数据集之前比较不同的算法。对于访问组织范围之外的数据,这些开放数据集是一个很好的选择。
数据集查找器
计算机视觉
计算机视觉通过模拟人类视觉系统的复杂性,使计算机能够以与人类相同的方式识别和处理图像和视频中的物体。在图像应用程序中利用机器学习,如使自动驾驶汽车能够了解周围环境、面部识别应用程序、增强现实和混合现实或在医疗保健领域通过x射线和MRI扫描发现症状的自动化任务。使用丰富的计算机视觉数据集建立一个健壮的计算机视觉模型。
用于计算机视觉机器学习模型的开源数据集跨各种领域 - 动物,棋盘游戏,自动驾驶汽车,医学,热图像,空中无人机图像,甚至综合生成的数据。您可以以任何格式自由下载图像和注释:VOC XML,COCO JSON,YOLOV3平面文本文件,甚至是TFRecords。
了解更多
演讲全集
录制和转录新的语音语料库以创建声学模型和火车语音识别发动机可能是耗时和昂贵的。使用语音音频文件的开放数据库和文本转录,以快速和便宜地建立在各种声学条件下的许多扬声器中的转录演讲Ortan。
数据采集
如果您的特定用例需要更自定义的数据集,我们将数据收集提供为独立服务以及多组件可交付的一部分,例如ASR语音数据库,通常包括音频数据,转录,发音词典,以及特定于语言的文档或注释图像数据集。我们的数据收集服务跨越各种数据类型和集合方法,以获得一系列环境,以最佳符合您的独特数据要求。
了解更多