开源数据集网站合集

一.Google数据集

链接:https://datasetsearch.research.google.com/

二.Huggingface数据集

链接1:GitHub - huggingface/datasets: 🤗 The largest hub of ready-to-use datasets for ML models with fast, easy-to-use and efficient data manipulation tools

链接2:https://huggingface.co/datasets

三.Kaggle 数据集

链接:Find Open Datasets and Machine Learning Projects | Kaggle

四.Paper With Code 数据集

链接:Machine Learning Datasets | Papers With Code

五.Reddit 数据集

链接:https://www.reddit.com/r/datasets/

六.CLUE 数据集

链接:https://www.cluebenchmarks.com/dataSet_search.html

七.Machine learning datasets

链接:Dataset list - A list of the biggest machine learning datasets

十.ChineseNlpCorpus

链接:https://github.com/InsaneLife/ChineseNLPCorpus

十一.CV Datasets on the web

链接:http://www.cvpapers.com/datasets.html

十二.Yet Another Computer Vision Index To Datasets (YACVID)

链接:http://yacvid.hayko.at/

十三.天池数据集_阿里系唯一对外开放数据分享平台-阿里云天池

链接:https://tianchi.aliyun.com/dataset/?spm=5176.14154004.J_4642415020.21.d08056996oMHQY

十四.公开数据集下载,优质机器学习数据集,图像识别、NLP免费获取 | 格物钛,非结构化数据平台

链接:https://gas.graviti.cn/open-datasets

相关推荐
大龄程序员狗哥2 小时前
第47篇:使用Speech-to-Text API快速构建语音应用(操作教程)
人工智能
KKKlucifer2 小时前
数据安全合规自动化:策略落地、审计追溯与风险闭环技术解析
人工智能·安全
RWKV元始智能2 小时前
RWKV超并发项目教程,RWKV-LM训练提速40%
人工智能·rnn·深度学习·自然语言处理·开源
dyj0952 小时前
Dify - (一)、本地部署Dify+聊天助手/Agent
人工智能·docker·容器
墨染天姬2 小时前
【AI】Hermes的GEPA算法
人工智能·算法
小超同学你好2 小时前
OpenClaw 深度解析系列 · 第8篇:Learning & Adaptation(学习与自适应)
人工智能·语言模型·chatgpt
紫微AI2 小时前
前端文本测量成了卡死一切创新的最后瓶颈,pretext实现突破了
前端·人工智能·typescript
码途漫谈2 小时前
Easy-Vibe开发篇阅读笔记(四)——前端开发之结合 Agent Skills 美化界面
人工智能·笔记·ai·开源·ai编程
易连EDI—EasyLink2 小时前
易连EDI–EasyLink实现OCR智能数据采集
网络·人工智能·安全·汽车·ocr·edi
冬奇Lab3 小时前
RAG 系列(二):用 LangChain 搭建你的第一个 RAG Pipeline
人工智能·langchain·llm