开源数据集网站合集

一.Google数据集

链接:https://datasetsearch.research.google.com/

二.Huggingface数据集

链接1:GitHub - huggingface/datasets: 🤗 The largest hub of ready-to-use datasets for ML models with fast, easy-to-use and efficient data manipulation tools

链接2:https://huggingface.co/datasets

三.Kaggle 数据集

链接:Find Open Datasets and Machine Learning Projects | Kaggle

四.Paper With Code 数据集

链接:Machine Learning Datasets | Papers With Code

五.Reddit 数据集

链接:https://www.reddit.com/r/datasets/

六.CLUE 数据集

链接:https://www.cluebenchmarks.com/dataSet_search.html

七.Machine learning datasets

链接:Dataset list - A list of the biggest machine learning datasets

十.ChineseNlpCorpus

链接:https://github.com/InsaneLife/ChineseNLPCorpus

十一.CV Datasets on the web

链接:http://www.cvpapers.com/datasets.html

十二.Yet Another Computer Vision Index To Datasets (YACVID)

链接:http://yacvid.hayko.at/

十三.天池数据集_阿里系唯一对外开放数据分享平台-阿里云天池

链接:https://tianchi.aliyun.com/dataset/?spm=5176.14154004.J_4642415020.21.d08056996oMHQY

十四.公开数据集下载,优质机器学习数据集,图像识别、NLP免费获取 | 格物钛,非结构化数据平台

链接:https://gas.graviti.cn/open-datasets

相关推荐
TomCN080311 分钟前
这篇文章终于讲清楚了MCP与Function Calling的关系!
人工智能·mcp
MARS_AI_20 分钟前
AI 智能外呼系统的智能体现
人工智能·自然语言处理·nlp·语音识别·信息与通信
想做后端的小C20 分钟前
Visual Studio 2022 UI机器学习训练模块
机器学习·vs
_一条咸鱼_32 分钟前
AI 大模型微调原理深度剖析与源码解读
人工智能·深度学习·机器学习
激动滴西瓜32 分钟前
使用 Spring AI 构建高效的AI Agent(Part 1)
人工智能·后端
jndingxin33 分钟前
OpenCV 图形API(22)矩阵操作
人工智能·opencv
蚝油菜花34 分钟前
AI终于能听懂宝宝说话了!ChildMandarin:智源研究院开源的低幼儿童中文语音数据集,覆盖22省方言
人工智能·开源
掘金安东尼37 分钟前
llm 训练脚本怎么写?平台启动怎么配?一文搞定
人工智能·llm
果冻人工智能39 分钟前
如何把未量化的 70B 大模型加载到笔记本电脑上运行?
人工智能
DevUI团队1 小时前
MateChat V1.4.0来了~MarkdownCard支持think、input组件增强
前端·人工智能