开源数据集网站合集

一.Google数据集

链接:https://datasetsearch.research.google.com/

二.Huggingface数据集

链接1:GitHub - huggingface/datasets: 🤗 The largest hub of ready-to-use datasets for ML models with fast, easy-to-use and efficient data manipulation tools

链接2:https://huggingface.co/datasets

三.Kaggle 数据集

链接:Find Open Datasets and Machine Learning Projects | Kaggle

四.Paper With Code 数据集

链接:Machine Learning Datasets | Papers With Code

五.Reddit 数据集

链接:https://www.reddit.com/r/datasets/

六.CLUE 数据集

链接:https://www.cluebenchmarks.com/dataSet_search.html

七.Machine learning datasets

链接:Dataset list - A list of the biggest machine learning datasets

十.ChineseNlpCorpus

链接:https://github.com/InsaneLife/ChineseNLPCorpus

十一.CV Datasets on the web

链接:http://www.cvpapers.com/datasets.html

十二.Yet Another Computer Vision Index To Datasets (YACVID)

链接:http://yacvid.hayko.at/

十三.天池数据集_阿里系唯一对外开放数据分享平台-阿里云天池

链接:https://tianchi.aliyun.com/dataset/?spm=5176.14154004.J_4642415020.21.d08056996oMHQY

十四.公开数据集下载,优质机器学习数据集,图像识别、NLP免费获取 | 格物钛,非结构化数据平台

链接:https://gas.graviti.cn/open-datasets

相关推荐
casterQ4 分钟前
4. Agent Quality ——【Google 5-Day AI Agents】
人工智能·llm·agent·langgraph·adk
组合缺一5 分钟前
Solon AI 开发学习11 - chat - 工具调用与定制(Tool Call)
人工智能·学习·ai·chatgpt·llm·solon·toolcall
HuggingFace8 分钟前
用开源模型强化你的 OCR 工作流
人工智能
子綦8 分钟前
Andrej Karpathy 推荐的 AI 读书法:我是如何结合“沉浸式翻译”啃动英文顶会论文的?(附 Prompt 模板)
人工智能·经验分享·prompt·学习方法
陈天伟教授10 分钟前
机器学习策略(1)四大学派
人工智能·机器学习
极客BIM工作室12 分钟前
AI论文整理:TOKENCOMPOSE: Text-to-Image Diffusion with Token-level Supervision
人工智能
Elastic 中国社区官方博客14 分钟前
Elasticsearch:在隔离环境中安装 ELSER 模型
大数据·数据库·人工智能·elasticsearch·搜索引擎·ai·全文检索
跨境卫士—小依21 分钟前
深耕 Ozon:俄罗斯电商精准盈利的核心玩法
大数据·人工智能·矩阵·跨境电商·亚马逊·防关联
roman_日积跬步-终至千里24 分钟前
【模式识别与机器学习(18)】关联规则深入浅出教程
数据库·机器学习·oracle
love530love25 分钟前
【ComfyUI/SD环境管理指南(二)】:如何避免插件安装导致的环境崩溃与“外科手术式”修复
人工智能·windows·python·stable diffusion·github·aigc·comfyui