一键部署丨DeepSeek-R1 新版本小幅升级便登顶开源王座,多项评测超越 Qwen3

近日,DeepSeek 官宣其 R1 模型进行「小幅」版本升级,发布 DeepSeek-R1-0528 。 在此次更新中,DeepSeek R1 通过提升计算资源配置并在后训练阶段引入算法优化机制,显著提升了其推理能力。该模型在数学、编程与通用逻辑等多项基准评测中表现出色,全面超越了 Qwen3-235B 和 DeepSeek-R1,堪称是「跨越一小步」便登顶开源王座。

DeepSeek-R1-0528 在多个基准测试中与主流模型的表现对比

更加值得一提的是,团队还蒸馏了 DeepSeek-R1-0528 的思维链(Chain-of-Thought),用于对 Qwen3-8B-Base 进行后训练,得到了 DeepSeek-R1-0528-Qwen3-8B 。 该模型在 AIME 2024 测试中达到了开源模型中的最新 SOTA(最先进)性能,较 Qwen3-8B 提升了 10.0%,并与 Qwen3-235B-thinking 的表现相当。

DeepSeek-R1-0528-Qwen3-8B 在各基准测试中与主流模型的表现对比

目前,「一键部署 DeepSeek-R1-0528-Qwen3-8B」已上线至 HyperAI 超神经官网的「教程」板块,快来体验吧!

教程地址:go.hyper.ai/uRzwv

Demo 运行

  1. 进入 hyper.ai 首页后,选择「教程」页面,并选择「一键部署 DeepSeek-R1-0528-Qwen3-8B」,点击「在线运行此教程」。
  1. 页面跳转后,点击右上角「克隆」,将该教程克隆至自己的容器中。
  1. 选择「NVIDIA RTX 4090」以及「vllm」镜像,OpenBayes 平台上线了新的计费方式,大家可以按照需求选择「按量付费」或「包日/周/月」,点击「继续执行」。新用户使用下方邀请链接注册,可获得 4 小时 RTX 4090 + 5 小时 CPU 的免费时长!

HyperAI 超神经专属邀请链接(直接复制到浏览器打开):

openbayes.com/console/sig...

  1. 等待分配资源,首次克隆需等待 2 分钟左右的时间。当状态变为「运行中」后,点击「API 地址」旁边的跳转箭头,即可跳转至 WebUI 页面。请注意,用户需在实名认证后才能使用 API 地址访问功能。

效果演示

端午节即将来临之际,又到了一年一度「甜咸大战」的时刻了,不如让我们来问问 DeepSeek-R1-0528-Qwen3-8B,看看它怎么回答 ⬇️

可以看到 DeepSeek-R1-0528-Qwen3-8B 会展示完整的思考过程,并且会从多个角度客观给出分析。

以上就是 HyperAI 超神经本次推荐的教程啦,感兴趣的小伙伴快来体验吧!教程地址:go.hyper.ai/uRzwv

相关推荐
twc82933 分钟前
大模型生成 QA Pairs 提升 RAG 应用测试效率的实践
服务器·数据库·人工智能·windows·rag·大模型测试
宇擎智脑科技35 分钟前
A2A Python SDK 源码架构解读:一个请求是如何被处理的
人工智能·python·架构·a2a
IT_陈寒36 分钟前
Redis缓存击穿:3个鲜为人知的防御策略,90%开发者都忽略了!
前端·人工智能·后端
vx_biyesheji000137 分钟前
Python 全国城市租房洞察系统 Django框架 Requests爬虫 可视化 房子 房源 大数据 大模型 计算机毕业设计源码(建议收藏)✅
爬虫·python·机器学习·django·flask·课程设计·旅游
电商API&Tina1 小时前
【电商API接口】开发者一站式电商API接入说明
大数据·数据库·人工智能·云计算·json
湘美书院--湘美谈教育1 小时前
湘美谈教育湘美书院网文研究:人工智能与微型小说选集
人工智能·深度学习·神经网络·机器学习·ai写作
uzong1 小时前
Harness Engineering 是什么?一场新的 AI 范式已经开始
人工智能·后端·架构
墨有6661 小时前
FieldFormer:基于物理场论的极简AI大模型底层架构,附带源码
人工智能·架构·电磁场算法映射
Mountain and sea2 小时前
从零搭建工业机器人激光切割+焊接产线:KUKA七轴协同+节卡AGV+视觉检测实战复盘
人工智能·机器人·视觉检测
K姐研究社2 小时前
阿里JVS Claw实测 – 手机一键部署 OpenClaw,开箱即用
人工智能·智能手机·aigc·飞书