gpt oss 20b 本地运行

GPT-OSS:20b 专为低延迟、本地或专用用例而设计。

注意:此型号至少需要 16GB 的统一内存(MAC)或 GPU 内存才能运行。

GPT-OSS:120b 专为生产、通用、高推理用例而设计。

注意:此型号至少需要 80GB 的统一内存或 GPU 内存才能运行。

bash 复制代码
ollama run gpt-oss:20b   

ollama run gpt-oss:120b  
相关推荐
维克兜率天3 小时前
【维克】ARMA模型:AR与MA的完美结合
后端·restful
是未才4 小时前
从输入 URL 到页面返回:DNS、路由、TLS 与 HTTP 完整链路
java·后端·计算机网络
上海安当技术4 小时前
半天接入:USBKey RESTful API + C 动态库,Web 和 C/S 两套集成路径实战
前端·后端·restful·集成·usbkey
DevUI团队5 小时前
从“即兴创作”到“规格先行”,华为云码道(CodeArts)代码智能体持续深耕企业级规范驱动开发能力
前端·人工智能·后端
weixin_431600446 小时前
NestJS 入门(3):Guard 如何挡住未登录请求?
前端·后端·学习·nest.js
IT_陈寒6 小时前
JavaScript类型转换把我坑惨了,这破玩意真该早点搞明白
前端·人工智能·后端
用户938515635077 小时前
手写一个 LLM Harness 框架:用工程化手段把大模型幻觉踩在脚下
javascript·人工智能·后端
wei_shuo8 小时前
KES 云原生部署与弹性扩展:容器化、Kubernetes编排与自动伸缩
后端
一木之林8 小时前
Python.五.(一)--1. 并发编程、异步IO与多进程
后端
feng尘8 小时前
# 彻底搞懂 ReentrantLock 与 tryLock:从秒杀实战到 AQS 独占模式源码剖析
后端