技术栈
vllm Qwen2.5-0.5B输出乱码解决办法 用-Instruct版本的
njsgcs
2026-01-25 14:14
我重新下过了,也改变量了,bfloat16改float16都没好
重新下-Instruct就行了
vllm
上一篇:
误差理论与测量平差基础笔记八
下一篇:
三维扫描数据如何与CAD软件无缝衔接?思看科技(SCANOLOGY/3DeVOK)的卓越解决方案
相关推荐
缘友一世
1 天前
GLM-5.3-NVFP4 部署实战系列[八]启动加速:编译缓存挂载与 CUDA 图捕获裁剪,首启 8 分钟 → 3 分钟
vllm
·
glm5.3 nvfp4
·
sm80
方方洛
1 天前
vllm教程-00-前言与导读
人工智能
·
算法
·
vllm
缘友一世
1 天前
GLM-5.3-NVFP4 部署实战系列[二]Docker 镜像选择与补丁镜像构建:纯 Python overlay,不重编一行 CUDA
python
·
docker
·
容器
·
vllm
缘友一世
1 天前
GLM-5.3-NVFP4 部署实战系列[七]正确的部署脚本与一键部署:deploy.sh参数拆解
vllm
·
glm5.3 nvfp4
·
sm80
JAI科研
1 天前
Deepseek Agent Harness教程(七) | Deepseek Harness不是一个内核加一堆插件
开发语言
·
人工智能
·
深度学习
·
算法
·
自然语言处理
·
transformer
·
vllm
缘友一世
2 天前
GLM-5.3-NVFP4 部署实战系列[四]问题深拆①:sm80 没有稀疏 MLA 注意力后端怎么办
vllm
·
glm5.3 nvfp4
·
sm80
随便做点啥
2 天前
32卡-64G-910B4-16后端-(Qwen3.8-27B-W8A8)集群部署报告
运维
·
服务器
·
经验分享
·
docker
·
vllm
xueyongfu
3 天前
vLLM 模型编译:从 torch.compile 到分段 CUDA Graph
vllm
sel_9
3 天前
【vLLM】vLLM 推理框架详解:从 PagedAttention 到生产级部署实战
人工智能
·
深度学习
·
算法
·
语言模型
·
框架
·
vllm
缘友一世
3 天前
GLM-5.3-Flash 在 8×A800 (sm_80) 上跑通(一):项目介绍与方案选型
vllm
·
模型推理部署
·
a800
·
glm5.3 flash
热门推荐
01
国内可直接用、免费额度/永久免费的大模型API清单(含 SiliconFlow、火山、阿里、智谱、百度、Kimi、DeepSeek、DMXAPI 等)
02
GitHub 镜像站点
03
ZCode 周末送额度活动开启:3 亿 Token 免费领取
04
历年考研数学一、数学二、数学三真题试卷及答案PDF
05
蜘蛛磁力 搜索引擎大全,如何使用蜘蛛磁力查找磁力链接
06
2026 国产 AI 大模型横评:DeepSeek、通义千问、Kimi、文心一言、星火、豆包谁更能打?
07
微信历史版本含下载地址( Windows PC | 安卓 | MAC )及设置微信不更新
08
AI 编程 IDE 全景解析 2026:Agent 全面接管开发链路
09
Agnes AI 免费 API 接入指南:文本、生图、生视频,一套接口全免费
10
VSCode+CodeX扩展,无法启动