技术栈

rtx3090

论文复现现场
3 小时前
模型量化·vllm·大模型推理·awq·算家云·rtx3090
RTX 3090 如何跑 13B 级大模型推理?4-bit AWQ、vLLM 部署与并发调优实战更新时间:2026 年 9 月 20 日 适用环境:Linux、NVIDIA RTX 3090 24GB、Docker、CUDA 驱动
我是有底线的