技术栈

mi50

zhangfeng1133
4 天前
人工智能·docker·ai编程·qwen·算子开发·vllm·mi50
AMD Instinct MI50(gfx906)上为 Qwen 系列模型优化并可用的 vLLM 相关仓库、Docker 镜像与实践指南。直接结论关键资源(推荐先看)ROCm / PyTorch / 兼容性要点性能与注意事项快速示例命令(用于验证与启动)
illuspas
7 个月前
glm·llama.cpp·mi50
MI50运行GLM-4.7-Flash的速度测试模型版本:https://huggingface.co/unsloth/GLM-4.7-Flash-GGUF GLM-4.7-Flash-UD-Q4_K_XL.gguf
我是有底线的