技术栈
mi50
zhangfeng1133
4 天前
人工智能
·
docker
·
ai编程
·
qwen
·
算子开发
·
vllm
·
mi50
AMD Instinct MI50(gfx906)上为 Qwen 系列模型优化并可用的 vLLM 相关仓库、Docker 镜像与实践指南。
直接结论关键资源(推荐先看)ROCm / PyTorch / 兼容性要点性能与注意事项快速示例命令(用于验证与启动)
illuspas
7 个月前
glm
·
llama.cpp
·
mi50
MI50运行GLM-4.7-Flash的速度测试
模型版本:https://huggingface.co/unsloth/GLM-4.7-Flash-GGUF GLM-4.7-Flash-UD-Q4_K_XL.gguf
我是有底线的