llama gguf大模型文件合并

llama-gguf-split.exe下载

https://github.com/ggerganov/llama.cpp/releases

下载vulkan win64版本,解压后,把目录添加到环境变量

进入大模型文件目录,运行命令行:

llama-gguf-split.exe --merge qwen2.5-coder-7b-instruct-q4_k_m-00001-of-00002.gguf qwen2.5-coder-7b-instruct-q4_k_m.gguf

相关推荐
福大大架构师每日一题6 小时前
ollama v0.32.14正式发布:WebP 自动转码、Qwen 系统消息兼容升级与 llama.cpp、MLX 更新全解析
android·java·llama
zyl837216 小时前
LLaMA‑Factory 使用条件 + 学习手册
llama
刻BITTER6 小时前
让 Intel NPU 跑AI 大模型?一次 llama.cpp OpenVINO 后端的完整实测
人工智能·llama·openvino
微软技术分享1 天前
Windows 环境下 llama.cpp 编译运行指南
windows·llama
zhy295631 天前
【DNN】Llama 3.2 1B模型LORA微调与QAIRT部署
人工智能·dnn·llama
Flynt2 天前
花一下午把Qwen3.8-27B跑在本地,最坑的不是显存
开源·llm·llama
uncle_ll2 天前
Llama 3 私有化落地全栈实战:从 Ollama 极速部署到 LLaMA Factory LoRA 定制微调
llm·nlp·llama·ollama·大模型微调
DAVIED92 天前
llama.cpp 本地部署完全指南
windows·llama·wsl·llamacpp
zhy295632 天前
在 QAIRT Genie SDK 上部署 Llama 3.2 1B 模型:从环境准备到 C++ 推理
开发语言·c++·llama
goodlook01234 天前
LLaMa factory 大模型高效微调(二)
人工智能·深度学习·llama