wsl中llama.cpp源码编译

1、下载源码,从地址:https://github.com/ggml-org/llama.cpp下载,如下图所示:

2、安装cuda,安装方法请看地址:https://blog.csdn.net/sunxiaoju/article/details/157170558?spm=1011.2415.3001.5331中的安装方法,安装好之后还需要安装:

bash 复制代码
apt install nvidia-cuda-toolkit

然后执行如下命令:

bash 复制代码
nvcc -V

如下图所示:

3、安装如下工具:

bash 复制代码
apt install -y build-essential cmake git wget
apt install libssl-dev

4、然后进入到llama.cpp源码目录创建一个build文件夹如:

bash 复制代码
mkdir build
cd build/
cmake .. -DGGML_CUDA=ON -DCMAKE_BUILD_TYPE=Release
cmake --build . --config Release -j$(nproc) 


mkdir -p /usr/share/llama.cpp/bin
cp bin/* /usr/share/llama.cpp/bin/
vim ~/.bashrc
export PATH=$PATH:/usr/share/llama.cpp/bin

编译过程中出现如下错误:

那就手动安装,通过如下命令安装:

bash 复制代码
npm install -g ws@8.20.1 --verbose

5、然后查看版本:

bash 复制代码
./bin/llama-cli --version
相关推荐
GPU实战笔记4 天前
本地跑不动 llama.cpp,临时租云 GPU 怎么搭?从启动服务到环境复用
java·服务器·网络·人工智能·深度学习·llama
牛马工作号6 天前
RK3588 使用 rk-llama.cpp + RKNPU2 部署 Qwen3.5:从零开始的 NPU 本地大模型实战
人工智能·语言模型·llama
书源丶6 天前
Qwen3-Embedding-0.6B 纯 CPU
网络·语言模型·embedding·llama
论文复现现场7 天前
Llama/Qwen 70B 部署需要几张 RTX 4090?2卡、4卡、8卡显存、量化与 vLLM 选型
llama·qwen·vllm·大模型推理·大模型部署·rtx4090
谢白羽8 天前
在4×B300用SGLang部署DeepSeek-V4.1 Flash优化实录
笔记·python·llm·llama·sglang
renzao_ai11 天前
本地 35B 大模型部署实战:Ollama 跑 Ornith-35B 全流程
python·llama·免费ai大模型
Είναι η κοπέλα11 天前
本地大模型部署完全指南:Ollama / vLLM / llama.cpp / MLX 四大引擎横评与选型实战
macos·llama·vllm
小饕11 天前
RK3588 NPU 跑大模型实测:rknn-llm 解码 25.9 tok/s,是 llama.cpp 的 4 倍!附三天完整踩坑记录
人工智能·机器人·llama
一航jason12 天前
Android平台推理框架及试用场景模型对比
android·人工智能·ai·架构·ai编程·llama
一航jason12 天前
Android 端侧大模型推理框架对比
android·人工智能·ai·ai编程·llama·ai-native