linux 安装 Ollama 框架

概述

Ollama 是一款旨在简化大语言模型(LLM)本地部署的工具,支持 Windows、Linux 和 MacOS 系统。它提供了一个用户友好的环境,让开发者可以轻松地运行和调优如 Qwen、Llama 等超过1700种的大语言模型。

核心优势

  • 多平台兼容性:无缝适配主流操作系统。
  • 丰富的模型库:内置了大量预训练模型,直接从官网下载即可使用。
  • 个性化配置:通过 modelfile 文件调整模型参数,实现对生成内容的精细控制。
  • 自定义模型支持:允许导入第三方 ggml 格式的模型,或转换其他格式的模型至 ggml。
  • 高性能推理:优化了多GPU环境下的并行处理能力,提升推理速度。

Ollama 的设计降低了大语言模型的使用门槛,特别适合希望快速构建 AI 应用或针对特定任务进行模型优化的开发者。

官方资源

快速安装指南

对于 Linux 用户,Ollama 提供了一键安装脚本,使得安装过程变得极为简便。以下是详细的安装步骤:

  1. 执行一键安装

    bash 复制代码
    curl -fsSL https://ollama.com/install.sh | sh
  2. 启动 Ollama 服务

    bash 复制代码
    ollama serve

如果遇到权限问题(例如提示需要 sudo 权限),建议下载离线安装包以避免权限限制。可以从 GitHub 发布页 获取对应系统的安装包,并按照以下步骤操作:

  1. 下载离线安装包

    访问发布页,选择适用于您系统的版本下载。

  2. 解压文件

    bash 复制代码
    tar -xzvf ./ollama-linux-amd64.tgz
  3. 启动 Ollama 服务

    bash 复制代码
    ./bin/ollama serve &

为了确保 ollama 命令可以在任何位置被调用,需要将其路径添加到系统的 PATH 环境变量中。这可以通过编辑您的 shell 配置文件(如 .bashrc.zshrc)来完成。

bash 复制代码
echo 'export PATH=$PATH:/home/ollama/bin' >> ~/.bashrc
echo 'export OLLAMA_KEEP_ALIVE=12h' >> ~/.bashrc
echo 'export OLLAMA_HOST=0.0.0.0:11434' >> ~/.bashrc
echo 'export OLLAMA_MODELS=/data/ollama/models' >> ~/.bashrc
source ~/.bashrc

现在,您可以直接在终端中使用 ollama 命令来管理和运行模型,例如:

bash 复制代码
ollama run llama3.1:8b

以上步骤将帮助您顺利完成 Ollama 的安装与配置,开始探索大语言模型的世界。

相关推荐
绵满4 小时前
"Mem2Evolve: Towards Self-Evolving Agents via Co-Evolutionary Capability Expansion and Experience Distillation" 论文笔记
大模型·智能体记忆
Web3&Basketball6 小时前
从0到1落地多模态表格/发票结构化识别:踩坑全记录
深度学习·大模型·ai技术
thesky1234568 小时前
27届大模型面试准备(六十六):大模型推理调度与弹性扩缩容工程——排队、优先级、抢占与弹性
大模型·抢占·连续批处理·推理调度·请求优先级·弹性扩缩容·chunked prefill
Tom·Ge1 天前
AI创业者通识日报 | 2026年8月28日
大模型·ai创业·ai创业者
VIP_CQCRE1 天前
在 WorkBuddy 里一键接入 Claude、GPT、Gemini、DeepSeek:Ace Data Cloud 让 AI 模型调用更简单
ai·大模型·openai·workbuddy·ace data cloud
Web3&Basketball1 天前
从0到1落地Claude Playwright浏览器自动化Agent:踩坑全记录
深度学习·大模型·ai技术
七牛云行业应用1 天前
国产新模型选型:GLM-5.3、DeepSeek V4、GLM-5.3-Flash、Qwen3.8-Flash-Next、Kimi K3 怎么选
人工智能·大模型·ai编程
thesky1234561 天前
27届大模型面试准备(六十二):大模型数值精度与混合精度工程——BF16/FP8、AMP、Loss Scale 与精度对齐
大模型·amp·混合精度·fp8·bf16·数值精度·梯度缩放
deepseek231 天前
智谱开源 GLM-5.3-Flash 拆解:320B 只激活 18B 的混合注意力架构与十万张国产卡
人工智能·大模型·glm