LocalAI 开源AI引擎,本地运行多模态模型无需GPU

文章目录

  • [LocalAI 开源AI引擎,本地运行多模态模型无需GPU](#LocalAI 开源AI引擎,本地运行多模态模型无需GPU)

LocalAI 开源AI引擎,本地运行多模态模型无需GPU

mudler 开源的 LocalAI 项目,目前获得 46,139 个 Star:

LocalAI 是开源AI引擎,支持运行多种AI模型,包括大语言模型、视觉模型、语音模型、图像生成模型、视频生成模型,可在任意硬件上运行,无需GPU。

LocalAI 兼容 OpenAI、Anthropic、ElevenLabs 等主流API接口,现有36+后端支持,包括 llama.cpp、vLLM、transformers、whisper、diffusers、MLX 等。

LocalAI 适配多种硬件平台,包括 NVIDIA、AMD、Intel、Apple Silicon、Vulkan,也支持仅使用CPU运行。

LocalAI 支持多用户使用,提供API密钥认证、用户配额、角色权限控制等功能。

LocalAI 内置AI代理,支持自主代理工具调用、RAG、MCP、技能扩展等能力。

LocalAI 采用隐私优先设计,所有数据处理均在用户本地基础设施完成,不会向外传输。

项目由 Ettore Di Giacinto 创建,目前由 LocalAI 团队维护。

快速安装

macOS 安装

用户可直接下载DMG安装包,安装后需执行命令清除隔离属性:

bash 复制代码
sudo xattr -d com.apple.quarantine /Applications/LocalAI.app

容器安装

LocalAI 提供 Docker、podman 等容器镜像,用户可根据硬件选择对应版本:

仅使用CPU运行:

bash 复制代码
docker run -ti --name local-ai -p 8080:8080 localai/localai:latest

使用NVIDIA GPU运行:

bash 复制代码
# CUDA 13
docker run -ti --name local-ai -p 8080:8080 --gpus all localai/localai:latest-gpu-nvidia-cuda-13
# CUDA 12
docker run -ti --name local-ai -p 8080:8080 --gpus all localai/localai:latest-gpu-nvidia-cuda-12

使用AMD GPU运行:

bash 复制代码
docker run -ti --name local-ai -p 8080:8080 --device=/dev/kfd --device=/dev/dri --group-add=video localai/localai:latest-gpu-hipblas

使用Intel GPU运行:

bash 复制代码
docker run -ti --name local-ai -p 8080:8080 --device=/dev/dri/card1 --device=/dev/dri/renderD128 localai/localai:latest-gpu-intel

使用Vulkan GPU运行:

bash 复制代码
docker run -ti --name local-ai -p 8080:8080 localai/localai:latest-gpu-vulkan

模型加载

LocalAI 支持多种来源的模型加载:

bash 复制代码
# 从模型库加载
local-ai run llama-3.2-1b-instruct:q4_k_m
# 从Huggingface加载
local-ai run huggingface://TheBloke/phi-2-GGUF/phi-2.Q8_0.gguf
# 从Ollama OCI registry加载
local-ai run ollama://gemma:2b
# 从YAML配置加载
local-ai run https://gist.githubusercontent.com/.../phi-2.yaml
# 从标准OCI registry加载
local-ai run oci://localai/phi-2:latest

LocalAI 可自动检测GPU能力,下载对应后端,无需用户手动配置。

2026年4月更新内容包括语音识别、人脸识别、Ollama API兼容、视频生成、后端版本自动升级、模型固定与按需加载切换、通用模型导入器,新增sglang、ik-llama-cpp、TurboQuant等多个后端。

项目开源地址:https://github.com/mudler/LocalAI

增sglang、ik-llama-cpp、TurboQuant等多个后端。

项目开源地址:https://github.com/mudler/LocalAI

相关推荐
木头科技几秒前
AI 工程化第四篇】Spring AI Agent 线上可观测实战:Token 成本、调用链、工具耗时、RAG 命中率怎么监控
java·人工智能·spring
吴建旭 智宅焕5 分钟前
AI时代智能家居交付知识资产架构:非业务内容作为可信信息源的系统设计
人工智能·架构·智能家居
土星云SaturnCloud11 分钟前
边缘计算 + AI 视频存管一体机:快递末端网点分拣提效与安全管控实战方案
服务器·人工智能·ai·边缘计算
起个名字费劲死了14 分钟前
VisionMaster集成深度学习算法(基础狗)
人工智能·深度学习·算法
制造业的搬运工14 分钟前
车载 PCB 打样周期与选型指南:从 IATF 16949 到 IPC-6012 的 5 个硬指标
大数据·网络·人工智能·制造·pcb工艺
55873 生态系统15 分钟前
55873 正和博弈经济模型:重构数字时代商业价值体系
大数据·人工智能·重构·全域文明操作系统·55873 操作系统·55873全域文明生态体系
法狗狗技术团队25 分钟前
2026年标书审查工具测评:AI标书检查软件怎么选?
人工智能·招投标·投标·标书检查·标书审查·标书制作·投标全流程
OpenCSG27 分钟前
CSGLite v0.9.82 开源版本更新
开源
“AI国潮设计-小江”28 分钟前
【SDXL实战】用AI生成“财神爷蛋糕×英歌舞人物”潮汕国潮甜品IP,附Prompt与批量生成思路
开发语言·人工智能·python·aigc
Bode_200230 分钟前
企业数智孪生构建方法
人工智能·智能制造