本地部署

会思想的苇草i4 天前
大模型·ai编程·开发·本地部署·omlx
oMLX 部署本地大模型云端 Token 太贵?用 oMLX 本地部署大模型,构建你的私有 AI 推理服务在 AI 应用开发中,越来越多工程师开始接入大模型能力(如 Copilot、AI 搜索、Agent 等)。但随着使用频率提升,一个现实问题逐渐暴露:
寒水馨6 天前
linux·ubuntu·llm·llama·本地部署·llama.cpp·推理引擎
Linux下载、安装llama.cpp-b10068(附安装包llama-b10068-bin-ubuntu-vulkan-x64.tar.gz)llama.cpp 是由保加利亚软件工程师 Georgi Gerganov 于 2023 年 3 月创建的开源 LLM(Large Language Model,大语言模型)推理引擎。最初是 Gerganov 在一个周末为了让 Meta 的 LLaMA 模型在 MacBook 上运行而发起的项目,如今已发展成为本地 AI 推理领域的事实标准。截至 2026 年中,该项目在 GitHub 上已获得约 12 万颗星(Stars)、超过 1600 位贡献者,增长速度超过 PyTorch 和 TensorFlow
神奇霸王龙8 天前
人工智能·计算机视觉·ai·开源·ai编程·本地部署
GB/T 46886 闭环屠夫:5 旗舰多模态 LLM 工业质检实测适用读者:想用 Qwen3.7-Max / GLM-5.2 / Claude Opus 4.7 这些多模态大模型做工业质检闭环的开发者 阅读时长:约 12 分钟 测试时间:2026 年 7 月(基于 炻光 AI 接入管理平台 公开文档)
寒水馨9 天前
windows·llm·大语言模型·llama·本地部署·ollama·模型运行
Windows下载、安装ollama-v0.32.1(附安装包OllamaSetup.exe)Ollama 是目前最流行的本地大语言模型(LLM)运行工具,在 GitHub 上已获得超过 130,000 颗星标(Stars),是 AI 开发者社区中最受关注的开源项目之一。
视***间11 天前
人工智能·gpt·大模型·本地部署·大模型本地部署·视程空间
端侧20B级推理标杆:视程空间Pandora,让GPT-OSS 20B在边缘原生落地OpenAI GPT-OSS 20B 的开源,为边缘端带来了20B 级强推理、低激活、可本地部署的顶级语言模型能力。但要让这一 “甜点级” 大模型真正跑起来、跑稳、跑快,硬件是核心瓶颈 —— 普通边缘设备要么显存不足、要么算力孱弱、要么调度低效,难以支撑 20B 模型的稳定离线推理。视程空间 Pandora 边缘算力盒子,凭借Jetson Orin NX 16G 旗舰算力、深度模型优化、极致硬件整合、全链路稳定调度,成为目前GPT-OSS 20B 在边缘端、机器人、嵌入式场景的首选部署平台,实现 19–2
2601_955781982 个月前
人工智能·本地部署·教程分享·hermes·hermes部署
Windows 环境快速部署 Hermes 智能 Agent,规避环境配置各类坑点许多朋友对 Hermes Agent 智能工具很感兴趣,但在自行部署时常常被复杂的环境配置难住。从安装依赖库到调试环境,再到处理路径错误、命令行异常、系统拦截和文件缺失等问题——这些繁琐步骤让想快速体验功能的用户望而却步。
带娃的IT创业者2 个月前
ai·图像生成·模型量化·本地部署·低资源推理
单比特奇迹:如何在本地设备运行 4B 图像生成模型?在生成式 AI 爆发的今天,每一次技术的飞跃似乎都伴随着硬件门槛的提升。当我们谈论最新的图像生成模型时,往往绕不开昂贵的显存需求。H100、A100 这些企业级显卡对于普通开发者而言遥不可及,即便是消费级旗舰 RTX 4090,在面对动辄几十亿参数的大模型时,也常常捉襟见肘。这种“算力焦虑”成为了阻碍 AI 技术普及的高墙。
codefan※2 个月前
运维·docker·容器·大模型·llm·本地部署·ollama
一键部署私人 LLM:Ollama + Docker 极简指南10 分钟本地跑起大模型,支持 Windows / Mac / Linux,无需代码基础想用 GPT-4 级别的大模型,但不想每次都担心隐私泄露、API 费用爆表?
一直会游泳的小猫2 个月前
开源·本地部署·ocr 全文检索·智能分类
Paperless-ngx:开源界的「数字档案室」——告别纸质,拥抱智能一套自托管文档管理系统,让 OCR 技术赋予你的扫描件「灵魂」,实现全文检索与智能分类。Paperless-ngx 是一个开源的文档管理系统(DMS),通过 OCR(光学字符识别) 技术将物理文档转化为可搜索的数字档案。它由社区维护,是已停止更新的 Paperless-ng 项目的官方继承者。
悟空码字2 个月前
ai·大模型·本地部署
延迟、吞吐、显存,开源模型部署的终极调优笔记大家好,我是小悟。在当前的AI工程化浪潮中,开源模型的私有化部署已成为企业保护数据隐私、控制推理成本的关键路径。
格桑阿sir2 个月前
ai·大模型·llm·部署·agent·qwen·本地部署
05-大模型智能体开发工程师:本地部署开源小模型实战系列文章导航:AI系列文章导航目录-持续更新中📝 本文摘要:本文指导在本地部署开源模型,包括硬件需求评估(显存估算)、Ollama一键部署方案(安装、运行、API调用)、量化技术(FP16/INT8/INT4及GGUF格式质量对比)、HuggingFace+transformers灵活方案、vLLM生产级加速(PagedAttention/连续批处理),以及从HuggingFace下载原始权重自行加载的完整实操(理解config.json/model.safetensors/tokenizer三大核心文
Emmamkq~~3 个月前
文生图·ai绘画·本地部署·gpu优化
造相-Z-Image技术白皮书精要:Z-Image模型结构与4090适配原理如果你手头有一块RTX 4090显卡,想用它来跑AI画图,可能会遇到一些头疼的问题:生成图片时突然显存爆了、出来的图全黑一片、或者速度并没有想象中那么快。市面上通用的文生图工具,往往是为“通用显卡”设计的,并没有针对4090这块顶级消费卡做专门的优化。
Fleshy数模3 个月前
python·语言模型·大模型·本地部署
本地部署 Qwen2.5-1.5B-Instruct 全流程教程|Ollama + 魔搭双方案在人工智能技术飞速发展的今天,大语言模型已经从云端服务走向本地部署,轻量化大模型凭借体积小、速度快、无需联网、隐私安全等优势,成为 AI 开发者、编程爱好者入门学习的最佳选择。Qwen2.5-1.5B-Instruct 作为通义千问系列的轻量级开源模型,参数规模适中,推理性能优秀,完美适配个人电脑本地运行,既能实现智能对话,也能轻松完成文本分类、情感分析、信息提取等 NLP 任务。
康de哥3 个月前
本地部署·opencode·gemma4
【一站式】本地部署Gemma 4 + 连接OpenCodeGemma 4 和OpenCode 的 太搭了,配置容易,实际使用体验也非常不错(综合体感优于原来折腾GLM + Claude Code Router+ Claude Code),有一定本地算力的话,值得推荐。
韩明君3 个月前
linux·人工智能·安全·debian·本地部署·ai agent·openclaw
OpenClaw安全部署实现1、版本V1.0.1 2、下载链接 https://download.xx.sn.cn/openclaw/V1.0.1/xOpenClaw_V1.0.1.ova3、SHA256值01531e935238fa7f62da7fd6e3f4d5cc5ee061be49ae2509089349ef84ea740f 4、版本默认配置 2vCPU、4G内存、128M显存 5、版本默认功能 1)已预装了openclaw(版本为:2026.3.13); 2)openclaw虚拟机和物理机文件系统隔离:文件请复制到电脑D盘
comedate4 个月前
大模型·本地部署·ollama·vibe coding
【OpenClaw】 8GB 显卡本地大模型部署指南本文档整理自实际问答,针对 8GB 显存环境下的本地大模型部署方案进行对比分析。Linux/macOS:
AI_DL_CODE4 个月前
本地部署·开源工具·新手教程·ai代理·阿里云百炼·skills·openclaw
【OpenClaw从入门到精通】第01篇:保姆级教程——从零开始搭建你的第一个本地AI助理(2026实测版)摘要:本文聚焦2026年开源AI代理工具OpenClaw的本地部署与实操,从核心概念拆解入手,先厘清OpenClaw、Gateway、Skills、ClawHub的关联,再明确硬件系统要求与大模型API-Key准备要点,通过官方一键安装脚本完成本地部署,并配置阿里云百炼API实现大模型对接。以“让AI助理抓取开源中国热门项目”的虚拟实战案例,详细演示Skills调用流程,同时梳理部署中“命令找不到”“API-Key配置失败”等高频问题的解决方法。内容兼顾新手友好性与实操参考性,所有步骤均基于公开技术文档验
盘古开天16664 个月前
人工智能·本地部署·智能体·gemma4·ai私有助理
Gemma4本地部署,零成本打造私有 AI 助手2026年4月2日,谷歌DeepMind正式发布Gemma4开源模型家族,这个消息在AI圈内炸开了锅。不是因为它又堆了多少参数,而是因为它彻底改写了"本地跑AI=烧钱"的固有认知。
旺财矿工4 个月前
本地部署·ai智能体·数字员工·ai自动化·openclaw·小龙虾
openclaw一键安装包,配置好了大模型可以直接使用2026 年开源 AI 圈的黑马OpenClaw(昵称小龙虾) 凭借「本地运行 + 零代码 + 自动化操作」的核心能力迅速出圈,GitHub 星标飙升至 28 万 +,成为开发者和办公人群的必备 AI 智能体。与传统聊天 AI 不同,OpenClaw 是真正能操控电脑的数字员工,可听懂自然语言指令并自动完成文件整理、浏览器操作、办公软件自动化等工作。
加斯顿工程师4 个月前
windows·大模型·本地部署·ollama·qwen3.5
Windows系统使用Ollama本地化部署Qwen3.5-9B模型教程在 Windows 系统上使用 Ollama 本地化部署 Qwen3.5-9B 大语言模型的教程,通过自定义安装路径实现灵活的磁盘空间管理。部署流程涵盖两种模型获取方式:一是通过魔塔社区下载 GGUF 格式量化模型,利用 Modelfile 配置文件执行命令完成本地模型构建;二是直接通过命令拉取官方仓库镜像。本教程适用于需要本地私有化部署,且对数据隐私有严格要求的 AI 应用场景。