本地部署

CSharp精选营2 天前
本地部署·ai agent·一键启动·deepseekharness·dsh·非技术友好
DeepSeek Harness 爆火但安装劝退?一键启动器来了,不懂编程也能用最近,DeepSeek Harness 刷屏了……大家好,我是码农刚子,本文来自 码录集 - CoderLog 中文技术博客。AI 圈子里都在讨论这个官方开源的 Agent 框架——它能让 AI 真正在本地读写文件、执行命令、拆解任务,相当于把你的电脑交给 AI“打工”。 但当你兴冲冲去搜教程时,画风却是这样的:
ShallWeL7 天前
人工智能·机器学习·大模型·llm·本地部署
【机器学习】(39)—— 部署测试摘要:模型文件导出成功,并不等于可以安全替换线上版本。部署测试需要覆盖输入数据、特征工程、新模型质量、服务基础设施,以及流水线组件之间的集成。本文说明可复现训练、接口快速校验、端到端集成、突然退化与缓慢退化门禁,以及模型与服务环境的兼容性检查,并结合汽车油耗与工单分类给出发布核对清单。适合读完特征变换与训练—服务偏差、准备发版的读者。
eric-sjq6 天前
前端·本地部署
0.6B 前端生成模型本地部署实战:消费级显卡跑通 WanlyFrontend 全流程想让 0.6B 的前端生成模型在你自己电脑上跑起来,随手生成网页?这篇教程手把手带你完成本地部署:从装库、下权重、跑推理,到把模型输出的 WanlyFrontend(WF)语言编译成能直接打开的 HTML 页面。全程消费级显卡即可,无需任何云端 API。
会思想的苇草i24 天前
大模型·ai编程·开发·本地部署·omlx
oMLX 部署本地大模型云端 Token 太贵?用 oMLX 本地部署大模型,构建你的私有 AI 推理服务在 AI 应用开发中,越来越多工程师开始接入大模型能力(如 Copilot、AI 搜索、Agent 等)。但随着使用频率提升,一个现实问题逐渐暴露:
寒水馨1 个月前
linux·ubuntu·llm·llama·本地部署·llama.cpp·推理引擎
Linux下载、安装llama.cpp-b10068(附安装包llama-b10068-bin-ubuntu-vulkan-x64.tar.gz)llama.cpp 是由保加利亚软件工程师 Georgi Gerganov 于 2023 年 3 月创建的开源 LLM(Large Language Model,大语言模型)推理引擎。最初是 Gerganov 在一个周末为了让 Meta 的 LLaMA 模型在 MacBook 上运行而发起的项目,如今已发展成为本地 AI 推理领域的事实标准。截至 2026 年中,该项目在 GitHub 上已获得约 12 万颗星(Stars)、超过 1600 位贡献者,增长速度超过 PyTorch 和 TensorFlow
神奇霸王龙1 个月前
人工智能·计算机视觉·ai·开源·ai编程·本地部署
GB/T 46886 闭环屠夫:5 旗舰多模态 LLM 工业质检实测适用读者:想用 Qwen3.7-Max / GLM-5.2 / Claude Opus 4.7 这些多模态大模型做工业质检闭环的开发者 阅读时长:约 12 分钟 测试时间:2026 年 7 月(基于 炻光 AI 接入管理平台 公开文档)
寒水馨1 个月前
windows·llm·大语言模型·llama·本地部署·ollama·模型运行
Windows下载、安装ollama-v0.32.1(附安装包OllamaSetup.exe)Ollama 是目前最流行的本地大语言模型(LLM)运行工具,在 GitHub 上已获得超过 130,000 颗星标(Stars),是 AI 开发者社区中最受关注的开源项目之一。
视***间1 个月前
人工智能·gpt·大模型·本地部署·大模型本地部署·视程空间
端侧20B级推理标杆:视程空间Pandora,让GPT-OSS 20B在边缘原生落地OpenAI GPT-OSS 20B 的开源,为边缘端带来了20B 级强推理、低激活、可本地部署的顶级语言模型能力。但要让这一 “甜点级” 大模型真正跑起来、跑稳、跑快,硬件是核心瓶颈 —— 普通边缘设备要么显存不足、要么算力孱弱、要么调度低效,难以支撑 20B 模型的稳定离线推理。视程空间 Pandora 边缘算力盒子,凭借Jetson Orin NX 16G 旗舰算力、深度模型优化、极致硬件整合、全链路稳定调度,成为目前GPT-OSS 20B 在边缘端、机器人、嵌入式场景的首选部署平台,实现 19–2
2601_955781983 个月前
人工智能·本地部署·教程分享·hermes·hermes部署
Windows 环境快速部署 Hermes 智能 Agent,规避环境配置各类坑点许多朋友对 Hermes Agent 智能工具很感兴趣,但在自行部署时常常被复杂的环境配置难住。从安装依赖库到调试环境,再到处理路径错误、命令行异常、系统拦截和文件缺失等问题——这些繁琐步骤让想快速体验功能的用户望而却步。
带娃的IT创业者3 个月前
ai·图像生成·模型量化·本地部署·低资源推理
单比特奇迹:如何在本地设备运行 4B 图像生成模型?在生成式 AI 爆发的今天,每一次技术的飞跃似乎都伴随着硬件门槛的提升。当我们谈论最新的图像生成模型时,往往绕不开昂贵的显存需求。H100、A100 这些企业级显卡对于普通开发者而言遥不可及,即便是消费级旗舰 RTX 4090,在面对动辄几十亿参数的大模型时,也常常捉襟见肘。这种“算力焦虑”成为了阻碍 AI 技术普及的高墙。
codefan※3 个月前
运维·docker·容器·大模型·llm·本地部署·ollama
一键部署私人 LLM:Ollama + Docker 极简指南10 分钟本地跑起大模型,支持 Windows / Mac / Linux,无需代码基础想用 GPT-4 级别的大模型,但不想每次都担心隐私泄露、API 费用爆表?
一直会游泳的小猫3 个月前
开源·本地部署·ocr 全文检索·智能分类
Paperless-ngx:开源界的「数字档案室」——告别纸质,拥抱智能一套自托管文档管理系统,让 OCR 技术赋予你的扫描件「灵魂」,实现全文检索与智能分类。Paperless-ngx 是一个开源的文档管理系统(DMS),通过 OCR(光学字符识别) 技术将物理文档转化为可搜索的数字档案。它由社区维护,是已停止更新的 Paperless-ng 项目的官方继承者。
悟空码字3 个月前
ai·大模型·本地部署
延迟、吞吐、显存,开源模型部署的终极调优笔记大家好,我是小悟。在当前的AI工程化浪潮中,开源模型的私有化部署已成为企业保护数据隐私、控制推理成本的关键路径。
格桑阿sir3 个月前
ai·大模型·llm·部署·agent·qwen·本地部署
05-大模型智能体开发工程师:本地部署开源小模型实战系列文章导航:AI系列文章导航目录-持续更新中📝 本文摘要:本文指导在本地部署开源模型,包括硬件需求评估(显存估算)、Ollama一键部署方案(安装、运行、API调用)、量化技术(FP16/INT8/INT4及GGUF格式质量对比)、HuggingFace+transformers灵活方案、vLLM生产级加速(PagedAttention/连续批处理),以及从HuggingFace下载原始权重自行加载的完整实操(理解config.json/model.safetensors/tokenizer三大核心文
Emmamkq~~4 个月前
文生图·ai绘画·本地部署·gpu优化
造相-Z-Image技术白皮书精要:Z-Image模型结构与4090适配原理如果你手头有一块RTX 4090显卡,想用它来跑AI画图,可能会遇到一些头疼的问题:生成图片时突然显存爆了、出来的图全黑一片、或者速度并没有想象中那么快。市面上通用的文生图工具,往往是为“通用显卡”设计的,并没有针对4090这块顶级消费卡做专门的优化。
Fleshy数模4 个月前
python·语言模型·大模型·本地部署
本地部署 Qwen2.5-1.5B-Instruct 全流程教程|Ollama + 魔搭双方案在人工智能技术飞速发展的今天,大语言模型已经从云端服务走向本地部署,轻量化大模型凭借体积小、速度快、无需联网、隐私安全等优势,成为 AI 开发者、编程爱好者入门学习的最佳选择。Qwen2.5-1.5B-Instruct 作为通义千问系列的轻量级开源模型,参数规模适中,推理性能优秀,完美适配个人电脑本地运行,既能实现智能对话,也能轻松完成文本分类、情感分析、信息提取等 NLP 任务。
康de哥4 个月前
本地部署·opencode·gemma4
【一站式】本地部署Gemma 4 + 连接OpenCodeGemma 4 和OpenCode 的 太搭了,配置容易,实际使用体验也非常不错(综合体感优于原来折腾GLM + Claude Code Router+ Claude Code),有一定本地算力的话,值得推荐。
韩明君4 个月前
linux·人工智能·安全·debian·本地部署·ai agent·openclaw
OpenClaw安全部署实现1、版本V1.0.1 2、下载链接 https://download.xx.sn.cn/openclaw/V1.0.1/xOpenClaw_V1.0.1.ova3、SHA256值01531e935238fa7f62da7fd6e3f4d5cc5ee061be49ae2509089349ef84ea740f 4、版本默认配置 2vCPU、4G内存、128M显存 5、版本默认功能 1)已预装了openclaw(版本为:2026.3.13); 2)openclaw虚拟机和物理机文件系统隔离:文件请复制到电脑D盘
comedate4 个月前
大模型·本地部署·ollama·vibe coding
【OpenClaw】 8GB 显卡本地大模型部署指南本文档整理自实际问答,针对 8GB 显存环境下的本地大模型部署方案进行对比分析。Linux/macOS:
AI_DL_CODE4 个月前
本地部署·开源工具·新手教程·ai代理·阿里云百炼·skills·openclaw
【OpenClaw从入门到精通】第01篇:保姆级教程——从零开始搭建你的第一个本地AI助理(2026实测版)摘要:本文聚焦2026年开源AI代理工具OpenClaw的本地部署与实操,从核心概念拆解入手,先厘清OpenClaw、Gateway、Skills、ClawHub的关联,再明确硬件系统要求与大模型API-Key准备要点,通过官方一键安装脚本完成本地部署,并配置阿里云百炼API实现大模型对接。以“让AI助理抓取开源中国热门项目”的虚拟实战案例,详细演示Skills调用流程,同时梳理部署中“命令找不到”“API-Key配置失败”等高频问题的解决方法。内容兼顾新手友好性与实操参考性,所有步骤均基于公开技术文档验