本地部署

维核科技2 天前
私有化部署·本地部署·大模型部署·维核智创·gpu服务器维修
知识库增量更新:让“新鲜事”实时可用业务知识每天都在变:新产品上线、政策更新、流程调整。知识库如果不能及时更新,再好用的 RAG 也会“答过时的问题”。
Blockbuater_drug2 天前
本地部署·从头设计·afcycdesign·环肽设计·环肽结构预测
AfCycDesign:给 AlphaFold2 换张“环状座位表“,环肽预测/重设计/从头设计一次跑通(本地部署实测)本文收录于专栏 开源多肽设计模型和方法实践 —— 专栏系统覆盖开源多肽设计模型与实战方法,点击订阅可跟踪后续更新。
维核科技3 天前
私有化部署·本地部署·大模型部署·离线部署·维核智创
AI 网络安全:攻防的新战线当 AI 越来越强,攻防两端都发生了变化。攻击者用 AI 自动挖掘漏洞、生成钓鱼内容,防守者也开始用 AI 实时识别威胁、自动响应。
维核科技4 天前
私有化部署·本地部署·大模型部署·离线部署
冷启动与预热优化大模型服务最尴尬的时刻,往往是“刚启动”的那几分钟——模型要加载、显存要分配,请求全在排队。这个冷启动问题,值得专门优化。
智码看视界5 天前
数学推理·本地部署·开源大模型·lora微调·zgcm-1-7b·256k长上下文
从零训出 7B 数学大模型全开源:ZGCM-1-7B 部署、实测与微调全记录2026-09-15,中关村学院(ZGCAGI)在 arXiv 挂出技术报告(arXiv:2609.13356),同时把权重、中间 checkpoint、训练代码和 5.44B 行训练数据全部开源。一个 7.39B 的稠密模型,在 MATH-500 上拿到 97.13%,超过了同档所有开源 7B–8B 模型。
深圳市爱派派智能科技有限公司6 天前
rk3588·agent·openai api·本地部署·边缘ai·端侧大模型·llamapi
告别部署繁琐:LlamaPi 一键搭建本地 Agent 推理底座端侧 AI 与本地 Agent 正在快速落地,各类端侧硬件的 NPU 推理算力也得到大幅提升。但不少开发者在实际落地时依旧要面对重重门槛,整个流程耗时长、上手门槛高,阻碍了端侧大模型与 Agent 项目的快速验证。
Eric.4625 天前
人工智能·ai绘画·comfyui·本地部署·ai漫剧
2026最新|ComfyUI AI漫剧全自动教程:统一人设、智能分镜、插帧动效、批量成片保姆级指南适配 8G 笔记本显存,全本地离线运行,不需要 API 密钥,无水印不限生成次数,从剧本生成、分镜绘图、角色一致性锁定、AI 插帧补帧到 MP4 成片完整闭环,适合自媒体连载漫剧批量产出。
邵奈一1 个月前
人工智能·深度学习·机器学习·大模型·本地部署
童年照本地部署实测大家好,我是邵奈一,一个爱折腾的程序猿、正儿八经的斜杠青年。 1、这几年,我整理了不少 IT 技术教程,也喜欢记录工作中的经验和生活的点滴。 2、如果文章对你有帮助,是我的荣幸,欢迎在评论区交流。
CSharp精选营1 个月前
本地部署·ai agent·一键启动·deepseekharness·dsh·非技术友好
DeepSeek Harness 爆火但安装劝退?一键启动器来了,不懂编程也能用最近,DeepSeek Harness 刷屏了……大家好,我是码农刚子,本文来自 码录集 - CoderLog 中文技术博客。AI 圈子里都在讨论这个官方开源的 Agent 框架——它能让 AI 真正在本地读写文件、执行命令、拆解任务,相当于把你的电脑交给 AI“打工”。 但当你兴冲冲去搜教程时,画风却是这样的:
ShallWeL1 个月前
人工智能·机器学习·大模型·llm·本地部署
【机器学习】(39)—— 部署测试摘要:模型文件导出成功,并不等于可以安全替换线上版本。部署测试需要覆盖输入数据、特征工程、新模型质量、服务基础设施,以及流水线组件之间的集成。本文说明可复现训练、接口快速校验、端到端集成、突然退化与缓慢退化门禁,以及模型与服务环境的兼容性检查,并结合汽车油耗与工单分类给出发布核对清单。适合读完特征变换与训练—服务偏差、准备发版的读者。
eric-sjq1 个月前
前端·本地部署
0.6B 前端生成模型本地部署实战:消费级显卡跑通 WanlyFrontend 全流程想让 0.6B 的前端生成模型在你自己电脑上跑起来,随手生成网页?这篇教程手把手带你完成本地部署:从装库、下权重、跑推理,到把模型输出的 WanlyFrontend(WF)语言编译成能直接打开的 HTML 页面。全程消费级显卡即可,无需任何云端 API。
会思想的苇草i2 个月前
大模型·ai编程·开发·本地部署·omlx
oMLX 部署本地大模型云端 Token 太贵?用 oMLX 本地部署大模型,构建你的私有 AI 推理服务在 AI 应用开发中,越来越多工程师开始接入大模型能力(如 Copilot、AI 搜索、Agent 等)。但随着使用频率提升,一个现实问题逐渐暴露:
寒水馨2 个月前
linux·ubuntu·llm·llama·本地部署·llama.cpp·推理引擎
Linux下载、安装llama.cpp-b10068(附安装包llama-b10068-bin-ubuntu-vulkan-x64.tar.gz)llama.cpp 是由保加利亚软件工程师 Georgi Gerganov 于 2023 年 3 月创建的开源 LLM(Large Language Model,大语言模型)推理引擎。最初是 Gerganov 在一个周末为了让 Meta 的 LLaMA 模型在 MacBook 上运行而发起的项目,如今已发展成为本地 AI 推理领域的事实标准。截至 2026 年中,该项目在 GitHub 上已获得约 12 万颗星(Stars)、超过 1600 位贡献者,增长速度超过 PyTorch 和 TensorFlow
神奇霸王龙2 个月前
人工智能·计算机视觉·ai·开源·ai编程·本地部署
GB/T 46886 闭环屠夫:5 旗舰多模态 LLM 工业质检实测适用读者:想用 Qwen3.7-Max / GLM-5.2 / Claude Opus 4.7 这些多模态大模型做工业质检闭环的开发者 阅读时长:约 12 分钟 测试时间:2026 年 7 月(基于 炻光 AI 接入管理平台 公开文档)
寒水馨2 个月前
windows·llm·大语言模型·llama·本地部署·ollama·模型运行
Windows下载、安装ollama-v0.32.1(附安装包OllamaSetup.exe)Ollama 是目前最流行的本地大语言模型(LLM)运行工具,在 GitHub 上已获得超过 130,000 颗星标(Stars),是 AI 开发者社区中最受关注的开源项目之一。
视***间2 个月前
人工智能·gpt·大模型·本地部署·大模型本地部署·视程空间
端侧20B级推理标杆:视程空间Pandora,让GPT-OSS 20B在边缘原生落地OpenAI GPT-OSS 20B 的开源,为边缘端带来了20B 级强推理、低激活、可本地部署的顶级语言模型能力。但要让这一 “甜点级” 大模型真正跑起来、跑稳、跑快,硬件是核心瓶颈 —— 普通边缘设备要么显存不足、要么算力孱弱、要么调度低效,难以支撑 20B 模型的稳定离线推理。视程空间 Pandora 边缘算力盒子,凭借Jetson Orin NX 16G 旗舰算力、深度模型优化、极致硬件整合、全链路稳定调度,成为目前GPT-OSS 20B 在边缘端、机器人、嵌入式场景的首选部署平台,实现 19–2
2601_955781984 个月前
人工智能·本地部署·教程分享·hermes·hermes部署
Windows 环境快速部署 Hermes 智能 Agent,规避环境配置各类坑点许多朋友对 Hermes Agent 智能工具很感兴趣,但在自行部署时常常被复杂的环境配置难住。从安装依赖库到调试环境,再到处理路径错误、命令行异常、系统拦截和文件缺失等问题——这些繁琐步骤让想快速体验功能的用户望而却步。
带娃的IT创业者4 个月前
ai·图像生成·模型量化·本地部署·低资源推理
单比特奇迹:如何在本地设备运行 4B 图像生成模型?在生成式 AI 爆发的今天,每一次技术的飞跃似乎都伴随着硬件门槛的提升。当我们谈论最新的图像生成模型时,往往绕不开昂贵的显存需求。H100、A100 这些企业级显卡对于普通开发者而言遥不可及,即便是消费级旗舰 RTX 4090,在面对动辄几十亿参数的大模型时,也常常捉襟见肘。这种“算力焦虑”成为了阻碍 AI 技术普及的高墙。
codefan※4 个月前
运维·docker·容器·大模型·llm·本地部署·ollama
一键部署私人 LLM:Ollama + Docker 极简指南10 分钟本地跑起大模型,支持 Windows / Mac / Linux,无需代码基础想用 GPT-4 级别的大模型,但不想每次都担心隐私泄露、API 费用爆表?
一直会游泳的小猫4 个月前
开源·本地部署·ocr 全文检索·智能分类
Paperless-ngx:开源界的「数字档案室」——告别纸质,拥抱智能一套自托管文档管理系统,让 OCR 技术赋予你的扫描件「灵魂」,实现全文检索与智能分类。Paperless-ngx 是一个开源的文档管理系统(DMS),通过 OCR(光学字符识别) 技术将物理文档转化为可搜索的数字档案。它由社区维护,是已停止更新的 Paperless-ng 项目的官方继承者。