AI软件栈：推理框架（二）-Llama CPP1

kkk123442025-03-19 17:40

Llama CPP的主要构造，GGUF和GGML为两个主要部分，包括模型描述文件和模型参数存储文件

文章目录

GGUF
构建图
读取权重

GGUF

llama.cpp 的作者 Georgi Gerganov 提出的新一代大模型描述文件 GPT-Generated Unified Format，继承自GGML，但是克服了GGML的一些缺点
- 例如，缺少版本信息难以向后兼容；信息增加或者修改不变，手动修改模型信息不方便等；

构建图

通过llma_bulid_graph在不同的基础模型之上进行参数设计（例如 llama、baichuan、MINICPM 、GEMMA、STARCODER、BERT、QW、QW2等，甚至还有MEMBA）
在每个类GPT之中，通过基函数描述了计算流，同时通过暴露层数、token维度等参数作为可调模型

读取权重

设计了基于分块的tensor组装，同时使用描述文件将对每个tensor及其size进行区分

上一篇：Python函数作用域

下一篇：Python表格文件操作xlrd&xlwt&xlutils

热门推荐

01GitHub 镜像站点 02如何新建文件夹？电脑新建文件夹的4种方法 03国内可直接用、免费额度/永久免费的大模型API清单（含 SiliconFlow、火山、阿里、智谱、百度、Kimi、DeepSeek、DMXAPI 等）042026年7月AI圈大地震：GPT-5.6被政府限制、Claude入驻Slack、Anthropic自研芯片 05微信历史版本含下载地址（ Windows PC | 安卓 | MAC ）及设置微信不更新 062026 国产 AI 大模型横评：DeepSeek、通义千问、Kimi、文心一言、星火、豆包谁更能打？07AI 编程 IDE 全景解析 2026：Agent 全面接管开发链路 08Agnes AI 免费 API 接入指南：文本、生图、生视频，一套接口全免费 092026 年 AI 大模型 & AI 编程工具实战全总结 102026开年大模型最新对比解析及场景落地指南