AI软件栈:推理框架(二)-Llama CPP1

Llama CPP的主要构造,GGUF和GGML为两个主要部分,包括模型描述文件和模型参数存储文件

文章目录

GGUF

  • llama.cpp 的作者 Georgi Gerganov 提出的新一代大模型描述文件 GPT-Generated Unified Format,继承自GGML,但是克服了GGML的一些缺点
    • 例如,缺少版本信息难以向后兼容;信息增加或者修改不变,手动修改模型信息不方便等;

构建图

  • 通过llma_bulid_graph在不同的基础模型之上进行参数设计(例如 llama、baichuan、MINICPM 、GEMMA、STARCODER、BERT、QW、QW2等,甚至还有MEMBA)
  • 在每个类GPT之中,通过基函数描述了计算流,同时通过暴露层数、token维度等参数作为可调模型

读取权重

  • 设计了基于分块的tensor组装,同时使用描述文件将对每个tensor及其size进行区分
相关推荐
WBingJ1 分钟前
深度学习零碎知识
人工智能·机器学习
gzgenius6 分钟前
独立部署DeepSeek 大语言模型(如 DeepSeek Coder、DeepSeek LLM)可以采用什么框架?
人工智能·学习·架构·deepseek
qq_508576097 分钟前
LLM(大型语言模型) 和 VLM(视觉语言模型)
人工智能·语言模型·自然语言处理
智哪儿7 分钟前
家庭摄像头:如何正确守护安全而非制造隐私危机?
人工智能·智能家居
金智维科技官方12 分钟前
AI Agent如何通过自然语言处理提升交互体验
人工智能·自然语言处理
kngines13 分钟前
从零构建大语言模型全栈开发指南:第一部分:数学与理论基础-1.1.1语言模型演进:从N-gram到Transformer
人工智能·transformer·n-gram·提示工程·moe·大预言模型·混合专家
墨绿色的摆渡人16 分钟前
pytorch小记(十):pytorch中torch.tril 和 torch.triu 详解
人工智能·pytorch·python
Shawn_Shawn25 分钟前
从 0 到 1:机器学习小白的起航指南
人工智能·机器学习
说私域28 分钟前
基于“十字型工具“增长框架的定制开发开源AI智能名片S2B2C商城小程序源码商业路径研究
人工智能·微信·小程序·开源·零售
FreeBuf_43 分钟前
生成式AI红队测试:如何有效评估大语言模型
人工智能·网络安全·语言模型