技术栈
[论文笔记] LLM端侧小模型篇——1、剪枝量化的latency
心心喵
2024-09-14 18:54
接 LLM大模型剪枝篇,开启LLM端侧小模型篇的极致0成本部署之路~!!!!
剪枝效果
量化效果
推理框架
MLC-LLM:编译器方式推理,跨平台可用推理框架
https://huggingface.co/mlc-ai
人工智能
上一篇:
详细分析linux中的MySql跳过密码验证以及Bug(图文)
下一篇:
【BUG报错已解决】`ERROR: Failed building wheel for jupyter-nbextensions-configurator`
相关推荐
Juchecar
32 分钟前
给AI装上“手脚”:大模型如何自动执行复杂任务?
人工智能
长鸳词羡
42 分钟前
LoRA微调
人工智能
·
深度学习
·
机器学习
jerryinwuhan
1 小时前
Transformer ViT 架构(转载)
人工智能
·
深度学习
·
transformer
码农阿豪
1 小时前
【征文计划】码上分享:基于 Rokid CXR-M SDK 构建「AI远程协作助手」实战全记录
人工智能
·
kotlin
·
sdk
·
rokid
mahuan168888
1 小时前
ITVDesk
人工智能
聚梦小课堂
1 小时前
用于大语言模型后训练阶段的新方法GVPO(Group Variance Policy Optimization)
人工智能
·
语言模型
·
后训练
说私域
1 小时前
基于开源AI智能名片链动2+1模式S2B2C商城小程序的互联网运营体系化研究
人工智能
·
小程序
谢栋_
2 小时前
基于 GitLab CI/CD 与 Google Gemini 的 AI Code Review 自动化方案
人工智能
·
ci/cd
·
gitlab
koo364
2 小时前
李宏毅机器学习笔记17
人工智能
·
笔记
·
机器学习
心无旁骛~
2 小时前
PIL与OpenCV图像读取的颜色格式陷阱:RGB vs BGR
人工智能
·
opencv
·
计算机视觉
热门推荐
01
两千字总结:Codex 国内如何安装和使用的教程,以及如何设置中文回答
02
GitHub 镜像站点
03
BongoCat - 跨平台键盘猫动画工具
04
GitLab 零基础入门指南:从安装到项目管理全流程
05
UV安装并设置国内源
06
Linux下V2Ray安装配置指南
07
46个Nano-banana 精选提示词,持续更新中
08
Labelme从安装到标注:零基础完整指南
09
2025羊城杯网络安全大赛 wp
10
UV 工具安装与国内镜像源配置指南