【星海出品】大模型微调-Part-One

LoRA (Low-Rank Adaptation of Large Language Model)

大规模语言模型的低秩适应

低秩: 指矩阵的秩远小于其行数和列数,意味着数据中存在大量冗余信息 。

NLA - 自然语言自编码器(Natural Language Autoencoder(s))

DeepSeek-Flash(即DeepSeek-V4-Flash)的总参数量为2840亿(284B),但在实际推理时,只会激活约130亿(13B)的参数

LLaMA-Factory

Unsloth Pro + LoRA-XT + QLoRA

HuggingFace生态: https://huggingface.co/

阿里巴巴达摩院提出的魔塔社区: https://modelscope.cn

行业有人称其为中国版的HuggingFace

LLaMA-Factory: https://github.com/hiyouga/LLaMA-Factory

Unsloth: https://github.com/unslothai/unsloth

适用 RTX 5080

使用的5080 16G显存 甜点级 大模型

文本生成模型:8B-13B级别(如Llama 3 8B/13B、Qwen2.5 14B)全精度模型

对比ollama提供的cloud 模型速度比,本地速度快出一小截

可能涉及到本地调整的参数与云上不同,以及云传的网络过滤延迟等。

相关推荐
屹立芯创ELEADTECH3 分钟前
先进封装RDL制程中的Build-up Film:关键应用、工艺挑战与发展趋势
大数据·人工智能·microsoft
bst@微胖子5 分钟前
Spring AI (5) : MCP 深度实战:从工具抽取到鉴权,SSE 与 STDIO
人工智能·spring·dubbo
richard_yuu6 分钟前
OpenCV 实战第 8 篇:几何测量算子族,从 boundingRect 到亚像素定位
人工智能·opencv·计算机视觉
2601_956743687 分钟前
上海GEO营销公司技术评估方法|以盾码无界公开产品路线为例,拆解企业知识库语义检索、资料版本核验、内容人工审核与大模型监测复测的验证要点及适用边界
人工智能·geo·上海·企业服务
中伟视界8 分钟前
AI视频监控矿山落地实践:从算法部署到误报调优全流程
人工智能
打工仔折腾 AI10 分钟前
FaceFusion本地换脸实战:Windows整合包、模型选择与遮罩调参记录
人工智能·windows·后端·python·深度学习·性能优化·ai agent 实战
DeviceHub18 分钟前
AI服务器电源设计进阶:TLVR电感的应用解析与选型验证指南
运维·服务器·人工智能
阿明副业观察22 分钟前
AI视频生成工具功能与作用全面解析:赋能高效内容创作
大数据·人工智能·aigc·音视频·ai写作
数智工坊26 分钟前
视觉SLAM第5讲|相机成像模型:针孔投影、畸变修正与深度感知全拆解
人工智能·深度学习·数码相机·机器人
坐吃山猪27 分钟前
Meta为Personal Agent推出一个新协议PAP
人工智能