通用多模态检索——大模型微调

1、7B的模型,参数量就占到了16G,而且你要检索,要把所有的候选项candidate全部变成向量嵌入,然后计算相似度,3090的24G显存很容易爆,而且数据量一旦大了一点,达到几万,基本就很难跑通了。如果输入还有图像的话,显存更加容易溢出,可以在加载模型的时候,限制图片输入的像素,例如max_pixel参数,加载模型的时候也可以使用int4量化。

2、例如原来是在64G的显存上跑,有些时候,即使你把batch_size改成1,num_workers改成0,也依然在24G的显存上跑不了。

3、一般原来的论文用到H200,A100,基本上完整全部复现论文也需要这个配置,24G可能只能复现部分论文。

相关推荐
小白说大模型31 分钟前
人工智能:深度学习中的卷积神经网络(CNN)实战应用
人工智能·深度学习·cnn
众人皆醒我独醉41 分钟前
Triton Inference Server:NVIDIA 的推理"瑞士军刀"——LLM 只是它的一种负载
人工智能·面试·ai编程
Vince的修炼之路42 分钟前
大模型推理框架SGLang的源码分析
人工智能·架构
码途潇潇1 小时前
Codex Rules 与 Skills:项目级和全局级配置一览
人工智能
饼干哥哥1 小时前
字节Seedance2.5终于上线,这次在收割谁?
人工智能·设计模式·前端框架
小程故事多_801 小时前
Claude Code与Codex六大组件拆解,Coding Agent怎么把任务做稳
人工智能
Keepreal4961 小时前
《从零构建大模型》——从头实现GPT模型进行文本生成
gpt·深度学习·llm
卡梅德生物科技小能手1 小时前
卡梅德生物科普 TPBG(5T4)
经验分享·深度学习·生活
董员外1 小时前
RAG 系统进化论(六):GraphRAG(基于知识图谱的 RAG),从相似文本走向实体关系
人工智能·后端·设计模式
Summer-Bright2 小时前
AI 软件简报 07.29-08.02:OpenAI 降价 80%、DeepSeek 全开源、欧盟动刀
人工智能·ai·开源·ai软件