2024-2-27 学习笔记(Pytorch训练提速,视觉大模型简介,SAM标注流程优化)

1.消除训练瓶颈,8点PyTorch提速技巧汇总

**摘要:**这篇文章提供了8个PyTorch的训练加速技巧,包括优化硬件、测试训练瓶颈、图片解码、数据增强加速、数据预读取、多GPU并行处理、混合精度训练以及其他细节。通过这些技巧,可以提高PyTorch训练大型数据集的速度。

**Raiden说:**实操性很强的指导。对于训练速度,学生在实验室很难感知。真正的现场环境,往往也是产品的重要指标之一。目前客户能忍受的训练时长最多也就四五个小时,Yolov8的模型勉强能达到这个训练速度。

2.深入浅出,万字长文全面解读视觉大模型

**摘要:**这篇文章详细介绍了视觉大模型的基础模型、预训练、对话式的视觉语言模型以及其他相关内容。它探讨了视觉系统对于理解和推理视觉场景的重要性,并介绍了一些生成式学习的方法和预训练数据集。此外,文章还讨论了基于对话式的视觉语言模型和一些应用领域的具体模型,如医学图像分割、遥感图像分割和导航规划。

Raiden说:此文章可以和多模态大模型综述论文《Multimodal Foundation Models:From Specialists to General-Purpose Assistants》一起学习。

3.使用Segment Anything(SAM)模型进行自动标注

**摘要:**Meta开源了一个图像分割模型【SegmentAnything Model】,简称SAM模型,号称分割一切,在短短开源的一周内,截止今天Github已经24k的star了!该模型可以用于自动标注图像数据集。

**Raiden说:**之所以点名这一篇文章,不是想再去介绍下SAM。截止到现在,各家AI平台,如果不支持SAM,恐怕也实在过于落伍了。

点名的意义是发现这个开源标注工具有个细节:"先选择类别再标注"。而一般的标注流程都是先标注再选类别。显然,某些场景只需要连续的批量的标注某一类时,"先选择类别再标注"操作效率更高。标注软件后续可以考虑加入这一设置。

相关推荐
小王子102412 分钟前
设计模式Python版 组合模式
python·设计模式·组合模式
kakaZhui16 分钟前
【llm对话系统】大模型源码分析之 LLaMA 位置编码 RoPE
人工智能·深度学习·chatgpt·aigc·llama
charlie11451419141 分钟前
从0开始使用面对对象C语言搭建一个基于OLED的图形显示框架(协议层封装)
c语言·驱动开发·单片机·学习·教程·oled
struggle20251 小时前
一个开源 GenBI AI 本地代理(确保本地数据安全),使数据驱动型团队能够与其数据进行互动,生成文本到 SQL、图表、电子表格、报告和 BI
人工智能·深度学习·目标检测·语言模型·自然语言处理·数据挖掘·集成学习
佛州小李哥1 小时前
通过亚马逊云科技Bedrock打造自定义AI智能体Agent(上)
人工智能·科技·ai·语言模型·云计算·aws·亚马逊云科技
Mason Lin1 小时前
2025年1月22日(网络编程 udp)
网络·python·udp
马船长2 小时前
[BSidesCF 2020]Had a bad day1
学习
清弦墨客2 小时前
【蓝桥杯】43697.机器人塔
python·蓝桥杯·程序算法
黄交大彭于晏2 小时前
三端回链增加截图功能
学习
linwq82 小时前
设计模式学习(二)
java·学习·设计模式