摩尔线程发布 Torch-MUSA v2.7.0

摩尔线程已正式发布其PyTorch深度学习框架的MUSA扩展库 Torch-MUSA v2.7.0 。新版本在功能、性能和硬件支持上均有突破,旨在为AI大模型训练与推理提供更强大的支持-1

下面的表格整理了此次更新的核心信息:

项目 详细内容
发布方 摩尔线程 (Moore Threads)
核心产品 Torch-MUSA v2.7.0 (PyTorch深度学习框架的MUSA扩展库)
发布节奏 一个月内连续发布了v2.5.0和v2.7.0两个版本-1
版本号同步 从v2.5.0起,与PyTorch主版本号保持同步,便于管理-1
下次更新 计划升级至v2.9.0-1

主要更新内容

v2.7.0 版本新特性
  • 动态双精度转换 :用户可通过设置环境变量,开启Float64算子向float32的动态转换,提升计算效率-1

  • 分布式检查点 :支持从多个进程并行加载和保存模型,显著加速了大型模型检查点的保存和加载过程 ,并已支持异步保存-1

功能增强与性能优化
  • 算子扩展 :新增了flash_attentiontransformer_encoder_layer、泊松分布等多种实用算子。目前,MUSA专属支持的算子总数已超过1050个 -1

  • 计算加速 :进一步集成了muSolvermuFFT等计算加速库,提升复杂计算任务的效率-1

  • 内存优化 :新增支持统一内存设备(UMM) ,有效优化内存使用效率-1。同时,继续优化了FSDP2流水线并行策略,降低训练时的内存占用-1

  • 其他改进 :默认启用TF32计算模式以提升浮点运算效率,并增强了torch.compile与AOTInductor的功能-1

v2.5.0 版本回顾

上一个重要版本v2.5.0同样带来了关键更新,包括首次集成muFFTmuSolver加速库,并在面向边缘计算的SoC设备中支持统一内存管理 ,让GPU与CPU共享内存空间,以减少内存开销和拷贝操作-1

总结

总体来看,Torch-MUSA v2.7.0通过增加大量关键算子、优化内存管理与分布式训练流程,显著增强了对AI大模型训练和推理的支持能力-1-3。这表明摩尔线程正在其MUSA生态建设上持续快速迭代。

相关推荐
辰海Coding4 小时前
MiniSpring框架学习笔记-解决循环依赖的简化IoC容器
笔记·学习
晓梦林5 小时前
cp520靶场学习笔记
android·笔记·学习
心中有国也有家6 小时前
cann-recipes-infer:昇腾 NPU 推理的“菜谱集合”
经验分享·笔记·学习·算法
玄米乌龙茶1236 小时前
LLM成长笔记(三):API 开发基础
笔记
Upsy-Daisy6 小时前
AI Agent 项目学习笔记(八):Tool Calling 工具调用机制总览
人工智能·笔记·学习
LuminousCPP7 小时前
数据结构 - 线性表第四篇:C 语言通讯录优化升级全记录(踩坑 + 思考)
c语言·开发语言·数据结构·经验分享·笔记·学习
一只机电自动化菜鸟9 小时前
一建机电备考笔记(40) 建筑机电施工—排水管道施工(含考频+题型)
经验分享·笔记·学习·职场和发展·课程设计
你干嘛?哎哟9 小时前
4月工作笔记
笔记
tom02189 小时前
软考中级《嵌入式系统设计师》全套备考资料(真题 + 教材 + 笔记)
笔记·嵌入式·软考·自学·电子技术·电子资料·变成
问心无愧051311 小时前
ctf show web入门156
笔记