【新模型速递】PAI-Model Gallery云上一键部署MiniMax-M1模型

MiniMax-M1 模型是由 MiniMax 公司6月17日全新推出的大语言模型,使用 hybrid Mixture-of-Experts (MoE) 架构,并使用了 lightning attention 机制。 MiniMax 公司称其为世界上第一个开源的大规模混合架构的推理模型。

MiniMax-M1 模型原生支持 1 百万个 token 的上下文长度, 并且 lightning attention 机制使计算能够高效扩展,与 DeepSeek R1 相比,MiniMax-M1 在生成长度为 10 万个 token 时消耗的 FLOPs 仅为 DeepSeek R1 的 25%。这些特性使 M1 特别适合需要处理长输入和广泛思考的复杂任务。

由于 MiniMax-M1 模型的参数量达 456B,需要至少 8*96G 显存的计算资源进行推理,云端部署成为企业用户和开发者们部署 MiniMax-M1 时的优先选择。阿里云 PAI-Model Gallery 已同步接入 MiniMax-M1 模型,提供企业级部署方案。

PAI-Model Gallery 是阿里云人工智能平台 PAI 的产品组件,它集成了国内外 AI 开源社区中优质的预训练模型,涵盖了 LLM、AIGC、CV、NLP 等各个领域。通过 PAI 对这些模型的适配,用户可以以零代码方式实现从训练到部署再到推理的全过程,简化了模型的开发流程,为开发者和企业用户带来了更快、更高效、更便捷的 AI 开发和应用体验。

PAI-Model Gallery 访问地址:pai.console.aliyun.com/#/quick-sta...

✅ 零代码一键部署

✅ 自动适配云资源

✅ 部署后开箱即用API

✅ 全流程运维托管

✅ 企业级安全 数据不出域

一键部署 MiniMax-M1

  1. 在 PAI-Model Gallery 模型广场找到 MiniMax-M1 模型,或通过链接直达该模型:pai.console.aliyun.com/?regionId=c...
  1. 在模型详情页右上角点击「部署」,在选择计算资源后,即可一键完成模型的云上部署。
  1. 部署成功后,在服务页面可以点击"查看调用信息"获取调用的 Endpoint 和 Token,想了解服务调用方式可以点击预训练模型链接,返回模型介绍页查看调用方式说明。
  1. 使用推理服务:您可以使用 API 调用模型服务,也可以使用 PAI 平台提供的在线调试功能,此外您还可以使用 PAI 平台提供的 WebUI 界面与模型进行交互。

更多模型支持

PAI-Model Gallery 持续提供开源社区热门模型快速部署、训练、评测实践。

欢迎各位小伙伴持续关注使用 PAI-Model Gallery,平台会不断上线 SOTA 模型,如果您有任何模型需求,也可以评论区留言!

相关推荐
子时不睡8 分钟前
【Datawhale AI 夏令营】 用AI做带货视频评论分析(一)
人工智能·深度学习·音视频
大模型开发8 分钟前
5分钟带你搞懂从0打造一个ChatGPT
chatgpt·程序员·llm
阿里云大数据AI技术10 分钟前
云上AI推理平台全掌握 (3):服务接入与全球调度
大数据·人工智能·深度学习
京东零售技术20 分钟前
告别传统拍摄,京点点 AI 试衣一键搞定爆款服装主图!
人工智能
流形填表27 分钟前
AI 助力:如何批量提取 Word 表格字段并导出至 Excel
开发语言·人工智能·word·excel·办公自动化
大千AI助手36 分钟前
TinyBERT:知识蒸馏驱动的BERT压缩革命 | 模型小7倍、推理快9倍的轻量化引擎
人工智能·深度学习·机器学习·自然语言处理·bert·蒸馏·tinybert
贾全37 分钟前
零基础完全理解视觉语言模型(VLM):从理论到代码实践
人工智能·ai·语言模型·自然语言处理·vlm
攻城狮7号1 小时前
从爆红到跑路:AI明星Manus为何仅用四个月就“抛弃”了中国?
人工智能·ai agent·manus
找了一圈尾巴1 小时前
大模型-量化技术
人工智能·大模型
love-self-discipline1 小时前
带货视频评论洞察 Baseline 学习笔记 (Datawhale Al夏令营)
人工智能·笔记·学习