阶跃星辰(StepFun)已于近期正式发布了开源图像生成模型 NextStep

根据最新信息,阶跃星辰(StepFun)已于近期正式发布了开源图像生成模型 NextStep,这标志着其自回归图像生成系列模型的一次重要升级。

下面是其核心信息汇总:

项目 详情
发布状态 已正式发布并开源
模型系列 NextStep
前代版本 NextStep-1(140亿参数)
参数量 150亿参数
核心改进 解决前代可视化故障,提高图像保真度和训练稳定性
关键技术 扩展训练 + Flow-based RL(基于流的强化学习)后训练范式
访问方式 模型权重已在 Hugging Face 平台开源

主要改进与技术特点

这次更新主要针对前代模型的已知问题进行优化,主要特点如下:

  • 修复可视化故障 :NextStep-1.1的核心目标是解决其前代版本 NextStep-1 中出现的图像"可视化故障"或"可视化异常问题",以提升输出的专业度。

  • 提升图像保真度与训练稳定性

    • 模型通过 "Flow-based RL" 的强化学习后训练方法,改善了生成图像的纹理细节 ,并旨在减少视觉伪影

    • 官方介绍称,这一技术也旨在解决自回归流基模型在强化学习中固有的数值不稳定性问题

与前代模型的区别

为了让你更清楚地了解此次升级,以下是NextStep-1.1与其前代NextStep-1的主要区别:

对比维度 NextStep-1 (前代) NextStep-1.1 (当前版本)
参数量 140亿参数 150亿参数
技术焦点 自回归+连续令牌+轻量级流匹配头 修复可视化故障Flow-based RL
主要目标 验证自回归模型生成高质量图像的可行性 提升图像质量、输出稳定性和训练稳定性

如何获取与使用

  • 开源信息 :该模型的权重文件已在 Hugging Face 平台上开源,可供下载和研究。

  • 性能数据:目前的公开信息中,尚未提及NextStep-1.1在具体基准测试(如WISE、GenEval等)中的详细分数。其性能表现,尤其是在与前代或主流扩散模型的对比上,有待社区进一步的验证和评估。

  • 硬件与部署 :参考前代NextStep-1的经验,这类大型自回归模型通常需要较强的GPU计算资源(如CUDA设备)进行推理。具体的硬件要求和部署文档,建议查阅即将发布的官方仓库说明。

相关推荐
INDEMIND2 分钟前
牵手海尔、TCL,INDEMIND家用具身陪伴机器人AI平台加速家庭AI陪伴落地
人工智能·机器人·陪伴机器人
wheelmouse77883 分钟前
AI 时代的 Git 进阶术:如何优雅地让多个 Agent 并行开发
人工智能·git·ai编程
輕華3 分钟前
矿物成分数据智能分类实战(三):以平均值填充数据集的pytorch框架和MLP算法实现与性能分析
pytorch·分类·数据挖掘
ZPC82106 分钟前
PPO (Proximal Policy Optimization) 算法模块详细拆解
人工智能·pytorch·算法·机器人
仙女修炼史7 分钟前
FCOS: Fully Convolutional One-Stage Object Detection
人工智能·目标检测·目标跟踪
大傻^9 分钟前
Spring AI Alibaba 多模态开发:集成视觉理解与视频分析能力
人工智能·spring·音视频·springai·springaialibaba·混合检索
前端摸鱼匠11 分钟前
面试题3:自注意力机制(Self-Attention)的计算流程是什么?
人工智能·ai·面试·职场和发展
出门吃三碗饭14 分钟前
CARLA: 如何在 CARLA 中回放自动驾驶场景
人工智能·机器学习·自动驾驶
Axis tech16 分钟前
第二届人形机器人半程马拉松即将于4月开赛,对比去年技术进步有哪些?
人工智能·机器人
志栋智能16 分钟前
超自动化巡检,如何成为业务稳定的“压舱石”?
大数据·运维·网络·人工智能·自动化