MiniMax H3 突破视频生成边界,音画内容一体生成;Ornith-1.5-35B-A3B 探索推理模型自进化训练新模式MiniMax H3 是 MiniMax 推出的通用全模态生成模型,让模型从「理解内容」进一步走向「统一生成」。它能够同时处理文本、图片、视频和音频等复杂输入,并根据多模态上下文直接生成视频,最高支持 2K 分辨率、24 FPS 和 15 秒时长。与传统视频生成模型侧重单一任务不同,H3 将文生视频、图生视频、参考生视频和视频编辑等能力统一在同一模型中,并采用音画联合生成机制,一次性生成画面、语音、音效与音乐。在实际应用中,模型还强化了复杂指令遵循、画面文字与品牌 Logo 渲染、视频运动迁移等能力,为广