【MiniMax H3】TaoMate-H3:3步LoRA让视频生成更快更高效,速度快10倍

TaoMate-H3 是阿里巴巴淘宝直播 AIGC 团队(TaoLive AIGC)开源的一个低延迟流式音视频生成模型。

它基于 MiniMax H3 大模型,加上一个专门的 3-step LoRA(三步低秩适配器),能把文字提示(prompt)快速转成声音和画面同步的视频。最大特点是"边生成边输出",像流水一样一块一块地产出内容,而不是等整段视频全部算完才出来。

主要特点

流式生成、延迟很低:视频被切成小块(每块大约几秒),每块只需要三步去噪就能定型,比原版 MiniMax H3 快很多(实测纯计算部分可快 10 倍以上,第一块可用视频出得更快)。

声音和画面一起出:说话、环境音和视频画面是在同一时间轴上同步生成的,不是先出画面再配音。

支持长时间连续生成:能保持人物外貌、声音和动作风格稳定,跨提示词边界也不容易"变脸"或跳戏,适合做几十秒甚至更长的内容。

分辨率灵活:支持竖屏/横屏,480p、768p、接近 1080p 都能生成。

使用方法:

可配合本站发布的 MiniMax H3一键包,比如 V5版

下载lora模型后,放到ComfyUI/models/loras 目录,前台切换即可。

注.当前版本主要是 T2AV(文本直接生成音视频),后续还会推出更完整的流式版本(比如图生视频/参考视频生成)。

下载地址:点此下载

相关推荐
Likeadust1 小时前
上传即转码、分类、嵌入:本地点播/网络点播EasyDSS点播如何撑起企业视频知识库
大数据·音视频·easydss
IT_陈寒1 小时前
Redis雪崩把我坑惨了,三招教你躲过去
前端·人工智能·后端
阿里云大数据AI技术1 小时前
云栖2026|Agentic AI Infra,加速模型与智能体创新
人工智能·强化学习
Thneonl1 小时前
99.9% 置信被拒收,76% 靠两个佐证进场
人工智能·架构
Thneonl1 小时前
stateless 4/6 漏判,stateful 3/5 错杀:该信谁?
人工智能·架构
百万蹄蹄向前冲1 小时前
一张平面图把学校做成2D游戏
前端·人工智能·后端
机器之心1 小时前
突发:Claude自主发现未知生物系统,或能编辑基因
前端·人工智能·后端
犀利豆1 小时前
AI 老板五分钟挂出招聘启事,四个月后开除了第一个人
人工智能·llm·aigc
乱码三千1 小时前
如何优雅地直连无公网 IP 的远程 GPU 服务器
linux·人工智能·程序员