技术栈

音画同步

东姬AI
21 天前
多模态·ai数字人·世界模型·ai视频生成·音画同步
当世界模型学会“开口说话“:从EchoWM开源,看AI生成内容的音画合流过去两年,AI视频生成的进步几乎都发生在"画面"上:分辨率从480P卷到1080P,时长从几秒卷到几十秒,物理规律和运镜质感也在肉眼可见地逼近实拍。但有一个维度长期被搁置在次要位置——声音。绝大多数视频生成模型产出的内容是"默片",配音、音效、环境声要靠后期另外补。9月初的京东全球科技探索者大会(JDD)上,京东探索研究院开源的交互视听世界模型EchoWM,把这个问题重新推到了台前:它生成的不是"带画面的视频",而是画面、环境音、音乐和语音原生同步的视听内容,并且允许用户像玩游戏一样走进去持续探索。
小C哈哈哈
8 个月前
人工智能·ai大模型·ai生成视频·seedance2.0·字节即梦·多镜头叙事·音画同步
字节杀疯了!Seedance2.0上线,AI视频创作彻底告别“后期地狱”大家好,我是小C。最近AI圈最炸的消息,莫过于字节跳动即梦AI(平台)推出的Seedance2.0视频制作工具 — 这款被称为"国产AI视频王炸"的大模型,直接打破我们对AI做视频所有的认知。
我是有底线的