阿里云用Happy Horse和Happy Oyster做了个AI短片,在摩纳哥AI电影节黑客马拉松拿了第七,把实景和AI场景混在一起拍科幻片,很有意思。
#视频生成
蚂蚁发了14B的世界模型LingBot-World-Infinity,能生成60分钟视频模拟20个场景,用MoBA注意力解决长时间漂移。不过目前只开放了检查点,没有完整代码。
MiniMax和Telkomsel、华为一起办了场AI电影创作大赛,1000人报名选100进决赛,7月11日雅加达现场从零到成片一天搞定,去瞅瞅吗?
蚂蚁灵波开源了LingBot-Video,专为机器人设计,RBench上超过Wan2.6,推理快3倍,适合做训练数据。
想快速生成动效页面和启动视频?motion-anything 用一句话搞定,还支持运行页面上按组件继续编辑,内置大量模板和 skill,省时省力。
Pika出了个Director's Suite,像视频导演智能体,能规划、生成、剪辑一条龙,还支持用自己的Anthropic key,挺实用。
LingBot-World 2.0 能生成一小时长、720p/60fps 的交互世界,Agent 驱动事件变化,像游戏一样可玩。
看看这篇论文,PACR-Video用提示路由和轻量适配器让长视频生成更稳定,不需要全量微调,在6个基准上全面领先。
这篇给了世界模型的具体定义和路线图,适合想了解它在强化学习、视频生成、机器人等领域不同玩法的人。
Meta新出的Muse Image和Muse Video,图像生成能精准按指令做,视频还带原生音频,比之前的模型强不少。
Meta 发了两个新模型 Muse Image 和 Muse Video,一个能画图还能编辑,一个能生成视频带声音,可以在 Instagram 里直接用了。
Meta新出的视频模型Muse Video直接冲到了排行榜第三,还比阿里的HappyHorse高30分,图像模型Muse Image也能调用工具了。
Meta新出的Muse Image和Muse Video在基准测试中表现超强,Muse Image仅次于GPT Image 2,视频模型也排第三,值得看看具体排名。
Meta的Muse模型不仅能生成高质量图像视频,还能做精准原地编辑,带智能体规划功能,比宣传更实用。
Kyutai Labs开源了MIRA,一个在神经网络里直接跑《火箭联盟》的模型,5B参数、20fps,不用游戏引擎纯靠学习生成,比传统游戏模拟器有意思多了。
Anthropic 的 Fable 5 回来了,1 小时一个人就能做出游戏宣传片级别的视频,省掉几万块和几周时间,视频创作者可以试试。