vLLM-Omni 首发支持 Kandinsky 6.0 Video 视频生成模型
Kandinsky 6.0 Video 开源了,能从文字或图片生成 5 秒带音频和对口型的视频,vLLM-Omni 第一天就能跑,感兴趣可以试试。
vLLM 项目宣布在 vLLM-Omni 中为 Kandinsky 6.0 Video 提供发布当天即可用的推理支持。该模型支持文本或图像输入,可生成 5 秒带同步音频和对口型(lip-sync)的视频片段。代码与模型权重以 MIT 许可证开源,推理支持随发布同步上线。
Day-0 support for Kandinsky 6.0 Video in vLLM-Omni! Great work from @kandinskylab_ai: 5-second video clips with synchronized audio and lip-sync, from text or image inputs. Open code and checkpoints under MIT, with inference support ready at launch.