8月8日
06:57
06:57官方账号Pika Labs@pika_labs
Pika Labs在社交平台展示了Seedance 2.5的视频编辑能力。仅用一张图像参考,就能改变复杂序列中的整个视觉环境,包括风景和主要主体。同时宣布Seedance 2.5在Pika API Club最高提供88%折扣。
事件专题

推荐理由:Pika把Seedance 2.5的视频编辑玩出花了,一张参考图就能换整个场景,API还打88折,做视频的可以看看。
02:17
02:05
02:05idoubi@idoubicc
ShipAny 推出了新模板 ShipAny Video Lite,支持 Seedance 2.5、MiniMax H3 等主流视频生成模型。模板开箱即用,功能完整,自带高颜值 Landing Page。适合有视频站需求的开发者直接使用。
事件专题

推荐理由:ShipAny 出了个现成的视频站模板,接入 Seedance 2.5 和 MiniMax H3,开箱即用,想省事直接抄。
8月7日
21:43
21:43The Rundown AI@therundownai
TheRundownAI 在 X 上发布了一条推文,内容仅为一段链接,指向 therundown.ai/p/ai-designs-v…。推文标题以“AI designs v”开头,具体内容未在推文中展开。该推文目前有 626 次浏览量,点赞、转发和评论均为 0。
推荐理由:TheRundownAI 发了条推文,只给个链接,标题是 AI designs v,可能是讲 AI 设计视频,具体得点开看。
14:41
14:41LovartAI@lovart_ai
Lovart AI 更新了其文生视频工作流,现在只需输入一个提示词即可生成连续视频片段。Lovart AI 新版取消了常见的片段拼接和画质放大步骤,流程更简洁。该功能可在官网 lovart.ai 直接测试使用。
推荐理由:Lovart AI 这次把文生视频简化为一条提示词出整段连续画面,省掉了手动拼接和放大的麻烦,想省事的视频创作者可以去试试。
14:40
14:40LovartAI@lovart_ai
Lovart 宣布接入 Seedance 2.5 Pro 模型,可直接生成 30 秒 4K 分辨率视频,无需后期拼接。模型支持最多 50 个参考素材用于锁定角色和场景一致性,并声称能实现逐帧级别的像素级控制。官方称这是 AI 视频生成的新阶段。
推荐理由:想用 AI 生成 4K 长视频的可以关注,Seedance 2.5 Pro 在 Lovart 上能一次出 30 秒,还支持 50 张参考图锁风格。
13:42
13:42量子位@量子位的朋友们
8月6日,阿里巴巴视频生成大模型Wan 3.0开启公测。该模型支持将文档、PPT等静态内容输入并转换为视频。公测版本已向用户开放使用。这一功能降低了视频制作门槛,让普通用户也能快速生成动态内容。
推荐理由:阿里发布了Wan 3.0,能直接把文档和PPT变成视频,做讲解、宣传片省事了,可以去试试公测。
12:56
12:56AI Will@FinanceYF5
Olivia Moore在X平台表示,AI视频广告已跨越鸿沟。她自2023年跟踪该领域,现在首次怀疑自己识别AI视频广告的能力。这一表态意味着AI视频广告的逼真度已对人工辨别形成挑战。推文附带的视频展示了当前AI视频广告的实际效果。
推荐理由:Olivia Moore说自2023年盯到现在,第一次怀疑自己还认不认得出AI视频广告。她贴了段视频,看一眼就知道这玩意儿多真。
12:55
11:36
11:36AI Will@FinanceYF5
76°
AI 电影《Hell Grind》时长 95 分钟,由 15 人团队在 14 天内制作完成,成本约 50 万美元,并入围戛纳。Higgsfield 现已将影片的提示词和全部资产开源。华尔街日报、Variety、BBC 都曾报道过该项目的制作流程。
事件专题

推荐理由:想用 AI 拍电影?Higgsfield 把《Hell Grind》的提示词和素材全开源了,照着做就能复现戛纳级短片。
8月6日
23:18
23:18Hailuo AI@Hailuo_AI
MiniMax在X平台发布H3模型新演示,展示Omni Reference功能在整段视频中保持角色、音频与环境一致性。测试片名为《黄金时代》,由liyuyuAi制作并发布。该演示通过引用的方式将人物特征贯穿全片,体现H3在多模态参照生成上的能力。
推荐理由:MiniMax官方发了段H3的演示片,角色长相、声音、场景从头到尾都没跑偏,想看多模态一致性效果的可以点开看看。
22:48
22:48官方一手歸藏(guizang.ai)@op7418
76°
阿里发布Wan 3.0视频生成模型,支持原生30秒1080P视频生成。它新增“全能参考”功能,可混合文本、图像、视频、音频以及文档、表格、PPT、网页等输入。定价为1080P每秒1.4元,720P每秒0.7元。该模型文本渲染和动效表现也不错。
推荐理由:阿里Wan 3.0开始公测了,能一次生成30秒1080P视频,还能混着文档PPT做参考,比一般视频模型更灵活。
16:41
16:41官方一手Pandaily@contact@pandaily.com (Pandaily)
中科通量推出金刚GC3芯片,基于RISC-V架构和数据流设计,目标降低视频生成成本。该芯片支持视频解码、编码及生成式AI,并配备统一的128GB内存池。其核心思路是应对AI计算中数据搬运带来的瓶颈,而非单纯堆算力。

推荐理由:中科通量做了款RISC-V芯片叫金刚GC3,用128GB统一内存跑视频生成,想靠省数据搬运来省钱,跟英伟达路线不一样。
15:45
09:23
09:23官方账号arXiv cs.LG@Zehua Chen, Junyou Wang, Yuxuan Jiang, Zhenying Fang, Yusheng Dai, Jianfei Chen, Ziwei Liu, Jun Zhu
TD-V2A是一种基于扩散模型的视频到音频生成方法,利用时间差异作为区分视频与图像的关键表示。研究对比了帧级和特征级的时间差异,发现特征级更有效。该方法引入分层持续学习策略和退火时间差异引导,在基准数据集上取得优于对比音视频预训练的效果。
推荐理由:这篇论文提出用时间差异做视频生成音频,不用额外网络,效果还超过了对比预训练方法,值得做V2A的人看看。
8月5日
21:38
21:38官方账号Decoder@Matthias Bastian
Black Forest Labs推出FLUX 3 Video,能生成最长20秒的全高清视频,并自带原生音频和唇形同步对话,支持超过14种语言。该模型还能直接在场景中渲染文字。BFL公布的Elo排行榜显示,FLUX 3 Video的评分高于Gemini Omni Flash和Seedance 2.0。
事件专题

推荐理由:Black Forest Labs出了FLUX 3 Video,能生成20秒带原生声音和口型对上的视频,还说自己比Seedance 2.0强,去看看效果吧。
16:51
04:07
04:07官方账号Simon Willison@simonw
MiniMax-H3 视频生成模型在 M5 Pro Mac 上运行,生成耗时约 45 分钟。模型下载大小约 115GB。测试提示词为“一只彩虹色的臭鼬跳过超市里长满苔藓的原木”。Simon Willison 在推文中分享了这一结果。
事件专题

推荐理由:Simon 用 M5 Pro Mac 跑 MiniMax-H3,下载 115GB 后花 45 分钟生成了彩虹臭鼬视频,效果挺有趣。
03:29
03:29官方账号Pika Labs@pika_labs
Pika Labs 推出 API Club,通过单一 API 接入超过100个主流生成式媒体模型,覆盖视频、图像、音频和 LLM。所有模型价格均公开透明,官网列出每个模型与竞品的详细对比。即使 API Club 偶尔定价更高,也会明确标示,方便开发者直接比较。
推荐理由:Pika 搞了个 API Club,一个接口就能调上百个视频、图像、音频和语言模型,价格还全透明,方便比价。
03:16
03:16OpenRouter@OpenRouterAI
Black Forest Labs 的 FLUX 3 Video 现已面向所有用户开放,可通过 OpenRouter 平台调用。该模型采用统一架构联合训练,支持视频、音频、图像和动作预测四类任务。官方称其兼顾写实、创意与电影感,适合多种创作场景。
事件专题

推荐理由:黑森林家的 FLUX 3 Video 上 OpenRouter 了,一个模型能生成视频、音频、图像还能做动作预测,想试试直接调 API 就行。
03:16
8月4日
12:41