12:33Hailuo AI@Hailuo_AI精选MiniMax H3 的开源权重已在社区中流传。有开发者在 RTX 5090 上本地运行该模型,生成 1280×720 分辨率、15 秒长的视频,耗时 10 分 40 秒。该配置使用了 Sol-Attn 与 SageAttention 优化,并设置 tau=0.8。生成的文字仍是乱码,但画面质量明显提升。AI模型MiniMaxH3RTX 5090视频生成6 个信源在谈事件专题推荐理由:想在本地玩视频生成?MiniMax H3 开源了,5090 跑 15 秒片段只要 10 分多钟,社区已经出优化方案了。原文稍后读已读值得跟进有用关注 MiniMaxH3
07:36lmarena.ai@lmarena_ai在LMSYS Text-to-Video Arena排行榜中,MiniMax-H3获得1455分,与Muse Video的1458分仅差3分,并列总榜第三。Hailuo-2.3以1260分排在第23位,Hailuo-02-pro以1228分排在第29位。MiniMax-H3比排名紧随其后的最佳开源模型高出283分,表现亮眼。AI模型MiniMax-H3Muse VideoHailuo6 个信源在谈事件专题推荐理由:MiniMax-H3这回冲到了视频生成基准第三,离Muse Video就差3分,还比其它开源模型高出一大截,值得看看。原文稍后读已读值得跟进有用关注 MiniMax-H3
07:35lmarena.ai@lmarena_ai72°MiniMax-H3在Video Arena中成为排名第一的开源模型,同时覆盖文生视频和图生视频。其得分比第二名的hunyuan-video-1.5高出280分。相比Hailuo-2.3的1199分和Hailuo-02-pro的1197分,MiniMax-H3进步显著。在图生视频单项中,MiniMax-H3拿到1476分,仅比Dreamina Seedance-2.0的1478分低2分,并列总体第一。AI模型MiniMax-H3Video ArenaHunyuan-Video6 个信源在谈事件专题推荐理由:MiniMax-H3刚开源就冲到视频榜开源第一,文生视频和图生视频都领先,连Seedance都没赢它几分,玩视频生成可以去试试。原文稍后读已读值得跟进有用关注 MiniMax-H3
04:10Justine Moore@venturetwinsMiniMax H3 在推文中展示一次性生成视频,提示词为《办公室》的 Jim 和 Dwight 讨论自主编码智能体。这段由 MiniMax H3 生成的视频重现了 Jim 与 Dwight 的对话。推文目前有 10 条回复、7 次转发、72 个点赞和 3928 次浏览。示例表明 MiniMax H3 能按单句提示词生成角色互动视频。AI模型MiniMax H3视频生成编码智能体6 个信源在谈事件专题推荐理由:MiniMax H3 一句提示词就生成《办公室》角色聊 AI 编码的视频,效果自然,可以去看看。原文稍后读已读值得跟进有用关注 MiniMax H3
23:10小互@imxiaohuSeedance 2.5 官方用户手册发布,面向即梦视频创作者。手册明确了上传素材的参数上限,并介绍了界面上的四个新入口。内容覆盖七类场景的提示词公式,每个公式都附有可直接复制的案例。官方还演示了 16 个亮点功能,按步骤操作即可生成电影级成片。技巧Seedance即梦视频生成推荐理由:即梦官方出了 Seedance 2.5 手册,七类场景的提示词公式都能直接抄,附带 16 个功能演示,做视频照着弄就行。原文稍后读已读值得跟进有用关注 Seedance
23:06小互@imxiaohu字节跳动为视频生成模型Seedance 2.5发布两份官方文档,分别是提示词指南和用户指南。提示词指南讲解如何撰写提示词,用户指南介绍从输入到生成的完整流程。两份文档已托管在Lark文档平台,可直接访问使用。技巧Seedance 2.5字节跳动视频生成2 个信源在谈事件专题推荐理由:字节跳动给Seedance 2.5出了官方提示词指南和用户手册,视频创作者照着写提示词就行,比看零散教程靠谱。原文稍后读已读值得跟进有用关注 Seedance 2.5
23:06小互@imxiaohu字节跳动发布了一份官方视频提示词指南,面向即梦和 API 用户。指南覆盖从一句话生成到 50 份参考素材调度的任务,也讲解 30 秒长片的分段方法。针对改片子时只动一处,即梦用户可按指南提供的模板定位修改。即梦和 API 使用者可以把它当作第一份成体系官方手册,模板直接套用。技巧即梦字节跳动视频生成推荐理由:字节跳动出了官方提示词指南,即梦/API 用户做视频直接抄模板,不用自己瞎试写法。原文稍后读已读值得跟进有用关注 即梦
22:15官方账号Decoder@Maximilian SchreinerMiniMax发布H3视频模型权重,这是开源模型首次登顶AI视频排行榜。H3在视频生成领域超越此前领先的闭源模型,成绩排名第一。该模型权重现已开放下载,开发者可以自由使用和改进。这一结果标志着开源视频模型在基准评测中首次处于领先位置。AI模型MiniMaxH3视频生成推荐理由:MiniMax把H3权重开源了,直接冲到视频榜第一,开源党可以下载来玩了。原文稍后读已读值得跟进有用关注 MiniMax
20:40官方账号快手可灵 Kling@Kling_AIKling MCP 提供了一套面向美食品牌的完整视频制作流程,涵盖创意风格分析、故事板构建和最终视频生成。教程演示了如何利用 AI 批量产出促销视频,提升内容生产效率。该流程适用于社交媒体短视频场景,帮助餐饮商家快速建立视觉内容。技巧Kling MCP视频生成工作流推荐理由:Kling MCP 出了个新教程,手把手教你从分析风格到生成视频,批量做美食促销宣传片,餐饮号运营可以看看。原文稍后读已读值得跟进有用关注 Kling MCP
19:41LovartAI@lovart_ai该提示词示例设定在雨夜街头电话亭,包含玻璃水痕、手持拍摄抖动等实拍细节。动画部分以0-5秒、5-10秒、10-15秒分段描述蝴蝶化为人形剪影再转为光带的过程。要求手绘线条保留颤抖和断笔效果,颜色以冷白和淡蓝为主。提示词还强调半透明叠加和错位,让动画如同投影而非实体。技巧提示词工程视频生成手绘动画推荐理由:这个提示词把电话亭场景和手绘动画分段写得超细,连抖动和反光都想到了,直接复制去生成视频就完事。原文稍后读已读值得跟进有用关注 提示词工程
19:23Hailuo AI@Hailuo_AI71°MiniMax正式发布开源视频模型MiniMax-H3,权重已公开。模型已上线Hugging Face,社区可免费获取。官方确认MiniMax-H3在RTX 5090和RTX 6000 GPU上验证运行。此次发布强调从社区来、到社区去,让智能触达每个人。AI模型MiniMax-H3MiniMax视频生成7 个信源在谈事件专题推荐理由:MiniMax开源了视频模型H3,RTX 5090能跑,想本地生成视频的直接去下权重。原文稍后读已读值得跟进有用关注 MiniMax-H3
19:14Hailuo AI@Hailuo_AIHailuoAI MiniMax H3 视频生成模型在文字渲染上表现精准。H3 能把教学设想转成提示词,直接生成学习视频。原本需要整支制作团队的工作,现在用 H3 单独就能完成。H3 的这一能力让教育视频制作门槛大幅降低。AI模型MiniMax H3HailuoAI视频生成6 个信源在谈事件专题推荐理由:H3 文字渲染是真的稳,想拿 AI 做教学视频的话,直接把教案写成提示词就能生成,比想象中省事。原文稍后读已读值得跟进有用关注 MiniMax H3
15:59官方一手pandaily@contact@pandaily.com (Pandaily)MiniMax 在 HuggingFace 上开源 H3-Base 权重,采用 33B 参数的稠密单流 Omni-Transformer 架构。该模型配备 16 倍空间和 4 倍时间压缩 VAE,本地运行只需两张 RTX 5090 显卡。其 API 定价仅为 Seedance 2.0 的三分之一。H3 在基准测试中直接对标 Seedance 2.0,展示了开源视频生成模型的竞争力。AI模型MiniMaxH3Seedance 2.0推荐理由:MiniMax 把 H3 开源了,33B 参数,两张 RTX 5090 就能本地跑,API 价格只有 Seedance 2.0 的三分之一,想玩视频生成的可以试试。原文稍后读已读值得跟进有用关注 MiniMax
15:29IT之家(博客/媒体)英特尔今日宣布为开源多模态视频模型 MiniMax H3 提供 Day 0 首发支持,锐炫 Pro B70 已率先完成适配。团队实现多卡 GPU 部署方案,Encoder 采用 8 卡张量并行,DiT 采用 8 卡 USP 并结合 Layer-wise Offloading,VAE 部署于 B70 GPU。相比纯 8 卡 USP,新方案还开发了 2TP×4USP 混合并行,将 USP 并行度降至 4 并引入 2 路张量并行,以减少通信开销。该方案还结合 llm-scaler-omni 项目的 XPU Kernel 优化,对矩阵乘法、注意力等算子进行持续优化。AI模型MiniMax H3Intel锐炫Pro B707 个信源在谈事件专题推荐理由:英特尔把 MiniMax H3 跑在多卡 GPU 上,锐炫 Pro B70 首发支持,还搞了 2TP×4USP 混合并行,视频生成部署有参考了。原文稍后读已读值得跟进有用关注 MiniMax H3
13:27IT之家(博客/媒体)MiniMax H3 于 8 月 3 日正式开源,支持文本、图片、音频和视频的多元输入,可直出 2K 分辨率、最长 15 秒的原生音画内容。该模型在 Artificial Analysis 视频模型榜单中拿下视频编辑能力全球第一,2K 分辨率视频生成价格低至 0.8 元/秒。摩尔线程基于 MTT S5000 与 MUSA 软件栈,仅用 3 小时就完成 H3 的完整适配与稳定运行。H3 支持企业本地化部署和自有数据定制,降低了多模态生成的应用门槛。AI模型MiniMaxH3摩尔线程推荐理由:MiniMax H3 开源当天就被摩尔线程国产卡接住了,2K 视频生成一秒钟才 8 毛钱,视频编辑能力还排全球第一。原文稍后读已读值得跟进有用关注 MiniMax
12:42Hailuo AI@Hailuo_AIHailuo 新模型 MiniMaxH3 主打精准口型同步,支持所有角色和画风。测试者 Stéphane 生成一段真人与动画角色的对话序列来评估模型,关注对话动态、表情和自然手势。视频显示 MiniMaxH3 在跨画风对话场景中口型匹配流畅,肢体动作自然。AI模型MiniMaxH3Hailuo口型同步6 个信源在谈事件专题推荐理由:Hailuo 的 MiniMaxH3 把真人和动画角色放在同一对话里练口型,表情手势都自然,和普通视频生成不同。原文稍后读已读值得跟进有用关注 MiniMaxH3
12:08orange.ai@oran_ge71°MiniMax 将开源视频生成模型海螺 H3 的权重公开至 Hugging Face。据称该模型在生成效果上达到 Seedance 2.0 的约 80% 水准。作为开源视频生成模型,H3 目前处于 SOTA 级别,性能领先同类开源方案。AI模型MiniMax-H3Seedance视频生成7 个信源在谈事件专题推荐理由:MiniMax 把海螺 H3 开源了,效果据说有 Seedance 2.0 的八成,是目前开源视频模型里最强的,Hugging Face 上直接就能下载。原文稍后读已读值得跟进有用关注 MiniMax-H3
10:57IT之家(博客/媒体)MiniMax 于 8 月 3 日开源新一代通用视频模型 H3,支持文本、图像、视频、音频统一理解与生成。H3 可输出最高 2K 分辨率、15 秒时长、32kHz 立体声音频的视频,帧率为 24 FPS。其输入规格包含 H3-Base-FL2VA 首尾帧模式和 H3-Base-Ref2VA 全模态参考模式,后者最多支持 9 张图像与 3 段视频。H3 稳定支持中英阿法等 11 种语言,完整系统由 H3-Context-IR、H3-Base 和 H3-Regenerate-2K 三模块组成。AI模型MiniMaxH3视频生成推荐理由:MiniMax 把能处理多模态上下文的视频模型直接开源了,最长生成 15 秒 2K 带立体声的视频,比一般文生视频强在能看懂图片、音频和视频混合输入。原文稍后读已读值得跟进有用关注 MiniMax
10:47SuperTechFans(博客/媒体)字节跳动发布新一代视频生成模型 Seedance 2.5,单次可生成最长 30 秒视频。Seedance 2.5 支持多模态引用,可参考图片和视频素材进行创作。该模型还提供高级编辑功能,方便用户调整生成内容。目前 Seedance 2.5 已上线多个平台,官方表示 API 即将推出。AI模型Seedance 2.5字节跳动视频生成3 个信源在谈事件专题推荐理由:字节跳动发布了 Seedance 2.5,一次能生成 30 秒视频,还能参考多模态素材,API 也快出了。原文稍后读已读值得跟进有用关注 Seedance 2.5
22:08Hailuo AI@Hailuo_AIMiniMax H3 在用户 Farhan 的测试中生成了完整的游戏风格电影片段,场景包含古代水神庙、发光神器、巨石守卫和逃跑序列。整个片段中角色外观、镜头运动、水面光照、动作和音频保持了跨镜头一致,没有出现角色突变或环境崩坏。Farhan 认为它虽有小瑕疵,但已比随机生成的 AI 片段更接近真正的游戏过场动画。AI模型MiniMax H3Hailuo AI视频生成7 个信源在谈事件专题推荐理由:Farhan 用 MiniMax H3 做了一段水神庙逃生的游戏过场,角色、镜头、音效全程没崩,比单图生成靠谱多了。原文稍后读已读值得跟进有用关注 MiniMax H3
20:10Hailuo AI@Hailuo_AIHailuo_AI转发了一条由用户aymiee创作的作品。该视频使用MiniMax H3模型,通过Pika MCP生成画面,并采用Google Flow生成音频,风格模仿自AIWarper。帖子目前获得6次点赞和802次观看。这个组合展示了MiniMax H3与第三方工具协作的潜力。技巧MiniMax H3Pika MCPGoogle Flow7 个信源在谈事件专题推荐理由:这个视频用MiniMax H3加Pika MCP复刻了AIWarper那种风格,音频还是Google Flow做的,想试类似工作流可以学一手。原文稍后读已读值得跟进有用关注 MiniMax H3
00:08Hailuo AI@Hailuo_AI视频创作者@mxvdxn在X平台表示,MiniMax H3成为其短剧系列BAD GOLD得以继续的关键。此前他因Seedance 2.0的生成成本过高,几乎放弃该系列。他称MiniMax H3通常第二次尝试就能达到预期对话效果,对语言细微差别的理解非常出色。相比Seedance 2.0,该模型价格更亲民,特别适合以对话驱动的微短剧创作。他还计划在特定动作场景中结合Seedance 2.5使用。AI产品MiniMax H3海螺AI视频生成7 个信源在谈事件专题推荐理由:MiniMax H3便宜好用,对白理解强,比Seedance 2.0省钱,做短剧的创作者说系列能续上了。原文稍后读已读值得跟进有用关注 MiniMax H3
21:56官方账号Decoder@Gregor Kobsik72°字节跳动发布AI视频模型Seedance 2.5,可同时生成视频与音频。单段片段最长30秒,是谷歌Gemini Omni Flash输出时长的三倍。用户可输入数十张图片、视频和音频文件作为参考。对广告团队而言,这省去了逐段拼接短片的流程。AI模型Seedance 2.5ByteDance视频生成1 个信源在谈事件专题推荐理由:字节Seedance2.5生成30秒带声视频,是Gemini Omni Flash的三倍,广告剪辑省事。原文稍后读已读值得跟进有用关注 Seedance 2.5
16:33官方一手marktechpost@Asif RazzaqMiniMax发布新一代多模态生成模型MiniMax H3。该模型将文本、图像、视频、音频作为统一上下文处理,直接输出视频及原生立体声。H3支持2K分辨率,时长可在4至15秒之间选择,且仅支持整数时长。MiniMax称其不是简单的文生视频外加组件,而是通用多模态生成模型。AI模型MiniMax H3MiniMax视频生成7 个信源在谈事件专题推荐理由:MiniMax H3能一次读文本、图、视频、音频,直接出带立体声的2K视频,最长15秒,试试看。原文稍后读已读值得跟进有用关注 MiniMax H3
10:53Justine Moore@venturetwins一位用户过去一年半用同一图灵测试提示词试遍了 AI 视频模型,无一成功。MiniMax 3 成为首个通过该测试的模型,能在黑板上写出"Hi"。该模型由 Hailuo AI 团队发布,已开源。这标志着视频生成模型在指令遵循和文字书写能力上的显著进展。AI模型MiniMax 3Hailuo AI视频生成推荐理由:MiniMax 3 居然能真在黑板上写 Hi,之前所有视频模型都做不到,还开源了,快去试试。原文稍后读已读值得跟进有用关注 MiniMax 3
02:11OpenRouter@OpenRouterAIRunway 正式登陆 OpenRouter,首批提供 Aleph 2.0 和 Gen-4.5 两个模型。开发者通过同一套 API 既能编辑现有镜头,也能生成全新场景。这意味着原本需要分别调用编辑和生成接口的工作,现在可以统一在 OpenRouter 上完成。AI产品RunwayOpenRouterAleph 2.0推荐理由:Runway 把 Aleph 2.0 和 Gen-4.5 放到 OpenRouter 上了,现在能用同一个 API 剪片子和生成画面,不用再单独接两个平台,省事。原文稍后读已读值得跟进有用关注 Runway
02:10OpenRouter@OpenRouterAIRunway推出视频生成模型Gen-4.5,主打可控性、电影感和跨镜头一致性。该模型强调精确遵循用户提示,并支持多种生成模式下的高级运动质量。开发者可通过OpenRouter平台直接调用Gen-4.5。官方示例展示了其在保持角色和场景连贯方面的能力。AI模型RunwayGen-4.5OpenRouter推荐理由:Runway 出了 Gen-4.5,视频生成更听指令了,还能保持前后镜头一致,现在 OpenRouter 上就能直接调。原文稍后读已读值得跟进有用关注 Runway
00:44Hailuo AI@Hailuo_AIHailuo AI展示Minimax 3的精准口型同步能力。用户Kyle Coghlan转发并称赞其效果,认为音乐视频创作将因此改变。该功能支持输入包含4段文字的参考图像,配合快速剪辑生成同步视频。AI产品Minimax 3Hailuo AI视频生成推荐理由:Hailuo AI的Minimax 3对口型超准,放一张带四段文字的参考图就能让角色唱歌,做音乐视频的可以试试。原文稍后读已读值得跟进有用关注 Minimax 3
23:02官方一手歸藏(guizang.ai)@op7418MiniMax H3能根据分镜图或特效层参考生成复杂动态特效,支持全模态参考。用户用九宫格图片输入,总分辨率约1K,输出清晰度依然很高。文字和UI排版细节表现突出,适合广告片、MV、游戏宣传等场景。MiniMax官方确认该模型即将开源。技巧MiniMax H3视频生成特效5 个信源在谈事件专题推荐理由:MiniMax H3能根据分镜图和参考图直接生成复杂动效,文字细节很清晰,做广告片MV都合适,而且快开源了。原文稍后读已读值得跟进有用关注 MiniMax H3
22:44小互@imxiaohuSeedance 2.5正式发布,单次生成视频最长可达30秒。模型最多支持50个参考素材输入,角色、道具、风格等可一次性提供。官方演示显示,镜头运用、特效与人物表现均为电影级,且一次生成、无分段拼接。Seedance 2.5即将登陆Higgsfield平台,该平台目前提供Seedance 2.0的4K无限量使用。AI模型SeedanceHiggsfield视频生成推荐理由:Seedance 2.5来了,一次生成30秒电影感视频,还能塞50个参考素材,等它上Higgsfield就能玩。原文稍后读已读值得跟进有用关注 Seedance
21:17IT之家(博客/媒体)稀宇科技宣布 MiniMax H3 通用多模态视频模型将于北京时间 8 月 3 日 0 点在魔搭社区开源。该模型支持文本、图像、视频、声音组成的多模态上下文统一理解,可输出带原生双声道的音视频,最高支持 15 秒 2K 分辨率。官方称其默认提供 2K 分辨率,每秒价格不到主流模型的 1/3,768P 分辨率下价格为主流模型 720P 的 1/2。AI模型MiniMaxH3视频生成推荐理由:MiniMax H3 8 月 3 日开源,能做 15 秒 2K 音视频,价格只有主流模型的 1/3,看看合不合用。原文稍后读已读值得跟进有用关注 MiniMax
19:39Hailuo AI@Hailuo_AI海螺AI官方分享了一段MiniMax H3生成的短视频,主打精准唇形同步。该片段来自用户Aaliya的第二次测试,提示词设定为16:9夜间武侠竹林。画面要求低饱和度冷蓝、墨绿、炭灰配色,并加入浅景深、面部特写等电影化细节。生成结果无字幕、无现代元素,强调拟真影视质感。AI模型MiniMax H3Hailuo AI视频生成5 个信源在谈事件专题推荐理由:MiniMax H3在海螺AI上对口型很准,一段提示词就能生成古风武侠片段,效果自然。原文稍后读已读值得跟进有用关注 MiniMax H3
16:45Hailuo AI@Hailuo_AI设计师Cia0用MiniMax H3和Midjourney V8.2制作了一个动画UI/UX作品集网站。页面采用十二栏网格布局,左侧五栏留白给主标题,光环动画作为加载器。MiniMax H3在一次生成中同时处理原生音频、屏幕文字和角色锁定,作者认为这一组合比SD2更有优势。整个制作使用了4,367个字符的中文提示词。AI模型MiniMax H3Midjourney视频生成5 个信源在谈事件专题推荐理由:Cia0用MiniMax H3加Midjourney V8.2做了个动画版UI作品集,H3能一次生成音频、文字和角色锁定,比SD2省事多了。原文稍后读已读值得跟进有用关注 MiniMax H3
15:44LovartAI@lovart_aiMiniMax H3 已上线视频平台 Lovart,官方称其为全球排名第二的视频模型。该模型可生成15秒电影级视频,具有流畅且高保真的运动表现。它支持文本、图像、视频和音频四种多模态参考输入,并保持角色、产品、场景和风格的一致性。官方表示,其生产成本低于同类方案的一半,适用于广告、MV 和 TVC 制作。AI模型MiniMaxH3Lovart推荐理由:MiniMax H3 上了 Lovart,15秒电影级视频,成本还不到一半,做广告片和MV的可以试试。原文稍后读已读值得跟进有用关注 MiniMax
15:09IT之家(博客/媒体)字节跳动 7 月 31 日发布新一代视频生成模型 Seedance 2.5,火山引擎近期将上线 API 服务。徐工集团、小鹏汽车、智元机器人、灵初智能等多家企业已达成合作意向,率先接入该模型。Seedance 2.5 新增白模参考能力,可将白模素材渲染为写实汽车拼装片段。小鹏汽车将其集成至内部 AI 设计平台,穹彻智能用它扩充具身智能大模型训练数据。多家智驾企业正探索用 Seedance 生成暴雨、大雾、降雪等极限工况训练数据。AI模型Seedance火山引擎字节跳动2 个信源在谈事件专题推荐理由:字节的 Seedance 2.5 来了,徐工、小鹏、智元都要用。能生成工业培训和智驾极限场景视频,还支持白模转写实。原文稍后读已读值得跟进有用关注 Seedance
13:39Hailuo AI@Hailuo_AIHailuo AI官方转发了一条玩家示范:用Hailuo AI生成长约15秒的“Deck-Builder Turn”等距战术肉鸽游戏视频。提示词先用两张参考图固定棋盘和UI风格,再按0-2秒、2-5秒、5-8秒、8-11秒、11-15秒分段描述运镜、卡牌发牌、能量增减和敌方回合。要求UI始终贴紧屏幕、文字清晰拼写正确,并给出负向提示词防止UI漂移和血腥。官方标签提到MiniMax H3,适合想研究视频生成分镜控制的人参考。技巧Hailuo AIMiniMax H3视频生成5 个信源在谈事件专题推荐理由:一条现成的15秒游戏UI视频提示词,把镜头、卡牌动作和音效都安排好了,想玩Hailuo AI直接抄作业。原文稍后读已读值得跟进有用关注 Hailuo AI
12:49IT之家(博客/媒体)字节跳动7月31日发布Seedance 2.5视频生成模型,单次生成时长从15秒提升到30秒,并支持多轮延长。模型延续Seedance 2.0统一的多模态音视频联合生成架构,可一次输入最多30张图片、10段视频、10段音频作为参考。官方示例展示了30秒音乐会片段,能同时还原多个人物形象与声音。Seedance 2.5将陆续上线即梦AI与豆包专业版,API服务近期接入火山方舟。模型面向影视、广告、教育、具身智能和自动驾驶等场景。AI模型Seedance字节跳动即梦AI推荐理由:字节新模型一次能生成30秒连贯视频,还能多轮延长,做短片不用一段段拼了,影视剪辑党可以试试。原文稍后读已读值得跟进有用关注 Seedance
12:29Hailuo AI@Hailuo_AIMiniMax H3 在 Artificial Analysis 视频编辑排行榜位列第一,文本转视频排名第二,图像转视频排名第三。该模型支持输入文本、图像、视频和音频,生成 5-15 秒 24fps 带原生音频的片段,2K 视频定价为每秒 0.13 美元(每分钟 7.80 美元)。其价格低于 Dreamina Seedance 2.0 的每分钟 22.45 美元、HappyHorse-1.1 的 9.90 美元和 Kling 3.0 的 20.16 美元,但高于 Google Gemini Omni Flash 的 6.00 美元。MiniMax 计划以社区许可发布权重,营收低于 2000 万美元的组织可商用,需显著署名。当前该模型已在 Hailuo AI app 和 MiniMax API 提供。AI模型MiniMax H3HailuoArtificial Analysis5 个信源在谈事件专题推荐理由:视频编辑直接登顶的 MiniMax H3,带原生音频,价格不到 Kling 的一半,还说要开源权重,做视频的可以试试。原文稍后读已读值得跟进有用关注 MiniMax H3
12:21lmarena.ai@lmarena_aiMiniMax H3已加入LMSYS视频竞技场,支持文本转视频和图像转视频两种模式,用户可参与投票评测。该模型主打全参考(Omni-Reference)能力、商业级生成效果和性价比,并承诺将开放权重。MiniMax H3现已在HailuoAI.video和MiniMax API上线,基准评分即将公布。AI模型MiniMaxH3HailuoAI推荐理由:MiniMax发了新视频模型H3,能文生视频也能图生视频,你可以在竞技场里直接投票试玩,效果和开源都值得关注。原文稍后读已读值得跟进有用关注 MiniMax
11:49官方账号arXiv cs.AI@Zexuan Yan, Yuzhou Wu, Yue Ma, Zonghang He, Kaibo Yin, Xiaobing Tu, Yinggui Wang, Jinkui Ren, Xiantao Zhang, Shijian Wang, Jinghong Liu, Linfeng ZhangEgoGenesis是一个基于预训练视频生成先验的自我中心世界动作模拟器,用于合成可控的操作视频。它通过在线锚定投影记忆(OAPM)保留第一帧3D场景锚点,并用Action-3D RoPE编码末端执行器运动。将400条真实轨迹与400条EgoGenesis生成轨迹合并后,单臂任务真实机器人成功率从77%提升至84%。双臂任务成功率从53%提升至70%,说明合成数据能显著改善下游世界动作模型的泛化。论文EgoGenesis视频生成具身智能推荐理由:EgoGenesis是个能生成机器人操作视频的工具,用400条合成数据就把单臂成功率从77%提到84%,双臂从53%提到70%,挺厉害。原文稍后读已读值得跟进有用关注 EgoGenesis