21:46IT之家(博客/媒体)字节跳动原计划8月推出的豆包大模型2.2将推迟面世。多位接近字节的人士称,延期是为了通过更充分的预训练和后训练提升编程、工具调用和Agent能力。Seed团队希望模型的Coding能力在年底前达到类似智谱GLM-5.2和Kimi-K3的行业冲击力。字节跳动创始人张一鸣表示公司不会依赖AI蒸馏技术改进模型,CEO梁汝波强调坚持自研,接受短期落后。行业豆包SeedGLM-5.22 个信源在谈事件专题推荐理由:字节推迟豆包2.2发布,专注提升编程和Agent能力,年底目标对标GLM-5.2和Kimi-K3原文稍后读已读值得跟进有用关注 豆包
04:23Fireworks AI@FireworksAI_HQ精选Arcee AI 宣布开源 nac,这是一个用于长时间运行任务的 agent harness,现已以 Apache 2.0 协议发布在 GitHub 上。同时,Arcee 推出开放模型 API 的 beta 版本。Fireworks AI 参与合作,在 Arcee 平台上提供 Kimi-K3 模型供用户试用。nac 专为开发者处理复杂多步骤的工程工作负载而设计。AI产品Arcee AInacFireworks AI5 个信源在谈事件专题推荐理由:Arcee 开源了 agent 工具 nac,能跑长时间任务,还出了 API 测试版,Fireworks 上也就能用 Kimi-K3 了。原文稍后读已读值得跟进有用关注 Arcee AI
09:08SuperTechFans(博客/媒体)82°Moonshot AI 开源 Kimi-K3,总参数 2.8T,激活参数 104B,采用 MoE 架构(896 专家中激活 16 个)。模型原生支持文本和图像输入,上下文长度 100 万 token,量化使用 MXFP4 权重和 MXFP8 激活。在 GPQA Diamond 上得分 93.5,DeepSWE 67.5,BrowseComp 91.2。部署需约 1.5TB 显存,成本较高,引发自建可行性与 API 定价讨论。AI模型Kimi-K3Moonshot AI多模态10 个信源在谈事件专题推荐理由:Moonshot AI 开源了 Kimi-K3,2.8T 参数的大模型,在推理和代理基准上很强,但显存要求高,适合有硬件或想评估部署成本的人看看。原文稍后读已读值得跟进有用关注 Kimi-K3
16:14AI Will@FinanceYF5Kimi-K3 由 Kimi_Moonshot 发布,在 Frontend Code Arena 基准测试中首次让中国超越美国。此前最接近的中国模型是 2025 年初的 DeepSeek-R1。该结果标志着中国在代码生成领域取得显著进展。AI模型Kimi-K3Kimi_MoonshotDeepSeek-R110 个信源在谈事件专题推荐理由:Kimi-K3 在编程基准上首次压过美国模型,看看它怎么做到的。原文稍后读已读值得跟进有用关注 Kimi-K3
16:10AI Will@FinanceYF5Kimi-K3在Arena AI前端代码竞技场获得1679分,超过Claude Fable 5的1631分。这是中国模型首次在该竞技场超越美国模型。上一次中国模型逼近该位置是2025年初的DeepSeek-R1。该结果由中国AI公司月之暗面推出。AI模型Kimi-K3Claude Fable 5Arena AI10 个信源在谈事件专题推荐理由:Kimi-K3在代码竞技场拿了1679分,比Claude Fable 5高48分,中国模型第一次赢美国模型,可以看看。原文稍后读已读值得跟进有用关注 Kimi-K3
04:45lmarena.ai@lmarena_ai77°月之暗面(Kimi_Moonshot)发布的Kimi-K3模型在Frontend Code Arena基准上首次超越美国模型,击败了此前领先的Fable。这是自2025年初DeepSeek-R1以来中国模型再次接近领先位置,仅隔6周。Kimi-K3使月之暗面成为全球前端编程能力第一的AI实验室。该模型为开源,标志着中国开源模型首次在编码领域超越美国。AI模型Kimi-K3Frontend Code Arena月之暗面10 个信源在谈事件专题推荐理由:月之暗面刚发的Kimi-K3直接打败了Fable,中国模型第一次在Frontend Code Arena登顶,开源领域又一大动静。原文稍后读已读值得跟进有用关注 Kimi-K3
00:16Jerry Liu@jerryjliu0精选Kimi-K3在Frontend Code Arena中以1679分排名第一,从第18位跃升至第1位,超越Claude Fable 5。它在7个测试域中6个排名第一,仅在Gaming域落后。全量模型权重将于7月27日开源。这一成绩展示了中国开源模型在任务特定基准上的竞争力。AI模型Kimi-K3Claude Fable 5Frontend Code Arena10 个信源在谈事件专题推荐理由:Kimi-K3刚拿了前端代码领域第一,全面超越Claude Fable 5,权重下月底就开源,搞AI的值得关注。原文稍后读已读值得跟进有用关注 Kimi-K3
16:26AI Will@FinanceYF5Kimi-K3在Frontend Code Arena基准测试中获得1679分,超越Claude Fable 5排名第一。相比上一代Kimi-K2.6(排名第18),Kimi-K3跃升17位。在前端7个能力领域中,Kimi-K3在品牌与营销、参考图设计等6项中排名第一,仅在游戏领域位列第二。完整模型权重预计于7月27日前发布。AI模型Kimi-K3Claude Fable 5Frontend Code Arena10 个信源在谈事件专题推荐理由:Kimi新模型K3在前端代码基准上直接干到第一,比自家K2.6猛升17名,6个领域第一,很能打。原文稍后读已读值得跟进有用关注 Kimi-K3
10:48orange.ai@oran_ge73°Kimi-K3在Frontend Code Arena中以1679分排名第一,超越Claude Fable 5。该模型从Kimi-k2.6的第18位跃升17个名次至榜首。在7个前端域中,Kimi-K3在6个领域(品牌营销、参考设计、数据分析、消费产品、模拟、内容创作工具)排名第一,仅在游戏领域落后于Fable 5位列第二。完整模型权重将于7月27日开源。AI模型Kimi-K3Kimi_MoonshotClaude Fable 510 个信源在谈事件专题推荐理由:月之暗面新模型Kimi-K3在代码排行榜上干掉了Claude Fable 5,六个子项第一,还承诺开源,看看能不能打。原文稍后读已读值得跟进有用关注 Kimi-K3
09:54Amjad Masad@amasad76°Kimi-Moonshot 的蒸馏模型 Kimi-K3 在 Frontend Code Arena 中获得 1679 分,排名第一,超越此前领先的 Claude Fable 5。相比前代 Kimi-k2.6(第 18 名),Kimi-K3 跃升 17 个位次。在 7 个前端评测领域中,Kimi-K3 在 Brand & Marketing、Reference-Based Design 等 6 个领域取得第一,仅在 Gaming 领域落后于 Fable 5。完整模型权重将于 7 月 27 日前开源。AI模型Kimi-K3Claude Fable 5Kimi_Moonshot10 个信源在谈事件专题推荐理由:Kimi-Moonshot 的蒸馏模型 Kimi-K3 在前端编码基准上直接干翻了 Claude Fable 5,还开源权重,值得关注。原文稍后读已读值得跟进有用关注 Kimi-K3
08:05lmarena.ai@lmarena_aiKimi-K3在Frontend Code Arena中以76%的pairwise win rate排名第一,击败Claude Fable 5(63%)和GPT-5.6 Sol(58%)。该模型获得1679分,从第18位跃升至第1位。在品牌营销、参考设计、数据分析等6个领域均排名第一,仅游戏领域落后于Fable 5。Kimi-Moonshot团队将于7月27日前开源完整模型权重。AI模型Kimi-K3Claude Fable 5GPT-5.6 Sol10 个信源在谈事件专题推荐理由:Kimi-K3刚在代码前端评测中干翻Claude Fable 5,76%胜率,6个领域第一,权重还开源,绝对值得关注。原文稍后读已读值得跟进有用关注 Kimi-K3
05:00lmarena.ai@lmarena_ai精选76°Kimi K3在Text Arena以1486分排名第9,较Kimi K2.6的38名跃升29位。该模型在创意写作、编程和指令遵循三个子项进入前十,并在物理与社会科学、法律与政府、医学与医疗三个职业领域排名第一。Kimi K3拥有2.8万亿参数和100万上下文窗口,其Delta注意力机制使百万token上下文的解码速度提升6.3倍,Attention Residuals在不到2%额外成本下实现约25%训练效率提升。完整模型权重将于2025年7月27日开源。AI模型Kimi-K3KimiMoonshot10 个信源在谈事件专题推荐理由:Kimi发了K3,2.8万亿参数,Text Arena排名比上代涨了29位,代码和创意写作都进前十,权重7月开源值得关注。原文稍后读已读值得跟进有用关注 Kimi-K3
03:27lmarena.ai@lmarena_ai精选78°Kimi_Moonshot 发布的 Kimi-K3 模型在 Frontend Code Arena 中以 1679 分排名第一,超越 Claude Fable 5。相比此前第 18 名的 Kimi-k2.6 跃升 17 位。在 Brand & Marketing 等 6 个领域中均排名第一,仅 Gaming 领域位居第二。完整模型权重将于 7 月 27 日前开源。AI模型Kimi-K3Kimi_MoonshotClaude Fable 510 个信源在谈事件专题推荐理由:Kimi-K3 刚把 Claude Fable 5 从第一拉下来,前端代码评测全面领先,很快还会开源权重,玩编程的可以关注。原文稍后读已读值得跟进有用关注 Kimi-K3
00:20岚叔@lufzzliz用户付费测评了Kimi-K3和GLM-5.2两个国产模型,认为它们与海外SOTA模型的差距正在缩小。在“托举大力神杯”任务中,Kimi-K3的表现仅次于fable-5模型。测评提到Kimi-K3推理速度较慢,需要付费才能完成测试。GLM-5.2也被评价为“国产之光”。AI模型Kimi-K3GLM-5.2fable-510 个信源在谈事件专题推荐理由:有人真金白银实测了Kimi-K3,发现和海外顶级模型差距缩小了,在特定任务上仅次于fable-5,值得看看具体表现。原文稍后读已读值得跟进有用关注 Kimi-K3