7月19日
09:53
09:53AI Will@FinanceYF5
Grok 4.5 模型参数规模为 1.5T,远低于 Kimi K3 的 2.8T 参数。但 Kimi K3 每次任务成本比 Grok 4.5 高出 3 倍。SpaceXAI 宣称在智能效率上实现突破,暗示参数更小但性能更优。若 Grok 扩至 3T 参数,效率优势可能进一步放大。
推荐理由:SpaceXAI 的 Grok 4.5 用 1.5T 参数就挑战了 2.8T 的 Kimi K3,成本还低 3 倍,看看参数效率和成本怎么平衡的。
7月18日
11:24
11:24elvis@omarsar0
Anthropic 宣布从 7 月 20 日起,Claude Fable 5 将包含在 Max 和 Team Premium 订阅中,但限制为原配额的 50%。Pro 和 Team Standard 用户可通过使用积分访问,并获一次性 100 美元积分。Anthropic 表示需求预测困难,因此分阶段逐步开放容量。
事件专题

推荐理由:Anthropic 调整了 Fable 5 订阅,Max 和 Team Premium 用户有 50% 配额,其他用户送 100 美元积分,竞争让策略更灵活。
11:14
7月17日
16:25
12:17
04:00
04:00官方账号Decoder@Matthias Bastian
Kimi发布名为K3的多模态开放权重模型,拥有2.8万亿参数和100万token上下文。在自有基准测试中,K3接近GPT-5.6 Sol和Claude Fable 5,并显著超过Opus 4.8和GLM 5.2。该模型定价大幅高于前代,标志着中国AI低价时代可能结束。完整权重计划于7月27日前公开发布。
事件专题

推荐理由:Kimi搞了个2.8万亿参数的开源模型K3,性能追平GPT-5.6 Sol和Claude Fable 5,不过价格也上去了,中国AI要涨钱了。
01:03
7月13日
09:52
7月11日
17:21
6月24日
6月23日
23:26
6月17日
06:57
06:57官方账号Jim Fan@jimfan
在一项无法在物理世界中被攻破的基准测试中,OpenAI Codex 的表现超越 Anthropic Claude,而 Claude 又优于月之暗面 Kimi。该基准由 @DrJimFan 参与的论文提出,专注于物理世界的真实场景评估。结果显示了各模型在复杂物理任务上的相对排名。
事件专题

推荐理由:英伟达科学家发推说他们论文里 Codex 把 Claude 和 Kimi 都干掉了,还是物理世界实测,看看你家模型排第几。
6月16日
09:32