7月17日
04:10
04:10Ethan Mollick@emollick
Kimi K3发布后,开源权重模型再次接近前沿水平。评论指出Anthropic和OpenAI可能因政府限制而无法加快模型发布节奏。Mythos于4月发布(早于Opus 4.7),而Fable 5已被视为“较老的模型”。
事件专题

推荐理由:讨论Kimi K3后开源模型逼近前沿,以及Anthropic和OpenAI的发布压力,适合关注模型竞争态势的人。
7月14日
17:28
17:28小互@imxiaohu
推文比较了三个 Claude 模型的人格特征。Sonnet 4.6 偏顺从、温暖、简洁。Opus 4.6 偏严格、顺从、简洁。Opus 4.7 偏谨慎、深度,更常挑战错误假设并主动指出风险。详细报告来自 best.xiaohu.ai。
事件专题

推荐理由:想了解Claude不同版本的个性差异?这篇文直接对比了Sonnet 4.6、Opus 4.6和Opus 4.7的回复风格,帮你选更合适的模型。
6月29日
17:45
17:45Browser Use@browser_use
Browser Use 团队使用 v4 版本构建 QA 基准测试,将 GLM 5.2、Opus 4.7、GPT 5.5 和 Minimax M3 四个模型在 LLM Arena 数据集上的任务进行对比。每个模型生成网站后由人工评估打分,测试涵盖多个任务类型。结果揭示了开源权重模型在特定场景下的表现差异。
事件专题

推荐理由:他们用 Browser Use v4 搞了个新基准,测了 GLM 5.2、Opus 4.7、GPT 5.5 和 Minimax M3,人工打分告诉你谁在 QA 任务上更强。
13:48
6月25日
6月8日
6月6日
04:18
04:18官方账号Anthropic@AnthropicAI
Anthropic发布新博客,展示其AI模型Claude Opus 4.7在核磁共振波谱(NMR)分析任务上的表现。NMR是化学家理解分子结构的关键工具。研究发现,Opus 4.7在部分任务上甚至超越了专用的NMR软件。这一进展表明AI在科学领域,尤其是化学分析中,具有巨大潜力。
事件专题

推荐理由:化学研究者或药物开发团队可以关注:Claude Opus 4.7在NMR分析上达到专业软件水平,意味着AI可能简化分子结构解析流程,值得尝试用于辅助实验。
5月19日