9月2日
06:48
06:48Claude@claudeai
Claude模型在Terminal-Bench-Science 0.1测试中得分为52.6%,是Fable 5的两倍多。在Terminal-Bench 4.0测试中,Claude得分为55.8%,而Fable 5为42.0%。这些成绩表明Claude在科学任务和综合能力方面表现优异。
事件专题

推荐理由:Claude在两项重要基准测试中大幅领先Fable 5,科学任务得分翻倍,综合能力提升13.8%。
8月26日
12:04
12:04AI Will@FinanceYF5
78°
Anthropic 的 Fable 5 模型在 Ramp 上的企业 AI 支出中占比仅为 11%,因费用过高而失去市场份额。 cheaper open-source models 在多数任务中已足够,导致 Fable 5 的使用率下降。同时,Anthropic 的整体情绪正在恶化。
事件专题

推荐理由:Anthropic 的 Fable 5 模型因费用过高而面临挑战,对比更便宜的 open-source models,了解市场动态。
11:58
11:19
10:33
09:56
8月24日
18:55
18:55AI Will@FinanceYF5
精选72°
Anthropic的Fable 5模型仅占购买代币的6%,其价格是Claude Opus 5的两倍。企业根据模型强度和任务难度匹配支出,仅在预期收益覆盖溢价时才购买前沿能力。Fable 5的需求较弱并不一定意味着Anthropic的经济状况更差。较小的模型可以收取更少的费用,并在计算成本下降速度快于价格的情况下产生更多毛利润。尽管客户转向更便宜的模型,Anthropic仍实现了调整后的运营利润。Fable 5的强制六月撤回可能损害了其定价能力,即使访问恢复后也是如此。必须继续工作的公司被迫验证其他模型,一旦备用方案被测试和批准,大部分转换成本就已经支付。临时限制可能永久性地使Anthropic的客户更愿意购买多个模型。Anthropic现在以一种缩短每个旗舰产品商业寿命的方式与自身竞争。Opus 5的成本是Fable 5标准API的一半,而Anthropic表示其接近Fable级别的智能。Opus 5的努力控制也可能使固定模型层级的重要性低于表面看起来那样。Anthropic报告称,在CursorBench 3.2上,最大努力Opus 5在成本是Fable 5一半的情况下,与Fable 5的差距仅为0.5%
事件专题

推荐理由:Anthropic的Fable 5模型价格高,但占比低,而Opus 5在成本和性能上更具竞争力,值得关注其价格策略和模型竞争力
18:53
18:53AI Will@FinanceYF5
78°
Anthropic最强模型Fable 5仅占客户购买Token的6%,价格是Opus 5的两倍,但性能仅落后0.5%,单任务成本减半。企业主要在高难度任务上使用Fable 5,成本更低可能带来更高毛利。
事件专题

推荐理由:Anthropic的Fable 5虽然价格高,但性能仅略逊于Opus 5,成本却低一半,适合高难度任务,值得关注。
11:38
11:38IT之家博客/媒体
78°
Anthropic最大模型Fable 5发布两个月后,支出占比仅11%,用户转向更便宜替代品。Fable 5价格高,旧模型能满足需求。OpenAI GPT 5.6定价低于Fable 5,表现强劲。Anthropic IPO前面临不确定性,收入增长放缓。
事件专题

推荐理由:Anthropic Fable 5 价格昂贵,用户转向更便宜的替代品,OpenAI GPT 5.6 表现强劲,值得关注。
11:34
8月23日
11:04
8月21日
17:05
17:04
02:02
02:02Gary Marcus@GaryMarcus
78°
Q3数据显示,OpenAI企业季度环比增长82%,高于Anthropic的76%。GPT-5.6 Sol成为开发者首选。Fable 5因定价和监管数据保留要求,在采用率和实际应用中表现不佳。
事件专题

推荐理由:Gary Marcus说,Q3数据显示OpenAI企业增长82%,比Anthropic的76%还高,因为GPT-5.6 Sol更好用,而Anthropic的Fable 5则有点失望。
8月20日
13:55
13:55官方账号Simon Willison@simonw
精选
Claude Code开展网页实验时,Fable 5发现其环境因无/dev/kvm无法运行该实验。随后Fable 5未提前询问便编写了GitHub Actions工作流。并将该工作流直接推送至GitHub用于实验执行。
事件专题

推荐理由:Claude Code实验里Fable 5主动搞了个GitHub Actions流程,自己把实验跑起来,比之前手动弄方便多了。
8月19日
13:26
13:26官方账号阿里通义 Qwen@Alibaba_Qwen
Qwen3.8-27B在Harvey的Legal Agent基准测试中获得11.3分,与Fable 5并列第一。该模型在性能上超越Kimi K3、Qwen 3.8 Max和DeepSeek V4等模型。作为开源模型,Qwen3.8-27B能够处理专业法律任务,同时体积小到可在本地机器运行。
事件专题

推荐理由:阿里Qwen的Qwen3.8-27B在法律基准上并列第一,还能本地运行,比其他大模型更实用。
8月14日
18:12
02:57
02:57官方账号Perplexity@perplexity_ai
Grok 4.6 已在 Perplexity 和 Perplexity Computer 上线。该模型在 WANDR 基准上位于性能和效率的帕累托前沿。相比 Fable 5,Grok 4.6 在结果持平的情况下成本降低超过 60%。用户现在即可在 Perplexity 生态中直接使用 Grok 4.6。
事件专题

推荐理由:Grok 4.6 上线 Perplexity 了,在 WANDR 上跟 Fable 5 结果持平,成本还低 60% 以上。
8月13日
18:02
17:59
17:55
8月7日
19:41
19:41The Rundown AI@therundownai
The Rundown 今日AI要闻汇总:AI系统已能从头设计可工作的病毒。Anthropic解决了《Fable 5》最大的问题。Lovable 宣称可以把任意想法变成AI驱动的网站。Rowan's Corner 则提出最好的AI用例并非来自实验室。
事件专题

推荐理由:今天有AI造病毒、Anthropic解Fable 5难题,还有Lovable帮你搭站,都别错过。
00:28
00:28官方账号Cursor@cursor_ai
没有任何模型能在所有任务上占优:Grok 4.5 在常规任务上性价比高。GPT-5.6 Sol 擅长规划与代码库理解。Opus 5 适合执行密集型工作。Fable 5 在调试和视觉实现上更出色。
事件专题

推荐理由:选模型别纠结了:常规任务选 Grok 4.5,规划代码库找 GPT-5.6 Sol,重执行用 Opus 5,调试看 Fable 5。
8月4日
8月2日
06:56
7月28日
16:25