9月3日
01:37
01:37lmarena.ai@lmarena_ai
73°
Anthropic的Fable 5.1 (Max)在Code Arena: WebDev基准测试中以1765分排名第一,领先第二名Qwen3.8-Max-0902达77分。相比前代Fable 5 (Max)排名第八,新版本提升了137分。Fable 5.1 (Max)每百万代币成本为40美元,在高价区间重新定义了性能边界。
事件专题

推荐理由:Anthropic新发布的Fable 5.1 Max在代码基准测试中大幅领先,比第二名高出77分,刷新了高价模型性能标准。
8月15日
00:25
00:25官方账号阿里通义 Qwen@Alibaba_Qwen
精选
阿里云发布 Qwen3.8-Max,即 2.4T-A95B 架构。即日起可通过 DigitalOcean Serverless Inference 调用,运行在 NVIDIA HGX B300 GPU 上。模型支持 1M token 上下文,专为长时程编码任务设计。用户按 API 用量付费,无需自建基础设施。
事件专题

推荐理由:阿里云把Qwen3.8-Max放上DigitalOcean了,1M上下文,写长代码直接调,按量付费不用管服务器。
7月11日
21:20
7月9日
08:02
08:02官方一手marktechpost@Michal Sutter
SpaceXAI推出Grok 4.5,该模型使用Cursor进行训练,专为编程、智能体任务和知识工作设计。推理速度达80 TPS,成本为每百万输入token $2、输出token $6。在Harvey法律智能体基准测试中排名第一。
事件专题

推荐理由:Grok 4.5用Cursor训练,编程和智能体任务表现强,法律基准第一,性价比不错。
6月12日