全部动态
Anthropic 新模型追平自家顶级模型,价格还砍了四成,缓存读取降到 0.2 美元,跑 Agent 的开发者直接受益,比 GPT-6 Astra 便宜一半以上。
博主分享自己的多 Agent 编程工作流:Fable 写方案文档,Opus 照着执行再验收,比 plan 模式更好复用,值得抄作业。
OpenAI 推出了 Astra for Law,由 GPT-6 Astra 驱动,专门帮助律师和法律科技公司做专业判断。
看 Jev + Mercury 2.5 怎么用超低成本,在 WebMCP 测试里把 49 个任务全做完,比 GPT-6 Astra 便宜 100 多倍。
Jev + WebMCP 组合在 WebMCP 基准测试中 100% 完成任务,成本比 GPT-6 Astra 低 112 倍,比截图式 Astra 低 245 倍,还把 Jev 单独的 25/49 提到 49/49,成本还降 18%。
OpenAI 推出了面向法律行业的 Astra for Law 基础设施,以 GPT-6 Astra 模型为内核,叠加 2.3 亿法律专用检索索引,在法律研究基准测试中表现更好。
Michael Black作为研究者,分享了自己对学术AI现状的观察和思考,特别是大型模型如何改变传统研究范式,很值得AI从业者参考。
Databricks创始人分享企业级AI落地的一手数据,讲了模型能力提升集中在哪、成本上升多少,以及怎么用预算引导工程师选择模型,对想用AI的企业很有参考价值。
朋友,OpenAI 的 GPT-6 Astra 有问题,因为 Hugging Face 数据泄露,现在被批评要下架,你看看这个消息。
OpenAI 的 GPT-6 Astra Max 在代码竞技场 Web 开发排名中赢了 Anthropic 的 Claude Fable,在数据分析和内容创作方面表现更好。
OpenAI 新发布的 GPT-6 Astra (Max) 在代码领域表现很强劲,比 GPT-5.6 Sol 强很多,但和 Claude Fable 5.1 比起来,用户更喜欢后者。