9月2日
04:29
04:29官方账号Decoder@Matthias Bastian
73°
Anthropic推出Claude Fable 5.1和Mythos 5.1,这是其迄今为止最强大的AI模型。Fable 5.1在Terminal-Bench-Science基准测试中的得分比前代提升一倍,智能体编码能力提高30%。长程自主运行且包含大量工具调用的场景下,成本降低最高达45%。
事件专题

推荐理由:Anthropic新发布的Fable 5.1模型在科学基准测试中翻倍得分,编码能力提升30%,同时成本降低45%。
03:46
03:21
02:53
02:53OpenRouter@OpenRouterAI
78°
Claude Fable 5.1 是 Fable 5 的直接升级版本,已在 OpenRouter 平台上线。该版本在智能体编程、长时间运行工作流、可视化代码生成、金融和分析领域有显著提升。用户可通过 openrouter.ai/anthropic/clau 访问此模型。
事件专题

推荐理由:Anthropic 发布了 Fable 5.1,在编程和金融分析方面表现更好,OpenRouter 已可使用。
02:44
02:44官方账号NVIDIA AI@NVIDIAAI
NVIDIA与CrowdStrike合作测试SafeMind智能体系统。该系统通过AI模拟攻击,将遥测数据转化为检测规则,并测试新攻击路径。测试结果显示系统能够防御未见过的攻击类型。CrowdStrike的SafeMind系统在网络安全领域展现了创新应用。
事件专题

推荐理由:NVIDIA和CrowdStrike合作测试了SafeMind智能体系统,能自动防御未知攻击,比传统安全系统更智能。
02:23
02:18
01:58
01:58Google AI Developers@googleaidevs
Gemini 3.7 Flash引入了新的智能体视频理解功能,能够准确识别并计数每一次拍手。传统AI处理视频时默认采用固定1帧/秒的速度,容易漏掉快速动作。Gemini通过自动调整处理速度解决了这一难题,避免了将拍手误判为其他快速动作。
推荐理由:Google的Gemini 3.7 Flash新增智能体视频理解功能,能自动调整处理速度准确计数拍手,解决了传统AI处理快速动作的难题。
01:58
01:43
01:41
01:41官方一手OpenAI Blog博客/媒体
精选
Basis、Clay和Exa Labs三家公司使用AI智能体优化客户入职流程、账户管理和开发者集成。这些AI原生企业展示了如何将AI技术融入日常运营。企业领导者可以借鉴这些实践案例。
事件专题

推荐理由:OpenAI分享三家AI原生公司如何用智能体提升运营效率,值得企业管理者参考。
00:34
00:08
9月1日
23:48
23:48Aravind Srinivas@AravSrinivas
精选
Perplexity为Mac应用所有用户引入混合计算功能。该功能允许Computer编排可在本地Mac上运行的语言模型。特别适用于处理敏感和私人文件的智能体步骤,如血液检查结果、纳税申报和诉讼文件等。
推荐理由:Perplexity Mac应用现在支持本地处理敏感文件,混合计算功能让用户隐私更安全。
21:45
21:45Richard Socher@RichardSocher
73°
Braintrust研究评估了1,329个时事问题,对比4个模型在14种条件下的表现。搜索功能将模型间差距从47.9分缩小至5.6分。检索增益随事件时间衰减,近期事件约45分,最旧事件约24分。5次以上搜索的得分反而下降19-49%。
推荐理由:Braintrust研究显示,搜索功能能让不同模型表现趋同,但搜索次数过多反而会降低准确率。
19:28
14:46