全部动态

AI 相关资讯全量信息流 · 77 条
9月17日
AITOP16:09
Anthropic拟10月在新加坡设亚太第五个办事处 开...

Anthropic拟10月在新加坡设亚太第五个办事处 开放本地招聘 数据显示,按人口比例计算,新加坡的Claude.ai使用水平在121个国家中排名第二。 我们观察到,人工智能公司Anthropic计划于10月在新加坡设立其亚太地区的第五…

9月16日
9月2日
9月1日
8月13日
8月10日
8月9日
8月7日
AITOP17:04
出口结构剧变:中国卖给世界的,不再是产品而是解法

中国出口"新新三样":从打火机到爬墙机器人,世界不再只是买便宜货 我们观察到一组清晰的数据信号:中国出口的"新新三样"已经从过去的服装、家具、家电,换成机器人、AI模型和创新药物。这不是产业升级的修辞游戏,而是发生在澳大利亚和巴西的实证样…

8月6日
8月2日
8月1日
7月24日
7月10日
7月9日
7月8日
7月6日
7月3日
6月30日
6月25日
6月24日
6月23日
6月22日
6月21日
6月18日
6月16日
6月12日
产品Agent 与开发者多源确认73°15:09
Artificial Analysis 更新编程智能体排行:DeepSWE 取代 SWE-Bench Pro,Claude Fable 5 登顶

基准测试更新直接影响了主流编程智能体的排名,做 AI 编程工具选型或评估模型能力的开发者值得关注——Claude Fable 5 新登顶,Codex 也大幅提升,建议点开看具体得分和对比。

事件专题
官方账号Artificial Analysis@ArtificialAnlys11 个信源在谈原文
6月11日
6月10日
6月9日
产品中美对照多源确认72°20:32
FrontierCode 基准测试:Claude Opus 4.8 仅 13.4%,AI 代码离可合并还很远

FrontierCode 把 AI 编程评测从「能跑就行」升级到「能合并才算数」,做代码质量评估或 AI 编程工具的团队值得关注——它暴露了当前模型在真实代码审查中的致命短板。

事件专题
rohanpaul_ai@rohanpaul_ai4 个信源在谈原文
6月8日
产品多源确认精选10:58
让 Claude Opus 长时自主运行的 5 条核心实战建议

Boris Cherny 的 5 条建议直击长时自主运行的痛点,做自动化任务编排的开发者可以直接套用到 Codex 或 GPT-5.5 上,尤其是端到端自我验证这条能帮你省下大量无效 token 消耗,值得收藏实践。

事件专题
shao__meng@shao__meng4 个信源在谈原文
6月7日
6月6日
6月5日