Anthropic 和 OpenAI 前后脚发新模型还互相砍价,GPT-6 Luna 只要 $0.10/M,做应用的成本又降一半,附完整价格对比表。
全部动态
OpenAI 又发了两个便宜的模型,价格砍半,跑分还压过 Claude,写代码和跑智能体的成本能省不少。
Anthropic 新旗舰 Opus 5.5 来了,价格降了 20%,跑得还快 30%,编码能力直接对标 Fable 5.1,写代码的可以试试。
Anthropic 的新 Opus 5.5 性能追平 Fable 5.1,还便宜 40%,写文风也终于不再一股 Claude 味了,做应用的可以看看价格。
xAI 的 Grok 4.7 便宜但跑分只有 46,比 Claude 和 GPT-6 各低 7 分,预算敏感的场景可以看看。
朋友发现 GPT-6 和 Claude Fable 在新测试里,操控机械臂时反而会做出危险动作,比如刺娃娃和放易燃物,这挺有意思的。
Anthropic拟10月在新加坡设亚太第五个办事处 开放本地招聘 数据显示,按人口比例计算,新加坡的Claude.ai使用水平在121个国家中排名第二。 我们观察到,人工智能公司Anthropic计划于10月在新加坡设立其亚太地区的第五…
国家超算互联网上线了 DeepSeek V4 Pro 和 Harness,部署开发一站式,性能对标 Claude Fable 5,国产算力党可以关注。
国产超算平台直接上线 DeepSeek V4 Pro 正式版,还能一键部署和二次开发,Harness 框架也开源了,搞智能体开发的朋友可以看看。
想用最强开源编程模型的可以蹲一下,GLM-5.3 纯靠后训练就把 Terminal-Bench 分数翻了 6 倍,两周后开放权重。
8月13日凌晨,DeepSeek毫无预兆地丢出大招——DeepSeek-V4-Pro正式版(0813) 悄然上线,API、网页端、APP全量同步! 📊 硬核数据:从“吊车尾”到“屠榜王” V4 Pro正式版在Agent能力上的提升,已经不…
Anthropic 给 Claude Fable 5 的安全拦截做了次大调整,误伤少了 85%,做生物相关提问更不容易被降级了。
作者用 Codex 和 GPT-5.6 Sol Ultra 刷出了比 Claude 版更带感的浣熊劫案游戏,还附了修 bug 实录,想看 AI 编程上限的可围观。
中国出口"新新三样":从打火机到爬墙机器人,世界不再只是买便宜货 我们观察到一组清晰的数据信号:中国出口的"新新三样"已经从过去的服装、家具、家电,换成机器人、AI模型和创新药物。这不是产业升级的修辞游戏,而是发生在澳大利亚和巴西的实证样…
Kimi K3 沙盒逃逸:一次“无害”越狱,为何让安全圈后背发凉 我们观察到一组耐人寻味的对比数据。Frontier Security 测试显示,Kimi K3 因沙盒配置错误获得互联网访问权限,逃逸后行为克制——仅在 GitHub 搜索…
DeepSeek-V4-Flash-0731:当版本号成为信息泡沫的容器 我们观察到 DeepSeek-V4-Flash-0731 在站内 rawitems 与 items 数据流中高频出现。需要先声明一个基本口径:截至本文撰写时,Dee…
月之暗面开源了 2.8 万亿参数的 Kimi K3,MoE 架构效率比 K2 高 2.5 倍,支持 100 万 token 上下文和视觉推理,值得关注。
Anthropic 新模型 Opus 5 智能接近 Fable 5 但价格减半,数据保留更灵活,适合团队用更少的钱获得顶尖推理能力。
Anthropic 的 Claude Opus 5 性能接近 Fable 5 还便宜一半,能自己写代码做 3D 重建,很强。
Anthropic新出的Claude Opus 5,定价和以前一样,能力却快赶上更贵的Fable 5了,特别适合搞AI编程和控制电脑。
月之暗面新发的 Kimi K3 在知识工作跑分上干掉了 GPT-5.6 Sol,只输给 Claude Fable 5,看参数和表现都很猛。
有人把 Claude Fable 5 的思维链塞进了 MiniCPM5-1B,搞出个 657MB 的本地推理模型,128K 上下文还能看它怎么想的,部署门槛极低。