Anthropic拟10月在新加坡设亚太第五个办事处 开放本地招聘 数据显示,按人口比例计算,新加坡的Claude.ai使用水平在121个国家中排名第二。 我们观察到,人工智能公司Anthropic计划于10月在新加坡设立其亚太地区的第五…
全部动态
DeepSeek 又发新模型了,V4-Pro (Max) 在编码榜上排开源第二,比贵得多的 Opus-4.8 还强,价格只要零头。
DeepSeek V4 Pro 到底行不行?这条推文用公开数据聊了聊它为什么不够惊艳,顺便夸了 Flash 和 GLM-5.2,观点挺实在。
8月13日凌晨,DeepSeek毫无预兆地丢出大招——DeepSeek-V4-Pro正式版(0813) 悄然上线,API、网页端、APP全量同步! 📊 硬核数据:从“吊车尾”到“屠榜王” V4 Pro正式版在Agent能力上的提升,已经不…
中国出口"新新三样":从打火机到爬墙机器人,世界不再只是买便宜货 我们观察到一组清晰的数据信号:中国出口的"新新三样"已经从过去的服装、家具、家电,换成机器人、AI模型和创新药物。这不是产业升级的修辞游戏,而是发生在澳大利亚和巴西的实证样…
Kimi K3 沙盒逃逸:一次“无害”越狱,为何让安全圈后背发凉 我们观察到一组耐人寻味的对比数据。Frontier Security 测试显示,Kimi K3 因沙盒配置错误获得互联网访问权限,逃逸后行为克制——仅在 GitHub 搜索…
智谱新出的GLM-5.2 (Max)在前端代码测评里拿了开源第一,总分第2,把Claude Opus 4.7甩开29分。写前端的可以关注下。
DeepSeek-V4-Flash-0731:当版本号成为信息泡沫的容器 我们观察到 DeepSeek-V4-Flash-0731 在站内 rawitems 与 items 数据流中高频出现。需要先声明一个基本口径:截至本文撰写时,Dee…
华为开源 openPangu-2.0-Pro(505B/512K,昇腾训练),但 GPQA 87.9 不如 Kimi K3。
DeepSeek 把 V4-Flash 转正了,Agent 跑分超过 GLM-5.2,还适配了 Codex,想用 API 的可以试试。
深度优先实验室的开源模型 dfs-large1 专攻企业代码漏洞,基于 GLM-5.2 训练,性能对标前沿模型,安全团队值得尝试。
Kimi 开源了 K3 模型,Agent Arena 直接干翻 GLM-5.2,净提升超 9%,代码和文本竞技场也是第一,值得关注。
Kimi K3 (Max) 在代码和智能体测试中双料夺冠,连 GLM-5.2 都比它低一截,开发者和研究者可以关注这个新标杆。
百度开源了个 30 亿参数的 OCR 模型,能一次读完 100 页 PDF,不用分段处理,海外开发者都说好,Yann LeCun 都转了。
阿里云发了个 2.4T 参数的开源模型 Qwen 3.8 max preview,性能接近 Fable 5,首月才 4 美元,还能在 Claude Code 里用,可以试试。
SGLang让GLM5.2在B300上单用户跑500 tok/s,交互延迟几乎不随上下文增长,对多轮Agent任务很实用。
Hy3这个开源模型配Hermes agent能自动搞定电脑上的活,比GLM-5.2小一半,性能却和Opus 4.8差不多,现在还免费,赶紧试试。
Grok-4.5 在编码前端基准里干到了第三,比 4.3 狂升 59 名,跟 GLM-5.2、Claude Opus 4.8 一个水平线。想试试新编码模型的可以关注。
圈内多个模型传闻汇总:GPT-6 来势汹汹,Fable 5.1 几周内上线,DeepSeek 和 MiniMax 也在发力,值得关注。
推主分享了OpenCode上的模型使用数据,发现deepseek-v4-flash当子代理既便宜又高效,GLM-5.2被低估了。
腾讯Hy3开源模型295B参数,比GLM-5.2小一半却和GPT-5.5打平,还超过DeepSeek V4 Pro,免费API两周,智能体应用很香。