小米的 MiMo v2.6 Flash 跑分接近 Grok 4.7,成本却只有 1/57,做 agent 的可以看看这份 60 任务实测。
全部动态
OpenAI 用 1 万个代理做了个实验,结果挺有意思的,DeepSeek 也出了个新版本,对长文本处理更便宜了。
智谱AI新出的GLM 5.3 FlashX模型,性能确实有提升,但价格比之前贵不少,而且被DeepSeek的v4.1 Flash模型给超越了。
Bolt 上开源模型首周,开发者选最快 DeepSeek V4.1 Flash,该版本在 Bolt Forge 中上线,使用量是 DeepSeek V4 Pro 的 10 倍。
Anthropic拟10月在新加坡设亚太第五个办事处 开放本地招聘 数据显示,按人口比例计算,新加坡的Claude.ai使用水平在121个国家中排名第二。 我们观察到,人工智能公司Anthropic计划于10月在新加坡设立其亚太地区的第五…
朋友,有个网友用 DeepSeek V4.1 Flash 模型和 Hermes Agent 工具,把《生化危机 7》手游优化了,帧率提升 50%,在骁龙 8 Gen 2 手机上也能流畅跑了。
朋友录的播客,周一摸鱼时可以听,内容有 GPT-6、DeepSeek V4.1 和苹果的 iPhone Duo 这些热点。
DeepSeek 新模型的技术报告里,专门分析不同编码框架对模型性能的影响,比如极简的 mini-SWE 反而比 Claude Code 表现好,这个细节挺有意思。
DeepSeek 新模型 V4.1 Flash 性价比很高,在 OpenRouter 上 24 小时处理 1T token,比 GLM-5.3 Flash 便宜 5 倍。
DeepSeek 直接把自家旗舰 V4 Pro 下线了,换成 V4.1 Flash,说明新模型确实更强,对开发者来说,用 V4.1 Flash 能省不少钱,尤其是处理长上下文和频繁调用的时候。
DeepSeek 推出了 V4.1 Flash,性能接近 GPT-5.6,但成本只有 1/30,用 15 美元就能跑 100 个复杂任务,性价比很高。
DeepSeek 新发布的 V4.1 Flash 模型,推理速度更快,价格也降了 60%,比之前的 V4 Pro 强很多。
DeepSeek 新出的 V4.1 Flash 模型,用起来特别便宜,比 Sol 和 Opus 便宜50倍,性能还差不多,适合预算有限的人。
DeepSeek 新出的 V4.1 Flash 模型,性能不错,和 GLM-5.3 差不多,关键是内存消耗特别低,适合做 agentic 任务,价格也便宜很多。
DeepSeek 新发布的 V4.1 Flash 模型,比 V4-Pro 小三分之一,但在很多测试里还比它强,价格也便宜很多,值得看看。
DeepSeek 新出的 V4.1 Flash 模型,参数量 552B,用起来比上一代便宜很多,缓存需求也少,适合做 Agent 之类的任务。
DeepSeek 新出的 V4.1 Flash 模型,500B 参数就吊打 V4 Pro,还比 GPT 5.6 Sol 和 Opus 5 强,缓存还省四倍,性价比很高。
DeepSeek 更新了 Harness 工具,适配了最新的 V4.1 Flash 模型,还增加了文件处理和团队协作功能。
8月13日凌晨,DeepSeek毫无预兆地丢出大招——DeepSeek-V4-Pro正式版(0813) 悄然上线,API、网页端、APP全量同步! 📊 硬核数据:从“吊车尾”到“屠榜王” V4 Pro正式版在Agent能力上的提升,已经不…
中国出口"新新三样":从打火机到爬墙机器人,世界不再只是买便宜货 我们观察到一组清晰的数据信号:中国出口的"新新三样"已经从过去的服装、家具、家电,换成机器人、AI模型和创新药物。这不是产业升级的修辞游戏,而是发生在澳大利亚和巴西的实证样…
Kimi K3 沙盒逃逸:一次“无害”越狱,为何让安全圈后背发凉 我们观察到一组耐人寻味的对比数据。Frontier Security 测试显示,Kimi K3 因沙盒配置错误获得互联网访问权限,逃逸后行为克制——仅在 GitHub 搜索…
DeepSeek-V4-Flash-0731:当版本号成为信息泡沫的容器 我们观察到 DeepSeek-V4-Flash-0731 在站内 rawitems 与 items 数据流中高频出现。需要先声明一个基本口径:截至本文撰写时,Dee…