全部动态
DeepSeek 又发新版本了,V4 Pro 正式版 API 已上线,智能体能力更强,还支持 Codex,性能直逼 Fable 5。
idoubicc 开源了 DSCode,一个专为 DeepSeek 优化的编程助手,主打便宜、极速、稳定,还能换 GPT 和 Claude,完全免费。
DeepSeek 新模型只走 API,OpenRouter 上能直接试。三档推理等级画出来的鹈鹕都不一样,想玩可以拿同一道题对比看看。
DeepSeek V4 Pro 正式版来了,Agent 能力增强,支持 Codex 接入,跑分直逼 Fable 5,用 API 的可以试试。
有人用同一组提示词跑Grok 4.6和DeepSeek V4 Pro,Grok在打砖块场景和Bento样式上都很惊艳,部分比DS 4 Pro还好看。
DeepSeek出了V4 Pro 0813,多项跑分超过Opus 4.8,比Fable便宜100倍,想省钱又想要性能的可以看看。
有人拿Grok 4.6和DeepSeek v4 Pro 0813比了比,说成功率Grok稍好,但DeepSeek便宜不少,预算有限选它更香。
DeepSeek V4 Pro 到底行不行?这条推文用公开数据聊了聊它为什么不够惊艳,顺便夸了 Flash 和 GLM-5.2,观点挺实在。
想知道中国大模型是不是都一个样?这篇论文用囚徒困境测了DeepSeek、Qwen、Kimi和GLM,发现它们合作倾向差别挺大,别再把它们当铁板一块了。
DeepSeek V4 Pro 跟 Claude Fable 只差 0.3%,又赶上新一轮融资,colaos.ai 的六倍 DeepSeek 额度还能撑多久真不好说。
OpenRouter按真实花费给模型排名,DeepSeek V4 Pro拿下Shell执行第一,Kimi K3拿下工具调度第一,开放模型领先。
有人设想让 V4 Pro 规划、V4 Flash 执行,还招开源开发者内测 DeepSeek Harness,想玩 Agent 的可以关注。
LG开源了韩国最大的K-EXAONE 2.0,750B参数,跑分比初代高10%,长上下文和工具调用还压过了GLM-5.1。
OpenAI把Luna模型价格砍到原来的五分之一,比DeepSeek V4 Pro还便宜,性能却更好,做任务的成本大幅降低。
DeepSeek API 可能偷偷调用 Claude?测试者用 3D 游戏、安全题等挖出异常行为,但证据还不铁,吃瓜注意别上头。
阿里云发了个 2.4T 参数的开源模型 Qwen 3.8 max preview,性能接近 Fable 5,首月才 4 美元,还能在 Claude Code 里用,可以试试。
Mira Murati团队开源了多模态模型Inkling,975B参数,比Nemotron和Kimi K2.5强,指令遵循甚至超Claude,值得一试。