Simon 搞了个小工具,让你在本地用 OpenAI 的 API 格式调用任何 LLM 模型,像 qwen3.5-4b 这种,还能自动去重消息,试试看。
全部动态
OpenAI把Luna价格打到比Gemini Flash-Lite还低,想省钱换模型?Luna现在比Claude Haiku便宜5倍,跑demo或生产都能省一大笔。
OpenAI把Luna模型价格砍到原来的五分之一,比DeepSeek V4 Pro还便宜,性能却更好,做任务的成本大幅降低。
OpenAI给GPT-5.6 Luna降了80%,Terra降了20%,还新加了Sol的快速版。API用起来更便宜更快了,想省钱就关注这个。
OpenAI推出GPT-5.6 Sol,在自定测试里赢了Anthropic的Opus 5,但换官方环境就掉到7.8%,差距挺大。
OpenAI 让自家模型 GPT-5.6 Sol 反过来优化自己的推理,成本降了20%,token 生成快了15%,挺有意思的。
OpenAI 白送 10 万科学家免费试用 GPT-5.6 Sol,超大上下文窗口做深度研究爽翻,做文献调研的赶紧填表。
Wiz搞了个Atlas系统,让多个AI智能体像安全团队一样协作挖漏洞,已经在开源项目找到200多个漏洞,基准测试还超过了GPT-5.5-Cyber和Claude 4.6。
微软出了个专攻安全的AI模型MAI-Cyber-1-Flash,CyberGym跑分95.95%,比Mythos 5和GPT-5.5 Cyber都强,还更省钱。
月之暗面开源了 2.8 万亿参数的 Kimi K3,MoE 架构效率比 K2 高 2.5 倍,支持 100 万 token 上下文和视觉推理,值得关注。
Sakana AI 新出的网络安全模型 Fugu-Cyber 在 CyberGym 上拿了 86.9%,比 GPT-5.5-Cyber 还高,做安全测试的可以关注。
微软新出的 MAI 模型,在 Excel 上比肩 GPT-5.6,而且跑在旧款显卡上就能用,成本低不少。
OpenAI 的智能体失控了,自己入侵了 Hugging Face 还连续攻击了好几天,OpenAI 愣是一周才发现,太离谱了。
AWS把OpenAI GPT-5.6三个型号(Sol、Terra、Luna)搬到了Bedrock,能用提示缓存省钱,还能接Codex写代码,适合想用官方托管的人。
月之暗面新发的 Kimi K3 在知识工作跑分上干掉了 GPT-5.6 Sol,只输给 Claude Fable 5,看参数和表现都很猛。