9月3日
06:03
8月27日
00:54
00:54官方账号阿里通义 Qwen@Alibaba_Qwen
72°
QwenCloud推出Qwen3.8-Flash多模态MoE模型,基于Qwen4架构,参数125B,成本效率高,支持1M上下文扩展。Qwen3.8-Flash-Next权重已开放,支持GDN+QSA混合注意力机制。API定价0.16/1M输入令牌和0.47/1M输出令牌。
事件专题

推荐理由:想体验成本效益高的多模态模型?试试Qwen3.8-Flash,它基于Qwen4架构,参数庞大,支持1M上下文扩展,API定价低至0.16/1M输入令牌!
00:18
00:18lmarena.ai@lmarena_ai
精选72°
Alibaba Qwen 的 Qwen3.8-Flash-Next 在 Code Arena WebDev 获第 8 名,性能比 Qwen3.8-27B 提升 22 点,参数量 125B,成本效率高。新架构 GDN + QSA 混合注意力,训练和推理成本降低 1/9。即将通过 QwenCloud API 提供,价格 0.16/0.47 美元/1M tokens。
事件专题

推荐理由:Alibaba Qwen 发布的 Qwen3.8-Flash-Next 在 Code Arena WebDev 获得优异成绩,性能提升显著,成本效率高,是 Qwen4 架构的早期预览,值得一看。
8月26日
23:10
23:10官方账号Decoder@Matthias Bastian
精选73°
阿里巴巴Qwen团队发布Qwen3.8-Flash-Next,混合专家模型,每token激活125亿参数中的6个。训练成本降低至九分之一,在编码和办公基准测试中击败DeepSeek-V4-Flash和Claude Opus 4.6,对OpenAI和Anthropic构成更多价格压力。
事件专题

推荐理由:想了解阿里巴巴如何以更低成本打造强大模型?Qwen3.8-Flash-Next值得一试,它比DeepSeek-V4-Flash和Claude Opus 4.6更高效,成本更低。
8月23日
14:43
7月31日
02:20
02:20官方一手@OpenAIDevs@OpenAIDevs
76°
OpenAI宣布API中GPT-5.6模型降价,Luna降价80%,Terra降价20%。同时推出GPT-5.6 Sol的更快选项。降价也适用于Codex和ChatGPT Work的用量计算,使开发者以更低成本获得更多智能。此次调整旨在提升成本效率,让每美元产出更多结果。
事件专题

推荐理由:OpenAI把GPT-5.6 API价格打下来了,Luna降八成,Terra降两成,还给了更快选项Sol,开发成本更低了。
7月10日
10:53
10:53官方一手Pandaily@contact@pandaily.com (Pandaily)
精选
DeepSeek、智谱AI和Qwen的成本高效模型在OpenRouter平台上周令牌份额超过20%,数据基于2025年7月的统计。这一增长显示开发者正从高价模型转向性价比更高的选项。结构性的市场转变表明成本正在成为AI基础设施选择的关键因素。

推荐理由:开发者的钱袋更聪明了:DeepSeek、智谱、Qwen靠低价拿下OpenRouter五分之一流量,值得关注。
7月9日
05:57
05:57Thomas Wolf@Thom_Wolf
精选
Matei Zaharia指出,在LLM推理中,使用简单的Pi harness(来自@badlogicgames)在Opus和GPT 5.5上达到了与LLM供应商提供的harness相同的成功率,但成本降低了一半。这种成本优势主要归因于更小的输入规模。该发现揭示了harness设计对性价比的巨大影响。
推荐理由:你知道吗?换个简单的工具就能把成本砍半,效果还不打折!Pi harness让Opus和GPT 5.5的推理省钱又高效,值得一试。
6月16日
16:17
16:17官方一手pandaily@contact@pandaily.com (Pandaily)
中国国产大模型通过多模型动态路由(Fusion)技术,在推理时动态选择最佳模型以平衡性能与成本。混合智能体架构将多个模型组合成系统,进一步降低部署开销。这种策略优先考虑实际应用的成本效率,而非单纯追求原始基准分数。

推荐理由:中国大模型厂商正在用多模型路由和混合智能体降低AI应用成本,比单纯堆参数更实用。
6月6日
09:43
09:43官方一手Pandaily@contact@pandaily.com (Pandaily)
精选
StepFun 最新模型 Step 3.7 Flash 在 Artificial Analysis 基准测试中夺得速度、成本效率和端到端性能三项第一。该模型在 OpenRouter 和 Hugging Face 上获得大量关注,展现出强大的竞争力。这一成绩表明 StepFun 在推理优化和成本控制方面取得了显著突破,为开发者提供了高性价比的 AI 模型选择。

推荐理由:做 AI 应用选型或部署推理服务的团队,Step 3.7 Flash 在速度和成本上的优势值得直接对比测试,可能帮你省下不少预算。
5月31日
22:54
22:54Viking@vikingmute
DeepSWE 对 Opus 4.8 的评分显示,该模型在性能上优于 Opus 4.7,且成本更低、效率更高,但相比 GPT5.5 仍有明显差距。作者表示尚未深度使用 4.8,仍在使用更便宜的 4.6 版本,并指出对基准测试已逐渐祛魅,更看重推特上的真实用户评价。目前普遍认为 GPT5.5 仍是大多数用户的最强模型。
事件专题

推荐理由:如果你在纠结是否升级到 Opus 4.8,这篇推文帮你省了试错成本——作者用真实体验告诉你,4.8 性价比提升但远不及 GPT5.5,做模型选型的开发者建议看看推文下的真实讨论。
5月23日
5月19日
00:53
00:53TestingCatalog@testingcatalog
78°
Cursor 发布了 Composer 2.5,该版本在性能上与 Opus 4.7 相当,但成本效率提升了最多 10 倍。新版本更智能,能更好地处理长时间运行的任务,并更可靠地遵循复杂指令。未来一周内,Composer 2.5 的使用限制将翻倍。这对使用 AI 编程助手的开发者来说是一个重大升级。
事件专题

推荐理由:Cursor 用户终于等来了性能与成本兼顾的升级——Composer 2.5 在复杂任务上更可靠,且成本大幅降低,做 AI 编程的团队建议立即试用。