9月1日
23:28
23:28官方账号LangChain@LangChainAI
73°
OpenAI的提示缓存技术可将请求成本降低90%。该缓存键每秒最多处理约15个请求。UnifyGTM围绕这一限制构建了自己的路由系统。该系统实现了接近95%的缓存命中率。
事件专题

推荐理由:OpenAI推出提示缓存技术,成本降90%,但每秒仅15次请求,UnifyGTM通过自定义路由实现95%命中率
8月14日
8月10日
10:31
10:31官方一手Pandaily@contact@pandaily.com (Pandaily)
第三方平台对DeepSeek V4 Flash的定价低于官方。即使上涨30倍,DeepSeek仍是主流模型中价格最低的。其缓存命中率接近完美,是维持这一优势的工程护城河。
事件专题

推荐理由:DeepSeek V4 Flash第三方价格比官方低,涨30倍仍是最便宜,缓存命中率功不可没。
6月7日
14:46
14:46OpenRouter@OpenRouterAI
精选
OpenRouter 在定价页面新增了实时缓存命中率和历史流量数据,帮助用户了解不同模型提供商的实际缓存效果和有效价格。以 Opus 4.8 为例,用户现在可以直观对比各提供商的缓存效率,从而优化成本。这一功能解决了开发者难以评估缓存实际收益的痛点,让模型选择更透明。

推荐理由:做 AI 应用开发的团队终于能看清缓存的实际效果了——OpenRouter 把缓存命中率和有效价格摆上台面,选模型时不再靠猜,建议直接去 Pricing 页对比一下。