9月1日
23:28
23:28官方账号LangChain@LangChainAI
73°
OpenAI的提示缓存技术可将请求成本降低90%。该缓存键每秒最多处理约15个请求。UnifyGTM围绕这一限制构建了自己的路由系统。该系统实现了接近95%的缓存命中率。
事件专题

推荐理由:OpenAI推出提示缓存技术,成本降90%,但每秒仅15次请求,UnifyGTM通过自定义路由实现95%命中率
7月31日
00:09
00:09官方一手AWS Machine Learning Blog@Melanie Li
75°
OpenAI GPT-5.6 的 Sol、Terra 和 Luna 三个模型已在 Amazon Bedrock 上正式可用。新推出的显式提示缓存功能允许用户精确指定缓存哪些部分。缓存复用可降低推理成本。AWS 提供了上手指南和迁移现有 GPT 工作负载的步骤。
事件专题

推荐理由:亚马逊Bedrock现在支持GPT-5.6,还能自己控制缓存哪些提示,省成本又灵活。
7月28日
06:38