主要来源DeepLearning.AI
查看原文事件专题 ·单一信源
DeepSeek 压缩智能体记忆:缓存每 token 仅 890 字节
DeepLearning.AI 在 The Batch 中解析了 DeepSeek 针对智能体场景的 KV 缓存压缩方案。智能体读取远多于写入,DeepSeek 将每 token 缓存降至 890 字节,比 DeepSeek-V1 小 437 倍。输入从 4K 扩展到 1M token 时,每输出 token 的计算量仅增加 25%。Flash 模型在 AA Index 上以 39 分超过 V4-Pro 的 36 分,价格 $0.27 对 $0.67 每百万 token。
当前结论
DeepSeek 把智能体的 KV 缓存砍到每 token 890 字节,比 V1 小 437 倍,Flash 还在 AA Index 上反超 V4-Pro,价格只要一半不到。
2 个信源52° AI 热度最后更新 2026/10/7 23:59:59
证据链
2 个信源相关来源 1kimmonismus
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。