论文Agent 与开发者09:27CompKV:补偿感知的稀疏注意力框架,长上下文推理最高提速 6.85 倍一篇新论文 CompKV,重新设计了稀疏注意力里的 token 选择逻辑,长上下文推理自注意力最高快 6.85 倍,做推理优化的可以看看。#CompKV#稀疏注意力#KV cache#长上下文aarXiv cs.AI@Zhen Huang 等 11 人原文稍后读已读值得跟进有用关注 CompKV