长上下文

general · 首次出现 2026-05-22 · 最近出现 2026-09-03 · 累计提及 326

综述

markdown
长上下文是一种能够处理大量连续文本信息的技术方案,常用于多轮对话、复杂任务等场景,在人工智能领域具有广泛应用价值。当前该领域技术发展迅速,多家企业与研究机构持续投入研发。

长上下文近期进展

9月,科大讯飞开源百万token上下文边缘模型,推动边缘设备长上下文处理能力提升。科大讯飞开源百万token上下文边缘模型 近期,腾讯混元Hy4轻量版开源,优化长上下文场景下的资源占用。腾讯混元 Hy4 preview 轻量版开源 TuringLLM推出20B参数专家混合模型,提升长上下文推理精度。TuringLLM推出20B参数专家混合模型 斯坦福提出Prefix Sliding推理优化方法,改进长上下文下模型效率。斯坦福提出Prefix Sliding推理优化方法

当前焦点与观察点

目前长上下文技术在参数规模、推理效率等方面存在平衡难题,多家企业通过开源模型、优化算法等方式推进落地。从行业趋势看,轻量化与高效推理成为核心方向,同时多模态结合长上下文的探索也在逐步展开。

相关报道

10 条在档