235b·general

235b

别名
首次出现
2026-06-04
最近出现
2026-09-02
累计提及
17
§ 01综述
  • 235B 是什么? 235B 是指在人工智能领域中,模型参数量达到 235 亿级别的模型,这类模型通常具有较强的学习和处理复杂任务的能力。
  • 235B 近期进展
  • - TEMPO:跨内存/计算受限场景的专家并行负载均衡:该研究提出了一种名为 TEMPO 的方法,旨在优化跨内存和计算受限场景的并行负载均衡。 - UrbanAgent:跨系统城市任务的工具增强智能体框架:UrbanAgent 是一个用于跨系统城市任务的智能体框架,旨在提高城市任务处理的效率。 - MemSFT:用外部参数化内存缓解对齐惩罚:MemSFT 利用外部参数化内存来减少对齐惩罚,从而提高模型的性能。 - EcoSpec:成本感知的MoE模型投机解码加速方法:EcoSpec 提出了一种成本感知的投机解码加速方法,以优化 MoE 模型的推理速度。 - Hugging Face Transformers模型可在vLLM中以原生速度推理:Hugging Face 的 Transformers 模型在 vLLM 中实现了以原生速度推理,提高了模型的效率。 - 自动CAD生成基础模型:LLMForge框架与97问题基准评估:LLMForge 框架用于自动生成CAD基础模型,并进行了97问题基准评估。 - 桥水基金研究:前沿AI模型金融判断准确率不足80%,微调开源模型达84.7%:桥水基金的研究显示,前沿AI模型在金融判断准确率不足80%,但通过微调开源模型可以达到84.7%。 - Evil Spectra: 优化器如何放大或抑制突现错位:Evil Spectra 研究了优化器如何放大或抑制突现错位,以提高模型的鲁棒性。 - 极摩客 EVO-X3 迷你主机发布:锐龙 AI Max+ 395,首发 21699 元起:极摩客发布 EVO-X3 迷你主机,搭载锐龙 AI Max+ 395 处理器,首发价格为 21699 元。 - 极摩客 EVO-X3 4T 机皇版曝光,搭载锐龙 AI Max+395 和 126TOPS NPU:极摩客 EVO-X3 4T 机皇版曝光,搭载锐龙 AI Max+395 和 126TOPS NPU,具有强大的性能。
  • 当前焦点与观察点:235B 级别的模型在人工智能领域的研究和应用逐渐增多,如何提高模型的效率和准确率成为了研究的热点。同时,模型的实际应用效果也受到关注,例如在金融领域的判断准确率。
  • § 02相关报道10 条在档
    1. 01
      PersianAnonymizer:评估基于LLM标注的波斯语NER匿名化
      arXiv: DeepSeek
    2. 02
      推理模型隐藏指令选择性披露研究
      arXiv: DeepSeek
    3. 03
      TEMPO:跨内存/计算受限场景的专家并行负载均衡
      arXiv: DeepSeek
    4. 04
      UrbanAgent:跨系统城市任务的工具增强智能体框架
      arXiv: DeepSeek
    5. 05
      MemSFT:用外部参数化内存缓解对齐惩罚
      arXiv cs.LG
    6. 06
      EcoSpec:成本感知的MoE模型投机解码加速方法
      arXiv: DeepSeek
    7. 07
      Hugging Face Transformers模型可在vLLM中以原生速度推理
      Clement Delangue
    8. 08
      自动CAD生成基础模型:LLMForge框架与97问题基准评估
      arXiv: DeepSeek
    9. 09
      桥水基金研究:前沿AI模型金融判断准确率不足80%,微调开源模型达84.7%
      IT之家
    10. 10
      Evil Spectra: 优化器如何放大或抑制突现错位
      arXiv cs.LG
    § 03邻近话题

    本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

    /topic/235b