论文09:48层级贝叶斯分析显示:推理模型规模扩大能力递减,效率几乎不变这项研究拿 DeepSeek-R1-Distill 全系列做实验,结论挺扎心:模型变大只是解题能力强了一点,推理消耗的 token 一点没省,想靠堆规模提效率可能走不通。#DeepSeek-R1-Distill#推理模型#层级贝叶斯#Chain-of-ThoughtaarXiv: DeepSeek@Moritz Laber 等 9 人原文稍后读已读值得跟进有用关注 DeepSeek-R1-Distill