主要来源Simon Willison’s Weblog
查看原文事件专题 ·多源确认
Qwen3.8 27B 开启推理后在 DGX Spark 上算对 169 位数加法实验
Simon Willison 复现了 Colin Frasier 两年前在 GPT-4o 上做过的大数加法实验,要求模型以文字形式返回答案。他用本地 DGX Spark 硬件跑 Qwen3.8-27B-Q4_K_M.gguf,每组 30 次、关闭推理时错误率明显更高。开启推理后仅测 169 次,Qwen3.8-27B 答对 167 次,推理轨迹显示模型逐位对齐并从右往左进位计算。
当前结论
有人在 DGX Spark 上重跑了 GPT-4o 的文字加法实验,Qwen3.8 27B 开推理后 169 次只错 2 次,还能看到逐位进位的思考过程。
3 个信源53° AI 热度最后更新 2026/10/4 23:34:00
证据链
3 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。