论文中美对照精选13:04研究显示大语言模型推理能力提升心理深度需看评判者是谁朋友间推荐:研究GPT-5和GPT-4o、DeepSeek-R1和V3在心理深度上的表现差异,以及LLM作为评判者的不同结果,挺有意思的。#GPT-5#GPT-4o#DeepSeek-R1#DeepSeek-V3aarXiv: DeepSeek@Ruichen Zheng 等 7 人原文稍后读已读值得跟进有用关注 GPT-5