18:38官方一手arXiv: DeepSeek@Francisco León Zúñiga Bolívar一项研究比较了DeepSeek V4 Pro、Qwen3-Max、Kimi K2.5和GLM-5.1四个中国前沿模型在进化囚徒困境中的合作倾向。通过固定代码转换器为GPT-5.4 Mini,排除了编码能力干扰,发现各模型攻击性均衡比例从Qwen3-Max的1%到DeepSeek V4 Pro的9%不等。四个实验室间的差异(8个百分点)大于中国与西方生态系统的均值差异(5.0%对5.0%)。研究支持H6假设,即中国模型并非单一整体,实验室层面而非生态系统层面决定合作倾向。论文DeepSeek V4 ProQwen3-MaxKimi K2.54 个信源在谈事件专题推荐理由:想知道中国大模型是不是都一个样?这篇论文用囚徒困境测了DeepSeek、Qwen、Kimi和GLM,发现它们合作倾向差别挺大,别再把它们当铁板一块了。原文稍后读已读值得跟进有用关注 DeepSeek V4 Pro
11:49小互@imxiaohu精选布拉格经济大学Tomáš Bruckner发现,AI模型无法生成真正随机数,每个模型有固定偏好的数字。GPT-4o偏爱42、37、57,Claude Sonnet 5几乎只说47,Qwen3-Max在30次采样中每次都答42。利用这一特征可以作为模型指纹,在OpenRouter等聚合商处验证实际调用的模型。该方法将常见缺陷转化为识别手段。技巧OpenRouterGPT-4oClaude Sonnet 5推荐理由:聚合商可能偷偷换模型,你输入一个随机数,看它回答哪个数字就能认出是谁,实测GPT-4o、Claude、Qwen各有偏好。原文稍后读已读值得跟进有用关注 OpenRouter