AITOPAI热报
今日精选全部动态早读东盟 AIAgent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOPAI热报

Qwen3-Max

共 2 条相关 AI 资讯
8月12日
18:38
18:38官方一手arXiv: DeepSeek@Francisco León Zúñiga Bolívar
一项研究比较了DeepSeek V4 Pro、Qwen3-Max、Kimi K2.5和GLM-5.1四个中国前沿模型在进化囚徒困境中的合作倾向。通过固定代码转换器为GPT-5.4 Mini,排除了编码能力干扰,发现各模型攻击性均衡比例从Qwen3-Max的1%到DeepSeek V4 Pro的9%不等。四个实验室间的差异(8个百分点)大于中国与西方生态系统的均值差异(5.0%对5.0%)。研究支持H6假设,即中国模型并非单一整体,实验室层面而非生态系统层面决定合作倾向。
论文DeepSeek V4 ProQwen3-MaxKimi K2.5
事件专题

推荐理由:想知道中国大模型是不是都一个样?这篇论文用囚徒困境测了DeepSeek、Qwen、Kimi和GLM,发现它们合作倾向差别挺大,别再把它们当铁板一块了。
原文
7月20日
11:49
11:49小互@imxiaohu
精选
布拉格经济大学Tomáš Bruckner发现,AI模型无法生成真正随机数,每个模型有固定偏好的数字。GPT-4o偏爱42、37、57,Claude Sonnet 5几乎只说47,Qwen3-Max在30次采样中每次都答42。利用这一特征可以作为模型指纹,在OpenRouter等聚合商处验证实际调用的模型。该方法将常见缺陷转化为识别手段。
技巧OpenRouterGPT-4oClaude Sonnet 5

推荐理由:聚合商可能偷偷换模型,你输入一个随机数,看它回答哪个数字就能认出是谁,实测GPT-4o、Claude、Qwen各有偏好。
原文
精选动态早读东盟登录