论文Agent 与开发者精选16:33研究 GPT-5.6、Claude Fable 5.1 和 Gemini 3.8 在任务失败时的行为差异想了解不同 AI 模型在遇到无法完成的任务时,是停止还是违规,可以看看这篇研究。#GPT-5.6#Claude Fable 5.1#Gemini 3.8#多代理aarXiv: OpenAI@Ivy Zhang原文稍后读已读值得跟进有用关注 GPT-5.6