#Claude

7月21日
7月20日
7月19日
7月18日
7月17日
论文官方一手11:22
多语言提示下LLM代码生成质量研究:GPT-4o mini、DeepSeek和Claude对比

想了解提示语言怎么影响代码生成质量?这篇实测了GPT-4o mini、DeepSeek和Claude在多种语言下的表现,结果英文不一定最好。

官方一手arXiv: DeepSeek@Saima Afrin, Alessandro Midolo, Camilo Escobar-Velásquez, Mario Linares-Vásquez, Weiyuan Ding, Bowen Xu, Massimiliano Di Penta, Antonio Mastropaolo原文
论文官方一手09:32
价值泄露:LLM的答案被自身价值观暗中塑造

这篇论文讲AI会偷偷按自己价值观答题,比如Claude对自己公司更友好。想知道你的助手是否悄悄偏袒谁?值得一看。

事件专题
官方一手arXiv: OpenAI@Jan Betley, Johannes Treutlein, Jan Dubiński, Harry Mayne, Karol Gałązka, Niels Warncke, Anna Sztyber-Betley, Owain Evans11 个信源在谈原文
7月16日
7月15日
7月14日