#Claude
这篇论文测试了ChatGPT、Claude、DeepSeek写科研计划的能力,发现人类评委分不出好坏,但AI评委偏爱AI写的。值得一读。
Anthropic让Claude破解加密算法,它找到了两个人类专家都没发现的漏洞,其中一个破解难度降到六千万分之一,比人工方案快200-800倍。
tldraw离线版直接集成Claude/Codex,喊一声就帮你画图,还支持脚本画勾股定理讲解,好用!
Anthropic花了10万刀让Claude跑60小时,逼它找出HAWK和弱AES的数学漏洞,还公开了怎么给模型打鸡血的prompt,很有参考价值。
有个用户觉得Claude没以前好用了,现在更喜欢Grok和Kimi,还发现Anthropic和OpenAI都在押注RL而不是RLHF,挺有意思的观察。
这篇论文用70道政治题+12种人格提示,测了GPT-5、Claude、Grok等7个模型,发现提示词比模型本身更能左右回答方向。想了解AI怎么被‘带节奏’的可以看看。
想知道怎么选ChatGPT和Claude的代理模式?这篇拆解了Work、Cowork、Codex、Code的用法和区别,帮你少踩命名坑。
Anthropic开源了一套金融分析智能体方案,这篇教程手把手教你用Claude和Python搭建,还能自动解析技能文件,适合搞量化分析的人试试。
Claude 自己一周末就调通了 AMD 新显卡,人类工程师全程没写代码。AMD 还给 AI 出了专用工具,以后换芯片可能跟装 App 一样简单。
三星为了省钱,给员工用 AI 设了 Token 配额,超了还得证明自己效率高才给提。韩国企业这波 AI 落地很真实,可以围观一下。
看开发者怎么用 Fable 5 和 Claude,几句提示就复刻出官网的酷炫书籍动画,Three.js 纯数学建模,好玩又省事。
这篇论文用四个主流模型实测了伪科学评估,发现Grok的Fast版本评分奇高,而且同一个模型API和Web结果差十几倍。看完你就知道模型答案多不可靠,值得所有AI用户看看。
Anthropic产品负责人亲口讲从5人团队到推出Mythos的经历,全是模型开发、评估和安全的内部视角,产品经理和AI从业者别错过。
这篇论文教你如何通过修改网页内容让大模型推荐时把你想要的东西排第一。SIREN用PAIR越狱循环,在Claude模型上成功率80%,挺有意思的。
卡帕西悄悄改了简介,网友炸了锅。这篇把他在Anthropic这68天的事儿都捋了,包括Claude Fable 5翻车、Claude Tag争议、还有没签开放权重公开信,挺有意思的。
Andrew Chen聊了Claude和ChatGPT桌面应用里的编码功能,说大家还是更爱用终端里的CLI,桌面内编码可能不太实用。