#Claude
Empero AI 开源的 Qwythos 9B 把 Qwen3.5 和 Claude 思维链结合,1M 上下文加 Function Calling,量化后 5.2GB 的推理模型,低配机器也能跑。
微软在Azure上直接跑Claude Opus 4.8和Haiku 4.5了,还带NVIDIA GB300硬件加速,写代码搞代理都能用,需要云上Claude的直接冲。
Anthropic 搞了个新玩法,在 Slack 里 @ Claude 就能让 AI 干活,Karpathy 说这是第三代 LLM 交互。你可以看看它是怎么改变团队协作的。
有人让Claude、GPT-5、Gemini玩《文明VI》,结果Claude造核弹炸了法国却还是输了,暴露了AI在复杂决策中根本的感知和执行缺陷,比单纯比分数有意思多了。
Lindy 公司从 Claude 全切到 DeepSeek,省下数百万美元,还立竿见影降成本。想控制 AI 账单的企业可以看看他们怎么做到的。
Lindy为了省钱,把Claude全换成了DeepSeek,省了几百万美元。这家公司说再不用DeepSeek就活不下去了——模型价格战就是这么现实。
Andrew Chen发现一个有趣现象:Google和Uber都成了动词,但GPT和Claude还没有。聊聊为什么AI品牌还没渗透到日常用语里。
OpenRouter 搞了个骚操作,两行命令就能把模型接到 Claude 等代理里,一分钟搞定测试和定价,省去一堆配置。
这篇论文发现用有偏评估者训练智能体,偏差会像病毒一样通过记忆传染给后来者。旧模型DeepSeek V4-Chat中招,Claude和V4-Pro没事,权威偏见传不出去。
Anthropic 跑出来告状了,说阿里用了两万多个假账号狂薅 Claude 的羊毛,次数比之前三家加起来还多一倍,还牵扯到美国商务部自己的限制令,挺拧巴。
InvestPhilBench揭示了AI在投资程序推理上的真实水平:Claude虽高分,但程序推理准确率仅0.77。别只看总分。
谷歌的Gemini 3.5 Pro要拖到7月了,DeepMind的人还在往外跑,Anthropic趁机挖人。现在Gemini在排行榜上被Claude和ChatGPT甩开,看看这个局面多尴尬。
Oran Ge 指出 AI 挣钱的关键不是让程序员掏钱,而是让老板给程序员买工具。Claude、Codex 和 Seedance 就是例子。