Anthropic 让 Claude 自己写代码控制机器狗,速度比人快20倍,虽然最后没抓到球,但过程特别有意思
#Claude
870 条 · 查看话题观测
6月19日
Claude Opus 4.7 在 Project Fetch 中编程机器人狗,速度比人类团队快20倍
6月18日
6月17日
产品11:36
微软上线Copilot Cowork智能体AI,成本比竞品低30-40%微软出了Copilot Cowork,企业级AI助手能自动搞定多步任务,成本还比Claude便宜三到四成。
IT之家原文
LlamaIndex 通过优化文档解析让 Claude 成本降低 37%
LlamaIndex 手把手教你用 traces 优化 Claude 的 PDF 解析,成本直降 37%,答案还更准了,值得一试。
6月16日
行业22:25
Sensor Tower:ChatGPT 全球市场份额首次跌破 50%,但仍是最受欢迎 AI 助手Sensor Tower 新数据:ChatGPT 份额跌到 46%,Gemini 涨到 27%,Claude 也冲到 10%。想看看各家 AI 助手谁在真正涨,这篇有硬数字。
IT之家原文
白宫报告发现Claude(Fable)越狱测试:拒绝审查但同意修复代码
白宫测了Anthropic的Claude(代号Fable),发现它不帮你找漏洞但愿意直接修代码。安全专家说这反而是正常防御,挺反直觉的。
论文11:39
Snyk VulnBench JS 1.0:LLM能否两次发现相同漏洞?这篇论文测试了LLM重复找漏洞的稳定性,发现Claude匹配结果很稳,但自己新发现的漏洞随机性高。建议和安全工具搭配用,别靠它单干。
人类注视与视觉语言模型注意力在安全场景中的比较研究
想知道AI能不能像人一样在危险场景下抓住关键区域?这篇论文用GPT-4o、Gemini Pro等模型做了对比,发现它们不靠眼动训练数据就能大致预测人类注视点。
Claude 订阅新增专用额度,Agent SDK 和 Claude-p 用量不计入原配额
Claude 订阅户注意了,现在跑 Agent 任务有单独额度,Pro 每月多 $20,Max 用户 $100,不抢日常对话池子,赶紧去领。
6月15日
Anthropic Claude Builder Day活动举行,Fable模型撤回引发失望
来看看Anthropic的Claude Builder Day黑客马拉松,Fable模型刚发布就被撤了,开发者们挺失落的,但不妨碍其他创意项目。
技巧17:54
Arena设计测评Claude领先,Qwen 3.7 Max惊艳,分享AI出图工作流设计测评里Claude最强,不用它可以试试Qwen 3.7 Max。还有一套用design.md先出图再生成页面的工作流,挺实用。
多维度免费代理检测工具,支持OpenAI/Grok/Gemini/Claude专项检查
这个工具能一键检测免费代理能不能用,还专门测能不能连上OpenAI、Claude这些AI服务,省去手动试错的麻烦。
6月14日
6月13日