Shopify用0.8B小模型微调后打败了GPT 5.6-sol xhigh,小模型专用训练有奇效。
edwin 从 OpenAI 到 Cursor 再到 Anthropic,这位资深人士的职业轨迹值得关注。
Anthropic发布Fable 5.1和Mythos 5.1,前者编程能力大幅提升且成本降低25%,后者专注网络安全和生命科学领域。
Google给Gemini加了个新功能,看视频更聪明还省钱,能自己决定看哪里,长视频分析成本大降。
World Labs 推出的 Atlas 模型能同时生成、重建和仿真世界,用几何输入而非文本控制相机,在3D重建上超越专用SOTA模型。
Anthropic发布了Claude Fable 5.1,专为复杂知识工作优化,比前代更简洁
DeepLearningAI 推出软件工程基础指南,教你如何让 AI 编程助手写出可靠安全的代码。
Cognition的Devin Fusion用前沿模型做规划,经济模型做执行,Fable 5.1让效果更好,省钱又智能。
Omar分享Harness工程入门技巧,教你从零构建最小化系统,比读教程更有效。
Perplexity 推出本地 PII 检测,数据不传云端,隐私保护更进一步。
Mac用户可以利用Apple Silicon降低AI使用成本并保护隐私,混合计算模式是未来趋势。
Claude在两项重要基准测试中大幅领先Fable 5,科学任务得分翻倍,综合能力提升13.8%。
Claude发布了Fable 5.1,缓存读取成本大降75%,实际使用成本最高省45%。
Anthropic 推出了企业级隐私保护系统 EFS,零数据保留还能防对抗攻击,秋季开始上线。
Meta新模型帮AI研究代理智能选择实验,比传统方法快30%,省1/3算力
前Apple设计师Anshul分享8个AI设计技巧,教你如何发挥AI 99%的创意潜力。
Claude Fable 5.1 上线,专注深度推理任务,能独立完成复杂工作流,比前版本更强大。
看Perplexity Computer如何在DGX Spark上本地运行,展示文件分析和工具连接功能。
Ilya Sutskever提醒:AI智能体将自主创建GPU节点训练自己,Neoclouds需加强网络安全防护。
Anthropic给企业级AI加了个安全监控层,让代理访问内部系统时能发现风险模式。
一篇仅用4个月完成的研究,6年后获得28万次引用,改变了AI发展轨迹。
Remi Fabre用鸭子动画解释强化学习,直观展示Microduck学习过程
openJiuwen框架让代理能力在运行时动态调整,性能超越现有方案,开发者可自由组装代理组件。
Perplexity Computer接入了Coinbase,现在可以直接用AI帮你交易、分析市场,不用写代码点一下就行。
OpenRouter在招社区负责人,管6万+成员的AI社区,需要活动组织者和社区沟通桥梁。
Replit MCP 让你能远程操控最强智能体,无需本地安装就能创建和管理应用。
Replit展示MCP实际应用案例,用户通过聊天直接管理多应用业务,比传统方式更高效。
Replit 推出 MCP 集成,现在能在 ChatGPT、Claude 和 Slack 里直接用 Replit 了。
Anthropic 推出了 Claude Fable 5.1,Premium 和 Plus 用户现在就能用上最新版本。
Qwen团队测试了18个模型在365天电商运营中的表现,GPT-5.6 Sol盈利最多但效率不高,Qwen3.8-Max-Preview在开源模型中领先。
Vercel 上线了 Fable 5.1,一个多模型平台,fx.sh 即可体验
发现ChatGPT桌面应用里藏了个完整的LibreOffice,藏在缓存文件夹里。
Martin Fowler分享了Fragments新功能,包括陈词滥调检测和智能体架构,关注AI安全和学术诚信问题。
Perplexity 上线了 Claude Fable 5.1,性能提升成本降低,Pro 和 Max 用户可用。
Arena开放5万美元资助,AI评估研究学者可申请
斯坦福、MIT等七校研究团队入选2026春季AI评估项目,聚焦LLM评估方法和智能体评估框架。
LangChain在波士顿办智能体开发路演,有Deep Agents和LangSmith Engine的实操工作坊
LangChain 在三城举办智能体开发线下活动,有实战工作坊和最佳实践分享
Anthropic 发布 Fable 5.1,擅长处理复杂长期任务,为科学进步提供新视角。
Anthropic刚发了Fable 5.1,专门处理复杂任务,比之前的版本更强了。
仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。