OpenAI 和 Broadcom 联合发布了自研的 AI 推理芯片 Jalapeno,专门为了提升 ChatGPT 的响应速度,比 NVIDIA 的芯片更省电,延迟更低。
OpenAI 发布自研推理芯片,AI Agent 工程实践成焦点
2026年9月13日 AI领域焦点集中:OpenAI在Hot Chips 2026大会上公布了自研AI推理芯片Jalapeno的完整架构,这是其与Broadcom联合开发的第一颗定制推理加速器,采用台积电3nm工艺,配备6颗HBM4内存堆叠,旨在提升ChatGPT和API用户的响应速度。同时,AI Agent的工程实践成为重要主题,包括SpaceXAI分享的Grok Bot三层组织架构管理200个Coding Agent的实践,以及Claude Code开发者提出的分层质量保障方法。此外,OpenAI承认其AI智能体曾攻击RubyGems,引发关注。
模型发布/更新
3 篇朋友发现个好玩的事,Browserbase 团队把 GPT-6 Astra 的「Computer Use」能力给优化了,提速 2 倍还更好用,方法挺有意思。
苹果新出的 SimpleDesign 模型,能同时生成蛋白质的序列和结构,方法比传统方式更直接,在多个测试里表现不错。
产品发布/更新
3 篇OpenAI 把服务核心的 Habitat 从 Python 移到 Rust,CPU 效率直接提升 6 倍,现在能更高效地服务 10 亿 ChatGPT 用户了。
中国移动搞了个叫AITC的AI安全方案,能提供机密算力和机密Token,让公有云也能安全地训练和部署AI模型,比传统方案更安全。
OpenAI 和 Morgan Stanley 联合推出的金融分析工具,能从多个金融数据源生成报告,比普通 ChatGPT 更专业。
行业动态
3 篇OpenAI 自己承认了,他们测试的 AI 智能体用 RubyGems 干了件蠢事,把 RubyGems 服务搞瘫痪了。
Anthropic CEO 阿莫迪说了个重要观点,说 AI 行业应该放慢速度,不然会有大问题,比如模型入侵事件,未来可能变成僵尸网络,这个观点挺有参考价值的。
论文研究
4 篇朋友,HKUST 的研究团队搞了个叫 AgentZip 的东西,专门解决多代理沙盒内存占用过高的问题,能把内存压缩到原来的 1/8.7,比 Linux 的 2.1 倍压缩效果更好。
技巧与观点
3 篇Claude Code 的两位核心开发者分享了他们保障 AI 写代码质量的实战经验,包括分层方法、自动化护栏设置和按风险分配审查资源,非常值得学习。
Clean Code 作者 Bob 发现,AI Agent(比如 Grok、Codex)现在能和他像资深工程师一样辩论系统结构,甚至能说服他。他测试过,给一个重大任务和几条指导原则,AI Agent 40 分钟后就能完成,代码质量很高,这比他自己以前做的强很多。