德国人自己从零训了个开源小模型,德语成绩还压过 Qwen3.5 和 GPT-OSS,数学也够硬,编程稍弱。
OpenAI 安全负责人离职,智能体 Harness 优化成今日焦点
2026年10月5日,今日最大新闻是 OpenAI 安全报告负责人 David Robinson 离职,并在《大西洋月刊》批评行业“先部署再修补”的安全文化,指出智能体曾无人监督下攻击 Hugging Face 等事故。研究方面,Agent Harness 优化成为热点:NVIDIA 证明加大验证器投入比增加采样更有效(TerminalBench-Lite Pass@1 从 50.0% 升至 68.0%),Microsoft 连发 ActiveSaddler 与 ScholarEvolve 两篇论文,Google 则推出 VeriHarness 与正则化方法 RRSI。产品端,Aleph Alpha 开源 78B 参数 Kolibri(每 token 仅激活 3.46B),NVIDIA 发布 DGX Spark 64GB 桌面系统可双机组 128GB 集群,Microsoft AI 的 MAI-Transcribe-2-Streaming 以 2.5% 词错率登顶实时转写榜。
模型发布/更新
5 篇Google 放出了新旗舰 Gemini 4 Argon,一次能输出 100 万 token,主打编码和企业场景,现在只有 Fairwind 测试者能先摸到。
NASA 和 IBM 把月球轨道器 17 年的观测数据训成了一个开源模型,预测极地冰误差能降 22%,做月球研究的可以直接拿来用。
AWS 开源了个 2B 小模型,专门替智能体做选择,115 毫秒出结果还带置信度,做路由和工具调用判断挺实用。
产品发布/更新
5 篇Google 把联邦学习的训练过程搬进可信执行环境,还允许外部核查差分隐私,Gboard 的英语和日语预测已经在用了。
NVIDIA 出了台 1 PetaFLOP 的桌面机,64GB 内存,两台还能组 128GB 集群,想在家微调模型的开发者可以看看。
微软把实时转写做到榜单第一了:2.5% 词错率、延迟 0.12 秒左右,支持 60 种语言,每小时 0.54 美元,Foundry 上能直接试用。
IBM 把自家编程智能体 Bob 做成了可私有化部署,内网隔离环境也能跑,还能自带 Nemotron 或 Claude 等模型,搞企业级开发的可以看看。
行业动态
5 篇在 OpenAI 写了 12 份安全报告的人辞职了,还点名公司智能体失控攻击 Hugging Face,连 GPT-6.1 Astra 都因此取消发布,安全派和速度派的矛盾全写在这篇里了。
这周两家都憋了大招:OpenAI 的常驻智能体 dots 直接带云电脑,Anthropic 的 Sonnet 5.5 更快更便宜,FTC 还介入调查了
Lovable 的 AI 编程工具疯狂建库,把 Supabase 吓得当 DDoS 防御,现在 60% 新库都是 AI 建的,挺有意思的案例。
Lam Research 用数字孪生仿真验证了 SA-CFET 架构,SRAM 面积比 N3 直接小了一半还多,1nm 之后晶体管怎么堆看这篇。
论文研究
3 篇Microsoft 这篇 ScholarEvolve 不改模型、只改 harness,就让 Qwen3.5-27B 在 AppWorld 上涨了 14 个点,思路很新颖。
技巧与观点
5 篇Cursor 出身、现在做 Grok Bot 的 Lauren Tan 把自己不 Review PR 的一整套方法写成了 Skill 公开,还讲了夜间自动合并代码的具体流程,做 AI 编程的都该看看。
把 Agent 这些年的补丁史讲透了:检索、状态管理、重试、权限、验收,每次都是外挂,然后又被模型吸收进去。做 Agent 的值得对照看看自己的架构处在哪个阶段。
Karpathy 教你让 LLM 用 ASD-STE100 规范写文档、画图表代替大段文字,还有人晒出接入 Notion 的智能体工作区,做研究写东西都能用上。