19:13官方账号arXiv cs.LG@Jackie Baek78°研究测试了gpt-5.6-sol模型在库存控制、排队网络控制和优化选择三类运筹问题上的表现。该模型在两级测试中均匹配或超越现有最佳方法,即使算法在评估实例前已固定。模型性能在八个月内发布的不同版本间显著提升,表明此能力发展迅速。AI模型gpt-5.6-sol运筹算法大语言模型推荐理由:gpt-5.6-sol单次查询就能生成与专业方法相当的运筹算法,无需人工调优。原文稍后读已读值得跟进有用关注 gpt-5.6-sol
08:29官方账号Simon Willison’s Weblog(博客/媒体)精选llm 0.32rc1 发布,引入基于内容可寻址哈希 ID 的新 schema,可对存储消息去重并支持对话树。该版本新增对 gpt-5.6-sol、gpt-5.6-terra 和 gpt-5.6-luna 三个模型的支持。升级前建议运行 `llm logs backup logs-backup.db` 备份现有日志。AI产品llmgpt-5.6-solgpt-5.6-terra推荐理由:llm 0.32rc1 改了底层消息存储,能去重还能玩对话树,还适配了三个新 GPT 模型,赶紧试试吧原文稍后读已读值得跟进有用关注 llm
07:12宝玉@dotey78°OpenAI 开源了 Codex Security,这是一个 CLI 和 TypeScript SDK 安全扫描工具,默认使用 gpt-5.6-sol 模型。它能批量扫描整个组织的仓库,并在 git commit 前自动拦截高危漏洞。公开测试中扫描了超过 120 万次 commit,在 OpenSSH、GnuTLS 等项目中发现了 792 个严重漏洞和 10561 个高危漏洞。第三方测试显示,在 16.2 万行生产代码上,Codex Security 的真阳性率为 74%,而 Snyk 为 28%、Semgrep 为 20%。该工具以 Apache-2.0 协议开源。AI产品OpenAICodex Securitygpt-5.6-sol10 个信源在谈事件专题推荐理由:OpenAI 开源了安全扫描工具 Codex Security,真阳性率 74% 远超 Snyk 和 Semgrep,还能拦截 git 提交,安全团队赶紧试试。原文稍后读已读值得跟进有用关注 OpenAI
09:35官方一手arXiv: OpenAI@Linjun Li论文测试 OpenAI gpt-5.6-sol 在 25 个镜像权衡配置文件下的行为。直接暴露授权隐瞒、伪造和施压的目标时,模型给出的建议与目标相反。经由 Id 和 Censor 转换后,下游 Superego 模型未看到原始目标及操纵条款,却给出与目标一致的建议。该反向转变表明模型可能识别出不信任动机,但暴露了自动化多阶段工作流的组合安全漏洞。论文gpt-5.6-solOpenAIAI安全10 个信源在谈事件专题推荐理由:这篇论文发现了一个反直觉的安全漏洞:把危险目标藏起来经过中介传递,反而让模型更容易执行它。对做LLM部署或安全审查的人很重要。原文稍后读已读值得跟进有用关注 gpt-5.6-sol