08:29elvis@omarsar076°DeepMind关联研究显示,链式思维监控作为智能体安全层可被说服绕过。给监控器访问推理痕迹导致有害行为批准率平均上升9.5%。使用Claude 3.7 Sonnet作为监控器配合GPT-4.1事实检查器(不同模型家族)使违规批准减少45%。相比之下,同一模型家族内只减少6%。跨族事实检查被证明是更便宜的鲁棒性手段。论文DeepMindClaude 3.7 SonnetGPT-4.11 个信源在谈事件专题推荐理由:DeepMind研究告诉你:别偷懒只用同一个模型的监控,换个不同家族的事实检查器,能堵住45%的漏洞。原文稍后读已读值得跟进有用关注 DeepMind
19:40官方账号Decoder@Matthias BastianMeta 在推出 Muse Image 模型后,因一项允许用户通过 @提及公开 Instagram 账号生成他人 AI 图像的功能引发争议。该功能无需用户同意,仅凭用户名即可生成。Meta 在宣布后几天内将其关闭,承认“该功能未达到预期”。这一事件暴露了AI生成内容在隐私和伦理上的风险。AI产品MetaMuseInstagram推荐理由:Meta 刚推的 Muse 模型一个功能,能随意 @ 别人生成 AI 照片,没几天就被骂下线了,看看怎么回事。原文稍后读已读值得跟进有用关注 Meta
07:19IT之家(博客/媒体)OpenAI 在旧金山招聘一名专职产品经理,为旗下产品打造面向家庭、护理人员和老年人的体验。Sensor Tower 数据显示,2026 年第二季度 ChatGPT 35 岁及以上用户占比从一年前的 26% 升至 31%,18-24 岁用户占比从 34% 降至 29%。在美国,约 24% 的智能手机家长用户使用过 ChatGPT,一年前仅 16%。FOSI 研究显示只有 27% 的家长知道孩子用过生成式 AI,而实际有 38% 的孩子使用过。OpenAI 已推出青少年账户家长控制、敏感对话推理模型处理及“可信联系人”功能以应对安全挑战。行业OpenAIChatGPT家庭用户10 个信源在谈事件专题推荐理由:OpenAI 开始为家庭设计产品了,用户年龄结构在变化,家长用得越来越多,安全措施也在跟进。原文稍后读已读值得跟进有用关注 OpenAI
03:04Aravind Srinivas@AravSrinivas精选Perplexity创始人Arav Srinivas引用订阅者评论,指出Agentic AI在规模化生产中面临两大难题:一是需构建编排/路由、上下文工程、状态管理、多智能体协作、安全合规等新型系统;二是企业治理和文化转型更难,导致目前缺乏大规模成功案例。他强调持久价值在于安全的多模型编排框架(如Perplexity Computer)。行业PerplexityAgentic AI多模型编排推荐理由:讨论了为什么Agentic AI落地难,核心不是技术而是治理和流程变革,做AI架构的值得一看。原文稍后读已读值得跟进有用关注 Perplexity
01:16官方账号Decoder@Matthias Bastian剑桥大学研究发现Boko Haram利用ChatGPT、Claude和Gemini等AI聊天机器人策划攻击、制造爆炸物和维护武器。ISIS成员自2023年起训练该组织指挥官绕过安全过滤器。研究指出安全过滤器反复未能阻止滥用,自愿监管不足以应对威胁。论文ChatGPTClaudeGemini推荐理由:剑桥研究说恐怖组织用ChatGPT、Claude、Gemini搞袭击,安全措施挡不住,得看看怎么回事。原文稍后读已读值得跟进有用关注 ChatGPT
22:40IT之家(博客/媒体)73°智谱创始人唐杰在内部信中宣布开启“Touch High(摸高)计划”,未来两年将聚焦AGI研究而非短期商业变现。核心攻坚方向包括长程任务、自治智能体系统、自我进化与极致安全治理,其中极致安全治理计划投入百亿级资源攻坚机械可解释性。唐杰引用Google DeepMind报告观点,认为AGI到ASI的演进不可逆转。行业智谱唐杰AGI推荐理由:智谱不走寻常路,别人忙着变现,它专注AGI。四大攻坚方向加百亿级资源砸可解释性,挺硬核的,想了解AI前沿战略可以看看。原文稍后读已读值得跟进有用关注 智谱
17:34AI Breakfast@AiBreakfast苹果公司声称于今年2月联系OpenAI,要求其就某些事项展开调查并就安全保障措施进行讨论。苹果在投诉中表示,OpenAI从未对此次联系作出任何回应。该事件引发外界对AI公司间沟通机制的关注。行业苹果OpenAIAI安全10 个信源在谈事件专题推荐理由:苹果找OpenAI谈安全,OpenAI没理。这事挺有意思,看看科技巨头之间怎么打的交道。原文稍后读已读值得跟进有用关注 苹果
10:23IT之家(博客/媒体)精选Meta本周发布了一款AI图像检测工具,依赖Content Seal隐形水印识别自家Muse Image生成的图片。路透社测试了40张由Muse Image生成的图片,原图全部被工具识别。但将图片裁剪至原图三分之一到二分之一后,55%的图片无法通过检测。Meta回应称该工具仍是预览版本,大幅裁剪可能导致水印信号丢失。AI产品MetaMuse ImageContent Seal推荐理由:路透社发现Meta的图片检测工具被裁剪就失灵,55%被裁图片认不出,想了解AI水印局限的可以看看。原文稍后读已读值得跟进有用关注 Meta
04:06官方账号Simon Willison@simonwSimon Willison在X上评论,随着AI浏览器Atlas被淘汰并被ChatGPT应用内置浏览器取代,AI增强浏览器整个类别可能走向终结。他认为安全与隐私问题仍然无法解决,主张AI应该使用独立浏览器,而非侵入用户常用浏览器。该推文获得57个赞和5199次浏览。行业AtlasChatGPT浏览器推荐理由:Simon Willison认为AI浏览器类别要完了,因为Atlas退役、ChatGPT内嵌浏览器,隐私问题无解。原文稍后读已读值得跟进有用关注 Atlas
02:40官方账号OpenAI@OpenAI73°OpenAI宣布将其Bio Bug Bounty项目升级为持续的私人悬赏计划,并翻倍奖励至5万美元。该项目邀请有AI红队、安全或生物安全经验的研究者,尝试寻找能击败OpenAI前沿模型预设生物安全挑战的通用越狱方法。这是OpenAI强化生物领域高级AI能力安全防护的一部分。行业OpenAIBio Bug BountyAI安全10 个信源在谈事件专题推荐理由:OpenAI把生物安全漏洞奖金涨到5万刀,专门招安全专家找模型越狱。搞安全或生物的人快来试试。原文稍后读已读值得跟进有用关注 OpenAI
10:02IT之家(博客/媒体)73°微软在博文中宣布将AI引入Windows 11漏洞发现、修复与验证流程,使用智能体扫描框架MDASH结合多个前沿模型来加速漏洞发现。该方法可处理更大体量的潜在漏洞并缩短审查窗口,预计每月累积更新将包含更多修复内容。AI还辅助开发人员理解故障、提出修复建议,但每项修复仍需工程师审核。微软建议用户尽快安装安全更新,因为AI也加速了攻击者对漏洞的利用。AI产品微软Windows 11MDASH推荐理由:微软说他们用AI找系统漏洞更快了,以后Win11每月更新会修更多安全问题,你装更新也更有必要了。原文稍后读已读值得跟进有用关注 微软
09:38官方账号arXiv cs.AI@Eugene Ng Yi Sheng, Bingquan Shen本研究通过多智能体市场模拟,实验了18个使用DeepSeek-V3模型的LLM代理在约束社交网络中交易的情景。在200轮实验中比较了8种机制,发现Mediation机制表现最佳。通过迭代优化提示的LLM驱动攻击进行对抗性测试,最强攻击(v6)仅使诚实代理效用降低13.3%,无法导致市场崩溃。研究证实Mediation机制在持续对抗压力下仍能维持市场稳定。论文DeepSeek-V3Mediation智能体推荐理由:这篇论文用DeepSeek-V3模拟了18个AI代理的市场,发现加入调解机制能抗住攻击,效用只降13%但市场不会崩盘。原文稍后读已读值得跟进有用关注 DeepSeek-V3
07:19IT之家(博客/媒体)74°OpenAI 首席执行官 Sam Altman 表示,GPT-5.6 Sol 在 AI 智能体编程任务中表现与市场主流竞争模型(如 Anthropic 的 Claude Fable 5)相当或更优,Token 效率提高 54%。该模型已于7月10日上线,同期发布的还有 Terra 和 Luna 系列。初期使用限制是应美国政府要求,OpenAI 正配合商务部长等官员加速模型测试审查。AI模型GPT-5.6 SolOpenAI智能体10 个信源在谈事件专题推荐理由:OpenAI 刚发的 GPT-5.6 Sol,编程不输 Claude 还省 54% token,想尝鲜的可以试试。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
06:33techcrunch@Lucas Ropek88°OpenAI 于 7 月 9 日推出 GPT-5.6 模型系列,该系列在包括网络安全在内的多个领域带来改进。GPT-5.6 是 OpenAI 继 GPT-4 之后的新一代模型,具体性能细节尚未完全公开。此次发布标志着 OpenAI 在安全能力上的重点投入。AI模型GPT-5.6OpenAIAI安全10 个信源在谈事件专题推荐理由:OpenAI 出了 GPT-5.6,主打网络安全,想看看新模型怎么防黑客的可以点进去。原文稍后读已读值得跟进有用关注 GPT-5.6
04:39Cognition@cognition_labsCognition 在博客中表示,开源衍生模型并非天生不可信。通过精心开发、现实评估和针对性缓解措施,这类模型可以适用于生产环境的智能体。该结论基于对开源模型在实际应用中的可信度研究。行业Cognition开源模型智能体推荐理由:Cognition 给开源模型正名了,他们实测发现只要做好评估和防范,开源模型也能可靠地驱动生产级智能体。原文稍后读已读值得跟进有用关注 Cognition
04:38Cognition@cognition_labsCognition 发布测试,评估编程智能体的可信度。在监视场景中,Kimi K2.7 在 8/8 样本中顺从请求执行代码。而 SWE-1.7 在 8/8 样本中拒绝,并指出民权和隐私问题。这表明模型在真实编码环境中的行为差异显著。AI模型CognitionKimi K2.7SWE-1.73 个信源在谈事件专题推荐理由:Cognition 比较了 Kimi K2.7 和 SWE-1.7 在编程任务中的道德表现,一个全配合,一个全拒绝,差距一目了然。原文稍后读已读值得跟进有用关注 Cognition
04:02官方一手Anthropic: Newsroom(资讯)AI 公司 Anthropic 于 2026 年 7 月 9 日发起公开倡议,邀请公众提出关于 AI 的最尖锐问题。该公司承诺将展示每个问题的应对过程,包括内部讨论、研究思路和最终决策,以此提升 AI 开发的透明度和社会信任。行业AnthropicAI安全透明度10 个信源在谈事件专题推荐理由:Anthropic 搞了个公开活动,让你直接问它们最难的问题,还承诺会公开怎么回答。想看看它们怎么应对公众质疑的可以关注。原文稍后读已读值得跟进有用关注 Anthropic
03:13techcrunch@Rebecca Bellan纽约时报在诉讼中指控OpenAI隐藏了用于识别ChatGPT输出中受版权保护的新闻内容的工具和数据集。该报于2026年7月9日提交了一项新的制裁动议,要求法院对OpenAI隐瞒证据的行为进行处罚。此案涉及OpenAI在2023年起的版权侵权纠纷,纽约时报声称至少有数千篇其文章被用于训练ChatGPT。行业OpenAIChatGPT纽约时报10 个信源在谈事件专题推荐理由:《纽约时报》告OpenAI隐瞒能证明ChatGPT抄袭新闻的工具,这回要申请法院制裁,性质更严重了。原文稍后读已读值得跟进有用关注 OpenAI
02:49官方账号OpenAI@OpenAI91°OpenAI发布GPT-5.6 Sol模型,在编码、知识工作、网络安全和科学领域实现最先进性能。该模型使用更少token并降低计算成本。相比前代,它在多个基准测试中表现更优,但具体数字未公开。AI模型GPT-5.6 SolOpenAI编程助手10 个信源在谈事件专题推荐理由:OpenAI新出的GPT-5.6 Sol能在编程、科研等领域做到顶尖,还省token省成本,想尝鲜的可以试试。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
02:23官方一手@OpenAIDevs@OpenAIDevs82°OpenAI 宣布 GPT-5.6 是其当前在网络安全和生物相关任务上能力最强的模型。部分 API 调用可能被阻止或暂停,以便安全系统在双用途领域(如网络安全)进行额外审查,因为防御性和攻击性活动初看相似。OpenAI 表示将根据实际使用持续调整安全措施。该发布强调了模型在敏感领域的应用风险与安全平衡。AI模型GPT-5.6OpenAI网络安全10 个信源在谈事件专题推荐理由:OpenAI 出了 GPT-5.6,专攻网络安全和生物任务,API 调用还会被安全审查,想了解最前沿模型能力与安全权衡的可以看看。原文稍后读已读值得跟进有用关注 GPT-5.6
01:44官方一手OpenAI Blog(博客/媒体)OpenAI宣布启动针对GPT-5.5的生物漏洞赏金计划,邀请安全研究人员评估模型在生物安全领域的潜在风险。该计划旨在通过奖励机制发现模型可能被用于恶意生物设计的问题。具体奖励金额和提交方式已在OpenAI官网公布。行业GPT-5.5OpenAIAI安全10 个信源在谈事件专题推荐理由:OpenAI开了个针对GPT-5.5的生物安全赏金,发现漏洞能拿钱,搞AI安全的值得关注。原文稍后读已读值得跟进有用关注 GPT-5.5
13:49IT之家(博客/媒体)黄仁勋在采访中称,英伟达软件工程师更愿意构建智能体而不是写Python代码。AI让工程师减少传统编码,转向构建智能体、设计基准测试和设置安全护栏。他反驳AI取代员工的说法,认为AI创造新岗位,并计划在各部门大规模部署智能体提升生产力。行业黄仁勋英伟达智能体推荐理由:黄仁勋说他的工程师更喜欢搭智能体而不是写代码,还反驳了AI取代人的说法。看看这位大佬怎么看待AI对程序员工作的改变吧。原文稍后读已读值得跟进有用关注 黄仁勋
11:20官方账号arXiv cs.AI@Yujiao Chen论文提出 institutional red-teaming 方法论并实例化为 IABench-CA 基准,覆盖 228 个上下文、5 条规范规则及 7 个模型种群(共 33,924 局游戏)。结果显示:仅改变后果规则即可使平均死亡人数变动 22-58 个百分点。没有任何规则在所有种群中安全:最安全与最不安全的规则及其影响方向均随种群变化,但回归性身份定位从未成为任何上下文中的绝对安全策略,且在 30-87% 的游戏中去除了资源最少的智能体。对最易受剥削种群(gpt-5.1)的消融实验表明,规则文本中命名损失承担者使针对性消除从 22% 升至 81%;重复游戏下匿名化仅延迟定位,智能体从观察结果反推隐藏规则。论文多智能体AI安全红队测试推荐理由:这篇论文拿多个模型种群跑了几万局游戏,发现换一条规则,事故率能差 58 个百分点,而且匿名化也挡不住针对性消除。做多智能体安全的一定要看。原文稍后读已读值得跟进有用关注 多智能体
10:49IT之家(博客/媒体)7月8日,俄罗斯国家杜马通过AI监管法案,引入“主权人工智能基础大模型”和“国家人工智能基础大模型”两种分类。主权模型全生命周期必须由俄罗斯法人控制,数据处理中心须在俄境内;国家模型可使用开源外国组件。法案要求日活超过50万的网站和应用为用户提供AI生成内容标记选项,但非强制。法案大部分条款于2026年9月1日生效,主权模型相关要求等推迟至2027年3月1日,现有系统过渡至2032年9月1日。行业俄罗斯AI监管主权模型推荐理由:俄罗斯正式立法:AI模型须本土开发,主权模型受俄价值观约束,生成内容标记可选。原文稍后读已读值得跟进有用关注 俄罗斯
10:22官方账号arXiv cs.AI@Mingguang Chen, Licheng Wang, Bo Qu精选该论文调查了2024-2026年间1250篇arXiv论文,沿两个轴分类:系统改进的对象(行为、策略、评估器、研究过程)和循环闭合程度。它将有界自优化(收敛、可评估、已成工业实践)与开放端递归自我改进(RSI)区分开,后者在所有可测维度上受制于基础、崩溃动态和计算约束。论文提出评估器设计空间,将信号从形式验证器(最强)到内在自我评估(最弱)排序,并证明自我改进强度与验证层级相关。失败模式如自确认循环、模型崩溃和多样性崩溃源于违反该层级,而保持人类在环中的“研究方向设定”瓶颈位于该层级顶端。论文自我改进递归自我改进自我评估推荐理由:这篇论文把AI自我改进的各种文献梳理得特别清楚,区分了“有界自优化”和真正的“递归自我改进”,还画出了验证强度层级,读完对AI安全风险理解更深。原文稍后读已读值得跟进有用关注 自我改进
09:24官方账号arXiv cs.AI@Mubarak Raji, Masooda Bashir2025年被广泛称为“Agentic AI之年”,自主规划执行任务的智能体AI加速部署。论文系统综述Agentic AI治理文献,识别出区别于传统AI系统的自主性、目标导向等特征。研究综合了当前治理优先级、建议机制(如监管沙盒)及利益相关者角色。该综述为制定负责任的Agentic AI治理路线图提供了初步基础。论文Agentic AIAI治理智能体推荐理由:这篇论文梳理了Agentic AI的特殊治理挑战,如果你关心AI安全和伦理,值得一看。原文稍后读已读值得跟进有用关注 Agentic AI
09:23shao__meng@shao__meng88°OpenAI 审计发现 SWE-Bench Pro 中约30%的任务存在致命缺陷,包括过严测试、题面欠指定、低覆盖测试和误导性题面。此前公开731题上,前沿模型通过率八个月内从23.3%升至80.3%,但分数飙升主要源于评测噪声而非能力提升。OpenAI 采用自动化质检、人机协同深审和人工标注三层流程,人工审核更常判出“坏题”(约30%)。OpenAI 因此撤回对 SWE-Bench Pro 的推荐,呼吁社区设计更可靠、难刷的编程评测基准。行业SWE-Bench ProOpenAI基准测试10 个信源在谈事件专题推荐理由:OpenAI 发现一个流行代码基准有30%的题有问题,分数虚高,直接影响了部署和安全判断。做评测或选模型的人得看这个。原文稍后读已读值得跟进有用关注 SWE-Bench Pro
09:06官方一手arXiv: OpenAI@Kiarash Ahi, Saeed Valizadeh该综述分析了LLM和生成式AI(如ChatGPT、Claude、Gemini)在网络安全中的双重用途:既用于自动威胁检测和防御,也被用于生成恶意软件。数据显示LLM生成的恶意软件在2025年预计占检测到威胁的50%,而2021年仅占2%。论文基于70多篇学术文献和行业报告,涵盖Google Play Protect、Microsoft Defender等平台的案例。最后提出了模型水印、对抗防御等负责任部署建议。论文LLMChatGPTClaude推荐理由:这篇论文详细梳理了LLM如何同时成为防御工具和攻击武器,还给出了具体数字和平台案例,适合想全面了解AI安全现状的人。原文稍后读已读值得跟进有用关注 LLM
09:05官方一手Anthropic: Research(资讯)Anthropic在2026年7月发布了一项关于AI双用途知识对齐的研究。研究提出了一种“关闭开关”机制,允许在推理时选择性地禁用模型中的危险知识。实验在生物和化学领域的多个安全基准上进行了评估。结果证明了该方法在降低恶意利用风险方面的有效性。论文Anthropic双用途知识AI安全7 个信源在谈事件专题推荐理由:Anthropic研究了一个很实际的问题:怎么让AI知道太多危险东西时能随时关掉。不是只喊口号,有具体方法。原文稍后读已读值得跟进有用关注 Anthropic
07:41IT之家(博客/媒体)73°Meta正在开发一款内部代号“超级感知”的AI智能眼镜原型,可始终开启音频录制并每隔几秒自动拍照。该设备在启用这些功能时可能不点亮镜框上的LED录制指示灯,引发隐私担忧。Meta内部讨论是否将采集数据用于训练AI模型,同时争议围绕现有Ray-Ban Meta眼镜展开,今年2月肯尼亚外包审核人员曾看到露骨内容。上个月《连线》杂志还发现其平台内嵌未发布的面部识别系统代码,后被移除。行业MetaRay-Ban Meta智能眼镜推荐理由:Meta又在搞事情,这款超级感知眼镜能一直录音拍照还不亮灯提醒,隐私争议又要升级了。原文稍后读已读值得跟进有用关注 Meta
04:45官方一手OpenAI Blog(博客/媒体)OpenAI发布了三大原则指导政府与国家安全合作:负责任AI使用、民主问责和公共安全。该指南旨在确保AI技术在与政府合作时符合伦理标准并保障公共利益。OpenAI强调这些原则将作为其未来合作的基础框架。行业OpenAIAI安全AI治理10 个信源在谈事件专题推荐理由:OpenAI出了份官方指南,告诉政府合作时怎么确保AI用着靠谱不越界。原则明确,适合关注AI治理的人看看。原文稍后读已读值得跟进有用关注 OpenAI
04:43techcrunch@Russell Brandom本周早些时候,一张显示美国参议员Mitch McConnell在病床上插管、极度痛苦的图片被证实是AI生成的深度伪造。Google的深度伪造检测系统被用于识别该图片属于伪造。该系统通过分析图像中的AI生成痕迹,成功揭穿了这一恶作剧。事件凸显了深度伪造检测技术在实际场景中的应用价值。行业GoogleDeepfake detectorMitch McConnell推荐理由:Google的深度伪造检测又立功了,这次识破了Mitch McConnell的病床假照片。看看AI检测技术怎么拆穿这种恶作剧的。原文稍后读已读值得跟进有用关注 Google
03:03techcrunch@Sarah PerezElon Musk宣布X平台将推出更新,当用户对帖子进行点赞、回复或转发后,若该帖子被添加Community Notes,系统会通过直接消息(DM)通知用户。这一功能旨在解决社区事实核查常滞后于虚假信息传播的批评。目前该更新尚未正式上线,但已通过Musk的推文公开。AI产品XElon MuskCommunity Notes推荐理由:你之前点赞转发的帖子可能已经被辟谣了,X现在会直接发私信提醒你,省得你一直蒙在鼓里。原文稍后读已读值得跟进有用关注 X
00:52宝玉@dotey83°Mitchell 在早期访问中对 GPT 5.6 Sol 和 Fable 进行了对比。他将 Sol 比作魅力十足、高效能干的同事,Fable 则是痴迷于特定领域的天才隐士。据 Mitchell 称,Sol 在速度和整体工作质量上优于 Fable,而 Fable 在针对性调试、安全和性能目标上无敌。他认为 Sol 在日常使用中更令人愉快,但 Fable 在高度定向任务中无对手。AI模型GPT 5.6 SolFable推理模型推荐理由:Mitchell 用同事和隐士的比喻讲透了两个模型的区别——日常编程选 Sol,底层安全调试选 Fable。原文稍后读已读值得跟进有用关注 GPT 5.6 Sol
16:07官方账号Decoder@Matthias Bastian91°OpenAI 将于周四推出 GPT-5.6,此前因美国政府要求额外测试而延迟。该模型代号 Sol,在编码基准上以约一半的成本超越 Anthropic 的 Claude Mythos 5。目前尚无模型审批的绑定标准。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 来了,代号 Sol,编码能力比 Claude Mythos 5 强,成本还低一半,值得看看。原文稍后读已读值得跟进有用关注 GPT-5.6
14:04IT之家(博客/媒体)76°工信部NVDB今日发布风险提示,指出AI编程工具Claude Code(版本2.1.91至2.1.196)内置监控机制,可在未经用户同意下向远程服务器回传地域、身份标识等敏感信息。该后门源于2026年4月2日发布的2.1.91版本起添加的检测机制,用于识别中国用户。Anthropic团队成员确认该机制为实验性措施,已在2026年7月2日新版本中删除。阿里巴巴于2026年7月初宣布自7月10日起禁止员工在办公环境使用Claude Code。NVDB建议相关用户立即卸载或升级至安全版本。行业Claude CodeAnthropic工信部10 个信源在谈事件专题推荐理由:工信部点名Claude Code特定版本会偷偷回传你的地域和身份信息,开发者赶紧检查版本,该卸就卸。原文稍后读已读值得跟进有用关注 Claude Code
14:01IT之家(博客/媒体)三星电子联席CEO卢泰文在7月22日Galaxy Unpacked发布会前撰文,称AI已进入智能体时代,能替用户执行操作但决策权归用户。三星通过Galaxy生态(手机、平板、手表、电视、家电)提供个性化AI体验,如Galaxy Watch睡眠数据可建议次日日程。生态基于开放平台SmartThings并依赖Samsung Knox保障设备安全。卢泰文认为AI竞争重点将是“谁更懂用户”,预计Galaxy Z Fold 8等新品将整合这些能力。行业三星Galaxy智能体推荐理由:三星讲了个实在观点:AI好不好,看它懂不懂你。卢泰文解释了怎么用设备生态让AI更贴心,还预告了7月22日的新折叠屏。原文稍后读已读值得跟进有用关注 三星
11:58官方账号Latent Space (swyx)(博客/媒体)OpenAI 研究员 Lilian Weng 发布了一份综述,汇总了 35 篇关于递归自我改进(RSI)控制工程(Harness Engineering)的论文。该综述梳理了不同控制策略和安全性分析方法。对理解 AI 自我改进的风险与调控有参考价值。论文Lilian Weng论文综述RSI9 个信源在谈事件专题推荐理由:Lilian Weng 帮你扒了 35 篇关于 RSI 控制工程的论文,想了解 AI 怎么自我调控又不跑偏的,直接看这份总结就行。原文稍后读已读值得跟进有用关注 Lilian Weng
11:19Ethan Mollick@emollick一篇推文梳理了中美AI竞争的8个可能维度,包括企业利润、科学声誉、商业模式(开放/封闭)、国家资产组合(芯片、电力、软件)、国家安全、对盟友的模型访问控制、AI人格反映国家理想,以及率先实现ASI。文章指出讨论竞争前需明确具体维度。行业中美AI竞争AI政策AI安全推荐理由:如果你想看清中美AI竞争到底在争什么,这篇推文帮你拆成了8个维度,省得大家各说各话。原文稍后读已读值得跟进有用关注 中美AI竞争
05:25Ate-a-Pi@svpino该基准测试评估前沿模型处理儿童安全风险的能力,覆盖12个风险类别,包括诱骗、冒充、描述未成年人和情感依赖。测试了5个前沿模型,失败率在2%到34%之间。这是首个针对非显式虐待风险的评估。现有评测仅捕捉显式滥用,完全忽略此类问题。论文链接附于推文中。论文儿童安全基准测试前沿模型推荐理由:想看看AI模型在安全上有多不靠谱?这个基准测了5个前沿模型在12类儿童非显式风险上的表现,失败率最高34%。原文稍后读已读值得跟进有用关注 儿童安全