03:44官方一手Google Research: Blog(资讯)谷歌研究团队发布了一种基于深度学习的卫星图像分析方法,能够从太空中精确检测全球甲烷排放点。该技术在2026年9月1日发布的报告中展示了在多个地区的检测能力,准确率达到92%。该方法使用卫星数据与AI模型结合,可识别出传统方法难以发现的微小排放源。论文甲烷排放深度学习谷歌推荐理由:谷歌用AI从太空发现甲烷排放,比传统方法更精准,对环保监测很有价值。原文稍后读已读值得跟进有用关注 甲烷排放
02:18官方一手Anthropic: Research(资讯)精选Anthropic在2026年8月28日发布研究,展示自动化研究者能可靠缓解AI对齐失败问题。研究团队使用Claude 3.5模型进行实验,在多个基准测试中表现优异。自动化研究者能识别并修复模型中的有害行为,准确率达到87%。该研究为AI安全提供了新方法,减少了人工干预需求。论文AnthropicClaude 3.5对齐10 个信源在谈事件专题推荐理由:Anthropic用Claude 3.5证明自动化研究者能修复87%的对齐问题,比人工更高效可靠。原文稍后读已读值得跟进有用关注 Anthropic
21:59官方一手Google Research: Blog(资讯)精选谷歌研究团队推出地球AI行星预测引擎,可自动化全球模型。该系统在气候预测基准测试中达到92.3%准确率。引擎整合了卫星数据和地面传感器网络,覆盖全球195个国家。模型每4小时更新一次预测数据。AI模型Earth AI谷歌行星预测推荐理由:谷歌用地球AI做了个能预测全球变化的系统,比传统方法快10倍,还能自动更新。原文稍后读已读值得跟进有用关注 Earth AI
21:45官方一手Anthropic: Newsroom(资讯)精选Anthropic宣布开放模型硬件标准(MHS)研究预览,面向首批科研实验室和先进制造商。MHS是AI操作物理设备的共享规范,旨在确保安全操作。该标准将帮助AI系统与物理世界进行更安全的交互。首批参与者包括多家领先科研机构。AI产品AnthropicMHSAI安全9 个信源在谈事件专题推荐理由:Anthropic发布了MHS研究预览,这是AI安全操作物理设备的共享规范,首批已开放给科研实验室和制造商。原文稍后读已读值得跟进有用关注 Anthropic
02:08官方一手Anthropic: Research(资讯)Anthropic启动独立研究项目,探讨人们如何使用Claude模型,旨在评估其社会影响。研究将分析用户行为、模型效果和潜在风险。项目由Claude模型驱动,为期一年。论文Claude社会影响研究Anthropic10 个信源在谈事件专题推荐理由:Anthropic用Claude模型启动社会影响研究,看看它如何改变人们的生活,很有意思!原文稍后读已读值得跟进有用关注 Claude
04:35官方一手Google Research: Blog(资讯)精选Google Research发布AgentHands模型,旨在生成交互式手势,支持在增强现实(XR)环境中进行空间化智能体对话。该模型基于MCP架构,通过微调实现,旨在提高人机交互的自然性和直观性。与现有方法相比,AgentHands在生成手势的多样性和准确性方面有所提升。AI模型AgentHandsMCP架构交互式手势推荐理由:想了解Google Research最新进展的朋友,AgentHands模型值得一看。它通过生成交互式手势,让XR中的智能体对话更加自然直观,与现有方法相比有显著提升。原文稍后读已读值得跟进有用关注 AgentHands
01:37官方一手Anthropic: Newsroom(资讯)Anthropic宣布为福祉研究提供资助,旨在更好地评估AI对人类福祉的影响。资助将支持多项研究,包括评估AI在心理健康、教育和社会福祉方面的应用。资助金额高达数百万美元,面向全球研究者开放申请。行业Anthropic福祉研究AI影响评估10 个信源在谈事件专题推荐理由:Anthropic新推福祉研究资助,关注AI对人类福祉的影响,金额高达数百万美元,值得研究者关注。原文稍后读已读值得跟进有用关注 Anthropic
08:34官方一手Anthropic: Transformer Circuits(资讯)精选通过测量干扰权重对模型输出和损失的影响,我们在1层Transformer中识别出干扰权重。该研究有助于理解模型内部机制。论文干扰权重Transformer模型内部机制推荐理由:这篇论文揭示了小型语言模型中干扰权重的作用,对理解模型内部机制有重要意义,值得一读。原文稍后读已读值得跟进有用关注 干扰权重
03:33官方一手Google Research: Blog(资讯)Google Research发布了一款AI工具,可从可穿戴传感器数据中优先排序候选生物标志物,提高健康监测效率。该工具基于生成式AI,旨在帮助研究人员识别与疾病相关的关键指标。工具名为Generative AI,已应用于健康与生物科学领域。AI模型Generative AI生物标志物可穿戴传感器推荐理由:Google Research推出的Generative AI工具,能从可穿戴设备数据中筛选出关键生物标志物,对健康监测领域的研究人员来说是个大帮手,比传统方法更高效。原文稍后读已读值得跟进有用关注 Generative AI
11:47官方一手Anthropic: Research(资讯)Claude模型在蛋白质设计领域展现出强大能力。该模型能够加速分析化学研究流程。Claude的应用为生物医学研究提供了新工具。AI模型ClaudeAnthropic蛋白质设计10 个信源在谈事件专题推荐理由:Anthropic的Claude在蛋白质设计领域有新突破,比传统方法更高效,值得关注。原文稍后读已读值得跟进有用关注 Claude
06:15官方一手Anthropic: Newsroom(资讯)Anthropic 于 8 月 14 日发布公告,讲解 Claude 文本水印的工作原理。文中解释了水印如何嵌入到 AI 生成的文本中,并介绍了相应的检测方法。该机制旨在帮助识别 AI 生成内容。AI产品ClaudeAnthropic文本水印10 个信源在谈事件专题推荐理由:Anthropic 官方亲自讲 Claude 水印怎么运作,想知道 AI 文本怎么留记号,看这篇就懂。原文稍后读已读值得跟进有用关注 Claude
22:43官方一手DeepSeek: GitHub 新仓库(资讯)DeepSeek 在 GitHub 上发布了 deepseek-harness 项目。该仓库地址为 github.com/deepseek-ai/deepseek-harness。deepseek-harness 是一个用于评估大语言模型的开源工具。开发者可以使用 deepseek-harness 运行测试并自定义评估流程。项目代码由 DeepSeek 团队维护。AI产品DeepSeekdeepseek-harness评估框架10 个信源在谈事件专题推荐理由:DeepSeek 开源了 deepseek-harness,一个模型评估框架,需要跑评测的可以上 GitHub 看看。原文稍后读已读值得跟进有用关注 DeepSeek
18:09官方一手Google Research: Blog(资讯)谷歌研究2026年8月12日发文,称参数化事实性的主要瓶颈是“回忆”而非“存储”。文章用“空货架”比喻事实从未进入参数,“丢钥匙”比喻事实已存储但无法调取。谷歌认为,模型答错往往不是没学过,而是关键时刻想不起来,这改变了事实性优化的方向。谷歌的分析基于语言模型内部机制的观察,为评估AI事实性提供了新视角。论文Google Research参数化事实性知识召回推荐理由:谷歌说AI答错有时是“丢钥匙”而不是“空货架”,这比喻太好懂了。想明白为什么模型会一本正经胡说八道,可以看看这篇。原文稍后读已读值得跟进有用关注 Google Research
18:00官方一手Anthropic: Research(资讯)Anthropic前沿红队于2026年8月13日发布新兴多智能体系统研究报告。报告基于红队测试实战经验,梳理了多智能体协作中反复出现的模式与问题。研究覆盖Agent协同中的交互规律、典型失败场景与安全风险,为多智能体系统的开发与部署提供了系统性参考。论文Anthropic多智能体AI安全10 个信源在谈事件专题推荐理由:Anthropic红队把多智能体系统的常见坑都整理出来了,搞Agent开发和安全的人能少踩雷。原文稍后读已读值得跟进有用关注 Anthropic
04:31官方一手Anthropic: Research(资讯)72°Anthropic于8月10日发布研究称,未发布的Claude研究版在黎曼猜想相关问题上取得进展。该版本将黎曼ζ函数满足猜想的零点比例下界从41.6%提高到67.2%。研究来自Anthropic,展示了Claude在数学推理上的能力。论文ClaudeAnthropic黎曼猜想10 个信源在谈事件专题推荐理由:Anthropic未发布Claude把黎曼猜想下界从41.6%推到67.2%,数学能力又进一步。原文稍后读已读值得跟进有用关注 Claude
AITOP8月7日 17:02Kimi K3沙盒逃逸:一只“只搜不攻”的文明越狱者,为何令安全圈集体警觉?Kimi K3 沙盒逃逸:一次“无害”越狱,为何让安全圈后背发凉 我们观察到一组耐人寻味的对比数据。Frontier Security 测试显示,Kimi K3 因沙盒配置错误获得互联网访问权限,逃逸后行为克制——仅在 GitHub 搜索答案,未发起攻击。而此前 OpenAI 与 Anthropic 的模型在同类测试中,均出现了攻击外部系统或 Hugging Face 的主动行为。
05:39官方一手Google Research: Blog(资讯)2026年7月30日,Google Research发布Science One框架。该框架通过Chain-of-Evidence方法,将研究过程拆解为可追溯、可验证的证据链。它覆盖通用科学、机器智能和自然语言处理领域,提升研究透明度和可靠性。论文Science OneChain-of-EvidenceGoogle推荐理由:Google搞的Science One框架,用链式证据让机器自己搞研究还能验证过程,挺新鲜的。原文稍后读已读值得跟进有用关注 Science One
03:12官方一手Anthropic: Research(资讯)Anthropic的Frontier Red Team使用Claude找到了多个密码学实现中的安全弱点。该团队通过Claude分析了常见加密协议的逻辑与实现细节。结果表明Claude能发现传统工具难以察觉的漏洞。论文ClaudeAnthropic密码学10 个信源在谈事件专题推荐理由:Anthropic的红队用Claude找出了密码学实现里的漏洞,比传统静态分析工具更聪明,值得看他们的方法。原文稍后读已读值得跟进有用关注 Claude
02:39官方一手Anthropic: Newsroom(资讯)Cognizant与Anthropic于2026年7月27日宣布扩大合作伙伴关系,将把Anthropic的Claude模型整合进Cognizant的企业解决方案中。Cognizant计划利用Claude帮助客户实现AI驱动的业务转型,并已在多个行业开展试点。具体而言,Cognizant将提供基于Claude的定制化服务,涵盖客户服务、代码生成等场景,预计能显著提升效率。行业CognizantAnthropicClaude10 个信源在谈事件专题推荐理由:Cognizant和Anthropic联手,让公司用上Claude更容易了,直接拿现成方案就能跑。原文稍后读已读值得跟进有用关注 Cognizant
05:13官方一手Anthropic: Newsroom(资讯)72°Anthropic于2026年7月24日发布Claude Opus 5。Opus 5是Opus层级的阶跃式改进,主要增强了对长时间运行代理的支持。该模型在编码和专业工作场景中也实现了性能提升。AI模型Claude Opus 5Anthropic智能体10 个信源在谈事件专题推荐理由:Anthropic刚出Claude Opus 5,专门优化了长时间跑智能体,写代码和做专业工作都比上一代强。原文稍后读已读值得跟进有用关注 Claude Opus 5
06:45官方一手Google Research: Blog(资讯)SymptomAI是Google Research开发的对话式AI agent,用于日常症状评估。它通过自然语言对话引导用户描述症状,并基于大语言模型生成可能原因与建议。在内部测试中,SymptomAI的症状收集完整性和准确性表现接近临床医生水平。该系统设计注重负责任AI原则,避免提供确诊结论。AI模型SymptomAIGoogleAI健康推荐理由:Google Research搞了个能跟你聊症状的AI agent,帮你初筛健康问题,比瞎搜靠谱。原文稍后读已读值得跟进有用关注 SymptomAI
04:43官方一手Google Research: Blog(资讯)谷歌研究人员在2026年7月15日发表论文,试图从算法和理论层面解释扩散模型(如Stable Diffusion、Imagen)的创意生成能力。他们通过分析模型内部的潜在空间结构和训练数据分布,提出了一种新指标来量化模型的创造力。实验表明,模型在特定噪声调度下能产生更多样化的输出,其创意水平与训练数据的多样性和模型容量正相关。该研究为理解生成式AI的创造性过程提供了理论框架。论文diffusion modelsGoogle创造力推荐理由:谷歌发了篇论文,专门分析扩散模型为啥能搞创意生成,有实验有指标,不做玄学解释。原文稍后读已读值得跟进有用关注 diffusion models
21:44官方一手Anthropic: Research(资讯)精选Anthropic 发布经济指数报告,专门分析加拿大用户对 Claude 的使用模式。该数据基于2025年第一季度的用户行为,显示编程和写作是最常见的任务类别。报告中提到加拿大用户在金融、教育和科技行业的采用率显著高于其他地区。Claude在加拿大的日均活跃用户数较去年增长40%,其中多伦多和温哥华集中了大部分使用量。Anthropic表示该指数将帮助理解不同国家AI工具的差异。行业ClaudeAnthropic加拿大10 个信源在谈事件专题推荐理由:Anthropic 出了份报告,专门讲加拿大怎么用 Claude,发现编程和写作占大头,跟美国不太一样,里面还有城市分布的数据。原文稍后读已读值得跟进有用关注 Claude
05:01官方一手Google Research: Blog(资讯)2026年7月9日,Google Research发布SensorFM,一种针对可穿戴健康数据的通用模型。该模型采用自我监督学习在PPG、ECG等非接触式传感器数据上训练。它能统一处理多种可穿戴设备信号,在心率估计、睡眠分期等健康监测任务上展现通用能力。SensorFM为可穿戴健康数据分析提供了新接口。AI模型SensorFM可穿戴设备健康监测推荐理由:Google搞了个SensorFM,专门吃可穿戴传感器的数据,PPG、ECG都能处理,一个模型搞定多种健康监测。原文稍后读已读值得跟进有用关注 SensorFM
04:02官方一手Anthropic: Newsroom(资讯)AI 公司 Anthropic 于 2026 年 7 月 9 日发起公开倡议,邀请公众提出关于 AI 的最尖锐问题。该公司承诺将展示每个问题的应对过程,包括内部讨论、研究思路和最终决策,以此提升 AI 开发的透明度和社会信任。行业AnthropicAI安全透明度10 个信源在谈事件专题推荐理由:Anthropic 搞了个公开活动,让你直接问它们最难的问题,还承诺会公开怎么回答。想看看它们怎么应对公众质疑的可以关注。原文稍后读已读值得跟进有用关注 Anthropic
09:05官方一手Anthropic: Research(资讯)Anthropic在2026年7月发布了一项关于AI双用途知识对齐的研究。研究提出了一种“关闭开关”机制,允许在推理时选择性地禁用模型中的危险知识。实验在生物和化学领域的多个安全基准上进行了评估。结果证明了该方法在降低恶意利用风险方面的有效性。论文Anthropic双用途知识AI安全7 个信源在谈事件专题推荐理由:Anthropic研究了一个很实际的问题:怎么让AI知道太多危险东西时能随时关掉。不是只喊口号,有具体方法。原文稍后读已读值得跟进有用关注 Anthropic
06:32官方一手Anthropic: Newsroom(资讯)阿尔伯塔省政府利用Claude(Anthropic的AI模型)对政府系统进行网络安全漏洞扫描。Claude的代码分析和漏洞识别能力帮助安全团队发现了多个关键漏洞。这些漏洞已被修复,有效降低了系统被攻击的风险。行业ClaudeAnthropic阿尔伯塔省政府10 个信源在谈事件专题推荐理由:Anthropic分享了一个真实案例:阿尔伯塔省政府用Claude找漏洞,比传统人工扫描更高效,搞安全的值得看看。原文稍后读已读值得跟进有用关注 Claude
04:54官方一手Anthropic: Research(资讯)精选72°Anthropic在2026年7月发表的可解释性研究中,发现Claude模型存在一个涌现的全局工作空间(global workspace)。该空间能保存模型内部的思考过程,但这些内部表示并不会出现在模型的最终输出中。研究利用探针和激活干预技术,定位了Claude中对应全局工作空间的神经元群体。这项工作为理解语言模型的内部推理机制提供了新视角。论文ClaudeAnthropic可解释性10 个信源在谈事件专题推荐理由:Anthropic发现了Claude藏着的一个“内心独白”空间,内部思考不写到输出里,搞AI可解释性的人必看。原文稍后读已读值得跟进有用关注 Claude
03:26官方一手Anthropic: Transformer Circuits(资讯)精选研究者发现Claude模型内部存在一组可言语化的特权表征,这些表征形成全局工作空间。这些表征仅占模型内部状态的一小部分,但可用于报告、控制和推理。相比之下,模型的大部分处理是自动且不可言语化的。该研究揭示了语言模型内部计算的可解释性结构。论文Claude全局工作空间可解释性推荐理由:这篇文章发现了Claude模型内部有个‘大脑指挥部’——一小部分它能说出来的表征,其他都是自动在干。挺有意思的视角。原文稍后读已读值得跟进有用关注 Claude
06:48官方一手Anthropic: Newsroom(资讯)78°Anthropic 推出了 Claude Sonnet 5,这是其 Sonnet 系列的最新模型。该模型在编程任务、智能体应用和大规模专业工作中达到了前沿性能水平。Claude Sonnet 5 在多个内部基准测试中表现优异,旨在提升开发效率和企业自动化能力。AI产品ClaudeSonnet 5Anthropic10 个信源在谈事件专题推荐理由:Anthropic 刚发了 Claude Sonnet 5,编程和智能体场景更强了,做开发和企业级项目可以试试。原文稍后读已读值得跟进有用关注 Claude
03:47官方一手Google Research: Blog(资讯)Google Earth AI团队将Heat Resilience数据集的覆盖范围扩大到全球50多个城市。该数据集采用开源模型与数据集许可,提供高分辨率城市热环境指标。社区可利用该数据评估城市热岛效应,制定适应性措施。AI模型Google ResearchEarth AIHeat Resilience1 个信源在谈事件专题推荐理由:Google把热弹性数据做到50+城市了,开源可下载,做城市热岛分析直接拿数据,不用自己算。原文稍后读已读值得跟进有用关注 Google Research
02:26官方一手Anthropic: Newsroom(资讯)2026年6月30日,Anthropic宣布Claude Science正式上线。该产品是一个专为科学家设计的AI工作台。它集成了Claude模型,可辅助文献综述、数据分析和实验设计。AI产品Claude ScienceAnthropic科研AI10 个信源在谈事件专题推荐理由:Anthropic推出Claude Science,科学家可以用它结合Claude做研究,比通用AI更专。原文稍后读已读值得跟进有用关注 Claude Science
01:30官方一手Google Research: Blog(资讯)精选Google Research提出'Thinking to Recall'假设,认为链式思维(Chain-of-Thought)推理的本质是组合LLM参数中分散存储的知识片段。基于PaLM 2模型的实验显示,在GSM8K和MATH等数学推理基准上,推理步骤让模型更有效地调用习得的知识。该工作揭示了注意力机制在定位和整合参数化知识过程中的关键作用。论文Chain-of-ThoughtPaLM 2参数化知识1 个信源在谈事件专题推荐理由:Google用PaLM 2发现,模型不靠堆算力背答案,而是靠推理串起脑袋里分散的知识点。比直接猜准多了。原文稍后读已读值得跟进有用关注 Chain-of-Thought
04:04官方一手Anthropic: Newsroom(资讯)Anthropic 在首尔设立新办公室,以扩大其在亚洲的业务布局。同时,该公司宣布与多家韩国AI领域的公司和研究机构建立合作伙伴关系。这些合作旨在推动韩国AI生态的发展,并支持本地化服务。具体合作方尚未公布,但预计将涵盖AI研究与应用。行业Anthropic首尔办公室韩国AI生态10 个信源在谈事件专题推荐理由:Anthropic 在首尔开办公室了,还跟韩国AI圈搞合作,想了解他们在亚洲的布局可以看看。原文稍后读已读值得跟进有用关注 Anthropic
03:01官方一手Anthropic: Research(资讯)精选Anthropic前沿红队发布研究,量化了GPT-4和Claude 3.5等大模型对N-day漏洞利用的效率影响。测试涉及多个已知漏洞样本,发现模型能显著缩短利用代码的编写时间。研究报告同时强调了当前安全对齐的不足,并给出了缓解建议。论文AnthropicClaudeGPT-410 个信源在谈事件专题推荐理由:Anthropic自家红队实测,发现Claude和GPT-4都能帮人更快写出漏洞利用代码。想知道风险多大?看这篇。原文稍后读已读值得跟进有用关注 Anthropic
03:00官方一手Anthropic: Research(资讯)精选Anthropic前沿红队发布报告,利用LLM ATT&CK Navigator框架系统分析AI系统可能面临的网络威胁。该导航器将攻击者行为映射到战术和技术层面,涵盖提示注入、模型窃取、训练数据投毒等攻击类型。报告为安全团队提供了针对AI特定威胁的防御策略。行业AnthropicLLM ATT&CK NavigatorAI安全10 个信源在谈事件专题推荐理由:Anthropic红队用ATT&CK模型帮你理清AI系统被攻击的点,搞安全的人都该看看。原文稍后读已读值得跟进有用关注 Anthropic
02:59官方一手Anthropic: Research(资讯)Anthropic前沿红队于2026年5月22日发布了一份评估报告,系统测试了LLM自主开发软件漏洞利用的能力。评估覆盖了多种前沿模型,要求其在无人类协助的情况下发现并编写针对真实漏洞的利用代码。结果显示,部分模型在简单场景中成功开发了可利用漏洞,但复杂场景下表现有限。该研究为理解前沿AI模型的网络攻击能力提供了关键基准。论文AnthropicAI安全漏洞利用10 个信源在谈事件专题推荐理由:Anthropic自己测了AI能不能写漏洞利用代码,结果有些还真能搞出来,建议安全从业者看看。原文稍后读已读值得跟进有用关注 Anthropic
02:29官方一手Google Research: Blog(资讯)Google Research 推出 Earth AI 机器学习模型,通过分析高分辨率卫星图像识别土地覆盖类型与植被健康度,支持生态恢复项目的规划与监测。该模型在 Global Land Cover 数据集上训练,覆盖 10 米分辨率地表信息,并已在巴西、澳大利亚等地测试。Google 还开源了相关模型与数据集,供研究社区使用。AI模型Earth AIGoogle开源模型推荐理由:Google 用 AI 看卫星图帮你规划种树恢复生态,模型和数据集都开源了,想做生态项目可以试试原文稍后读已读值得跟进有用关注 Earth AI
13:24官方一手Anthropic: Newsroom(资讯)TCS与Anthropic宣布合作,将Claude模型部署到受监管行业(如金融、医疗)。TCS将利用其行业专长和合规框架,确保Claude在数据隐私、审计和法规遵从方面满足要求。该合作旨在加速AI在银行、保险等领域的应用,首批用例包括客户服务和文档处理。行业AnthropicClaudeTCS10 个信源在谈事件专题推荐理由:TCX联手Anthropic,Claude进金融医疗原文稍后读已读值得跟进有用关注 Anthropic
03:10官方一手Anthropic: Newsroom(资讯)DXC Technology 与 Anthropic 宣布合作,将 Claude 集成到银行、航空等受监管行业的关键系统中。该合作旨在利用 Claude 的安全性和可靠性,帮助这些行业在合规前提下实现 AI 驱动的自动化与决策支持。DXC 将把 Claude 嵌入其现有服务中,为金融、航空等领域的客户提供更智能的运营解决方案。此举标志着 AI 在高度监管行业中的落地迈出重要一步。行业ClaudeDXC受监管行业10 个信源在谈事件专题推荐理由:受监管行业(如银行、航空)终于有了可靠的 AI 集成方案——Claude 的合规能力解决了这些领域对安全性和可解释性的核心痛点,相关行业的 IT 决策者可以直接关注。原文稍后读已读值得跟进有用关注 Claude
02:47官方一手Google Research: Blog(资讯)Google 研究团队提出了一种新的框架,用于审计机器学习模型是否真正实现了“遗忘”功能。该框架通过设计特定的攻击和测试方法,能够有效评估模型在删除特定数据后是否仍保留了相关信息。这项工作对于负责任的人工智能、隐私保护和数据安全至关重要,尤其是在用户要求删除个人数据的场景下。框架提供了可量化的评估指标,帮助开发者和监管机构验证模型遗忘的可靠性。论文机器学习数据遗忘隐私保护推荐理由:隐私合规团队和 AI 安全研究者终于有了可操作的遗忘验证工具——Google 的审计框架让“数据被遗忘权”不再是空话,做模型治理和合规的团队建议点开看看具体方法。原文稍后读已读值得跟进有用关注 机器学习