7月2日
02:30
02:30官方一手Google Blog: AI博客/媒体
2026年6月,Google发布多项AI更新,涵盖模型升级、产品新功能和工具发布。具体内容包括Gemini模型的性能提升、Bard新增功能,以及AI视频生成和推理模型的推出。这些更新在多项基准测试中取得显著进展。

推荐理由:谷歌的月度更新打包了一堆新东西,Gemini和Bard都有变化,可以快速了解
7月1日
15:53
15:53AI Will@FinanceYF5
CharacterAI的DAU/MAU黏性指数达45%,远超ChatGPT的36%和Gemini的21%。用户单次会话时长17-22分钟,重度用户每天消息过百。尽管用户留存能力最强,CharacterAI最终以27亿美元被Google收购,暴露出高黏性产品难以盈利的困局。

推荐理由:CharacterAI把ChatGPT和Gemini按在地上摩擦,用户黏性这么高却赚不到钱,最后卖身了。看看数据你就知道为啥。
06:12
6月30日
19:18
19:18官方账号Decoder@Matthias Bastian
Meta雇佣数百名承包商伪装成未成年人,向OpenAI的ChatGPT、Google的Gemini和Character.AI发送自杀、性、毒品相关提示。单轮测试中发送了超过45,000条提示。被测试公司对此毫不知情。该测试旨在评估聊天机器人对未成年人危机场景的回应。
事件专题

推荐理由:Meta偷偷拿对手的聊天机器人做未成年人危机测试,一口气发了4.5万条提示,看看它们怎么应对。
10:25
10:25官方一手arXiv: DeepSeek@Caglar Uysal, Baturay Birinci, Süha Orhun Mutluergil, Orçun Çetin
该论文对DeepSeek、GPT、Gemini、Grok、Llama和Qwen六种前沿LLM进行了提示注入漏洞实证评估。测试涵盖直接攻击与多阶段混淆攻击,涉及多种语言和字符编码。结果显示所有模型均存在系统性漏洞,非英语语种的恶意合规率显著高于英语。DeepSeek、Gemini和Grok在复杂指令下尤其易受攻击,简单字符编码仅部分降低风险。
推荐理由:这篇论文告诉你,DeepSeek、GPT这些模型在非英语场景下有多容易被黑客利用来生成钓鱼内容,安全对齐的漏洞比想象中大。
6月29日
02:45
6月25日
07:33
07:33@koltregaskes@koltregaskes
72°
Gemini 3.5 Pro 发布推迟至7月,多个 Google DeepMind 关键研究人员已跳槽至 Anthropic 等竞争对手。在顶级模型排行榜上,Gemini 目前位列第三,与 Claude 和 ChatGPT/Codex 差距明显。Google 拥有远超对手的资源,但 Gemini 的表现和人才流失反映出内部问题。
事件专题

推荐理由:谷歌的Gemini 3.5 Pro要拖到7月了,DeepMind的人还在往外跑,Anthropic趁机挖人。现在Gemini在排行榜上被Claude和ChatGPT甩开,看看这个局面多尴尬。
6月23日
02:42
02:42官方账号Decoder@Matthias Bastian
Google DeepMind已将Interactions API设为Gemini模型和智能体的默认接口,取代了旧的generateContent API。新API采用简化schema和typed steps替代基于角色的结构。未来所有新的智能体功能将仅通过此API发布。

推荐理由:Google DeepMind给Gemini换了新API,以后做智能体全靠它,老接口被取代了,开发者得抓紧学。
6月22日
12:54
6月21日
04:27
6月18日
15:25
15:25官方账号Decoder@Matthias Bastian
Noam Shazeer是2017年Transformer论文《Attention Is All You Need》的合著者,曾共同领导Google Gemini模型。2024年他作为27亿美元交易的一部分从Character.AI重返Google,现又转投OpenAI。这是继Andrej Karpathy跳槽Anthropic后,今年AI行业第二次重大高管变动。
事件专题

推荐理由:Transformer论文作者Noam Shazeer从Google跳到OpenAI了,他去年刚从Character.AI回归Google,这次跳槽节奏很快。
6月17日
10:45
10:45官方账号arXiv cs.AI@Weizhi Zhang, Zechen Li, Hamid Palangi, Ben Graef, A. Ali Heydari, Simon A. Lee, Salman Rahman, Ray Luo, Zeinab Esmaeilpour, Erik Schenck, Chloe Zhang, Yamin Li, Menglian Zhou, Philip S. Yu, Daniel McDuff, Lindsey Sunden, Mark Malhotra, Shwetak Patel, Ahmed A. Metwally
RubricsTree是一个专家对齐的分层评估框架,包含超过100个可临床验证的原子布尔规则,这些规则从4000个真实用户查询中通过迭代人机协作提炼而成。框架使用上下文自适应路由器为每个查询激活相关子集,实现可扩展且与专家质量对齐的评估。在元评估中,RubricsTree在专家对齐上显著超过强基线,且可靠惩罚上下文退化的响应。作为结构化指令、文本反馈或训练奖励用于性能优化时,RubricsTree在HealthBench上为Gemini、GPT和Qwen系列模型带来高达约66%的相对提升。
推荐理由:RubricsTree用4000条真实查询构建100多条可验证规则,评估健康AI比LLM裁判更准,还能当训练奖励,让Gemini等模型性能飙升66%。
6月16日
6月15日
15:50
15:50Geek@geekbb
该工具支持HTTP/HTTPS/SOCKS4/SOCKS5代理的批量可用性检测。可针对OpenAI、Grok、Gemini、Claude等服务做专项可达性检查。附带Web管理界面和代理仓库功能。项目地址在github.com/strongshuai/pr...
事件专题

推荐理由:这个工具能一键检测免费代理能不能用,还专门测能不能连上OpenAI、Claude这些AI服务,省去手动试错的麻烦。
6月11日
04:42
04:42官方账号Google DeepMind@GoogleDeepMind
Google DeepMind 发布了一项为期八周的研究,评估 AI 对教育的影响。研究不仅关注考试成绩,还观察了学生的行为变化。结果显示,学生使用 Gemini 的方式从直接寻找答案转向理解概念,关于“如何解决问题”的查询比例从 68% 上升到 90%。这表明 AI 正在促进更深层次的学习,而非简单的答案获取。
推荐理由:这项研究揭示了 AI 在教育中的真实价值——不只是提分工具,而是改变学习方式。教育工作者、AI 产品经理和关注学习效率的家长值得一看,了解如何引导 AI 从“答案机”变成“思维教练”。