5月28日
10:28
10:28Google Gemini App@GeminiApp
Google 宣布 Gemini Omni 现已面向所有 Google AI Plus、Pro 和 Ultra 订阅用户开放,支持网页版和 Gemini 应用。该功能提供了更强大的多模态交互能力,用户可以在对话中同时处理文本、图像和音频。此次开放标志着 Gemini 在多模态 AI 领域的重要进展,订阅用户可以直接体验。
推荐理由:多模态交互是 AI 的下一个关键方向,Gemini Omni 让订阅用户能同时处理文本、图像和音频,做内容创作或数据分析的团队值得立即体验。
5月26日
11:49
11:49官方账号arXiv cs.AI@Junyuan Liu, Xinglei Wang, Zichao Zeng, Jiazhuang Feng, Quan Qin, Ilya Ilyankou, Guangsheng Dong, Tao Cheng
精选
城市表示学习将复杂城市环境编码为通用嵌入,但现有评估多局限于少数城市和任务,且随机划分导致空间泄漏,高估性能。CityRep 提出统一基准,包含空间单元无关的评估框架、基于区块的空间划分协议,以及覆盖 8 城市 8 任务的可扩展套件。评估 11 个模型发现,随机划分会扭曲性能排名,且模型表现因城市和任务差异显著。该基准提供数据集、评估管道和诊断工具,旨在推动城市表示学习的公平比较和泛化能力研究。
推荐理由:城市表示学习领域终于有了一个靠谱的评估标准——CityRep 解决了空间泄漏和跨城市泛化评估的痛点,做城市计算或地理空间 AI 的研究者可以直接用这个基准来检验自己的模型,避免被随机划分的虚假高分误导。
5月25日
20:56
20:56官方账号阿里云 Alibaba Cloud@alibaba_cloud
在Qwen Conference 2026上,行业领袖和生态先驱在基础模型论坛中围绕“Qwen的多模态未来”展开圆桌讨论。他们探讨了驱动跨模态对齐的架构变革,并深入分析了AI原生趋势。会议旨在揭示多模态AI的最新进展和未来方向。活动详情可通过链接获取。

推荐理由:关注多模态AI架构演进的开发者,这场圆桌讨论能帮你理解跨模态对齐的核心技术趋势,值得一看。
14:42
14:42官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里云将于5月26日在新加坡金沙会展中心举办Agentic AI前沿峰会,汇聚行业先驱与远见者。会议将深入分析Agentic AI的核心基础设施及跨行业多模态工作流。该峰会旨在探讨AI代理技术的最新进展与行业应用,为参会者提供前沿洞察。活动详情可通过链接获取。

推荐理由:想了解Agentic AI最新趋势的开发者与行业决策者,这场峰会值得关注——阿里云将展示从底层基础设施到跨行业应用的全景图。
10:16
5月21日
08:01
08:01Google Gemini App@GeminiApp
Google 宣布全球 AI Plus、Pro 和 Ultra 订阅用户现可在 Gemini 应用中试用 Gemini Omni 功能。该功能允许用户直接在应用内进行多模态交互和创作。Google 鼓励用户分享自己的创作成果。此举标志着 Google 在 AI 多模态能力上的进一步扩展,面向高级订阅用户开放。
推荐理由:Google 将多模态 AI 能力直接集成到 Gemini 应用中,Plus/Pro/Ultra 订阅用户现在就能上手体验,做内容创作或 AI 实验的团队值得一试。
08:00
08:00官方一手歸藏(guizang.ai)@op7418
72°
谷歌在 I/O 大会上宣布将 Antigravit 整个生态整合进 Gemini,Gemini CLI 更名为 Antigravit CLI,并发布对应 SDK。Antigravit 2.0 版本更像 Codex,而非 Cursor。实测 Gemini 3.5 Flash 配合 Antigravit 在排版上表现不错,但权限审批繁琐、缺少内置浏览器等细节体验不足。整体仍处于早期阶段,适合基础任务。
事件专题

推荐理由:谷歌把 Antigravit 生态整合进 Gemini,做 AI 编程的开发者可以试试它的多模态排版能力,但别期待太复杂的自动化——权限和体验还差一截。
08:00
08:00IT之家博客/媒体
83°
谷歌在 2026 I/O 开发者大会上宣布,Gemini 3.5 Pro 模型将于下月正式发布。目前该模型已在谷歌内部使用,官方称其进步非常强,但未透露具体细节。这一消息表明谷歌在 AI 模型迭代上持续加速,Gemini 3.5 Pro 有望在性能、多模态或推理能力上带来显著提升,值得开发者和 AI 从业者关注。
事件专题

推荐理由:谷歌 Gemini 系列模型迭代节奏加快,3.5 Pro 内部使用已获「进步超强」评价,做多模态或推理应用的开发者值得提前关注,下月发布后可直接上手体验。
5月20日
18:46
18:46官方账号阿里云 Alibaba Cloud@alibaba_cloud
精选
阿里云宣布将于2026年举办Qwen Conference,主题议程聚焦AI原生云、智能体原生云架构、推理未来和多模态视觉技术。会议承诺无冗余内容,直接提供面向全球规模的工程蓝图。该会议旨在展示阿里云在AI基础设施和智能体领域的最新进展,为开发者和企业提供可落地的技术方案。目前已开放注册。

推荐理由:阿里云首次将AI原生云和智能体原生云架构作为核心议题,做云原生和AI基础设施的团队可以提前了解工程蓝图,建议关注注册。
15:14
15:14AI Will@FinanceYF5
83°
Google AI 今日宣布推出全新智能搜索框,集成了其最先进的 Gemini 3.5 模型,带来更强的智能体能力。用户可以通过文本、图像、文件和视频等多种模态进行提问,搜索能够跨模态进行推理。该搜索体验将 AI Overviews 和 AI Mode 合并为统一的 AI 搜索体验,支持追问、构建上下文,并提供更个性化的回答。新功能已在全球桌面端和移动端上线。
推荐理由:Google 将 Gemini 3.5 的智能体能力直接嵌入搜索,意味着日常搜索从关键词匹配升级为多模态推理助手。重度依赖搜索获取信息的用户、研究者和开发者,值得立刻体验这种能理解图片和视频的搜索方式。
09:28
09:28官方账号Google AI@GoogleAI
72°
Google 宣布推出全新智能搜索框,将 AI Overviews 和 AI Mode 合并为统一的 AI 搜索体验。该搜索框基于最先进的 Gemini 3.5 模型,支持文本、图像、文件和视频等多模态输入,并能跨模态进行推理。用户可提出后续问题、构建上下文,获得更个性化和精准的回复。新搜索体验已在全球桌面端和移动端上线。
推荐理由:Google 将 AI 搜索能力整合进一个统一入口,做搜索优化或内容运营的团队值得关注——这意味着用户行为和数据反馈将更集中,直接影响 SEO 策略和内容分发逻辑。
07:26
07:26orange.ai@oran_ge
83°
Google 昨晚发布 Gemini flash 3.5 模型,现已可用。该模型在多项指标上大幅超越 3.1 Pro,与 GPT 5.5 接近,且在 Agentic 和多模态能力上更优。价格仅为 GPT 5.5 的三分之一,缓存价格六分之一,API 定价 $1.50/$9.00 每百万 token。上下文窗口达 1M token,速度是其他旗舰模型的 4 倍,非常适合 Agent 场景。

推荐理由:做 Agent 和多模态应用的开发者终于有了性价比更高的选择——Gemini flash 3.5 速度是旗舰模型的 4 倍,价格却只有 GPT 5.5 的三分之一,建议直接试 API。