09:32官方账号阿里通义 Qwen@Alibaba_Qwen83°阿里 Qwen 团队正式推出 Qwen3.7-Plus,这是一款将视觉与语言能力统一的多模态智能体模型。它支持多模态交互混合智能体,可同时处理 GUI 和 CLI 操作;具备全模态输入的编程助手与生产力工具能力;视觉方面涵盖感知、推理、定位和搜索增强问答。该模型在多种智能体框架上表现出跨框架泛化能力,现已通过阿里云 Model Studio API 开放使用。AI模型多模态智能体Qwen3.7-Plus3 个信源在谈事件专题推荐理由:做多模态应用或智能体开发的团队可以直接用 API 试——一个模型搞定看、想、写、做,省去多模型拼接的麻烦。原文稍后读已读值得跟进有用关注 多模态
23:20Philipp Schmid@_philschmid精选Google 在 Gemini API 中推出了 Managed Agents 功能,旨在简化 AI 智能体的构建。开发者只需一次 API 调用,即可创建一个能在托管 Linux 沙箱中推理、编写和运行代码、管理文件的智能体。该服务将循环和环境管理移至平台端,让开发者专注于产品构建而非基础设施。团队表示将快速迭代并欢迎反馈。AI产品智能体Gemini API托管服务推荐理由:做 AI 智能体开发的团队终于可以省去环境搭建的麻烦——单次 API 调用就能跑起一个完整智能体,建议直接试试。原文稍后读已读值得跟进有用关注 智能体
14:50官方一手歸藏(guizang.ai)@op7418精选76°MiniMax 正式发布大版本模型升级 MiniMax M3,核心亮点包括标配 1M 超长上下文、采用新的 MSA(MoE with Segment-wise Attention)稀疏注意力架构,以及从训练起就融合了文本、图片、视频和桌面操作的原生多模态能力。MSA 架构在 100 万上下文下每 token 计算量仅为上一代的约 1/20,大幅提升可落地性。API 价格同步更新,小于 512k 的 API 限时五折(7 天)。模型权重和技术报告将在约 10 天后开源。AI模型MiniMax M3长上下文稀疏注意力6 个信源在谈事件专题推荐理由:MiniMax M3 把长上下文、稀疏注意力和多模态融合做到了一个模型里,而且计算效率大幅提升,做 Agent 开发、多模态应用或长文档处理的团队可以直接用 API 试试,价格也很友好。原文稍后读已读值得跟进有用关注 MiniMax M3
12:14官方账号Runway ML@runwaymlRunway 宣布其 API 持续新增模型和端点,方便开发者将生成式 AI 能力直接集成到应用、产品和平台中。新增模型包括 Seedance 2.0、GPT Image 2、HappyHorse 1.0、Nano Banana Pro 和 Magnific Precision Upscaler V2 等。Runway API 旨在提供一站式模型服务,降低开发者集成多种生成式 AI 功能的门槛。此举有助于加速 AI 应用开发,尤其适合需要快速部署图像、视频生成能力的团队。AI产品RunwayAPI生成式AI推荐理由:Runway API 把多个热门生成模型整合到一起,做 AI 应用集成的开发者不用再四处对接不同 API,直接在一个地方调用 Seedance 2.0 和 GPT Image 2 等模型,值得试试。原文稍后读已读值得跟进有用关注 Runway
02:10官方账号xAI@xai83°xAI 宣布 grok-build-0.1 模型通过 API 进入公开测试阶段。该模型与驱动 Grok Build CLI 的模型相同,专为智能体编程场景优化。定价为每百万输入 token 1 美元、每百万输出 token 2 美元,兼具高性价比、智能性和速度。这是 xAI 在 AI 编程助手领域的重要布局,为开发者提供了新的选择。AI产品xAIgrok-build-0.1智能体编程推荐理由:做智能体编程的开发者有了一个性价比极高的新选择——grok-build-0.1 定价仅为 $1/$2 每百万 token,且专为 agentic coding 优化,值得在项目中试试它的表现。原文稍后读已读值得跟进有用关注 xAI
01:31OpenRouter@OpenRouterAIOpenRouter 宣布支持 OpenAI 模型的增量 diff 流式输出,通过 delta 事件逐步传输差异,而其他模型则返回完整补丁。用户可通过 `engine` 参数(auto、native、openrouter)控制行为。该功能让应用接收干净的结构化补丁并应用,下一轮交互时报告结果。这提升了流式输出的效率和实时性,尤其适合需要持续更新内容的场景。AI产品OpenAI流式输出增量 diff10 个信源在谈事件专题推荐理由:做实时协作或流式内容更新的开发者,现在可以用 OpenAI 模型获得增量 diff,减少带宽和延迟,建议试试 OpenRouter 的 engine 参数。原文稍后读已读值得跟进有用关注 OpenAI
00:57宝玉@dotey72°Anthropic 在发布 Claude Opus 4.8 的同时,上线了 API 层面的新能力:mid-conversation system messages(对话中途系统消息)。该功能允许在对话过程中动态修改系统提示词,且不影响 Prompt Caching。对于 Agent 开发者来说,这解决了之前无法在对话中途覆盖原始系统指令的痛点,例如让一个被设定为只写文档的系统设计师角色转变为可以写代码的开发工程师。目前该功能仅支持 Claude Opus 4.8,且仅在 Anthropic 自家 API 和 AWS 上的 Claude Platform 可用。系统消息不能放在对话开头,也不能连续放置两条,必须跟在 user 消息后面。AI产品Claude Opus 4.8AnthropicAPI10 个信源在谈事件专题推荐理由:做 Agent 开发的团队终于可以动态调整系统提示词了,不用再靠 hack 方式覆盖指令,建议直接试。原文稍后读已读值得跟进有用关注 Claude Opus 4.8
12:40LlamaIndex@llama_index精选LlamaIndex 今日发布了 LlamaParse Opus 4.8 版本,并公布了 ParseBench 评测结果。新版本在表格解析、语义格式和布局方面有轻微提升,但在图表解析和内容忠实度上出现小幅退步。同时,每页价格略有上涨。团队表示,在教 LLM 像人类一样阅读文档方面仍有大量优化空间。LlamaParse 依然是 AI 智能体最佳的文档摄取 API。AI产品LlamaParse文档解析ParseBench推荐理由:做文档解析或构建 AI 智能体的开发者,可以看看 ParseBench 的详细数据,评估是否值得升级。原文稍后读已读值得跟进有用关注 LlamaParse
04:44rohanpaul_ai@rohanpaul_ai大多数 AI 团队仍像从单一供应商买软件一样购买推理服务:选一个模型、接受固定价格、持续付费,即使更便宜的模型也能完成相同工作。The Grid AI 采用不同方法:用户只需选择任务等级(标准、高级、最大),系统自动将请求路由到符合该等级的最便宜供应商。这意味着应用使用同一 API,但背后的模型可随价格和质量变化。作者在 Ubuntu 上测试了 Hermes Agent 与 The Grid 的集成,用于读取支持工单、应用策略文件并编写分类报告。AI产品推理路由成本优化The Grid AI推荐理由:做 AI 推理的团队终于有了按需降本的方法——不用改代码就能自动切换更便宜的模型,适合处理大量相似任务的开发者直接试试。原文稍后读已读值得跟进有用关注 推理路由
02:01Claude@claudeai76°Anthropic 宣布为 Opus 4.8 模型推出 Fast 模式,在保持相同模型质量的前提下,推理速度提升约 2.5 倍,同时价格降至原来的三分之一。用户可在 Claude Code 中通过 /fast 命令启用该模式。API 用户需联系客户经理申请访问或加入等待列表。这一更新显著降低了使用成本并提升了响应速度,适合对延迟敏感或高频调用的场景。AI产品Opus 4.8Fast 模式Claude Code10 个信源在谈事件专题推荐理由:Opus 4.8 的 Fast 模式让重度 Claude 用户直接省下三分之二的 API 费用,同时响应更快,做自动化脚本或实时交互的开发者值得立刻试试 /fast 命令。原文稍后读已读值得跟进有用关注 Opus 4.8
00:35官方账号LangChain@LangChainAILangChain 宣布其 API 新增多项功能,包括创建智能体、更新配置、创建线程以及从产品工作流中流式运行。这些能力让开发者能更灵活地将 LangChain 集成到自己的平台中,实现自动化智能体管理。该更新降低了构建复杂 AI 工作流的门槛,尤其适合需要定制化智能体编排的团队。AI产品LangChain智能体API推荐理由:LangChain API 新增的智能体创建和流式运行能力,让做 AI 工作流编排的开发者可以直接在自己的产品中集成,省去自建编排层的麻烦,值得一试。原文稍后读已读值得跟进有用关注 LangChain
17:55IT之家(博客/媒体)5月28日上午,DeepSeek 出现服务故障,网页对话和API均受影响,官方状态页面显示为“部分中断”。故障于10:21被定位,10:50修复,持续约半小时。这是DeepSeek本月第五次服务问题,其中两次为完全中断。频繁故障可能影响用户信任和日常使用体验。行业DeepSeek服务故障API推荐理由:DeepSeek 本月已崩五次,做AI应用开发的团队需要评估其稳定性,建议关注官方后续的改进措施。原文稍后读已读值得跟进有用关注 DeepSeek
10:29IT之家(博客/媒体)OpenAI 于 5 月 27 日确认 ChatGPT 及其 API 服务出现高延迟问题,用户在北京时间凌晨遇到响应变慢。OpenAI 在状态页面于 22:47 确认问题,并于次日凌晨 4:06 修复。目前仍有 Codex 上下文压缩慢和安卓企业版切换工作区问题未完全解决。行业OpenAIChatGPTAPI10 个信源在谈事件专题推荐理由:API 延迟直接影响开发者和企业用户的业务效率,使用 OpenAI 服务的团队建议关注状态页面,避免在高峰期调用。原文稍后读已读值得跟进有用关注 OpenAI
09:48官方账号Greg Brockman@gdb精选76°OpenAI 宣布支持企业将 MCP 服务器部署在私有网络内,ChatGPT、Codex 和 Responses API 可通过出站 HTTPS 安全连接。这解决了企业数据隐私与 AI 工具集成之间的核心矛盾,让团队在不暴露内部服务的前提下使用 OpenAI 产品。开发者可以保持 MCP 服务器在内部网络,同时享受 OpenAI 的 AI 能力,无需担心数据外泄。该功能现已开放,适合需要安全 AI 集成的企业团队。AI产品MCP/工具OpenAI企业安全10 个信源在谈事件专题推荐理由:企业终于能安全地让 ChatGPT 和 Codex 连接内部数据了——做 AI 集成或数据安全的团队可以直接用,无需担心隐私泄露。原文稍后读已读值得跟进有用关注 MCP/工具
06:14rohanpaul_ai@rohanpaul_aiThe Grid 是一个智能推理路由层,它根据任务复杂度自动选择最合适的模型,并按实时市场价格计费,而非固定费率。用户只需定义任务等级(标准、高级、最大),The Grid 会在多个供应商中动态选择最便宜的可用模型。这避免了为简单任务支付高端模型费用,也摆脱了对单一供应商的依赖。新用户可免费使用前 2 亿 token。作者演示了如何将 Hermes Agent 与 The Grid 集成,在本地运行代理但通过 The Grid 调用 AI。AI产品推理成本模型路由供应商管理推荐理由:做 AI 应用开发的团队,如果还在为推理成本头疼,The Grid 的思路值得一试——它用市场机制替代了固定定价,简单任务不再花冤枉钱。原文稍后读已读值得跟进有用关注 推理成本
03:07官方一手@OpenAIDevs@OpenAIDevsOpenAI 宣布在 API 平台中引入 Workload Identity Federation,允许团队通过 IAM 工作流管理访问权限,减少在服务间分发永久 API 密钥的需求。这一更新使企业用户能够利用云身份认证(如 AWS、Azure、GCP)来访问 OpenAI API,提升安全性和管理效率。开发者可以更安全地集成 OpenAI 服务,无需担心密钥泄露风险。AI产品OpenAIAPI身份认证10 个信源在谈事件专题推荐理由:企业团队终于可以告别 API 密钥满天飞的安全隐患了——用云 IAM 管理 OpenAI 访问,做云原生集成的开发者值得试试。原文稍后读已读值得跟进有用关注 OpenAI
03:07官方一手@OpenAIDevs@OpenAIDevs76°OpenAI 宣布其产品(ChatGPT、Codex、Responses API)现在支持通过出站 HTTPS 连接私有 MCP 服务器。这意味着团队可以将 MCP 服务器保留在内部网络中,同时让 OpenAI 产品安全地访问这些服务器。这一更新解决了企业使用 AI 工具时数据安全与隐私的核心痛点,使得在保持数据不外泄的前提下,AI 助手能够调用内部工具和数据源。开发者可以通过 OpenAI 的 API 文档了解具体配置方法。AI产品OpenAIMCP/工具私有部署10 个信源在谈事件专题推荐理由:企业团队终于可以在不暴露内部网络的情况下,让 ChatGPT 和 Codex 安全调用私有 MCP 服务器——做 AI 集成和数据安全的开发者可以直接参考文档配置。原文稍后读已读值得跟进有用关注 OpenAI
19:26Skywork@Skywork_aiSkywork AI 宣布其 SkyClaw-v1.0 模型自上线以来访问量激增,导致服务拥堵。为保障整体服务稳定,平台临时实施限流措施。但 Skywork Agent 上的 SkyClaw-v1.0 使用不受影响。团队感谢用户理解与支持。AI产品SkyClaw-v1.0Skywork AI限流推荐理由:SkyClaw-v1.0 的火爆说明其能力受认可,但限流可能影响直接 API 调用者。如果你在用 Skywork Agent 或关注国产模型进展,这条值得留意——Agent 端仍可正常使用。原文稍后读已读值得跟进有用关注 SkyClaw-v1.0
14:34Geek@geekbb一个名为 tokei 的开源工具可在 macOS 菜单栏实时显示 Claude Code 和 Codex CLI 的 API 使用率和速率限制。该工具基于 GitHub 仓库 otoha1119/tokei 开发,支持监控 API 调用次数和限制阈值。用户无需打开终端即可查看当前使用状态,避免因超出速率限制导致服务中断。AI产品开源/仓库ClaudeCodex CLI1 个信源在谈事件专题推荐理由:监控 API 用量,避免超限原文稍后读已读值得跟进有用关注 开源/仓库
21:18IT之家(博客/媒体)DeepSeek 宣布其 API 已完成输出速度提升和服务扩容,默认支持 500 并发同时在线,企业用户可申请更大并发。此前,DeepSeek-V4-Pro 模型 API 价格将于 2026 年 5 月 31 日结束 2.5 折优惠,正式调整为原价的 1/4,大幅降低使用成本。此次升级旨在提升开发者体验,满足高并发场景需求。AI产品DeepSeekAPI服务扩容2 个信源在谈事件专题推荐理由:DeepSeek API 提速扩容后,默认 500 并发对高流量应用开发者是直接利好,配合即将到来的降价,做 AI 应用或服务的团队值得关注。原文稍后读已读值得跟进有用关注 DeepSeek
23:05Philipp Schmid@_philschmid精选83°Google I/O 上,Phil Schmid 展示了 Gemini Managed Agents 的新 Interactions API,允许开发者通过一次 API 调用为 AI 提供一个安全托管的 Linux 沙箱环境。这个沙箱让 AI 可以执行代码、管理自己的内存,相当于拥有了一个独立的“电脑”。这大大简化了构建复杂智能体的流程,降低了开发门槛。对于需要让 AI 自主操作环境的场景,这是一个重要的基础设施更新。AI产品智能体GeminiAPI推荐理由:做智能体开发的团队终于可以省去自己搭建沙箱的麻烦——一次 API 调用就能给 AI 一个安全 Linux 环境,建议直接看演示。原文稍后读已读值得跟进有用关注 智能体
22:50IT之家(博客/媒体)DeepSeek 官方宣布,DeepSeek-V4-Pro 模型 API 将于 2026 年 5 月 31 日结束 2.5 折优惠活动后,正式调整为原定价的 1/4,即永久保持当前折扣水平。原价输入(缓存命中)0.1 元/百万 Tokens、输入(缓存未命中)12 元/百万 Tokens、输出 24 元/百万 Tokens,降价后相当于缓存未命中输入降至 3 元/百万 Tokens,输出降至 6 元/百万 Tokens。这一调整意味着开发者可以长期享受低成本调用高性能模型的便利,无需担心优惠到期后价格反弹。AI产品DeepSeekAPI降价2 个信源在谈事件专题推荐理由:DeepSeek 把 API 价格直接砍到 1/4 并永久生效,做 AI 应用开发或高频调用大模型的团队可以放心接入,不用再盯着优惠截止日期了。原文稍后读已读值得跟进有用关注 DeepSeek
13:52Ate-a-Pi@svpino开发者Santiago Valdarrama发布了一个从零开始构建语音智能体的分步视频教程。他使用Claude Code编写代码,并利用AssemblyAI新推出的Voice Agent API,该API整合了语音识别、自然语言处理和语音合成等12个组件,简化了开发流程。教程展示了如何快速搭建一个功能完整的语音智能体,无需手动编写大量代码或拼接多个服务。AI产品语音智能体Claude CodeAssemblyAI推荐理由:想快速上手语音智能体开发的开发者,这个教程直接给你一条捷径——用Claude Code和AssemblyAI的API,省去拼接12个组件的麻烦,建议跟着视频实操一遍。原文稍后读已读值得跟进有用关注 语音智能体
10:08IT之家(博客/媒体)83°智谱今日面向部分企业客户推出 GLM-5.1 高速版 API,输出速度达到 400 tokens/s,刷新全球大模型 API 速度上限。该模型首次在国产大模型中实现旗舰级能力与低延迟的结合,打破了高速模型通常为轻量级模型的行业惯例。GLM-5.1 高速版由智谱 GLM 团队与 TileRT 团队联合打造,在推理引擎、调度系统和基础设施三个层面进行系统级优化,确保 400 TPS 是稳定可用的生产级能力。该模型适用于 AI 编程、实时交互、商业决策、实时语音等对响应延迟要求高的场景,现已面向部分企业客户开放服务。AI模型智谱GLM-5.1高速推理推荐理由:智谱把旗舰模型的推理速度拉到 400 tokens/s,做实时交互、AI 编程的团队可以直接用,延迟敏感场景终于有了国产高性能选项,建议点开看技术细节。原文稍后读已读值得跟进有用关注 智谱
15:20AI Will@FinanceYF5Google 发布了全新模型 Gemini Omni,能够根据任意输入(如文本、图像、音频)生成任意输出内容,首先支持视频生成。该功能将集成到 Gemini App、Flow 和 YouTube 中,API 支持即将推出。Omni 被视为“Nano Banana”的视频版,标志着多模态生成能力的重大突破。这一进展将极大简化内容创作流程,尤其对视频创作者和开发者意义重大。AI产品Gemini Omni多模态生成视频生成推荐理由:多模态生成从文本扩展到视频,做内容创作或视频开发的团队可以直接在 Gemini App 和 YouTube 中体验,建议第一时间试用。原文稍后读已读值得跟进有用关注 Gemini Omni
08:00Replicate@replicate72°Google 的 Gemini 3.5 Flash 模型已通过 Replicate 平台提供 API 访问。该模型被官方称为目前最快、最高效的模型,擅长处理日常任务和多步骤创意项目,能应对真实世界的复杂性。开发者现在可以通过 Replicate 的 API 直接调用,无需自行部署。这为需要快速集成 AI 能力的团队提供了便捷选择。AI产品Gemini 3.5 FlashReplicateAPI推荐理由:对于需要快速集成高效 AI 模型的开发者,Gemini 3.5 Flash 通过 Replicate API 直接可用,省去部署成本,值得一试。原文稍后读已读值得跟进有用关注 Gemini 3.5 Flash
08:00HeyGen@HeyGen_Official83°HeyGen 发布了其最高质量的 AI 虚拟形象模型 Avatar V API,定价为每秒 0.05 美元。该模型在跨场景说话头像生成任务中,与 Veo 3.1、Kling O3 Pro、OmniHuman 1.5 和 Seedance 2.0 进行了基准测试,并在所有类别中胜出。HeyGen 同时发布了研究论文和 API 接口,供开发者直接使用。这标志着 AI 虚拟形象生成在质量和成本上迈出了重要一步,尤其适合需要高保真数字人视频的应用场景。AI产品虚拟形象API数字人推荐理由:HeyGen 的 Avatar V 在跨场景说话头像生成上全面领先竞品,做数字人、虚拟主播或视频生成的开发者可以直接用 API 接入,成本可控且效果顶级。原文稍后读已读值得跟进有用关注 虚拟形象
08:00Philipp Schmid@_philschmidGoogle 正式推出 Gemini 3.5 模型,并同步发布了开发者指南和 AI Studio 平台。开发者指南提供了详细的 API 文档和集成示例,帮助快速上手。AI Studio 则是一个在线实验环境,支持直接测试模型能力。这一更新意味着开发者可以更便捷地利用 Gemini 3.5 构建应用,尤其适合需要多模态理解或长上下文处理的场景。AI产品Gemini 3.5开发者指南AI Studio5 个信源在谈事件专题推荐理由:做 AI 应用开发的团队可以直接用 Gemini 3.5 的 API 和 AI Studio 快速验证想法,省去本地部署的麻烦,值得点开看看文档和示例。原文稍后读已读值得跟进有用关注 Gemini 3.5
08:00HeyGen@HeyGen_OfficialHeyGen宣布降低其API栈的定价,同时声称在逼真度、唇形同步、动作质量和身份一致性方面仍优于竞争对手。此举旨在让AI视频生成更易于规模化,降低开发者与企业使用成本。降价后,用户能以更低价格获得高质量AI视频输出。这对于需要大量生成视频内容的团队来说是一个重要利好。AI产品HeyGenAI视频生成API推荐理由:做AI视频生成或内容制作的团队,现在可以用更低成本获得HeyGen的高质量输出,值得关注并尝试接入API。原文稍后读已读值得跟进有用关注 HeyGen
08:00官方账号Sam Altman@samaOpenAI 宣布推出 Guaranteed Capacity 服务,允许客户通过 1-3 年承诺获得折扣算力,并确保长期稳定的计算资源访问。Sam Altman 表示,随着模型能力提升,全球算力将长期受限,此举既帮助客户规划关键工作负载,也帮助 OpenAI 优化基础设施投资。该服务面向需要确定性算力的大客户,旨在实现双赢。AI产品OpenAI算力保障企业服务8 个信源在谈事件专题推荐理由:算力不确定性是当前 AI 部署的最大瓶颈之一,OpenAI 用长期承诺和折扣解决了这个问题——做大模型应用或依赖 API 的团队,现在可以锁定成本并规划生产环境,值得关注。原文稍后读已读值得跟进有用关注 OpenAI
08:00官方账号OpenAI@OpenAI (@OpenAI)OpenAI 宣布推出 Guaranteed Capacity 服务,允许客户长期预留 OpenAI 计算资源。该服务基于 OpenAI 在基础设施、合作伙伴关系和容量规划方面的长期投资,旨在帮助客户在计算资源受限的环境中为关键工作负载提前规划。这对于依赖 OpenAI API 进行大规模推理或训练的企业用户尤为重要,可避免资源争抢和不可预测的访问限制。AI产品OpenAI计算资源企业服务6 个信源在谈事件专题推荐理由:依赖 OpenAI API 做关键业务的企业团队终于可以提前锁定计算资源,避免高峰期排队或限流,建议有稳定推理需求的团队直接了解。原文稍后读已读值得跟进有用关注 OpenAI
07:59AI Will@FinanceYF572°Anthropic 于 5 月 18 日宣布收购 Stainless,这家公司虽不为人熟知,但几乎所有使用 Claude API 的开发者都依赖其生成的 SDK。Stainless 专注于自动生成高质量、多语言的 API 客户端库,收购后有望提升 Claude API 的开发者体验和生态兼容性。此举表明 Anthropic 正在加强基础设施层,以吸引更多开发者并加速企业级应用落地。行业AnthropicStainlessSDK10 个信源在谈事件专题推荐理由:Stainless 的 SDK 生成能力直接关系到 Claude API 的易用性和集成效率,做 AI 应用开发的团队值得关注——未来调用 Claude 可能更丝滑,建议点开了解收购背后的生态布局。原文稍后读已读值得跟进有用关注 Anthropic
07:59Google AI Developers@googleaidevsGoogle 在 Gemini API 中推出了托管智能体(Managed Agents)功能,开发者只需一次 API 调用即可构建生产级智能体。该功能降低了智能体开发的门槛,无需管理底层基础设施。Google 通过 Twitter 线程详细介绍了其用法和优势,旨在让更多开发者快速上手并部署智能体应用。AI产品智能体Gemini API托管智能体推荐理由:Google 把智能体部署简化到一次 API 调用,做 AI 应用开发的团队可以大幅降低运维成本,值得立即上手体验。原文稍后读已读值得跟进有用关注 智能体
00:44Philipp Schmid@_philschmid76°Google AI Studio 为 Gemini 推出了一个独立的 Linux 沙盒环境,允许模型在一个 API 调用中完成推理、运行代码、浏览网页和管理文件。用户可以通过 Markdown 定义自定义行为、添加技能、挂载仓库和提供凭证。目前处于早期预览阶段,沙盒计算资源免费。这一功能大幅简化了 AI 代理的构建流程,开发者无需再手动编排多个工具。AI产品Gemini沙盒API推荐理由:做 AI 代理和自动化流程的开发者终于可以一个 API 搞定推理+执行+文件管理,省去繁琐的工具链编排,建议直接去 AI Studio 体验免费沙盒。原文稍后读已读值得跟进有用关注 Gemini
09:34rohanpaul_ai@rohanpaul_ai72°Google 发布了 Gemini 3.5 Flash 模型,在多项基准测试中超越了 Gemini 3.1 Pro,成为同级别中的最强模型。该模型具备智能体能力,每秒 token 处理速度提升 4 倍。AI/ML API 平台已集成该模型,并提供 24 小时免费使用。开发者可快速体验其强大性能。AI模型Gemini 3.5 Flash推理模型智能体推荐理由:Gemini 3.5 Flash 以更小体量超越 Pro 级模型,做智能体或高吞吐应用的开发者值得立即体验,尤其是 API 限免窗口仅 24 小时。原文稍后读已读值得跟进有用关注 Gemini 3.5 Flash
07:02官方账号Simon Willison’s Weblog(博客/媒体)83°谷歌在 I/O 大会上正式发布 Gemini 3.5 Flash,跳过预览版直接进入通用可用阶段。该模型支持 104 万输入 token 和 6.5 万输出 token,知识截止于 2025 年 1 月。价格显著上涨:输入每百万 token 1.5 美元,输出 9 美元,是前代 3 Flash Preview 的 3 倍、3.1 Flash-Lite 的 6 倍,接近 3.1 Pro 水平。尽管如此,谷歌仍将其部署到 Gemini 应用、AI 搜索模式、Antigravity 平台、AI Studio 等全线产品。同时推出新的 Interactions API(测试版),类似 OpenAI 的服务器端历史管理。这反映出三大 AI 实验室都在试探 API 客户的价格承受力。AI模型Gemini 3.5 Flash谷歌 I/O模型定价6 个信源在谈事件专题推荐理由:Gemini 3.5 Flash 价格翻倍但谷歌全线铺开,做 AI 应用开发的团队需要评估成本变化,建议点开看看定价对比和 API 新特性。原文稍后读已读值得跟进有用关注 Gemini 3.5 Flash
03:38官方一手Google Blog: AI(博客/媒体)72°Google I/O 2026 大会上,Google 发布了一系列 AI 和开发者工具更新,旨在让 AI 更贴近实际应用。重点包括 Gemini 模型的进一步整合、新的开发工具链,以及面向企业和个人的 AI 功能。这些更新降低了 AI 开发门槛,同时提升了用户体验。对于开发者而言,新的 API 和平台支持将加速 AI 应用的构建和部署。AI产品Google I/OGemini开发者工具推荐理由:Google I/O 2026 的 AI 更新直接影响了开发者和企业用户,做 AI 应用或依赖 Google 生态的团队可以快速了解新工具和 API,建议点开看看哪些能直接用到你的项目中。原文稍后读已读值得跟进有用关注 Google I/O
03:20官方账号Google DeepMind@GoogleDeepMind78°Google DeepMind 宣布将 3.5 Flash 模型全面推向 GeminiApp 和 Google 搜索的 AI 模式。开发者可通过 Antigravity 和 Gemini API 在 Google AI Studio 中开始构建。这是 Google I/O 期间的重要更新,意味着更快速、更高效的 AI 能力将直接服务于用户和开发者。3.5 Flash 模型在推理速度和成本上进行了优化,适合实时交互场景。AI产品3.5 FlashGeminiAppGoogle 搜索推荐理由:Google 把 3.5 Flash 直接塞进搜索和 GeminiApp,做 AI 应用或搜索增强的开发者可以立刻在 API 里试,用户也能在搜索中体验更快的 AI 回复。原文稍后读已读值得跟进有用关注 3.5 Flash
08:25IT之家(博客/媒体)72°Anthropic 宣布收购软件基础设施初创公司 Stainless,成交额超 2.8 亿欧元(约 22.18 亿元人民币)。Stainless 专注于自动化创建和维护 SDK,能将 API 规格说明直接转换成可部署工具,并支持多种编程语言,在 API 变化时自动更新代码。收购后,Stainless 关闭所有外部托管服务,现有客户无法再获得官方更新。此举使 OpenAI、谷歌等此前依赖 Stainless 的 AI 实验室失去关键工具,Anthropic 则强化了对 AI 智能体开发连接层的控制。行业AnthropicStainlessSDK/工具10 个信源在谈事件专题推荐理由:Stainless 的 SDK 自动化工具曾是 OpenAI、谷歌等团队的共用基础设施,Anthropic 的收购直接切断了竞争对手的依赖,做 AI 智能体或 API 集成的开发者值得关注这一战略变化。原文稍后读已读值得跟进有用关注 Anthropic
12:15向阳乔木@vista8Hermes 用户可通过订阅或 API 配置国内外主流模型,包括 OpenAI Codex 的 gpt-5.5、xAI Premium 的 grok-4.3、谷歌 Gemini 的 gemini-3.1-pro-preview 和 gemini-3-flash-preview、DeepSeek 的 deepseek-v4-pro 和 deepseek-v4-flash、智谱的 glm-5.1 和 glm-5-turbo、Kimi 的 kimi-k2.6 以及小米的 mimo-v2.5-pro。配置后可通过 /model 指令在机器人对话中切换模型。该指南为 Hermes 用户提供了清晰的模型接入路径,覆盖了从订阅到 API 的多种方式,适合需要灵活调用不同 AI 模型的开发者和重度用户。AI产品Hermes模型配置API10 个信源在谈事件专题推荐理由:Hermes 用户终于有了清晰的模型配置清单,覆盖 OpenAI、xAI、谷歌、DeepSeek、智谱、Kimi、小米等主流模型,做多模型切换的开发者可以直接按指令配置,省去摸索时间。原文稍后读已读值得跟进有用关注 Hermes