Google 的 Gemini 4 据说要这两天就发,The Information 爆料的,感兴趣的可以先蹲一下官方消息。
谷歌Google
美国·Mountain View
Gemini 模型、DeepMind 与 TPU 算力
在做什么
谷歌隶属 Alphabet,总部在加州山景城。AI 研究主要由 Google DeepMind 承担,产品包括 Gemini 系列模型、视频生成模型 Veo、自研 TPU 芯片和 Google Cloud 算力服务。
最近动态
信息流里提到这家公司的条目The Information 称 Google 将在两天内发布旗舰 Gemini 4 模型
模型价格战:OpenAI 代币降价 62%,GPU 租金却涨 50%
Ornn 拉了三个月数据:OpenAI 降价 62%,DeepSeek 降 51%,但 B200 租金反涨 50%。想搞清楚钱最后流向谁的,看这篇。
OpenAI 称 ChatGPT 与苹果合作表现远低于预期
OpenAI 头一回公开吐槽苹果:ChatGPT 塞进几亿台 iPhone 也没带来多少订阅,苹果还转头找了谷歌 Gemini,法庭文件里细节不少。
IT之家原文
Gemini 3.8 TTS 模型发布:支持多语音对话生成,价格更低
Gemini 3.8 的语音合成变便宜了,能一次生成多人对话,2000 多种声音可选还能克隆,Simon Willison 已经拿来做 demo 玩了。
Google 发布 Gemini 3.8 Flash TTS 两款语音模型,支持 30 秒克隆自定义音色
Google 新出的 TTS 模型支持 30 秒音频克隆音色,还能让多个角色用不同声音对话,生成 1 分多钟音频只要 2.74 美分。
Google 论文提出 RRSI:防止智能体 harness 自动进化过拟合基准
Google 这篇论文值得做 Agent 的人细读:自动优化 harness 会让你 eval 分数涨但真实任务变差,RRSI 用双向正则化解决了这个问题。
Google 发布 Gemini 3.8 Flash TTS,可用文字描述自定义语音
Google 新出的 Gemini 3.8 Flash TTS 能用一句话描述就造出音色,还能一段剧本生成双人对话,做播客和配音的可以试试。