想省token跑agentic任务?试试Ling-3.0-flash,124B参数只激活5B,OpenRouter上免费到8月3日。
Kimi K3 马上就能在 Together AI 上用了,7月27日当天就能跑编程和智能体任务,想抢先体验的快去试试。
Amazon 开源了 Perception Agents 框架,让智能体学会感知真实混乱环境,直接解决知识工作中的痛点,值得关注。
讲Poolside怎么用Model Factory快速做模型,Laguna S的思路,以及他们看好更多基础模型公司。
阿里刚发了Qwen-Audio-3.0-TTS Plus,语音更自然好听,还支持多语言和不同风格,做语音合成的可以试试。
阿里出了个新TTS,能实时克隆声音,连不好的录音都能用,交互时延迟很低。
PrimeIntellect 用 vLLM 把 agentic RL 搞到万亿参数级了,FP8 加专家并行,28 个 H200 节点跑 131k 序列,每步不到 5 分钟,训练 GLM-5 做 SWE 任务。
Offloop搞了个D1路由层,3B参数就能自动调度多个AI agent,基准上干掉了Claude Code和Codex,挺有意思。
微软新模型上线OpenRouter,图像更清晰,语音更实时,适合开发者和创作者试玩。
需要更快更自然的语音合成?微软新模型速度快两倍,15种语言随意切换,适合搭实时语音Agent。
OpenRouter 分享了微软新模型的介绍页面,想了解具体有什么新模型可以点进去看看。
AMD 亮出真家伙:MI455X 堆了 432GB HBM4 和 3200 亿晶体管,FP4 算力比上代快 4 倍,72 卡显存比英伟达 Rubin 多一半,直接对标 NVL72。
Black Forest Labs的Flux 3能生成带声音的视频,最长20秒,性能还略超Seedance 2.0,他们想搞世界模型,值得关注。
Offloop用D1调度器解决了多智能体互相重复工作的老问题,成本低还让你用自己订阅的AI。
看看 Epoch AI 怎么用 Slay the Spire 测试 GPT-5.6 Sol 的游戏智商,和之前的基准很不一样。
OpenAI公布新数据,每周3亿人用ChatGPT问健康,还出了GPT-5.6 Sol专门优化复杂问答,免费用户也能体验升级。
微软把MAI模型塞进了PPT、OneDrive和Bing,成本降了84%,速度还快了,效果挺猛。
微软新语音模型MAI-Voice-2-Flash,跑得快还便宜32%,支撑企业呼叫中心,GPU成本能砍89%。
微软推出 MAI-Image-2.5-Pro 预览版,生成图像质量最高,还能精准渲染文字,适合专业场景。
花5美元用托管RL把Nemotron 3 Nano的数学准确率从22%拉到91%,还能一键扩展到更大模型,太实用了!
Gary Marcus解释了现在ChatGPT和Claude比两年前强的原因——它们加了层'Harness'变成神经符号系统了。
有人把Kimi的视觉编码器接到GLM 5.2上,开源了量化权重,让GLM 5.2能看图片了。这种插件式玩法很实用。
Black Forest Labs 开源了 Flux 3,能文生视频、图生视频、视频延长和智能剪辑,功能很全面,还支持多语言和多种视觉风格,值得试试。
Black Forest Labs 开源了 Flux 3,功能超全:文生视频、图生视频、关键帧控制、视频延长,还支持文字动画和智能剪辑,像开源的 Sora。
Milvus团队搞了个Vector Graph RAG,用向量库替代图数据库做多跳检索,效果更好还更省钱。一次安装就能跑,适合知识密集场景。
看 FLUX 3 怎么把“小孩拿泳池面条打架”这种日常脑洞变成电影级画面,黑森林团队又秀了一把。
Black Forest Labs 的 FLUX 3 能用一个提示生成20秒多镜头真实视频,还可以做图像、音频和机器人预测,很值得试试。
Miles 发布了 OPD 方法,让 Qwen3.5 模型推理更快更准,无需任务奖励,比传统蒸馏更高效,适合模型压缩场景。
Poolside的Laguna S 2.1是个118B参数的稀疏MoE模型,只激活8B参数,SWE-bench多语言拿下78.5%,还能跑在单个DGX Spark上,适合长时编程任务。
阿里出了个TTS新模型,能用标签控制笑声耳语,还能自然语言调语速,排行榜第一,支持16语言。
Anthropic 的 Claude Opus 5 可能今晚就上线,赶紧关注供应商动向
Deepgram 出了 Nova-3,语音转文字更准了,还支持多语言,做转录工具很实用。
Deepgram发布了Aura-2多语言TTS,能生成7种语言的语音,现已上架OpenRouter,适合需要多语种语音合成的场景。
智谱开源GLM-5.2,1M上下文还让Hugging Face自己部署搞定了安全事件,比闭源模型更灵活。
Poolside的Laguna S 2.1小巧但能打,花几分钱就解了1975年的数学难题,代码能力强过很多大模型,开源还能自己玩。
黑森林工作室的 FLUX 3 预告来了,全模态还能一次生成20秒视频,可能开源,老用户该关注了。
Plasma AI 刚开源了 Fractal,每个节点自己循环决策,遇到子任务自动分叉,适合做复杂多步工作流,不用手动写死流程。
Google要砸2050亿美元推Gemini 4,Pichai说模型规模是关键,看看他们怎么规划下一步。
专家辟谣了!Kimi K3不是靠‘偷’Fable,它有真本事,想了解内幕的来读。
Apodex 1.0-H 让智能体团队协作处理复杂任务,还用独立验证提升准确率。每月10万算力补贴,研究机构别错过。
仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。