18:13AI SDK@aisdkSpaceXAI发布Grok 4.6,称其达到前沿智能水平。相比Grok 4.5,Grok 4.6有显著改进,且定价保持不变。开发者可通过AI SDK在应用中集成Grok 4.6。AI模型Grok 4.6Grok 4.5SpaceXAI推荐理由:SpaceXAI刚发Grok 4.6,能接AI SDK,跟4.5同价但更强,搞开发的可以试试。原文稍后读已读值得跟进有用关注 Grok 4.6
18:10elvis@omarsar0Grok 4.6正式发布,官方称其具备前沿智能。相比Grok 4.5,性能显著提升,但价格维持不变。原推文对Grok 4.6能否媲美Fable 5的质量表示不确定。目前官方未公布具体基准测试数据。AI模型Grok 4.6Grok 4.5SpaceXAI推荐理由:哎,Grok 4.6出来了,说比4.5强不少,价格没变。到底能不能打Fable 5还不清楚,先观望下。原文稍后读已读值得跟进有用关注 Grok 4.6
12:40AI Will@FinanceYF5xAI 官方账号发布 Grok 4.6,称其具备前沿智能水平。官方表示,Grok 4.6 相比上一代 Grok 4.5 有显著改进,但价格维持不变。目前官方尚未公布具体基准测试数据。AI模型Grok 4.6Grok 4.5xAI推荐理由:xAI 悄悄发了 Grok 4.6,说是比 4.5 强不少,还维持原价。用过 4.5 的可以关注下,没准能直接升级。原文稍后读已读值得跟进有用关注 Grok 4.6
12:39AI Will@FinanceYF5精选xAI 在 Grok 4.5 基础上进行了更长的补充训练,加入推理、工程和高级技术数据,并让 Grok 4.5 重新生成 SFT 轨迹。强化学习阶段覆盖知识工作、通用编程、内核优化、网页开发和 CAD 等任务,目标直指复杂工程技术场景。AI模型Grok 4.5xAI推理模型推荐理由:xAI 把 Grok 4.5 又练了更长一轮,还专门强化编程、内核和 CAD,想搞技术活的话可以看看。原文稍后读已读值得跟进有用关注 Grok 4.5
03:27官方一手歸藏(guizang.ai)@op7418精选SpaceX AI 发布 Grok 4.6 模型,官方称其达到前沿智能水平。相比 Grok 4.5,Grok 4.6 在相同价格下性能显著提升。定价为每百万输入 token 2 美元、每百万输出 token 6 美元。Twitter Premium+ 会员可通过 Grok Build 授权免费使用。AI模型Grok 4.6SpaceX AIGrok 4.58 个信源在谈事件专题推荐理由:想用前沿模型又嫌贵?Grok 4.6 比 4.5 强但价格不变,输入百万才 2 美元,Twitter 会员还能白嫖。原文稍后读已读值得跟进有用关注 Grok 4.6
09:47宝玉@dotey精选一位硅谷AI大厂团队负责人申请100万美元预算,让20多人团队不限量使用Token。结果显示,成员单日最高花费7000美元,团队中位数2000美元,AI成本超过大部分人的月工资。团队普遍反映更累,会议数环比减少近80%,变成AI与AI对话。最受欢迎模型是GPT-5.6 Sol Fast和Fable 5 Fast,但便宜模型Grok 4.5因反复迭代反而更贵。作者认为效率提升最大的是组织从0到1使用AI,现有组织架构为人设计,导致Token无限使用出现天花板。行业GPT-5.6Grok 4.5Token推荐理由:硅谷团队烧了100万美元试无限Token,结果AI比人贵,开会少八成,想搞AI转型的得看看这个真实教训。原文稍后读已读值得跟进有用关注 GPT-5.6
21:31Geek@geekbb精选作者在推文中表示,他用 Oh My Pi 搭配 Grok 4.5,替换掉了此前使用的所有 Agent。部署场景覆盖 VPS、OpenWrt 路由器以及通过 tty7 接入的 macOS。Pi 自带 read、bash、edit、write 这 4 个内置工具,作者认为这些已是编码 Agent 所需的大部分能力。他还展示了用 Pi 的 SDK 将这些原语集成到自有应用的代码。作者把模型切换为 DeepSeek V4 Flash 与 Grok 4.5 的组合,称个人场景下“无敌”。技巧PiOh My PiGrok 4.57 个信源在谈事件专题推荐理由:哥们儿用 Oh My Pi 把 VPS 和路由器的 Agent 全换了,Pi 就靠 read/bash/edit/write 四个内置工具干活,说个人场景很够用。原文稍后读已读值得跟进有用关注 Pi
00:28官方账号Cursor@cursor_ai没有任何模型能在所有任务上占优:Grok 4.5 在常规任务上性价比高。GPT-5.6 Sol 擅长规划与代码库理解。Opus 5 适合执行密集型工作。Fable 5 在调试和视觉实现上更出色。技巧Grok 4.5GPT-5.6 SolOpus 58 个信源在谈事件专题推荐理由:选模型别纠结了:常规任务选 Grok 4.5,规划代码库找 GPT-5.6 Sol,重执行用 Opus 5,调试看 Fable 5。原文稍后读已读值得跟进有用关注 Grok 4.5
12:24Geek@geekbb75°VulcanBench 用 23 个真实软件工程任务评测模型,Qwen3.8-Max 跑完全套成本 126.25 美元,DeepSeek V4-Flash 仅需 13.60 美元。Qwen3.8-Max 每个任务耗时 20-25 分钟,是测试中最慢的模型,固定预算下最佳设置只排中游,默认设置垫底。六个原本能解决的任务贡献了 26 分降幅的 83%,其中三个得分直接归零。在准确率上 Grok 4.5 领先,按每美元准确率 DeepSeek V4-Flash 很难被击败。AI模型VulcanBenchQwen3.8-MaxDeepSeek V4-Flash7 个信源在谈事件专题推荐理由:VulcanBench 实测:Qwen3.8-Max 跑一趟 126 美元,DeepSeek V4-Flash 只要 13.6 美元,便宜 10 倍还更快。选性价比就 DeepSeek,选准确率就 Grok 4.5。原文稍后读已读值得跟进有用关注 VulcanBench
23:08Viking@vikingmutevikingmute 分享了一套多模型协作调试流程:几轮搞不定的问题,用 /handoff 把会话压成交接文档,避免上下文被污染。他还会并行开 worktree 让多个模型改 bug,最后由主模型 reconcile。以 GPT 5.6 两次十分钟以上未完成的任务为例,Grok 4.5 三分钟就搞定了,所以别在一个模型上恋战。技巧GPT 5.6Grok 4.5/handoff推荐理由:改 bug 别恋战:/handoff 交接 + 多模型并行,GPT 5.6 卡住的活 Grok 4.5 三分钟搞定。原文稍后读已读值得跟进有用关注 GPT 5.6
09:34IT之家(博客/媒体)马斯克旗下xAI的Grok 4.5模型已入驻GitHub Copilot平台,开发者可在云智能体、Copilot CLI及VS Code等环境中切换调用。该模型专为编码设计,上下文窗口最大50万token,支持文本和图像输入,并提供低、中、高三种推理难度。测试显示Grok 4.5在VS Code和Copilot CLI终端编码任务中表现出色,特别擅长并行调度和直接操作,适合探索性开发与时间敏感任务。收费为每百万输入Token 2美元,每百万输出Token 6美元。AI产品Grok 4.5GitHub Copilot编程助手推荐理由:GitHub Copilot现在能用Grok 4.5了,上下文窗口大、推理可调,编码能力很强,价格也划算。原文稍后读已读值得跟进有用关注 Grok 4.5
15:42Aman Sanger@amanrsangerCursor 宣布印度用户数量在过去一年增长三倍,且人均 agent 请求量全球最高。新推出的 Cursor Start 计划定价 ₹649/月,提供对 Grok 4.5 和 Composer 的慷慨访问权限。该计划面向印度开发者,Grok 4.5 和 Composer 都是高效低成本的模型。AI产品CursorGrok 4.5Composer7 个信源在谈事件专题推荐理由:Cursor 为印度开发者搞了个 ₹649/月的新订阅,包含 Grok 4.5 和 Composer,适合日常开发用。原文稍后读已读值得跟进有用关注 Cursor
06:27Guillermo Rauch@rauchgGrok 4.5在Vercel的DeepsecBench网络安全漏洞检测基准中取得最佳性价比。其成本仅为Sol的1/10、Opus 5的1/5.7、Kimi K3的1/2.2,但性能与Kimi K3相近。Sol仍保持最高准确率分数,领先Opus 5。Kimi K3以1/5成本获得Sol一半的分数。AI模型Grok 4.5SolDeepsecBench推荐理由:Grok 4.5做安全漏洞检测,比Sol便宜10倍但性能接近Kimi,预算有限的团队可以考虑它。原文稍后读已读值得跟进有用关注 Grok 4.5
15:47官方一手歸藏(guizang.ai)@op7418精选CodePilot 新增通过 Super Grok(Twitter 账号)授权免费使用 Grok 4.5 的功能,已购买 Twitter Premium 的用户额度更高。同时集成千问 3.8 Max Preview 模型。授权路径:设置 > 服务商 > 添加服务 > 选择 XAI Grok OAuth。AI产品CodePilotGrok 4.5千问 3.8 Max推荐理由:CodePilot 现在能免费蹭 Grok 4.5 了,还支持千问 3.8 Max,有 Twitter 账号就能白嫖,快去设置里授权。原文稍后读已读值得跟进有用关注 CodePilot
15:20官方一手歸藏(guizang.ai)@op7418CodePilot 最新更新支持通过 Super Grok(Twitter 账号)授权免费使用 Grok 4.5。Twitter Premium 用户可获得更高额度。同时平台推出新的千问 Token Plan,现可正常使用千问 3.8 Max Preview 模型。用户可通过“设置-服务商-添加服务-XAI Grok OAuth”路径添加 Grok 授权。AI产品CodePilotGrok 4.5千问3.8 Max Preview推荐理由:CodePilot 现在能免费连 Grok 4.5,还支持千问3.8,白嫖老马算力,写代码更爽。原文稍后读已读值得跟进有用关注 CodePilot
00:54The Rundown AI@therundownaiGoogle发布了Gemini 3.6 Flash和Gemini 3.5 Flash Lite两个新模型,主打效率提升和更低价格。与上一代Flash和Pro相比有升级,但多数基准测试成绩低于Grok 4.5和GPT-5.6 Luna。Google同时宣布已启动针对Gemini 4的“最大规模预训练”,但未提及Gemini 3.5 Pro。AI模型GoogleGemini 3.6 FlashGemini 3.5 Flash Lite10 个信源在谈事件专题推荐理由:谷歌发了两款新模型,速度和价格更香,但跑分不如Grok和GPT,想追新可以瞧瞧。原文稍后读已读值得跟进有用关注 Google
12:04向阳乔木@vista8一条Vista的推文列出了当前模型排行。Fable5位列第一,GPT 5.6 sol第二,Kimi K3第三,Grok 4.5第四,GLM 5.2第五。推文还指出GLM 5.2参数约750B,猜测若增加至1T~10T可能效果更好。同时对比了OpenAI研究员与Kimi研究员可用的算力资源差异。行业Fable5GPT 5.6 solKimi K310 个信源在谈事件专题推荐理由:看看新模型排行,Fable5和GPT 5.6 sol都靠前,Kimi K3排第三,智谱GLM才750B参数,潜力不小。原文稍后读已读值得跟进有用关注 Fable5
08:10berryxia@berryxiaGrok推出Excel插件Grok for Excel,用户可直接在电子表格中使用Grok 4.5构建财务模型、分析市场数据并生成图表。该功能扩展了Grok在职业场景的应用范围,与Claude的生态策略类似。目前插件已上线,用户可尝试。AI产品GrokGrok 4.5Excel插件推荐理由:Grok出了Excel插件,用Grok 4.5就能在表格里做财务分析和图表,打工人赶紧试试。原文稍后读已读值得跟进有用关注 Grok
00:52向阳乔木@vista8AI编程工具Codex的前端审美不佳,OpenCodex项目允许用户自由切换后端模型。支持非OpenAI模型如Kimi K3(OAuth)、Grok 4.5(OAuth)、GLM 5.2。用K3做前端设计,切GPT sol5.6做后端,还能随时调用Grok 4.5搜索X信息。该项目在GitHub上开放,热度已有1534次浏览。技巧CodexOpenCodexKimi K310 个信源在谈事件专题推荐理由:Codex用户注意,OpenCodex可以让你用K3、Grok等模型做前端,GPT做后端,切换超方便。原文稍后读已读值得跟进有用关注 Codex
09:54AI Will@FinanceYF576°Elon Musk 表示,将速度和成本纳入考量后,Grok 4.5 是目前第一名。在 Artificial Analysis 上,Grok 4.5 每项 Intelligence Index 任务仅花 $0.31,而 Claude Fable 5 为 $2.75、Claude Opus 4.8 为 $1.80、GPT-5.6 Sol 为 $1.04、Kimi K3 为 $0.95,Grok 4.5 成本比 Claude Fable 5 低近 9 倍。在 FrontierSWE 基准上,Grok 4.5 每任务 token 用量比 Fable 5 少近 6 倍,仍排名靠前。SpaceXAI 通过 token 效率实现顶级智能与低成本结合。AI模型Grok 4.5效率成本推荐理由:SpaceXAI 的 Grok 4.5 用 $0.31 就干到一流水平,比 Claude 便宜 9 倍,token 还省 6 倍,省钱党可以关注。原文稍后读已读值得跟进有用关注 Grok 4.5
07:15Windsurf@windsurf_aiDevin Desktop 和 CLI 新增了对 Inkling 和 Grok 4.5 模型的支持。FrontierCode 排行榜已上线,专门追踪模型生成的可合并代码质量。所有分数,包括 Grok 4.5 和 Inkling,以及完整方法论和示例任务均已公开。AI产品InklingGrok 4.5Devin Desktop7 个信源在谈事件专题推荐理由:Devin 桌面版和命令行现在能用 Inkling 和 Grok 4.5 了,还有个 FrontierCode 排行榜看谁的代码更靠谱,挺实用的。原文稍后读已读值得跟进有用关注 Inkling
06:20Cognition@cognition_labsCognition发布FrontierCode排行榜,专门评估模型生成可合并代码的能力。榜单包含Grok 4.5、Inkling等模型的得分。官方提供了完整的评分方法和示例任务。AI模型FrontierCodeGrok 4.5Inkling10 个信源在谈事件专题推荐理由:想知道哪个AI写代码最靠谱?FrontierCode榜单直接告诉你哪些模型写的代码能直接合并。原文稍后读已读值得跟进有用关注 FrontierCode
00:25elvis@omarsar0Gavin Baker指出,Kimi K3可能成为AI的重要转折点。Kimi K3推理成本比GPT 5.6高50-70%(Artificial Analysis),且token效率低,每个任务的实际成本高于GPT 5.6和Grok 4.5。开源模型需要相同算力运行,但会降低模型层利润率,利好基础设施和应用层。这一趋势可能对Anthropic和OpenAI不利,但对其他公司是净正面。行业Kimi K3GPT 5.6Grok 4.510 个信源在谈事件专题推荐理由:Gavin Baker说Kimi K3可能改变AI格局,开源模型会让推理更便宜,对大部分公司利好。原文稍后读已读值得跟进有用关注 Kimi K3
18:31shao__meng@shao__meng76°Cursor 团队在 AI Engineer 大会分享其自动化 AI 研究框架,包含外循环(基于真实用户反馈和 A/B 测试结果改进模型)和内循环(优化训练过程,如生成更难 RL 环境)。Composer 2.5 成为产品内最受欢迎模型,得益于更多 RL 环境和训练方法。团队构建大规模 agent 系统(主 agent + 子 agent)自动完成实验启动、监控和问题上报,研究者可从 Slack 直接操作。与 SpaceXAI 联合训练的 Grok 4.5 是 Cursor 迄今最强模型,训练使用了海量 Cursor 真实交互数据和强化学习。演讲还揭示了递归自我改进机制:更强主模型蒸馏出更好辅助模型,进一步加速下一代训练。AI模型CursorGrok 4.5SpaceXAI10 个信源在谈事件专题推荐理由:Cursor 团队分享了他们如何用 agent 系统自动化模型训练,还聊了和 SpaceXAI 联合训练 Grok 4.5 的细节,干货很多。原文稍后读已读值得跟进有用关注 Cursor
09:15官方账号xAI@xaiGrok 4.5 在 Proximal 的 FrontierSWE 基准测试中综合排名第二,仅次于 Claude Fable 5。在实现与性能维度上同样位列第二。在研究能力维度上排名第一,超过 Opus 4.8、GPT-5.5 和 GLM-5.2。该基准测试评估模型在真实软件工程任务中的表现。AI模型Grok 4.5FrontierSWEProximal推荐理由:Grok 4.5 在代码基准上超越 GPT-5.5 和 Opus 4.8,研究能力还拿了第一,值得关注。原文稍后读已读值得跟进有用关注 Grok 4.5
14:56AI Will@FinanceYF5Grok 4.5 比 Opus 4.8 便宜 60% 以上,每任务成本约 $2.49,而 Claude Code 中 Fable 任务约 $12。搭配 Hermes 工具链后,可为 Grok 4.5 配置独立邮箱、电话、借记卡和工具访问权限,使其充当 AI 联合创始人。该方案速度也很快,目前可在 Hermes 或 OpenClaw 中运行。技巧Grok 4.5Hermes智能体推荐理由:Grok 4.5 比 Opus 4.8 便宜六成,配 Hermes 搞个 AI 联合创始人,成本低速度快,值得试试。原文稍后读已读值得跟进有用关注 Grok 4.5
00:22Aravind Srinivas@AravSrinivasPerplexity Computer在数小时内集成了Grok 4.5模型。该模型在其评测中得分最佳,且成本效益最高。Grok 4.5同时支持零数据保留(ZDR),满足客户对隐私的需求。API密钥使用Grok Build也尊重ZDR。用户可通过/privacy命令查看或更改数据保留设置。AI产品Grok 4.5Perplexity ComputerSpaceXAI推荐理由:Perplexity刚集成了Grok 4.5,评测第一还支持零数据保留,隐私党有福了。原文稍后读已读值得跟进有用关注 Grok 4.5
12:58Aravind Srinivas@AravSrinivas一位用户使用 Grok 4.5 与 Perplexity Computer 构建了名为 PODMEME 的播客播放器,能按话题聚合技术/商业播客并连续播放。该工具扫描热门播客话题,用户点击“PLAY DEEP-LINK STREAM”即可收听多个节目中关于“中国和开源”的片段。制作成本为 1100 credits(约 11 美元),每 48 小时运行一次的具体成本未知。技巧Grok 4.5Perplexity播客聚合推荐理由:有人用 Grok 4.5 和 Perplexity 自己搞了个播客播放器,能按主题串播不同节目,才花了 11 美元,挺有意思的实用技巧。原文稍后读已读值得跟进有用关注 Grok 4.5
22:00小互@imxiaohu社交平台用户称 Grok 4.5 在多数测试中能与 Opus 4.8 持平。该模型处理简单任务速度极快,被比喻为 SpaceX 火箭般的体验。用户还表示期待今晚 GPT5.6 的表现。AI模型Grok 4.5Opus 4.8GPT5.63 个信源在谈事件专题推荐理由:有人说 Grok 4.5 比肩 Opus 4.8,速度还快得像火箭,你要不要试一下?原文稍后读已读值得跟进有用关注 Grok 4.5
11:23Aravind Srinivas@AravSrinivasPerplexity 为 Enterprise 组织启用了 Grok 4.5 模型。面向 Consumer Pro 和 Max 订阅用户,Grok 4.5 可作为计算机编排模型。在 WANDR 基准上,Grok 4.5 得分高于其他五种编排配置。其成本约为 Opus 4.8 的一半。AI模型Grok 4.5PerplexityOpus 4.83 个信源在谈事件专题推荐理由:Perplexity 现在能用 Grok 4.5 做编排了,比 Opus 4.8 便宜一半,性能还更强,Pro 和 Max 用户快去试试。原文稍后读已读值得跟进有用关注 Grok 4.5
07:14官方账号Perplexity@perplexity_ai精选Perplexity 宣布 Grok 4.5 作为 Computer 的编排模型,面向 Pro 和 Max 订阅用户可用。在 WANDR 基准上,Grok 4.5 的得分高于五个其他编排配置。其成本约为 Opus 4.8 的一半。该更新旨在提升 AI 电脑的自动化任务能力。AI产品Grok 4.5PerplexityComputer推荐理由:Perplexity 给 Pro 和 Max 用户升级了 Grok 4.5 做编排模型,在 WANDR 上比 Opus 4.8 便宜一半还得分更高,值得试试。原文稍后读已读值得跟进有用关注 Grok 4.5
05:58Aravind Srinivas@AravSrinivas精选Perplexity CEO透露其自研编排器架构,基于GLM 5.2模型进行后训练。在需要时,系统会升级到Opus模型作为顾问。该编排器将利用更多计算资源快速提升质量。同时,Grok 4.5和Opus Fast也被认为是优秀的编排模型。AI模型PerplexityGLM 5.2Opus推荐理由:Perplexity CEO揭秘自家搜索背后的模型编排:用GLM 5.2后训练,必要时上Opus,比Grok 4.5和Opus Fast还强?原文稍后读已读值得跟进有用关注 Perplexity
05:16Paul Couvert@itsPaulAi过去72小时内,OpenAI发布了GPT-5.6,SpaceXAI推出了Grok 4.5,Muse发布了Spark 1.1,Meta推出了Muse图像/视频模型,OpenAI还发布了GPT-Live,Mistral推出了Robostral Navigate。这6款新模型/产品覆盖语言、图像、导航等多个方向。AI模型GPT-5.6Grok 4.5Muse Spark 1.110 个信源在谈事件专题推荐理由:这两天AI圈太热闹了,OpenAI、SpaceXAI、Meta一口气发了6个新模型,包括GPT-5.6和Grok 4.5,值得一看。原文稍后读已读值得跟进有用关注 GPT-5.6
04:40Aravind Srinivas@AravSrinivas精选Perplexity CEO Arav Srinivas透露,SpaceXAI的Grok 4.5在内部代理研究基准WANDR上获得最高分。该模型作为orchestrator集成到Perplexity Computer中,价格仅为Claude Opus 4.8(高)的一半。Grok 4.5还以相近成本超越了Perplexity当前GLM 5.2后训练模型的表现。该模型现已面向Consumer Pro和Max订阅用户提供。AI模型Grok 4.5Claude Opus 4.8Perplexity推荐理由:Perplexity把Grok 4.5作为Computer的编排模型,代理研究任务得分最高,价格只有Opus 4.8的一半,值得试。原文稍后读已读值得跟进有用关注 Grok 4.5
19:58Geek@geekbb一条推文提出GPT 5.6、Grok 4.5、GLM 5.2三款模型的组合能否超越Claude Fable 5的问题。该推文获得1599次查看和2次投票。评论区有2条讨论,目前尚无定论。AI模型GPT 5.6Grok 4.5GLM 5.28 个信源在谈事件专题推荐理由:看看网友在聊GPT 5.6、Grok 4.5、GLM 5.2和Claude Fable 5谁更强,挺有意思的。原文稍后读已读值得跟进有用关注 GPT 5.6
17:05AI Will@FinanceYF5Deedy汇总今日AI新闻:GPT-5.6 Sol和Sol Ultra明日发布,早期评价不如Fable但积极;Grok 4.5发布,声称达到Opus 4.7质量、80tps速度、$2/M输入$6/M输出定价;字节跳动Seedream 5 Pro发布,图像生成能力接近GPT Image 2,成本低至$0.045-$0.09/张,擅长编辑和信息图,远超Meta Muse Image;GPT-Live推出全双工非轮次语音模型,允许说话时无缝交互。AI模型GPT-5.6Grok 4.5Seedream 5 Pro推荐理由:今天AI圈炸了,一口气四个新模型/产品:GPT-5.6、Grok 4.5、Seedream 5 Pro、GPT-Live语音,每个都有具体数字和对比,值得快速了解。原文稍后读已读值得跟进有用关注 GPT-5.6
10:58Geek@geekbbClaude Fable 5、OpenAI GPT-5.6、Grok 4.5、Meta Muse Spark 1.1 和 Hy3 五个新模型被同时提及。这些模型分别来自 Anthropic、OpenAI、xAI、Meta 等主流厂商。目前尚无各模型的详细参数或基准成绩。市场关注度极高,相关帖子浏览量已超 1100。AI模型Claude Fable 5GPT-5.6Grok 4.510 个信源在谈事件专题推荐理由:Anthropic、OpenAI、xAI、Meta 一口气发了五个新模型,名称和版本号都列出来了,赶紧看看都有谁。原文稍后读已读值得跟进有用关注 Claude Fable 5
10:45lmarena.ai@lmarena_aiArena CEO @ml_angelopoulos 在MTSlive中指出,AI竞赛中首个发布者能占全部注意力,但三个月后优势就会消失。当前OpenAI和Anthropic看似主导,但已出现开源模型GLM、Meta的Muse Spark 1.1和Grok 4.5等新竞争者。Grok 4.5在前端开发任务上表现突出,证明没有谁的地位绝对安全。他认为AI生态丰富,最终赢家未定。行业OpenAIAnthropicGLM10 个信源在谈事件专题推荐理由:听听Arena CEO怎么说:OpenAI、Anthropic可能被GLM、Muse Spark或Grok 4.5赶超,三个月的时间差就能改变格局。原文稍后读已读值得跟进有用关注 OpenAI
06:26andrew chen@andrewchen作者认为,对于占大部分使用场景的日常查询(如谷歌搜索式的“normie prompts”),前沿模型与开源模型输出质量差异已不明显,用户难以盲测区分。他用Qwen 27b dense在Mac上运行,觉得已足够胜任。这预示开源模型将占据多数查询,AI定价趋近于零并转向广告支持,竞争焦点将移向隐私、互联和免费捆绑。只有前沿模型用于编程、科学等小众高价值场景继续存在。行业Qwen 27b denseGrok 4.5开源模型9 个信源在谈事件专题推荐理由:作者说大部分用户根本分不清不同模型的输出好坏,开源模型就够用,AI可能要免费了。观点反主流但很实在,值得一读。原文稍后读已读值得跟进有用关注 Qwen 27b dense
03:46Guillermo Rauch@rauchgVercel将Meta的Muse Spark 1.1多模态推理模型集成到AI Gateway中。该模型专为智能体任务设计,兼具高速推理和高智能水平。同时,Grok 4.5和GLM 5.2可能在本周发布,预计将显著分走token市场份额。当前是使用AI Gateway的好时机。AI模型Meta Spark 1.1Grok 4.5GLM 5.2推荐理由:Vercel把Meta的Muse Spark 1.1接入AI Gateway,这是个专门干智能体任务的又快又聪明的多模态模型,你值得试试。原文稍后读已读值得跟进有用关注 Meta Spark 1.1