11:41Jerry Liu@jerryjliu0精选Jerry Liu指出厂商中立初创公司能比前沿实验室更好地解决特定任务。这些公司可访问全套开源和前沿模型,能根据需要使用前沿模型,并针对特定任务优化端到端系统。凭借领域专业知识,这些公司甚至可以对模型进行后训练,创建专业评估标准。行业Jerry Liu厂商中立AI模型推荐理由:Jerry Liu分析厂商中立初创公司如何利用多模型优势优化特定任务解决方案。原文稍后读已读值得跟进有用关注 Jerry Liu
00:28官方账号Logan Kilpatrick@OfficialLoganKGoogle发布Gemini 3.8 Flash模型,价格与3.7版本相同,速度基本一致。该模型现已通过Gemini API、AI Studio、Antigravity和Gemini App等多渠道提供。Google团队正努力推动AI技术前沿发展。AI模型Gemini3.8 FlashGoogle推荐理由:Google新发布的3.8 Flash模型价格不变,速度相当,多平台可用,性价比提升。原文稍后读已读值得跟进有用关注 Gemini
13:48IT之家(博客/媒体)73°马斯克宣布 Grok 4.7 将于 9 月 12 日发布,参数量达 2.1 万亿,较 Grok 4.6 增长 40%。该模型在各方面表现优于 Grok 4.6,Token 效率更高。Grok 4.6 已超越 GPT-5.6 Sol,仅次于 Opus 5 和 Fable 5。马斯克称 Grok 4.7 将超越所有竞品。AI模型GrokGrok 4.7Elon Musk推荐理由:马斯克说 Grok 4.7 十天后上线,参数量暴涨 40%,性能要碾压所有 AI原文稍后读已读值得跟进有用关注 Grok
09:43IT之家(博客/媒体)73°英伟达正就收购人工智能初创企业Hugging Face展开深入谈判,交易总规模接近140亿美元。最快可能于本周达成协议,包含129亿美元收购款和10亿美元员工留任激励。Hugging Face成立于2016年,平台上托管超过300万个公开模型和100多万个数据集。若交易达成,将是英伟达CEO黄仁勋迄今为止规模最大的收购举措。行业英伟达Hugging FaceAI模型推荐理由:英伟达要花140亿美元收购AI界的GitHub,Hugging Face平台上有300多万个模型,这交易对AI开发者影响巨大。原文稍后读已读值得跟进有用关注 英伟达
09:36官方账号arXiv cs.AI@Xining Xun精选73°研究显示在Pythia模型套件(160M-12B参数)中,线性探针可在第1000步读取目标变量,但沿相同方向的引导在48个模型检查点中有43个无效。内部可读性系统性地领先于因果效力,且这种滞后不会随规模缩小。研究将此结构分解为三个可分离的轨迹:内部可读性在第一个检查点就已饱和(AUROC≥0.990),行为可读性随规模逐渐发展且出现更晚(12B模型仅在最后检查点达到0.909),因果效力几乎总是无效。论文Pythia滞后耦合内部表征推荐理由:MIT发现AI模型内部表征可读性先于因果性,这一滞后现象在12B参数规模下依然存在,挑战了传统模型理解。原文稍后读已读值得跟进有用关注 Pythia
04:28官方账号Perplexity@perplexity_aiClaude Fable 5.1 现已面向 Perplexity Computer 的 Pro 和 Max 订阅用户开放。该模型在 8 月 WANDR 评估中排名第一,得分为 0.601,每任务成本为 12.76 美元。相比 Fable 5 版本,Fable 5.1 的得分提高了 21%,成本降低了 37%。AI产品ClaudeFablePerplexity推荐理由:Perplexity 上线了 Claude Fable 5.1,性能提升成本降低,Pro 和 Max 用户可用。原文稍后读已读值得跟进有用关注 Claude
03:43Lovable@lovable_devLovable每周测试新AI模型,使用Fable 5.1进行构建。团队会对每个新模型进行调优,并决定路由方式以确保构建效果最佳。Lovable负责跟进最新模型,用户则专注于构建工作。AI产品LovableFableAI模型推荐理由:Lovable每周测试新模型,用Fable 5.1调优路由,帮你获得最佳构建效果。原文稍后读已读值得跟进有用关注 Lovable
03:43Lovable@lovable_devLovable 每周测试新 AI 模型并进行调优。他们使用 Fable 5.1 版本构建模型,确保构建结果最佳。Lovable 的团队负责跟进最新模型,而用户则专注于构建工作。AI产品LovableFableAI模型推荐理由:Lovable 用 Fable 5.1 每周测试新模型,帮你优化构建结果。原文稍后读已读值得跟进有用关注 Lovable
00:43Fireworks AI@FireworksAI_HQ精选73°Fireworks Lab提供嵌入式研究服务,将研究人员和工程师部署到客户环境中。该服务帮助客户共同设计或构建定制模型。已有Cursor、Harvey、Figma、Vercel、Cognition等知名公司采用此服务。Fireworks专注于前沿AI模型开发。AI产品FireworksFireworks Lab嵌入式研究4 个信源在谈事件专题推荐理由:Fireworks Lab推出嵌入式研究服务,帮大厂定制AI模型,已有Cursor、Figma等知名客户。原文稍后读已读值得跟进有用关注 Fireworks
19:05Recraft@recraftai@zeng_wt分享了使用RecraftAI新模型V4 Styles的实验结果,生成图像风格一致,令人印象深刻。该模型表现出色,用户对其爱不释手。AI模型RecraftAIV4 Styles风格一致推荐理由:看看@zeng_wt用RecraftAI的V4 Styles模型生成的图像,风格一致,效果惊人,和传统方法相比,这个模型太神奇了!原文稍后读已读值得跟进有用关注 RecraftAI
18:28IT之家(博客/媒体)精选智谱上线开源GLM-5.3-Flash (320B-A18B),摩尔线程宣布支持,实现极速适配与高效运行。GLM-5.3-Flash为GLM-5系列首个原生多模态模型,总参数320B,激活参数18B,在AA综合智能指数中得分57分。摩尔线程团队完成模型架构拆解、核心技术分析与算子优化,与SGLang-MUSA协同,提升长上下文推理效率。AI模型智谱GLM-5.3-Flash摩尔线程AI模型推荐理由:摩尔线程首个支持智谱GLM-5.3-Flash,实现极速适配,效率提升显著,值得关注。原文稍后读已读值得跟进有用关注 智谱GLM-5.3-Flash
05:44Justine Moore@venturetwinsfal Research发布H3 Max视频模型,15秒生成5秒720p视频,性能领先,下周五折促销。AI模型H3 Max视频生成模型fal Research1 个信源在谈事件专题推荐理由:fal Research发布的新模型H3 Max,15秒生成5秒720p视频,性能卓越,性价比高,下周还有折扣!原文稍后读已读值得跟进有用关注 H3 Max
02:49官方账号Runway ML@runwayml78°Meta的Muse Image模型今日加入Runway平台,与全球最佳图像和视频模型一同可用。立即尝试。AI产品MetaMuse ImageRunway推荐理由:Meta的Muse Image模型加入Runway,与全球顶级模型并肩,体验最新图像处理技术。原文稍后读已读值得跟进有用关注 Meta
22:30techcrunch@Rebecca BellanZ.ai确认是Ox Alpha模型的背后AI实验室,该模型在基准测试和排行榜上领先,其权重即将发布。AI模型Ox Alpha模型Z.aiAI模型推荐理由:Z.ai揭秘了神秘的Ox Alpha模型,看看它如何领先其他模型!原文稍后读已读值得跟进有用关注 Ox Alpha模型
18:58IT之家(博客/媒体)面壁智能宣布,其MiniCPM系列开源模型全球累计下载量突破5000万次。该模型由清华大学孵化,深度赋能三星Galaxy AI,并在最新AA榜单评测中取得最高得分。AI模型MiniCPM面壁智能开源模型推荐理由:面壁智能的MiniCPM模型下载量突破5000万,深度赋能三星,性能优异,值得关注。原文稍后读已读值得跟进有用关注 MiniCPM
18:28IT之家(博客/媒体)72°智谱确认Ox Alpha模型为GLM系列新版本,今晚将发布权重。Ox Alpha在OpenRouter平台预览期间免费使用,成为平台榜首,每日可处理100万亿个token。研究人员发现其token数量与GLM-5.3几乎完全吻合。AI模型智谱Ox AlphaGLM系列9 个信源在谈事件专题推荐理由:智谱新版本Ox Alpha模型今晚发布权重,与GLM-5.3高度相似,值得关注。原文稍后读已读值得跟进有用关注 智谱
09:55AI Will@FinanceYF578°Nvidia计划投入60亿美元,获得Poolside技术授权,并投资10亿美元,打造全球最强开放权重AI模型,挑战DeepSeek、Kimi等中国模型,与OpenAI、Anthropic竞争。行业NvidiaAI模型Poolside10 个信源在谈事件专题推荐理由:Nvidia大动作,挑战OpenAI,想看AI模型竞争的看这里!原文稍后读已读值得跟进有用关注 Nvidia
09:54AI Will@FinanceYF578°Nvidia计划投资60亿美元打造一款强大的开放权重AI模型,并从Poolside公司引进技术及员工。此举旨在挑战DeepSeek等中国领先者,并与OpenAI等美国前沿实验室竞争。Nvidia还将向Poolside投资10亿美元,估值120亿美元。行业NvidiaAI模型投资10 个信源在谈事件专题推荐理由:Nvidia投资Poolside,打造强大AI模型,挑战中国领先者,值得关注!原文稍后读已读值得跟进有用关注 Nvidia
02:05lmarena.ai@lmarena_ai查看Image-to-WebDev排行榜完整版,了解最新排名和成绩。AI模型Image-to-WebDev排行榜AI模型推荐理由:想了解最新排行榜,看看谁在Image-to-WebDev领域表现最佳吧!原文稍后读已读值得跟进有用关注 Image-to-WebDev
00:11官方账号Perplexity@perplexity_ai精选便携电脑支持运行经过训练和本地安装的PPLX 27B模型。Qwen 3.8 27B版本即将推出,支持NVIDIA Nemotron 3.5 Lightning。AI产品PPLX 27B便携电脑AI模型8 个信源在谈事件专题推荐理由:便携电脑支持PPLX 27B模型,使用方便,适合需要高性能AI模型的用户。原文稍后读已读值得跟进有用关注 PPLX 27B
10:45官方账号arXiv cs.AI@Melissa Dell, Ashesh RambachanAI模型将非结构化数据转换为结构化变量,推动经济学测量变革。本文提供指导,描述AI在测量流程中的三个阶段:发现、构建定义和观察,并强调对AI生成变量的可信推理需要适当设计的验证。同时,探讨如何支持有效推理,即使AI预测存在任意偏差,以及随机验证样本不可用时如何处理。论文AI模型经济学测量可信推理推荐理由:这篇论文深入探讨了AI在经济学测量中的应用,提供了关于如何进行可信推理的宝贵见解,对于对AI在测量领域应用感兴趣的人来说是个好资源。原文稍后读已读值得跟进有用关注 AI模型
06:38Gary Marcus@GaryMarcus78°Anthropic IPO预期过高,若不调整,恐成灾难。Thomson Reuters欲减少对Claude依赖,自建基于Qwen的AI模型。TR CTO认为使用前沿实验室而非开源如租房。行业AnthropicIPOAI模型10 个信源在谈事件专题推荐理由:Anthropic IPO遇阻,Thomson Reuters自建AI模型,Claude受影响。了解行业动态,关注AI模型发展。原文稍后读已读值得跟进有用关注 Anthropic
23:37Geek@geekbb78°DeepSeek V4在价格战中败给Ox Alpha,开发者对模型忠诚度低;Ox Alpha在3天内超越DeepSeek V4;任何公司都能通过努力和发布优质模型赢得市场。AI模型DeepSeek V4Ox Alpha价格战10 个信源在谈事件专题推荐理由:看看DeepSeek V4和Ox Alpha的价格战,Ox Alpha以更快的速度超越DeepSeek V4,显示出其性价比优势。原文稍后读已读值得跟进有用关注 DeepSeek V4
22:04IT之家(博客/媒体)精选汤森路透推出基于阿里千问构建的大语言模型Thomson,研发成本约4000万美元,Qwen3.5-397B版本,在Stanford LegalBench测试中得分0.823,落后于Gemini 3.1 Pro和GPT-5.5。AI模型Thomson阿里千问汤森路透推荐理由:汤森路透新推AI模型,基于阿里千问,适合文档审查等场景,成本更低,调整更自由。原文稍后读已读值得跟进有用关注 Thomson
21:23官方账号Decoder@Maximilian SchreinerThomson Reuters推出基于阿里巴巴Qwen的AI语言模型Thomson,投资约4000万美元,为期两年。模型在访问公司内部内容如Westlaw时表现最佳。CTO Joel Hron强调,重要的是拥有所需智能而非智能本身。行业Thomson ReutersAI模型自建AI推荐理由:Thomson Reuters投资4000万美元自建AI模型,与OpenAI或Anthropic租赁相比,拥有自己的AI模型更具优势。原文稍后读已读值得跟进有用关注 Thomson Reuters
18:28官方账号Decoder@Maximilian SchreinerCerebras推出CS-4 AI加速器,CEO Andrew Feldman称其为行业最快系统。CS-4在相同芯片上实现性能翻倍。AI模型CerebrasAI加速器性能翻倍推荐理由:Cerebras发布CS-4,性能翻倍,行业领先!原文稍后读已读值得跟进有用关注 Cerebras
16:24官方一手Pandaily@contact@pandaily.com (Pandaily)8月20日,OpenRouter低调列出匿名、免费的模型'ox-alpha',其真实世界编码结果击败多个封闭前沿模型,引发行业猜测游戏,并聚焦中国隐形模型策略。AI模型Ox Alpha编码基准OpenRouter9 个信源在谈事件专题推荐理由:OpenRouter发布了一个免费模型,其编码能力超越多个前沿模型,引发行业关注。原文稍后读已读值得跟进有用关注 Ox Alpha
09:36Gary Marcus@GaryMarcusMisha Glouberman将八年的Fitbit数据输入到Claude模型,模型分析后得出结论:熬夜导致睡眠时间减少。AI模型ClaudeFitbit数据睡眠分析推荐理由:想看看你的Fitbit数据如何被AI分析?Claude模型给你答案!比其他AI更直观!原文稍后读已读值得跟进有用关注 Claude
01:04Stanford AI Lab@StanfordAILabStanfordAILab启动了Marin 535B-A23B模型的训练,使用11 x GB200 NVL72进行,预计3个月完成。这是迄今为止最大的训练,预计将出现意外。AI模型StanfordAILabMarin 535B-A23B模型训练3 个信源在谈事件专题推荐理由:StanfordAILab发布了Marin 535B-A23B模型的训练消息,这是他们迄今为止最大的训练项目,值得关注。原文稍后读已读值得跟进有用关注 StanfordAILab
18:18官方账号Decoder@Matthias Bastian自2025年2月6日起,AI代理在OpenRouter上消耗的令牌数量已超过人类。代理使用量增长了14倍,而人类使用量仅增长2.8倍。尽管如此,近70%的代理令牌消耗来自廉价的缓存提示,因此实际成本增长速度远低于原始数据所显示的速度。AI模型OpenRouter代理令牌AI代理推荐理由:OpenRouter上AI代理令牌使用量激增,成为自身最大客户,了解代理令牌的消耗情况,对比人类使用量增长。原文稍后读已读值得跟进有用关注 OpenRouter
16:14IT之家(博客/媒体)78°英伟达向Poolside支付60亿美元获取AI模型授权,并追加10亿美元投资,旨在开发与DeepSeek和Kimi K3竞争的AI模型。Poolside将保持独立运营,英伟达寻求加快AI技术渗透各行各业。行业英伟达PoolsideAI模型1 个信源在谈事件专题推荐理由:英伟达投资Poolside,助力打造中国开源AI竞争者,值得关注其未来发展。原文稍后读已读值得跟进有用关注 英伟达
17:13官方账号Latent Space (swyx)@Dan McAteer模型持续吸收注意力约束,未来将转向人类注意力而非模型自身。模型名:智能体;约束类型:注意力约束;未来趋势:转向人类注意力。AI模型智能体注意力约束模型进化推荐理由:Latent Space 发布了智能体注意力约束的进化,看看它如何影响人类注意力吧!原文稍后读已读值得跟进有用关注 智能体
03:53techcrunch@Julie BortNvidia研究显示,即使AI模型在任务上表现不佳,通过微调,AI智能体仍能良好表现,不会失控。AI模型NvidiaAI智能体微调3 个信源在谈事件专题推荐理由:Nvidia展示了AI模型之外的另一个关键因素——harness,它对AI性能至关重要。原文稍后读已读值得跟进有用关注 Nvidia
22:05elvis@omarsar0Ox Alpha(隐秘模型)免费一周,支持1M上下文、多模态、零数据保留,每日100T令牌容量,限时体验。AI模型Ox Alpha多模态零数据保留5 个信源在谈事件专题推荐理由:Ox Alpha免费一周,多模态、零数据保留,体验最新AI模型。原文稍后读已读值得跟进有用关注 Ox Alpha
19:53Geek@geekbbDeepSeek-V4-Flash-Vision-Exp模型上线,多模态能力提升,接近Opus-4.8水平。DeepSeek Harness 0.1.1支持新模型。AI模型DeepSeek-V4-Flash-Vision-Exp多模态模型发布推荐理由:DeepSeek新模型发布,多模态能力大幅提升,值得一试。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash-Vision-Exp
15:06orange.ai@oran_geBen Davis 在 x.com 上分享,DeepSWE 在 10 项任务中表现优于 Fable 和 GPT-5.6-sol,得分超过 80%,引发热议。AI模型DeepSWEFableGPT-5.6-sol推荐理由:Ben Davis 在 x.com 上展示了 DeepSWE 在多项任务中的出色表现,比 Fable 和 GPT-5.6-sol 更胜一筹,值得关注。原文稍后读已读值得跟进有用关注 DeepSWE
13:41IT之家(博客/媒体)DeepReinforce推出Ornith-1.5系列开源模型,其最大397B规模模型部分性能超过Claude Opus 4.8;Ornith-1.5系列包含多规模模型,397B版在部分测试中胜过Claude Opus 4.8;该系列还有9B量化版本,可在iPhone 17等手机上运行。AI模型Ornith-1.5Claude Opus 4.8iPhone 17推荐理由:DeepReinforce刚发布了Ornith-1.5系列开源模型,里面有量化版居然能在iPhone 17手机上用,而且大模型性能和Claude Opus 4.8差不多甚至更强,和其他模型比也有优势,值得看看。原文稍后读已读值得跟进有用关注 Ornith-1.5
11:22量子位@量子位的朋友们墨奇智能首次亮相国内,公开展示其新近发布的具身智能模型MoRA架构,该模型在WRC场景下的长程任务实战中表现出色,完成超5小时连续作业,展现出具身大脑的技术革新AI模型MoRA墨奇智能具身智能推荐理由:墨奇发的MoRA模型,能让机器人做长程任务,比普通模型实战效果更好原文稍后读已读值得跟进有用关注 MoRA
10:16官方账号arXiv cs.AI@Boqiao Zhang, Godbless James, Sai Krishna Gottipati, Andrew FitzgibbonPGFS++是一种用于分子性质优化的强化学习框架,在合成和多样性约束下实现改进。该框架基于PGFS升级,采用可训练反应模板表示,显著提升性能。相比前代方法,它在改善目标性质的同时保持了输出多样性。AI模型PGFS++分子优化强化学习推荐理由:PGFS++是新分子优化方法,能解决合成和多样性难题,比之前版本效果更好还保分子多样性。原文稍后读已读值得跟进有用关注 PGFS++
10:13官方一手pandaily@contact@pandaily.com (Pandaily)小米MiMo - V2.5模型登顶OpenRouter月周通话榜单,展现前沿实力;自研Xuanjie芯片完成大规模验证,技术突破明显;新类人机器人工厂应用成功率达98%,拓展业务边界。AI产品XiaomiMiMo-V2.5OpenRouter推荐理由:小米发布了MiMo - V2.5模型、Xuanjie芯片和新机器人,这些新品在性能和场景上比之前更好了,值得了解下。原文稍后读已读值得跟进有用关注 Xiaomi