22:07官方账号NVIDIA AI@NVIDIAAI精选77°NVIDIA发布官方skills插件,Cursor智能体可调用300多项技能,覆盖CUDA、NeMo、RAG等30多个产品。开发者只需描述构建目标,插件会自动推荐并执行合适技能。该插件已上架Cursor marketplace,完整技能目录托管在GitHub。AI产品NVIDIACursor智能体10 个信源在谈事件专题推荐理由:NVIDIA给Cursor出了个官方插件,装完你的智能体就会用CUDA和RAG这些技能了,搞开发更省事。原文稍后读已读值得跟进有用关注 NVIDIA
18:16官方账号NVIDIA AI@NVIDIAAI82°NVIDIA今日发布Nemotron 3.5,这是一款专为智能体AI系统中高吞吐量执行而设计的开源模型。Dream Security获得该模型的早期访问权限,其研究团队进行了监督微调、后训练、领域适配、网络安全推理和智能体工具使用等优化。该模型在Dream的内部网络安全基准测试中表现强劲,可帮助客户理解安全态势、调查风险并转化安全数据。相关发布博客已在开发者社区上线。AI模型NVIDIANemotron 3.5Dream Security10 个信源在谈事件专题推荐理由:NVIDIA出了新开源模型Nemotron 3.5,专为智能体场景打造,Dream Security抢先调教成了网络安全专用版,内部测试表现不错。原文稍后读已读值得跟进有用关注 NVIDIA
18:15官方账号NVIDIA AI@NVIDIAAI精选英伟达发布Nemotron 3.5 Lightning,一款30B参数的MoE模型,活跃参数仅3B。该模型由Nemotron 3 Ultra蒸馏而来,现已上线Fireworks平台。它在PinchBench上表现强劲,并在AA-Omniscience非幻觉测试中获得顶尖分数。模型专为高吞吐智能体工作流设计,强调可靠性与专精化。AI模型NemotronFireworksNVIDIA10 个信源在谈事件专题推荐理由:想做智能体又怕模型太贵太慢?Nemotron 3.5 Lightning只有3B活跃参数,在Fireworks上直接就能调。原文稍后读已读值得跟进有用关注 Nemotron
18:15官方账号NVIDIA AI@NVIDIAAI72°AgileRL 宣布与 NVIDIA 合作,支持 Nemotron 系列模型的后训练。NVIDIA 提前提供了 30B3A 参数 MoE 模型 Nemotron 3.5 Lightning。在 Arena 平台上,该模型经微调后在长程推理和真实客服任务上超过 Claude Sonnet 5。单次训练只需四块 H100 GPU 运行六小时即可掌握推理任务,上下文长度超过 50,000 token。Arena 客户可在 Nemotron 模型发布后立即获得相应的训练与评估环境。AI模型NemotronNVIDIAAgileRL10 个信源在谈事件专题推荐理由:AgileRL 把 Nemotron 3.5 Lightning 放到 Arena 上微调,6 小时就能超过 Claude Sonnet 5,训练完权重还归你。原文稍后读已读值得跟进有用关注 Nemotron
18:14官方账号NVIDIA AI@NVIDIAAI72°NVIDIA Nemotron 3.5 Lightning 已在 Baseten 上线,定位为长时运行智能体设计。相比同类开源模型,其吞吐量提升 4 倍,成本降低 50%。在生产测试中,输出 token 数量减少 63.4%。该模型采用 30B MoE 架构,仅激活 3B 参数,支持 100 万 token 上下文。AI模型NVIDIANemotron 3.5 LightningBaseten10 个信源在谈事件专题推荐理由:跑长时任务的智能体注意了,Nemotron 3.5 Lightning 上线 Baseten,吞吐翻 4 倍、成本砍半,输出还更精简。原文稍后读已读值得跟进有用关注 NVIDIA
18:08官方账号Groq@GroqInc精选Groq 宣布成为 NVIDIA 云合作伙伴。公司称这是对现有客户体验的验证,即其 AI 基础设施运行达到最高标准。CEO Adam Winter 表示,推理正在成为 AI 中最大最关键的一层,Groq 打算比任何人都运行得更好。行业GroqNVIDIA推理服务3 个信源在谈事件专题推荐理由:Groq 成了 NVIDIA 的云合作伙伴,等于推理基础设施拿到官方认证,CEO 还放话要跑赢所有人。原文稍后读已读值得跟进有用关注 Groq
18:06官方账号NVIDIA AI@NVIDIAAI精选71°Harvey联合Trajectory Labs对NVIDIA的Nemotron 3.5 Lightning进行后训练,在Legal Agent Bench上得分从0%升至8.3%。该成绩超过了Opus 4.6和更大的后训练版Nemotron 3 Ultra。后训练覆盖九个执业领域,未出现能力退化。平均输出长度从90k tokens降至37k tokens,每token奖励提升2.4倍。AI模型Nemotron 3.5 LightningNVIDIAHarvey10 个信源在谈事件专题推荐理由:Harvey把Nemotron 3.5 Lightning后训练了一把,法律Agent评测从0冲到8.3%,比Opus 4.6还强,输出也从90k缩到37k,省Token。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
18:04官方账号NVIDIA AI@NVIDIAAI精选NVIDIA Nemotron 3.5 Lightning 已在 Together AI 平台上线。该模型被定位为同类中速度最快的开源模型。它专为常驻型智能体设计,能快速完成高吞吐量的专业工作。AI模型NVIDIANemotron 3.5 LightningTogether AI10 个信源在谈事件专题推荐理由:NVIDIA 的 Nemotron 3.5 Lightning 开源模型上线 Together AI,跑得最快,适合需要高强度处理任务的智能体。原文稍后读已读值得跟进有用关注 NVIDIA
18:04官方账号NVIDIA AI@NVIDIAAI精选Reasonable 团队用 4B token 的合成 Verus 数据微调了 NVIDIA 最新开源模型 Nemotron 3.5 Lightning(30B)。微调后的模型在单次尝试通过率上超越了一个规模约 50 倍于它的模型,pass@3 则几乎持平。它的 token 生成速度也快于测试过的所有同尺寸开源模型。配套博客还分析了各模型在形式化证明中的失败方式、作弊行为,以及微调带来的影响。AI模型NemotronNVIDIAVerus10 个信源在谈事件专题推荐理由:Reasonable微调了NVIDIA的30B开源模型,形式化证明通过率胜过50倍大的模型,生成还更快。博客还拆解了模型怎么作弊。原文稍后读已读值得跟进有用关注 Nemotron
18:04官方账号NVIDIA AI@NVIDIAAIFastino Labs与NVIDIA合作发布两款开源模型Fastino-Nemotron-3.5-Lightning-Finance和Fastino-Nemotron-3.5-Lightning-Healthcare,均基于Nemotron 3.5 Lightning微调。金融模型在FinQA基准上执行准确率从15.86%提升至59.23%,增幅43.37个百分点;在BizFinBench上从49.65%升至57.46%。医疗模型在HealthAdminBench上从25.67%升至29.95%,在MedCalc-Bench上从49.09%升至54.18%。两款模型均以Apache 2.0许可发布在Hugging Face上。同时,Fastino还发布了自动微调工具Fastino Fine-Tuning Agent的私人预览版。AI模型FastinoNVIDIANemotron 3.510 个信源在谈事件专题推荐理由:Fastino跟NVIDIA合作,用自动微调Agent搞出了金融和医疗两个开源模型,FinQA涨了43个点,Apache 2.0随便用。原文稍后读已读值得跟进有用关注 Fastino
18:02官方账号NVIDIA AI@NVIDIAAI72°NVIDIA今日推出Nemotron 3.5 Lightning模型,并已上线Tinker平台。该模型仅激活3B参数,针对吞吐速度进行优化。它面向对延迟和成本敏感的应用场景,适合高频实时推理任务。用户可在Tinker上直接体验该模型。AI模型NemotronNVIDIATinker10 个信源在谈事件专题推荐理由:NVIDIA出了个轻量级新模型,3B参数跑得快又便宜,延迟敏感场景用得上,Tinker上现在就能玩。原文稍后读已读值得跟进有用关注 Nemotron
17:55官方账号NVIDIA AI@NVIDIAAI72°英伟达宣布推出开源权重模型 Nemotron 3.5 Lightning。Deep Cogito 表示该模型继续推动开放模型生态,并宣布加入英伟达后训练合作伙伴生态。此次合作聚焦开源权重与可定制模型,旨在让前沿智能更易获取。AI模型Nemotron 3.5 LightningNVIDIADeepCogito10 个信源在谈事件专题推荐理由:英伟达出了开源版 Nemotron 3.5 Lightning,Deep Cogito 马上加入了它的后训练伙伴计划。想搞开源模型定制化的,这条有信息量。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
17:55官方账号NVIDIA AI@NVIDIAAIUniphore实测NVIDIA Nemotron 3.5 Lightning在企业级智能体工作负载中的表现。与参数规模相近的Gemma 4 31B IT相比,Nemotron 3.5 Lightning吞吐量提升5倍,准确率也有明显增长。Uniphore已将其纳入Business AI Cloud高流量路径的评估范围。AI模型Nemotron 3.5 LightningNVIDIAGemma 410 个信源在谈事件专题推荐理由:NVIDIA新模型在企业任务上直接碾压Gemma 4,吞吐量翻5倍,跑真实负载的数据很硬核。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
17:53官方账号NVIDIA AI@NVIDIAAI精选Trajectory 获得 NVIDIA Nemotron 3.5 Lightning 早期访问权,在 Harvey LAB 上完成后训练。该后训练在 Trajectory 平台一键完成,无需新工程。模型在一项测试中从 0% 提升到 8.3%,超过 Opus 4.6 的 6.6%。Trajectory 强调持续学习让小型模型可每晚、按客户反复训练,逼近按量计费的智能。AI模型NemotronNVIDIATrajectory10 个信源在谈事件专题推荐理由:Trajectory 一键后训练 Nemotron 3.5 Lightning,测试冲到 8.3% 超 Opus 4.6,小模型按客户定制能落地。原文稍后读已读值得跟进有用关注 Nemotron
17:45官方账号NVIDIA AI@NVIDIAAIApplied Compute 平台现已支持 NVIDIA 的 Nemotron 3.5 Lightning 进行训练和推理。该模型在 agentic coding benchmark 中,当并发和总 token 吞吐量扩展 16 倍时,解码吞吐量、首 token 时间和用户中位延迟保持不变。其 LatentMoE 和 Mamba 架构能以最小开销扩展稀疏性、上下文长度和批大小,显著提升后训练迭代吞吐量。AI产品Nemotron 3.5 LightningNVIDIAApplied Compute10 个信源在谈事件专题推荐理由:Applied Compute 支持 Nemotron 3.5 Lightning 了,并发翻 16 倍延迟不涨,训练迭代快多了。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
17:42官方账号NVIDIA AI@NVIDIAAI72°CrowdStrike 定制 NVIDIA Nemotron 3.5 Lightning,用于网络安全 agent 工作流。该模型达到分析师级准确率,训练速度更快、计算需求更低。它能自动关闭最高 88% 的良性检测,让安全团队专注真实威胁。AI模型Nemotron 3.5 LightningCrowdStrikeNVIDIA10 个信源在谈事件专题推荐理由:CrowdStrike 用 Nemotron 3.5 Lightning 做了安全智能体,自动关掉 88% 误报,训练快又省算力。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
07:20官方账号NVIDIA AI@NVIDIAAI精选NVIDIA 发布全新 MoE 模型 Nemotron 3.5 Lightning。distil labs 作为欧洲发布合作伙伴,对其进行了微调。该团队将微调版与 4 个可比 MoE 模型在 6 项任务上对比,未微调时排名第三,微调后跃居第一。完整数值与失败场景已公布在 distil labs 博客上。AI模型Nemotron 3.5 LightningNVIDIAdistil labs10 个信源在谈事件专题推荐理由:NVIDIA 的 Nemotron 3.5 Lightning 微调后,在 6 项任务上超过 4 个同类 MoE 模型拿了第一。想知道怎么调出来的,可以看这篇。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
04:58Julien Chaumond@julien_c精选73°开源社区迎来开放权重模型密集发布潮。DeepSeek-V4-Flash-0731(304B MoE)在Terminal-Bench 2.1上从61.8升至82.7,逼近Opus-4.8。Meta发布首个开放智能体模型Muse-Glimmer-30B,支持完全本地运行,采用Apache 2.0。Liquid AI LFM2.5-2.6B以2.69B参数在M5 Max上达220 tok/s,内存占用低于2.5GB。MiniMax-H3支持原生立体声音频,可生成2K/15秒视频。Mistral Shieldstral-1.0-3B在HarmBench上得分99.4,超过LlamaGuard-4-12B和ShieldGemma-9B。AI模型DeepSeekMetaNVIDIA10 个信源在谈事件专题推荐理由:开源模型大爆炸!DeepSeek、Meta、NVIDIA一口气发了十几个新模型,从推理到视频到语音都有,性能还紧追闭源。原文稍后读已读值得跟进有用关注 DeepSeek
17:59IT之家(博客/媒体)精选芝加哥商品交易所集团8月11日宣布与Silicon Data合作,推出基于NVIDIA AI GPU租赁价格的两项计算期货合约,分别为Silicon Data H100租赁指数期货和B200租赁指数期货,每份代表租赁一个月对应GPU的费用。新合约计划10月5日在纽约商品交易所上线,目前等待监管审查。该工具旨在帮助企业管理计算成本、平抑算力价格波动,并提升市场透明度。Silicon Data CEO Carmen Li指出,此前两家公司购买相同GPU容量价格可能差异悬殊,新基准提供了公开可比较的价格参考。行业NVIDIAH100B2007 个信源在谈事件专题推荐理由:芝商所要把GPU租赁价格变成期货了,H100和B200都能交易,企业以后可以锁定算力成本,不用再怕价格暴涨。原文稍后读已读值得跟进有用关注 NVIDIA
17:42Aravind Srinivas@AravSrinivas精选NVIDIA 的 Nemotron 3.5 Lightning 现已面向所有开发者开放,可通过 Perplexity Agent API 调用。该模型为开源 30B MoE 架构,仅激活 3B 参数,专为高频智能体执行层设计,适用于工具调用、验证和子智能体任务。输入定价为每百万 tokens 0.0115 美元,输出定价为每百万 tokens 0.17 美元。开发者可将 Lightning 与 Nemotron Ultra 等前沿模型搭配,用于规划与批量执行。AI产品Nemotron 3.5 LightningPerplexityNVIDIA10 个信源在谈事件专题推荐理由:NVIDIA 把 30B MoE 的 Lightning 放到 Perplexity API 上了,每百万输入才 1 分多钱,适合跑高频工具调用,跟 Ultra 搭配干活很划算。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
16:04AI Will@FinanceYF5精选NVIDIA推出Nemotron 3.5 Lightning,专为长时运行的智能体任务设计。该模型总参数量30B,激活参数3B,支持高达1M token的上下文,并已开放商用。NVIDIA提供BF16和更小的NVFP4量化检查点,支持在单张H100或DGX Spark上部署,也兼容RTX 5090。通过多token预测、DSpark和DFlash投机解码以及NVFP4量化,生成速度最高提升4倍。在PinchBench基准上,其准确率达86%,完成速度比Qwen3.6 35B快30%。AI模型Nemotron 3.5 LightningNVIDIA智能体10 个信源在谈事件专题推荐理由:NVIDIA出了个轻量模型,30B参数但只激活3B,跑长任务上下文能到1M,单卡就能部署,速度还快4倍。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
16:02官方一手marktechpost@Asif Razzaq精选NVIDIA推出开源MoE模型Nemotron 3.5 Lightning,总参数量30B,激活参数仅3B,专为智能体执行层设计。同时发布NeMo Switchyard模型路由器,可将每个执行步骤路由到成本最低且能力足够的模型。该组合旨在降低智能体推理成本,提升执行效率。Nemotron 3.5 Lightning基于开源许可发布,开发者可自由使用。AI模型NemotronNVIDIAMoE10 个信源在谈事件专题推荐理由:NVIDIA开源了30B MoE,激活才3B,跑起来便宜,还配了个路由器帮你省钱,搞智能体的可以看看。原文稍后读已读值得跟进有用关注 Nemotron
07:36IT之家(博客/媒体)CoreWeave 发布 2026 财年第二财季财报,营收 25.75 亿美元,同比增长 112.46%,超出市场预期。上半年营收达 46.53 亿美元,同比增长 112.08%,但归母净利润亏损 13.66 亿美元,同比扩大 125.79%。公司收入储备订单达 1040 亿美元,主动算力规模扩张至 1.5 GW。CoreWeave 完成行业首次 NVIDIA Vera Rubin NVL72 启动验证,并获 Jane Street 10 亿美元战略投资。公司已被纳入纳斯达克 100 指数。行业CoreWeaveNVIDIAAI云服务4 个信源在谈事件专题推荐理由:AI 云巨头 CoreWeave 财报来了,营收翻倍但亏损也在扩大,订单储备 1040 亿美元,还搞定了 NVIDIA 新硬件,想了解 AI 基建行情可以看看。原文稍后读已读值得跟进有用关注 CoreWeave
04:05官方账号NVIDIA AI@NVIDIAAINVIDIA在发布Lightning模型的同时,推出了Nemotron-RL-Agentic-Terminal-Pivot数据集。该数据集是用于后训练编码智能体能力的开放智能体强化学习数据集。数据集已上传至Hugging Face平台,供开发者使用。论文NVIDIANemotron-RL-Agentic-Terminal-PivotHugging Face10 个信源在谈事件专题推荐理由:NVIDIA开源了训练编码智能体的数据集,想搞强化学习或智能体开发的可以看看。原文稍后读已读值得跟进有用关注 NVIDIA
03:46Aravind Srinivas@AravSrinivasNVIDIA推出Nemotron 3.5 Lightning,这是一款开放权重的30B MoE模型,仅3B参数激活,专为常驻智能体设计,可高效处理高吞吐、专业化任务。其输出速度比同类模型快4倍,能在笔记本或DGX Spark等本地硬件上流畅运行。用户也可通过Perplexity使用更大的Nemotron Ultra版本。AI模型Nemotron 3.5 LightningNVIDIAMoE10 个信源在谈事件专题推荐理由:NVIDIA新出的开源MoE模型,30B参数但只激活3B,笔记本就能跑,速度还快4倍,做智能体任务很合适。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
03:02Harrison Chase@hwchase17LangChain创始人Harrison Chase在X上表示,对NVIDIA发布的Nemotron 3.5 Lightning模型感到兴奋,并计划将其集成到deepagents框架中。NVIDIA CEO黄仁勋称该模型为连续和长期运行智能体设计,具备智能、快速、高效且开源的特点。该模型旨在提升智能体的持续运行能力,可能对AI代理生态产生重要影响。AI模型Nemotron 3.5 LightningNVIDIALangChain10 个信源在谈事件专题推荐理由:LangChain创始人亲自下场点赞,还要集成到deepagents里,说明Nemotron 3.5 Lightning对智能体开发是真有用,搞AI代理的可以关注下。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
02:29ollama@ollamaOllama宣布与NVIDIA及黄仁勋团队合作,共同推出开源模型Nemotron 3.5 Lightning。该模型主打智能、快速、高效,并保持开源特性,旨在支持持续运行的智能体。双方强调开放模型无边界,未来将继续合作推动生态发展。AI模型OllamaNVIDIANemotron 3.5 Lightning10 个信源在谈事件专题推荐理由:Ollama和NVIDIA联手了,新出的Nemotron 3.5 Lightning主打快和高效,还是开源的,做智能体可以试试。原文稍后读已读值得跟进有用关注 Ollama
01:10官方账号LangChain@LangChainAI精选LangChain在Deep Agents评测套件中测试了NVIDIA开源路由器Switchyard,该套件包含145个多步任务,覆盖工具使用、检索、文件系统操作和长上下文场景。结果显示,93%的调用被路由到30B模型,仅7%需要Claude Opus 4.8。通过路由策略,总成本降低约70%,同时保留了Opus约90%的准确率。LangChain已推出与Switchyard的deepagents集成。AI产品SwitchyardNVIDIALangChain10 个信源在谈事件专题推荐理由:想知道你的智能体能不能少花点钱?LangChain实测NVIDIA的Switchyard,93%任务用30B模型搞定,成本砍七成,准确率还保住九成。原文稍后读已读值得跟进有用关注 Switchyard
00:46ollama@ollama精选NVIDIA 的 Nemotron 3.5 Lightning 现已可通过 Ollama 本地运行。这是一款 30B 参数的混合专家模型,仅激活 3B 参数,支持 1M token 上下文。该模型专为常驻运行的智能体设计,擅长编码、工具调用和多轮对话。相比同类规模的开源模型,其吞吐量提升 4 倍,任务完成时间降低 30%。用户可通过 Claude Code、Hermes Agent 或 OpenClaw 等工具直接调用。AI模型Nemotron 3.5 LightningNVIDIAOllama10 个信源在谈事件专题推荐理由:NVIDIA 新出的 30B 模型,跑在本地,专门给常驻智能体用,速度快 4 倍,还支持 1M 上下文,搞智能体的可以试试。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
23:29Fireworks AI@FireworksAI_HQ精选NVIDIA 推出 Nemotron 3.5 Lightning,这是一款 30B MoE 模型,仅 3B 参数激活,专为高吞吐智能体任务设计。该模型从 Nemotron 3 Ultra 蒸馏而来,在 PinchBench 和 AA-Omniscience Non-Hallucination 基准上表现强劲。目前已在 Fireworks 平台上线,供开发者用于构建智能体工作流。AI模型Nemotron 3.5 LightningNVIDIAFireworks10 个信源在谈事件专题推荐理由:NVIDIA 新出的 30B MoE 模型,3B 激活参数跑得快,专为智能体场景优化,Fireworks 上直接能用。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
22:52官方账号NVIDIA AI@NVIDIAAI精选NVIDIA 推出 Nemotron 3.5 Lightning 模型,延续开放策略,公开权重、训练数据和配方。该模型已上线 Hugging Face 平台,开发者可自由获取和定制。Nemotron 3.5 Lightning 旨在提供高性能推理能力,适用于多种自然语言处理任务。此次发布进一步巩固了 NVIDIA 在开源模型领域的布局。AI模型NemotronNVIDIAHugging Face10 个信源在谈事件专题推荐理由:NVIDIA 把 Nemotron 3.5 Lightning 的权重、数据和配方全开放了,想自己改模型的话直接上 Hugging Face 就能拿,比闭源省事多了。原文稍后读已读值得跟进有用关注 Nemotron
22:43OpenRouter@OpenRouterAI精选NVIDIA Nemotron 3.5 Lightning已在OpenRouter上线。该模型为30B混合专家架构,仅激活3B参数,由Nemotron 3 Ultra蒸馏而来。它面向高容量、专业化的AI智能体工作负载,相比同类模型吞吐量最高提升4倍,任务完成速度最高快30%。AI模型NemotronNVIDIAOpenRouter10 个信源在谈事件专题推荐理由:NVIDIA新出的轻量MoE,30B参数只激活3B,跑智能体任务比同类快30%,想省算力可以试试。原文稍后读已读值得跟进有用关注 Nemotron
22:03官方账号NVIDIA AI@NVIDIAAI精选73°NVIDIA推出Nemotron 3.5 Lightning,一个30B参数的MoE模型,仅激活3B参数。该模型专为常驻智能体设计,可快速完成高并发、专业化任务。其输出速度比同类模型快4倍。模型已开源,适合需要高效推理的场景。AI模型NemotronNVIDIAMoE10 个信源在谈事件专题推荐理由:NVIDIA出了个30B MoE模型,只激活3B参数,跑得快4倍,适合做常驻智能体,开源可白嫖。原文稍后读已读值得跟进有用关注 Nemotron
22:02官方账号NVIDIA AI@NVIDIAAI精选NVIDIA推出Nemotron 3.5 Lightning,专为长时间运行的智能体工作流优化,覆盖工具调用、结果验证和任务委派等高频执行场景。该模型体积适中,可从DGX Spark到数据中心灵活部署。NVIDIA展示了其在DGX Spark上运行智能体工作流的实例,并提供了技术细节文档。AI模型Nemotron 3.5 LightningNVIDIA智能体10 个信源在谈事件专题推荐理由:NVIDIA新出的Nemotron 3.5 Lightning,专门为跑智能体高频调用工具的场景优化,体积小到能在DGX Spark上跑,适合做Agent开发的朋友看看。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
22:01官方账号NVIDIA AI@NVIDIAAI精选NVIDIA发布NeMo Switchyard,一个用于模型路由的开源库。该库允许在智能体工作流中为不同步骤选择不同模型,例如用前沿模型处理复杂推理和规划,用Lightning模型处理高容量、专业化执行。这能优化成本和性能。更多信息见官方链接。AI产品NVIDIANeMo Switchyard模型路由10 个信源在谈事件专题推荐理由:NVIDIA出了个新开源库,能让智能体工作流里不同步骤用不同模型,省钱又高效,搞Agent的可以看看。原文稍后读已读值得跟进有用关注 NVIDIA
08:46IT之家(博客/媒体)72°NVIDIA宣布与阿波罗、贝莱德、黑石、布鲁克菲尔德、高盛、KKR六家金融机构达成战略合作,共同打造可调动5000亿美元(约合3.38万亿元人民币)第三方资金的人工智能计算基础设施融资平台。该平台将NVIDIA生态系统的AI基础设施转变为可投资资产类别,为NVIDIA客户创建专属资金池。黄仁勋表示,部分情况下NVIDIA可能为项目提供最高达剩余价值25%的支持,帮助客户构建DSX人工智能工厂。行业NVIDIAAI基础设施融资3 个信源在谈事件专题推荐理由:NVIDIA拉上六家顶级金融机构搞了5000亿美元的算力融资平台,客户不用自己掏钱就能建AI工厂,黄仁勋说最多能出25%兜底。原文稍后读已读值得跟进有用关注 NVIDIA
00:35官方一手Hugging Face: Blog(博客/媒体)精选NVIDIA发布Magpie TTS,一个开放权重的多语言语音合成模型。该模型针对低延迟场景专门优化,适合部署实时语音代理。开发者通过开放权重可以完全控制部署流程,包括自定义推理配置。Magpie TTS支持多种语言,能用于构建跨语言交互系统。AI模型Magpie TTSNVIDIA语音合成10 个信源在谈事件专题推荐理由:NVIDIA把Magpie TTS开放权重了,能自己控制部署,低延迟跑多语言语音代理,比闭源API灵活。原文稍后读已读值得跟进有用关注 Magpie TTS
16:37IT之家(博客/媒体)Firebird于8月8日宣布在亚美尼亚赫拉兹丹投运CIS区域最大AI工厂,距动工仅半年多。该工厂基于NVIDIA的AI GPU与DSX平台,初期客户包括Perplexity AI。Firebird计划到2027年底在亚美尼亚部署300MW基础设施容量,对应超7万块Rubin和Blackwell GPU,并在哈萨克斯坦获得125MW容量。NVIDIA已计划对Firebird进行投资。行业FirebirdNVIDIAPerplexity AI3 个信源在谈事件专题推荐理由:Firebird在亚美尼亚开了个CIS最大AI工厂,NVIDIA都要投它,初期客户有Perplexity,明年还要上7万块Rubin和Blackwell。原文稍后读已读值得跟进有用关注 Firebird
04:43官方一手marktechpost@Asif RazzaqNVIDIA Labs开源了NOOA(NVIDIA Object-Oriented Agents),一个模型无关的Python智能体框架。以往智能体开发要分散在提示模板、工具schema、回调代码和工作流图里,NOOA把这一切压缩进单个Python类。在NOOA中,类方法就是模型可执行的动作,字段就是智能体状态,文档字符串就是提示词。开发者只需维护一个类,就能完成智能体的定义与运行。AI产品NVIDIANOOAPython1 个信源在谈事件专题推荐理由:NVIDIA开源了个叫NOOA的框架,写智能体变成写一个Python类,方法当动作、注释当提示词,省掉一堆配置文件。原文稍后读已读值得跟进有用关注 NVIDIA
11:05AI Engineer@aiDotEngineerAI Engineer World's Fair 2026 的 Local AI Track 已开始直播,由 NVIDIA 赞助,主题是“前沿智能正变成你拥有的东西”。首场 State of the Union 由 Joseph O'Fowa、Alex Ochema、Ahmad Osman 和 Matthew Berman 主讲。Osmantic 团队在 Desktop Frontier 环节讨论桌面端 AI,Local Models 环节由 Vincent Weisser 等探讨本地模型。Compression at the Edge 环节由 Daniel Han Chen 等讲解边缘压缩,Model Routing 环节由 Walden Yan 等讨论模型路由。全程可在这条推文附带的 YouTube 链接观看。行业AI Engineer World's Fair 2026NVIDIA本地模型7 个信源在谈事件专题推荐理由:AI Engineer 大会的 Local AI 专场正在直播,讲桌面端、本地模型、边缘压缩和模型路由,想围观最新方向就看这个。原文稍后读已读值得跟进有用关注 AI Engineer World's Fair 2026