8月13日
22:07
22:07官方账号NVIDIA AI@NVIDIAAI
精选77°
NVIDIA发布官方skills插件,Cursor智能体可调用300多项技能,覆盖CUDA、NeMo、RAG等30多个产品。开发者只需描述构建目标,插件会自动推荐并执行合适技能。该插件已上架Cursor marketplace,完整技能目录托管在GitHub。
事件专题

推荐理由:NVIDIA给Cursor出了个官方插件,装完你的智能体就会用CUDA和RAG这些技能了,搞开发更省事。
18:14
18:14官方账号NVIDIA AI@NVIDIAAI
72°
NVIDIA Nemotron 3.5 Lightning 已在 Baseten 上线,定位为长时运行智能体设计。相比同类开源模型,其吞吐量提升 4 倍,成本降低 50%。在生产测试中,输出 token 数量减少 63.4%。该模型采用 30B MoE 架构,仅激活 3B 参数,支持 100 万 token 上下文。
事件专题

推荐理由:跑长时任务的智能体注意了,Nemotron 3.5 Lightning 上线 Baseten,吞吐翻 4 倍、成本砍半,输出还更精简。
18:08
18:08官方账号Groq@GroqInc
精选
Groq 宣布成为 NVIDIA 云合作伙伴。公司称这是对现有客户体验的验证,即其 AI 基础设施运行达到最高标准。CEO Adam Winter 表示,推理正在成为 AI 中最大最关键的一层,Groq 打算比任何人都运行得更好。
事件专题

推荐理由:Groq 成了 NVIDIA 的云合作伙伴,等于推理基础设施拿到官方认证,CEO 还放话要跑赢所有人。
18:06
18:06官方账号NVIDIA AI@NVIDIAAI
精选71°
Harvey联合Trajectory Labs对NVIDIA的Nemotron 3.5 Lightning进行后训练,在Legal Agent Bench上得分从0%升至8.3%。该成绩超过了Opus 4.6和更大的后训练版Nemotron 3 Ultra。后训练覆盖九个执业领域,未出现能力退化。平均输出长度从90k tokens降至37k tokens,每token奖励提升2.4倍。
事件专题

推荐理由:Harvey把Nemotron 3.5 Lightning后训练了一把,法律Agent评测从0冲到8.3%,比Opus 4.6还强,输出也从90k缩到37k,省Token。
18:04
18:04官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA Nemotron 3.5 Lightning 已在 Together AI 平台上线。该模型被定位为同类中速度最快的开源模型。它专为常驻型智能体设计,能快速完成高吞吐量的专业工作。
事件专题

推荐理由:NVIDIA 的 Nemotron 3.5 Lightning 开源模型上线 Together AI,跑得最快,适合需要高强度处理任务的智能体。
18:02
18:02官方账号NVIDIA AI@NVIDIAAI
72°
NVIDIA今日推出Nemotron 3.5 Lightning模型,并已上线Tinker平台。该模型仅激活3B参数,针对吞吐速度进行优化。它面向对延迟和成本敏感的应用场景,适合高频实时推理任务。用户可在Tinker上直接体验该模型。
事件专题

推荐理由:NVIDIA出了个轻量级新模型,3B参数跑得快又便宜,延迟敏感场景用得上,Tinker上现在就能玩。
17:55
17:55官方账号NVIDIA AI@NVIDIAAI
72°
英伟达宣布推出开源权重模型 Nemotron 3.5 Lightning。Deep Cogito 表示该模型继续推动开放模型生态,并宣布加入英伟达后训练合作伙伴生态。此次合作聚焦开源权重与可定制模型,旨在让前沿智能更易获取。
事件专题

推荐理由:英伟达出了开源版 Nemotron 3.5 Lightning,Deep Cogito 马上加入了它的后训练伙伴计划。想搞开源模型定制化的,这条有信息量。
17:55
17:55官方账号NVIDIA AI@NVIDIAAI
Uniphore实测NVIDIA Nemotron 3.5 Lightning在企业级智能体工作负载中的表现。与参数规模相近的Gemma 4 31B IT相比,Nemotron 3.5 Lightning吞吐量提升5倍,准确率也有明显增长。Uniphore已将其纳入Business AI Cloud高流量路径的评估范围。
事件专题

推荐理由:NVIDIA新模型在企业任务上直接碾压Gemma 4,吞吐量翻5倍,跑真实负载的数据很硬核。
17:42
17:42官方账号NVIDIA AI@NVIDIAAI
72°
CrowdStrike 定制 NVIDIA Nemotron 3.5 Lightning,用于网络安全 agent 工作流。该模型达到分析师级准确率,训练速度更快、计算需求更低。它能自动关闭最高 88% 的良性检测,让安全团队专注真实威胁。
事件专题

推荐理由:CrowdStrike 用 Nemotron 3.5 Lightning 做了安全智能体,自动关掉 88% 误报,训练快又省算力。
07:20
07:20官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA 发布全新 MoE 模型 Nemotron 3.5 Lightning。distil labs 作为欧洲发布合作伙伴,对其进行了微调。该团队将微调版与 4 个可比 MoE 模型在 6 项任务上对比,未微调时排名第三,微调后跃居第一。完整数值与失败场景已公布在 distil labs 博客上。
事件专题

推荐理由:NVIDIA 的 Nemotron 3.5 Lightning 微调后,在 6 项任务上超过 4 个同类 MoE 模型拿了第一。想知道怎么调出来的,可以看这篇。
8月12日
04:05
8月11日
22:52
22:52官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA 推出 Nemotron 3.5 Lightning 模型,延续开放策略,公开权重、训练数据和配方。该模型已上线 Hugging Face 平台,开发者可自由获取和定制。Nemotron 3.5 Lightning 旨在提供高性能推理能力,适用于多种自然语言处理任务。此次发布进一步巩固了 NVIDIA 在开源模型领域的布局。
事件专题

推荐理由:NVIDIA 把 Nemotron 3.5 Lightning 的权重、数据和配方全开放了,想自己改模型的话直接上 Hugging Face 就能拿,比闭源省事多了。
22:43
22:43OpenRouter@OpenRouterAI
精选
NVIDIA Nemotron 3.5 Lightning已在OpenRouter上线。该模型为30B混合专家架构,仅激活3B参数,由Nemotron 3 Ultra蒸馏而来。它面向高容量、专业化的AI智能体工作负载,相比同类模型吞吐量最高提升4倍,任务完成速度最高快30%。
事件专题

推荐理由:NVIDIA新出的轻量MoE,30B参数只激活3B,跑智能体任务比同类快30%,想省算力可以试试。
22:03
22:03官方账号NVIDIA AI@NVIDIAAI
精选73°
NVIDIA推出Nemotron 3.5 Lightning,一个30B参数的MoE模型,仅激活3B参数。该模型专为常驻智能体设计,可快速完成高并发、专业化任务。其输出速度比同类模型快4倍。模型已开源,适合需要高效推理的场景。
事件专题

推荐理由:NVIDIA出了个30B MoE模型,只激活3B参数,跑得快4倍,适合做常驻智能体,开源可白嫖。
22:02
22:02官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA推出Nemotron 3.5 Lightning,专为长时间运行的智能体工作流优化,覆盖工具调用、结果验证和任务委派等高频执行场景。该模型体积适中,可从DGX Spark到数据中心灵活部署。NVIDIA展示了其在DGX Spark上运行智能体工作流的实例,并提供了技术细节文档。
事件专题

推荐理由:NVIDIA新出的Nemotron 3.5 Lightning,专门为跑智能体高频调用工具的场景优化,体积小到能在DGX Spark上跑,适合做Agent开发的朋友看看。
22:01
22:01官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA发布NeMo Switchyard,一个用于模型路由的开源库。该库允许在智能体工作流中为不同步骤选择不同模型,例如用前沿模型处理复杂推理和规划,用Lightning模型处理高容量、专业化执行。这能优化成本和性能。更多信息见官方链接。
事件专题

推荐理由:NVIDIA出了个新开源库,能让智能体工作流里不同步骤用不同模型,省钱又高效,搞Agent的可以看看。
00:35
00:35官方一手Hugging Face: Blog博客/媒体
精选
NVIDIA发布Magpie TTS,一个开放权重的多语言语音合成模型。该模型针对低延迟场景专门优化,适合部署实时语音代理。开发者通过开放权重可以完全控制部署流程,包括自定义推理配置。Magpie TTS支持多种语言,能用于构建跨语言交互系统。
事件专题

推荐理由:NVIDIA把Magpie TTS开放权重了,能自己控制部署,低延迟跑多语言语音代理,比闭源API灵活。