7月11日
00:10
00:10官方账号LangChain@LangChainAI
精选
LangChain 团队将 NVIDIA 的 Nemotron 3 Ultra 接入 agent 框架 Deep Agents 进行调优。他们通过特定的训练和推理优化,提升了模型在复杂任务中的表现。调优后的 Nemotron 在多个 benchmark 上取得进展,展示了开源模型在智能体场景下的潜力。
事件专题

推荐理由:LangChain 分享了怎么用 Deep Agents 调优 Nemotron 3 Ultra,有具体方法,做 agent 的可以看看。
7月10日
23:56
23:56官方一手AWS Machine Learning Blog@Sandeep Raveesh-Babu
精选
本文介绍NVIDIA Nemotron 3架构的特点,并详细演示如何通过Amazon SageMaker AI的无服务器定制功能进行微调。步骤涵盖在SageMaker Studio中配置环境、加载Nemotron 3模型、调整超参数并启动训练。该方法无需管理服务器资源,支持高效迭代模型。
事件专题

推荐理由:想无服务器微调NVIDIA Nemotron 3?AWS官方教程手把手教你用SageMaker Studio搞定。
11:45
11:45官方账号arXiv cs.LG@Kaifeng Zhao, Mathis Petrovich, Haotian Zhang, Tingwu Wang, Siyu Tang, Davis Rempe
73°
ARDY 是一个流式生成框架,采用混合表示(显式根特征与潜在身体嵌入)和两阶段自回归变压器去噪器,支持在线文本提示和灵活的运动学约束。在 HumanML3D 基准和 Bones Rigplay 数据集上的评估显示,其运动质量和约束遵循度高。通过交互式演示展示动态文本控制、关键帧姿势约束、路径跟随和鼠标键盘运动控制。代码和模型已发布。
事件专题

推荐理由:NVIDIA 实验室提出 ARDY,能实时生成高质量人体运动,支持文本+约束控制,比传统方法更可控、更快速。
05:54
05:54官方账号NVIDIA AI@NVIDIAAI
精选
Flex-Forcing是NVIDIA研究团队发布的视频生成方法。当前主流方法有双向扩散(同时建模所有帧,结构稳但慢)和自回归(逐帧生成,快且支持长片段,但漂移)。Flex-Forcing训练单一模型在推理时可根据计算预算选择任一种方式或中间态。
事件专题

推荐理由:NVIDIA新出的Flex-Forcing,一个模型就能在双向扩散和自回归之间切换,想快想稳都行,挺省事的。
02:31
02:31Aravind Srinivas@AravSrinivas
精选
Arav Srinivas宣布将在美国的NVIDIA B200s上托管一个模型,并计划对Nemotron 3 Ultra进行后训练。后训练旨在提升该模型的性能,使其与美国开源模型具备同等能力。更多细节即将公布。
事件专题

推荐理由:Arav Srinivas说要在美国用B200s跑Nemotron 3 Ultra后训练,让美国开源模型追上对手进度。
7月9日
03:19
03:19官方一手NVIDIA AI Blog@Adel El Hallak
精选
NVIDIA Nemotron 3 Ultra 在 LangChain 的 Deep Agents 框架上取得开放模型最高准确率。它完成更多任务且吞吐量更高,运行速度提升10倍。其成本低于顶级闭源模型。这使得 Nemotron 3 Ultra 成为构建 AI 智能体的高性价比选择。
事件专题

推荐理由:NVIDIA 的 Nemotron 3 Ultra 和 LangChain 合作,以更低成本跑出比闭源模型快10倍的成绩,做智能体首选。
02:34
02:34Harrison Chase@hwchase17
Prime Intellect 宣布完成1.3亿美元A轮融资,由 Radical Ventures 领投,NVIDIA、Intel Capital、Dell Capital 及现有投资者跟投。该公司将利用资金构建开放超级智能堆栈(Open Superintelligence Stack),使用户能自主训练、部署并持续改进模型。此轮融资将用于加速平台开发与生态扩展。
事件专题

推荐理由:Prime Intellect 融了1.3亿美元,NVIDIA和Intel都跟投了。他们要搞开放的超级智能堆栈,让你自己训练和部署模型,不用依赖大厂。
01:46
01:46官方账号LangChain@LangChainAI
精选
NVIDIA与LangChain联合发布NemoClaw Deep Agents蓝图,包含开放权重模型层Nemotron 3 Ultra,支持领域定制。Deep Agents层提供规划、工具调用、记忆和长时任务处理能力。OpenShell Runtime作为开放运行时,允许用户控制、审计和治理。该蓝图旨在简化智能体应用的构建与部署。
事件专题

推荐理由:NVIDIA和LangChain搞的这个蓝图很实在,Nemotron 3 Ultra开放权重随便微调,智能体框架自带规划、工具、记忆,运行时也开源可审计。
01:42
01:42官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA AI 与 LangChain 联合推出基于 Nemotron 3 Ultra 的 Deep Agents 开源智能体框架。该 agent 在评测中取得 0.86 聚合分数,推理成本仅 4.48 美元。而性能最接近的闭源模型成本为 43.48 美元,实现了 10 倍的成本降低。框架完全开放可定制,开发者可直接使用。
事件专题

推荐理由:NVIDIA 和 LangChain 搞了个开源智能体,用 Nemotron 3 Ultra 跑 Deep Agents,性能比肩闭源但成本只要 4 块多,比最接近的对手便宜 10 倍。搞 AI agent 的值得看看。
01:01
01:01官方账号LangChain@LangChainAI
精选
LangChain调整了NVIDIA Nemotron 3 Ultra模型的推理框架,在基准测试中获得0.86的聚合分数,成本仅4.48美元。与之性能最接近的模型成本为43.48美元,实现了10倍的成本降低。该优化在保持领先性能的同时大幅降低了推理开销。
事件专题

推荐理由:LangChain让Nemotron 3 Ultra跑分0.86,成本只要4.48刀,比对手便宜近10倍,性价比拉满。
7月8日
23:37
23:37Harrison Chase@hwchase17
精选
LangChain与NVIDIA合作发布NemoClaw Deep Agents Blueprint,这是一个完全开源的企业级代理系统参考架构。该蓝图在基准测试中取得领先性能,同时推理成本相比现有方案降低超过10倍。企业可以完全拥有并自定义整个堆栈。
事件专题

推荐理由:LangChain和NVIDIA联手搞了个叫NemoClaw的开源代理系统,性能领先还便宜10倍以上,搞企业级AI代理的可以看看。
16:44
10:31
10:31官方账号NVIDIA AI@NVIDIAAI
精选74°
NVIDIA 开源了 NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-NVFP4 模型,总参数量 75.3B,激活参数 9.3B,采用 MoE 架构。该模型从 Nemotron-3-Super-120B 通过 Iterative Puzzle 框架压缩而来,支持 1M token 上下文长度。模型可运行在单张 GB10 显卡上。
事件专题

推荐理由:NVIDIA 刚开源的 75B MoE 模型,实际只激活 9.3B 参数,单卡就能跑百万 token 上下文,适合长文档或代码分析。
08:54
08:54官方一手marktechpost@Asif Razzaq
NVIDIA发布了Nemotron-Labs-Audex-30B-A3B(Audex)模型,这是一个混合专家(MoE)架构,统一了音频理解、语音识别、翻译、文本转语音和音频生成五种能力。该模型以Nemotron-Cascade-2为骨干,仅在音频任务上产生边际的性能回归。Audex在30B总参数中仅有3B活跃参数,高效实现了多模态融合。
事件专题

推荐理由:NVIDIA发了款新模型Audex,能同时搞定音频理解、语音识别、翻译、TTS和音频生成,而且几乎没牺牲原有文本模型的性能。
7月7日
01:11
01:11官方账号NVIDIA AI@NVIDIAAI
精选
在 ICML 2026 上,NVIDIA 的 Nemotron 模型和数据集被 145 篇论文引用。NVIDIA 自身有 74 篇论文被接受,约 2000 篇论文引用了 NVIDIA GPU。这些数据体现了 NVIDIA 在 AI 研究中的基础设施地位。Nemotron 作为开放模型正在成为现代 AI 研究的基础。
事件专题

推荐理由:NVIDIA在ICML 2026上刷了一波存在感:145篇论文用上Nemotron,74篇自家论文入选,还有2000篇靠NVIDIA GPU跑出来的。学术圈地位一览无余。
7月5日
00:11
00:11官方一手marktechpost@Asif Razzaq
NVIDIA 发布 HORIZON 框架,一种免手动代理,通过 Git Worktrees 将每个 RTL 问题作为版本化仓库托管。该框架在多个 RTL 基准测试中达到 100% 完成率,无需人工干预。HORIZON 自动迭代设计、验证和修复硬件描述代码,显著提升芯片设计效率。
事件专题

推荐理由:NVIDIA 新出的 HORIZON 代理,能自动搞定 RTL 设计,基准测试全通过,做芯片验证的可以看看。
7月4日
14:38
14:38官方一手marktechpost@Asif Razzaq
NVIDIA 发布了 ASPIRE 自改进机器人框架,能自动编写并优化机器人控制程序。该框架在 LIBERO-Pro 长任务上实现 31% 零样本成功率,并通过迭代修复将性能提升最多 77 点。ASPIRE 还能将已验证的修复技能蒸馏为可复用的技能库,支持零样本迁移到未见过的长时任务。
事件专题

推荐理由:NVIDIA 搞了个新框架 ASPIRE,自己写程序自己修,LIBERO-Pro 长任务零样本就 31%,还能再提 77 点,做机器人的可以看看。
7月3日
10:14
7月2日
23:29
23:29官方账号LMSYS Org (SGLang)@lmsysorg
76°
NVIDIA推出Qwen3.6-27B-NVFP4模型,采用4位浮点量化,模型大小仅为BF16版本的约1/2.5。该模型在MMLU Pro基准上达到86.3分,与FP8版本性能几乎无损。上下文长度完整保留262K。SGLang已提供Day-0支持,并附带cookbook。
事件专题

推荐理由:NVIDIA新出的Qwen3.6-27B模型,4位量化体积小很多但精度没怎么降,SGLang直接就能用,可以去试试。
7月1日
15:50
15:50AI Will@FinanceYF5
根据统计,55位C级高管常驻西雅图,来自Anthropic、OpenAI、NVIDIA、Cisco等公司。还包括Palo Alto Networks、CrowdStrike、Shopify、Stripe。西雅图拥有全美25%的AI工程师和第二大开发者人才池。该数据凸显西雅图作为全球科技巨头工程中心的地位。
事件专题

推荐理由:西雅图不只有AWS和微软,这份统计列出了55位来自Anthropic、OpenAI等公司的C级高管,让你看清AI人才聚集地。