04:42Aravind Srinivas@AravSrinivas73°Perplexity Computer在NVIDIA DGX Spark上实现了完全本地运行。演示展示了该便携式计算机在本地环境中的性能表现。DGX Spark是NVIDIA的AI计算平台。Perplexity Computer是一款便携式AI设备。AI产品Perplexity ComputerDGX SparkNVIDIA4 个信源在谈事件专题推荐理由:看Perplexity Computer如何在DGX Spark上实现本地运行,比云端更安全快速。原文稍后读已读值得跟进有用关注 Perplexity Computer
03:23官方账号NVIDIA AI@NVIDIAAI73°Open Secure AI Alliance现已成为Linux基金会的一部分。该联盟最初由NVIDIA创立,将开发开源工具、共享标准和防御实践。这些工具和实践将帮助组织检查、审计和保障AI系统安全。联盟致力于提供开放、实用的AI系统安全方案。行业Open Secure AI AllianceLinux FoundationNVIDIA4 个信源在谈事件专题推荐理由:NVIDIA发起的Open Secure AI Alliance加入Linux基金会,共同开发开源AI安全工具和标准。原文稍后读已读值得跟进有用关注 Open Secure AI Alliance
02:12官方一手marktechpost@Michal SutterNVIDIA发布了Switchyard,一个Apache-2.0许可的Rust代理和库,用于LLM流量处理。该工具可将请求解码为提供商中立类型,使用直通、随机、LLM分类器或阶段路由器算法进行路由,并将响应转换回客户端格式。Switchyard支持Claude Code或Codex CLI在vLLM、NIM或Ollama上运行无需修改。目前项目处于预alpha阶段,不适合生产环境使用。AI产品SwitchyardNVIDIAOpenAI10 个信源在谈事件专题推荐理由:NVIDIA出了个Switchyard代理库,能让OpenAI和Anthropic API互转,Claude Code和Codex CLI能无缝跑在vLLM上。原文稍后读已读值得跟进有用关注 Switchyard
02:44官方账号NVIDIA AI@NVIDIAAINVIDIA与CrowdStrike合作测试SafeMind智能体系统。该系统通过AI模拟攻击,将遥测数据转化为检测规则,并测试新攻击路径。测试结果显示系统能够防御未见过的攻击类型。CrowdStrike的SafeMind系统在网络安全领域展现了创新应用。行业SafeMindCrowdStrikeNVIDIA5 个信源在谈事件专题推荐理由:NVIDIA和CrowdStrike合作测试了SafeMind智能体系统,能自动防御未知攻击,比传统安全系统更智能。原文稍后读已读值得跟进有用关注 SafeMind
02:43官方账号NVIDIA AI@NVIDIAAINVIDIA使用Nemotron 3 Ultra进行编排,配合微调后的Nemeton 3 Super编写和修复检测规则。这些规则测试了8种未用于创建规则的新型攻击。其中3条规则通过了所有质量门限,成功捕获全部8种攻击。技术细节可在nvda.ws/4iE6JOX查看。AI产品NVIDIANemotron安全检测5 个信源在谈事件专题推荐理由:NVIDIA用Nemotron模型测试了安全检测规则,3条规则成功捕获全部8种新型攻击。原文稍后读已读值得跟进有用关注 NVIDIA
17:11AI Will@FinanceYF5Honen平台上线一个月,可将企业内部知识转化为持续自我优化的互动课程。该平台已与NVIDIA达成合作,为25万名学习者提供AI素养培训。Honen致力于确保个人和企业不落后于AI发展潮流。AI产品HonenNVIDIAAI素养1 个信源在谈事件专题推荐理由:Honen刚上线一个月就与NVIDIA合作,能将企业知识变智能课程,已培训25万人学AI素养。原文稍后读已读值得跟进有用关注 Honen
06:26官方账号NVIDIA AI@NVIDIAAI精选NVIDIA Dynamo是一个围绕推理引擎的工具,支持与SGL、vLLM和TensorRT-LLM等引擎协作。Dynamo能够帮助用户在多个GPU和节点上扩展推理性能。该工具通过优化推理流程来提升AI模型的部署效率。AI产品NVIDIADynamo推理引擎3 个信源在谈事件专题推荐理由:NVIDIA解释了Dynamo如何与现有推理引擎配合工作,帮你扩展GPU推理能力。原文稍后读已读值得跟进有用关注 NVIDIA
04:26lmarena.ai@lmarena_ai73°NVIDIA将AI模型发布周期从6-8个月缩短至4-6周。NVIDIA应用深度学习研究副总裁Bryan Catanzaro详细介绍了这一变化。NVIDIA将约30%的Nemotron计算资源用于合成数据生成。视频展示了GPT-3与Muse Glimmer等模型在参数和能力上的对比。行业NVIDIANemotronBryan Catanzaro6 个信源在谈事件专题推荐理由:NVIDIA高管揭秘如何将模型发布周期缩短一半,还分享了计算资源分配策略原文稍后读已读值得跟进有用关注 NVIDIA
12:10官方账号阿里通义 Qwen@Alibaba_Qwen精选Alibaba Qwen3.8-Flash-Next模型发布,支持NVIDIA NeMo AutoModel和NeMo RL微调,提供运行食谱。AI模型NVIDIA NeMo AutoModelAlibaba Qwen模型微调10 个信源在谈事件专题推荐理由:Alibaba Qwen3.8-Flash-Next模型发布,NVIDIA提供微调支持,与TokenSpeed等工具兼容,值得开发者关注。原文稍后读已读值得跟进有用关注 NVIDIA NeMo AutoModel
10:38官方账号Latent Space (swyx)(博客/媒体)78°NVIDIA宣布以130亿美元收购开源公司HuggingFace,同时OpenAI发布其HF事件回顾。HuggingFace为开源社区提供强大的自然语言处理工具,而OpenAI则对近期事件进行反思。行业NVIDIAHuggingFaceOpenAI10 个信源在谈事件专题推荐理由:NVIDIA大手笔收购开源NLP工具,OpenAI反思事件,开源社区再获关注。原文稍后读已读值得跟进有用关注 NVIDIA
23:14官方账号阿里通义 Qwen@Alibaba_Qwen精选@vllm_project使Qwen3.8-Flash-Next从第一天起就在NVIDIA和AMD上运行,超稀疏多模态MoE模型,125B参数,6B活跃,262K本地,1M通过YaRN,额外51B N-gram表可卸载,Qwen Sparse Attention是新的引擎工作所在。AI模型Qwen3.8-Flash-Next多模态MoENVIDIA10 个信源在谈事件专题推荐理由:@vllm_project让Qwen3.8-Flash-Next在NVIDIA和AMD上无缝运行,新模型带来更多可能性,值得一看!原文稍后读已读值得跟进有用关注 Qwen3.8-Flash-Next
07:23IT之家(博客/媒体)NVIDIA推出Jetson Orin Nano 2,算力提升至前代2倍,功耗降低至前代的60%,AI算力达78 TOPS,集成8核CPU和8GB内存。预计2027H1上市。AI产品NVIDIAJetson Orin Nano 2边缘人工智能4 个信源在谈事件专题推荐理由:NVIDIA新推出的Jetson Orin Nano 2算力翻倍,功耗降低,为开发者提供实时推理性能和能效,是边缘人工智能的不错选择。原文稍后读已读值得跟进有用关注 NVIDIA
23:42IT之家(博客/媒体)NVIDIA发布DLSS 4.5光线重建技术,采用第二代Transformer AI模型,提升35%计算能力,增强降噪和空间感知。IT之家实测对比DLSS 4.5与DLSS 4在《生化危机:安魂曲》等游戏中的表现,画面细节和反射效果显著提升。AI产品NVIDIADLSS 4.5光线重建3 个信源在谈事件专题推荐理由:NVIDIA发布DLSS 4.5,游戏画面细节提升明显,值得一试。原文稍后读已读值得跟进有用关注 NVIDIA
07:35官方账号Groq@GroqInc精选NVIDIA在其博客上发布了更多关于其技术的细节。查看博客以获取更多信息。论文NVIDIA技术细节博客2 个信源在谈事件专题推荐理由:NVIDIA分享了更多技术细节,了解其最新进展。原文稍后读已读值得跟进有用关注 NVIDIA
23:23lmarena.ai@lmarena_ai精选78°NVIDIA应用深度学习研究副总裁Bryan Catanzaro与Peter Gostev讨论了Nemotron模型家族的构建过程,以及NVIDIA加速开放模型发布的原因。讨论内容包括特殊教师模型在构建强大能力中的作用,训练后推理的挑战,开源模型的重要性,以及这一切对NVIDIA构建Nemotron的意义。行业NVIDIANemotron模型家族开放模型8 个信源在谈事件专题推荐理由:想了解NVIDIA如何快速发布前沿开放模型?来看看Bryan Catanzaro和Peter Gostev的讨论,了解Nemotron模型家族的构建过程和开源模型的重要性。原文稍后读已读值得跟进有用关注 NVIDIA
21:36elvis@omarsar0精选NVIDIA新论文探讨评估智能体技能,提出Skill Lift方法,通过对比加载与未加载技能的执行差异来衡量技能提升。研究基于145个真实技能案例,发现技能执行、行为检查和技能效率方面有显著提升。论文NVIDIA智能体技能评估3 个信源在谈事件专题推荐理由:NVIDIA提出Skill Lift新方法,评估智能体技能提升,与现有方法相比有显著优势,值得一读。原文稍后读已读值得跟进有用关注 NVIDIA
11:33IT之家(博客/媒体)NVIDIA 考虑向 Perplexity AI 投资“数十亿美元”,双方正磋商交易,可能达成技术授权协议。Perplexity AI 计划以超过 300 亿美元的估值进行新一轮融资,年化营收规模从 2.5 亿美元增长至 7.5 亿美元以上。行业NVIDIAPerplexity AI投资9 个信源在谈事件专题推荐理由:NVIDIA 考虑投资 Perplexity AI,估值高达 300 亿美元,营收增长迅速,值得关注。原文稍后读已读值得跟进有用关注 NVIDIA
01:19elvis@omarsar0Jacob Peake分享一篇关于AI芯片架构的长篇博客,涵盖NVIDIA、AMD、TPU、Trainium、Cerebras、Groq等主要架构,分析架构、扩展(向上扩展和向外扩展)和软件堆栈,帮助理解架构及其权衡。论文AI芯片架构NVIDIAAMD2 个信源在谈事件专题推荐理由:想要了解AI芯片架构全景的朋友,强烈推荐阅读Jacob Peake的这篇博客,内容详实,对架构和权衡有深入分析。原文稍后读已读值得跟进有用关注 AI芯片架构
01:13lmarena.ai@lmarena_aiNVIDIA应用深度学习研究副总裁@ctnzr将参与Arena Conversations新节目,探讨教师模型在构建强大能力中的作用、训练后推理挑战的增长、开源模型的重要性以及这对NVIDIA构建Nemotron的意义。节目将于8月24日早上9点(东部时间)/6点(太平洋时间)播出。行业NVIDIA教师模型开源模型8 个信源在谈事件专题推荐理由:想了解NVIDIA如何利用教师模型和开源模型构建Nemotron的读者,不要错过这场专家访谈!原文稍后读已读值得跟进有用关注 NVIDIA
12:03ollama@ollama72°PoolsideAI与NVIDIA工程师合作推出开放模型,旨在构建美国开放人工智能生态系统,与中美AI巨头竞争。行业PoolsideAINVIDIA开放模型7 个信源在谈事件专题推荐理由:PoolsideAI和NVIDIA合作推出开放模型,值得关注其未来发展。原文稍后读已读值得跟进有用关注 PoolsideAI
06:18官方账号Clement Delangue@ClementDelangue81°NVIDIA自建编码工具优化CUDA GPU内核,在ARC-AGI-3的25款游戏中全通关,实现183个关卡。将使AI模型和内核的运行、优化、后训练变得容易,预计将有1亿AI开发者。AI模型NVIDIACUDA优化4 个信源在谈事件专题推荐理由:NVIDIA优化CUDA内核,实现100%通关,让AI开发更简单,预计1亿开发者参与。原文稍后读已读值得跟进有用关注 NVIDIA
01:34官方账号NVIDIA AI@NVIDIAAI精选随着AI智能体承担更复杂任务,NVIDIA讨论了安全在智能体堆栈中的定位。指南控制智能体尝试做什么,基础设施控制它能做什么。AI安全和安全团队分享了他们的思考。AI模型AI安全智能体安全控制3 个信源在谈事件专题推荐理由:NVIDIA探讨了AI智能体安全定位,了解如何在智能体堆栈中实现安全控制。原文稍后读已读值得跟进有用关注 AI安全
01:34官方账号NVIDIA AI@NVIDIAAI精选78°NVIDIA 深入解析堆栈组件,从引导智能体行为的组件到确保其安全边界的基础设施。阅读详细分析:nvda.ws/4zyvjHm技巧NVIDIA智能体堆栈组件1 个信源在谈事件专题推荐理由:NVIDIA 深入解析堆栈组件,了解智能体行为引导和安全性保障。原文稍后读已读值得跟进有用关注 NVIDIA
01:08Jim Fan@DrJimFan精选73°T-Rex 是一种全新的机器人触觉探索方法,通过将触觉视为模型的第一公民,结合视觉和触觉专家进行实时运动规划与修正。同时,开源了最大的触觉数据集,并提供了训练方法。NVIDIA 和加州大学伯克利分校合作开发。AI模型触觉探索机器人触觉T-Rex3 个信源在谈事件专题推荐理由:T-Rex 是一种全新的机器人触觉探索方法,结合了视觉和触觉专家,能够实现更精准的运动规划。开源的数据集和训练方法,让更多人能够参与到机器人触觉研究中。原文稍后读已读值得跟进有用关注 触觉探索
21:38官方账号NVIDIA AI@NVIDIAAINVIDIA AVO通用编码智能体在ARC-AGI-3推理基准测试中满分,完成183个级别,无需指令或规则自主决策。AI模型NVIDIAARC-AGI-3智能体3 个信源在谈事件专题推荐理由:NVIDIA的通用编码智能体ARC-AGI-3测试满分,展示了强大的自主推理能力,是AI领域的又一里程碑!原文稍后读已读值得跟进有用关注 NVIDIA
16:18IT之家(博客/媒体)NVIDIA与韩国AI芯片企业Rebellions就潜在合作进行初步讨论,双方领导人会面探讨技术合作、投资或收购。Rebellions的Rebel100产品拥有2 PFLOPS FP8算力,523MB SRAM缓存和144GB HBM3E内存。行业NVIDIARebellionsAI芯片6 个信源在谈事件专题推荐理由:NVIDIA与Rebellions初步探讨合作,关注AI芯片技术合作动态,Rebel100性能值得关注。原文稍后读已读值得跟进有用关注 NVIDIA
14:13官方账号Latent Space (swyx)(博客/媒体)Poolside公司获得120亿美元反向雇佣至NVIDIA,创始人获得10亿美元,员工获得60亿美元,Infraco扩展至70吉瓦新云服务行业PoolsideNVIDIA反向雇佣6 个信源在谈事件专题推荐理由:Poolside反向雇佣至NVIDIA,创始人及员工获得巨额回报,关注云计算扩展动态原文稍后读已读值得跟进有用关注 Poolside
04:02官方账号Greg Brockman@gdb81°OpenAI 宣布其首批 NVIDIA Vera Rubin 机架已到货并运行训练栈。这是扩展算力的重要一步。该算力将支持 OpenAI 下一代前沿 AI 模型的预训练。行业OpenAINVIDIAVera Rubin10 个信源在谈事件专题推荐理由:OpenAI 的首批 NVIDIA Vera Rubin 机架上线了,能支持下一代前沿 AI 模型训练,比之前的算力更强。原文稍后读已读值得跟进有用关注 OpenAI
01:25官方账号NVIDIA AI@NVIDIAAI74°英伟达对超300项验证技能开展基准测试,以相同任务、模型和设置对比有无技能的代理表现。在多项真实任务基准中,带技能的代理正确率提升41个百分点。与无技能代理相比,带技能代理效率提升35个百分点。AI模型NVIDIASkillsBenchmark7 个信源在谈事件专题推荐理由:英伟达测试超300项技能,对比后可知技能对代理帮助大小, 和无技能代理比效果不同, 值得去了解。原文稍后读已读值得跟进有用关注 NVIDIA
07:06官方一手OpenAI Blog(博客/媒体)NVIDIA团队使用ChatGPT Work减少手动任务,连接快速变化的信号,并在全球范围内扩展成功的工作流程。OpenAI官网介绍了这一案例,展示了ChatGPT Work在企业中的应用。NVIDIA通过该工具提升了工作效率,实现了知识共享和流程标准化。AI产品ChatGPT WorkNVIDIAOpenAI10 个信源在谈事件专题推荐理由:看看NVIDIA怎么用ChatGPT Work干活,减少重复劳动,还能把好流程推广到全球。原文稍后读已读值得跟进有用关注 ChatGPT Work
01:34官方账号NVIDIA AI@NVIDIAAI精选78°NVIDIA 发布了 TensorRT Model Connect 公测版。用户只需两个命令即可将 Hugging Face 模型转换为 TensorRT 推理格式。该工具无需中间 ONNX 导出,生成的包支持原生 C++ API。整个项目由 OpenAI Codex agents 构建,人类负责指导和审查工作。AI产品NVIDIATensorRTHugging Face10 个信源在谈事件专题推荐理由:NVIDIA 发了个工具,两行命令把 Hugging Face 模型转 TensorRT,省去 ONNX 导出步骤。原文稍后读已读值得跟进有用关注 NVIDIA
00:12官方账号NVIDIA AI@NVIDIAAINVIDIA AI 官方账号在 X 上发文,称今年夏天是开源 AI 的黄金时期,并询问网友最喜欢的开源发布。该推文引发讨论,目前已有 7 条回复、6 个点赞和 1547 次浏览。NVIDIA 近期在开源领域动作频繁,包括发布多个模型和工具。行业NVIDIA开源模型AI社区10 个信源在谈事件专题推荐理由:NVIDIA 官方在 X 上问大家最喜欢的开源发布,评论区有料,看看社区都在聊啥。原文稍后读已读值得跟进有用关注 NVIDIA
09:43IT之家(博客/媒体)Groq在8月17日宣布以35亿美元估值完成3.5亿美元A轮融资,由Disruptive领投,NVIDIA计划参与。此前的6月,Groq已获6.5亿美元融资,近期累计达10亿美元。去年12月,Groq与NVIDIA签署价值200亿美元的非独家技术许可协议,授权其LPU推理加速ASIC。本月12日,Groq成为NVIDIA云合作伙伴,将提供基于NVIDIA加速集群的训练和推理服务。其算力容量计划从当前的54MW提升至2027年的200+MW。行业GroqNVIDIANeocloud7 个信源在谈事件专题推荐理由:Groq从芯片厂转型做云服务,刚拿了3.5亿美元,NVIDIA也要参投,以后能用上它的LPU和NVIDIA集群算力。原文稍后读已读值得跟进有用关注 Groq
06:13ollama@ollama8月20日,Ollama在旧金山举办线下聚会,邀请NVIDIA、friendliai、OpenHandsDev的四位从业者展开对谈。讨论焦点是开源模型如何改变AI原生工程成本,以及编程助手投入生产的实际路径。活动包含观众问答和自由交流,名额有限,需通过Luma链接报名。行业OllamaNVIDIAfriendliai10 个信源在谈事件专题推荐理由:Ollama这周四旧金山组了个局,NVIDIA和几家开源项目的工程师会聊编程助手落地,现场有问答和社交,想去的记得先RSVP。原文稍后读已读值得跟进有用关注 Ollama
02:15官方一手AWS Machine Learning Blog@Venu Kanamatareddy精选NVIDIA Nemotron 3.5 Lightning 已可在 Amazon SageMaker JumpStart 中部署。这是一款面向高并发智能体工作负载的开源模型,采用 30B 参数的 MoE 架构,其中活跃参数为 3B。该模型可提供最高 4 倍的吞吐量提升,以及最高 30% 更快的任务完成速度。开发者可通过 SageMaker JumpStart 一键启动部署。AI模型Nemotron 3.5 LightningNVIDIASageMaker JumpStart5 个信源在谈事件专题推荐理由:英伟达的新开源模型,30B MoE 但只跑 3B 活跃参数,放在 SageMaker 上直接部署,专为智能体高频调用设计,吞吐量翻 4 倍,适合跑大批量任务的人。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
14:50IT之家(博客/媒体)精选TrendForce 预测,2026 年液冷散热在 AI 芯片中的渗透率将从 2025 年的约 33% 升至 53%。英伟达、AMD 的芯片方案已全面采用液冷技术。谷歌在云服务商中率先导入液冷,覆盖其 AI 服务器比例超过 80%。英伟达 Vera Rubin 平台将导入全液冷架构,散热范围扩大至 CX9 网卡、配电板等部件,AVC 预计第三季出货该平台水冷板模块。行业液冷散热TrendForceNVIDIA8 个信源在谈事件专题推荐理由:AI 服务器散热要转液冷了,明年渗透率过半,谷歌已经大面积用,英伟达新平台也全液冷,做散热件的 AVC 要出货了。原文稍后读已读值得跟进有用关注 液冷散热
18:44IT之家(博客/媒体)72°英伟达8月11日宣布与阿波罗、贝莱德、黑石、布鲁克菲尔德、高盛和KKR合作,建立独立融资平台,计划调动超5000亿美元第三方资本用于AI基础设施。黄仁勋称,部分AI基础设施投资项目可获最高25%的残值支持,以降低金融机构的资产融资风险。英伟达强调,该融资平台面向符合条件的AI实验室、企业和云服务商,金融机构将独立评估项目。英伟达以A100为例称,这款2020年推出的GPU到2026年仍用于AI训练、微调、推理和高性能计算,说明硬件可通过软件升级延长经济寿命。行业NVIDIAAI基础设施融资平台2 个信源在谈事件专题推荐理由:英伟达携手六家金融巨头要调动超5000亿美元建AI算力,还给项目最高25%残值补贴,这条讲清了钱怎么流转。原文稍后读已读值得跟进有用关注 NVIDIA
12:33官方账号阿里通义 Qwen@Alibaba_QwenQwen3.8-27B是阿里开源模型,目前可在NVIDIA RTX Spark上本地运行。开发者能够直接下载、部署这款27B模型,并基于它构建应用。推文显示该模型在RTX Spark上运行流畅,为本地AI开发提供了新选择。AI模型Qwen3.8-27BRTX SparkNVIDIA7 个信源在谈事件专题推荐理由:阿里把Qwen3.8-27B开源了,还能在RTX Spark上本地跑,下载就能部署,不用走云端。原文稍后读已读值得跟进有用关注 Qwen3.8-27B
03:33官方账号NVIDIA AI@NVIDIAAI71°NVIDIA发布开源库NeMo Switchyard,用于智能体工作流中的模型路由。该库允许复杂推理和规划步骤调用前沿模型,高容量专门执行使用Nemotron Lightning。开发者可自定义路由策略,在成本和性能间灵活取舍。AI产品NVIDIANeMoSwitchyard3 个信源在谈事件专题推荐理由:NVIDIA出了个开源的模型路由库Switchyard,能让工作流里复杂步骤用强模型、简单步骤用轻量模型,省成本。原文稍后读已读值得跟进有用关注 NVIDIA
14:12IT之家(博客/媒体)LG 与 NVIDIA 于当地时间 13 日在圣克拉拉签署谅解备忘录,双方 CEO 出席。LG 将在田纳西州洗衣机工厂验证轮式机器人 CLOiD,计划 2027 年第一季度推出基于 Jetson Thor 芯片和 Isaac GR00T 平台的双足人形机器人。LG 还计划 2027 年上半年建设基于 Vera Rubin 芯片的 NVIDIA DSX 架构 AI 工厂示范项目,并在 2028 年上半年建成 80MW AI 工厂。此外,LG 将开发集成自有车载软件的 NVIDIA DRIVE Hyperion 高性能计算平台。行业LGNVIDIA人形机器人3 个信源在谈事件专题推荐理由:LG 和英伟达正式签约了,要造双足机器人和 80MW 的 AI 工厂,还把芯片用到车上,值得看看细节。原文稍后读已读值得跟进有用关注 LG