7月1日
03:13
03:13官方账号Nous Research@NousResearch
Hermes Agent Accelerated Business Hackathon由NVIDIA AI、Stripe和NousResearch联合举办,提交将于6月30日太平洋时间晚11:59截止。目前仅剩一天时间,鼓励最后时刻提交项目。黑客松聚焦于AI Agent应用开发。
事件专题

推荐理由:还剩一天!想参加NVIDIA和Stripe办的Agent黑客松的话,赶紧提交项目,截止时间是明天晚上。
02:17
02:17官方账号NVIDIA AI@NVIDIAAI
Nemotron Labs发布了一项基于5000名Kaggle竞赛参与者数据的研究。他们分析了参与者的解题行为与推理策略。研究揭示了团队协作和多样化方法对提升AI推理效果的关键作用。这些经验可直接应用于现有模型的优化。
事件专题

推荐理由:Nemotron Labs用5000个Kaggle实战案例总结了AI推理的改进方法,比看论文更接地气。
01:51
01:51官方账号Jim Fan@jimfan
精选
NVIDIA GEAR lab 联合 UMich、Berkeley、CMU 推出 ASPIRE,这是首个自动化机器人技能发现系统。它不逐个解决任务,而是持续发现并积累可复用技能,作为机器人智能的构建模块。ASPIRE 支持多任务迁移、sim-to-real 迁移以及跨实体迁移。相关论文和项目页面已在 research.nvidia.com 发布。
事件专题

推荐理由:NVIDIA 和几个顶级高校联手搞了个新系统 ASPIRE,能自动发现并存下可复用的机器人技能,跨任务、跨仿真到现实、跨机器人本体都能迁移,挺有看头。
6月30日
14:14
14:14AI Will@FinanceYF5
田渊栋(前Meta FAIR研究员、ELF OpenGo作者、CMU机器人博士)创立Recursive Superintelligence,目标是让AI自主完成研究和自我改进。该公司获得6.5亿美元融资,估值达46.5亿美元,投资方包括GV、NVIDIA和AMD。
事件专题

推荐理由:田渊栋的新公司让AI自己搞研究,拿了6.5亿美元融资,比很多AI实验室都猛。
12:27
12:27官方账号NVIDIA AI@NVIDIAAI
NVIDIA 宣布其 Nemotron 模型与 LangChain 集成,覆盖从推理到编排的智能体工作流。开发者可在开放栈上自定义、调优和部署模型。该集成面向生产环境,基于 LangChain 框架实现灵活编排。Nemotron 是 NVIDIA 的前沿智能体性能模型,支持多种部署方式。
事件专题

推荐理由:NVIDIA的Nemotron现在接入了LangChain,你可以按需调优和部署智能体,不受厂商锁定,适合做定制化AI代理。
03:09
03:09官方一手marktechpost@Asif Razzaq
精选
NVIDIA 开源了 BioNeMo Agent Toolkit,将 OpenFold3、DiffDock 和 GenMol 等生物分子模型包装为 AI 代理可直接调用的技能。每个技能包含模型用途、输入、输出和失败模式说明。在 NVIDIA 使用 Codex CLI 和 GPT-5.5 fast 的基准测试中,该工具将任务完成率从 57.1% 提升至 100%,并实现 token 效率翻倍。
事件专题

推荐理由:NVIDIA 开源了这个工具,让 AI 代理能直接调用分子模型做药物发现。用上它任务完成率翻倍还省 Token,做生物计算的同学可以试试。
6月29日
18:57
18:57官方账号vLLM@vllm_project
精选
NVIDIA 与 vLLM 合作发布 step-by-step 指南,教你用四台 DGX Spark 盒子组建私有集群,自托管 550B 参数的 Nemotron-3-Ultra 模型。指南基于 vLLM 官方容器,可提供兼容 OpenAI 的端点。无需数据中心,适合构建私有 agent 工作流。
事件专题

推荐理由:想不依赖数据中心自己跑 550B 模型?NVIDIA 出了详细教程,四台 DGX Spark 就能拼出 OpenAI 兼容的端点。
13:50
13:50官方账号阿里云 Alibaba Cloud@alibaba_cloud
在Flink Forward Asia Shenzhen 2026上,NVIDIA的Chuan Chen介绍了与阿里云的技术合作。双方通过CUDA库加速Apache Flink的多模态数据流处理。这一开源协作实现了端到端高性能多模态流式架构,适用于AI评论、实时图文流和交互式问答。
事件专题

推荐理由:NVIDIA和阿里云用CUDA把Flink的多模态数据处理速度拉满了,想做实时AI评论或图文问答的可以看看这个架构。
6月27日
13:54
13:54官方账号vLLM@vllm_project
精选
NVIDIA发布GLM-5.2的NVFP4检查点,在Blackwell GPU上相比FP8内存占用降低一半。该模型在推理、编码和长上下文基准测试中保持与FP8相同的准确率。用户可通过vLLM直接加载运行:vllm serve nvidia/GLM-5.2-NVFP4。
事件专题

推荐理由:想省显存又不想降精度?GLM-5.2的NVFP4版在vLLM上线了,比FP8省一半内存,推理编码长文本都稳。
6月25日
00:51
00:51官方一手Hugging Face: Blog博客/媒体
精选
NVIDIA 发布 NeMo AutoModel,通过自动化模型并行、混合精度训练和梯度检查点,简化 Transformer 模型微调流程。该工具可自动检测硬件配置,支持多 GPU 分布式训练,无需手动调整参数。在微调 BERT-base 模型时,相比标准 PyTorch 实现,NeMo AutoModel 将训练时间缩短约 40%,并保持相同精度。
事件专题

推荐理由:NVIDIA 搞了个 NeMo AutoModel,能自动帮你加速微调 Transformer 模型,省去手动调参的麻烦,速度还快很多,适合想快速出结果的人。
6月24日
09:58
09:58官方一手Pandaily@contact@pandaily.com (Pandaily)
NVIDIA、高通等芯片巨头正在加码具身AI芯片赛道。多家公司发布了针对人形机器人等应用的专用芯片方案。市场争夺日趋白热化,各厂商正通过差异化设计和生态合作抢占先机。
事件专题

推荐理由:NVIDIA和高通都在押注具身AI芯片,看看他们谁能笑到最后。
6月23日
6月20日
06:57
06:57官方一手marktechpost@Asif Razzaq
NVIDIA AI推出了SpatialClaw,这是一个无需训练的智能体。它通过编写Python代码在持久内核中执行,将代码作为动作接口。SpatialClaw能够组合多种感知工具,实现3D空间推理。这种设计免去了传统微调或训练步骤。
事件专题

推荐理由:NVIDIA搞了个叫SpatialClaw的智能体,不用训练,直接用写Python代码的方式做3D空间推理,挺创新的。
6月19日
18:42
18:42官方账号Together AI@togethercompute
Together AI的James Zou与NVIDIA的Venkat Srinivasan将于7月1日在AI Engineer World's Fair上讨论开放模型如何实现集体智能。该活动聚焦开源模型在协作智能系统中的作用。演讲将结合两家公司的技术实践,分析开放模型对多智能体架构的影响。
事件专题

推荐理由:想了解开放模型怎么支撑多智能体协作?Together AI和NVIDIA的人要聊这个,7月1日别错过。
18:19
18:19官方一手pandaily@contact@pandaily.com (Pandaily)
73°
Coherent、Nokia、JX Advanced Metals 等全球光芯片厂商宣布扩大产能,以满足AI数据中心对高速互联的需求。NVIDIA 为此投资20亿美元,锁定光子互连供应链。这些扩产计划预计在2026年前完成,以支撑下一代AI网络架构。
事件专题

推荐理由:光芯片是AI数据中心的血管,英伟达砸20亿锁定供应,可以了解一下三巨头各自的扩产计划