英伟达NVIDIA
AI 训练与推理 GPU 的主要供应商
在做什么
英伟达总部在加州圣克拉拉,GPU 与 CUDA 软件栈是大模型训练和推理的主要算力来源,业务还包括数据中心网络、自动驾驶与机器人平台。
最近动态
信息流里提到这家公司的条目有人在 6GB 显存的笔记本上,用土耳其语 109 页报告实测了五款 7B-8B 开源模型,还顺手证明花哨检索方案打不过 TF-IDF,做 RAG 的可以看看。
Hugging Face 老板在安理会讲自家被 AI 攻击的经过,闭源 API 拦着不让用,最后靠中国的开源模型 GLM 5.2 才防住,观点挺有意思。
NVIDIA 开源了个说话人追踪模型,1秒语音就能分清谁在说话,还能让 Reachy Mini 机器人认人记名字,商用许可也友好。
NVIDIA 的说话人分离模型拿了 Diarization-Bench 第一,错误率 14.72%,比第二名低了近四分之一,做语音相关应用的可以关注下。
NVIDIA 出了个 100M 参数的小模型,专门搞定多人说话分不清谁是谁的问题,8 人以内、说话重叠都能识别,已经上了 Hugging Face。
一家伦敦公司拿了 Nvidia 和 Anthropic 的钱,用雨林和深海里的基因训练模型来设计抗生素,思路挺特别。
Runway 一周后办 AI Summit,Nvidia、DeepMind、Wayve 的人要同台聊物理世界里的智能,做视频或世界模型方向的可以关注下议程。
NVIDIA 放出了一个教程,教你用 Nemotron 3 做说话人分离,会议转写能分清谁说了哪句,想做语音应用可以照着搭一遍。
中国电信开源了个 29B 的 MoE 模型,只激活 4B 参数、支持 256K 上下文,全程在昇腾芯片上训练,权重挂在 Hugging Face 和 ModelScope 上可以直接下载。