04:04DeepLearning.AI@DeepLearningAI73°OpenAI展示GPT 5.6 Sol每秒处理750个token。Google发布Gemini 3.7 Flash平均每秒330个token。Nvidia推出Nemotron 3.5 Lightning并配备NeMo Switchyard动态步进路由技术。更快的吞吐量和更低的延迟可减轻开发者上下文切换负担。这些模型支持实时智能体工作流。AI模型GPT 5.6Gemini 3.7Nemotron 3.510 个信源在谈事件专题推荐理由:OpenAI、Google和Nvidia都在竞相提升AI模型推理速度,各有不同技术方案。原文稍后读已读值得跟进有用关注 GPT 5.6
18:16官方账号NVIDIA AI@NVIDIAAI82°NVIDIA今日发布Nemotron 3.5,这是一款专为智能体AI系统中高吞吐量执行而设计的开源模型。Dream Security获得该模型的早期访问权限,其研究团队进行了监督微调、后训练、领域适配、网络安全推理和智能体工具使用等优化。该模型在Dream的内部网络安全基准测试中表现强劲,可帮助客户理解安全态势、调查风险并转化安全数据。相关发布博客已在开发者社区上线。AI模型NVIDIANemotron 3.5Dream Security10 个信源在谈事件专题推荐理由:NVIDIA出了新开源模型Nemotron 3.5,专为智能体场景打造,Dream Security抢先调教成了网络安全专用版,内部测试表现不错。原文稍后读已读值得跟进有用关注 NVIDIA
18:04官方账号NVIDIA AI@NVIDIAAIFastino Labs与NVIDIA合作发布两款开源模型Fastino-Nemotron-3.5-Lightning-Finance和Fastino-Nemotron-3.5-Lightning-Healthcare,均基于Nemotron 3.5 Lightning微调。金融模型在FinQA基准上执行准确率从15.86%提升至59.23%,增幅43.37个百分点;在BizFinBench上从49.65%升至57.46%。医疗模型在HealthAdminBench上从25.67%升至29.95%,在MedCalc-Bench上从49.09%升至54.18%。两款模型均以Apache 2.0许可发布在Hugging Face上。同时,Fastino还发布了自动微调工具Fastino Fine-Tuning Agent的私人预览版。AI模型FastinoNVIDIANemotron 3.510 个信源在谈事件专题推荐理由:Fastino跟NVIDIA合作,用自动微调Agent搞出了金融和医疗两个开源模型,FinQA涨了43个点,Apache 2.0随便用。原文稍后读已读值得跟进有用关注 Fastino
04:32官方一手Hugging Face: Blog(博客/媒体)NVIDIA 推出 Nemotron 3.5 Content Safety,这是一款面向全球企业 AI 的可定制多模态安全模型。它支持文本和图像输入,能够检测有害内容(如仇恨言论、暴力、色情等),并允许企业根据自身政策进行微调。该模型基于 Llama 3.1 架构,提供 8B 和 70B 两种规模,在多个安全基准上表现优异。Nemotron 3.5 旨在帮助企业安全部署生成式 AI,满足不同地区的合规要求。AI模型NVIDIANemotron 3.5内容安全10 个信源在谈事件专题推荐理由:企业部署 AI 最头疼的就是内容安全合规,NVIDIA 这个模型直接让企业按自己的政策微调安全过滤规则,做 AI 应用落地的团队值得关注。原文稍后读已读值得跟进有用关注 NVIDIA