主要来源AWS Machine Learning Blog
查看原文事件专题 ·官方一手
AWS SageMaker AI评测小型LLM推理性能
AWS在SageMaker AI上评测了Qwen3-Coder-30B和NVIDIA Nemotron-3-Nano-30B两个30B专家混合模型。测试对比了G5、G6、G6e和G7 GPU实例的吞吐量、延迟和每token成本。G7搭载的NVIDIA Blackwell GPU在实时LLM推理中展现出明显的价格性能优势。
当前结论
AWS实测了两种30B模型在四种GPU上的表现,帮你算清楚哪种实例性价比最高。
3 个信源58° AI 热度最后更新 2026/9/8 16:21:57
证据链
3 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。