事件专题 ·官方一手

AWS SageMaker AI评测小型LLM推理性能

AWS在SageMaker AI上评测了Qwen3-Coder-30B和NVIDIA Nemotron-3-Nano-30B两个30B专家混合模型。测试对比了G5、G6、G6e和G7 GPU实例的吞吐量、延迟和每token成本。G7搭载的NVIDIA Blackwell GPU在实时LLM推理中展现出明显的价格性能优势。

当前结论

AWS实测了两种30B模型在四种GPU上的表现,帮你算清楚哪种实例性价比最高。

3 个信源58° AI 热度最后更新 2026/9/8 16:21:57

证据链

3 个信源
主要来源AWS Machine Learning Blog
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。