17:59IT之家(博客/媒体)精选芝加哥商品交易所集团8月11日宣布与Silicon Data合作,推出基于NVIDIA AI GPU租赁价格的两项计算期货合约,分别为Silicon Data H100租赁指数期货和B200租赁指数期货,每份代表租赁一个月对应GPU的费用。新合约计划10月5日在纽约商品交易所上线,目前等待监管审查。该工具旨在帮助企业管理计算成本、平抑算力价格波动,并提升市场透明度。Silicon Data CEO Carmen Li指出,此前两家公司购买相同GPU容量价格可能差异悬殊,新基准提供了公开可比较的价格参考。行业NVIDIAH100B2007 个信源在谈事件专题推荐理由:芝商所要把GPU租赁价格变成期货了,H100和B200都能交易,企业以后可以锁定算力成本,不用再怕价格暴涨。原文稍后读已读值得跟进有用关注 NVIDIA
00:12小互@imxiaohuNVIDIA在GTC 2024上发布Blackwell架构GPU B200,集成2080亿晶体管。相比H100,大模型训练性能提升约4倍。首批客户包括OpenAI和微软。该芯片预计2024年晚些时候出货。AI模型NVIDIABlackwellB20010 个信源在谈事件专题推荐理由:WSJ详细介绍了Blackwell B200的架构和性能,想了解最新AI芯片的来看看。原文稍后读已读值得跟进有用关注 NVIDIA
10:38官方账号vLLM@vllm_project精选vLLM项目实现了预填充与解码分离,TileRT通过vLLM V1连接器将自身低延迟解码引擎与vLLM预填充配对,无需修改vLLM代码。原生vLLM解码默认用于吞吐场景,TileRT解码用于延迟敏感场景(如智能体、实时助手)。TileRT在GLM-5.1-FP8(8×B200)上单用户解码达618 tok/s,启用推测解码(MTP)后约为无MTP基线的2倍,峰值接近800 tok/s。AI模型vLLMTileRTGLM-5.1-FP8推荐理由:vLLM拆开预填充和解码,TileRT提供低延迟解码,单用户618 tok/s,适合实时助手。原文稍后读已读值得跟进有用关注 vLLM