03:38Y Combinator@ycombinator73°Wafer使用智能体优化GPU并运行开源模型,达到行业领先速度。该公司在推出云服务四个月后,ARR达到800万美元,并完成4000万美元A轮融资。他们成功使GLM 5.2运行速度比市场上其他方案快2-3倍。速度而非成本正推动企业采用开源模型。行业WaferGLM 5.2AI推理推荐理由:Wafer从大学项目成长为AI基础设施公司,GLM 5.2速度领先行业,800万美元ARR证明市场认可。原文稍后读已读值得跟进有用关注 Wafer
05:56Guillermo Rauch@rauchgVercel 通过 AI Gateway 独家推出 GLM 5.2 Fast (via Wafer) 模型。内部基准测试显示,其 token 吞吐量比其他提供商快 2 倍。该模型可通过指定 'zai/glm-5.2-fast' 调用。开发者可在 Vercel 平台上直接使用,无需额外配置。AI模型GLM 5.2 FastVercel AI GatewayWafer推荐理由:Vercel 搞了个 GLM 5.2 Fast,速度是其他家的两倍,做推理任务可以试试。原文稍后读已读值得跟进有用关注 GLM 5.2 Fast