7月1日
02:02
02:02官方账号Decoder@Matthias Bastian
据 The Information 报道,OpenAI 将 AI 模型的推理成本降低超过一半。这项优化已应用于 ChatGPT,使得响应 guest 用户所需的 Nvidia GPU 数量有时降至仅几百块。这一调整显著降低了运营成本。
事件专题

推荐理由:OpenAI 给免费用户省了钱,自家推理成本砍半,GPU 数量降到了几百块,效率提了不少。
6月20日
16:43
16:43官方一手pandaily@contact@pandaily.com (Pandaily)
摩尔线程与 SGLang 社区在首次线下见面会上宣布,MUSA 后端已合并入 SGLang 主线。该合并使 SGLang 能够原生支持摩尔线程 GPU,不再依赖 CUDA。此次 Meetup 聚焦中国开源 AI 生态的 GPU 兼容性与性能优化。此举为国内开发者提供了更低门槛的国产 GPU 推理方案。

推荐理由:想用国产GPU跑大模型?摩尔线程和SGLang把MUSA后端合到主线了,以后直接用,不用再折腾CUDA转译。
6月6日
07:17
07:17Gary Marcus@GaryMarcus
AI学者Gary Marcus在X上发文讽刺“规模至上”观点,指出去年人们还需从装甲车偷GPU,今年SpaceX却四处出租GPU,暗示xAI未能有效利用这些算力。Marcus以此质疑“规模就是一切”的信仰,认为单纯堆算力并非AI成功的关键。该评论引发对AI发展路径的讨论,尤其是算力分配与模型效率的平衡问题。
事件专题

推荐理由:Marcus用马斯克出租GPU的实例戳破了“规模至上”的泡沫,关注AI算力效率与模型实际价值的团队值得一看,看完会重新思考堆算力的性价比。
5月30日
5月27日
17:38
17:38IT之家博客/媒体
龙芯中科宣布其首款 GPU 芯片 9A1000 已完成流片,即将回片进入测试阶段。该芯片定位为支持 AI 加速的入门级显卡,AI 算力达 40TOPS,性能较前代提升 5 倍以上,图形性能相当于 AMD RX 550。龙芯表示将争取开发 Windows 驱动,使其可与 Windows 电脑配套。9A1000 与龙芯 CPU 形成自我配套,旨在提升系统性价比。

推荐理由:国产 GPU 终于有了独立芯片,做信创、国产化替代的团队值得关注——龙芯 9A1000 的 AI 算力和图形性能对标入门级独显,搭配自家 CPU 能降低整机成本,建议关注后续测试结果。
5月17日
5月11日
22:16
22:16AI Breakfast@AiBreakfast
一位网友提出将人类历史上最坚固的建筑(如金字塔等)改造为数据中心,安装80万个GPU。这一想法既是对古代建筑耐久性的致敬,也讽刺了现代数据中心的建设标准。虽然仍属创意设想,但引发了对AI算力基础设施与历史建筑融合的讨论。

推荐理由:该观点以幽默方式揭示了AI算力扩张与土地、能源、基础设施的关系,值得行业思考未来数据中心选址与设计的可能性。