6月26日
16:55
16:55Geek@geekbb
精选
NVIDIA 基于智谱 GLM-5.2 模型量化出 NVFP4 精度版本,命名为 nvidia/GLM-5.2-NVFP4。该模型通过 Hugging Face 免费层级 API 提供,限制为每小时 300 次或每天 1,000 次请求。作者认为其性能至少应优于 deepseek-v4-flash。
事件专题

推荐理由:NVIDIA 把智谱的 GLM-5.2 量化成 NVFP4 精度,放 Hugging Face 上免费调,还能白嫖,日常推理够用了。
01:15
01:15官方账号Hugging Face@huggingface
Hugging Face 通过直播演示如何在本机部署和运行开源 AI 模型。教程覆盖了从模型下载、环境配置到推理执行的完整流程,无需依赖云端服务。适合希望离线使用 LLaMA、Mistral 等模型的开发者。
推荐理由:想自己跑开源模型?Hugging Face 这场直播手把手教你在本地部署,省去云端费用和延迟。
6月24日
6月23日
16:51
16:51官方一手Hugging Face: Blog博客/媒体
精选
Hugging Face将huggingface_hub库的发布频率从每两个月一次提升至每周一次。流程中利用GPT-4自动生成发布说明,通过GitHub Actions运行超过2000项测试,并由人类维护者进行最终审核。该方案使版本迭代速度提升8倍,同时保持稳定性。
推荐理由:Hugging Face分享了他们如何用GPT-4和GitHub Actions把库发布从两个月一次提速到每周一次,还保留了人工把关,挺实用的经验。
6月19日
04:25
04:25官方账号Clement Delangue@ClementDelangue
精选
Poolside 发布了其最新模型 Laguna M.1,拥有 256K 上下文长度。该模型采用 Apache 2.0 许可,权重已开放至 Hugging Face。包括基础版和微调版检查点可供下载。
事件专题

推荐理由:Poolside 把最强的 Laguna M.1 模型完全开放了,256K 上下文,Apache 2.0 许可,直接去 Hugging Face 下载权重用。
6月18日
15:03
13:03
13:03@atomic_chat_hq@atomic_chat_hq
Atomic Chat 正式在 Hugging Face 上线,成为该平台上的 Local App。用户可以直接在本地设备运行 Hugging Face 上的 200,000+ 个开放权重模型,所有处理都在设备端完成,保障隐私。该应用完全开源,无需联网即可使用多种模型。

推荐理由:Atomic Chat 现在能在本地跑 Hugging Face 上 20 多万个模型,完全离线私密,还开源,搞 AI 的可以试试看。
01:10
6月17日
13:28
13:28Geek@geekbb
精选
介绍了一个工具,可在Apple Silicon Mac上通过MLX框架本地运行大语言模型。用户能从Hugging Face搜索并下载模型,用MLX进行离线推理,并启动一个OpenAI兼容的API服务。这样就能用curl或OpenAI客户端库调用本地模型。
事件专题

推荐理由:想在Mac上本地跑大模型、不用联网?这个工具能从Hugging Face下模型,用MLX推理,还直接开个OpenAI API,当本地服务使。
6月12日
01:36
6月11日
06:14
03:18
03:18官方账号Clement Delangue@ClementDelangue
Google、Hugging Face 与开源 AI 社区联合发起 Gemma 挑战赛,旨在通过数十个智能体协作,让 Gemma 4 E4B 模型运行更快。Hugging Face 的 Hub 正从人类协作平台演变为智能体协作平台,这一赛事展示了 AI 智能体在模型优化中的潜力。挑战赛鼓励开发者参与,推动开源 AI 生态发展。

推荐理由:这是 AI 智能体协作的实战案例,做模型优化或智能体开发的团队值得关注——看看智能体如何像人类一样在 Hub 上合作提速模型。
6月9日
22:43
22:43官方账号Clement Delangue@ClementDelangue
Arcee AI 宣布成为首个完全用 Hugging Face 替换 AWS S3 存储其所有模型和数据集的美国主要 AI 实验室,包括公开和私有数据。双方达成数百万美元合作,旨在支持美国开源 AI 发展。此举标志着 AI 基础设施向去中心化、开源生态的转变,Hugging Face 作为存储和分发平台的地位进一步巩固。

推荐理由:这对使用 AWS S3 存储 AI 资产的团队是个信号——Hugging Face 正成为更灵活、开源友好的替代方案,做模型部署和数据集管理的开发者值得关注这一趋势。
01:53
01:53官方账号Clement Delangue@ClementDelangue
Hugging Face CEO Clement Delangue 在 X 上发文,指出 AI 行业正走向成熟,多模型工作负载成为主流。他预测,未来公司不仅会使用数十个模型,还会针对特定用例进行适配、后训练和优化。最终,模型数量将像代码仓库一样多,因为模型正在成为新的代码。这一观点反映了 AI 从单一模型向多元化、定制化发展的趋势。
推荐理由:AI 从业者终于可以告别“一个模型打天下”的思维了——多模型工作负载是未来,做模型选型、微调或部署的团队值得关注这个趋势,提前布局。
6月8日
6月6日
6月4日
23:42
23:42官方账号Clement Delangue@ClementDelangue
Hugging Face 联合创始人 Clement Delangue 分享称,已将 NanoClaw AI 的智能体追踪数据上传至 Hugging Face 平台。他认为所有智能体默认应将追踪数据私有存储在 HF 上,以便用户保留历史记录、进行分析、分享,并用于后训练更好的模型和工具。这一方向旨在提升智能体的可追溯性和数据利用效率,推动 AI 代理生态发展。

推荐理由:智能体开发者终于有了标准化的追踪数据存储方案——NanoClaw AI 与 Hugging Face 的集成让分析、分享和后训练变得简单,做 AI 代理的团队值得关注这个方向。
22:09
06:44
06:44官方账号Clement Delangue@ClementDelangue
Hugging Face CEO Clement Delangue 在 X 上发帖调侃,认为现在即使把开源模型命名为“0pus 4.8”或“GPT 5.S”放进应用,用户也会大量使用而不抱怨。他指出这是“前沿”营销的力量——品牌和命名比实际技术更能吸引用户。这条推文引发了关于 AI 行业品牌效应与真实技术差距的讨论。
推荐理由:做 AI 应用或营销的团队值得看看——品牌命名对用户认知的影响可能远超技术本身,别让“前沿”标签蒙蔽了你的判断。
6月3日
13:43
13:43官方账号Cohere@cohere
Cohere 宣布赞助一场由 Hugging Face 和 Gradio 主办的黑客马拉松,主题是“缩小规模”。活动鼓励开发者构建足够小、运行成本低,但又能真正改变他人生活的 AI 应用。参与者可以创造古怪有趣的 AI 作品,或为身边人解决实际问题。这反映了行业对轻量、实用 AI 模型的关注趋势。
推荐理由:想用低成本模型做出真正有用的东西?这场黑客马拉松就是为你准备的——Cohere 赞助、Hugging Face 和 Gradio 主办,直接上手做点小而美的 AI 应用,建议关注。