9月3日
12:15
12:15官方账号arXiv cs.AI@Canjie Liu, Jiawen Kang, Jinbo Wen, Zishao Zhong
78°
RVSD是一种无需训练即插即用的解码框架,首次统一了令牌稀疏化和语义空间视觉检索。该框架在减少视觉幻觉方面达到最先进性能,在长上下文生成设置中保持强大的抑制能力。代码已在GitHub开源,可供研究人员直接使用。
推荐理由:清华团队提出RVSD框架,不用训练就能减少大视觉语言模型的幻觉,效果还特别好。
06:57
06:57Aravind Srinivas@AravSrinivas
78°
Perplexity开源了Lily本地推理引擎,专为Apple Silicon上的Qwen3.6-35B-A3B模型优化。该引擎支持Perplexity Computer的混合计算功能,确保设备端计算不会成为瓶颈。Lily是Perplexity Mac应用混合计算功能的核心组件。

推荐理由:Perplexity开源了专为Apple Silicon优化的Lily推理引擎,让Qwen3.6-35B-A3B在本地运行更高效。
04:33
04:33ollama@ollama
Muse Spark 1.3 版本今日发布,在编程和智能体工作方面实现了迄今为止最大的性能提升。该模型性能接近前沿水平,成本极低。用户可以在 Muse Code 和 API 中试用此模型。未来还将发布 Muse Spark 开放权重版本。
事件专题

推荐理由:Muse Spark 1.3 发布了,编程和智能体工作能力大幅提升,成本还很低,开放权重版本也快来了。
03:23
9月2日
23:14
16:29
16:29官方一手pandaily@contact@pandaily.com (Pandaily)
精选73°
科大讯飞全资子公司发布并开源了Spark X2.5-4B和X2.5-1.7B模型。这两款模型原生支持高达100万token的上下文长度。它们是首批支持如此长上下文的边缘模型。这些模型专为设备端AI设计。

推荐理由:科大讯飞开源了百万token上下文的边缘模型,比普通模型能处理更长文本,适合设备端部署。
00:33
9月1日
21:43
21:43Qdrant@qdrant_engine
精选
Qdrant 发布了 Supernova 向量搜索系统,可处理数十亿向量,每秒支持数千次请求,并保持极低的尾部延迟。该系统性能远超现有公开基准测试。Qdrant 已将完整代码开源在 GitHub 上,并提供了相关数据集。
推荐理由:Qdrant 开源了高性能向量搜索 Supernova,能处理数十亿向量,远超现有公开基准,代码已开源。
13:13
10:34
10:34官方一手Pandaily@contact@pandaily.com (Pandaily)
DeepSeek在Hugging Face上发布了V4-Flash-Vision-Exp,采用MIT许可证。这是V4系列首次支持图像输入的原生视觉模型。该模型扩展了DeepSeek的产品线,为多模态应用提供了新选择。

推荐理由:DeepSeek开源了首个原生视觉模型V4-Flash-Vision-Exp,支持图像输入,MIT许可证可商用。
08:13
08:13lmarena.ai@lmarena_ai
精选
Qwen3.8-Flash-Next 在整体排名中位列第24位,净提升2.4%。在开源模型中排名第7位。Confirmed Success指标提升12.3%,Bash Recovery提升2.9%。Praise vs. Complaint指标下降1.6%,Steerability下降1.1%。该模型没有工具幻觉问题。

推荐理由:阿里Qwen3.8-Flash-Next在LMSYS排行榜上表现亮眼,开源模型中排名第7,Confirmed Success指标大幅提升。
02:42
02:42Harrison Chase@hwchase17
Alex @AlexatVester 发起开源智能体浏览器基础设施项目征集。该项目旨在构建类似 Codex 的应用内浏览器,专为智能体设计。目前已有 293 人关注此倡议。@hwchase17 和 @danshipper 等行业人士参与讨论。
事件专题

推荐理由:Alex 正在寻找开发者构建开源智能体浏览器,可能是下一个重要基础设施项目。
00:09
00:09lmarena.ai@lmarena_ai
精选
GLM-5.3-Flash模型在AI排行榜中排名第19位,整体性能提升4.6%。在开源模型中排名第4位。该模型在成功率指标上提升15.3%,在表扬与投诉比例上提升4.9%,在可控性上提升2.4%。工具幻觉问题未出现。
事件专题

推荐理由:智谱AI的GLM-5.3-Flash在开源模型中排第4,成功率提升15.3%,无工具幻觉问题。
8月31日
21:47
21:47shao__meng@shao__meng
73°
DeepSeek-V4-Flash-Vision-Exp 模型已开源,总参数量达 305B。该模型在 DeepSeek-V4-Flash 架构上增加视觉编码器和 aligner,获得视觉理解能力。每张图片最多按 384 tokens 计费,多模态性能接近 Claude Opus-4.8。
事件专题

推荐理由:DeepSeek 10 天前发布 API,10 天后就开源了这款 305B 参数的多模态模型,性价比超高。
8月30日
08:47
8月29日
17:51
17:51官方账号Decoder@Matthias Bastian
78°
LAION推出Big Video Dataset(BVD),包含800万视频和550万自动描述片段。该数据集总时长达1000万小时,模型训练后性能超越InternVid基准最高2.1个百分点。LAION可依据2024年汉堡法院裁决,为非商业研究收集版权内容。

推荐理由:LAION开源了千万小时视频数据集,训练效果比之前基准高2.1个百分点,非商业研究可合法使用。