16:33Geek@geekbbDeepSeek 模型强大且免费,成为美国开源 AI 竞争对手,对 OpenAI 和 Anthropic 影响有限。需具备足够计算能力以实现大规模推理,以改变局势。AI模型DeepSeek开源模型智能体10 个信源在谈事件专题推荐理由:DeepSeek 模型免费且强大,成为 OpenAI 和 Anthropic 的有力竞争者,值得关注其发展。原文稍后读已读值得跟进有用关注 DeepSeek
12:05官方一手arXiv: DeepSeek@Seungwoo Jung, Dohyeok Kwon, Seungmin Cha, Junseok Lee, Yeonho Yoo, Chuck Yoo, Gyeongsik Yang精选73°PARSER是一种新的残差稀疏化方法,用于压缩Mixture-of-Experts大模型。该方法通过引入输出重要性指标,将压缩目标从最小化独立矩阵误差转变为保留专家输出误差。在Qwen和DeepSeek模型上,PARSER将压缩后模型与未压缩模型的精度差距分别缩小1.41倍和1.44倍,同时实现相同的峰值内存减少。论文MoEPARSERQwen推荐理由:PARSER方法通过输出重要性指标优化MoE模型压缩,在相同内存减少下提升模型精度。原文稍后读已读值得跟进有用关注 MoE
11:49官方一手arXiv: DeepSeek@Zhengyi Jin, Ru Zhang, Xiao Chen, Xinbo Liu, Jiaxuan Lin, Jia Huang, Jianyi Liu, Zhen Yang精选73°研究人员提出FUSE框架,通过知识(K)、防御(D)和危害(H)三个正交管道评估模型。该框架使用化学-生物(CB)模块评估了12个商业LLM,来自Claude、DeepSeek和GPT四个家族。研究发现模型间危险能力存在显著差异,知识相当的模型在拒绝韧性上表现不同,强防御模型在服从时仍可能生成有害内容。时间分析表明,新模型知识增强但防御仅部分改善,扩展和对齐进展未均匀转化为安全提升。论文FUSELLMsClaude推荐理由:FUSE框架首次系统评估了12个商业LLM的危险能力,发现模型间存在显著差异,新模型知识增强但安全提升有限。原文稍后读已读值得跟进有用关注 FUSE
08:02DeepLearning.AI@DeepLearningAI73°DeepSeek发布了V4 Pro 0813模型,同时推出了开源评估工具DeepSeek Harness。该工具记录所有工具调用、系统提示和子代理调度信息。开发者现在可以复现性能表现,不再依赖封闭测试环境。他们还可以轻松研究、分叉或创建自己的评估工具。AI模型DeepSeekDeepSeek V4 Pro 0813开源模型推荐理由:DeepSeek不仅发布了新模型V4 Pro 0813,还开源了评估工具,让开发者能透明复现性能并自定义评估框架。原文稍后读已读值得跟进有用关注 DeepSeek
16:13AI产品黄叔@PMbackttfuture精选Grok Bot网站已实现自动更新功能,每日新案例会在顶部呈现。该网站整合了《Grok Bot 橙皮书》和awesome-grok-bot资源,提供8核/16G内存/126G硬盘的专享服务器配置。用户可调用Grok额度和DeepSeek API,操作无需理解服务器技术。AI产品Grok BotGLM 5.3 FlashDeepSeek推荐理由:黄叔用Zcode+GLM 5.3 Flash做了个Grok Bot网站,每天自动更新案例,专享服务器配置超实用。原文稍后读已读值得跟进有用关注 Grok Bot
12:47AI产品黄叔@PMbackttfuture精选Grok Bot分身可自动转发任务到群组,指挥其他BOT完成任务,并在私聊窗口汇报结果。该产品提供8核/16G内存/126G硬盘专享资源,包含Grok额度及DeepSeek API调用权限。操作极简且无需理解服务器配置。用户可通过网站grokbot.aihuangshu.com获取《Grok Bot 橙皮书》和awesome-grok-bot资源。AI产品GrokGrok BotDeepSeek1 个信源在谈事件专题推荐理由:黄叔用Grok Bot做了个任务自动化分身,能指挥其他BOT干活,还整合了橙皮书资源。原文稍后读已读值得跟进有用关注 Grok
09:32官方一手arXiv: DeepSeek@Seungwoo Jung, Dohyeok Kwon, Seungmin Cha, Junseok Lee, Yeonho Yoo, Chuck Yoo, Gyeongsik Yang精选73°PARSER是一种新的残差稀疏化方法,用于压缩Mixture-of-Experts大模型。该方法通过引入输出重要性指标,将压缩目标从最小化孤立矩阵误差转变为保留专家输出误差。实验显示,在Qwen和DeepSeek模型上,PARSER将压缩后模型与未压缩模型之间的精度差距分别缩小1.41倍和1.44倍,同时实现了相同的峰值内存减少。论文MoEPARSERQwen推荐理由:PARSER方法解决了MoE模型压缩中误差累积问题,在相同内存减少下提升模型精度。原文稍后读已读值得跟进有用关注 MoE
02:24Fireworks AI@FireworksAI_HQ73°DeepSeek V4 Flash 现已在 Fireworks 平台支持原生视觉功能。该模型在服务器层和优先层均可使用。相比纯文本版本的 0731 版本,DeepSeek V4 Flash 在基准测试中表现更好。价格保持不变,输入每百万 token 0.22 美元,输出每百万 token 0.66 美元。AI产品DeepSeekFireworks视觉模型推荐理由:DeepSeek V4 Flash 在 Fireworks 上新增视觉功能,价格不变但性能提升,性价比更高。原文稍后读已读值得跟进有用关注 DeepSeek
12:42AI产品黄叔@PMbackttfutureGrok Bot提供8核/16G内存/126G硬盘的专享资源,能分担大量任务。用户还获得Grok额度,可自行调用DeepSeek API。该服务操作极简,无需理解服务器技术。作者已整合《Grok Bot 橙皮书》和awesome-grok-bot资源创建网站grokbot.aihuangshu.com。AI产品Grok BotDeepSeekGLM 5.3 Flash推荐理由:Grok Bot提供Mac级硬件资源,还能调用DeepSeek API,比买新Mac划算多了。原文稍后读已读值得跟进有用关注 Grok Bot
10:34官方一手Pandaily@contact@pandaily.com (Pandaily)DeepSeek在Hugging Face上发布了V4-Flash-Vision-Exp,采用MIT许可证。这是V4系列首次支持图像输入的原生视觉模型。该模型扩展了DeepSeek的产品线,为多模态应用提供了新选择。AI模型DeepSeekV4-Flash-Vision-ExpHugging Face推荐理由:DeepSeek开源了首个原生视觉模型V4-Flash-Vision-Exp,支持图像输入,MIT许可证可商用。原文稍后读已读值得跟进有用关注 DeepSeek
10:20官方一手arXiv: DeepSeek@Bo Chen精选研究人员对24个标记的端点对进行了冻结阈值研究,其中包含Qwen 3.8和DeepSeek V4等模型变体。开发集上的12对端点完全分离,冻结阈值为0.725。但在保持集上,仅6对符合三重复规则,平衡准确率为0.75,灵敏度为0.50,特异度为1.00。研究验证了令牌计数一致性作为共享标记化堆栈的指纹,但拒绝将其作为模型血统的独立必要测试。论文LLMAPIQwen推荐理由:OpenAI兼容API的令牌计数能识别共享标记化堆栈,但不能单独用于确定模型家族关系,Qwen 3.8和DeepSeek V4变体测试低于阈值。原文稍后读已读值得跟进有用关注 LLM
21:47shao__meng@shao__meng73°DeepSeek-V4-Flash-Vision-Exp 模型已开源,总参数量达 305B。该模型在 DeepSeek-V4-Flash 架构上增加视觉编码器和 aligner,获得视觉理解能力。每张图片最多按 384 tokens 计费,多模态性能接近 Claude Opus-4.8。AI模型DeepSeek-V4-Flash-Vision-ExpDeepSeek多模态3 个信源在谈事件专题推荐理由:DeepSeek 10 天前发布 API,10 天后就开源了这款 305B 参数的多模态模型,性价比超高。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash-Vision-Exp
19:41IT之家(博客/媒体)精选73°DeepSeek-V4-Flash-Vision-Exp 是 DeepSeek V4 系列首款原生支持图片输入的视觉模型,采用 MIT License 开源。该模型支持 JPEG、PNG、GIF、WebP 格式图片,可描述图片、识别文字、分析图表。在 Agent 基准测试中较 V4-Flash 大幅提升,多模态 Agent 能力已接近 Opus-4.8。AI模型DeepSeek-V4-Flash-Vision-ExpDeepSeek多模态推荐理由:DeepSeek 开源了支持图片输入的 V4-Flash-Vision-Exp,多模态能力接近 Opus-4.8,还能做图文分析。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash-Vision-Exp
23:22elvis@omarsar0DeepSeek工程框架在GitHub上获得20万星标。该框架采用插件化设计,所有组件均可自定义。框架专为满足未来AI需求和能力而构建。AI产品DeepSeekGitHub工程框架推荐理由:DeepSeek发布工程框架,插件化设计满足未来AI需求,已获20万GitHub星标。原文稍后读已读值得跟进有用关注 DeepSeek
17:19官方一手arXiv: DeepSeek@Aamir Sohail, Xintong Zhong, Arkady Konovalov, Patricia L. Lockwood, Lei Zhang精选73°研究人员通过两个经济游戏和认知计算模型,测试了DeepSeek、GPT-4.1、GPT-5和Gemini 2.0 Flash共2099个LLM代理的心智化能力。结果显示,不同模型提供商和大小的LLM表现出明显不同的心智化行为和计算特征。GPT-5代理能够灵活调整其递归推理深度,表现优于251名人类参与者。论文GPT-5DeepSeekGemini 2.0推荐理由:这篇论文用经济游戏测试了四大模型家族的心智化能力,发现GPT-5能灵活调整推理深度,表现超过人类。原文稍后读已读值得跟进有用关注 GPT-5
09:19官方一手arXiv: DeepSeek@Xiao Fan, Jingyuan Li, Hongbin Guo, Yubo Han, Yi ZhangThis paper proposes claim-locked reporting, a protocol that ensures the statistical evidence in scientific reports is fixed by structured results before prose generation. It improves reproducibility by 37.4 and 20.5 points in fMRI and randomized controlled trial reporting, respectively. DeepSeek's fMRI cost analysis demonstrates lower token use and generation latency with this method.论文LLMsreporting protocolreproducibility推荐理由:This paper introduces a new reporting protocol for scientific reports that could significantly improve reproducibility. It's a must-read for anyone interested in improving the quality of scientific reporting and the use of LLMs in research.原文稍后读已读值得跟进有用关注 LLMs
16:06IT之家(博客/媒体)78°DeepSeek 今年前 7 个月营收达 4.75 亿元,是去年全年的 10 倍。公司推进第二轮融资,目标募集 500 亿元。DeepSeek 毛利率达 44.6%,API 业务毛利率 82.9%。行业DeepSeek营收增长融资推荐理由:DeepSeek 营收增长惊人,第二轮融资目标高,毛利率表现优异,值得关注其发展动态。原文稍后读已读值得跟进有用关注 DeepSeek
09:55AI Will@FinanceYF578°Nvidia计划投入60亿美元,获得Poolside技术授权,并投资10亿美元,打造全球最强开放权重AI模型,挑战DeepSeek、Kimi等中国模型,与OpenAI、Anthropic竞争。行业NvidiaAI模型Poolside10 个信源在谈事件专题推荐理由:Nvidia大动作,挑战OpenAI,想看AI模型竞争的看这里!原文稍后读已读值得跟进有用关注 Nvidia
09:54AI Will@FinanceYF578°Nvidia计划投资60亿美元打造一款强大的开放权重AI模型,并从Poolside公司引进技术及员工。此举旨在挑战DeepSeek等中国领先者,并与OpenAI等美国前沿实验室竞争。Nvidia还将向Poolside投资10亿美元,估值120亿美元。行业NvidiaAI模型投资10 个信源在谈事件专题推荐理由:Nvidia投资Poolside,打造强大AI模型,挑战中国领先者,值得关注!原文稍后读已读值得跟进有用关注 Nvidia
20:10The Rundown AI@therundownaiNvidia joins SpaceX to build orbital AI, Thomson Reuters launches legal AI model, Open Design offers reusable AI design system, Chinese hackers use DeepSeek for double attacks行业NvidiaSpaceXThomson Reuters7 个信源在谈事件专题推荐理由:Nvidia与SpaceX合作,Thomson Reuters推出法律AI模型,Open Design提供可复用AI设计系统,中国黑客利用DeepSeek进行双重攻击,值得关注原文稍后读已读值得跟进有用关注 Nvidia
14:43orange.ai@oran_gekarminski-牙医发布 OX-Alpha 和 DeepSeek-V4-Flash-Vision-Exp 代码能力对比测试,OX-Alpha 性能占优势,参数量可能达100B。期待本周正式版发布,价格合理。#oxalpha #v4flashvision #多模态大模型 #deepseek #deepseek多模态AI模型OX-AlphaDeepSeek-V4-Flash-Vision-Exp多模态大模型10 个信源在谈事件专题推荐理由:看看 DeepSeek-V4-Flash-Vision-Exp 和 OX-Alpha 的性能对比,期待正式版发布,性价比高!原文稍后读已读值得跟进有用关注 OX-Alpha
12:48IT之家(博客/媒体)72°中国AI模型快速缩小与美差距,清华大学等高校人才网络、开源技术、人才回流和高效算力共同推动。智谱AI、月之暗面、DeepSeek等研究者构成重要力量。中美AI模型能力差距已缩小至数月。行业智谱AI月之暗面DeepSeek1 个信源在谈事件专题推荐理由:想了解中国AI发展,看这些关键人物如何推动技术进步。智谱AI、月之暗面、DeepSeek,技术交流与人才回流加速追赶。原文稍后读已读值得跟进有用关注 智谱AI
11:13Milvus@milvusio精选72°DeepSeek Harness采用“一切皆插件”架构,支持模型、工具、存储、代理循环、调度和UI的替换或重新组合。MemSearch提供记忆和学习信号,DeepSeek Harness提供可组合的运行时环境。MemSearch和DeepSeek Harness结合,实现代理自我进化的新版本。AI模型DeepSeekAIAgentsAgentMemory推荐理由:DeepSeek Harness更新,支持插件式架构,实现代理自我进化的新版本,值得一试。原文稍后读已读值得跟进有用关注 DeepSeek
10:28官方一手arXiv: DeepSeek@Donghui Zha, Lingwei Xu, Linxiao Wu, Yixue Dong, Haochen Li本文提出CacheRouter,一种双路径路由设计,将工具选择和交付分配到不同的通道。主模型始终看到一组固定的核心工具,其他工具通过独立的路由通道选择和执行。工具注册自动化,支持运行时更新。在55个功能查询和30轮对话中测试,缓存命中率达到90.99%和95.2%,在DeepSeek定价下,缓存命中输入令牌成本约为缓存未命中令牌的1/30。论文CacheRouter长尾工具发现双路径路由架构推荐理由:CacheRouter通过双路径设计优化了LLM系统中的工具使用,自动化工具注册和运行时更新,显著提高缓存命中率,降低输入成本,值得一试。原文稍后读已读值得跟进有用关注 CacheRouter
10:20官方一手Pandaily@contact@pandaily.com (Pandaily)神秘模型'Ox Alpha'在OpenRouter和OpenCode上免费一周,结束DeepSeek 56天排名第一,创单日使用记录,社区搜寻其创作者。AI模型Ox AlphaDeepSeekOpenCode10 个信源在谈事件专题推荐理由:神秘模型'Ox Alpha'在OpenCode上免费,终结DeepSeek的统治,寻找其创作者,值得关注。原文稍后读已读值得跟进有用关注 Ox Alpha
04:36宝玉@doteyDeepSeek 8月发布 DeepSeek Harness,一切皆插件。作者认为初期看似过度工程,但方向有意义。AI模型DeepSeekAIAgent智能体推荐理由:想了解 DeepSeek Harness 的朋友,这篇文章写得很好,值得一读。原文稍后读已读值得跟进有用关注 DeepSeek
01:38Suhail@Suhail用户在社交媒体上寻求与DeepSeek团队联系,表达了对多个模型的兴趣。行业DeepSeek智能体模型推荐理由:想了解DeepSeek模型,直接联系团队更直接!原文稍后读已读值得跟进有用关注 DeepSeek
16:14IT之家(博客/媒体)78°英伟达向Poolside支付60亿美元获取AI模型授权,并追加10亿美元投资,旨在开发与DeepSeek和Kimi K3竞争的AI模型。Poolside将保持独立运营,英伟达寻求加快AI技术渗透各行各业。行业英伟达PoolsideAI模型1 个信源在谈事件专题推荐理由:英伟达投资Poolside,助力打造中国开源AI竞争者,值得关注其未来发展。原文稍后读已读值得跟进有用关注 英伟达
07:48IT之家(博客/媒体)特斯拉监督版FSD不支持中国;DeepSeek调整API计费,周末统一低谷价;成都铁路局回应占座放零食事件;雷军携小米折叠新机现身;Anthropic计划IPO,目标估值2万亿;OPPO暂停小屏手机项目;苹果上架Bellroy邮差包;iPhone 18 Pro手机壳曝光;世界人形机器人运动会开幕;微软Win11默认启用时光机;印度少年为iPhone威胁父母跳崖身亡;小米首款RGB-Mini LED电视开启盲订;雷军川渝续航挑战第一;豆包输入法鸿蒙版尝鲜;宝马新世代i3续航超1000公里;小米miclaw结束封测;特斯拉回应召回;漫威《复仇者联盟4》重映;小米调研洗鞋机;荣耀机器人破百米记录;OpenAI下调GPT-5.6 Sol模型价格。行业特斯拉DeepSeek成都铁路局10 个信源在谈事件专题推荐理由:特斯拉FSD不支持中国,DeepSeek周末统一低谷价,成都铁路局回应占座事件,雷军携小米折叠新机,Anthropic计划IPO,OPPO暂停小屏手机项目,苹果上架Bellroy邮差包,iPhone 18 Pro手机壳曝光,世界人形机器人运动会开幕,微软Win11默认启用时光机,印度少年为iPhone威胁父母跳崖身亡,小米首款RGB-Mini LED电视开启盲订,雷军川渝续航挑战第一,豆包输入法鸿蒙版尝鲜,宝马新世代i3续航超1000公里,小米miclaw结束封测,特斯拉回应召回,漫威《复仇者联盟4》重映,小米调研洗鞋机,荣耀机器人破百米记录,OpenAI下调GPT-5.6 Sol模型价格。这些资讯都是最新的,值得关注。原文稍后读已读值得跟进有用关注 特斯拉
05:03Suhail@Suhail探讨 DeepSeek v4 Flash 0731 与 Miles 训练的兼容性问题。💬14 🔄2 ❤️21 👀4302 📊14 ⚡技巧DeepSeekMCP/工具训练兼容性推荐理由:想了解 DeepSeek v4 Flash 0731 与 Miles 训练兼容性的朋友可以看看这个讨论。原文稍后读已读值得跟进有用关注 DeepSeek
22:33Geek@geekbb78°DeepSeek 从明天起调整周末时段,不再区分峰谷时段。AI产品DeepSeek时段调整智能体推荐理由:DeepSeek 调整周末时段,使用更便捷。原文稍后读已读值得跟进有用关注 DeepSeek
20:58IT之家(博客/媒体)DeepSeek 将于 2026 年 8 月 23 日起调整 API 计费规则,周六日全天统一按低谷价收费。调整距离峰谷定价机制实施仅一周。新的周末计费规则简化了计费逻辑,开发者可享受低谷时段价格。以 DeepSeek-V4-Pro 为例,高峰时段每百万 tokens 输出价格为 27 元,空闲时段为 13.5 元。AI产品DeepSeekAPI计费低谷价推荐理由:DeepSeek 又调整了 API 计费规则,周末统一按低谷价收费,对开发者来说更实惠了。和之前的峰谷定价相比,这次调整更简单,价格也更优惠。原文稍后读已读值得跟进有用关注 DeepSeek
22:43OpenRouter@OpenRouterAI72°DeepSeek AI推出新模型,支持图像输入,V4 Flash定价,在文本代理基准测试中与V4 Flash 0731相当,在Agents Last Exam和ZeroBench上击败Opus-4.8。立即使用:openrouter.ai/deepseek/deeps...AI模型DeepSeekV4 FlashVision Exp推荐理由:DeepSeek AI新模型上线,图像输入,性价比高,性能卓越,优于Opus-4.8,值得一试!原文稍后读已读值得跟进有用关注 DeepSeek
19:58shao__meng@shao__meng78°DeepSeek发布新模型deepseek-v4-flash-vision-exp,在多模态能力上接近Claude Opus 4.8,DeepSeek Harness 0.1.1支持新模型。AI模型DeepSeek多模态模型发布推荐理由:DeepSeek新模型发布,多模态能力提升,值得一试!原文稍后读已读值得跟进有用关注 DeepSeek
19:53Geek@geekbbDeepSeek-V4-Flash-Vision-Exp模型上线,多模态能力提升,接近Opus-4.8水平。DeepSeek Harness 0.1.1支持新模型。AI模型DeepSeek-V4-Flash-Vision-Exp多模态模型发布推荐理由:DeepSeek新模型发布,多模态能力大幅提升,值得一试。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash-Vision-Exp
18:38爱范儿@莫崇宇78°DeepSeek 多模态模型更新,带来全新功能。鲸鱼模型开‘天眼’,提升多模态识别能力。AI模型DeepSeek多模态智能体推荐理由:DeepSeek 更新,多模态识别更强,值得一试。原文稍后读已读值得跟进有用关注 DeepSeek
18:04官方账号深度求索 DeepSeek@deepseek_ai精选DeepSeek推出免费使用的Files API,支持单次上传图片,通过file_id引用以节省带宽,重复请求无需重复上传。详情见api-docs.deepseek.com/guides/files_a…AI产品DeepSeekFiles API上传图片推荐理由:DeepSeek推出免费Files API,一次上传图片多次使用,节省带宽,方便快捷。原文稍后读已读值得跟进有用关注 DeepSeek
18:03官方账号深度求索 DeepSeek@deepseek_ai精选DeepSeek发布多模态API,支持模型deepseek-v4-flash-vision-exp,图像可支持最多384个token,支持Chat Completions、Messages & Responses,混合文本和图像输入,图像可通过base64、外部URL或Files API提供。AI产品DeepSeek多模态API推荐理由:DeepSeek新推出多模态API,支持多种图像输入方式,功能强大,值得一试。原文稍后读已读值得跟进有用关注 DeepSeek
14:34爱范儿@张子豪DeepSeek模型支持多模态功能即将到来,爱范儿带你快速上手DeepSeek Harness,体验赛博乐高乐趣。技巧DeepSeek赛博乐高多模态推荐理由:想快速掌握DeepSeek Harness?爱范儿教你玩转赛博乐高,体验多模态模型魅力!原文稍后读已读值得跟进有用关注 DeepSeek
13:03AI Will@FinanceYF5DeepSeek旨在降低AI成本,却可能导致美国科技巨头债务规模激增,预计2026、2027年债务规模将从2880亿美元升至6590亿美元。行业DeepSeek科技巨头债务规模推荐理由:想了解DeepSeek如何影响科技巨头债务?这篇报道揭示了关键细节。原文稍后读已读值得跟进有用关注 DeepSeek