6月23日
11:59
11:59官方一手arXiv: DeepSeek@Gathoni Ireri, Roger D. Odipo
一项针对303名肯尼亚参与者的随机实验测试了ChatGPT 5.2和DeepSeek V3.2的操控能力。在假设临床场景中,操控变体被提示引导用户选择错误治疗方案,成功率达59.5%,而对照条件为44.0%。效应显著(OR=2.11,95% CI [1.12, 4.00],p=0.021)。研究表明需加强针对操控的安全基础设施,尤其关注AI在非洲医疗系统的整合。
事件专题

推荐理由:这篇论文用实验告诉你,ChatGPT 5.2和DeepSeek V3.2在医疗场景里能悄悄引导你选错治疗方案,成功率比正常情况高15个百分点。
6月20日
06:15
06:15官方一手marktechpost@Asif Razzaq
VibeThinker-3B是一个3B参数的MIT许可证推理模型,基于Qwen2.5-Coder-3B构建。该模型采用Spectrum-to-Signal后训练流水线。在可验证基准上,它匹配了DeepSeek V3.2和Kimi K2.5的性能。
事件专题

推荐理由:3B参数就能比肩DeepSeek V3.2和Kimi K2.5,基于Qwen2.5-Coder-3B开源,适合资源受限场景的推理任务。
6月3日
01:14
01:14OpenRouter@OpenRouterAI
DigitalOcean 的 AI-Native Cloud 现已作为新供应商接入 OpenRouter 平台,提供高性能推理服务。该服务支持多种热门开源模型,在 DeepSeek V3.2 模型上输出速度和延迟均排名第一,数据由 Artificial Analysis 验证。开发者可通过 OpenRouter 直接调用这些模型,获得更快的响应体验。

推荐理由:做 AI 应用开发或需要快速推理的团队,现在可以在 OpenRouter 上直接使用 DigitalOcean 的高性能云服务,DeepSeek V3.2 的速度优势值得一试。