模型精选73°

DeepSeek V4.1 Flash 模型正式发布

DeepSeek V4.1 Flash 模型正式发布,支持原生多模态视觉理解

精选理由

DeepSeek 发布了最小尺寸但性能强大的 V4.1 Flash,成本更低却能超越旗舰模型,特别适合需要视觉理解的应用场景。

深度求索发布 DeepSeek V4.1 Flash 模型,是全新模型结构系列中的最小尺寸模型。该模型为 552B 参数的 MoE 模型,采用 Causal-Encoder-Decoder 结构,输入激活仅 8B,输出激活 16B。在 Agentic Benchmark 测试中,超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型。

原文 · IT之家

DeepSeek V4.1 Flash 模型正式发布,支持原生多模态视觉理解

IT之家 9 月 10 日消息,深度求索今日正式发布 DeepSeek V4.1 Flash 模型 。这是其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。 新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型 ,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。 ▲ DeepSeek-V4.1-Flash 与主流前沿模型在 Agentic Benchmark 上的性能对比