DeepSeek发布最小尺寸多模态模型V4.1 Flash

9月10日,DeepSeek正式推出最新模型V4.1 Flash。这款新模型是该公司全新架构系列中最小的版本,主打原生多模态视觉理解能力。据官方介绍,该模型设计目标是实现更高性能、更快推理速度和更大吞吐量,同时具备扩展到更大参数模型的潜力。
首页 新闻资讯 行业资讯 DeepSeek发布最小尺寸多模态模型V4.1 Flash

9月10日,DeepSeek正式推出最新模型V4.1 Flash。这款新模型是该公司全新架构系列中最小的版本,主打原生多模态视觉理解能力。据官方介绍,该模型设计目标是实现更高性能、更快推理速度和更大吞吐量,同时具备扩展到更大参数模型的潜力。

DeepSeek发布最小尺寸多模态模型V4.1 Flash

V4.1 Flash采用552B参数的MoE架构,创新性地使用Causal-Encoder-Decoder结构。输入端仅需8B激活量,输出端提升至16B,显著降低计算成本。相比同尺寸模型,其训练方式和强化学习规模均有突破,在基准测试中超越了包括V4 Pro在内的多个旗舰模型。

新模型在硬件需求上实现重大优化。KV Cache缓存体积大幅缩减,HBM需求降至四分之一,SSD需求减少到八分之一。这对依赖缓存命中的Agent类应用而言,直接降低使用成本。DeepSeek同步调整API定价策略,闲时价格仅为高峰时段一半,鼓励用户灵活安排任务时间。

腾讯WorkBuddy、CodeBuddy及OpenCode已全面接入该模型。此次发布标志着DeepSeek在模型小型化与成本控制方面取得关键进展,为更多用户提供高性价比的AI服务方案。