DeepSeek正式发布V4.1 Flash:原生多模态视觉理解,性能超越V4 Pro并下调API价格
据IT之家报道,DeepSeek正式发布V4.1 Flash,这是其全新模型架构系列中尺寸最小的模型。该模型为5520亿参数的混合专家模型,采用Causal-Encoder-Decoder结构,输入激活80亿参数,输出激活160亿参数。V4.1 Flash原生支持多模态视觉理解,官方称其在包括Agentic Benchmark在内的测试中超过DeepSeek V4 Pro等旗舰模型。新的KV Cache设计使HBM需求降至上一代的四分之一,SSD需求降至八分之一,从而降低长上下文和Agent任务的使用成本。模型已上线DeepSeek API,调用名称为deepseek-flash,旧模型名称暂时会路由至新版本。DeepSeek计划在2026年9月14日后逐步下线V4 Pro,并同步下调V4.1 Flash的API价格,继续采用峰谷定价。模型及技术报告已发布在Hugging Face。
本文来源:IT之家,AIbase,仅供学习参考,版权归原作者所有。