原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://www.ithome.com/1/000/719.htm
立即前往原文

DeepSeek正式发布V4.1 Flash:原生多模态视觉理解,性能超越V4 Pro并下调API价格

据IT之家报道,DeepSeek正式发布V4.1 Flash,这是其全新模型架构系列中尺寸最小的模型。该模型为5520亿参数的混合专家模型,采用Causal-Encoder-Decoder结构,输入激活80亿参数,输出激活160亿参数。V4.1 Flash原生支持多模态视觉理解,官方称其在包括Agentic Benchmark在内的测试中超过DeepSeek V4 Pro等旗舰模型。新的KV Cache设计使HBM需求降至上一代的四分之一,SSD需求降至八分之一,从而降低长上下文和Agent任务的使用成本。模型已上线DeepSeek API,调用名称为deepseek-flash,旧模型名称暂时会路由至新版本。DeepSeek计划在2026年9月14日后逐步下线V4 Pro,并同步下调V4.1 Flash的API价格,继续采用峰谷定价。模型及技术报告已发布在Hugging Face。
行业资讯 应用 行业新闻 AI模型 研究 开源 2026-09-10 14:00:09 239 阅读 阅读约 1 分钟 来源:IT之家,AIbase
本文来源:IT之家,AIbase,仅供学习参考,版权归原作者所有。