9月10日,DeepSeek正式发布新一代模型 V4.1 Flash,并同步上线国家超算互联网「模型服务」专区。官方表示,V4.1 Flash 在性能、费用、速度、总用时等各项指标上已全面超越 V4 Pro,同时将快速、专家、识图三种模式合而为一,用户无需再手动切换。

新架构Causal-Encoder-Decoder:输入激活仅8B,成本大幅下探
V4.1 Flash 为 552B 参数的 MoE 模型,采用全新的 Causal-Encoder-Decoder 结构,输入与输出不对称:输入侧仅激活 8B 参数、输出侧激活 16B,成本显著低于已知的同尺寸模型。模型原生支持多模态视觉理解,可自动检测查询复杂度并在检测到图片输入时激活视觉能力。
在基准测试中,V4.1 Flash 成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。新架构也让缓存更小、成本更低:与上一代相比,对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8,Agent 场景下缓存命中的费用占比明显下降。
国家超算互联网上线:V4 Pro 请求 9月14日起自动切换
用户登录国家超算互联网官网(www.scnet.cn),从首页进入「模型服务」页面即可调用 DeepSeek V4.1 Flash API。按官方规划,北京时间 9月14日12:00 起,对 deepseek-v4-pro 的请求将全部路由到 V4.1 Flash 并按 V4.1 Flash 单价计费,直至 V4.1 Pro 上线。
DeepSeek 表示将全力支持开源社区适配这一新架构的推理,并探索更广泛的部署路径;有大规模部署需求的团队(如 2000 张 GPU 与存储集群)可直接与官方接洽。
常见问题(FAQ)
V4.1 Flash 采用全新 Causal-Encoder-Decoder 架构(552B 参数 MoE,输入激活仅 8B),在性能、费用、速度、总用时等指标上全面超越 V4 Pro,并原生支持多模态视觉理解。
登录国家超算互联网官网 www.scnet.cn,从首页进入「模型服务」页面即可调用 API;DeepSeek 开放平台也已上线该模型。
不会立即下线:北京时间 9月14日12:00 起,对 deepseek-v4-pro 的请求将全部自动路由到 V4.1 Flash 并按新价格计费,直至 V4.1 Pro 上线。
延伸阅读
相关文章:谷歌连发Gemini 3.8 Flash与安全版Flash Cyber · 阿里通义千问Qwen3.8系列全面上线 · 极派星球首页
© 版权声明
文章版权归作者所有,未经允许请勿转载。
相关文章
暂无评论...












