DeepSeek V4.1 Flash正式发布并上线国家超算互联网:全面超越V4 Pro,HBM需求降至四分之一

9月10日,DeepSeek正式发布新一代模型 V4.1 Flash,并同步上线国家超算互联网「模型服务」专区。官方表示,V4.1 Flash 在性能、费用、速度、总用时等各项指标上已全面超越 V4 Pro,同时将快速、专家、识图三种模式合而为一,用户无需再手动切换。

DeepSeek V4.1 Flash模型

新架构Causal-Encoder-Decoder:输入激活仅8B,成本大幅下探

V4.1 Flash 为 552B 参数的 MoE 模型,采用全新的 Causal-Encoder-Decoder 结构,输入与输出不对称:输入侧仅激活 8B 参数、输出侧激活 16B,成本显著低于已知的同尺寸模型。模型原生支持多模态视觉理解,可自动检测查询复杂度并在检测到图片输入时激活视觉能力。

在基准测试中,V4.1 Flash 成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。新架构也让缓存更小、成本更低:与上一代相比,对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8,Agent 场景下缓存命中的费用占比明显下降。

国家超算互联网上线:V4 Pro 请求 9月14日起自动切换

用户登录国家超算互联网官网(www.scnet.cn),从首页进入「模型服务」页面即可调用 DeepSeek V4.1 Flash API。按官方规划,北京时间 9月14日12:00 起,对 deepseek-v4-pro 的请求将全部路由到 V4.1 Flash 并按 V4.1 Flash 单价计费,直至 V4.1 Pro 上线。

DeepSeek 表示将全力支持开源社区适配这一新架构的推理,并探索更广泛的部署路径;有大规模部署需求的团队(如 2000 张 GPU 与存储集群)可直接与官方接洽。

常见问题(FAQ)

V4.1 Flash 采用全新 Causal-Encoder-Decoder 架构(552B 参数 MoE,输入激活仅 8B),在性能、费用、速度、总用时等指标上全面超越 V4 Pro,并原生支持多模态视觉理解。

登录国家超算互联网官网 www.scnet.cn,从首页进入「模型服务」页面即可调用 API;DeepSeek 开放平台也已上线该模型。

不会立即下线:北京时间 9月14日12:00 起,对 deepseek-v4-pro 的请求将全部自动路由到 V4.1 Flash 并按新价格计费,直至 V4.1 Pro 上线。

延伸阅读

相关文章:谷歌连发Gemini 3.8 Flash与安全版Flash Cyber · 阿里通义千问Qwen3.8系列全面上线 · 极派星球首页

© 版权声明

相关文章

暂无评论

none
暂无评论...