DeepSeek V4.1 Flash上线超算互联网
IT时代网9月10日消息,DeepSeek V4.1 Flash 模型今日上线国家超算互联网中心。用户登录官网进入模型服务页面,即可快速打开该模型的 API 调用界面。
DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型,采用全新的 Causal-Encoder-Decoder 结构,输入与输出不对称,输入激活仅 8B、输出激活 16B,成本显著低于同尺寸已知模型。该模型采用新预训练方式并经过更大规模强化学习后训练,在基准测试中超越包括 DeepSeek V4 Pro 在内的一众旗舰模型。
此外,该模型大幅压缩 KV Cache 缓存大小,相比上一代对 HBM 需求减至四分之一、对 SSD 需求减至八分之一。在 Agent 使用场景中,缓存命中费用占比较高,对 KV Cache 的压缩显著降低了此类任务的使用成本。

注:本文综合自IT之家等,文中包含AI辅助创作的内容。
编辑:林一舟
THE END