17173 > 游戏资讯 > 科技新闻 > 正文

DeepSeek V4.1 Flash 模型上线国家超算互联网

2026-09-10 20:05:57 神评论
17173 新闻导语

DeepSeek V4.1 Flash上线国家超算互联网!552B参数MoE模型,成本低、性能超越旗舰,Agent任务成本大幅降低,立即体验智能进化。

9 月 10 日消息,DeepSeek V4.1 Flash 模型今日上线国家超算互联网中心。用户可登录国家超算互联网官网,从首页进入「模型服务」页面,即可快速打开 DeepSeek V4.1 Flash 模型 API 调用界面。

据了解,DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。

同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。

此外,DeepSeek V4.1 Flash 大幅减少了 KV Cache 缓存的大小,与上一代模型相比,对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8。在 Agent 使用场景中,缓存命中的费用往往占比较高,对 KV Cache 的压缩大幅降低了 Agent 类任务的使用成本。

【来源:IT之家】
关于DeepSeek V4.1 Flash,国家超算互联网,MoE模型,Causal-Encoder-Decoder,KV Cache,AI模型,强化学习,基准测试的新闻
17173想了解一下大家怎么看17173的,以便提供更好的阅读体验,所以请各位路过的大佬们花一分钟时间看看这个问卷吧 一键参与