DeepSeek V4.1 Flash正式发布:552B新架构,输入只激活8B

BiRun 讯,动察 Beating AI 快讯,DeepSeek 正式发布 V4.1 Flash。新模型总参数 552B(5520 亿),采用全新的 Causal-Encoder-Decoder 架构,并原生支持图片理解。它也是 DeepSeek 这套新架构系列里目前最小的模型。

这套架构把输入和输出分开处理。读取输入时只激活 8B(80 亿)参数,生成回答时激活 16B(160 亿)。DeepSeek 称,这让 552B 的大模型也能把推理成本压下来。经过新的预训练和更大规模强化学习后,V4.1 Flash 在官方基准中已经超过 V4 Pro。

缓存也被大幅压缩。相比上一代,V4.1 Flash 对 HBM 显存的需求降至 1/4,SSD 存储需求降至 1/8,主要用来降低长上下文和 Agent 反复调用时的成本。

V4.1 Flash 已同步上线 API,模型名改成 deepseek-flash 即可调用。
利多
你怎么看这条消息?来投第一票

评论

0/500
免责声明:本文内容仅供参考,不构成任何投资建议。
更多快讯