返回行业动态

DeepSeek 发布多模态 MoE 模型 DeepSeek-V4.1-Flash,主打 KV Cache 压缩

2026/09/18 03:32
查看原文

OmniTools 9月18日消息,DeepSeek 近日发布 DeepSeek-V4.1-Flash,一款参数量达 552B 的多模态混合专家(MoE)模型,主打 KV Cache 压缩技术以提升推理效率。该模型支持最长 100 万 token 的上下文长度,模型权重已开源并上线 Hugging Face 平台。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部