OmniTools 9月18日消息,DeepSeek 近日发布 DeepSeek V4.1 Flash,一款参数量达 552B 的多模态混合专家(MoE)模型,主打 KV Cache 压缩技术以提升推理效率。该模型支持最长 100 万 token 的上下文长度,模型权重已开源并上线 Hugging Face 平台。