Skip to content
AI情报2026年9月20日AI情报
文章

深度求索发布DeepSeek-V4.1-Flash模型,支持百万Token上下文

DeepSeek 发布了 DeepSeek-V4.1-Flash,采用 5520 亿参数的因果编码器-解码器混合专家(MoE)架构。该模型支持 100 万 token 的上下文窗口,并利用 CSA2 和 FP4 KV 缓存压缩技术,实现约每 token 890 字节。它可通过 API 以 deepseek-flash 名称使用。

Frontier 编辑部来源: Pandaily
01

来源简报

深度求索发布DeepSeek-V4.1-Flash模型,支持百万Token上下文: DeepSeek 发布了 DeepSeek-V4.1-Flash,采用 5520 亿参数的因果编码器-解码器混合专家(MoE)架构。该模型支持 100 万 token 的上下文窗口,并利用 CSA2 和 FP4 KV 缓存压缩技术,实现约每 token 890 字节。它可通过 API 以 deepseek-flash 名称使用。