AI情报2026年9月20日AI情报
文章
深度求索发布DeepSeek-V4.1-Flash模型,支持百万Token上下文
DeepSeek 发布了 DeepSeek-V4.1-Flash,采用 5520 亿参数的因果编码器-解码器混合专家(MoE)架构。该模型支持 100 万 token 的上下文窗口,并利用 CSA2 和 FP4 KV 缓存压缩技术,实现约每 token 890 字节。它可通过 API 以 deepseek-flash 名称使用。
Frontier 编辑部来源: Pandaily