AI情报2026年9月11日AI情报
文章
Deepseek发布V4.1-Flash模型,KV缓存内存需求降低75%
Deepseek 发布了 V4.1-Flash,这是一个拥有 5520 亿参数的多模态模型,可将 KV 缓存内存降低至前代产品的四分之一。该模型每个 token 有 160 亿活跃参数,并在 DeepSWE 编程基准上以微弱优势超过 Opus 5 和 GPT-5.6 Sol。它采用 MIT 许可证发布。
Frontier 编辑部来源: The Decoder
Deepseek 发布了 V4.1-Flash,这是一个拥有 5520 亿参数的多模态模型,可将 KV 缓存内存降低至前代产品的四分之一。该模型每个 token 有 160 亿活跃参数,并在 DeepSWE 编程基准上以微弱优势超过 Opus 5 和 GPT-5.6 Sol。它采用 MIT 许可证发布。