Deepseek V4 1 Flash
主题归档 • 1 条结果
2026-09-20
科技
深度求索发布DeepSeek-V4.1-Flash模型,支持百万Token上下文: DeepSeek 发布了 DeepSeek-V4.1-Flash,采用 5520 亿参数的因果编码器-解码器混合专家(MoE)架构。该模型支持 100 万 token 的上下文窗口,并利用 CSA2 和 FP4 KV 缓存压缩技术,实现约每 token 890 字节。它可通过 API 以 deepseek-flash 名称使用。
AI 模型 • Pandaily
永久链接