DeepSeek V4.1 Flash

4 篇报道

DeepSeek-V4.1-Flash 是一个大规模混合架构的语言模型,其主模型约551.566B参数、总体约748B(含约196.929B的engram、14.225B的DSpark/MTP和约0.485B的视觉编码器)。近期报道聚焦对 safetensors 的检测、Artificial Analysis 基准中与 Qwen 和 GPT‑6 的性能差异,以及社区建议将其 KVCache 和 Engram 思路用于中大型模型以便在 32GB VRAM 上以 Q8/Q4 运行(估计 30B 的 engram 约占1/3–1/2,约10–15GB)。

相关话题
已经到底了