**DeepSeek-V4持续...
发布者:麦子
**DeepSeek-V4持续更新(0424)**
DeepSeek-V4持续更新(0424)@ 在系统工程部分提到过硬件平台,但语境不是“训练主集群用什么卡”,而是说他们的MoE专家并行kernel在:NVIDIAGPUs和HUAWEIAscendNPUs。 训练算力:没有披露多少卡、多少小时;推理算力:有披露,但主要是“相对指标”。 V4-Pro的单token推理FLOPs是DeepSeek-V3.2的27%; V4-Pro的KVcache是DeepSeek-V3.2的10%; V4-Flash的单token推理FLOPs是DeepSeek-V3.2的10%; V4-Flash的KVcache是DeepSeek-V3.2的7%。