**【国联】DeepSeekV...
发布者:麦子
**【国联】DeepSeekV4发布**
【国联】DeepSeekV4发布,国产模型进入“万亿参数+百万上下文”新阶段,建议关注国产模型厂商价值重估 一、DeepSeekV4今日开启预览,分为Pro与Flash两个版本,Pro为1.6T总参数、49B激活参数,Flash为284B总参数、13B激活参数,均支持100万token上下文;架构上采用MoE、混合注意力、FP4/FP8混合精度,并以超32Ttokens完成预训练,核心方向是“更长上下文、更低推理成本、更强推理与代码能力”。 二、从跑分表现看,DeepSeekV4-Pro在代码、推理及长上下文任务中已进入全球第一梯队。根据官方模型卡及社区测试结果,其在LiveCodeBench、E-benchVerified等关键代码基准上接近或达到当前主流闭源模型水平。同时,在百万上下文场景下,推理FLOPs与KVcache占用显著优化,成本曲线进一步下移。 三、V4模型以文本为主,多模态能力并非本次核心;超大MoE模型本地部署门槛极高。我们认为,V4发布意味着模型能力继续上行、推理成本继续下降,有望直接扩大AIAgent、代码、办公、视频等应用场景的Token消费总量。 建议关注国产大模型MiniMax,公司围绕多模态、Agent、视频、语音、陪伴、办公生产力和全球化订阅/API形成商业闭环,代表国产模型商业化与全球化弹性方向。 风险提示:行业竞争加剧;模型推理成本下降向收入转化不及预期;海外监管及商业化进展不及预期。 联系人:国联民生计算机吕伟/周慧敏