**DeepseekV4发布:...
发布者:麦子
**DeepseekV4发布:Agent能力大幅提升,Flash版本性价比极高**
事件:4月24日,DeepseekV4发布。 模型分为两个版本,Pro版本参数量达到1.6T。一、DeepSeek-V4-Pro:参数1.6T,激活49B,预训练数据33T,定位为高性能版本。二、DeepSeek-V4-Flash:参数284B,激活13B,预训练数据32T。定位为更快捷、经济的高效版本。上下文长度为1M。 Agent能力大幅提高,比肩Opus4.6非思考模式。目前DeepSeek-V4已成为公司内部员工使用的AgenticCoding模型,据评测反馈使用体验优于Sonnet4.5,交付质量接近Opus4.6非思考模式,但仍与Opus4.6思考模式存在一定差距。 两款模型比较来看,在Agent测评中,DeepSeek-V4-Flash在简单任务上与DeepSeek-V4-Pro旗鼓相当,但在高难度任务上仍有差距。 DeepSeek-V4开创了一种全新的注意力机制,在token维度进行压缩,结合DSA稀疏注意力(DeepSeekSparseAttention),实现了全球领先的长上下文能力,并且相比于传统方法大幅降低了对计算和显存的需求(见下图)。 根据论文,Deepseek在英伟达GPU与华为昇腾NPU两大硬件平台上,完成了细粒度并行执行方案的有效性验证。相较于优质的非融合基线方案,该方案在通用推理任务中,可实现1.50~1.73倍的加速效果;在强化学习推演、高速智能体服务等低延迟刚需场景下,最高加速比可达1.96倍。公司已开源基于CUDA开发的巨型内核实现项目MegaMoE2。 价格方面,Deepseek实现了高性价比。DeepSeek-V4-Pro输入/输出百万Token价格12元/24元;对比国内1T模型,比如小米Token价格在1(入)/3(出)(小于256K上下文)。Deepseek-V4-Flash输入/输出价格1元/2元。对比来看,昨日腾讯HY3.0参数量295B的模型已经达到了极高性价比,但0-16K上下文输入/输出每百万Token1.2/4元。 欢迎联系国信互联网张伦可/陈淑媛/张昊晨