返回话题列表
二月麦
2026/04/24 22:39
类型 talk 1阅读 1

**DeepseekV4速评:...

发布者:麦子

**DeepseekV4速评:全面利好国产算力**

全面超越V3.2/其余国内开源模型,多余benchmark成绩等不赘述,几个亮点 1)据评测反馈使用体验优于Sonnet4.5,交付质量接近Opus4.6非思考模式,但仍与Opus4.6思考模式存在一定差距——很诚恳的自我评价,考虑到Sonnet4.5发布后ClaudeARR飞升,我们认为这一水平模型商业价值较高; 2)超高性价比,在1MToken场景下,V4-Pro仅需V3.2约27%的单Token推理算力+10%的KVCache显存。 背后是更加原创的Attention架构、更加极致的稀疏化——在DSA基础上的A(压缩注意力)/HCA(重度压缩注意力),MoE专家数到了384个; 思路简单但是有效,也意味着更加分化的路线/更多的手搓算力; 3)如预期中的Day0国产算力适配,Fine-GrainedEP在昇腾平台实现1.50~1.96x加速,明确提到受限于高端算力,目前Pro的服务吞吐十分有限,预计下半年昇器950超节点批量上市后,Pro的价格会大幅下调。期待一下下午4点的直播。另外寒武纪也day0适配了。 更多技术文档细节和部署实测后续发出