正文内容 评论(0

DeepSeek V4正式版性能封神:Flash直追Opus 静待Pro斩杀四方
2026-07-31 14:58:18  出处:快科技 作者:宪瑞 编辑:宪瑞     评论(0)点击可以复制本篇文章的标题和链接复制对文章内容进行纠错纠错

快科技7月31日消息,早上刚有传闻DeepSeek V4正式版会在8月3日发布,没想到中午DeepSeek就拿出了正式版,首先登场的是DeepSeek V4 Flash,Pro版还要等到8月初。

根据官方消息,DeepSeek-V4-Flash-0731 的模型结构、尺寸和 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练,Agent能力大幅增强,基准测试远超 V4-Pro-Preview。

DeepSeek V4正式版性能封神:Flash直追Opus 静待Pro斩杀四方

根据官方发布的对比,V4 Flash在多个AI编程能力测试中大幅提升,最夸张的一个是DeepSwe,从7.3分提升到了54.4分,性能暴涨6倍多,只能说明之前Flash在这个编程测试中表现确实不行。

官方性能对比的是国产编程代表GLM-5.2及美国的Opus 4.8,Flash整体性能超过了GLM-5.2,比Opus 4.8差一些。

DeepSeek V4正式版性能封神:Flash直追Opus 静待Pro斩杀四方

还有网友让GPT整理了V4 Flash对比其他大模型的性能测试,可以看到跟国产的K3及GPT的旗舰Sol还有点差距。

DeepSeek V4正式版性能封神:Flash直追Opus 静待Pro斩杀四方

著名大模型测试员的结果显示性价比上Flash依然无敌,比降价后的GPT-5.6 Luna还要少一半的费用。

以上需要注意的是,V4 Flash只是个小参数模型,2840亿参数量,激活130亿而已,而GLM-5.2是7400多亿参数,K3是2.8万亿参数,5.6 Sol及Fable 5这样的美国顶级大模型虽然每公布参数量,但公认在4-5万亿级别,保守估计也是K3这种3万亿级别的。

可以说V4 Flash只用1/10到1/3的参数量就做到了前沿级性能,DeepSeek这一波真的是后训练仙人了,而V4 Pro是1.6万亿参数量,规模大了4倍以上,意味着性能还有更大的提升空间。

按照这个幅度来算,V4 Pro正式版的性能达到甚至超过K3、Opus 5、GPT-5.6 Sol或者Fable 5都是有可能的,此前网上流传的那些V4正式版测试果然不是骗人,DeepSeek无愧于AI斩杀线的美誉,比他强的大模型没奖励,但是比他弱的就麻烦了。

DeepSeek V4正式版性能封神:Flash直追Opus 静待Pro斩杀四方

【本文结束】如需转载请务必注明出处:快科技

责任编辑:宪瑞

文章内容举报

  • 支持打赏
  • 支持0

  • 反对

  • 打赏

文章价值打分

当前文章打分0 分,共有0人打分
  • 分享好友:
  • |

  • 热门文章
  • 换一波

  • 好物推荐
  • 换一波

  • 关注我们

  • 微博

    微博:快科技官方

    快科技官方微博
  • 今日头条

    今日头条:快科技

    带来硬件软件、手机数码最快资讯!
  • 抖音

    抖音:kkjcn

    科技快讯、手机开箱、产品体验、应用推荐...