DeepSeek V4 Flash正式版这波跑分确实有点东西,AII指数直接干到50分,离GPT-5.6 Luna就差1分,Terminal Bench甚至反超了GLM 5.2。最绝的是,这次架构完全没动,纯靠后训练把Agent能力榨干了,284B的MoE底子硬是跑出了顶级旗舰的味儿。
以前总觉得大模型竞争就是堆参数、拼算力,现在看DeepSeek这招“不换脑子换练法”挺聪明。输入1块输出2块每百万Token,加上98%的缓存折扣,单任务成本比Luna还低六成。这种极致性价比配上特化的Agent能力,正好卡在GLM 5.2和Kimi K3之间,走出一条差异化路子。
对于咱们这些天天跟代码打交道的开发者来说,原生支持Responses API和Codex适配才是真香现场,一键配置脚本省了不少折腾时间。虽然网页端和App还没动静,但API这波更新已经足够让很多垂直场景的应用重新评估选型了。不卷参数卷后训练,看来以后软实力才是硬道理。DeepSeekV4Flash正式版跑分出炉



