众力资讯网

DeepSeek真正的杀招来了!8月6日,DeepSeek新一轮融资说明文件被公

DeepSeek真正的杀招来了!8月6日,DeepSeek新一轮融资说明文件被公布在网上,有几个非常关键的描述:V4-Pro性能跻身全球第一梯队、编程能力仅弱于Claude旗舰0.3%,百万Token超长上下文,API定价仅海外竞品的1/10~1/100,性价比断崖式领先,原生适配华为昇腾950PR!请注意最后一句描述,这个将成为未来中国算力硬件出海最关键的背书!

DeepSeek V4-Flash 0731的性能已经让大家见识到了,284B(2840亿)总参数、13B(130亿)激活,官方FP4+FP8权重只有160GB,比起动辄TB级的大部分开源模型来看,这绝对是一个超级轻量级的“MINI”大模型。

但它的性能却相当不俗!能达到Anthropic的Claude Fable 5约83%的性能,并且它的速度还是Claude Fable 5的1.5倍,价格却只有Claude Fable 5的1%左右,你说这样的诱惑哪个白嫖佬能顶得住?

当然最强的杀招还是DeepSeek V4-Flash 0731的“离线”部署方式。这个开源权重的模型体积小,激活参数少,意味着部署这种模型所需要的资源会指数级下降。以个人使用为例,单并发15~22 token/s,上下文上限64K的情况下,大概1.5万人民币就能搞定。如果是生产环境部署,大概是60~100万人民币。

所以DeepSeek V4-Flash 0731发布后将会极大地刺激英伟达显卡的销售。一个是个人部署,因为很多玩家宁愿一次性投资,也不愿意一次次去订阅API,毕竟他们有些数据是“见不得人”的!另一个则是托管或者服务器租用业务,租用算力资源跑你自己架构的大模型,这不门槛低了嘛,很多之前被挡在门外的个人与机构可以玩这套逻辑了。

这个过程中收益最大的是谁?当然是英伟达无疑!这就是最近这些年黄仁勋声嘶力竭地游说特朗普开放显卡销售,不要禁止中国的开源大模型。原因就是中国每发布一次高性能大模型都能为英伟达带来一波红利,这种财神爷不得供着?老黄说的不是好话,每一句都能为他带来现金的“金句”!
那么在这个过程中,我们获得了什么好处?

大模型免费下载,英伟达挣得盆满钵满,中国花巨资就赚了个“AI共产主义、老钟牛逼”的吆喝?这几天在社交媒体X上确实是这样,因为中国优秀大模型的发布,美国闭源大模型进入了一轮降价狂潮:

早在7月24日,Anthropic的Claude系列已经大幅调价,性能对标Fable 5的Claude Opus 5定价腰斩,主打轻量日常的Claude Haiku 4.5综合调用成本下调35%!全新的Google Gemini Flash也卷入降价狂潮,全系下调40%~60%!7月30日,GPT-5.6断崖式大降价更是震惊了全球,降幅达到了80%。

各位不要理解错,这个可不是吆喝!因为美国大模型的初衷就是要限制中国AI获取英伟达显卡,堵死算力资源路径,让中国AI产业彻底消亡,然后美国就可以圈起来赚取高额利润了。这样美国AI产业界的数万亿美元投入,要不了几年就能挣回来,复制当年互联网生态的盈利逻辑。

现在中国大模型横插一杠,这不美国的叙事逻辑不就玩不转了?拿着投资人的钱不断烧,再下去就难以为继了。中国这套方式打垮美国大模型不敢说,但夺取AI大模型的部分话语权绝对是没问题的。所以这个逻辑可不是赚吆喝哦,是生死之争中首先必须要确立的生存!

目前这个状态就是中国以相当优秀的开源模型,比如KIMI K3、DeepSeek V4-Flash 0731与即将发布的V4-Pro,还有Qwen3.8-Max等等,第一刀就看向了API订阅。性能优秀价格低,国外用户如潮水涌入。现在老外也精明了,懂得用路由去平衡模型调用,耗资最大的日常用中国模型,只有极端麻烦的问题才用Anthropic和OpenAI的顶级大模型。不是不用,而是少用!

第二刀就是托管服务器租用。只要用户有需求,微软Azure、英伟达NIM、亚马逊AWS自然会屁颠屁颠跑过来适配中国大模型。不仅是适配,还会部署大模型供用户调用API,有钱挣就是王道,这不商业生态也建立起来了?

第三刀就是私有大模型部署。V4-Flash 0731部署的门槛降到了个人都能摸到的程度,这个就会炸出一大堆中国大模型的潜在用户!

这些都做好了铺垫之后,估计各位应该也猜出来DeepSeek的V4-Pro原生适配华为昇腾950PR是为什么了吧?假如某国被美国制裁,拿不到英伟达的显卡,那么他们会去用啥部署?

如果某国在取得硬件时美国搭配各种限制条件,他们是不是有了第二个选项,还能议价!如果华为昇腾系列性能越来越优秀,那么搭配早就建立的生态,未来会不会像华为交换机与5G产品一样大杀四方?所以英伟达的CUDA护城河早就已经被各个击破了!