我是一个中小企业AI从业者
收藏回复举报
我是一个中小企业AI从业者
新人帖
发表于2026-04-28 06:37:40
0 查看

最近抖音上很多人说“950出来了,华为站起来了”。我也希望这是真的,但我看到的另一面是:华为吃掉的H20市场,正在变成A100二手洪流,冲向华为最薄弱的根基——中小企业。

一、一个没人注意的“死亡循环”

华为在政企市场每拿下一单,英伟达的大客户就多淘汰一批旧卡。这批卡正以崩盘价涌向全球二手市场,而中国是最大的承接方。

结果就是:华为在上层吃得越狠,底层的中小企业和开发者市场就被洋垃圾冲击得越狠。

中小企业不需要千亿大模型,32B-70B这个区间就够用了。

而这个区间,8卡A100 40G就能跑得很好,二手价已经很低了。未来随着英伟达新卡发布,A100、H100、R6000、L20、L40会全线降价——可能真的会人手一张。

二、未来模型演进的三个趋势

1. 大模型迭代会变慢

未来大模型可能1-2年才出一个新版本,不像现在这么卷了。

2. 小模型会越来越强

小模型和满血大模型的差距正在从10%缩小到5%左右。而且小模型一年出很多个,差距只会越来越小。

3. 未来主流是“小模型+API”

纯API成本太高,纯本地化能力有限。混合模式才是出路。但本地化推理这块,如果二手英伟达卡足够便宜,谁还会用昇腾?

三、国内二手算力的“堰塞湖”

国内现有的存量:

显卡型号存量规模价格趋势
A100 (各类)数十万张40G版本二手价已很低,80G持续下跌
H20几十万张(字节、阿里等大厂库存)国企停采后疯狂抛售
R6000 / L20 / L40大量流通受二手A100冲击,价格持续承压

未来海外还会涌入更多:

显卡型号来源预计规模
A100/H100英伟达新卡发布,大厂集中退役数百万张将涌入全球二手市场

预估价格走势:

显卡型号当前二手价12个月后24个月后
A100 40G已很低继续下跌可能“人手一张”
A100 80G6-8万(拆机)4-6万跌破1万
H100 8卡整机100-140万60-80万可能更低
H20持续抛售大量流入市场价格崩塌
L20/L40/R6000各有区间受冲击持续降价价格体系重塑

四、70B模型的门槛已经被“洋垃圾”踏平

关键事实:70B模型推理,8卡A100 40G就够用了。

8卡A100 40G总显存320GB。70B的4-bit量化只需要35-40GB,8卡张量并行后,每卡负载很均匀,推理速度足够流畅。

对于跑32B-70B模型的中小企业来说,A100 40G的性能已经完全够用。这意味着:只要二手A100 40G足够便宜,昇腾的300I A2和300I Duo在中小企业市场就没有吸引力。

五、CANN的生存空间在哪里?

华为950最终可能会替换掉50%的高端市场。但淘汰下来的A100、H100、R6000、L20、L40会全面降价,这些卡会长期占据中低端市场。

对于中小企业(中国最多的群体),他们的选择很简单:

对比项二手英伟达方案昇腾方案
成本极低(A100 40G已经很便宜)较高(300I Duo 1.3万,A2 8万+)
生态CUDA,开箱即用CANN,需要折腾
够用吗32B-70B完全够用够用,但门槛高

CANN的生存空间,在于华为能不能在“人手一张洋垃圾”之前,把昇腾的入门卡打到让人“无脑买”的价格。否则,等中小企业和个人开发者都用惯了CUDA,再想让他们迁移到CANN,就难了。

 

350出来,300I已经“报废”了

昇腾350出来之后,300I系列(包括Duo和A2)的定位其实很尴尬。

350的FP4算力1.56 PFLOPS,112GB HBM。300I Duo呢?96GB LPDDR4X,带宽只有204GB/s(单路),推理速度只有15-20 tok/s。性能差距不是一星半点。

300I Duo目前的性能,只能和RTX 3090比拼。 而3090是2020年的卡。2026年的今天,它已经被远远甩在后面了。

也就是说,300I Duo已经不是“未来主力”,而是“上一代产品”了。

对比参数

对比项昇腾350 HBM版昇腾300I DuoRTX 3090 (二手参考)
显存容量112GB HBM96GB LPDDR4X24GB GDDR6X
显存带宽1.4 TB/s408 GB/s(单芯片204)936 GB/s
FP4算力1.56 PFLOPS不支持不支持
FP16算力未明确140 TFLOPS142 TFLOPS
INT8算力未明确280 TOPS
功耗~600W150W350W
架构定位推理主力边缘推理消费级旗舰(2020)

从参数看:300I Duo的显存是3090的4倍,但带宽只有其1/4。跑大模型能装下,但速度慢。FP16算力两者持平,说明300I Duo在“能装下”的场景下推理速度与3090相当,但一旦模型超过24GB(比如32B量化后约16GB,其实没超),3090就装不下了。300I Duo的卖点是“容量”,不是“速度”。  

 

更大的危险:二手卡正在疯狂涌入

我们之前讨论过,英伟达新卡发布后,A100、H100会大量淘汰。这批“洋垃圾”正以崩盘价涌向中国。

一旦二手A100价格崩盘,8卡A100 40G总显存320GB,跑70B 4-bit推理(只需35-40GB)完全够用。对于中小企业来说,二手A100插上就能跑CUDA,生态成熟、开箱用。而300I Duo性能还不如A100,还要折腾CANN。

程序员正在大量涌入AI应用和微调

现在90%的程序员都开始接触AI应用开发和微调。这批人正是CANN生态潜在的“用户基数”。

关键问题:这批人第一次接触AI算力,用的是什么卡?

如果他用的是二手A100,那他就会习惯CUDA,习惯英伟达的生态。以后让他再学CANN,可能性很低。

所以现在是最关键的时间窗口:在A100大跳水之前,抢占这批新入场的程序员。

再不行动,窗口期就关了

现在是因为封锁,海外高端卡进不来,这是CANN扩大用户基数最好的时期。

等封锁松动,或者A100/H100的二手洪流彻底冲垮价格体系,再想抢开发者就晚了。

90%的新程序员正在涌入AI领域,他们正在选择“第一张卡”。

如果他们的第一张卡是A100,那CANN就永远失去了这批人。

如果他们的第一张卡是300I Duo,那CANN就多了一个长期用户。

我要发帖子