最近抖音上很多人说“950出来了,华为站起来了”。我也希望这是真的,但我看到的另一面是:华为吃掉的H20市场,正在变成A100二手洪流,冲向华为最薄弱的根基——中小企业。
一、一个没人注意的“死亡循环”
华为在政企市场每拿下一单,英伟达的大客户就多淘汰一批旧卡。这批卡正以崩盘价涌向全球二手市场,而中国是最大的承接方。
结果就是:华为在上层吃得越狠,底层的中小企业和开发者市场就被洋垃圾冲击得越狠。
中小企业不需要千亿大模型,32B-70B这个区间就够用了。
而这个区间,8卡A100 40G就能跑得很好,二手价已经很低了。未来随着英伟达新卡发布,A100、H100、R6000、L20、L40会全线降价——可能真的会人手一张。
二、未来模型演进的三个趋势
1. 大模型迭代会变慢
未来大模型可能1-2年才出一个新版本,不像现在这么卷了。
2. 小模型会越来越强
小模型和满血大模型的差距正在从10%缩小到5%左右。而且小模型一年出很多个,差距只会越来越小。
3. 未来主流是“小模型+API”
纯API成本太高,纯本地化能力有限。混合模式才是出路。但本地化推理这块,如果二手英伟达卡足够便宜,谁还会用昇腾?
三、国内二手算力的“堰塞湖”
国内现有的存量:
未来海外还会涌入更多:
预估价格走势:
四、70B模型的门槛已经被“洋垃圾”踏平
关键事实:70B模型推理,8卡A100 40G就够用了。
8卡A100 40G总显存320GB。70B的4-bit量化只需要35-40GB,8卡张量并行后,每卡负载很均匀,推理速度足够流畅。
对于跑32B-70B模型的中小企业来说,A100 40G的性能已经完全够用。这意味着:只要二手A100 40G足够便宜,昇腾的300I A2和300I Duo在中小企业市场就没有吸引力。
五、CANN的生存空间在哪里?
华为950最终可能会替换掉50%的高端市场。但淘汰下来的A100、H100、R6000、L20、L40会全面降价,这些卡会长期占据中低端市场。
对于中小企业(中国最多的群体),他们的选择很简单:
CANN的生存空间,在于华为能不能在“人手一张洋垃圾”之前,把昇腾的入门卡打到让人“无脑买”的价格。否则,等中小企业和个人开发者都用惯了CUDA,再想让他们迁移到CANN,就难了。
350出来,300I已经“报废”了
昇腾350出来之后,300I系列(包括Duo和A2)的定位其实很尴尬。
350的FP4算力1.56 PFLOPS,112GB HBM。300I Duo呢?96GB LPDDR4X,带宽只有204GB/s(单路),推理速度只有15-20 tok/s。性能差距不是一星半点。
300I Duo目前的性能,只能和RTX 3090比拼。 而3090是2020年的卡。2026年的今天,它已经被远远甩在后面了。
也就是说,300I Duo已经不是“未来主力”,而是“上一代产品”了。
对比参数
从参数看:300I Duo的显存是3090的4倍,但带宽只有其1/4。跑大模型能装下,但速度慢。FP16算力两者持平,说明300I Duo在“能装下”的场景下推理速度与3090相当,但一旦模型超过24GB(比如32B量化后约16GB,其实没超),3090就装不下了。300I Duo的卖点是“容量”,不是“速度”。
更大的危险:二手卡正在疯狂涌入
我们之前讨论过,英伟达新卡发布后,A100、H100会大量淘汰。这批“洋垃圾”正以崩盘价涌向中国。
一旦二手A100价格崩盘,8卡A100 40G总显存320GB,跑70B 4-bit推理(只需35-40GB)完全够用。对于中小企业来说,二手A100插上就能跑CUDA,生态成熟、开箱用。而300I Duo性能还不如A100,还要折腾CANN。
程序员正在大量涌入AI应用和微调
现在90%的程序员都开始接触AI应用开发和微调。这批人正是CANN生态潜在的“用户基数”。
关键问题:这批人第一次接触AI算力,用的是什么卡?
如果他用的是二手A100,那他就会习惯CUDA,习惯英伟达的生态。以后让他再学CANN,可能性很低。
所以现在是最关键的时间窗口:在A100大跳水之前,抢占这批新入场的程序员。
再不行动,窗口期就关了
现在是因为封锁,海外高端卡进不来,这是CANN扩大用户基数最好的时期。
等封锁松动,或者A100/H100的二手洪流彻底冲垮价格体系,再想抢开发者就晚了。
90%的新程序员正在涌入AI领域,他们正在选择“第一张卡”。
如果他们的第一张卡是A100,那CANN就永远失去了这批人。
如果他们的第一张卡是300I Duo,那CANN就多了一个长期用户。
最近抖音上很多人说“950出来了,华为站起来了”。我也希望这是真的,但我看到的另一面是:华为吃掉的H20市场,正在变成A100二手洪流,冲向华为最薄弱的根基——中小企业。
一、一个没人注意的“死亡循环”
华为在政企市场每拿下一单,英伟达的大客户就多淘汰一批旧卡。这批卡正以崩盘价涌向全球二手市场,而中国是最大的承接方。
结果就是:华为在上层吃得越狠,底层的中小企业和开发者市场就被洋垃圾冲击得越狠。
中小企业不需要千亿大模型,32B-70B这个区间就够用了。
而这个区间,8卡A100 40G就能跑得很好,二手价已经很低了。未来随着英伟达新卡发布,A100、H100、R6000、L20、L40会全线降价——可能真的会人手一张。
二、未来模型演进的三个趋势
1. 大模型迭代会变慢
未来大模型可能1-2年才出一个新版本,不像现在这么卷了。
2. 小模型会越来越强
小模型和满血大模型的差距正在从10%缩小到5%左右。而且小模型一年出很多个,差距只会越来越小。
3. 未来主流是“小模型+API”
纯API成本太高,纯本地化能力有限。混合模式才是出路。但本地化推理这块,如果二手英伟达卡足够便宜,谁还会用昇腾?
三、国内二手算力的“堰塞湖”
国内现有的存量:
未来海外还会涌入更多:
预估价格走势:
四、70B模型的门槛已经被“洋垃圾”踏平
关键事实:70B模型推理,8卡A100 40G就够用了。
8卡A100 40G总显存320GB。70B的4-bit量化只需要35-40GB,8卡张量并行后,每卡负载很均匀,推理速度足够流畅。
对于跑32B-70B模型的中小企业来说,A100 40G的性能已经完全够用。这意味着:只要二手A100 40G足够便宜,昇腾的300I A2和300I Duo在中小企业市场就没有吸引力。
五、CANN的生存空间在哪里?
华为950最终可能会替换掉50%的高端市场。但淘汰下来的A100、H100、R6000、L20、L40会全面降价,这些卡会长期占据中低端市场。
对于中小企业(中国最多的群体),他们的选择很简单:
CANN的生存空间,在于华为能不能在“人手一张洋垃圾”之前,把昇腾的入门卡打到让人“无脑买”的价格。否则,等中小企业和个人开发者都用惯了CUDA,再想让他们迁移到CANN,就难了。
350出来,300I已经“报废”了
昇腾350出来之后,300I系列(包括Duo和A2)的定位其实很尴尬。
350的FP4算力1.56 PFLOPS,112GB HBM。300I Duo呢?96GB LPDDR4X,带宽只有204GB/s(单路),推理速度只有15-20 tok/s。性能差距不是一星半点。
300I Duo目前的性能,只能和RTX 3090比拼。 而3090是2020年的卡。2026年的今天,它已经被远远甩在后面了。
也就是说,300I Duo已经不是“未来主力”,而是“上一代产品”了。
对比参数
从参数看:300I Duo的显存是3090的4倍,但带宽只有其1/4。跑大模型能装下,但速度慢。FP16算力两者持平,说明300I Duo在“能装下”的场景下推理速度与3090相当,但一旦模型超过24GB(比如32B量化后约16GB,其实没超),3090就装不下了。300I Duo的卖点是“容量”,不是“速度”。
更大的危险:二手卡正在疯狂涌入
我们之前讨论过,英伟达新卡发布后,A100、H100会大量淘汰。这批“洋垃圾”正以崩盘价涌向中国。
一旦二手A100价格崩盘,8卡A100 40G总显存320GB,跑70B 4-bit推理(只需35-40GB)完全够用。对于中小企业来说,二手A100插上就能跑CUDA,生态成熟、开箱用。而300I Duo性能还不如A100,还要折腾CANN。
程序员正在大量涌入AI应用和微调
现在90%的程序员都开始接触AI应用开发和微调。这批人正是CANN生态潜在的“用户基数”。
关键问题:这批人第一次接触AI算力,用的是什么卡?
如果他用的是二手A100,那他就会习惯CUDA,习惯英伟达的生态。以后让他再学CANN,可能性很低。
所以现在是最关键的时间窗口:在A100大跳水之前,抢占这批新入场的程序员。
再不行动,窗口期就关了
现在是因为封锁,海外高端卡进不来,这是CANN扩大用户基数最好的时期。
等封锁松动,或者A100/H100的二手洪流彻底冲垮价格体系,再想抢开发者就晚了。
90%的新程序员正在涌入AI领域,他们正在选择“第一张卡”。
如果他们的第一张卡是A100,那CANN就永远失去了这批人。
如果他们的第一张卡是300I Duo,那CANN就多了一个长期用户。