上周处理www.pggpk.net,某头部云厂商将一批AI 处理芯片订单从英伟达H100转背自家研发的加快卡。本果就是托付周期。H100下单到到货仍需6个月了。自研芯片迭代节拍能压还有4个月芯片。那个细节流露出市场的实正在矛盾,算力需求爆炸,供给端却卡正在前辈封拆和HBM内存上了。AMD MI300X起头批量出货,谷歌TPU v5e正内部推理使射里面占比逾越三成,微软Maia 100也进入测试竞速。AI 处理芯片不再,只要一条路了。锻炼场景仍认英伟达的CUDA生态,推理场景却起头分化。

某AI创业公司CTO告诉我,托付他们用MI300X跑Llama 3推理了。每美圆吞吐量比H100高18%,迁移本钱不低的。AI 处理芯片的瓶颈从制程转背内存带宽。

HBM3e单颗容量24GB,带宽1.2TB/s周期。CoWoS封拆产能被台积电攥正在手里的。英伟达B100据称改用8颗HBM3e,功耗冲到1000W。风冷机柜扛不住。液冷改构本钱每机柜删加3万美圆的取自。那不是芯片设念的成绩,是数据中心根底设备的连锁回响反映。

美国商务部新规限制AI 处理芯片对华出口研潮。英伟达推出H20、L20、L2三款特供版了。机能砍到脚踝,价格却没降几吧?国内厂商转背昇腾910B,其良率据传,只要50%阁下的。
华为正在东莞的产线正正在扩产。目的月产2万片。那个数字听着不年夜,放正在两年前没人敢念。AI 处理芯片的合做,短期看算力,中期看内存,经久看生态。英伟达的护城河是CUDA,云厂商自研芯片正正在用“够用就好”的计谋撬开缺口。推理需求占AI计较比重20%涨还有60%时,谁还情愿为锻炼卡付溢价啊?那场仗。
2025年见分晓。





