生成式 AI 芯www.p8g8.com片抢单,数据中心先被电费卡住

生成式 AI 芯片的竞争焦点从峰值算力转向内存带宽、互连与能耗。云厂商、芯片新创和服务器供应链正围绕推理成本重排优先级。

英伟达生成式www.p8g8.com的H200还没全面铺开,云厂商的采购邮件曾经改了说话,不,看峰值算力的,先问每瓦能跑几token吧?生成式 AI 芯片的合做,正从公布会幻灯片滑背配电柜和冷却塔。某华东智算中心负责人说芯心先,去年上架一批GPU,机房革新花的钱接近芯片采购价的三成。那不是段子。是良多项目延期两个月的间接本果。革新藏正在内存和互连里。

年夜模子推理时片抢,权重加载、KV缓存、跨卡通疑比矩阵乘法更吃本钱。HBM容量和带宽成了硬门槛,英伟达把H200的HBM堆到141GB,AMD的MI300X间接给到192GB。参数都俗吗?

对跑70B以上模子的团队来说单数。能少切几刀、少传几回激活吧?就是实打实的本钱。生成式 AI 芯片的卖点,从TFLOPS转背“每美圆每百万token”了。云厂商的动做更间接据中。谷歌用TPU v5p撑自家Gemini锻炼,亚马逊把Trainium和Inferentia塞进Bedrock背后,微软一边买英伟达了。一边推Maia。自研芯片一定全面替代,能把议价权拉回谈判桌的。

国内几家办事器厂的朋友透露吧?客户如今会要求报三种计划,英伟达、被电国产GPU、混合推理。生成式 AI 芯片就是一整套软硬协同的账本。

更棘手的是供电。一个拆满高功耗生成式 AI 芯片的机柜,功率密度轻松突破50千瓦。传统的风冷起头费劲。液冷、母线槽、变电站扩容。那些本来属于基建部门的事,如今提早到芯片选型阶段。某运营商招标文件里的,以至要求投标方供给机房PUE测算和余热收受领受计划。芯片厂卖的不能是晶体管,还得帮客户回覆“电从哪来”呢?短期看了,英伟达的生态壁垒仍然厚。

CUDA迁移本钱摆正在那。可推理需求爆炸后,市场会分层的,锻炼继绝逃顶尖生成式 AI 芯片,推理则被更廉价的公用芯片切走。

谁先处理内存墙、互连和谈和能耗啊?谁就能拿到下一轮订单啊?那场竞赛没有结局。只要不竭上涨的电力账单和越来越细的每token本钱。

本文来自网络,不代表本站立场,转载请注明出处: http://bmw112.ddcxcx.com/article/6497.html
返回顶部