通用GPU仍是主角,但推理账单逼着芯片厂把「为模型定制硅片」写进路线图——AMD盯上了Taalas。
AMD(纳斯达克:AMD)是全球主要半导体公司,加速器产品线以Instinct GPU、EPYC CPU与ROCm软件栈服务训练与推理。过去两年,云与企业侧资本开支叙事正从「囤训练卡」转向「压推理单价」:同样服务十亿级聊天与Agent调用,decode阶段的token成本与能耗开始决定毛利。Taalas成立于2023年,总部位于加拿大安大略省多伦多,定位专用AI推理硅片:优化推理数据流,降低通用架构下的算力与内存瓶颈。
所谓专用推理硅,白话就是不为「什么模型都能跑」而设计,而是把特定模型的权重与数据通路「焊」进芯片,换极高token吞吐。代价是灵活性下降——换模型可能意味着换硅或重做映射。对云厂商,这往往以「GPU做prefill、专用硅做decode」的异构组合出现;对芯片厂,则是在通用GPU主航道之外再买一条效率曲线。
8月6日,AMD宣布已就收购Taalas达成最终协议,计划将该技术融入加速器路线图,并与Instinct GPU等组合形成系统级方案,同时覆盖Helios机架级方案、EPYC CPU、ROCm软件及更广生态。交易尚需满足惯例交割条件与监管批准;财务条款未在新闻稿中披露。外媒报道口径称,Taalas融资累计约2.19亿美元,测试芯片曾在Llama 3.1 8B等模型上展示约每秒上万token量级的演示成绩——第三方报道口径,最终产品指标以AMD后续披露为准。
在AI资本开支从训练转向大规模推理的阶段,Groq、Cerebras等专用路线已经证明「不为通用、只为吞吐」可以切出利基。AMD此举是在Instinct与Helios主航道之外补强差异化推理效率,并用加拿大工程团队补强人才。对云与企业买家,意义不在「又一家被收购」,而在未来机架里是否真能买到可运维的异构参考架构,以及ROCm与调度层是否把两种硅片当成一等公民。
下一观察点是交割完成后技术并入时间表,以及是否出现可对外售卖的联合参考架构,而非仅停留在实验室演示——收购新闻换来的是路线图席位;能不能进招标清单,要看功耗、软件栈与可采购SKU是否同时到位。