AMD 收购 Taalas:把大模型直接「刻」进芯片
这家多伦多初创公司在权重冻结后定制芯片金属层,宣称推理系统可完全不用 HBM、先进封装、3D 堆叠与液冷。
8 月 6 日,AMD 宣布已达成协议收购多伦多芯片初创公司 Taalas。这家成立于 2023 年的公司不做通用算力芯片,而是围绕某一个固定模型来造芯片。交易金额未披露,需通过监管审批,预计四季度完成交割。
Taalas 造的是什么
Taalas 把自己的产品称为「Hardcore Models」。当一个模型的权重确定后,公司只需定制芯片中少数几层金属层就能把权重固化进硬件,让存储与计算在同一颗裸片上合一。其宣称的结果是:整套推理系统不需要高带宽内存、不需要先进封装、不需要 3D 堆叠、也不需要液冷——而这四项恰恰是当代推理机柜物料成本的大头。公司称,从拿到一个全新模型到做出硬件约需两个月。今年 2 月亮相的首款产品固化的是 Meta 的 Llama 3.1 8B。
AMD 人工智能事业群高级副总裁 Vamsi Boppana 表示,此次收购是在补全全栈 AI 平台,Taalas 技术将与 Instinct GPU 一同进入加速器路线图。Taalas 联合创始人兼 CEO Ljubisa Bajic(此前是 Tenstorrent 的创始人之一)称,并入 AMD 带来了规模与工程资源。
为什么重要
行业算力开支的重心正从训练转向推理,而推理是一种形态完全不同的负载:同一套权重被调用数十亿次。把权重硬连线进芯片,等于用全部灵活性换效率——此前这笔交易一直显得太脆,因为前沿模型几个月就换一代。Taalas 的两个月周转期,赌的就是这笔交易如今算得过来了。对 AMD 而言,这是一条不必在通用 GPU 上正面赢过英伟达的对冲路径:一旦相当比例的生产级推理沉淀到少数几个稳定的开源权重模型上,固定功能芯片有望在服务成本上大幅压过 GPU。这同时也给开源权重生态添了一条硬件层面的理由——只有部署广、版本稳的模型才值得「刻进硅里」,而这正是任何人都能下载的那类模型的天然优势。