超威半导体(中国):母公司AMD买下24人推理芯片团队Taalas,把AI模型“焊死”进硅片——距英伟达200亿美元买Groq仅7个月 美东时间8月6日,AMD(超威半导体)宣布达成最终协议,全资收购加拿大AI推理芯片初创公司Taalas。官方未披露金额;交易宣布日距英伟达斥资约200亿美元拿下Groq核心技术资产过去7个多月。两家GPU巨头不约而同把战火烧向毫秒级推理:智能助手、自动驾驶、人形机器人正在把“首次输出延迟”变成新的采购标准。 先看关键数字 交易主体 AMD(美)收购Taalas(加) 官方未披露金额,有媒体称约6亿美元,未经证实 标的规模 24人 / 累计融资2.19亿美元 2023年成立于多伦多,2026年2月完成1.69亿美元融资 技术路线 “模型即计算机”MSIC 模型权重蚀刻进芯片掩模ROM,省去HBM 对手动作 英伟达约200亿美元获Groq技术授权 2025年12月官宣,Groq 3 LPU计划2026年Q3出货 AMD底色 Q2营收115亿美元,数据中心67亿美元 数据中心收入同比+107%,占总营收近六成 中国主体 超威半导体(中国)为在华投资总部 注册资本3000万美元,100%美资,参保15人 这笔交易是什么:把“模型固化”做成生意 Taalas 2023年成立于多伦多,团队仅约24人,创始人柳比沙·巴伊奇(Ljubisa Bajic)曾在AMD和英伟达担任高级架构师,是AI芯片公司Tenstorrent的联合创始人;CTO德拉戈·伊格纳托维奇同样出身AMD。用媒体的话说,这是一支“从AMD走出去、又被AMD请回来”的团队,技术语言和工程文化的磨合成本几乎为零。 什么值得买 Taalas的技术路线是“模型即计算机”:把AI模型的结构、参数与权重直接固化到芯片物理层,权重写入掩模ROM,KV缓存与微调适配器放在片上SRAM,从而省掉通用GPU必备的高带宽内存(HBM)、先进封装和液冷系统。代价是灵活性——芯片一旦流片便与特定模型绑定,模型大改需重新流片;公司称只需改两层金属层,从拿到新模型到硬件落地约两个月。 网易财经转载 AMD官方口径是“补强AI推理路线图”:Taalas技术将并入AMD人工智能事业部,与Instinct GPU、EPYC CPU、ROCm软件及Helios机架级系统协同,计划做“分离式架构”——计算密集的提示词处理交给GPU,token生成环节卸载到Taalas加速器。AMD AI事业部高级副总裁Vamsi Boppana称,这将为AMD AI产品组合带来“差异化的推理性能和效率”。 财联社 一张图看AMD的AI收购清单(2024–2026) 2024年 6.65亿美元收购Silo AI (AI模型开发); 49亿美元收购ZT Systems (AI服务器,2025年3月完成,制造业务随后以30亿美元售予Sanmina,轻资产转向Helios整机柜) 2025年11月 收购高速推理软件公司 MK1 (财联社口径) 2026年6月 收购内存优化初创公司 Mext 2026年7月 FastFlowLM纳入AI事业部;与 Cerebras 建立合作 2026年8月 收购Taalas ——本轮第4次在推理侧出手,首次补齐硬件级专用推理芯片 来源: 什么值得买 、 财联社 。Helios机架级系统已向Meta、微软交付,是AMD对标英伟达一体化机架的首款产品。 技术路线的正面交锋:AMD买“焊死”,英伟达买“分工” 维度 AMD + Taalas 英伟达 + Groq 官宣时间 2026年8月6日 2025年12月24日(约200亿美元,外媒口径,双方未披露) 核心技术 MSIC:权重蚀刻进硅片,省HBM LPU确定性数据流处理器,230MB片上SRAM、80TB/s带宽 性能口径 HC1(台积电6nm,815mm²)跑Llama 3.1 8B约16960 token/秒,厂商称约为B200的48倍 Groq 3 LPU首Token延迟<0.1秒,厂商称推理性能为H100的10倍 成本口径 Llama 3.1 8B每百万token约0.75美分;构建成本号称传统方案约1/20 “GPU高吞吐+LPU低延迟”混合,组合推理性能号称最高提升35倍 出货节奏 测试芯片已发布,量产时间未披露 Groq 3 LPU计划2026年三季度出货 共同约束 均为“专用化”路线:牺牲通用性换效率;模型迭代需重新设计/流片 性能与成本数据均为厂商公布口径,未经独立验证;分别见 芯东西 、 钛媒体 、 每日经济新闻 。 为什么是现在:推理市场进入“Token经济学”时间 黄仁勋在2026年GTC上把竞争定义为“Token工厂”效率:AI的核心工作从一次性训练转向持续生成Token,谁能把单位Token成本压到最低谁就是“Token国王”;英伟达给出的市场规模预测是2027年AI计算基础设施接近1万亿美元。 每日经济新闻 。AMD这边,苏姿丰7月表态:“芯片领域没有一种方案适合所有情况”,但GPU仍将占据主流——这句话正是Taalas收购的注脚:GPU保灵活,ASIC拼成本,两者并存。 对AMD而言这是有底气的进攻。8月5日发布的2026年Q2财报显示:总营收115亿美元(同比+50%)、数据中心收入67亿美元(同比+107%),但Q3指引130亿美元上下低于市场激进预期,股价盘后一度跌近9%——两天后宣布收购Taalas,市场需要的是一个“训练之外的第二增长故事”。 中关村在线 。而在此前的4月,AMD已因AI数据中心预期升温走出八连阳、累计涨近25%。 同花顺 风险同样摆在明面:模型一旦固化进芯片,客户就被“绑”在特定模型版本上,这与大模型动辄数月迭代的现实存在张力;AMD软件生态ROCm与CUDA的差距不会因一次收购消失;交易还需满足惯例成交条件和监管批准。外部变量是,英伟达的Groq 3 LPU已把出货时间定在2026年三季度,Feynman芯片还规划了LPU 3D堆叠路线——留给AMD把测试芯片变成量产产品的窗口并不宽裕。 芯东西 中国主体视角:交易在母公司,落点在生态 按工商档案,超威半导体(中国)有限公司成立于2004年2月,注册资本3000万美元,由美国超威半导体公司100%持股,法定代表人潘晓明,注册于北京海淀,参保人数15人,性质是AMD在华投资性总部。其下设超威半导体(上海)、超威半导体产品(中国),并参股苏州通富超威半导体(持股15%、注册资本超1.3亿美元)——后者是与通富微电合资的封测产能,构成AMD在华供应链的一环。 天眼查 本次收购的决策与出资均在美国母公司层面,中国主体短期不直接参与交易;但它提示了一个趋势:当推理成本成为大模型规模化盈利的关键变量,AMD的“GPU+ASIC”组合若落地,国内云厂商与模型厂商会多一个成本选项;而国产推理芯片(华为昇腾等)与英伟达LPU、AMD-Taalas事实上在同一个“降低每Token成本”的赛道上竞争。 下一步验证什么 交易对价与交割 :官方金额、预计完成时间——媒体“约6亿美元”口径与累计融资2.19亿美元量级是否吻合。 产品化节奏 :Taalas从测试芯片HC1到量产的时间表,以及首个适配的大模型版本。 对手先手 :英伟达Groq 3 LPU三季度出货后的实测与定价,是否重演“先发定义标准”。 AMD Q3财报 :数据中心增速、Helios放量与MI350订单能见度,验证推理故事能否撑起指引。 在华落地 :AMD推理方案进入中国市场的方式与出口管制环境变化。 来源 网易财经:AMD收购AI推理芯片初创公司Taalas,加码布局“后GPU时代” 财联社(东方财富转载):AMD宣布收购芯片初创公司Taalas,强化AI推理布局 芯东西(今日头条转载):AMD收购Taalas:推理芯片赛道再升温 什么值得买:6亿美元买一张AI推理船票,AMD把模型刻进芯片 中国网财经:200亿美元!英伟达拿下芯片初创公司Groq推理技术授权 每日经济新闻:AI驶入“推理时代”:英伟达欲加冕“Token国王” 钛媒体(新浪财经):一文看懂黄仁勋在GTC2026核心观点 中关村在线:AMD 2026年Q2营收创新高,数据中心成增长主引擎 同花顺:超威半导体八连阳涨近25%,AI数据中心预期升温 天眼查:超威半导体(中国)有限公司工商档案 注:Taalas性能与成本数据为厂商公布口径,未经独立验证;交易金额以AMD官方披露为准。