【导语:Anthropic团队仅用一个周末,就让Claude在全新的AMD MI355X机架上跑通,且人类工程师未改动一行代码,跨越了英伟达20年堆起的CUDA护城河,这一突破将为GPU软件栈带来变革。】
前段时间,AMD给Anthropic送来一台搭载MI355X的机架。团队本以为新平台配新软件栈需要新一轮适配,没想到让Claude接上机器,下达“把这台机器跑起来”的指令后,等周末结束,屏幕上就出现持续上涨的性能曲线,不仅跑起来了,性能还不断提升。
很快,这场周末实验便接上了真正的部署计划。Anthropic宣布将在AMD Helios系统中部署最高2GW的Instinct GPU,首批1GW计划于2027年上半年启动,双方还会用Claude优化AMD工作负载,加速ROCm软件开发。
AMD在Advancing AI 2026大会上发布的ROCm.AI,是给Claude、Codex和Cursor准备的一整套GPU工具箱。入口AMD Skills里装着经过验证的ROCm知识,Agent拿到这些知识后,能自己装环境、部署模型、读日志、查故障,再通过ROCm CLI调用真实机器。
AMD甚至改变了芯片说明书的写法,每一代AMD GPU都会公开指令集,并提供AI可读的ISA。Agent读懂手册后就能直接调性能,AMD把这部分工作交给Hyperloom,它能提升模型输出速度,还能沉淀测试经验。
CUDA经过20年发展,靠无数工程师积累起了庞大的生态,包括编译器、数学库等,更难复制的是工程师们积累的经验。后来者即便造出性能接近的芯片,也得从头构建软件生态。
而Agent能读平台文档、调用工具、定位问题、优化代码。人类培养顶级GPU工程师需要按年计算,多启动一个Agent只需开一个任务,能并行排查报错、定位瓶颈,还能将经验传承给下一批Agent,将追赶时间从按年压缩到按任务计算。
编辑观点:Claude调通AMD新GPU是突破性进展,ROCm.AI和Agent的应用为追赶CUDA生态提供了新路径,有望加速GPU软件栈发展,中国工程师的经验也将助力这一进程。