AMD MI455X发布:告别GCN架构,单机柜72卡挑战英伟达霸主地位

AMD正式发布Instinct MI455X加速卡,标志着其数据中心GPU从延续了15年的GCN架构彻底转向基于RDNA的CDNA5新架构。该芯片专为机架级AI部署设计,采用TSMC CoWoS-L封装,集成8个XCD内核,共计256个WGP(工作组处理器)。在计算性能方面,其最高主频达2.4GHz,在MXFP4精度下可达40.26 PFLOP,并配备432GB HBM4内存,提供23.3 TB/s的惊人带宽。架构层面,MI455X引入了全新的Wave32 SIMD32单元和广播仲裁器,通过多播加载机制优化显存带宽,显著提升了矩阵乘法效率。系统层面,AMD同步推出Helios机架级解决方案,支持单机柜72张GPU全互联,利用UALink over Ethernet实现单跳通信,并用Infinity Fabric取代传统PCIe连接主机CPU,旨在通过极致的集群互联能力挑战英伟达的市场地位。

事件分析

CDNA5架构的底层革新是此次发布的核心看点,AMD摒弃了老旧的GCN微架构,转而采用RDNA的双发射Wave32设计,这不仅提升了FP4/FP8等低精度计算的吞吐量,还通过广播仲裁器优化了显存带宽利用率,缓解了AI训练中的内存墙瓶颈。产业层面,AMD不再单纯拼单卡性能,而是强调“机架即系统”的Helios解决方案,通过72卡全互联和高带宽Infinity Fabric技术,直接对标英伟达GB200级别的机柜级产品。这种软硬一体化、计算与网络深度整合的路径,反映了未来AI算力竞争从“芯片制程”向“集群互联效率”的转移,UALink生态的成熟度将成为其能否打破英伟达垄断的关键。

💡 核心观点:AMD借CDNA5架构重塑与机架级互联技术,正式向英伟达的AI集群霸权发起全面冲锋。

原文链接:Hacker News

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›

抢沙发

评论前必须登录!

立即登录   注册