网易首页 > 网易号 > 正文 申请入驻

苏姿丰掌舵,AMD连宣7项重磅发布,涉及GPU、CPU

0
分享至

在年度AMD Advancing AI大会上,AMD董事会主席兼CEO苏姿丰博士连放大招,全球首颗2nm GPU芯片Instinct MI455X正式亮相,号称“最强智能体CPU”的第六代EPYC“Venice”同期登场,还有一套完整的机架级AI基础设施Helios以及专为机器人设计的Ryzen芯片。



AMD一口气发布了七项覆盖GPU、CPU、机架、软件、本地AI与物理AI的全线新品,苏姿丰还宣布,AI加速器市场的规模预期从去年预测的2028年5000亿美元大幅上调至2030年1.4万亿美元,AMD认为自己在所参与细分市场的机会到2030年可达到约2万亿美元。

1.MI455X GPU:全球首颗2nm AI芯片,40PFLOPS算力登顶

AMD Instinct MI455X是迄今为止最先进的AI加速器,也是全球首款采用2nm制程的GPU。它基于新一代CDNA 5架构,拥有3200亿颗晶体管,配备最高432GB HBM4显存,支持FP4、FP6、FP8等多种AI数据格式。



制程与封装方面,MI455X采用Chiplet设计,计算Chiplet使用台积电N2工艺,Fabric与缓存裸片(FCD)和I/O Die则选用N3P工艺,通过台积电CoWoS-L 2.5D封装与3D混合键合技术组合实现异构集成。

性能参数方面,MI455X的MXFP8峰值算力达20PFLOPS,MXFP4峰值算力高达40PFLOPS,均为上一代MI355X的4倍。理论显存带宽最高23.3TB/s,达到上一代的2.9倍。在跑DeepSeek-V4 Flash模型时,MI455X的Token吞吐量最高可达MI355X的34倍,每百万Token成本降至原来的1/18。

架构创新方面,MI455X改用WGP作为核心计算组织单位,每个Shader Engine配置16个启用WGP;取消了Wave64支持,以Wave32为主要执行模式;新增MXFP8、MXFP6、MXFP4量化支持,还新增tanh指令,将超越函数吞吐提高1倍。缓存层级也做了重新设计——取消独立的Infinity Cache,将容量和带宽集中到两个96MB的全局L2缓存,合计带宽达到MI355X整体Infinity Cache聚合带宽的3倍。

2.Helios机架级AI平台:18000个GPU核心,每美元多产30%Token

Helios是AMD首个完全集成的机架级AI解决方案,基于开放标准设计,包含72张MI455X GPU和18张Venice CPU,通过Pensando网络技术实现互联。

核心规格方面,整套机架提供18000个CDNA 5 GPU计算单元、4600个Zen 6 CPU核心,31TB HBM4统一内存,1.7PB/s显存带宽,峰值FP4算力达2.9EFLOPS,FP8算力达1.4EFLOPS。横向扩展带宽43TB/s,纵向扩展带宽260TB/s。



网络层面,Helios采用三层网络架构:前端网络由第三代Pensando Salina DPU(400G)负责;纵向扩展网络基于第一代UALoE以太网架构,将72张GPU连成统一资源池;横向扩展网络由第二代Pensando Vulcano AI NIC(800G)支撑,每GPU最多可配3张AI NIC,总带宽最高2.4Tbps。

性能对比方面,相比英伟达Vera Rubin NVL72方案,Helios的AI算力高出15%,HBM容量高出50%,横向扩展带宽高出50%。在跑Kimi K2 Thinking模型时,Helios吞吐量比Vera Rubin方案高出10%~15%,每美元可多生产最多30%的Token。

Helios现已进入生产阶段,OpenAI、Meta、Anthropic、微软、Oracle均选用Helios参考设计,三家顶尖大模型公司已承诺以吉瓦级规模部署。

3.Venice CPU:2nm服务器CPU实测,性能是英伟达Vera的2.2倍

第六代AMD EPYC 9006系列“Venice”是全球首款2nm服务器CPU,也是AMD迄今为止性能最强的服务器处理器。

型号布局方面,Venice系列共四款产品:面向最高性能的Venice SP7(最高256核/512线程,1.6TB/s带宽,64Gbps PCIe 6.0);平衡性能与成本的Venice SP8(8~128核,8个内存通道);面向AI预处理和HPC的Venice-X(最多96核,16个内存通道,1152MB L3缓存);以及提高机架效率的Verano(最多72核,LPDDR5x内存)。Venice SP7已进入量产阶段,预计2026年Q4出货。

性能对比方面,AMD与英伟达Vera CPU直接对标,Venice的吞吐性能达到Vera的2.2倍,开箱状态下每核心性能领先20%。相比英特尔和Arm平台,Venice的吞吐量达到2倍,每核心性能达到1.3倍。一个使用五年的老旧数据中心(约1000颗英特尔至强处理器),只需82张Venice即可替代,替换比例12:1,可减少77%功耗、92%服务器数量、40%五年TCO。

4.MI350P:风冷PCIe GPU,每美元Token数是英伟达的4.2倍

面向企业级服务器,AMD推出了一款风冷PCIe GPU——Instinct MI350P。它配备144GB HBM3e,显存带宽4TB/s,支持PCIe 5.0×16,最高TBP 600W。

在性能表现上,MI350P的每美元每秒Token生成数量是英伟达RTX Pro 4000的4.2倍。AMD重点测试了自主威胁检测和个人智能体两个场景,通过Token路由将部分请求发送给云端前沿模型,另一部分路由到运行在EPYC和MI350P上的开放权重模型,最终Token成本降低约43%,本地运行工作负载的响应速度最高提高约3倍。



5.ROCm.ai软件栈:AI驱动的全栈优化,3个月性能提升5.3倍

AMD发布了AI驱动的ROCm.ai软件栈,包括Skills层(编程智能体)、HyperLoom层(端到端AI工作负载优化)、框架集成层(PyTorch、vLLM、SGLang、JAX)以及核心SDK。

其中HyperLoom是一套智能体工作流,可自动对模型进行性能剖析、定位瓶颈、发现可融合的内核并自动执行优化。演示显示,仅通过一次点击,HyperLoom即将MiniMax M3的推理性能提升了38.3%。

ROCm现已支持Hugging Face上超过300万个模型,能在新开源模型发布首日提供支持。以DeepSeek-V4 Pro为例,从4月获得Day-0支持到7月,AMD仅通过软件优化就在相同硬件上取得了5.3倍的性能提升。

6.Gorgon Halo与Ryzen AI:本地可跑3000亿参数大模型

AMD早在Computex上就已预告新一代Ryzen AI Max PRO 400系列(代号Gorgon Halo),它将统一内存支持从128GB提高到192GB,本地可运行约3000亿参数的大模型,相比上一代2000亿参数上限再次提升。

AMD已形成涵盖笔记本电脑、工作站、小型台式机和开发者平台的广泛个人AI系统生态,并与Hugging Face深化合作,每台Ryzen AI Halo附赠一年Hugging Face Pro订阅。

7.Kria AI机器人平台:从“大脑”到“关节”的全套方案

面向物理AI和机器人领域,AMD发布了一系列产品,能够从“身”到“脑”承包自主机器人开发:

- Ryzen AI Embedded X100系列:16核Zen 5 CPU + RDNA 3.5 iGPU + XDNA 2 NPU,充当机器人的“大脑”,负责高级感知和推理。

- Kria AI系统模块与开发者平台:预集成高速接口和基础计算模块,可插入客户定制载板,计划2026年Q4出货。

- Kria AI平台性能:与英伟达Jetson AGX Thor对比,实现3.4倍实时控制性能、2.3倍并发智能体数量、1.6倍CPU容量。

AMD同时公布了机器人“朋友圈”,涵盖模型、中间件、传感器、物理仿真等合作伙伴,构建起从训练到部署的完整生态。

综合来看,AMD此次发布实现了GPU、CPU、网络、软件、本地AI与物理AI的全线布局。苏姿丰将AI加速器市场规模预期大幅上调至1.4万亿美元,背后正是这套完整的产品组合在支撑其“到2030年可在所参与细分市场达到约2万亿美元机会”的判断。

评论:七项连发远不止一次产品更新,而是一次从“组件供应商”到“系统方案商”的战略升维

AMD在年度Advancing AI大会上的七项连发,远不止一次产品更新,而是一次从“组件供应商”到“系统方案商”的战略升维。在AI算力需求膨胀、推理成本敏感、部署场景多元化的产业节点上,AMD正用一套覆盖云端到边缘的完整产品矩阵,重新划定AI基础设施产业的竞争边界。

对数据中心产业而言,Helios机架级方案与Venice CPU构成了一个“开放标准版”的AI算力底座。它直接对标英伟达Vera Rubin NVL72,以每美元多产30%Token的性价比优势,为云服务商和AI大模型公司提供了除封闭生态之外的真实选择。OpenAI、Meta、Anthropic、微软、Oracle同步站台,说明头部玩家已不再将AMD视为“替代品”,而是一个不可或缺的供应链战略支点。

对芯片制造产业而言,MI455X采用台积电2nm与3nm异构集成、CoWoS-L 2.5D封装加3D混合键合的组合方案,将先进封装和Chiplet设计的工程复杂度推到了新高度。这验证了在后摩尔时代,算力突破不再仅依赖制程微缩,而是封装、互连、内存协同设计的系统级工程。AMD的设计选择,正影响着台积电、日月光等封装供应链的能力投资方向。

对企业AI部署产业而言,MI350P风冷PCIe GPU和Gorgon Halo本地AI平台揭示了一个清晰信号:AI推理正从云端集中式走向“云端+本地”的混合架构。以MI350P为核心的混合部署方案可将Token成本降低43%,本地响应速度提升3倍。这意味着金融、医疗、制造等对数据主权和延迟敏感的传统行业,终于有了规模化落地的可执行路径。Kria机器人平台则将这套逻辑延伸至工厂和物流场景,用3.4倍实时控制性能切入工业AI的边缘节点。

对软件生态产业而言,ROCm.ai发布与DeepSeek-V4 Pro三个月5.3倍的纯软件性能提升,证明AMD正以“开源+AI辅助优化”两条腿加速缩小与CUDA的差距。HyperLoom智能体自动优化工作流使性能调优从“工程师月级工作”变成“点击即完成”,大幅降低了开发者的迁移门槛。

对半导体竞争格局而言,AMD将AI加速器市场规模预期从2028年5000亿美元上调至2030年1.4万亿美元,这不是一个随意的数字调整,而是对整个产业增长曲线的一次重新定价。配合“Venice实测性能2.2倍于英伟达Vera”的公开对标,AMD已明确宣示:AI芯片市场不再是谁的“单行道”,而是多技术路线并行、多供应商共存的新常态。

在AI从“训练军备竞赛”走向“推理普及时代”的关键转折点上,AMD用这套覆盖GPU、CPU、网络、软件、边缘、机器人的完整方案,给出了一个产业级答案:未来的AI基础设施不是一颗芯片的独角戏,而是一整套可组合、可优化、可落地的系统协奏曲。

声明:个人原创,仅供参考

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
刘翔08年曾退赛!媒体人:当年只有他顶雷,说他愚弄观众又蠢又坏

刘翔08年曾退赛!媒体人:当年只有他顶雷,说他愚弄观众又蠢又坏

奥拜尔
2026-09-10 14:15:03
涉案资金高达1.2亿元!西安警方破获特大制售假冒高端白酒案

涉案资金高达1.2亿元!西安警方破获特大制售假冒高端白酒案

环球网资讯
2026-09-10 21:44:14
皇马险胜国米后,穆帅认为阿诺德不能长期踢中场,与前利物浦主帅克洛普5年前观点相同!

皇马险胜国米后,穆帅认为阿诺德不能长期踢中场,与前利物浦主帅克洛普5年前观点相同!

福酱的小时光
2026-09-10 10:07:37
美股三大指数集体收跌 存储板块下挫

美股三大指数集体收跌 存储板块下挫

每日经济新闻
2026-09-11 05:06:04
中国女篮挺进4强,创造历史最佳战绩!女篮世界杯半决赛赛程公布,央视全程直播,全民期待燃爆屏幕!

中国女篮挺进4强,创造历史最佳战绩!女篮世界杯半决赛赛程公布,央视全程直播,全民期待燃爆屏幕!

安若浅溪b
2026-09-10 23:16:26
万科商业,岌岌可危了

万科商业,岌岌可危了

地产一品塘
2026-09-10 01:06:39
iPhone 18 Pro Max现场真机上手:槽点不吐不快

iPhone 18 Pro Max现场真机上手:槽点不吐不快

搞机小帝
2026-09-11 01:11:03
5年倒闭15000家!曾经的街边小吃之王,为什么没人吃了?

5年倒闭15000家!曾经的街边小吃之王,为什么没人吃了?

房产衫哥
2026-09-08 18:21:11
胖东来,一个开超市的跑去建楼,耗资65亿,把整个建筑行业的脸都打肿了:按时给钱、真材实料、给工人装空调!

胖东来,一个开超市的跑去建楼,耗资65亿,把整个建筑行业的脸都打肿了:按时给钱、真材实料、给工人装空调!

谭谈社会
2026-09-09 23:50:25
让春晚导演向全国道歉,入美国籍却回中国捞金,她到底什么来头?

让春晚导演向全国道歉,入美国籍却回中国捞金,她到底什么来头?

观察鉴史
2024-09-15 17:25:45
必须还上海体育局一个清白

必须还上海体育局一个清白

大嘴説
2026-09-10 15:20:06
韩旭距离创历史仅差1篮板 场均18.8分赛事第一

韩旭距离创历史仅差1篮板 场均18.8分赛事第一

体坛周报
2026-09-10 22:43:09
建议中老年人:若不差钱,少吃猪肉多吃这8样,高蛋白低脂又美味

建议中老年人:若不差钱,少吃猪肉多吃这8样,高蛋白低脂又美味

美食店主
2026-09-09 00:27:04
真离谱!曝员工被禁止上厕所后裸奔抹屎,宁德时代辟谣并报警,公司群聊曝光,真相浮出水面!

真离谱!曝员工被禁止上厕所后裸奔抹屎,宁德时代辟谣并报警,公司群聊曝光,真相浮出水面!

谭谈社会
2026-09-09 23:27:16
国际油价10日大幅上涨

国际油价10日大幅上涨

新华社
2026-09-11 03:30:02
核酸造假曝光,半年敛财4.5亿,核酸大王张核子,如今结局是怎样

核酸造假曝光,半年敛财4.5亿,核酸大王张核子,如今结局是怎样

鲸探所长
2026-09-10 11:51:26
雅万高铁一夜变天,印尼更换股东,欠中国的钱80年后再还?

雅万高铁一夜变天,印尼更换股东,欠中国的钱80年后再还?

凡知
2026-09-10 13:33:29
《深渊无间》连看四集,再看《交锋》,真是没有对比就没有伤害!

《深渊无间》连看四集,再看《交锋》,真是没有对比就没有伤害!

蹲坑看世界
2026-09-10 06:11:26
他曾是董建华头号劲敌,在政商界大杀四方,却一生都没能当选特首

他曾是董建华头号劲敌,在政商界大杀四方,却一生都没能当选特首

青梅侃史啊
2026-09-10 11:42:09
烟草系统拉响警报:再这样下去,中国烟草真要出大问题

烟草系统拉响警报:再这样下去,中国烟草真要出大问题

阿振观点
2026-08-25 05:56:32
2026-09-11 06:23:00
数据Wave incentive-icons
数据Wave
专注IT领域 洞察产业发展
1011文章数 767关注度
往期回顾 全部

数码要闻

官方商城悄然下架且迭代计划搁浅 Google或将再次退出平板电脑硬件市场

头条要闻

特朗普:如果伊朗拥核 我会对最高领袖说"能为您效劳吗"

头条要闻

特朗普:如果伊朗拥核 我会对最高领袖说"能为您效劳吗"

体育要闻

16岁的国产小库里,还有多少功课要做

娱乐要闻

参加晚宴,刘亦菲因合照深陷争议

财经要闻

向松祚:年轻人不必过早买房

科技要闻

一文看懂:iPhone折叠屏顶配2万6,10月才卖

汽车要闻

标配全线控底盘 全新一代智己LS6预售20.99万起

态度原创

教育
手机
家居
亲子
军事航空

教育要闻

重磅!市教委最新通知,暗藏教改大动作

手机要闻

一个壳近千元!苹果iPhone Duo双面夹保护壳定价999元

家居要闻

2026建博会(广州) 公装联探展交流活动

亲子要闻

宝蓝和家人一起去游乐场打水仗,过山车还有恐龙乐园玩的很开心~

军事要闻

中东“两线战火”同时升级

无障碍浏览 进入关怀版