网易首页 > 网易号 > 正文 申请入驻

GPU荒还没结束,CPU可能要被抢起来了

0
分享至



2026 年 5 月 31 日,英伟达(Nvidia)宣布一颗拥有 88 个定制核心的 CPU 已经进入全面量产。它叫 Vera,采用 Arm 指令集和英伟达自研的 Olympus 核心,既会进入 Vera Rubin 超级计算平台,也会被单独装进 CPU 服务器。戴尔、惠普、联想、超微以及多家服务器厂商,已经开始制造搭载 Vera 的系统。

英伟达把 Vera 称作“第一颗为 AI 智能体打造的 CPU”。Vera 会与 Rubin GPU 组成一套平台,也会被装进独立 CPU 服务器。时隔多年,卖 GPU 的英伟达,又开始单独卖 CPU 算力了,这件事听起来似乎并不寻常。


图丨 Nvdia Vera(来源:Nvdia)

过去三年,AI 产业的硬件焦虑几乎都围绕 GPU 展开。训练需要更多 GPU,推理需要更多 GPU,模型参数和用户数量增长后,答案仍然是增加 GPU。CPU 在这套系统里负责启动任务、搬运数据和管理服务器,很少成为投资者关心的主角。

直到 AI Agent 改变了任务的形态。

普通聊天机器人接收一段文字,运行一次模型,再生成一段文字。Agent 还要把模型的判断变成操作:读取文件、搜索网页、查询数据库、调用应用程序接口(API)、执行代码,再把结果送回模型。一次任务可能经历十几轮“推理—操作—观察”,每一轮都要在 GPU 与 CPU 之间切换。

GPU 仍然负责最重的模型计算,而解析模型输出、判断工具类型、发起请求、运行程序、管理文件、收集结果和安排下一轮任务等工作,则通常由 CPU 处理。AMD 计算与企业 AI 副总裁 Madhu Rangarajan 称,在公司测试的一条真实智能体流水线中,8 个阶段有 7 个完全运行在 CPU 上。这个比例来自 AMD 自测,不一定代表所有系统,但也足以说明:模型推理只是智能体完成任务的一环,而在这一环之外的所有协调工作都压在 CPU 上。

单个 Agent 带来的开销可能还不算大,但在规模化以后这个数字就会相当恐怖。

一个智能体可以同时调用多个工具,也可以创建子智能体。企业把同一套系统部署给数万名员工后,并发任务可能迅速膨胀。每个智能体都在解析输出、执行代码和读写数据,原本零散的 CPU 开销开始积累成容量需求。CPU 处理得慢,GPU 就要等待下一轮推理所需的输入。

安全检查也在增加这部分负担。智能体拥有的权限越多,系统越需要检查它打开了什么文件、调用了哪个接口、是否触碰敏感数据。规则匹配、日志分析和小模型审核通常留在 CPU 上运行,因为任务分散、延迟敏感,单独调用 GPU 未必划算。于是,智能体越自主,需要检查的环节就越多,CPU 的负担就越重。

今年 7 月 OpenAI 的智能体在一次内部安全评估中意外突破沙箱、闯入 Hugging Face 生产系统的事件,足以说明这类安全机制的重要性,也说明了它们在实际部署中会带来多少额外的计算开销。

另一个容易被忽视的负担是分词。

大模型处理文本前,要先把文字转换成 Token。这个过程包含大量字符串处理和条件分支,不像矩阵运算那样适合 GPU。普通对话的输入很短,分词延迟通常没有存在感;智能体会不断积累工具返回结果、代码、日志和历史操作,输入可能增长到数万甚至数十万个 Token。

佐治亚理工学院博士生 Euijun Chung 在接受 IEEE Spectrum 采访时举例称,在一些实现中,已有 10 万个 Token 的上下文再加入 1,000 个 Token 的工具结果,分词器仍可能重新处理整段输入。前缀缓存和增量分词可以减少重复工作,所以这并非所有系统必然采用的方式;长文本带来的 CPU 压力仍然存在。

Chung 团队在最新论文中测试了 Llama 3.1 和 Qwen3 等模型。在长序列、大批量配置下,分词最高占到首个 Token 延迟的约 80%。当 CPU 核心数不足,分词线程还会与任务调度和 GPU 内核启动争抢资源,导致 CPU 满载、而 GPU 未能跑满。增加 CPU 核心后,不同配置的首个 Token 延迟改善了 1.47—5.15 倍,而无需增加 GPU。

产业数据已经开始回应这一变化。2026 年 1 月,KeyBanc 根据供应链调查判断,Intel 全年大部分服务器 CPU 产能已经售出,AMD 的服务器 CPU 供应也接近满载,两家公司因此拥有了提价空间。这是分析机构的渠道判断,并非厂商披露的订单数据。

Intel 随后的财务文件给出了部分印证。公司称,服务器 CPU 需求在 2026 年第一季度超过可供应数量,内部产能限制预计持续至年底。服务器产品平均售价同比提高 27%,出货量却下降了 5%;Intel 将价格上涨归因于高端产品占比提升、需求定价和成本增加。

AMD 同期的数据中心业务收入达到 58 亿美元,同比增长 57%,增长同时来自 EPYC 服务器 CPU 和 Instinct GPU。AMD 没有单独披露服务器 CPU 收入增速,因此无法把这 57% 全部归因于智能体需求。

公司对未来的判断更加激进。AMD 此前预计服务器 CPU 市场年增长约 18%;2026 年 5 月又将预期提高到 35% 以上,预计市场规模到 2030 年超过 1,200 亿美元。AMD 给出的理由是,智能体需要独立的 CPU 计算层来承担编排、数据处理、工具执行和安全检查。

数据中心过去常用一颗 CPU 管理 4—8 颗 GPU。AMD 观察到,智能体系统正把这一比例推向 1∶1,部分负载使用的 CPU 甚至更多。这仍是供应商根据客户需求作出的判断,工作负载不同,实际配置会有很大差异。比例变化的方向却很清楚:多配几颗 CPU 已经不够,云厂商开始考虑为智能体单独建设 CPU 机架。

Arm 也在 2026 年 3 月第一次从出售处理器设计方案走向直接出售数据中心 CPU。其 AGI 处理器最多拥有 136 个核心,由 Meta 参与开发。Arm 预计,同等功耗下,智能体数据中心需要的 CPU 容量可能达到现有数据中心的 4 倍以上。

高通随后发布拥有超过 250 个核心的 Dragonfly C1000,并与 Meta 签署多代服务器 CPU 合作协议。Intel、AMD、Arm、高通和 英伟达在几个月内把“智能体 CPU”写进各自的产品路线,说明这轮竞争已经越过传统的 x86 市场,扩展到 Arm 服务器、自研核心和整机架设计。

英伟达在其中占据了一个特殊位置。它既销售造成 CPU 压力的 GPU,也销售缓解压力的 Vera;从处理器、网络到存储,整套设备都可以由 英伟达提供。Vera 因而不只是一次产品线扩张,它还要保护 GPU 的利用率。GPU 每减少一秒等待,都可能转化成更多 Token 和更高的机架收入。

不过,芯片厂商跟着钱走的时候,总有人要承担代价。和 GPU、存储芯片一样,这次产能的变化很可能又是由我们消费者来买单。

Intel 在 2025 年第四季度财报电话会上承认,公司正在尽量把内部晶圆供应转向数据中心,同时增加客户端产品的外部代工;管理层随后补充说,Intel 也不能完全退出客户端市场。到了 2026 年第一季度,Intel 客户端 CPU 的平均售价同比上涨 16%,销量下降 13%,公司预计供应限制至少持续至上半年。

客户端产品的变化不能全部算在智能体头上。Intel 自身的制程切换、内外部产能和内存供应同样影响了价格与出货。但在有限产能中,服务器芯片核心更多、售价更高,云厂商又愿意签订长期订单,生产资源自然也就开始向数据中心倾斜。

过去三年,普通消费者已经见识了 GPU 涨价和断货的滋味。接下来,同样的事可能发生在 CPU 上。

参考资料:

1.https://spectrum.ieee.org/ai-cpu-comeback

2.https://www.amd.com/en/blogs/2026/agentic-ai-changes-the-cpu-gpu-equation.html

3.https://arxiv.org/html/2603.22774v2

运营/排版:何晨龙

注:封面/首图由 AI 辅助生成

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
世界杯大冷门!西班牙女篮三分22中4崩盘输马里 最多落后16分

世界杯大冷门!西班牙女篮三分22中4崩盘输马里 最多落后16分

醉卧浮生
2026-09-05 20:24:45
江苏警方捕捞浙江企业?灵活用工平台行业面临生死局

江苏警方捕捞浙江企业?灵活用工平台行业面临生死局

法治边角料
2026-09-05 10:29:45
与前妻离婚7年,和儿子甚少联系,60岁的他如今忙着跟富婆谈恋爱

与前妻离婚7年,和儿子甚少联系,60岁的他如今忙着跟富婆谈恋爱

圆梦的小老头
2026-08-12 23:59:35
有件事,憋很久了。今天必须说!我发现郭德纲有一个很严重的问题

有件事,憋很久了。今天必须说!我发现郭德纲有一个很严重的问题

再战五百回合
2026-09-05 13:18:17
60后无锡前首富,在川300亿基地即将投产……

60后无锡前首富,在川300亿基地即将投产……

次元君情感
2026-09-05 08:46:20
阿森纳夏窗引援:20人候选名单仅签1人,操作成败几何

阿森纳夏窗引援:20人候选名单仅签1人,操作成败几何

篮坛第一线
2026-09-06 03:15:39
恩爱14年难抵现实,姐弟恋的“残酷”,在46岁的高圆圆身上展现

恩爱14年难抵现实,姐弟恋的“残酷”,在46岁的高圆圆身上展现

记录天下风云
2026-09-04 18:32:18
徐正源:姆本扎的回归对我们帮助非常大,球队准备得非常好

徐正源:姆本扎的回归对我们帮助非常大,球队准备得非常好

懂球帝
2026-09-06 00:12:18
心理学的赚钱铁律:一个人能不能发家,从不看学历,不看出身,更不看运气,核心在于悟透这两步财富逻辑

心理学的赚钱铁律:一个人能不能发家,从不看学历,不看出身,更不看运气,核心在于悟透这两步财富逻辑

心理观察局
2026-08-30 07:03:18
中国羽毛球大师赛:国羽闯入3项决赛

中国羽毛球大师赛:国羽闯入3项决赛

新华社
2026-09-06 00:12:16
曝孙宇晨是假富豪!群友称他自由支配仅3亿美金,想靠景甜翻身

曝孙宇晨是假富豪!群友称他自由支配仅3亿美金,想靠景甜翻身

情感的我
2026-08-30 20:56:47
坚持不向中国市场低头,三菱退出中国市场2年后,如今后悔了吗?

坚持不向中国市场低头,三菱退出中国市场2年后,如今后悔了吗?

铭记历史呀
2026-09-06 00:53:40
66岁刘雪华独居上海别墅,每天清晨六点,都会准时给远在加拿大的姐姐通话报平安

66岁刘雪华独居上海别墅,每天清晨六点,都会准时给远在加拿大的姐姐通话报平安

音乐时光的娱乐
2026-08-26 02:44:53
手机集体涨价,吓跑了买手机的人

手机集体涨价,吓跑了买手机的人

财天COVER
2026-09-03 18:53:29
中建集团党组:坚决拥护党中央决定

中建集团党组:坚决拥护党中央决定

环球网资讯
2026-09-05 13:05:14
知名演员(白某,36岁)宣布破产:不敢买咖啡,甚至想接雨水洗澡

知名演员(白某,36岁)宣布破产:不敢买咖啡,甚至想接雨水洗澡

黎兜兜
2026-09-04 23:09:27
豪门悲喜夜:皇马0-1首败,巴黎圣日耳曼1-2首败,利物浦2-0首胜

豪门悲喜夜:皇马0-1首败,巴黎圣日耳曼1-2首败,利物浦2-0首胜

侧身凌空斩
2026-09-05 05:25:02
我陪嫁380万,母亲只让我说3万8万,婚礼第二天,公公笑眯眯让我把嫁妆交出来,我只说了句话,他却急跺脚

我陪嫁380万,母亲只让我说3万8万,婚礼第二天,公公笑眯眯让我把嫁妆交出来,我只说了句话,他却急跺脚

晓艾故事汇
2026-09-01 09:39:12
长辈哪句话让你愣了很久?

长辈哪句话让你愣了很久?

康富贵碎碎念
2026-09-05 15:34:52
【逝者】何勇:一个摇滚歌手和他的钟鼓楼

【逝者】何勇:一个摇滚歌手和他的钟鼓楼

界面新闻
2026-09-04 17:38:09
2026-09-06 04:16:49
DeepTech深科技 incentive-icons
DeepTech深科技
麻省理工科技评论独家合作
17195文章数 515201关注度
往期回顾 全部

数码要闻

IFA2026现场直击:绿联双馆齐发,AI全家桶抢占C位

头条要闻

江西遂川泥石流1死11失联 男子:母亲电话一直打不通

头条要闻

江西遂川泥石流1死11失联 男子:母亲电话一直打不通

体育要闻

本西蒙斯加盟国王,不管怎样,回来就好

娱乐要闻

阿Sa蔡卓妍首度求婚细节,感动落泪

财经要闻

被曝试药后死亡,药企董事竟怒怼记者

科技要闻

华为何庭波,再次更新韬定律论文

汽车要闻

千里浩瀚H5/30英寸大屏 星越L PLUS让你看到油车越级的一面

态度原创

教育
艺术
数码
家居
公开课

教育要闻

雅思口语考试的刻板印象和邪修捷径

艺术要闻

14岁种下画家梦,51岁才拿起笔。她笔下的加拿大乡村,治愈了无数疲惫的灵魂!

数码要闻

1.28kg塞进12核Zen 5!积核X16 Pro AMD版亮相:32GB LPDDR5X

家居要闻

2026建博会(广州) 公装联探展交流活动

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版