一枚"辣椒",让全球芯片之王有点尴尬。
8月25日,OpenAI在Hot Chips大会上公布了首款自研推理芯片Jalapeño的首批评测数据。这枚名字意为"墨西哥辣椒"的芯片由OpenAI与博通联合开发,标称功耗仅700瓦——英伟达GB300是1400瓦,刚好两倍。
![]()
结果更扎心:在三个模型上,Jalapeño每瓦完成的AI工作量是GB300的1.5到1.9倍,端到端延迟降到对方的28%至59%。最夸张的一项:在DeepSeek R1 670B上,Jalapeño每千瓦吞吐量是对方的104.3倍。
英伟达跑到喘气的地方,这颗辣椒还在悠闲巡航。
9个月,从0到行业前沿
Jalapeño只做一件事:推理。在AI商业化世界里,推理才是烧钱大头——用户每次提问、每个Agent任务执行,消耗的都是推理算力。
芯片配备6组HBM4内存共216GB,采用台积电3纳米工艺,测试中持续功耗没超过550瓦。SemiAnalysis现场评估后直接说:这是他们测过的所有英伟达、AMD和谷歌芯片中最好的。
更惊人的是速度。从团队组建到流片只花了9个月,OpenAI还用自家AI模型辅助电路设计——部分代码由AI生成,比人类工程师手写快了1.8倍。一家做软件的公司,用AI造芯片,第一代就摸到了前沿。
数字很尴尬,事实没那么尴尬
OpenAI给自己留了退路。对比对象是GB200和GB300,不是英伟达最新的Vera Rubin,后者已开始交付,真正的对决还没发生。评测数据也主要由OpenAI提供,SemiAnalysis只验证了部分流程。
更讽刺的是:OpenAI今年刚拿英伟达1050亿美元融资承诺,一边用对方的钱,一边造对方的替代品。理查德·何承认"我们仍然非常需要英伟达"。
但市场读懂了信号——Anthropic在造自己的芯片,谷歌在谈定制推理芯片,每个大客户都在减少对英伟达的依赖。
真正的战场
Jalapeño触碰的不只是性能上限,而是更深的东西:CUDA生态。英伟达最坚固的护城河不是硬件参数,而是全球数百万开发者的软件栈。OpenAI的解法是用AI写芯片代码绕过这个问题——如果AI能持续替代人类完成内核优化,CUDA的护城河就可能被稀释。
Jalapeño今年底小规模部署,2027年放量。第二代在开发,第三代在构想。
一颗辣椒烧不毁一座帝国,但烟雾已经飘过来了。
来源:The Next Web
来源:Reuters
来源:TradingKey
来源:SemiAnalysis
免责声明:本文内容基于公开新闻报道和资料整理,仅供参考,不构成任何投资或决策建议。文中观点仅代表作者个人,不代表任何机构立场。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.