2026年7月31日,国家发改委新闻发布会上甩出一组数据:首个全国产10万卡AI超集群正式投用,全国智能算力规模达去年同期的2.8倍。大洋彼岸的硅谷还在拿着封锁清单挨个封杀单卡,中国已经把10万张国产芯片塞进同一个机房,织成了一个算力澎湃的超级大脑。这场面简直充满了戏剧性——你不是要卡我脖子吗?行,我换个打法。
十万张卡连在一起,到底有多难?
![]()
很多人以为,10万卡超集群就是把10万张显卡插在插座上。大错特错。
把100张卡连起来叫拼装,把1万张卡连起来叫工程,把10万张卡无缝连接并同时稳定运转,这叫物理界的玄学与奇迹。
第一关:通信墙。
让10个人合唱一首歌很容易,让10万个人在不同房间里合唱同一首歌,只要有一个人慢了半拍,整首歌就砸了。传统以太网中,万卡集群的丢包率只要达到0.1%,整个集群的计算效率就会暴跌50%以上。曙光8000(登峰)采用了自研的scaleFabric类IB原生RDMA高速网络,能绕过CPU直接在两张卡的内存之间传输数据,把通信延迟压缩到微秒级别——10万个“歌手”耳朵里听到的拍子,分毫不差。
第二关:存储墙。
大模型训练时,每隔几小时就要保存一次“断点照片”,防止系统崩溃后前功尽弃。如果存储写入太慢,10万张卡就得集体停工“挂起等待”。曙光8000配套的ParaStor分布式存储系统,直接拿下了2026全球IO500榜单生产型全节点和10节点性能双榜第一。每秒数TB的读写吞吐,GPU还没反应过来,数据就已经存好了。
第三关:散热墙。
10万张卡同时开动,总功耗惊人。如果用传统风冷,芯片瞬间就能把机房变成烤箱。“登峰”集群直接上了浸没式相变液冷技术,机柜里没有风扇的噪音,只有清澈的液体在缓缓流动——芯片直接泡在液体里,液体沸腾带走热量,PUE值(能源利用效率)降到了1.04以下,远低于业界主流的1.8。散热能耗骤降,真正做到了“既要算得快,又要省电费”。
![]()
这座“Token工厂”,能算出什么来?
这套系统不是摆设。它采用“超智融合”技术路线,既能跑千亿参数的AI大模型,也能支撑高精度的科学计算。目前已完成300余项超智融合应用优化,覆盖大模型、生物医药、新材料、量子计算、天文气象等二十多个领域。
新药研发——过去靶向药研发需要在海量分子组合中靠试错,消耗10年和10亿美元。现在利用十万卡集群,AI负责预测蛋白质结构,超算做原子级物理动力学模拟。原本需要计算几个月的复杂分子筛选,现在压缩到了一天。
气象防御——传统数值预报求解复杂方程,算出未来24小时台风路径往往要跑6小时。而接入超算互联网的十万卡集群,结合气象大模型,预测速度大幅提升。
真正的“新质生产力”
西部丰富的风电、光伏电,通过“东数西算”源源不断输送到这个集群中。绿电在这里被转化成蕴含智能的Token,输出给智能驾驶、AI医疗、工业机器人。
这也是为什么发改委敢宣布:国产大模型全球下载量突破100亿次,AI相关行业增速超30%。需求不是吹出来的,是实打实算出来的。
![]()
中美AI大对决:两条截然不同的路
美国走的是“单卡暴打”路线,靠英伟达极致性能和封闭的CUDA生态筑墙。中国走的是“工业集群”路线——既然单芯片制程短时间内追不上,那就通过全栈自研的网络、全球顶级的存储、极限的液冷散热和超级调度系统,把10万张卡粘合成一个威力无比的超级计算机。
发改委还预告了“十五五”算力网建设将新增直接投资4万亿元——国家队把基础设施底座修好了,接下来就是生态繁荣的大戏。
当年西方用各种禁运清单试图让中国数字经济“歇菜”;今天,全国产10万卡AI超集群的满载轰鸣,交出了一份硬核答卷。这不仅仅是技术的突破,更是一种工业文明的胜利——当单点突破被锁死时,中国工程人员总能用磅礴的系统重构能力,走出一条别人难以想象的通天大道。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.