网易首页 > 网易号 > 正文 申请入驻

GPU 相关常见术语

0
分享至

CPU像总经理,GPU像几万个熟练工人;CUDA 像管理这些工人的操作手册,HBM 像高速仓库,NVLink 像工厂之间的专用高铁。AI 模型越大、Token 调用越多,对 GPU、显存、互联、电力和散热的要求就越高。

你可以把 GPU 理解成:一座有成千上万个“小工人”的计算工厂,特别擅长同时处理大量重复计算,所以非常适合 AI、图形渲染、科学计算和大模型训练。

一、GPU 基础概念

  1. GPU 图形处理器
    原本用来处理图像,现在也非常适合 AI 计算,像一支“并行计算军队”。

  2. CPU 中央处理器
    电脑的“总指挥”,擅长复杂决策和调度,但不如 GPU 擅长大规模并行计算。

  3. 显卡 Graphics Card
    把 GPU、显存、供电、散热等装在一起的硬件卡,像 GPU 的整套工作平台。

  4. 集成显卡 iGPU
    集成在 CPU 或芯片里的 GPU,省电、便宜,但性能通常较弱。

  5. 独立显卡 dGPU
    单独的一块显卡,性能更强,常用于游戏、AI、设计和服务器。

  6. 数据中心 GPU
    专门用于 AI、云计算、高性能计算的 GPU,像工业级计算发动机。

  7. 消费级 GPU
    面向游戏玩家、设计师、个人用户的 GPU。

  8. 专业 GPU
    面向工作站、设计、仿真、影视渲染等专业场景的 GPU。

  9. AI GPU
    主要用于 AI 训练和推理的 GPU,强调矩阵计算、显存和互联能力。

  10. GPGPU 通用 GPU 计算
    不只用 GPU 画图,还用它做科学计算、AI、金融模拟等任务。

二、GPU 公司与生态
  1. 英伟达 NVIDIA
    全球重要 GPU 厂商,CUDA 生态让它在 AI 计算中占据强势地位。

  2. AMD
    重要 GPU 和 CPU 厂商,也提供 AI 加速卡和 ROCm 软件生态。

  3. Intel GPU
    Intel 的图形和加速芯片业务,包括集成显卡、独显和数据中心加速器。

  4. CUDA
    NVIDIA 的 GPU 编程平台,像一套让程序员指挥 GPU 干活的“语言和工具箱”。

  5. ROCm
    AMD 的 GPU 计算软件平台,可以理解为 AMD 版的 GPU 计算工具箱。

  6. oneAPI
    Intel 推动的跨硬件编程平台,希望让程序能跑在 CPU、GPU 等不同硬件上。

  7. CUDA 生态
    围绕 NVIDIA GPU 形成的软件、库、工具和开发者体系,像一座繁荣的应用城市。

  8. 驱动 Driver
    让操作系统和 GPU 正常沟通的软件,像翻译兼交通指挥。

  9. SDK 软件开发包
    提供开发工具、示例和接口,帮助开发者使用 GPU 能力。

  10. GPU 云服务
    通过云平台租用 GPU,不必自己买机器,像按小时租用计算工厂。

三、GPU 架构与核心部件
  1. GPU 架构 Architecture
    GPU 内部设计方式,决定它怎么计算、怎么存数据、怎么传数据。

  2. CUDA Core
    NVIDIA GPU 中大量小计算单元,像工厂里的基础工人。

  3. Stream Processor 流处理器
    AMD GPU 中类似 CUDA Core 的并行计算单元。

  4. Tensor Core 张量核心
    专门加速 AI 矩阵计算的单元,像为大模型计算定制的高速车间。

  5. RT Core 光线追踪核心
    用于游戏和图形中的真实光影计算,像专门模拟光线的部门。

  6. SM 流式多处理器
    NVIDIA GPU 的核心计算模块,里面包含很多 CUDA Core、Tensor Core 等。

  7. CU 计算单元
    AMD GPU 的基础计算模块,类似一个小型计算车间。

  8. Shader 着色器
    图形处理中负责计算颜色、光影、纹理的程序或单元。

  9. Pipeline 流水线
    GPU 按步骤处理任务,像工厂流水线一样分工协作。

  10. Warp 线程束
    NVIDIA GPU 中一组一起执行的线程,像一小队工人同时行动。

四、显存与存储
  1. 显存 VRAM
    GPU 自己使用的高速内存,像 GPU 身边的仓库。

  2. HBM 高带宽内存
    高端 AI GPU 常用显存,像超宽高速仓库通道。

  3. GDDR 显存
    消费级显卡常见显存,常用于游戏和图形渲染。

  4. HBM2E
    较早一代高带宽内存,曾用于多种 AI 和 HPC 芯片。

  5. HBM3
    更高带宽的 HBM,常用于高端 AI GPU。

  6. HBM3E
    HBM3 的增强版本,带宽和容量进一步提升。

  7. 显存容量
    GPU 能装下多少数据,像仓库有多大。

  8. 显存带宽
    GPU 读写显存的速度,像仓库门有多宽、货能搬多快。

  9. Cache 缓存
    GPU 内部更近更快的小仓库,用来放常用数据。

  10. 共享内存 Shared Memory
    GPU 内部线程共同使用的小型高速空间,像一个小组共享的工具台。

五、算力与性能指标
  1. 算力 Compute Power
    GPU 每秒能做多少计算,像工厂每小时能生产多少产品。

  2. FLOPS 浮点运算次数
    衡量计算能力的单位,表示每秒能做多少次小数运算。

  3. TFLOPS
    每秒万亿次浮点运算,常用来描述 GPU 算力。

  4. PFLOPS
    每秒千万亿次浮点运算,常用于大型 AI 集群和超算。

  5. TOPS
    每秒万亿次整数运算,常用于 AI 推理芯片指标。

  6. 峰值算力 Peak Performance
    理想条件下的最高算力,像汽车标称最高速度。

  7. 实际性能 Real-world Performance
    真实任务中的表现,可能低于峰值算力。

  8. 利用率 Utilization
    GPU 实际忙碌程度,利用率低说明很多计算资源闲着。

  9. 吞吐量 Throughput
    单位时间处理多少任务,像工厂实际出货量。

  10. 延迟 Latency
    一个任务从开始到完成需要多久,像外卖送达时间。

六、AI 训练与推理
  1. 训练 Training
    让模型从大量数据中学习规律,像学生刷题学习。

  2. 推理 Inference
    模型训练好后回答问题或生成内容,像学生参加考试。

  3. 大模型 LLM
    参数很多、能力很强的 AI 模型,比如聊天、写作、编程模型。

  4. 参数 Parameters
    模型内部的知识旋钮,数量越多,模型容量通常越大。

  5. Token
    AI 处理文本的小单位,可以理解为“字词碎片”。

  6. Batch 批次
    一次送进 GPU 处理的一组数据,像一车货一起进工厂。

  7. Batch Size 批大小
    一次处理多少样本,越大越吃显存。

  8. Epoch 训练轮次
    模型完整看一遍训练数据,像把整本教材学一遍。

  9. Gradient 梯度
    告诉模型参数该往哪个方向调整,像老师批改后指出改进方向。

  10. Backpropagation 反向传播
    训练模型时把错误往回传,帮助模型改正。

七、AI 计算精度
  1. FP32 单精度浮点
    精度较高但计算和存储成本较高,像用精细尺子测量。

  2. FP16 半精度浮点
    精度较低但速度更快、占用更少,AI 训练常用。

  3. BF16
    一种适合 AI 训练的低精度格式,在速度和稳定性间折中。

  4. FP8
    更低精度格式,可大幅提升 AI 计算效率,但对算法和硬件要求更高。

  5. INT8
    8 位整数计算,常用于 AI 推理,像用简化数字快速估算。

  6. INT4
    更低位宽的整数计算,更省资源,但可能损失精度。

  7. 混合精度 Mixed Precision
    不同计算环节用不同精度,像该精算的地方精算,该快算的地方快算。

  8. 量化 Quantization
    把高精度模型压成低精度,减少显存和计算量。

  9. 稀疏计算 Sparsity
    跳过大量无用或为零的计算,像只处理真正有货的箱子。

  10. 矩阵乘法 Matrix Multiplication
    AI 计算的核心操作之一,GPU 特别擅长,像成千上万次表格计算同时做。

八、GPU 互联与集群
  1. PCIe
    GPU 和 CPU、主板之间的连接通道,像电脑内部的高速公路。

  2. NVLink
    NVIDIA GPU 之间的高速互联,像 GPU 之间的专用高铁。

  3. NVSwitch
    让多颗 GPU 高速互联的交换芯片,像 GPU 集群里的交通枢纽。

  4. Infinity Fabric
    AMD 的高速互联技术,用于芯片内部或芯片之间通信。

  5. GPU 集群
    很多 GPU 连在一起协同工作,像一支 AI 计算军团。

  6. Scale Up 纵向扩展
    在一个节点或机柜里把 GPU 更紧密连接,像组建一台更强的大机器。

  7. Scale Out 横向扩展
    增加更多服务器和 GPU,像多建几座工厂一起干活。

  8. 分布式训练
    多颗 GPU、多台服务器一起训练模型,像多人合作完成一本巨著。

  9. AllReduce
    分布式训练中同步各 GPU 结果的操作,像每个小组算完后统一汇总。

  10. 通信瓶颈
    GPU 算得很快,但彼此传数据太慢,像工人干活快但物流堵车。

九、服务器、电力与散热
  1. GPU 服务器
    装有多颗 GPU 的服务器,专门用于 AI 和高性能计算。

  2. AI 服务器
    为训练和推理模型设计的服务器,通常配 GPU、HBM、高速网卡等。

  3. 机柜 Rack
    数据中心里放服务器的柜子,像计算设备的货架。

  4. 功耗 Power Consumption
    GPU 消耗多少电,高端 GPU 往往很耗电。

  5. TDP 热设计功耗
    散热系统需要应对的热量水平,像发动机最大散热需求。

  6. 风冷 Air Cooling
    用风扇带走热量,像给机器吹风降温。

  7. 液冷 Liquid Cooling
    用液体带走热量,散热能力更强,像给服务器接冷却水管。

  8. 散热器 Heat Sink
    帮 GPU 散热的金属结构,像芯片的散热鳍片。

  9. 温控 Thermal Management
    控制温度,防止 GPU 过热降频或损坏。

  10. 降频 Throttling
    GPU 太热或供电不足时自动降速,像人累了跑不动。

十、产品、应用与产业链
  1. GeForce
    NVIDIA 面向游戏和个人用户的显卡品牌。

  2. RTX
    NVIDIA 支持光线追踪和 AI 加速的显卡系列名称。

  3. A100
    NVIDIA 曾广泛用于 AI 训练和数据中心的 GPU 型号。

  4. H100
    NVIDIA Hopper 架构数据中心 GPU,常用于大模型训练和推理。

  5. B100 / B200
    NVIDIA Blackwell 系列 AI GPU,面向更高性能 AI 计算。

  6. MI300
    AMD 面向 AI 和高性能计算的重要加速器系列。

  7. CUDA Library CUDA 库
    NVIDIA 提供的数学、AI、图像等加速库,像现成工具箱。

  8. cuDNN
    NVIDIA 用于深度学习的加速库,帮助神经网络跑得更快。

  9. GPU 供给紧张
    市场上高端 GPU 不够用,AI 公司和云厂商抢购,像热门车排队提货。

  10. GPU 产业链
    包括芯片设计、晶圆制造、先进封装、HBM、PCB、服务器、散热、电源、光模块和云服务。

欢迎加入行业交流群,备注岗位+公司,请联系老虎说芯(加V:tigerchip)

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
彻底失控!俄乌终极碰撞,生死对决上演!

彻底失控!俄乌终极碰撞,生死对决上演!

大嘴说天下
2026-10-04 21:30:04
1米84的他演龙傲天被熟知,《余红旧事》颠覆喜剧人形象又火了

1米84的他演龙傲天被熟知,《余红旧事》颠覆喜剧人形象又火了

大眼妹妹
2026-10-05 22:25:58
全世界公认的十大健康食品,大蒜排第二,第一名家家都有!(建议收藏)

全世界公认的十大健康食品,大蒜排第二,第一名家家都有!(建议收藏)

诗词天地
2026-09-28 14:09:52
美军总结:我们最大失误,就是以为志愿军的战斗力相当于韩军水平

美军总结:我们最大失误,就是以为志愿军的战斗力相当于韩军水平

纪史行者
2026-09-10 06:25:03
国乒首日10胜4负,男单3人晋级32强,日本男单首日全军覆没!

国乒首日10胜4负,男单3人晋级32强,日本男单首日全军覆没!

体坛侃侃球
2026-10-05 00:05:17
中日关系再起波澜,日媒又把旧账翻出来,高市早苗触碰中方红线

中日关系再起波澜,日媒又把旧账翻出来,高市早苗触碰中方红线

话史官1
2026-10-05 20:51:43
谢贤前女友Coco直播被说丑,本人回应:“姐都40岁了,把头发往下一放还是迷倒一大片的”

谢贤前女友Coco直播被说丑,本人回应:“姐都40岁了,把头发往下一放还是迷倒一大片的”

韩小娱
2026-09-04 05:54:22
《兰香如故》今日47集大结局!15岁的鲁隽让兰香算计程凤仙,才知,他为何改姓林

《兰香如故》今日47集大结局!15岁的鲁隽让兰香算计程凤仙,才知,他为何改姓林

乡野小珥
2026-10-05 17:25:49
性专家说:当一个异性开口跟你要钱,要礼物,不管对方是不是想试探你的真心,你都应该明白,你已被对方列入供养者行列

性专家说:当一个异性开口跟你要钱,要礼物,不管对方是不是想试探你的真心,你都应该明白,你已被对方列入供养者行列

心理观察局
2026-08-05 06:46:04
苹果新iPhone官宣:10月16日,开启预售!

苹果新iPhone官宣:10月16日,开启预售!

科技堡垒
2026-10-04 11:18:09
发车格上赛车集体趴窝,FIA承认软件没测透

发车格上赛车集体趴窝,FIA承认软件没测透

竞技风云录
2026-10-04 20:59:26
2027款奥迪Q9全黑取消镀铬,能压住GLS吗?

2027款奥迪Q9全黑取消镀铬,能压住GLS吗?

沙雕小琳琳
2026-10-05 10:27:48
讽刺!名古屋亚运闭幕式上座率最高,组委会就是想办最不隆重赛事

讽刺!名古屋亚运闭幕式上座率最高,组委会就是想办最不隆重赛事

杨华评论
2026-10-04 23:51:56
高市早苗:发生如此极其残忍、凶恶的事件,令人深感遗憾,强烈要求美方最大限度配合调查,严肃军纪,小泉进次郎:无法容忍,感到强烈愤慨

高市早苗:发生如此极其残忍、凶恶的事件,令人深感遗憾,强烈要求美方最大限度配合调查,严肃军纪,小泉进次郎:无法容忍,感到强烈愤慨

政知新媒体
2026-10-04 13:47:25
想不到!定居法国无儿无女的巩俐,竟给76岁的张艺谋留下一手好牌

想不到!定居法国无儿无女的巩俐,竟给76岁的张艺谋留下一手好牌

不似少年游
2026-10-05 22:00:39
9家上市公司抢先发布年报预告

9家上市公司抢先发布年报预告

上游新闻
2026-10-05 17:39:14
公路车骑行服,熟女骑行穿搭,利落面料勾勒饱满曲线

公路车骑行服,熟女骑行穿搭,利落面料勾勒饱满曲线

只要高兴就好
2026-09-24 11:58:50
WTT中国大满贯:男单32强出炉!国乒7胜7负,梁靖崑首秀零封名将

WTT中国大满贯:男单32强出炉!国乒7胜7负,梁靖崑首秀零封名将

全言作品
2026-10-05 22:02:28
我刚把火葬场炉子点火,尸体竟坐起喊救命,家属却按住我手:别停!

我刚把火葬场炉子点火,尸体竟坐起喊救命,家属却按住我手:别停!

悬案解密档案
2026-01-06 10:46:34
砍机长的副驾驶身份曝出!谁都没料到,他竟发过3000条"厌女"言论

砍机长的副驾驶身份曝出!谁都没料到,他竟发过3000条"厌女"言论

云景侃记
2026-10-05 21:57:56
2026-10-05 23:00:49
老虎说芯 incentive-icons
老虎说芯
资深半导体工程师的经验分享
901文章数 31关注度
往期回顾 全部

科技要闻

2026年诺奖:三名科学家因光遗传学获奖

头条要闻

高市早苗新内阁遭"当头一棒":日农相丑闻被披露遭围攻

头条要闻

高市早苗新内阁遭"当头一棒":日农相丑闻被披露遭围攻

体育要闻

30天30队·热:扬尼斯、阿德巴约与克雷

娱乐要闻

蔡康永回应漏洞百出,太平轮旧事被扒

财经要闻

零跑声明切割!蔡康永两面人身份被抵制

汽车要闻

方程豹9月热销破4万 首款皮卡鲨鱼将于四季度上市

态度原创

教育
家居
房产
本地
时尚

教育要闻

聪明的父母,大多是“农民思维”

家居要闻

2026建博会(广州) 公装联探展交流活动

房产要闻

保利大爆发,冲到榜一!海南楼市前三季度,热销榜出炉!

本地新闻

中秋逛白塔寺,体验国医妙荟雅集

帆布鞋,今年这样穿酷极了!

无障碍浏览 进入关怀版