网易首页 > 网易号 > 正文 申请入驻

GPU 相关常见术语

0
分享至

CPU像总经理,GPU像几万个熟练工人;CUDA 像管理这些工人的操作手册,HBM 像高速仓库,NVLink 像工厂之间的专用高铁。AI 模型越大、Token 调用越多,对 GPU、显存、互联、电力和散热的要求就越高。

你可以把 GPU 理解成:一座有成千上万个“小工人”的计算工厂,特别擅长同时处理大量重复计算,所以非常适合 AI、图形渲染、科学计算和大模型训练。

一、GPU 基础概念

  1. GPU 图形处理器
    原本用来处理图像,现在也非常适合 AI 计算,像一支“并行计算军队”。

  2. CPU 中央处理器
    电脑的“总指挥”,擅长复杂决策和调度,但不如 GPU 擅长大规模并行计算。

  3. 显卡 Graphics Card
    把 GPU、显存、供电、散热等装在一起的硬件卡,像 GPU 的整套工作平台。

  4. 集成显卡 iGPU
    集成在 CPU 或芯片里的 GPU,省电、便宜,但性能通常较弱。

  5. 独立显卡 dGPU
    单独的一块显卡,性能更强,常用于游戏、AI、设计和服务器。

  6. 数据中心 GPU
    专门用于 AI、云计算、高性能计算的 GPU,像工业级计算发动机。

  7. 消费级 GPU
    面向游戏玩家、设计师、个人用户的 GPU。

  8. 专业 GPU
    面向工作站、设计、仿真、影视渲染等专业场景的 GPU。

  9. AI GPU
    主要用于 AI 训练和推理的 GPU,强调矩阵计算、显存和互联能力。

  10. GPGPU 通用 GPU 计算
    不只用 GPU 画图,还用它做科学计算、AI、金融模拟等任务。

二、GPU 公司与生态
  1. 英伟达 NVIDIA
    全球重要 GPU 厂商,CUDA 生态让它在 AI 计算中占据强势地位。

  2. AMD
    重要 GPU 和 CPU 厂商,也提供 AI 加速卡和 ROCm 软件生态。

  3. Intel GPU
    Intel 的图形和加速芯片业务,包括集成显卡、独显和数据中心加速器。

  4. CUDA
    NVIDIA 的 GPU 编程平台,像一套让程序员指挥 GPU 干活的“语言和工具箱”。

  5. ROCm
    AMD 的 GPU 计算软件平台,可以理解为 AMD 版的 GPU 计算工具箱。

  6. oneAPI
    Intel 推动的跨硬件编程平台,希望让程序能跑在 CPU、GPU 等不同硬件上。

  7. CUDA 生态
    围绕 NVIDIA GPU 形成的软件、库、工具和开发者体系,像一座繁荣的应用城市。

  8. 驱动 Driver
    让操作系统和 GPU 正常沟通的软件,像翻译兼交通指挥。

  9. SDK 软件开发包
    提供开发工具、示例和接口,帮助开发者使用 GPU 能力。

  10. GPU 云服务
    通过云平台租用 GPU,不必自己买机器,像按小时租用计算工厂。

三、GPU 架构与核心部件
  1. GPU 架构 Architecture
    GPU 内部设计方式,决定它怎么计算、怎么存数据、怎么传数据。

  2. CUDA Core
    NVIDIA GPU 中大量小计算单元,像工厂里的基础工人。

  3. Stream Processor 流处理器
    AMD GPU 中类似 CUDA Core 的并行计算单元。

  4. Tensor Core 张量核心
    专门加速 AI 矩阵计算的单元,像为大模型计算定制的高速车间。

  5. RT Core 光线追踪核心
    用于游戏和图形中的真实光影计算,像专门模拟光线的部门。

  6. SM 流式多处理器
    NVIDIA GPU 的核心计算模块,里面包含很多 CUDA Core、Tensor Core 等。

  7. CU 计算单元
    AMD GPU 的基础计算模块,类似一个小型计算车间。

  8. Shader 着色器
    图形处理中负责计算颜色、光影、纹理的程序或单元。

  9. Pipeline 流水线
    GPU 按步骤处理任务,像工厂流水线一样分工协作。

  10. Warp 线程束
    NVIDIA GPU 中一组一起执行的线程,像一小队工人同时行动。

四、显存与存储
  1. 显存 VRAM
    GPU 自己使用的高速内存,像 GPU 身边的仓库。

  2. HBM 高带宽内存
    高端 AI GPU 常用显存,像超宽高速仓库通道。

  3. GDDR 显存
    消费级显卡常见显存,常用于游戏和图形渲染。

  4. HBM2E
    较早一代高带宽内存,曾用于多种 AI 和 HPC 芯片。

  5. HBM3
    更高带宽的 HBM,常用于高端 AI GPU。

  6. HBM3E
    HBM3 的增强版本,带宽和容量进一步提升。

  7. 显存容量
    GPU 能装下多少数据,像仓库有多大。

  8. 显存带宽
    GPU 读写显存的速度,像仓库门有多宽、货能搬多快。

  9. Cache 缓存
    GPU 内部更近更快的小仓库,用来放常用数据。

  10. 共享内存 Shared Memory
    GPU 内部线程共同使用的小型高速空间,像一个小组共享的工具台。

五、算力与性能指标
  1. 算力 Compute Power
    GPU 每秒能做多少计算,像工厂每小时能生产多少产品。

  2. FLOPS 浮点运算次数
    衡量计算能力的单位,表示每秒能做多少次小数运算。

  3. TFLOPS
    每秒万亿次浮点运算,常用来描述 GPU 算力。

  4. PFLOPS
    每秒千万亿次浮点运算,常用于大型 AI 集群和超算。

  5. TOPS
    每秒万亿次整数运算,常用于 AI 推理芯片指标。

  6. 峰值算力 Peak Performance
    理想条件下的最高算力,像汽车标称最高速度。

  7. 实际性能 Real-world Performance
    真实任务中的表现,可能低于峰值算力。

  8. 利用率 Utilization
    GPU 实际忙碌程度,利用率低说明很多计算资源闲着。

  9. 吞吐量 Throughput
    单位时间处理多少任务,像工厂实际出货量。

  10. 延迟 Latency
    一个任务从开始到完成需要多久,像外卖送达时间。

六、AI 训练与推理
  1. 训练 Training
    让模型从大量数据中学习规律,像学生刷题学习。

  2. 推理 Inference
    模型训练好后回答问题或生成内容,像学生参加考试。

  3. 大模型 LLM
    参数很多、能力很强的 AI 模型,比如聊天、写作、编程模型。

  4. 参数 Parameters
    模型内部的知识旋钮,数量越多,模型容量通常越大。

  5. Token
    AI 处理文本的小单位,可以理解为“字词碎片”。

  6. Batch 批次
    一次送进 GPU 处理的一组数据,像一车货一起进工厂。

  7. Batch Size 批大小
    一次处理多少样本,越大越吃显存。

  8. Epoch 训练轮次
    模型完整看一遍训练数据,像把整本教材学一遍。

  9. Gradient 梯度
    告诉模型参数该往哪个方向调整,像老师批改后指出改进方向。

  10. Backpropagation 反向传播
    训练模型时把错误往回传,帮助模型改正。

七、AI 计算精度
  1. FP32 单精度浮点
    精度较高但计算和存储成本较高,像用精细尺子测量。

  2. FP16 半精度浮点
    精度较低但速度更快、占用更少,AI 训练常用。

  3. BF16
    一种适合 AI 训练的低精度格式,在速度和稳定性间折中。

  4. FP8
    更低精度格式,可大幅提升 AI 计算效率,但对算法和硬件要求更高。

  5. INT8
    8 位整数计算,常用于 AI 推理,像用简化数字快速估算。

  6. INT4
    更低位宽的整数计算,更省资源,但可能损失精度。

  7. 混合精度 Mixed Precision
    不同计算环节用不同精度,像该精算的地方精算,该快算的地方快算。

  8. 量化 Quantization
    把高精度模型压成低精度,减少显存和计算量。

  9. 稀疏计算 Sparsity
    跳过大量无用或为零的计算,像只处理真正有货的箱子。

  10. 矩阵乘法 Matrix Multiplication
    AI 计算的核心操作之一,GPU 特别擅长,像成千上万次表格计算同时做。

八、GPU 互联与集群
  1. PCIe
    GPU 和 CPU、主板之间的连接通道,像电脑内部的高速公路。

  2. NVLink
    NVIDIA GPU 之间的高速互联,像 GPU 之间的专用高铁。

  3. NVSwitch
    让多颗 GPU 高速互联的交换芯片,像 GPU 集群里的交通枢纽。

  4. Infinity Fabric
    AMD 的高速互联技术,用于芯片内部或芯片之间通信。

  5. GPU 集群
    很多 GPU 连在一起协同工作,像一支 AI 计算军团。

  6. Scale Up 纵向扩展
    在一个节点或机柜里把 GPU 更紧密连接,像组建一台更强的大机器。

  7. Scale Out 横向扩展
    增加更多服务器和 GPU,像多建几座工厂一起干活。

  8. 分布式训练
    多颗 GPU、多台服务器一起训练模型,像多人合作完成一本巨著。

  9. AllReduce
    分布式训练中同步各 GPU 结果的操作,像每个小组算完后统一汇总。

  10. 通信瓶颈
    GPU 算得很快,但彼此传数据太慢,像工人干活快但物流堵车。

九、服务器、电力与散热
  1. GPU 服务器
    装有多颗 GPU 的服务器,专门用于 AI 和高性能计算。

  2. AI 服务器
    为训练和推理模型设计的服务器,通常配 GPU、HBM、高速网卡等。

  3. 机柜 Rack
    数据中心里放服务器的柜子,像计算设备的货架。

  4. 功耗 Power Consumption
    GPU 消耗多少电,高端 GPU 往往很耗电。

  5. TDP 热设计功耗
    散热系统需要应对的热量水平,像发动机最大散热需求。

  6. 风冷 Air Cooling
    用风扇带走热量,像给机器吹风降温。

  7. 液冷 Liquid Cooling
    用液体带走热量,散热能力更强,像给服务器接冷却水管。

  8. 散热器 Heat Sink
    帮 GPU 散热的金属结构,像芯片的散热鳍片。

  9. 温控 Thermal Management
    控制温度,防止 GPU 过热降频或损坏。

  10. 降频 Throttling
    GPU 太热或供电不足时自动降速,像人累了跑不动。

十、产品、应用与产业链
  1. GeForce
    NVIDIA 面向游戏和个人用户的显卡品牌。

  2. RTX
    NVIDIA 支持光线追踪和 AI 加速的显卡系列名称。

  3. A100
    NVIDIA 曾广泛用于 AI 训练和数据中心的 GPU 型号。

  4. H100
    NVIDIA Hopper 架构数据中心 GPU,常用于大模型训练和推理。

  5. B100 / B200
    NVIDIA Blackwell 系列 AI GPU,面向更高性能 AI 计算。

  6. MI300
    AMD 面向 AI 和高性能计算的重要加速器系列。

  7. CUDA Library CUDA 库
    NVIDIA 提供的数学、AI、图像等加速库,像现成工具箱。

  8. cuDNN
    NVIDIA 用于深度学习的加速库,帮助神经网络跑得更快。

  9. GPU 供给紧张
    市场上高端 GPU 不够用,AI 公司和云厂商抢购,像热门车排队提货。

  10. GPU 产业链
    包括芯片设计、晶圆制造、先进封装、HBM、PCB、服务器、散热、电源、光模块和云服务。

欢迎加入行业交流群,备注岗位+公司,请联系老虎说芯(加V:tigerchip)

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
暴雨或大暴雨,大雪或雨夹雪来了

暴雨或大暴雨,大雪或雨夹雪来了

第一财经资讯
2026-10-05 19:51:21
以色列:严禁拥有伊朗、伊拉克、黎巴嫩、阿曼、巴基斯坦、卡塔尔和沙特等27国单一或双重国籍的机组人员执飞或搭乘赴以航班

以色列:严禁拥有伊朗、伊拉克、黎巴嫩、阿曼、巴基斯坦、卡塔尔和沙特等27国单一或双重国籍的机组人员执飞或搭乘赴以航班

第一财经资讯
2026-10-05 09:08:21
“缅方一直通报说,没有中国人死”,为了取证,民警冒着果敢战火深入缅北电诈园区,在埋尸点找到三具高度腐败的尸体并带回国内

“缅方一直通报说,没有中国人死”,为了取证,民警冒着果敢战火深入缅北电诈园区,在埋尸点找到三具高度腐败的尸体并带回国内

都市快报橙柿互动
2026-10-05 16:51:52
刚刚,杨兰兰案开庭!早前警告:不现身就逮捕!

刚刚,杨兰兰案开庭!早前警告:不现身就逮捕!

澳洲红领巾
2026-10-05 14:30:22
新加坡牵头20国,在联合国大会抛出提案,想给中美AI“立规矩”?

新加坡牵头20国,在联合国大会抛出提案,想给中美AI“立规矩”?

策前论
2026-10-04 18:08:07
那个逼空姐下跪的欧某某"真容现身",网传系大连一家企业高管,果然不简单

那个逼空姐下跪的欧某某"真容现身",网传系大连一家企业高管,果然不简单

子非鱼人
2026-10-05 00:33:00
“顺风车司机提前收高速费,却故意拖到1日零点免费下高速”,乘客称100多公里花了5小时,哈啰平台客服回应

“顺风车司机提前收高速费,却故意拖到1日零点免费下高速”,乘客称100多公里花了5小时,哈啰平台客服回应

极目新闻
2026-10-05 12:20:16
事态升级!蔡康永风波扯出5位港台明星,已不是道德问题这么简单

事态升级!蔡康永风波扯出5位港台明星,已不是道德问题这么简单

孤城落日
2026-10-05 16:53:01
特朗普:我和金正恩相处得很好,若有人拥有112枚核武器,应当与他保持良好关系

特朗普:我和金正恩相处得很好,若有人拥有112枚核武器,应当与他保持良好关系

台州交通广播
2026-10-05 08:37:45
樊振东不再沉默!和陈梦领证结婚,退役选择一下说清楚

樊振东不再沉默!和陈梦领证结婚,退役选择一下说清楚

小蒋爱唠嗑
2026-10-05 08:02:50
一场2-1险胜,郑钦文赢麻了:收利好消息,排名飙升+狂揽70万元!

一场2-1险胜,郑钦文赢麻了:收利好消息,排名飙升+狂揽70万元!

大秦壁虎白话体育
2026-10-05 17:46:23
同济研二女生坠楼身亡,已买好国庆回家票,弟弟发声字字泣血:要真相,不要冷处理

同济研二女生坠楼身亡,已买好国庆回家票,弟弟发声字字泣血:要真相,不要冷处理

笔尖下的人生
2026-10-05 16:30:03
中纪委严厉强调!要求各地哪怕脱层皮,也要一抓到底!

中纪委严厉强调!要求各地哪怕脱层皮,也要一抓到底!

职场资深秘书
2026-10-05 14:17:32
深圳APEC开幕在即,高市称谓被撤!中方拒认“首相级”外交名分

深圳APEC开幕在即,高市称谓被撤!中方拒认“首相级”外交名分

无情有思可
2026-10-05 16:13:32
缅北明家,给中国人起了个蔑称

缅北明家,给中国人起了个蔑称

极目新闻
2026-10-05 18:27:38
成都3片回锅肉卖105元:老板说“就赚20块”,网友算完账沉默了!

成都3片回锅肉卖105元:老板说“就赚20块”,网友算完账沉默了!

大稻网络科技
2026-10-04 15:59:45
国庆节后,我国或将迎来四大涨潮:除了鸡蛋,这3样也有上涨压力

国庆节后,我国或将迎来四大涨潮:除了鸡蛋,这3样也有上涨压力

白米饭怎么吃
2026-10-05 08:03:12
蔡康永怂了!最新回应还想当双面人网友不买账,更多品牌出面切割

蔡康永怂了!最新回应还想当双面人网友不买账,更多品牌出面切割

萌神木木
2026-10-05 16:31:00
“家里钱多的鲍岩板,有个大库房专门装钱,警卫员偷他一千多万都没发现!”缅北电诈覆灭纪实第一集《利剑出鞘》,完整视频来了

“家里钱多的鲍岩板,有个大库房专门装钱,警卫员偷他一千多万都没发现!”缅北电诈覆灭纪实第一集《利剑出鞘》,完整视频来了

都市快报橙柿互动
2026-10-05 19:13:23
被开除后、实名举报中国电信 4 名高管:串标、虚假合同、套取财政资金等

被开除后、实名举报中国电信 4 名高管:串标、虚假合同、套取财政资金等

云头条
2026-10-05 15:38:10
2026-10-05 21:59:00
老虎说芯 incentive-icons
老虎说芯
资深半导体工程师的经验分享
901文章数 31关注度
往期回顾 全部

科技要闻

2026年诺奖:三名科学家因光遗传学获奖

头条要闻

缅北电诈头目在中国临刑前对着镜头叫嚣:狼生来要吃肉

头条要闻

缅北电诈头目在中国临刑前对着镜头叫嚣:狼生来要吃肉

体育要闻

30天30队·热:扬尼斯、阿德巴约与克雷

娱乐要闻

蔡康永回应漏洞百出,太平轮旧事被扒

财经要闻

零跑声明切割!蔡康永两面人身份被抵制

汽车要闻

方程豹9月热销破4万 首款皮卡鲨鱼将于四季度上市

态度原创

房产
旅游
亲子
家居
公开课

房产要闻

保利大爆发,冲到榜一!海南楼市前三季度,热销榜出炉!

旅游要闻

永定河集盲盒双路线实测!闺蜜漫游线vs情侣约会线

亲子要闻

今天我们来玩一个锻炼反应能力的小游戏

家居要闻

2026建博会(广州) 公装联探展交流活动

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版