AI领域英文缩写的核心价值,在于用简洁的字母组合,精准指代从底层硬件到上层应用全链路中的关键技术、架构与概念。以下按照技术链路,从底层到上层,梳理一份常用英文缩写清单。
一、算力与芯片层
| 缩写 | 全称 | 简要说明 |
|---|---|---|
| CPU | Central Processing Unit | 中央处理器,擅长处理通用计算任务,但AI计算速度相对较慢 |
| GPU | Graphics Processing Unit | 图形处理器,具备强大的并行计算能力,是当前AI训练和推理最主要的算力硬件 |
| NPU | Neural Processing Unit | 神经网络处理器,专为AI神经网络量身定制的专用芯片,执行AI任务效率最高 |
| TPU | Tensor Processing Unit | 张量处理器,Google自研的专用AI加速芯片 |
| ASIC | Application-Specific Integrated Circuit | 专用集成电路,为特定应用(如AI推理)定制的芯片 |
| FPGA | Field-Programmable Gate Array | 现场可编程门阵列,可重构的硬件加速器 |
| IPU | Intelligence Processing Unit | 智能处理单元,专为AI工作负载设计的处理器 |
| DPU | Data Processing Unit | 数据处理单元,专为数据中心基础设施卸载和加速网络、存储等任务而设计的处理器 |
二、存储与内存层
| 缩写 | 全称 | 简要说明 |
|---|---|---|
| VRAM | Video RAM / 显存 | 大模型的“血液”,决定了能跑多大参数的模型 |
| HBM | High Bandwidth Memory | 高带宽内存,AI芯片(如GPU)广泛使用的高速堆叠式内存 |
| DRAM | Dynamic Random-Access Memory | 动态随机存取存储器,通用内存 |
| SSD | Solid State Drive | 固态硬盘 |
| NVMe | Non-Volatile Memory Express | 非易失性内存标准,高速存储接口协议 |
| CXL | Compute Express Link | 计算快速链接,高速缓存一致性的互连协议,用于CPU与加速器、内存之间的高效通信 |
三、网络与通信层
| 缩写 | 全称 | 简要说明 |
|---|---|---|
| RDMA | Remote Direct Memory Access | 远程直接内存访问,允许数据绕过CPU直接在内存间传输 |
| RoCE | RDMA over Converged Ethernet | 基于融合以太网的RDMA,RDMA在以太网上的实现方案 |
| NVLink | NVIDIA NVLink | NVIDIA开发的高速GPU间直连互连技术 |
| GDS | GPUDirect Storage | 绕过CPU和系统内存,建立存储设备与GPU显存之间的直接数据传输路径 |
| NIC | Network Interface Card | 网络接口卡 |
| DCI | Data Center Interconnect | 数据中心互连,连接不同数据中心的高速光网络 |
四、模型与架构层
| 缩写 | 全称 | 简要说明 |
|---|---|---|
| AI | Artificial Intelligence | 人工智能 |
| ML | Machine Learning | 机器学习 |
| DL | Deep Learning | 深度学习 |
| LLM | Large Language Model | 大语言模型,经海量数据训练的参数巨大的深度学习模型 |
| SLM | Small Language Model | 小语言模型 |
| VLM | Vision Language Model | 视觉语言模型,能同时理解图像和语言的多模态模型 |
| LMM | Large Multimodal Model | 大型多模态模型,能处理文本、图像、视频等多种模态数据 |
| Transformer | Transformer | 当前统治大模型的底层神经网络架构,基于注意力机制 |
| MoE | Mixture of Experts | 混合专家架构,将大模型拆分为多个专家网络,按需调用 |
| MoGE | Mixture-of-Grouped-Experts | 分组混合专家架构,MoE的一种变体 |
| GPT | Generative Pre-trained Transformer | 生成式预训练Transformer |
| BERT | Bidirectional Encoder Representations from Transformers | 双向编码器表征Transformer |
| CNN | Convolutional Neural Network | 卷积神经网络 |
| RNN | Recurrent Neural Network | 循环神经网络 |
| LSTM | Long Short-Term Memory | 长短期记忆网络 |
| GRU | Gated Recurrent Unit | 门控循环单元 |
| GAN | Generative Adversarial Network | 生成对抗网络 |
| VAE | Variational Autoencoder | 变分自编码器 |
| ANN | Artificial Neural Network | 人工神经网络 |
| AGI | Artificial General Intelligence | 通用人工智能,具备与人类同等或超越人类智能的AI |
| ASI | Artificial Super Intelligence | 人工超级智能,全面超越人类智能的AI |
| GenAI | Generative AI | 生成式AI,能创造新内容(文本、图像、代码等)的AI |
| XAI | Explainable AI | 可解释AI |
五、训练与优化层
| 缩写 | 全称 | 简要说明 |
|---|---|---|
| SFT | Supervised Fine-Tuning | 有监督微调,用高质量数据训练模型学会“回答” |
| RLHF | Reinforcement Learning from Human Feedback | 基于人类反馈的强化学习,用人类偏好排序优化模型 |
| DPO | Direct Preference Optimization | 直接偏好优化,RLHF的一种高效替代方案 |
| PPO | Proximal Policy Optimization | 近端策略优化,RLHF中常用的强化学习算法 |
| LoRA | Low-Rank Adaptation | 低秩适配,一种高效微调技术,仅训练少量新增参数 |
| QLoRA | Quantized LoRA | 量化低秩适配,LoRA的量化版本 |
| RL | Reinforcement Learning | 强化学习 |
六、推理与部署层
| 缩写 | 全称 | 简要说明 |
|---|---|---|
| KV Cache | Key-Value Cache | 键值缓存,推理加速的核心技术,用显存换速度 |
| CoT | Chain of Thought | 思维链,要求模型展示推理步骤的提示技巧 |
| RAG | Retrieval-Augmented Generation | 检索增强生成,先检索外部知识再生成答案,减少幻觉 |
| MCP | Model Context Protocol | 模型上下文协议,统一标准让AI模型与外部工具、数据源交互 |
| API | Application Programming Interface | 应用程序编程接口 |
| SDK | Software Development Kit | 软件开发工具包 |
| MLOps | Machine Learning Operations | 机器学习运维,涵盖ML模型的CI/CD、监控和管理 |
| vLLM | vLLM | 高性能LLM推理引擎,以PagedAttention技术闻名 |
七、应用与Agent层
| 缩写 | 全称 | 简要说明 |
|---|---|---|
| NLP | Natural Language Processing | 自然语言处理 |
| NLU | Natural Language Understanding | 自然语言理解 |
| NLG | Natural Language Generation | 自然语言生成 |
| CV | Computer Vision | 计算机视觉 |
| OCR | Optical Character Recognition | 光学字符识别 |
| NER | Named Entity Recognition | 命名实体识别 |
| Agent | AI Agent | 人工智能智能体,能够自主感知、规划、调用工具、执行任务 |
| SOTA | State-of-the-Art | 最先进的,指当前领域最佳性能 |
技术链路总览
从底层硬件到上层应用,这些缩写串联起一条完整的技术链路:
算力与芯片层(CPU / GPU / NPU / TPU / ASIC) → 存储与内存层(VRAM / HBM / DRAM / SSD / NVMe / CXL) → 网络与通信层(RDMA / RoCE / NVLink / GDS / NIC / DCI) → 模型与架构层(AI / ML / DL / LLM / SLM / VLM / LMM / Transformer / MoE / GPT / BERT / CNN / RNN / LSTM / GRU / GAN / AGI) → 训练与优化层(SFT / RLHF / DPO / PPO / LoRA / QLoRA / RL) → 推理与部署层(KV Cache / CoT / RAG / MCP / API / SDK / MLOps / vLLM) → 应用与Agent层(NLP / NLU / NLG / CV / OCR / NER / Agent / SOTA)
理解这些缩写,不只是记住字母组合,更是建立起从“芯片如何算”到“模型如何学”、再到“应用如何用”的完整认知框架。每个缩写都在这个链路中占据一个生态位,理解它在链路中的位置,比孤立记忆定义更重要。
291

被折叠的 条评论
为什么被折叠?



