2025年1月7日,英伟达CEO黄仁勋在 2025 CES 上的演讲再次将 AI 算力推到聚光灯下,揭示了智算中心与 GPU 协同驱动智能变革的新路径。
RTX 50 系列显卡的发布备受瞩目。全新的 GeForce RTX 50 GPU 采用先进的 Blackwell 架构,拥有多达 920 亿个晶体管,其强大的算力高达 4000TOPS。配备4 个 AI 处理单元,性能相比上一代 Ada 实现三倍的飞跃。RTX 5090 售价 1999 美元,RTX 5080 售价 999 美元,从 1 月份开始供应市场。
美光为新 GPU 提供内存支持。该GPU 产品不仅为游戏玩家带来更极致的体验,更为 AI 领域的数据处理、模型训练等提供了坚实的硬件基础,使得 AI 算力在处理复杂任务时更加高效快捷。
黄仁勋在演讲中还提及了 NVIDIA Cosmos 模型,这一旨在理解现实世界的基础模型,可以接受文本、图像或视频的提示,生成虚拟世界状态,作为针对自动驾驶和机器人应用独特需求的视频输出,为相关领域的发展提供全新的思路和技术支撑,进一步丰富了 AI 算力在不同应用场景中的可能性。

#5090参数#
一、AI 算力的发展背景与现状
1. AI 算力需求激增
随着大模型时代的开启,AI 算力需求呈爆炸式增长。从 2012 - 2023 年,算力需求翻了数十万倍,远超摩尔定律。大模型的训练,如 GPT - 4 等,需要千亿甚至万亿级参数和大量高质量数据,其计算量极大,推动了智能算力需求的井喷。预计未来 10 年,AI 算力需求将再增长 500 倍,这主要归因于算法的突破、模型规模的指数级增长以及应用场景的不断拓展。Sora 等视频生成类模型相较于大语言模型消耗的算力提升 20 倍。
大模型,AI 发展的关键驱动力,自 2015 - 2016 年左右开启以来,整体训练计算量较之前时期大幅增长 2 到 3 个数量级。2022 年底 ChatGPT 的成功发布,引发了大规模参数通用大模型的相继涌现,对算力的需求达到前所未有的高度。GPT - 4 这类的模型参数量高达数千亿甚至上万亿美元,训练所需的数据量也达到海量级别,对算力的需求超乎想象。
随着模型规模的不断扩大,从 GPT - 3 到 GPT - 4 的演进,参数量的增加以及对数据处理能力的提升,都直接导致了对算力需求的持续增长。这种增长趋势不仅体现在训练阶段,推理阶段同样对算力有着巨大的需求,尤其是当模型应用于复杂场景,如实时视频生成、大规模数据分析等时,所需的推理算力也随之大幅增加。

算法拉动算力
AIGC(人工智能生成内容)的快速发展更是进一步推动了AI 算力需求的增长。AIGC 技术涵盖文本、图像、音频、视频等多种内容形式的生成,其背后依赖于强大的算力支持。以图像生成模型为例,生成高分辨率、逼真的图像需要大量的计算资源来进行复杂的模型运算和数据处理。
文本生成任务中处理长文本、多轮对话等场景也对算力提出了更高的要求。随着 AIGC 技术在创意设计、内容创作、智能客服等各个领域的广泛应用,对算力的需求也不断深化,促使算力基础设施持续升级和扩展。
AI 应用的持续放量也推动了 AI 算力需求的快速增长。据统计,2024 年 1 月至 8 月份,全球 AI 应用下载量同比增长 26%,达到 22 亿次,预估全年下载量将达到 33 亿,同比增长 26%。在收入端,全球 AI 应用同比激增 51%,规模至 20 亿美元。
IDC 预测 2024 年全球将涌现出 5 亿个智能化应用,相当于过去 40 年间应用数总和。全球AI PC 出货量的市场占比和 AI 手机出货量的市场占比在未来几年呈现出明显的上升趋势,这也将进一步带动对 AI 算力的需求。
2. AI 算力市场蓬勃发展,AI服务器需求激增
全球人工智能市场快速增长,2023 年市场收入达 5381 亿美元,同比增长 18.5%,预计到 2026 年将达 9000 亿美元。2024 年 Q1 全球 AI 领域完成 1779 笔融资交易,筹集的风险投资总额达 216 亿美元。全球人工智能呈现 “中美主导” 格局,截至 2023 年三季度,全球人工智能企业有 29542 家,其中美国有 9914 家,占比 34%;中国有 4469 家,占比 15%。
数字基础设施建设步伐加快,算力结构不断调整,智能算力增长势头强劲,2023 年底全球算力总规模约 910EFLOPS,其中智能算力从 2021 年的 113EFLOPS 增长至 2023 年的 335EFLOPS,增速远超其他算力类型。

AI 服务器
AI 服务器作为智能算力的重要载体,在全球范围内正迅速扩张。根据相关数据显示,2023 年,全球 AI 服务器市场规模突破 500 亿美元,增幅高达 95.8%,预计到 2028 年,市场规模有望突破 1000 亿美元,五年的年复合增长率预计为 14.5%。从具体数据来看,2020 年市场规模为 151 亿美元,2021 年增长至 180 亿美元,2022 年达到 263 亿美元,2023 年则突破 500 亿美元,后续几年虽增速有所放缓,但仍保持增长态势。
中国 AI 服务器在 AI 及智算产业的高速发展下也持续攀升。2020 - 2028 年中国 AI 服务器的市场规模从 2020 年的 149 亿人民币增长至 2023 年的 692 亿人民币,预计到 2028 年,AI 服务器的市场规模将达到 1433 亿人民币。其中2020 年为 149 亿人民币,2021 年增长到 273 亿人民币,2022 年达到 341 亿人民币,2023 年达到 692 亿人民币,后续几年也呈现出稳步增长的趋势。
3. 政策支持推动
国家层面,我国陆续出台多项政策支持算力发展。如国家发展改革委员会发布的《国家数据标准体系建设指南》强调强化算力保障等标准建设;《国务院办公厅关于加快公共数据资源开发利用的意见》推动公共数据资源开发利用;《政府工作报告》提出适度超前建设数字基础设施,加快形成全国一体化算力体系等。各省市也积极响应,山东、河北、北京、江苏等多地出台相关政策,推动地方算力资源的开放共享、数据中心的集约化发展、算力网络的一体化建设以及算力与实体经济的深度融合,加速 AI 应用落地和数字经济发展。
二、AI 算力的技术体系与关键要素
1. 算力系统的复杂性
满足大模型需求的算力不仅要求计算能力指数级增长,还需在数据传输、存储和处理等多维度深度优化。算力系统设计面临诸多挑战,如低时延数据交换、节点间计算负载均衡分配、消除算力堵点、预防硬件故障等。不同应用场景对算力效率、调度灵活性、扩展性、安全稳定和成本效益等方面有独特需求,构建算力基础设施时,需综合规划设计,以实现高效、经济且可持续的算力供给。


137

被折叠的 条评论
为什么被折叠?



