【前沿未来培训】《AI算力基础设施与模型部署》
![]()
一、算力底座:AI芯片的架构原理与选型逻辑
1.1 AI计算的核心硬件:从CPU到专用加速器
1.1.1 为什么通用CPU难以满足大模型算力需求——并行计算与内存带宽瓶颈
1.1.2 AI芯片主流架构概览:GPU、ASIC、FPGA、NPU的技术分野
1.1.3 Scaling Law与Chinchilla Law对算力需求的指数级驱动逻辑
1.2 国内AI算力芯片三大技术路线对比
1.2.1 推理专用SRAM架构:片上存储、低延迟优势与适用场景(曲速科技为代表)
1.2.2 全栈自研架构:端到端自主可控、训推全场景(华为昇腾为代表)
1.2.3 通用GPGPU架构:生态兼容性与训推兼顾(寒武纪、海光信息为代表)
1.3 运营商视角的芯片选型考量
1.3.1 训练 vs 推理场景的芯片需求差异——算力密度、显存带宽与能效比
1.3.2 国产化要求与供应链安全对选型决策的影响
1.3.3 万卡集群场景下的芯片协同与异构计算挑战
二、智算中心:架构设计与运营商实践
2.1 智算中心与传统数据中心的本质差异
2.1.1 从“通用算力资源池”到“AI专用算力集群”的架构跃迁
2.1.2 大模型训练对算力密度、网络带宽、存储性能的刚性需求
2.1.3 运营商智算集群布局的独特优势:网络资源+机房资源+属地化服务
2.2 智算中心核心架构组件
2.2.1 计算层:AI服务器选型与GPU/NPU集群设计
2.2.2 网络层:高速互联组网方案与无损网络技术
2.2.3 存储层:分级存储架构与PB级数据吞吐能力
2.3 运营商智算中心建设实践
2.3.1 中国移动(哈尔滨)算力中心:1.8万架机架、100%国产AI芯片、天池SDN与GSE自主组网
2.3.2 芜湖智算集群:全国首个“五算合一”调度平台、6.4万P智算规模与“三券联动”模式
2.3.3 三大运营商智算布局比较:算力规模、组网方案与商业模式差异
三、模型部署:云边端协同与工程实践
3.1 云边端协同部署架构
3.1.1 云侧:大规模模型训练与重推理——集中化算力池与弹性伸缩
3.1.2 边侧:低时延响应与数据本地化——边缘节点部署与自治服务
3.1.3 端侧:轻量化推理与功耗约束——模型压缩与芯片级优化
3.2 关键技术实践
3.2.1 PD分离架构:Prefill与Decode任务分离部署,提升推理效率
3.2.2 长距跨DC分布式推理:百公里级拉远场景下保持SLA的工程方案
3.2.3 云原生与容器化部署:K8S编排、GPU共享与任务调度
3.3 运营商特有的部署场景
3.3.1 数据不出园区的企业级推理方案——园区部署少量算力+云端弹性扩展
3.3.2 网络即算力:OTN全光网络支撑下的算力调度与协同
3.3.3 从“智算中心建设者”到“智算服务运营者”的角色升级
四、成本与选型:模型落地的经济性分析
4.1 部署模式的成本对比
4.1.1 公有云API模式 vs 开源托管服务 vs 私有化部署的经济性推演
4.1.2 不同推理规模下的TCO(总拥有成本)分析——从轻量应用到重度场景
4.1.3 Dell ESG研究结论:本地化推理经济性较公有云IaaS提升2.1~2.6倍
4.2 推理成本的关键决定因素
4.2.1 模型参数规模 vs 推理延迟 vs Token成本的三角权衡
4.2.2 硬件采购摊销、电力与能耗、专业运维人力的隐性成本
4.2.3 开源模型 vs 闭源模型的成本差异——GLM-5.2推理成本约为Claude Opus 4.8的三分之一
4.3 运营商决策框架:如何为不同场景选择最优方案
4.3.1 场景识别:面向ToC、ToB、ToG的差异化算力需求
4.3.2 决策四维度:性能要求、数据安全、成本预算、国产化合规
4.3.3 运营商的核心竞争力:算力+连接+信任的叠加优势
授课专家:北京前沿未来科技产业发展研究院院长 陆峰博士
联系电话13716300228(微信同号)
(信息来源:北京前沿未来科技产业发展研究院)
北京前沿未来科技产业发展研究院
【重磅推荐】《前沿未来科技产业发展 : 前沿与基础》(人民出版社,2026年6月)
![]()
![]()
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.