万本电子书0元读

万本电子书0元读

顶部广告

面向AI大模型的智能算力基础设施构建与应用电子书

2、内容系统深,覆盖智能算力构建与应用全流程:遵循“需求—技术—建设—应用—展望”的逻辑,系统剖析智能算力基础设施构建的全流程,涵盖行业大模型的构建方法与应用案例,分析超大规模集群面对的挑战及应对方案。 3、覆盖智能算力的完整技术路,详解大规模集群互联:深探讨多元异构计算、芯片间高速互联、弹性高速存储、模型优化、资源管理与调度、AI安全等关键技术,清晰呈现大型算力节之间的连架构与部署思路。

售       价:¥

纸质售价:¥70.00购买纸书

0人正在读 | 0人评论 6.8

作       者:苗青,张先锋,黄瑾,李强 等 著

出  版  社:人民邮电出版社有限公司

出版时间:2026-08-01

字       数:18.5万

所属分类: 科技 > 计算机/网络 > 软件系统

温馨提示:数字商品不支持退换货,不提供源文件,不支持导出打印

为你推荐

  • 读书简介
  • 目录
  • 累计评论(条)
  • 读书简介
  • 目录
  • 累计评论(条)
本书系统阐述面向AI大模型的智能算力基础设施的构建之道与应用前景。本书遵循“需求—技术—建设—应用—展望”的逻辑,从驱动AI发展的算力需求出发,深讲解多元异构计算、芯片间高速互连、节间高性能无损网络、弹性高速存储等核心技术。在此基础上,本书提供详尽的基础设施建设方案,包括网络建设方案、资源配置方案、资源池管理方案、安全建设方案及AI平台建设方案等。此外,本书还探讨算力互联互通的实现路径,展示行业大模型的构建方法与应用案例,并分析超大规模集群面对的挑战及应对方案。本书从专业设计视角出发,聚焦顶层规划与设计决策背后的原理及权衡,有助于全面提升读者在AI算力领域的系统性思维和实践能力。 本书适合需要部署AI大模型的企业或组织的技术决策者和一线工程师阅读,也适合AI领域的研究者、投资者阅读。<br/>【推荐语】<br/>1、沉淀一线工程方案,设计院专业视角直痛:本书由上海邮电设计咨询研究院团队撰写,聚焦顶层规划、技术选型、系统设计和成本效益评估等关键决策环节,助力技术决策者和一线工程师构建系统性思维。 2、内容系统深,覆盖智能算力构建与应用全流程:遵循“需求—技术—建设—应用—展望”的逻辑,系统剖析智能算力基础设施构建的全流程,涵盖行业大模型的构建方法与应用案例,分析超大规模集群面对的挑战及应对方案。 3、覆盖智能算力的完整技术路,详解大规模集群互联:深探讨多元异构计算、芯片间高速互联、弹性高速存储、模型优化、资源管理与调度、AI安全等关键技术,清晰呈现大型算力节之间的连架构与部署思路。 4、方案可落地复用,横向对比支撑高效技术选型:提供网络建设、资源配置、资源池管理、安全建设、AI平台建设等关键环节的可落地建设方案,并对各类方案等行性能与适用场景对比,帮助读者高效完成技术选型。 5、方法论贯通各产业领域,真实案例赋能千行百业:介绍算力互联互通与行业大模型构建的通用方法,展示智算网络在电信运营商、设备与方案供应商等产业的应用实践,以及DeepSeek大模型在银行系统部署的真实案例,前瞻超大规模集群的未来发展趋势。<br/>【作者】<br/>苗青,博士,正高级工程师,曾任上海邮电设计咨询研究院有限公司执行董事、党委书记、总经理,现任中国电信集团有限公司云南电信实业分公司、云南省通信产业服务有限公司董事、党委书记、总经理。长期从事云计算、物联网、人工智能、语音处理及信息系统集成等领域的技术研究,作为企业负责人和项目负责人完成工业和信息化部“网络协同制造业务流程优化工业互联网平台测试床项目”、上海市发展和改革委员会“基于AI语音技术的中小企业自助客服云平台”、上海市科学技术委员会“区域级消防物联网关键技术研发与应用”和“基于人工智能的物联网产业敏捷服务平台”等重课题项目,带领团队荣获多个奖项。 张先锋,硕士,正高级工程师,现任上海邮电设计咨询研究院有限公司党委书记、总经理。长期从事IT系统、大数据、云计算等领域的技术研究工作,作为项目负责人完成大量政府、企事业单位(包括运营商总部)的项目规划、咨询和设计工作。 黄瑾,硕士,正高级工程师,国家注册一级建造师、注册咨询工程师、注册监理工程师,现任上海邮电设计咨询研究院有限公司数据勘察设计院副总工程师。长期从事算力基础设施的规划设计、标准编制及新技术跟踪研究工作,曾获多项国家级和省部级优秀咨询奖项,多次主编或参编国家及行业标准。 李强,工程师,现任上海邮电设计咨询研究院有限公司一级设计师。长期从事云计算、人工智能及IT系统等领域的技术研究和运营商总部项目咨询与设计工作,曾以项目设计负责人身份参与天翼云上海临港国产万卡算力池工程建设项目。近年来聚焦算力网络、大规模智算集群建设等方向的技术落地与实践。<br/>
目录展开

内容提要

本书作者团队

前言

第1章 概述

1.1 算力:数字时代的核心生产力

1.2 AI:新质生产力的重要引擎与算力需求的变革者

1.3 智能算力:为AI而生的计算新范式

1.4 AI大模型:驱动智能算力走向超大规模的核心引擎

1.5 标准化:构建产业协同的基石

第2章 AI对智能算力基础设施的需求

2.1 AI发展对算力的宏观需求与驱动

2.1.1 技术演进重塑算力基础设施的需求

2.1.2 算力规模增长与结构演变

2.2 智能算力服务模式分类

2.3 大模型预训练场景的需求

2.3.1 预训练对智能算力基础设施的功能需求

2.3.2 预训练对智能算力基础设施的资源需求

2.4 大模型微调场景的需求

2.4.1 SFT :追求极致性能的高昂路径

2.4.2 PEFT :兼顾效果与成本的主流选择

2.4.3 微调的资源需求与策略选择

2.5 大模型推理场景的需求

2.5.1 模型准备与优化:奠定高效推理的基础

2.5.2 推理对智能算力基础设施的资源需求

第3章 智能算力基础设施的关键技术

3.1 多元异构计算

3.1.1 多元异构计算的架构

3.1.2 智算服务器架构设计理念

3.1.3 深度学习训练型AI服务器

3.1.4 智能应用推理型AI服务器

3.1.5 技术发展趋势

3.2 芯片间高速互连

3.2.1 PCIe

3.2.2 CXL

3.2.3 NVLink

3.2.4 PCIe、CXL、NVLink的对比

3.3 节点间高性能无损网络

3.3.1 核心使能技术RDMA

3.3.2 关键网络架构与拓扑

3.3.3 应用方案:从智算中心内到跨广域网

3.4 弹性高速存储

3.4.1 AI 大模型的存储需求

3.4.2 主流存储技术的适用性

3.4.3 优化存储性能和成本的策略

3.5 并行加速技术

3.5.1 数据并行

3.5.2 张量并行

3.5.3 流水线并行

3.5.4 混合并行与使能技术

3.6 模型优化关键技术

3.6.1 模型压缩

3.6.2 提示词工程

3.6.3 RAG

3.7 资源管理与调度

3.7.1 异构算力管理与调度的挑战

3.7.2 异构算力管理与调度的关键技术

3.8 智能体

3.8.1 核心架构与关键组件

3.8.2 人机协同模式

3.8.3 主要应用场景与产业实践

3.9 AI安全

3.9.1 数据安全

3.9.2 模型安全

3.9.3 应用安全

第4章 智能算力基础设施的建设

4.1 总体架构

4.1.1 硬件层

4.1.2 软件层

4.1.3 平台服务层

4.1.4 业务系统层

4.1.5 运维管理层

4.2 网络建设方案

4.2.1 参数网络

4.2.2 存储网络

4.2.3 业务网络

4.2.4 管理网络

4.3 资源配置方案

4.3.1 GPU 服务器配置

4.3.2 存储资源配置

4.3.3 其他服务器资源

4.4 资源池管理方案

4.4.1 核心功能

4.4.2 资源池管理平台系统架构与技术选型

4.5 安全建设方案

4.5.1 资源池安全风险分析

4.5.2 资源池安全防护目标

4.5.3 纵深防御:分层安全建设方案与技术选型

4.6 AI平台建设方案

4.6.1 AI 平台的核心定位与功能

4.6.2 AI平台建设路径与技术栈选型

第5章 算力互联互通

5.1 算力网络

5.1.1 算力网络的背景

5.1.2 算力互联互通的核心需求

5.1.3 算力互联互通的流程机理

5.1.4 算力网络的参考架构

5.2 跨域算力调度系统

5.2.1 系统定位

5.2.2 功能架构

5.2.3 关键技术

5.3 算力网络的产业实践

5.3.1 电信运营商:网络的构建者与服务的主导者

5.3.2 设备与方案供应商:全栈技术的赋能者

5.3.3 云服务提供商:算力供给与平台创新的核心

5.4 算力网络的未来发展趋势

第6章 行业大模型构建与应用

6.1 行业大模型构建

6.1.1 行业需求分析与资源评估

6.1.2 行业数据与大模型共建

6.1.3 行业大模型微调与优化部署

6.2 行业大模型能力评价指标

6.2.1 行业大模型基础能力评估

6.2.2 行业大模型服务能力评估

6.3 DeepSeek大模型在银行系统部署的行业实践案例

6.3.1 挑战与需求分析

6.3.2 系统架构设计

6.3.3 系统部署与持续优化

6.3.4 成本估算

6.4 大模型应用面临的风险与应对措施

6.4.1 大模型的幻觉问题

6.4.2 信息安全及隐私风险

6.4.3 算法偏见与社会公平性挑战

第7章 超大规模集群展望

7.1 超大规模集群是通向更强AI的算力阶梯

7.2 超大规模集群面对的挑战与应对方案

7.2.1 应对功耗挑战:园区级部署与散热方案

7.2.2 应对网络挑战:超大规模拓扑设计策略

7.2.3 优化物理互连:布线方案与成本效益

7.2.4 保障系统稳定:可靠性设计与故障恢复

7.2.5 控制建设成本:网络技术选型与权衡

参考文献

累计评论(条) 个书友正在讨论这本书 发表评论

发表评论

发表评论,分享你的想法吧!

买过这本书的人还买过

读了这本书的人还在读

回顶部