华为 Atlas 800I A2 大模型部署实战(七):完整的安装部署流程
这份指南详细阐述了华为Atlas 800I A2推理服务器上大型模型的部署流程,旨在提供一个全面的安装与配置实践,用于扩展部署到其它服务器。随后,文章通过流程图和具体命令脚本,逐步指导用户如何创建和挂载逻辑卷、同步并安装驱动固件、部署Docker环境以及导入所需的MindIE和vLLM镜像。最后,指南还涵盖了同步大型模型权重文件的关键步骤,并指示用户通过Docker Compose启动模型服务,确保MindIE和vLLM能够顺利运行,以实现AI推理功能。
服务器配置
AI 服务器:华为 Atlas 800I A2 推理服务器
| 组件 | 规格 |
|---|---|
| CPU | 鲲鹏 920(5250) |
| NPU | 昇腾 910B4(8X32G) |
| 内存 | 1024GB |
| 硬盘 | 系统盘:450GB SSDX2 RAID1 数据盘:3.5TB NVME SSDX4 |
| 操作系统 | openEuler 22.03 LTS |
完整安装部署流程

graph TD
subgraph 主机 - 172.16.33.106
A[② 同步驱动、固件、MCU、推理引擎] --> B{等待同步完成};
C[⑥ 同步大模型权重] --> D{等待同步完成};
B ~~~ C
end
subgraph 构建 AI Stack - Atlas 800I A2 服务器
E[① 创建逻辑卷并挂载到 /data] --> F[② 主机同步:驱动、固件、MCU、推理引擎];
F --> G[③ 安装驱动/固件并升级 MCU];
G --> H[④ 安装 Docker];
H --> I[⑤ 导入镜像:MindIE 和 vLLM];
I --> J[⑥ 主机同步:大模型权重];
J --> K[⑦ 部署 LLM:MindIE 和 vLLM];
end
B -- 同步完成 --> F;
D -- 同步完成 --> J;
%% Style Definitions
classDef hostSync fill:#E0BBE4,stroke:#8A2BE2,stroke-width:2px;
classDef hostWait fill:#F58DAD,stroke:#5D3FD3,stroke-width:2px;
classDef serverConfig fill:#FFC72C,stroke:#B8860B,stroke-width:2px;
classDef serverInstall fill:#7ED956,stroke:#3CB371,stroke-width:2px;
class A,C,F,J hostSync;
class B,D hostWait;
class E,G,H serverConfig;
class I,K serverInstall;
① 创建逻辑卷
