
沿用目录平台参考图,不作为具体部件、接口和盘位的交付依据;实际配置以项目确认表为准。
英睿特 T 系列
T8X V8 高互联 AI 训练服务器
高端训练 / 多机扩展 / 科研平台
- 系统形态
- OAM / HGX 高互联 AI 训练服务器,机箱形态按 GPU 平台和项目方案确认
- CPU 平台
- 项目制高互联训练主机平台
- GPU / 加速
- 8x OAM / HGX H200 / B200 级高互联 GPU,按项目确认
- 内存范围
- 2TB+ ECC
- 存储方向
- 高速 NVMe + InfiniBand / 集群存储
部件选项、内存与存储需组合确认,不等同于固定标配。
适用负载与部署边界
适用方向
面向高端 AI 训练、模型公司和科研平台的高互联项目制训练服务器,必须先做方案评估。
- 需要 NVLink/NVSwitch 或 HGX 方向的高互联训练
- 多机扩展、NCCL 通信和科研训练平台
- 客户愿意以真实训练任务定义验收指标
- 高端训练
- 多机扩展
- 科研平台
- 模型公司项目
需要另行评估
- 普通 4/8 GPU 训练节点即可满足的项目
- 推理、渲染或转码为主的 GPU 负载
- 现场供电、制冷、网络和预算尚未明确
如果没有明确训练框架、互联需求和预算边界,不建议直接进入 T8X。
重新判断平台方向采购前确认
- GPU 互联路线和供应周期
- NCCL/IB/集群拓扑
- 训练数据与共享存储
- 机房供电、制冷和验收样例
关键规格与配置选项
公开目录选项不等同于已认证的任意组合。
| 项目 | 配置内容 | 信息性质 |
|---|---|---|
| CPU 平台 | 高互联训练主机平台 / HGX 主机平台 / 按项目确认 CPU 版本 | 目录选项 |
| GPU / 加速选项 | OAM GPU 项目确认 / HGX H200 项目确认 / HGX B200 项目确认 / NVLink / NVSwitch 拓扑确认 | 目录选项 |
| 内存选项 | 2TB+ ECC | 目录选项 |
| 存储与网络方向 | 高速 NVMe / InfiniBand / 集群存储接入 | 目录选项 |
| 固定标配 | 当前平台目录未定义固定标配,以报价清单为准。 | 项目确认 |
| 最大支持能力 | 最大容量、数量与功耗需按具体部件、拓扑和散热条件确认。 | 项目确认 |
| 尺寸、盘位与电源 | 具体尺寸、物理盘位、电源型号与额定功率需在项目确认表中锁定。 | 项目确认 |
配置沟通档位
用于讨论配置方向,不代表固定库存型号或最终报价。
评估档
HGX / 高互联平台,2TB ECC,高速 NVMe
方案档
HGX H200 / B200 级互联,IB 网络,集群软件栈,按项目确认
验收档
高端 AI 训练、科研平台、模型公司项目,需确认预算、供电、制冷、网络和交付周期
完整平台资料
平台规格与工程指导分开理解,最终以项目确认表为准。
7 组平台资料
处理器与平台
- CPU 选项
- 项目制高互联训练主机平台
- 平台体系
- 项目制平台
- 可选平台
- 高互联训练主机平台 / HGX 主机平台 / 按项目确认 CPU 版本
- 平台定位
- 高互联 AI 训练平台,面向 OAM / HGX / NVLink / NVSwitch 项目咨询,不等同普通 PCIe 8 GPU 节点
- 平台主板
- 项目制高互联 / 整柜 AI 平台,按厂商路线、机房条件和集群软件栈确认
- 芯片组/通道
- 训练服务器平台,重点确认 GPU 互联、PCIe/NVLink、网络和散热方案
- 系统环境
- Linux 为主,PyTorch / TensorFlow / CUDA / Slurm / Kubernetes 可选
内存与扩展
- 内存范围
- 2TB+ ECC
- 可选内存
- 2TB+ ECC
- 内存拓扑
- ECC 大内存,容量按模型规模、数据预处理和多用户训练规划
- 容量建议
- 建议 2TB+ ECC,按模型规模、数据管线和多机训练策略确认
- PCIe 扩展
- OAM / HGX 高互联拓扑,需确认 GPU 模组路线、CPU 平台、网络插卡、管理节点和供货窗口
GPU 与加速
- GPU 方向
- 8x OAM / HGX H200 / B200 级高互联 GPU,按项目确认
- 可选 GPU
- OAM GPU 项目确认 / HGX H200 项目确认 / HGX B200 项目确认 / NVLink / NVSwitch 拓扑确认
- 拓扑/数量
- OAM / HGX H200 / B200 级高互联项目方向,重点确认 NVLink/NVSwitch、NCCL 和集群拓扑
- 供电关注
- 训练 GPU 满载时间长,需同步核算机柜供电、散热、线缆和冗余策略
- 适配软件
- PyTorch / CUDA / NCCL / Slurm / Kubernetes
存储与数据
- 存储策略
- 高速 NVMe + InfiniBand / 集群存储
- 可选存储
- 高速 NVMe / InfiniBand / 集群存储接入
- 盘位/缓存
- 高速 NVMe + InfiniBand / 集群存储接入,按训练数据路径设计
- 数据分层
- 建议训练热数据落在本地 NVMe 或高速共享存储,冷数据进入容量层
- 保护策略
- 按实验数据、模型 checkpoint、日志和数据集版本规划备份策略
网络与管理
- 网络选项
- InfiniBand 或 400GbE 方向,按多机训练通信和存储访问拆分网络
- 远程管理
- 带外管理、CUDA/NCCL/容器/调度环境交付
- 安全策略
- 支持多用户实验环境、容器镜像、数据权限和内网训练平台策略
- 部署运维
- 可提供 CUDA/NCCL/驱动版本、容器镜像建议、训练环境交付说明和测试记录
机箱电源散热
- 机箱形态
- OAM / HGX 高互联 AI 训练服务器,机箱形态按 GPU 平台和项目方案确认
- 电源策略
- 高互联训练平台需结合机柜供电、液冷/风冷、PDU 和现场条件规划
- 散热验证
- 建议按机房制冷能力、液冷条件、GPU 平台要求和满载测试共同确认
- 部署环境
- 训练平台建议机房部署;高密度 GPU 需提前确认供电、制冷和承重
- 交付边界
- 项目制高互联 AI 训练平台
交付与支持
- 交付周期
- 项目评估后确认
- 满载验证
- 建议验证 NCCL、分布式训练样例、GPU 互联、IB/高速网络、集群调度和故障告警
- 交付资料
- 可提供 CUDA/NCCL/驱动版本、容器镜像建议、训练环境交付说明和测试记录
- 项目说明
- 具体品牌、料号、尺寸、盘位和电源型号以最终报价单与项目确认表为准
软件与工作流
交付前一起确认
训练平台条件
确认高功率 GPU 供电、制冷、网络互联、数据路径和调度环境。
数据路径
确认本地盘、项目盘、共享存储、备份和数据不落地要求。
交付验证
交付前建议记录驱动版本、系统环境、满载测试和基础软件验证结果。
项目评估后确认。具体交付范围、周期及服务条款以项目确认与合同为准。
同系列其他平台
查看本系列从您的工作负载开始
软件、数据规模、预算与部署条件,都是配置沟通的起点。



