英睿特 T 系列

T8X V8 高互联 AI 训练服务器

高端训练 / 多机扩展 / 科研平台

系统形态
OAM / HGX 高互联 AI 训练服务器,机箱形态按 GPU 平台和项目方案确认
CPU 平台
项目制高互联训练主机平台
GPU / 加速
8x OAM / HGX H200 / B200 级高互联 GPU,按项目确认
内存范围
2TB+ ECC
存储方向
高速 NVMe + InfiniBand / 集群存储

部件选项、内存与存储需组合确认,不等同于固定标配。

适用负载与部署边界

适用方向

面向高端 AI 训练、模型公司和科研平台的高互联项目制训练服务器,必须先做方案评估。

  • 需要 NVLink/NVSwitch 或 HGX 方向的高互联训练
  • 多机扩展、NCCL 通信和科研训练平台
  • 客户愿意以真实训练任务定义验收指标
  • 高端训练
  • 多机扩展
  • 科研平台
  • 模型公司项目

需要另行评估

  • 普通 4/8 GPU 训练节点即可满足的项目
  • 推理、渲染或转码为主的 GPU 负载
  • 现场供电、制冷、网络和预算尚未明确

如果没有明确训练框架、互联需求和预算边界,不建议直接进入 T8X。

重新判断平台方向
采购前确认
  • GPU 互联路线和供应周期
  • NCCL/IB/集群拓扑
  • 训练数据与共享存储
  • 机房供电、制冷和验收样例

关键规格与配置选项

公开目录选项不等同于已认证的任意组合。

确认配置
项目配置内容信息性质
CPU 平台高互联训练主机平台 / HGX 主机平台 / 按项目确认 CPU 版本目录选项
GPU / 加速选项OAM GPU 项目确认 / HGX H200 项目确认 / HGX B200 项目确认 / NVLink / NVSwitch 拓扑确认目录选项
内存选项2TB+ ECC目录选项
存储与网络方向高速 NVMe / InfiniBand / 集群存储接入目录选项
固定标配当前平台目录未定义固定标配,以报价清单为准。项目确认
最大支持能力最大容量、数量与功耗需按具体部件、拓扑和散热条件确认。项目确认
尺寸、盘位与电源具体尺寸、物理盘位、电源型号与额定功率需在项目确认表中锁定。项目确认
配置沟通档位

用于讨论配置方向,不代表固定库存型号或最终报价。

评估档

HGX / 高互联平台,2TB ECC,高速 NVMe

方案档

HGX H200 / B200 级互联,IB 网络,集群软件栈,按项目确认

验收档

高端 AI 训练、科研平台、模型公司项目,需确认预算、供电、制冷、网络和交付周期

完整平台资料

平台规格与工程指导分开理解,最终以项目确认表为准。

7 组平台资料
处理器与平台
CPU 选项
项目制高互联训练主机平台
平台体系
项目制平台
可选平台
高互联训练主机平台 / HGX 主机平台 / 按项目确认 CPU 版本
平台定位
高互联 AI 训练平台,面向 OAM / HGX / NVLink / NVSwitch 项目咨询,不等同普通 PCIe 8 GPU 节点
平台主板
项目制高互联 / 整柜 AI 平台,按厂商路线、机房条件和集群软件栈确认
芯片组/通道
训练服务器平台,重点确认 GPU 互联、PCIe/NVLink、网络和散热方案
系统环境
Linux 为主,PyTorch / TensorFlow / CUDA / Slurm / Kubernetes 可选
内存与扩展
内存范围
2TB+ ECC
可选内存
2TB+ ECC
内存拓扑
ECC 大内存,容量按模型规模、数据预处理和多用户训练规划
容量建议
建议 2TB+ ECC,按模型规模、数据管线和多机训练策略确认
PCIe 扩展
OAM / HGX 高互联拓扑,需确认 GPU 模组路线、CPU 平台、网络插卡、管理节点和供货窗口
GPU 与加速
GPU 方向
8x OAM / HGX H200 / B200 级高互联 GPU,按项目确认
可选 GPU
OAM GPU 项目确认 / HGX H200 项目确认 / HGX B200 项目确认 / NVLink / NVSwitch 拓扑确认
拓扑/数量
OAM / HGX H200 / B200 级高互联项目方向,重点确认 NVLink/NVSwitch、NCCL 和集群拓扑
供电关注
训练 GPU 满载时间长,需同步核算机柜供电、散热、线缆和冗余策略
适配软件
PyTorch / CUDA / NCCL / Slurm / Kubernetes
存储与数据
存储策略
高速 NVMe + InfiniBand / 集群存储
可选存储
高速 NVMe / InfiniBand / 集群存储接入
盘位/缓存
高速 NVMe + InfiniBand / 集群存储接入,按训练数据路径设计
数据分层
建议训练热数据落在本地 NVMe 或高速共享存储,冷数据进入容量层
保护策略
按实验数据、模型 checkpoint、日志和数据集版本规划备份策略
网络与管理
网络选项
InfiniBand 或 400GbE 方向,按多机训练通信和存储访问拆分网络
远程管理
带外管理、CUDA/NCCL/容器/调度环境交付
安全策略
支持多用户实验环境、容器镜像、数据权限和内网训练平台策略
部署运维
可提供 CUDA/NCCL/驱动版本、容器镜像建议、训练环境交付说明和测试记录
机箱电源散热
机箱形态
OAM / HGX 高互联 AI 训练服务器,机箱形态按 GPU 平台和项目方案确认
电源策略
高互联训练平台需结合机柜供电、液冷/风冷、PDU 和现场条件规划
散热验证
建议按机房制冷能力、液冷条件、GPU 平台要求和满载测试共同确认
部署环境
训练平台建议机房部署;高密度 GPU 需提前确认供电、制冷和承重
交付边界
项目制高互联 AI 训练平台
交付与支持
交付周期
项目评估后确认
满载验证
建议验证 NCCL、分布式训练样例、GPU 互联、IB/高速网络、集群调度和故障告警
交付资料
可提供 CUDA/NCCL/驱动版本、容器镜像建议、训练环境交付说明和测试记录
项目说明
具体品牌、料号、尺寸、盘位和电源型号以最终报价单与项目确认表为准

软件与工作流

PyTorch

CUDA、显存、数据吞吐

查看软件选型

CUDA

驱动版本、GPU 架构、容器环境

查看软件选型

NCCL

按版本、数据规模和插件确认硬件瓶颈

查看软件选型

Slurm

调度、节点、网络与用户策略

查看软件选型

Kubernetes

容器编排、网络、存储插件

查看软件选型

交付前一起确认

训练平台条件

确认高功率 GPU 供电、制冷、网络互联、数据路径和调度环境。

数据路径

确认本地盘、项目盘、共享存储、备份和数据不落地要求。

交付验证

交付前建议记录驱动版本、系统环境、满载测试和基础软件验证结果。

项目评估后确认。具体交付范围、周期及服务条款以项目确认与合同为准。

获取配置建议

同系列其他平台

查看本系列

从您的工作负载开始

软件、数据规模、预算与部署条件,都是配置沟通的起点。

获取配置建议
英睿特 T8X V8 高互联 AI 训练服务器 平台图产品图

平台图 · 实际部件与配置以项目确认表为准。