英睿特 T 系列

T-RackScale V8 整柜级 AI 平台

智算中心 / 整柜 AI / 平台级客户

系统形态
整柜级 AI 平台,计算、网络、存储、供电和制冷按现场方案规划
CPU 平台
按整柜方案规划
GPU / 加速
GB200 / GB300 / 后续整柜平台项目制
内存范围
按整柜方案确认
存储方向
液冷 / 高速网络 / 集群管理按现场规划

部件选项、内存与存储需组合确认,不等同于固定标配。

适用负载与部署边界

适用方向

用于智算中心、平台级客户和大型科研平台的整柜级 AI 项目咨询入口,不作为普通标准 SKU。

  • 整柜级算力、网络、存储和集群管理一起规划
  • 平台级客户或科研平台有明确机房条件
  • 需要液冷、高速网络、集群软件和交付管理
  • 智算中心
  • 整柜 AI 平台
  • 大型科研平台
  • 平台级客户

需要另行评估

  • 单台服务器或部门级训练需求
  • 缺少现场供电、制冷、承重和网络规划
  • 只需要短期实验或轻量训练

单台服务器采购不应进入整柜方案;如果只需要 4/8 GPU 节点,先比较 T4 V8 / T8 V8。

重新判断平台方向
采购前确认
  • 现场供电、制冷、承重和网络
  • 整柜平台路线和交付周期
  • 集群管理、监控和调度
  • 数据中心验收标准和运维责任

关键规格与配置选项

公开目录选项不等同于已认证的任意组合。

确认配置
项目配置内容信息性质
CPU 平台按整柜方案目录选项
GPU / 加速选项GB200 方向项目确认 / GB300 方向项目确认 / 后续整柜平台目录选项
内存选项按项目方案目录选项
存储与网络方向液冷 / 高速网络 / 集群管理目录选项
固定标配当前平台目录未定义固定标配,以报价清单为准。项目确认
最大支持能力最大容量、数量与功耗需按具体部件、拓扑和散热条件确认。项目确认
尺寸、盘位与电源具体尺寸、物理盘位、电源型号与额定功率需在项目确认表中锁定。项目确认
配置沟通档位

用于讨论配置方向,不代表固定库存型号或最终报价。

评估档

整柜项目评估,先确认供电、制冷、承重、网络和安全边界

方案档

GB200 / GB300 / 后续整柜平台方向,计算、网络、存储、液冷和集群管理按项目规划

验收档

智算中心级项目,形成现场勘查、交付周期、验收项和运维责任清单

完整平台资料

平台规格与工程指导分开理解,最终以项目确认表为准。

7 组平台资料
处理器与平台
CPU 选项
按整柜方案规划
平台体系
项目制平台
可选平台
按整柜方案
平台定位
整柜级 AI 平台,按计算、网络、存储、供电和制冷整体规划
平台主板
项目制高互联 / 整柜 AI 平台,按厂商路线、机房条件和集群软件栈确认
芯片组/通道
训练服务器平台,重点确认 GPU 互联、PCIe/NVLink、网络和散热方案
系统环境
Linux 为主,PyTorch / TensorFlow / CUDA / Slurm / Kubernetes 可选
内存与扩展
内存范围
按整柜方案确认
可选内存
按项目方案
内存拓扑
ECC 大内存,容量按模型规模、数据预处理和多用户训练规划
容量建议
按整柜方案和节点规格确认,重点看模型规模、并发训练和集群调度
PCIe 扩展
整柜级互联拓扑,需确认计算柜、网络柜、存储层、管理网络、液冷/风冷和现场施工边界
GPU 与加速
GPU 方向
GB200 / GB300 / 后续整柜平台项目制
可选 GPU
GB200 方向项目确认 / GB300 方向项目确认 / 后续整柜平台
拓扑/数量
GB200 / GB300 / 后续整柜平台项目方向,按厂商路线、供货窗口和现场条件确认
供电关注
训练 GPU 满载时间长,需同步核算机柜供电、散热、线缆和冗余策略
适配软件
CUDA / NCCL / Slurm / Kubernetes / 集群监控
存储与数据
存储策略
液冷 / 高速网络 / 集群管理按现场规划
可选存储
液冷 / 高速网络 / 集群管理
盘位/缓存
整柜训练数据路径规划,通常需要高速缓存层、共享存储和容量层配合
数据分层
建议训练热数据落在本地 NVMe 或高速共享存储,冷数据进入容量层
保护策略
按实验数据、模型 checkpoint、日志和数据集版本规划备份策略
网络与管理
网络选项
按整柜互联、存储网络、管理网络和外部接入网络分层规划
远程管理
带外管理、CUDA/NCCL/容器/调度环境交付
安全策略
支持多用户实验环境、容器镜像、数据权限和内网训练平台策略
部署运维
可提供 CUDA/NCCL/驱动版本、容器镜像建议、训练环境交付说明和测试记录
机箱电源散热
机箱形态
整柜级 AI 平台,计算、网络、存储、供电和制冷按现场方案规划
电源策略
必须基于现场配电、PDU、承重、制冷和机房条件做项目级评估
散热验证
液冷/风冷方案按整柜平台要求、机房条件和交付周期确认
部署环境
训练平台建议机房部署;高密度 GPU 需提前确认供电、制冷和承重
交付边界
项目制整柜级 AI 平台
交付与支持
交付周期
按整柜项目周期确认
满载验证
建议按整柜交付流程验证集群管理、调度、网络、存储、训练样例和监控告警
交付资料
可提供 CUDA/NCCL/驱动版本、容器镜像建议、训练环境交付说明和测试记录
项目说明
具体品牌、料号、尺寸、盘位和电源型号以最终报价单与项目确认表为准

软件与工作流

CUDA

驱动版本、GPU 架构、容器环境

查看软件选型

NCCL

按版本、数据规模和插件确认硬件瓶颈

查看软件选型

Slurm

调度、节点、网络与用户策略

查看软件选型

Kubernetes

容器编排、网络、存储插件

查看软件选型

集群监控

按版本、数据规模和插件确认硬件瓶颈

查看软件选型

交付前一起确认

训练平台条件

确认高功率 GPU 供电、制冷、网络互联、数据路径和调度环境。

数据路径

确认本地盘、项目盘、共享存储、备份和数据不落地要求。

交付验证

交付前建议记录驱动版本、系统环境、满载测试和基础软件验证结果。

按整柜项目周期确认。具体交付范围、周期及服务条款以项目确认与合同为准。

获取配置建议

同系列其他平台

查看本系列

从您的工作负载开始

软件、数据规模、预算与部署条件,都是配置沟通的起点。

获取配置建议