英睿特 K 系列

K-I8 V1 昇腾推理服务器

国产 AI 推理 / RAG / 知识库 / 视觉识别

系统形态
国产 AI 推理服务器
CPU 平台
4 个鲲鹏 920 处理器
GPU / 加速
8 模组昇腾推理加速方向,可选 NPU 全互联
内存范围
32 个 DDR4 内存插槽,最高 3200MT/s
存储方向
8 * 2.5 SATA + 2 * 2.5 NVMe,或 4 * 2.5 SATA + 6 * 2.5 NVMe

部件选项、内存与存储需组合确认,不等同于固定标配。

适用负载与部署边界

适用方向

面向政企知识库、RAG、视觉识别和国产 AI 服务化部署的昇腾推理平台,重点确认模型框架、算子适配和并发吞吐。

  • 国产 AI 推理、知识库和 RAG 服务
  • 模型可适配 CANN/MindIE 或已有昇腾生态方案
  • 需要政企内网部署、权限和国产化验收
  • 政企知识库
  • RAG 推理
  • 视觉识别
  • 国产 AI 服务

需要另行评估

  • 要求 NVIDIA CUDA 生态无改造迁移
  • 未确认模型、算子或框架能适配昇腾
  • 只做普通业务服务器或低并发轻量服务

如果重点是训练或微调,应比较 K-T8;如果要求 CUDA/NVIDIA 软件栈,应转 G/T 系列重新评估。

重新判断平台方向
采购前确认
  • 模型来源和框架
  • CANN/MindIE 版本
  • 并发/QPS/上下文长度
  • 向量库、知识库数据路径和验收样例

关键规格与配置选项

公开目录选项不等同于已认证的任意组合。

确认配置
项目配置内容信息性质
CPU 平台4 * 鲲鹏 920 / 按供货版本确认目录选项
GPU / 加速选项8 模组昇腾推理方向 / 可选 NPU 全互联机型 / 整机互联带宽 392GB/s目录选项
内存选项32 个 DDR4 内存插槽 / 最高 3200MT/s / 单根 16/32/64GB目录选项
存储与网络方向8 * 2.5 SATA + 2 * 2.5 NVMe / 4 * 2.5 SATA + 6 * 2.5 NVMe / 8 * 200GE QSFP RoCE目录选项
固定标配当前平台目录未定义固定标配,以报价清单为准。项目确认
最大支持能力最大容量、数量与功耗需按具体部件、拓扑和散热条件确认。项目确认
尺寸、盘位与电源具体尺寸、物理盘位、电源型号与额定功率需在项目确认表中锁定。项目确认
配置沟通档位

用于讨论配置方向,不代表固定库存型号或最终报价。

标准档

4U 昇腾推理平台,4 * 鲲鹏 920,32 个 DDR4 插槽,NVMe 向量库/缓存盘,CANN/MindIE 基础环境

主力档

8 模组昇腾推理方向,可选 NPU 全互联,8 * 200GE RoCE,模型适配与并发验证

项目档

政企知识库、国产大模型推理、视觉识别和多部门 AI 服务平台

完整平台资料

平台规格与工程指导分开理解,最终以项目确认表为准。

7 组平台资料
处理器与平台
CPU 选项
4 个鲲鹏 920 处理器
平台体系
昇腾平台
可选平台
4 * 鲲鹏 920 / 按供货版本确认
平台定位
4 个鲲鹏 920 处理器,面向国产大模型推理、RAG、知识库和视觉识别服务
平台主板
4U AI 推理服务器底座,采用 8 模组高效推理方向,按 CANN/MindIE、模型框架和并发吞吐确认
芯片组/通道
鲲鹏 920 + 昇腾 AI 推理加速平台,需确认 CANN、驱动固件、模型算子和精度边界
系统环境
openEuler / 麒麟 / 统信 / EulerOS / Linux 发行版按客户信创要求确认
内存与扩展
内存范围
32 个 DDR4 内存插槽,最高 3200MT/s
可选内存
32 个 DDR4 内存插槽 / 最高 3200MT/s / 单根 16/32/64GB
内存拓扑
32 个 DDR4 内存插槽,最高 3200 MT/s,单根内存条容量支持 16/32/64GB
容量建议
建议从 512GB 起步,RAG/知识库、向量库和多模型并发建议按 1TB+ ECC 规划
PCIe 扩展
最多支持 3 个 PCIe 4.0 扩展插槽
GPU 与加速
GPU 方向
8 模组昇腾推理加速方向,可选 NPU 全互联
可选 GPU
8 模组昇腾推理方向 / 可选 NPU 全互联机型 / 整机互联带宽 392GB/s
拓扑/数量
8 模组昇腾推理加速方向,可选 NPU 全互联机型,整机互联带宽 392GB/s
供电关注
AI 加速平台需核算整机满载功耗、冗余电源、机柜 PDU、进风温度和散热余量
适配软件
CANN / MindIE / MindSpore / PyTorch 适配 / 向量数据库
存储与数据
存储策略
8 * 2.5 SATA + 2 * 2.5 NVMe,或 4 * 2.5 SATA + 6 * 2.5 NVMe
可选存储
8 * 2.5 SATA + 2 * 2.5 NVMe / 4 * 2.5 SATA + 6 * 2.5 NVMe / 8 * 200GE QSFP RoCE
盘位/缓存
本地存储可选 8 * 2.5 SATA + 2 * 2.5 NVMe,或 4 * 2.5 SATA + 6 * 2.5 NVMe
数据分层
支持 RAID 0/1/10/5/50/6/60,建议系统盘、向量库盘、模型盘和日志盘分离
保护策略
按政企数据安全、快照、备份、权限审计和国产化平台运维要求规划
网络与管理
网络选项
8 * 200GE QSFP 接口直出,RoCE 协议方向,需同步确认交换机和端到端吞吐
远程管理
带外管理、国产 OS 镜像、驱动/固件版本、容器镜像和平台运维清单按项目交付
安全策略
重点确认国产操作系统、数据库、中间件、虚拟化、容器和安全软件的兼容认证
部署运维
可提供国产化兼容性确认清单、配置方案、驱动/固件版本、基础测试记录和验收建议
机箱电源散热
机箱形态
国产 AI 推理服务器
电源策略
4 个热插拔 2.6kW 电源模块,支持 2+2 冗余;供电支持 200-240V AC、240V DC
散热验证
4U AI 推理节点需验证 NPU、CPU、NVMe、网卡和满载推理温度
部署环境
建议部署在机房或设备间,国产 AI 平台和多节点项目需提前确认供电、制冷和承重
交付边界
昇腾 AI 推理与知识库平台
交付与支持
交付周期
按昇腾加速卡供应、模型适配、CANN/MindIE 环境和验收样例确认
满载验证
建议验证 CANN/MindIE、模型加载、RAG 并发、NPU 互联、RoCE 网络、日志和告警
交付资料
可提供国产化兼容性确认清单、配置方案、驱动/固件版本、基础测试记录和验收建议
项目说明
以上参数依据公开平台资料与英睿特产品规划整理,具体部件版本、供货状态、兼容认证和交付配置以项目确认表与正式报价单为准

软件与工作流

CANN

按版本、数据规模和插件确认硬件瓶颈

查看软件选型

MindIE

按版本、数据规模和插件确认硬件瓶颈

查看软件选型

MindSpore

按版本、数据规模和插件确认硬件瓶颈

查看软件选型

PyTorch 适配

按版本、数据规模和插件确认硬件瓶颈

查看软件选型

向量数据库

按版本、数据规模和插件确认硬件瓶颈

查看软件选型

交付前一起确认

国产环境与迁移

模型来源和框架;CANN/MindIE 版本;并发/QPS/上下文长度;向量库、知识库数据路径和验收样例

数据路径

确认本地盘、项目盘、共享存储、备份和数据不落地要求。

交付验证

交付前建议记录驱动版本、系统环境、满载测试和基础软件验证结果。

按昇腾加速卡供应、模型适配、CANN/MindIE 环境和验收样例确认。具体交付范围、周期及服务条款以项目确认与合同为准。

获取配置建议

同系列其他平台

查看本系列

从您的工作负载开始

软件、数据规模、预算与部署条件,都是配置沟通的起点。

获取配置建议
英睿特 K-I8 V1 昇腾推理服务器 平台图产品图

平台图 · 实际部件与配置以项目确认表为准。