
沿用目录平台参考图,不作为具体部件、接口和盘位的交付依据;实际配置以项目确认表为准。
英睿特 K 系列
K-I8 V1 昇腾推理服务器
国产 AI 推理 / RAG / 知识库 / 视觉识别
- 系统形态
- 国产 AI 推理服务器
- CPU 平台
- 4 个鲲鹏 920 处理器
- GPU / 加速
- 8 模组昇腾推理加速方向,可选 NPU 全互联
- 内存范围
- 32 个 DDR4 内存插槽,最高 3200MT/s
- 存储方向
- 8 * 2.5 SATA + 2 * 2.5 NVMe,或 4 * 2.5 SATA + 6 * 2.5 NVMe
部件选项、内存与存储需组合确认,不等同于固定标配。
适用负载与部署边界
适用方向
面向政企知识库、RAG、视觉识别和国产 AI 服务化部署的昇腾推理平台,重点确认模型框架、算子适配和并发吞吐。
- 国产 AI 推理、知识库和 RAG 服务
- 模型可适配 CANN/MindIE 或已有昇腾生态方案
- 需要政企内网部署、权限和国产化验收
- 政企知识库
- RAG 推理
- 视觉识别
- 国产 AI 服务
需要另行评估
- 要求 NVIDIA CUDA 生态无改造迁移
- 未确认模型、算子或框架能适配昇腾
- 只做普通业务服务器或低并发轻量服务
如果重点是训练或微调,应比较 K-T8;如果要求 CUDA/NVIDIA 软件栈,应转 G/T 系列重新评估。
重新判断平台方向采购前确认
- 模型来源和框架
- CANN/MindIE 版本
- 并发/QPS/上下文长度
- 向量库、知识库数据路径和验收样例
关键规格与配置选项
公开目录选项不等同于已认证的任意组合。
| 项目 | 配置内容 | 信息性质 |
|---|---|---|
| CPU 平台 | 4 * 鲲鹏 920 / 按供货版本确认 | 目录选项 |
| GPU / 加速选项 | 8 模组昇腾推理方向 / 可选 NPU 全互联机型 / 整机互联带宽 392GB/s | 目录选项 |
| 内存选项 | 32 个 DDR4 内存插槽 / 最高 3200MT/s / 单根 16/32/64GB | 目录选项 |
| 存储与网络方向 | 8 * 2.5 SATA + 2 * 2.5 NVMe / 4 * 2.5 SATA + 6 * 2.5 NVMe / 8 * 200GE QSFP RoCE | 目录选项 |
| 固定标配 | 当前平台目录未定义固定标配,以报价清单为准。 | 项目确认 |
| 最大支持能力 | 最大容量、数量与功耗需按具体部件、拓扑和散热条件确认。 | 项目确认 |
| 尺寸、盘位与电源 | 具体尺寸、物理盘位、电源型号与额定功率需在项目确认表中锁定。 | 项目确认 |
配置沟通档位
用于讨论配置方向,不代表固定库存型号或最终报价。
标准档
4U 昇腾推理平台,4 * 鲲鹏 920,32 个 DDR4 插槽,NVMe 向量库/缓存盘,CANN/MindIE 基础环境
主力档
8 模组昇腾推理方向,可选 NPU 全互联,8 * 200GE RoCE,模型适配与并发验证
项目档
政企知识库、国产大模型推理、视觉识别和多部门 AI 服务平台
完整平台资料
平台规格与工程指导分开理解,最终以项目确认表为准。
7 组平台资料
处理器与平台
- CPU 选项
- 4 个鲲鹏 920 处理器
- 平台体系
- 昇腾平台
- 可选平台
- 4 * 鲲鹏 920 / 按供货版本确认
- 平台定位
- 4 个鲲鹏 920 处理器,面向国产大模型推理、RAG、知识库和视觉识别服务
- 平台主板
- 4U AI 推理服务器底座,采用 8 模组高效推理方向,按 CANN/MindIE、模型框架和并发吞吐确认
- 芯片组/通道
- 鲲鹏 920 + 昇腾 AI 推理加速平台,需确认 CANN、驱动固件、模型算子和精度边界
- 系统环境
- openEuler / 麒麟 / 统信 / EulerOS / Linux 发行版按客户信创要求确认
内存与扩展
- 内存范围
- 32 个 DDR4 内存插槽,最高 3200MT/s
- 可选内存
- 32 个 DDR4 内存插槽 / 最高 3200MT/s / 单根 16/32/64GB
- 内存拓扑
- 32 个 DDR4 内存插槽,最高 3200 MT/s,单根内存条容量支持 16/32/64GB
- 容量建议
- 建议从 512GB 起步,RAG/知识库、向量库和多模型并发建议按 1TB+ ECC 规划
- PCIe 扩展
- 最多支持 3 个 PCIe 4.0 扩展插槽
GPU 与加速
- GPU 方向
- 8 模组昇腾推理加速方向,可选 NPU 全互联
- 可选 GPU
- 8 模组昇腾推理方向 / 可选 NPU 全互联机型 / 整机互联带宽 392GB/s
- 拓扑/数量
- 8 模组昇腾推理加速方向,可选 NPU 全互联机型,整机互联带宽 392GB/s
- 供电关注
- AI 加速平台需核算整机满载功耗、冗余电源、机柜 PDU、进风温度和散热余量
- 适配软件
- CANN / MindIE / MindSpore / PyTorch 适配 / 向量数据库
存储与数据
- 存储策略
- 8 * 2.5 SATA + 2 * 2.5 NVMe,或 4 * 2.5 SATA + 6 * 2.5 NVMe
- 可选存储
- 8 * 2.5 SATA + 2 * 2.5 NVMe / 4 * 2.5 SATA + 6 * 2.5 NVMe / 8 * 200GE QSFP RoCE
- 盘位/缓存
- 本地存储可选 8 * 2.5 SATA + 2 * 2.5 NVMe,或 4 * 2.5 SATA + 6 * 2.5 NVMe
- 数据分层
- 支持 RAID 0/1/10/5/50/6/60,建议系统盘、向量库盘、模型盘和日志盘分离
- 保护策略
- 按政企数据安全、快照、备份、权限审计和国产化平台运维要求规划
网络与管理
- 网络选项
- 8 * 200GE QSFP 接口直出,RoCE 协议方向,需同步确认交换机和端到端吞吐
- 远程管理
- 带外管理、国产 OS 镜像、驱动/固件版本、容器镜像和平台运维清单按项目交付
- 安全策略
- 重点确认国产操作系统、数据库、中间件、虚拟化、容器和安全软件的兼容认证
- 部署运维
- 可提供国产化兼容性确认清单、配置方案、驱动/固件版本、基础测试记录和验收建议
机箱电源散热
- 机箱形态
- 国产 AI 推理服务器
- 电源策略
- 4 个热插拔 2.6kW 电源模块,支持 2+2 冗余;供电支持 200-240V AC、240V DC
- 散热验证
- 4U AI 推理节点需验证 NPU、CPU、NVMe、网卡和满载推理温度
- 部署环境
- 建议部署在机房或设备间,国产 AI 平台和多节点项目需提前确认供电、制冷和承重
- 交付边界
- 昇腾 AI 推理与知识库平台
交付与支持
- 交付周期
- 按昇腾加速卡供应、模型适配、CANN/MindIE 环境和验收样例确认
- 满载验证
- 建议验证 CANN/MindIE、模型加载、RAG 并发、NPU 互联、RoCE 网络、日志和告警
- 交付资料
- 可提供国产化兼容性确认清单、配置方案、驱动/固件版本、基础测试记录和验收建议
- 项目说明
- 以上参数依据公开平台资料与英睿特产品规划整理,具体部件版本、供货状态、兼容认证和交付配置以项目确认表与正式报价单为准
软件与工作流
交付前一起确认
国产环境与迁移
模型来源和框架;CANN/MindIE 版本;并发/QPS/上下文长度;向量库、知识库数据路径和验收样例
数据路径
确认本地盘、项目盘、共享存储、备份和数据不落地要求。
交付验证
交付前建议记录驱动版本、系统环境、满载测试和基础软件验证结果。
按昇腾加速卡供应、模型适配、CANN/MindIE 环境和验收样例确认。具体交付范围、周期及服务条款以项目确认与合同为准。
同系列其他平台
查看本系列从您的工作负载开始
软件、数据规模、预算与部署条件,都是配置沟通的起点。



