私有化部署 · PRIVATE DEPLOYMENT

全栈私有化部署,
数据不出域

应用、大模型推理、异构算力调度、数据库与对象存储全部运行在本单位服务器上,不依赖任何第三方云服务;支持完全离线安装与升级,适配信创环境。

01 — 部署形态

一套 K3s 集群,
承载应用、模型、算力与存储

云原生微服务架构支持单机与多节点集群;应用服务、模型推理、算力调度、数据库和对象存储作为一个整体交付。

全栈私有化

前端、API 网关、业务微服务、MySQL 数据库与 MinIO 对象存储,基于 K3s 云原生集群一体交付,全部运行在您的内网。

自有大模型推理

内置 vLLM 推理引擎与统一模型路由,兼容主流开源大模型;交互问答优先调度,批量任务后台错峰执行。

私有异构算力调度平台

在同一后台管理 GPU、NPU、资源池、镜像、实例、存储与模型服务,为不同 AI 工作负载配置资源策略。

统一镜像分发与持久

集群内镜像分发减少逐节点导入;自定义镜像保存到 MinIO 持久面,节点重装后可按备份恢复。

完全离线交付

离线安装包内含全部镜像与依赖,配合专用装机工具完成装系统、建集群、启 GPU——不依赖外网,升级同样离线完成。

信创与国产化适配

兼容统信 UOS、麒麟等国产操作系统与浏览器环境(含较老内核版本),可接入既有信创基础设施,无需升级终端设备。

  • 数据不出域
  • 无外网依赖
  • K3s 云原生
  • vLLM 推理
  • 异构算力调度
  • 信创国产化
02 — 算力与运维

算力资源、环境与实例
在同一管理面统一运维

从设备纳管、资源池划分到镜像、实例和运行监测,管理员可以在一个入口掌握资源容量、使用状态与访问边界。

算力节点、GPU 运行监测、镜像实例与诊断日志协同管理的设备示意

节点与加速卡纳管

集中展示计算节点、GPU / NPU 类型、数量、可分配资源与健康指标,形成统一资源目录。

镜像与实例生命周期

从标准镜像创建开发、推理或应用实例,统一管理连接、停止、再启动、释放与环境复用。

资源池与用量治理

按业务和组织划分资源池,通过配额、使用期限、访问授权与用量记录控制资源边界。

系统监测与故障排查

统一查看 CPU、内存、磁盘、加速卡和实例状态,结合趋势、事件与日志定位运行问题。

03 — 安全与权限

多级权限
与操作审计

在数据不出域的基础上,平台提供组织内部的访问控制与操作审计。

组织角色、知识库访问边界与操作审计记录的分层权限示意

多级组织与角色

按组织树逐级授权,区分管理员、操作员与查阅者角色;账号与部门调整后权限同步变更。

知识库级可见性

每个知识库按分支与人员配置可见范围,个人文档空间相互隔离;问答与检索仅在授权范围内执行。

全量操作与登录审计

关键操作全量记录,登录成功与失败逐条留存,并提供操作系统与浏览器分布分析。

架构层面的数据边界

推理、检索与存储均在内网完成,数据在任何环节都不离开本单位网络。

04 — 部署流程

从评估到上线的
四个阶段

  1. 01

    场景评估

    梳理文档规模、用户数量、重点场景与现有卡型,测算 GPU、国产加速卡接入范围和存储配置。

  2. 02

    环境就绪

    服务器到位后交付离线安装包与装机工具,内网环境无需任何外网准备。

  3. 03

    安装部署

    装机工具完成建集群、识别加速卡节点,并部署智脑应用、算力调度平台与模型服务。

  4. 04

    运行支持

    提供系统监测、版本升级与功能迭代支持。

部署评估 · 硬件测算

预约部署评估

提供文档规模与使用人数,我们将给出部署方案与硬件配置建议。