
易管理与运维的人工智能加速平台,把复杂的智算集群管成一台电脑般简单
智算容器云 LtAI
LtAI 是面向 AI 算力场景的云平台,基于容器与 Kubernetes 体系,为高校、科研院所、企业与智算中心提供从数据集管理、模型开发、分布式训练到推理服务上线的全流程能力。平台将分散在不同机房、不同芯片上的算力统筹为一个统一的资源池,通过精细化调度、多级资源隔离与一键预置环境,让每一位用户"拿到账号就能跑",让管理员"一屏管住整个集群"。
万卡异构,一屏掌控
-
精细化算力调度
资源组、资源规格、资源队列三级调度体系;多队列优先级与抢占策略,核心任务不排队;空闲算力自动回收再利用,让每一块卡都运转起来。 -
严格的资源隔离
域—项目—用户多级租户体系,计算、存储、配额层层隔离;支持域专属资源,各团队互不干扰;全流程操作审计,资源使用有据可查。 -
灵活易用
集成 Jupyter Notebook、VSCode 等主流开发环境;预置 PyTorch、TensorFlow、MindSpore 等框架镜像,一键创建开发容器;数据集、模型从 ModelScope、HuggingFace 平台直接导入;环境配置耗时缩短 80%,科研人员不必再卡在"配环境"上。 -
训推加速
支持单机多卡、多机多卡分布式并行训练;兼容基于华为昇腾、天数等国产 GPU 卡的大模型推理加速,训练推理同一平台、平滑衔接。 -
GPU 虚拟化
支持 vGPU 按算力或显存精细切分(单卡可划分不少于 10 个 vGPU),支持 NVIDIA MIG 拆分——小任务不再占用整卡,GPU 利用率显著提升。 -
异构算力统一纳管
通过广域网纳管多可用区、多集群,NVIDIA 与华为昇腾、天数智芯等国产芯片统一资源管理与调度,打破地域与芯片型号壁垒。
功能特性

应用场景
-
院校与科研院所
多团队共享 GPU 集群,配额隔离、按项目核算,把时间还给科研本身。 -
企业 AI 研发
统一算力池 + 标准化环境 + 多租户隔离,投入产出算得清。 -
智算中心对外运营
异构统一调度 + 白牌定制 + 计费账单,构建自主品牌对外提供算力服务。





