简体中文
首页 > 新闻动态 > 公司动态

华为发布并开源 Flex:ai AI 容器技术,实现单卡同时承载多个 AI 工作负载

2025-11-24 09:30:16

【导语】11月21日,在AI容器应用落地与发展论坛上,华为发布基于Kubernetes的Flex:ai AI容器软件,其通过算力切分、“共享算力池”及智能调度技术,实现AI工作负载与算力资源精准匹配,且具备虚拟化、智能调度两大独特优势,发布后将同步开源至魔擎社区。

华为发布并开源 Flex:ai AI 容器技术,实现单卡同时承载多个 AI 工作负载

  11 月 21 日消息,在 AI 容器应用落地与发展论坛上,华为发布 Flex:ai AI 容器软件,通过算力切分技术,将单张 GPU / NPU 算力卡切分为多份虚拟算力单元,切分粒度精准至 10%,实现了单卡同时承载多个 AI 工作负载,并可聚合集群内各节点的空闲 XPU 算力聚合形成“共享算力池”。

  Flex:ai 是一款基于 Kubernetes(开源容器编排平台)构建的 XPU(各种类型处理器)池化与调度软件,主要是通过对 GPU、NPU 等智能算力资源的精细化管理与智能调度,实现对 AI 工作负载与算力资源的“精准匹配”。

  相比英伟达旗下 Run:ai 公司的核心技术,华为认为 Flex:ai 具备两大独特优势:

  一是虚拟化。除了在本地虚拟化技术中实现算力单元的按需切分,Flex:ai 独有的“拉远虚拟化”技术,可以不做复杂的分布式任务设置,将集群内各节点的空闲 XPU 算力聚合形成“共享算力池”。

  二是智能调度。Flex:ai 的智能资源和任务调度技术,可以自动感知集群负载与资源状态,结合 AI 工作负载的优先级、算力需求等多维参数,对本地及远端的虚拟化 GPU、NPU 资源进行全局最优调度,满足不同 AI 工作负载对资源的需求。

  从发布会获悉,Flex:ai 将在发布后同步开源在魔擎社区中



热门新闻

即刻开启您的物联网之旅

联系解决方案专家
平台
2.0
解决方案
智慧家庭
智慧车联网
智慧农业
公司动态
行业资讯
永续发展
经营者的话
社会参与
环境永续
公司治理

400-8552-389

7×24小时服务热线

法律声明 隐私权条款

关注“”

服务尽在掌握

© 2022-2025 物联智慧科技(深圳)有限公司版权所有 粤ICP备14023641号
在线咨询
扫一扫

服务尽在掌握

全国免费服务热线
400-8552-389

返回顶部