活动

天翼云最新优惠活动,涵盖免费试用,产品折扣等,助您降本增效!
热门活动
  • 驭马迎春·福礼抢先领 5.5折无门槛折扣券+开箱即用方案双加持,节后上云快人一步!
  • 云上钜惠 爆款云主机全场特惠,2核4G只要1.8折起!
  • 中小企业服务商合作专区 国家云助力中小企业腾飞,高额上云补贴重磅上线
  • 出海产品促销专区 NEW 爆款云主机低至2折,高性价比,不限新老速来抢购!
  • 天翼云奖励推广计划 加入成为云推官,推荐新用户注册下单得现金奖励
免费活动
  • 免费试用中心 HOT 多款云产品免费试用,快来开启云上之旅
  • 天翼云用户体验官 NEW 您的洞察,重塑科技边界

息壤智算

领先开放的智算服务平台,提供算力、平台、数据、模型、应用“五位一体”智算服务体系,构建全流程的AI基础设施能力
AI Store
  • 算力市场
  • 模型市场
  • 应用市场
  • MCP市场
算力互联调度平台
  • 裸金属
  • 定制裸金属
训推服务
  • 模型开发
  • 训练任务
  • 服务部署
模型推理服务
  • 模型广场
  • 体验中心
  • 服务接入
应用托管
  • 应用实例
科研助手
  • 科研智能体
  • 科研服务
  • 开发机
  • 并行计算
大模型
  • DeepSeek-V3.1
  • DeepSeek-R1-0528
  • DeepSeek-V3-0324
  • Qwen3-235B-A22B
  • Qwen3-32B
智算一体机
  • 智算一体机
模型适配专家服务
  • 模型适配专家服务
算力服务商
  • 入驻算力服务商

应用商城

天翼云精选行业优秀合作伙伴及千余款商品,提供一站式云上应用服务
进入甄选商城进入云市场进入AI Store创新解决方案公有云生态专区智云上海应用生态专区
建站工具
  • 新域名服务
  • SSL证书
  • 翼建站
企业办公
  • 安全邮箱
  • WPS 365 天翼云版
  • 天翼企业云盘(标准服务版)
灾备迁移
  • 云管家2.0
  • 翼备份(SaaS版)

定价

协助您快速了解云产品计费模式、价格详情,轻松预估上云成本
价格计算器
  • 动态测算产品价格
定价策略
  • 快速了解计费模式

合作伙伴

天翼云携手合作伙伴,共创云上生态,合作共赢
天翼云生态合作中心
  • 天翼云生态合作中心
天翼云渠道合作伙伴
  • 天翼云代理渠道合作伙伴
天翼云服务合作伙伴
  • 天翼云集成商交付能力认证
天翼云应用合作伙伴
  • 天翼云云市场合作伙伴
  • 天翼云甄选商城合作伙伴
天翼云技术合作伙伴
  • 天翼云OpenAPI中心
天翼云培训认证
  • 天翼云学堂
  • 天翼云市场商学院
天翼云合作计划
  • 云汇计划
天翼信创云专区
  • 信创云专区
  • 适配互认证

开发者

开发者相关功能入口汇聚
技术社区
  • 专栏文章
  • 互动问答
  • 技术视频
资源与工具
  • OpenAPI中心
培训与认证
  • 天翼云学堂
  • 天翼云认证
开源社区
  • 魔乐社区
  • OpenTeleDB

支持与服务

为您提供全方位支持与服务,全流程技术保障,助您轻松上云,安全无忧
文档与工具
  • 文档中心
  • 新手上云
  • 自助服务
  • OpenAPI中心
定价
  • 价格计算器
  • 定价策略
基础服务
  • 售前咨询
  • 在线支持
  • 在线支持
  • 工单服务
  • 服务保障
  • 会员中心
增值服务
  • 红心服务
  • 首保服务
  • 客户支持计划
  • 专家技术服务
  • 备案管家
我要反馈
  • 建议与反馈
  • 用户体验官
信息公告
  • 客户公告

了解天翼云

天翼云秉承央企使命,致力于成为数字经济主力军,投身科技强国伟大事业,为用户提供安全、普惠云服务
品牌介绍
  • 关于天翼云
  • 智算云
  • 天翼云4.0
  • 新闻资讯
  • 天翼云APP
基础设施
  • 全球基础设施
  • 信任中心
最佳实践
  • 精选案例
  • 超级探访
  • 云杂志
  • 分析师和白皮书
  • 天翼云·创新直播间
市场活动
  • 2025智能云生态大会
  • 2024智算云生态大会
  • 2023云生态大会
  • 2022云生态大会
  • 天翼云中国行
天翼云
  • 活动
  • 息壤智算
  • 产品
  • 解决方案
  • 应用商城
  • 定价
  • 合作伙伴
  • 开发者
  • 支持与服务
  • 了解天翼云
      • 文档
      • 控制中心
      • 备案
      • 管理中心
      文档中心

      智算套件

      智算套件

      • 智算套件

      无数据

        • 产品动态
        • 产品介绍
        • 产品定义
        • 产品优势
        • 产品功能
        • 应用场景
        • 基本概念
        • 使用限制
        • 计费说明
        • 计费项
        • 快速入门
        • 创建训练应用
        • 创建推理应用
        • 用户指南
        • 套件管理
        • 套件概述
        • 套件安装
        • 套件更新
        • 套件卸载
        • 训练
        • 创建单机训练任务
        • 创建多机训练任务
        • 管理训练任务
        • 推理
        • 创建vLLM GPU单机推理任务
        • 创建vLLM GPU单机PD分离任务
        • 创建vLLM GPU多机PD分离任务
        • 创建vLLM NPU单机推理任务
        • 创建vLLM NPU单机PD分离任务
        • 创建vLLM NPU多机PD分离任务
        • 负载调度
        • 调度策略
        • Gang Scheduling调度
        • 装箱调度(Binpack)
        • GPU共享调度
        • 模型管理
        • 导入模型
        • 魔乐社区导入
        • 魔搭社区导入
        • Hugging Face社区导入
        • 模型预热
        • 公共模型预热
        • 数据集管理
        • 创建数据集
        • 管理数据集
        • 导入数据集
        • 数据集存储
        • 开发机
        • NoteBook管理
        • 创建JupyterLab开发机
        • 创建VSCode开发机
        • 管理开发机
        • 开发机镜像
        • Tensorboard管理
        • 创建Tensorboard
        • 数据加速
        • Fluid概述
        • 开启数据加速
        • 解除数据加速
        • 数据预热
        • 使用加速数据集
        • 数据集加速性能测试
        • 可观测
        • 监控总览
        • 训练监控
        • 训练日志
        • 推理监控
        • 推理日志
        • 最佳实践
        • 创建单机训练任务
        • 创建多机训练任务
        • 常见问题
        • 框架管理
        • 数据集管理
        • 模型管理
        • 队列管理
        • 相关协议
        • 服务协议
        • 服务等级协议
          无相关产品

          本页目录

          帮助中心智算套件用户指南推理创建vLLM NPU多机PD分离任务
          创建vLLM NPU多机PD分离任务
          更新时间 2026-02-11 21:08:35
          • 新浪微博
          • 微信
            扫码分享
          • 复制链接
          最近更新时间: 2026-02-11 21:08:35
          分享文章
          • 新浪微博
          • 微信
            扫码分享
          • 复制链接
          本节介绍如何创建vLLM NPU多机PD分离任务。

          前置条件

          1. 确认智算套件已经安装并且全部运行中


           

          2. 进入智算套件,AI应用管理,队列管理,确保队列存在并且有足够的资源(NPU,CPU,内存) [参考创建队列的文档]

          操作步骤

          创建任务

          进入智算套件,AI应用列表,在线推理菜单,创建AI应用

          基本信息

          应用类型:vLLM

          开启PD分离选择 静态PD分离

          推理类型选择 多机

          配置信息

          推理框架,框架版本,推理模型,模型版本,Prefill 实例数和副本数,Decode 实例数和副本数,根据实际情况选择。

          注意

          Prefill 实例数和副本数,Decode 实例数和副本数用默认参数即可。

          Prefill 菜单中的 PrefillMaster, PrefillWorker,Decode 菜单中的 DecodeMaster,DecodeWorker 启动参数用默认参数即可。

          Prefill 菜单中的 PrefillMaster, PrefillWorker 中的资源都要填 NPU。

          Decode 菜单中的 DecodeMaster,DecodeWorker 中的资源都要填 NPU。

          简单的示例:

          推理框架: ascend-vllm

          框架版本:v0.11.0rc2

          推理模型:deepseek-r1-distill-qwen-1.5b 

          模型版本:v1

          队列:选择存在且资源足够的的队列

          PrefillMaster

          CPU,内存,共享内存不填,NPU填:4

          PrefillWorker

          CPU,内存,共享内存不填,NPU填:4

          DecodeMaster

          CPU,内存,共享内存不填,NPU填:4

          DecodeWorker

          CPU,内存,共享内存不填,NPU填:4

          点击确认完成创建。

           

           

          文档反馈

          建议您登录后反馈,可在建议与反馈里查看问题处理进度

          鼠标选中文档,精准反馈问题

          选中存在疑惑的内容,即可快速反馈问题,我们会跟进处理

          知道了

          上一篇 :  创建vLLM NPU单机PD分离任务
          下一篇 :  负载调度
          搜索 关闭
          ©2026 天翼云科技有限公司版权所有 增值电信业务经营许可证A2.B1.B2-20090001
          公司地址:北京市东城区青龙胡同甲1号、3号2幢2层205-32室
          备案 京公网安备11010802043424号 京ICP备 2021034386号
          ©2026天翼云科技有限公司版权所有
          京ICP备 2021034386号
          备案 京公网安备11010802043424号
          增值电信业务经营许可证A2.B1.B2-20090001
          用户协议 隐私政策 法律声明