活动

天翼云最新优惠活动,涵盖免费试用,产品折扣等,助您降本增效!
热门活动
  • 12.12年度钜惠 NEW 爆款云主机2核2G仅需28.8元/年,X实例35.1元/半年起! 8代机+XSSD新客专享2.5折!
  • 免费体验DeepSeek,上天翼云息壤 NEW 新老用户均可免费体验2500万Tokens,限时两周
  • 云上钜惠 HOT 爆款云主机全场特惠,更有万元锦鲤券等你来领!
  • 算力套餐 HOT 让算力触手可及
  • 天翼云AI产品特惠 NEW 人脸识别+文字识别焕新,新用户免费试用
  • 中小企业服务商合作专区 国家云助力中小企业腾飞,高额上云补贴重磅上线
  • 出海产品促销专区 NEW 爆款云主机低至2折,高性价比,不限新老速来抢购!
  • 天翼云电脑专场 HOT 移动办公新选择,爆款4核8G畅享1年3.5折起,快来抢购!
  • 天翼云奖励推广计划 加入成为云推官,推荐新用户注册下单得现金奖励
免费活动
  • 免费试用中心 HOT 多款云产品免费试用,快来开启云上之旅
  • 天翼云用户体验官 NEW 您的洞察,重塑科技边界

息壤智算

领先开放的智算服务平台,提供算力、平台、数据、模型、应用“五位一体”智算服务体系,构建全流程的AI基础设施能力
智算云(DeepSeek专区)
AI Store
  • 算力市场
  • 模型市场
  • 应用市场
  • MCP市场
算力互联调度平台
  • 裸金属
  • 定制裸金属
训推服务
  • 模型开发
  • 训练任务
  • 服务部署
模型推理服务
  • 模型广场
  • 体验中心
  • 服务接入
应用托管
  • 应用实例
科研助手
  • 科研智能体
  • 科研服务
  • 开发机
  • 并行计算
大模型
  • DeepSeek-V3.1
  • DeepSeek-R1-0528
  • DeepSeek-V3-0324
  • Qwen3-235B-A22B
  • Qwen3-32B
智算一体机
  • 智算一体机
模型适配专家服务
  • 模型适配专家服务
算力服务商
  • 入驻算力服务商

应用商城

天翼云精选行业优秀合作伙伴及千余款商品,提供一站式云上应用服务
进入甄选商城进入云市场进入AI Store创新解决方案智云上海应用生态专区
AI应用
  • 泛微合同管理解决方案
  • 泛微数智大脑Xiaoe.AI解决方案
  • MaxKB知识库解决方案
  • 天翼AI文创
AI服务
  • 昆仑AI训推服务解决方案
  • 国信模型服务解决方案
企业应用
  • 翼电子签约解决方案
  • 翼协同解决方案
  • 翼电签-契约锁解决方案
  • 翼视频云归档解决方案
教育应用
  • 翼电子教室
  • 潜在AI教育解决方案
建站工具
  • SSL证书
  • 翼定制建站解决方案
  • 翼多端小程序解决方案
办公协同
  • 天翼云企业云盘
  • 安全邮箱
灾备迁移
  • 云管家2.0
资源管理
  • 全栈混合云敏捷版(软件)
  • 全栈混合云敏捷版(一体机)

定价

协助您快速了解云产品计费模式、价格详情,轻松预估上云成本
价格计算器
  • 动态测算产品价格
定价策略
  • 快速了解计费模式

合作伙伴

天翼云携手合作伙伴,共创云上生态,合作共赢
天翼云生态合作中心
  • 天翼云生态合作中心
天翼云渠道合作伙伴
  • 天翼云代理渠道合作伙伴
天翼云服务合作伙伴
  • 天翼云集成商交付能力认证
天翼云应用合作伙伴
  • 天翼云云市场合作伙伴
  • 天翼云甄选商城合作伙伴
天翼云技术合作伙伴
  • 天翼云OpenAPI中心
天翼云培训认证
  • 天翼云学堂
  • 天翼云市场商学院
天翼云合作计划
  • 云汇计划
天翼信创云专区
  • 信创云专区
  • 适配互认证

开发者

开发者相关功能入口汇聚
技术社区
  • 专栏文章
  • 互动问答
  • 技术视频
资源与工具
  • OpenAPI中心
培训与认证
  • 天翼云学堂
  • 天翼云认证
魔乐社区
  • 魔乐社区

支持与服务

为您提供全方位支持与服务,全流程技术保障,助您轻松上云,安全无忧
文档与工具
  • 文档中心
  • 新手上云
  • 自助服务
  • OpenAPI中心
定价
  • 价格计算器
  • 定价策略
基础服务
  • 售前咨询
  • 在线支持
  • 在线支持
  • 工单服务
  • 服务保障
  • 会员中心
增值服务
  • 红心服务
  • 首保服务
  • 客户支持计划
  • 专家技术服务
  • 备案管家
我要反馈
  • 建议与反馈
  • 用户体验官
信息公告
  • 客户公告

了解天翼云

天翼云秉承央企使命,致力于成为数字经济主力军,投身科技强国伟大事业,为用户提供安全、普惠云服务
品牌介绍
  • 关于天翼云
  • 智算云
  • 天翼云4.0
  • 新闻资讯
  • 天翼云APP
基础设施
  • 全球基础设施
  • 信任中心
最佳实践
  • 精选案例
  • 超级探访
  • 云杂志
  • 分析师和白皮书
  • 天翼云·创新直播间
市场活动
  • 2025智能云生态大会
  • 2024智算云生态大会
  • 2023云生态大会
  • 2022云生态大会
  • 天翼云中国行
天翼云
  • 活动
  • 息壤智算
  • 产品
  • 解决方案
  • 应用商城
  • 定价
  • 合作伙伴
  • 开发者
  • 支持与服务
  • 了解天翼云
      • 文档
      • 控制中心
      • 备案
      • 管理中心
      文档中心

      训推服务

      训推服务

      • 训推服务

      无数据

        • 产品动态
        • 产品介绍
        • 产品定义
        • 产品优势
        • 功能特性
        • 应用场景
        • 术语解释
        • 使用限制
        • 与其他服务的关系
        • 计费说明
        • 包周期计费模式
        • 按需计费模式-卡时
        • 产品退订
        • 快速入门
        • 准备工作
        • 用户使用流程
        • 用户指南
        • 数据工具
        • 数据处理
        • 模型定制
        • 模型精调
        • 模型精调功能介绍
        • 模型精调功能使用
        • 模型开发
        • 训练任务
        • 断点续训
        • 模型服务
        • 服务部署
        • 模型工具
        • 模型评估
        • 模型压缩
        • 训推加速
        • CTCCL优化套件
        • CTCCL简介
        • 安装、升级与使用CTCCL库
        • CTCCL环境变量设置
        • 慢节点检测工具套件 CTCCL-Slowdetect
        • CTCCL-Slowdetect简介
        • 使用CTCCL-Slowdetect
        • CTCCL-Slowdetect最佳实践
        • 训练性能加速
        • 模型适配与性能加速
        • 断点续训加速
        • Snapckpt加速
        • 智算资产
        • 我的模型
        • 我的数据集
        • 基础数据集
        • 标注数据集
        • 我的镜像
        • 我的代码包
        • 运维观测
        • 监控大盘
        • 集群监控大盘
        • 工作空间监控大盘
        • 用量统计
        • 调度中心
        • 资源总览
        • 操作审计
        • 管理中心
        • 成员管理
        • 队列管理
        • 设置
        • 资源配额
        • 工作空间管理
        • 创建工作空间
        • 工作空间关联资源
        • 工作空间成员管理
        • 进入工作空间
        • 工作空间角色权限
        • 常见问题
        • 计费类
        • 操作类
        • 最佳实践
        • 基于昇腾通用推理镜像的自定义部署
        • 基于昇腾通用推理镜像的自定义部署BGE模型
        • 多模态模型训练
        • 专业模型训练-昇腾环境
        • 专业模型训练-英伟达环境
        • 图像分类模型训练
        • NLP大模型快速微调
        • 保密数据集最佳实践
        • 多层级资源管理最佳实践
        • API参考
        • 推理服务API
        • 如何调用API
        • 错误处理
        • 接口类型列表
        • API列表
        • API
        • Chat对话API
        • Image文本生图API
        • Embeddings文本向量化API
        • 模型列表API
        • 模型简介
        • DeepSeek-R1
        • DeepSeek-V3
        • Baichuan2-Turbo
        • Llama3-70B-Instruct
        • Qwen2.5-72B-Instruct
        • Qwen2-72B-Instruct
        • Qwen-VL-Chat
        • TeleChat-12B
        • InternLM2-Chat-7B
        • Baichuan2-7B
        • Qwen-7B-Chat
        • Llama2-Chinese-13B-Chat
        • CodeLlama-34B-Instruct
        • Chinese-Alpaca-2-13B
        • 平台OpenAPI
        • 平台功能API使用说明
        • 文档下载
        • 相关协议
        • 训推智算服务平台服务协议
        • 训推服务用户信息处理规则
          无相关产品

          本页目录

          帮助中心训推服务用户指南运维观测监控大盘工作空间监控大盘
          工作空间监控大盘
          更新时间 2025-11-27 10:05:32
          • 新浪微博
          • 微信
            扫码分享
          • 复制链接
          最近更新时间: 2025-11-27 10:05:32
          分享文章
          • 新浪微博
          • 微信
            扫码分享
          • 复制链接

          前置条件

          • 资源限制:您已开通专属集群(专属集群需联系客户经理开通),该功能仅统计专属集群相应用量。

          • 用户权限:账号为主账号,或者角色为IAM管理员、二级管理员的子账号。

          功能介绍

          工作空间监控大盘展现了专属集群下的工作空间概览、具体工作空间的资源使用情况、工作空间指标监控。进入“运维观测”>“监控大盘”菜单,上方点击“工作空间”Tab,查看您相应权限下的工作空间监控,该功能仅对主账号、IAM管理员、二级管理员用户开放。

          说明

          1. 由于工作空间可以关联不同集群的配额,统计数值可能会跨集群,即工作空间的监控不会受顶部集群切换的影响;

          2. 仅统计专属集群相关数据及展示专属集群监控;

          3. 统计的数值会受到您权限的影响,此处仅统计您有权限查看的工作空间。若您是主账号或IAM管理员,此处统计的是您租户账号下所有的工作空间;若您是二级管理员,此处统计的是您自己创建及有管理权限的工作空间。

          工作空间概览

          1. 统计说明及名词解释:

            1. 分配:是指分配到工作空间,即相关资源创建配额,该配额绑定工作空间的状态。被分配意味着该资源可以被任务使用:在本平台,建立专属集群后,您需要先创建配额,并在相应的工作空间里绑定配额,才可以在任务中选择配额运行任务,分配是专属集群资源可用的必要步骤。

            2. 占用:占用是指被任务中的pod占用,这意味着分配的资源真正被任务使用;

          2. 各指标含义说明:

          指标项

          解释

          占用CPU核数占比

          • 分配CPU核数:您权限下所有工作空间绑定配额的CPU总核数;

          • 占用CPU核数:分配CPU中被任务占用的CPU核数;

          • 占用CPU核数占比:即占用CPU核数与分配CPU核数的比值。

          占用内存量占比

          • 分配内存量:您权限下所有工作空间绑定配额的总内存量;

          • 占用内存量:分配内存中被任务占用的内存量;

          • 占用内存量占比:即占用内存量与分配内存量的比值。

          占用显卡数占比

          • 分配显卡数:您权限下所有工作空间绑定配额的总显卡数;

          • 占用显卡数:分配显卡中被任务占用的显卡数;

          • 占用显卡数占比:即占用显卡数与分配显卡数的比值。

          占用显存量占比

          • 分配显存量:您权限下所有工作空间绑定配额的总显存量;

          • 占用显存量:分配显存中被任务占用的显存量;

          • 占用显存量占比:即占用显存量与分配显存量的比值。

           工作空间资源使用情况及监控

          1. 选择您权限下具体的工作空间,可查看该空间下的资源使用情况。

          2. 资源使用情况:指定工作空间的占用CPU、内存量、显卡数以及显存量使用情况,具体含义可参考上述工作空间概览部分,其中显卡相关情况支持按卡类型查看,点击【按卡类型查看】可查看每类显卡的卡数及显存使用明细。

          3. 工作空间监控:此处监控以工作空间维度展示,其在真实采集值的基础上,做了空间维度的聚合,代表本空间的整体使用情况。聚合方式上,一般使用率、速率以加权平均值聚合,使用量以累加值聚合。以CPU使用量与GPU使用率为例说明指标在此处的含义:

            1. CPU使用量(工作空间维度):当前时刻下,该工作空间被分配的所有CPU的实际使用量的总和。例如,工作空间1 CPU分配量为100核,空间1下有3个任务,每个任务分别实际使用了20核,则 CPU使用量=20+20+20=60(C);

            2. GPU使用率(工作空间维度):当前时刻下,该工作空间被分配的所有显卡的GPU实际使用率的加权平均值。例如,工作空间A分配4张某类型的显卡,其中卡1使用率50%、卡2使用率20%、卡3和4使用率0%,则该类型下:GPU使用率=1/4*50%+1/4*20%+2/4*0%=17.5%。

          4. 各指标含义说明:

          类别

          指标

          解释

          CPU、内存与网络监控

          CPU使用率

          CPU在单位时间内,CPU被任务占用使用的时间占比。

          默认按 加权平均值 聚合。

          CPU使用量

          CPU 实际使用的核数。

          默认按 累加值 聚合。

          内存使用率

          已用内存占总内存的百分比。

          默认按 加权平均值 聚合。

          内存使用量

          内存实际使用量。

          默认按 累加值 聚合。

          显卡基础指标

          显卡使用率

          在单位时间内,显卡被任务占用使用的时间占比。

          默认按 加权平均值 聚合。

          显存使用率

          已用显存占总显存的百分比。

          默认按 加权平均值 聚合。

          显存使用量

          显存实际使用量。

          默认按 累加值 聚合。

           

          文档反馈

          建议您登录后反馈,可在建议与反馈里查看问题处理进度

          鼠标选中文档,精准反馈问题

          选中存在疑惑的内容,即可快速反馈问题,我们会跟进处理

          知道了

          上一篇 :  集群监控大盘
          下一篇 :  用量统计
          搜索 关闭
          ©2025 天翼云科技有限公司版权所有 增值电信业务经营许可证A2.B1.B2-20090001
          公司地址:北京市东城区青龙胡同甲1号、3号2幢2层205-32室
          备案 京公网安备11010802043424号 京ICP备 2021034386号
          ©2025天翼云科技有限公司版权所有
          京ICP备 2021034386号
          备案 京公网安备11010802043424号
          增值电信业务经营许可证A2.B1.B2-20090001
          用户协议 隐私政策 法律声明