排查项八:拉取公共镜像达上限 问题现象 创建工作负载时报如下错误。 ERROR: toomanyrequests: Too Many Requests. 或 you have reached your pull rate limit, you may increase the limit by authenticating an upgrading: 问题原因 DockerHub对用户拉取容器镜像请求设定了上限,详情请参见Understanding Docker Hub Rate Limiting。 解决方案: 将常用的镜像上传到SWR,然后从SWR拉取镜像。 四、工作负载异常:启动容器失败 问题定位 工作负载详情中,若事件中提示“启动容器失败”,请按照如下方式来初步排查原因: 步骤 1 登录异常工作负载所在的节点。 步骤 2 查看工作负载实例非正常退出的容器ID。 docker ps a grep $podName 步骤 3 查看退出容器的错误日志。 docker logs $containerID 根据日志提示修复工作负载本身的问题。 步骤 4 查看操作系统的错误日志。 cat /var/log/messages grep 根据日志判断是否触发了系统OOM。 排查思路 根据具体事件信息确定具体问题原因,如下表所示。 容器启动失败 日志或事件信息 问题原因与解决方案 日志中存在exit(0) 容器中无进程。请调试容器是否能正常运行。排查项一:(退出码:0)容器中无持续运行的进程 事件信息:Liveness probe failed: Get http…日志中存在exit(137) 健康检查执行失败。排查项二:(退出码:137)健康检查执行失败 事件信息:Thin Pool has 15991 free data blocks which is less than minimum required 16383 free data blocks. Create more free space in thin pool or use dm.minfreespace option to change behavior 磁盘空间不足,需要清理磁盘空间。排查项三:容器所在磁盘空间不足 日志中存在OOM字眼 内存不足。排查项四:达到容器资源上限排查项五:工作负载的容器规格设置较小导致 Address already in use Pod中容器端口冲突排查项六:同一pod中container端口冲突导致 出上述可能原因外,还可能存在如下原因,请根据顺序排查。 排查项七:容器启动命令配置有误导致 排查项九:用户自身业务BUG 在ARM架构的节点上创建工作负载时未使用正确的镜像版本,使用正确的镜像版本即可解决该问题。 排查思路