• [容器专区] 【AR502H】【eciot-ova】eciot-ova工具对docker镜像文件有什么限制吗
    使用eciot-ova.tar.gz中的create-ova工具,将docker镜像文件转成ova容器,对docker镜像文件有什么限制吗?比如大小限制
  • [沃土-方案构建经验分...] CCE云服务-咨询—docker 容器中运行redis无法启动:ignore-warnings ARM64-COW-BUG报错
    【故障现象】docker 容器中运行redis无法启动,详情截图如下:【故障诊断】根据redis的日志信息提示,初步判断是配置文件的问题。【故障原因】配置文件中的内容导致redis无法启动。【解决方案】Redis will now exit to prevent data corruption. Note that it is possible to suppress this warning by setting the following config: ignore-warnings ARM64-COW-BUG。根据信息提示,即在 redis.conf 中取消这最后一条注释: ignore-warnings ARM64-COW-BUG ,再重启redis服务即可。
  • [沃土-方案构建经验分...] CCE-docker镜像拉取失败
    **一、现象描述** 1、CCE控制台创建无状态工作负载,一个负载同时创建两个实例,在创建过程中,一个创建成功,一个创建失败。创建失败的报错信息为镜像拉取失败,具体报错如下所示: Failed to pull image “swr.cn-north-4.myhuaweicloud.com/tansj/hw_cns_bmfw_web:v50”: [rpc error: code = Unknown desc = Error response from daemon: Get https://swr.cn-north-4.myhuaweicloud.com/v2/: dial tcp: lookup swr.cn-north-4.myhuaweicloud.com on [::1]:53: read udp [::1]:58207->[::1]:53: read: connection refused, rpc error: code = Unknown desc = Error response from daemon: Get https://swr.cn-north-4.myhuaweicloud.com/v2/: dial tcp: lookup swr.cn-north-4.myhuaweicloud.com on [::1]:53: read udp [::1]:47536->[::1]:53: read: connection refused] **二、问题分析** 1、根据具体的报错可知,镜像拉取过程中,在访问华为云的SWR时连接被拒绝。初步分析为服务器访问华为云SWR时被拒绝。 2、登录镜像拉取失败的服务器执行以下命令: curl https://swr.cn-north-4.myhuaweicloud.com/v2/ ![image.png](https://bbs-img.huaweicloud.com/data/forums/attachment/forum/202111/23/151932lwey26wq9dxfoflu.png) Cloud not resolve host swr.cn-north-4.myhuaweicloud.com ,根据报错可知当前服务器没办法正常解析域名 尝试curl其他网站,如curl www.baidu.com,还是出现同样的问题。 ![image.png](https://bbs-img.huaweicloud.com/data/forums/attachment/forum/202111/23/151957if98svutoeqbaw1n.png) 3、查看当前服务器的resolv.conf 文件。 cat /etc/resolv.conf ![image.png](https://bbs-img.huaweicloud.com/data/forums/attachment/forum/202111/23/152019ie7jpwjk8p7pobke.png) 根据以上文件配置内容可知,当前服务器没有配置DNS服务器的地址,导致解析出现问题。 **三、解决方案** 1、查询北京四DNS服务器的内网地址 https://support.huaweicloud.com/dns_faq/dns_faq_002.html ![image.png](https://bbs-img.huaweicloud.com/data/forums/attachment/forum/202111/23/152046cdt0rsma2jbo1rff.png) 2、resolv.conf 文件配置上nameserver nameserver 100.125.1.250 nameserver 100.125.129.250 3、重新curl https://swr.cn-north-4.myhuaweicloud.com/v2/ ![image.png](https://bbs-img.huaweicloud.com/data/forums/attachment/forum/202111/23/152102ipqiv6kcxgyuxcqk.png) 4、CCE控制台重新创建负载,如图可见两个实例创建成功 ![image.png](https://bbs-img.huaweicloud.com/data/forums/attachment/forum/202111/23/152113q3edupjkua8hrerv.png)
  • [问题求助] Docker容器里安装鲲鹏迁移工具报错,无法执行./install
  • [容器专区] 【AR502H产品】【docker容器功能】docker容器安装报错,启动也失败
    【功能模块】按照《边缘网关二次开发指南(AR502系列)》说明,安装容器失败【操作步骤&问题现象】1、container install demo latest.ova2、 Failed to start container.【截图信息】 【日志信息】(可选,上传日志内容或者附件)不知道去哪里查容器日志
  • [其他] TensorFlow 基于 Docker 安装
    通过Docker运行TensorFlow  该方式的优点是不用操心软件依赖问题。方法  首先,安装Docker,一旦Docker已经启动运行,可以通过命令启动一个容器:$ docker run -it b.gcr.io/tensorflow/tensorflow  该命令将启动一个已经安装好的TensorFlow及相关依赖的容器。其它镜像   默认的 Docker 镜像只包含启动和运行 TensorFlow 所需依赖库的一个最小集. 我们额外提供了 下面的容器, 该容器同样可以通过上述 docker run 命令安装:  b.gcr.io/tensorflow/tensorflow-full: 镜像中的 TensorFlow 是从源代码完整安装的, 包含了编译和运行 TensorFlow 所需的全部工具。  在该镜像上, 可以直接使用源代码进行实验, 而不需要再安装上述的任何依赖.
  • [ARM原生] robox容器可以启动,但是docker容器里的android镜像没有启动成功
    目前robox容器可以启动,但是进入docker容器里发现android镜像并没有启动成功,使用的是华为云官网上提供的android镜像:
  • [ARM原生] robox部署完成后启动失败
    按照官网robox方案搭建android环境(地址:https://support.huaweicloud.com/prtg-robox-kunpengcps/kunpengcps_02_0002.html),按照操作步骤完成安装部署(除了ExaGear没有安装部署,因为不需要arm32转arm64),最后运行的时候报错,不知道有没有人能帮忙看下。从运行日志上看主要是session-manager 起不来,单独起docker也是ok的,单独启动session-manager 报错如下:root@ni:/home/robox-master# export DISPLAY=:0 root@ni:/home/robox-master# export XDG_RUNTIME_DIR=/run/user/0 root@ni:/home/robox-master# mkdir /run/user/0 root@ni:/home/robox-master# root@ni:/home/robox-master# anbox session-manager --run-multiple=1 --standalone --experimental --single-window --window-size=720,1280 libEGL warning: DRI2: failed to authenticate [ 2021-09-05 08:19:57] [daemon.cpp:63@Run] Failed to connect to DBus root@ni:/home/robox-master# 单独起docker运行:root@ni:/home/robox-master# root@ni:/home/robox-master# docker images REPOSITORY TAG IMAGE ID CREATED SIZE android robox_with_exagear 2cc0051fd624 2 days ago 860MB root@ni:/home/robox-master# root@ni:/home/robox-master# docker run -d -it --name instance1 android:robox_with_exagear /anbox-init.sh 53e1c5f5e883e3cd6ee086ca493bf529fba6eb3c6bc65e0095766370ef4b67b1 root@ni:/home/robox-master# root@ni:/home/robox-master# docker ps CONTAINER ID IMAGE COMMAND CREATED STATUS PORTS NAMES 53e1c5f5e883 android:robox_with_exagear "/anbox-init.sh" 5 seconds ago Up 4 seconds instance1 root@ni:/home/robox-master# Xorg启动运行如下:root@ni:/home/robox-master# root@ni:/home/robox-master# Xorg :0 -config /etc/X11/xorg.conf X.Org X Server 1.19.6 Release Date: 2017-12-20 X Protocol Version 11, Revision 0 Build Operating System: Linux 4.15.0-140-generic aarch64 Ubuntu Current Operating System: Linux ni 4.15.18 #1 SMP Fri Sep 3 11:35:37 CST 2021 aarch64 Kernel command line: BOOT_IMAGE=/boot/vmlinuz-4.15.18 root=/dev/mapper/ni--vg-root ro Build Date: 08 April 2021 01:53:49PM xorg-server 2:1.19.6-1ubuntu4.9 (For technical support please see http://www.ubuntu.com/support) Current version of pixman: 0.34.0 Before reporting problems, check http://wiki.x.org to make sure that you have the latest version. Markers: (--) probed, (**) from config file, (==) default setting, (++) from command line, (!!) notice, (II) informational, (WW) warning, (EE) error, (NI) not implemented, (??) unknown. (==) Log file: "/var/log/Xorg.0.log", Time: Sun Sep 5 16:22:06 2021 (++) Using config file: "/etc/X11/xorg.conf" (==) Using system config directory "/usr/share/X11/xorg.conf.d" pci id for fd 13: 19e5:1711, driver (null) EGL_MESA_drm_image required.
  • [ARM原生] robox启动报错,anbox_bridge qemu_pipe anbox_audio 这3个没有 求助指导排查
    参考bootkit arm云原生编译robox启动报错,anbox_bridge qemu_pipe anbox_audio 这3个没有,是否是缺包导致还是可能什么步骤没执行,帮忙指导看下目前使用Ubuntu18.04.1 内核4.15.18https://bbs.huaweicloud.com/forum/forum.php?mod=viewthread&tid=151195看日志是docker容器没有成功启动,可以用docker ps -a查看是哪个容器启动失败,再使用docker logs 容器id查看具体报错排查一下1.xorg的进程是否启动 2.启动脚本里的镜像名字与你注册的是否一样 3.启动脚本里xorg的端口号是否xorg的进程端口号一致客户反馈目前就起了一个容器, 执行./robox -v start 1 启动命令的时候, 没有容器启动信息, 所以docker logs看不了。其他排查点:1.xorg的进程是否启动 2.启动脚本里的镜像名字与你注册的是否一样 3.启动脚本里xorg的端口号是否xorg的进程端口号一致另外看了一下, 启动应该是是卡在检测如下三个文件上:/run/user/0 这个目录本来是没有的,是我手动创建的
  • [技术干货] 编写Playbook批量二进制部署Docker
    编写Playbook批量二进制部署Docker   二进制方式部署的Docker,可以离线完成,不要求网络,并且对系统的适配性较好。vi example.yaml- hosts: docker   vars:  remote_user: root  gather_facts: false  tasks:  - name: 分发并解压docker二进制包    unarchive: src=files/docker-18.09.6.tgz dest=/tmp   - name: 移动docker二进制文件    shell: mv /tmp/docker/* /usr/bin  - name: 分发service文件    copy: src=files/docker.service dest=/usr/lib/systemd/system/  - name: 启动docker并设置开机启动    systemd: name=docker state=restarted enabled=yes daemon_reload=yes  - name: 查看状态    shell: docker info    register: docker   - debug: var=docker.stdout_lines#ansible-playbook example.yaml -k
  • [技术干货] prometheus监控docker主机
    与监控实体主机一样,首先需要在被监控端安装采集器cAdvisor选一台安装了docker的主机:Docker部署cAdvisor:docker run -d \--volume=/:/rootfs:ro \--volume=/var/run:/var/run:ro \--volume=/sys:/sys:ro \--volume=/var/lib/docker/:/var/lib/docker:ro \--volume=/dev/disk/:/dev/disk:ro \--publish=8080:8080 \--detach=true \--name=cadvisor \google/cadvisor:latest使用浏览器http://EIP:8080访问:配置prometheus的数据源:[root@ecs-0720 prometheus]# vi prometheus.yml - job_name: "docker"    static_configs:      - targets:["114.115.168.136:8080"][root@ecs-0720 prometheus]# kill -HUP 7155grafana中再import一个模板193:
  • [openEuler] openEuler20.03 LTS sp1下Docker 17.12安装
    一、操作系统和软件版本介绍1.操作系统为openEuler 20.03 (LTS-SP1)   可用如下命令查询:[root@1ocalhost ~]# cat /etc/os-release [root@1ocalhost ~]# uname -i二.docker安装  下载软件rpm包wget https://download.docker.com/linux/centos/7/x86_64/stable/Packages/docker-ce-17.12.1.ce-1.el7.centos.x86_64.rpm 用yum命令安装[root@1ocalhost ~]# yum install docker-ce-17.12.1.ce-1.el7.centos.x86_64.rpm  加入自启动[root@1ocalhost ~]# systemctl enable docker 启动docker[root@1ocalhost ~]# systemctl start docker [root@1ocalhost ~]# docker run hello-world三.开启远程访问  查询状态[root@1ocalhost ~]# systemctl status docker ● docker.service - Docker Application Container Engine Loaded: loaded (/usr/lib/systemd/system/docker.service; enabled; vendor preset: disabled) Active: active (running) since Wed 2021-08-18 14:30:54 CST; 3min 21s ago Docs: https://docs.docker.com Main PID: 39341 (dockerd) Tasks: 19 Memory: 28.7M CGroup: /system.slice/docker.service ├─39341 /usr/bin/dockerd └─39347 docker-containerd --config /var/run/docker/containerd/containerd.toml Aug 18 14:30:53 1ocalhost dockerd[39341]: time="2021-08-18T14:30:53.976077406+08:00" level=info msg="L> Aug 18 14:30:54 1ocalhost dockerd[39341]: time="2021-08-18T14:30:54.043802823+08:00" level=info msg="D> Aug 18 14:30:54 1ocalhost dockerd[39341]: time="2021-08-18T14:30:54.070649796+08:00" level=info msg="L> Aug 18 14:30:54 1ocalhost dockerd[39341]: time="2021-08-18T14:30:54.105805696+08:00" level=info msg="D> Aug 18 14:30:54 1ocalhost dockerd[39341]: time="2021-08-18T14:30:54.105846846+08:00" level=info msg="D> Aug 18 14:30:54 1ocalhost dockerd[39341]: time="2021-08-18T14:30:54.110040371+08:00" level=info msg="A> Aug 18 14:30:54 1ocalhost systemd[1]: Started Docker Application Container Engine. Aug 18 14:31:05 1ocalhost dockerd[39341]: time="2021-08-18T14:31:05+08:00" level=info msg="shim docker> Aug 18 14:31:05 1ocalhost dockerd[39341]: time="2021-08-18T14:31:05+08:00" level=info msg="shim reaped> Aug 18 14:31:05 1ocalhost dockerd[39341]: time="2021-08-18T14:31:05.974762303+08:00" level=info msg="i> lines 1-21/21 (END) 开启远程端口,允许远程访问[root@1ocalhost ~]# vi /usr/lib/systemd/system/docker.service   刷新配置重启docker[root@1ocalhost ~]# systemctl daemon-reload [root@1ocalhost ~]# systemctl restart docker测试[root@1ocalhost ~]# curl http://localhost:2375/version [root@1ocalhost ~]# curl http://localhost:2375/info
  • [技术干货] k8s重启报错处理
     昨天重装好的k8s,今天重启机器,运行kubectl get pod报错:The connection to the server 192.168.0.X:6443 was refused - did you specify the right host or port?[root@ecs-0720 ~]# ss -antulp | grep :6443[root@ecs-0720 ~]# 端口没有起来。通过docker ps -a查看,有些容器没有正常启动。重启docker之后,重启kubeletdocker start $(docker ps -a | awk '{ print $1}' | tail -n +2)docker ps -a:列出所有的容器|:管道输出awk '{ print $1}':逐行打印第一个字段,就是容器的idtail -n +2:从第2行开始,跳过表头合在一起就是重启docker的所有容器。[root@ecs-0720 /]# kubectl get podNAME                     READY   STATUS    RESTARTS   AGEnginx-6799fc88d8-z76rk   1/1     Running   1          16hk8s状态运行正常了。
  • [设备专区] 【AR502H】【docker 线程128个数限制?】
    做压力测试时,发现docker容器只能支持128个线程。超过128后出现 fork: retry: Resource temporarily unavailable导致容器中的其他进程无法启动。AR502H宿主由于linux下的每个线程都有一个PID。如果按PID的方式限制是否应该按进程的PID。容器的ulimit  -a 信息top -H问题:1. 如何修改线程128限制?2. 如果128个PID受限了,怎样配置为按进程的PID而不是按线程的PID?
  • [技术干货] 为什么有了docker还需要k8s?
    Docker 是 PaaS 提供商 dotCloud 开源的一个基于 LXC 的高级容器引擎,源代码托管在 Github 上, 基于go语言并遵从Apache2.0协议开源。为什么要用Docker?首先分析下没有使用容器时软件行业面临的问题:1. 上线流程繁琐,周期漫长开发、测试、审批、部署、上线,整个过程繁琐,漫长。2. 资源利用率低服务器普遍利用率偏低,浪费资源;多个应用部署到同一服务器上,相互影响,隔离度差,不利于安全防护和管理维护。3. 扩容/缩容不及时业务高峰期扩容流程繁琐,上线不及时。不能动态响应弹性扩容。4. 服务器环境臃肿服务器越来越臃肿,对维护、迁移带来困难。5. 环境不一致性 开发、测试、现场,不同的生产环境需要分别适配,故障排查困难。Docker的主要功能:应用程序打包和发布应用程序隔离持续集成部署微服务快速搭建测试环境提供PaaS产品(平台即服务)我们一般学习docker会使用单机,但实际的生产环境却需要考虑单点故障,一般都是集群部署的。为提高业务并发和高可用,会使用多台服务器,因此会面向这些问题:• 多容器跨主机提供服务• 多容器分布节点部署• 多容器升级版本管理• 如何高效管理这些容器为满足上述需求,先后出现了几种容器编排系统:• Kubernetes• Swarm• Mesos Marathon其中swarm是docker官方推出的,不需要单独安装,直接可以使用,但是功能有限;kubernetes是谷歌开源的,功能丰富,是事实上的标准系统。Mesos Marathon是对分别式集群管理框架,用户比较少。
总条数:476 到第
上滑加载中