高级功能
裸金属管理
裸金属设备无法获取硬件信息,怎么办?
裸金属设备无法获取硬件信息一般有以下两种原因,可根据原因分类,尝试参考解决方案进行排查解决:
原因一
服务器存在多个IPMI地址,同时存在共享网络配置地址、专有网络地址。
解决方案
原因二
裸金属主机BIOS模式需配置为Legacy。
解决方案
解决方案
若非以上两种原因,可尝试检查以下配置进行排查:
Ceph主存储创建裸金属主机失败,如何解决?
原因
带宽过低导致创建超时。
解决方案
操作步骤
- SSH连接至管理节点。
-
依次执行以下命令,修改超时时间为24小时:
[root@localhost ~]# zstack-cli admin >>>LogInByAccount accountName=admin password=$password //密码为平台admin用户密码 admin >>> UpdateGlobalConfig category=baremetal2 name=convert.volume.to.local.disk.timeout value=24h
弹性裸金属管理
裸金属节点无法获取硬件信息,如何解决?
原因
- 网络问题:
- 添加网关节点时,网关节点的网卡和裸金属节点PXE启动网卡可能未在同一个二层网络。
- 裸金属节点可能接入了其他DHCP网络,PXE启动时获取了其他DHCP服务提供的地址。
- 配置问题:
- 裸金属节点BIOS可能未设置UEFI启动。
- 裸金属节点与网关节点互联的网卡可能未设置PXE模式启动。
- 网关节点上的TFTP等服务可能没有正常启动。
- 服务器硬件兼容性问题:
- 服务器硬件和云平台可能会存在兼容性问题,导致弹性裸金属功能无法正常使用,例如网卡固件版本可能存在不支持UEFI启动的问题。
解决方案
可根据以上问题分类,尝试以下步骤进行排查:
解决方案
可尝试检查以下步骤进行排查:
- 请确认网关节点的网卡和裸金属节点PXE启动网卡在同一个独立二层网络互联。
- 请确认部署网络内不存在其他DHCP服务,避免DHCP冲突。
- 请确认裸金属节点BIOS已设置UEFI启动。
- 请确认裸金属节点与网关节点互联的网卡已设置PXE模式启动。
- 请确认网关节点上的DHCP、TFTP等服务已正常启动。
- 请确认服务器硬件兼容性良好。
弹性裸金属实例登录缓慢,如何解决?
原因
弹性裸金属实例配置了DNS解析导致登录缓慢。
解决方案
操作步骤
- SSH连接至弹性裸金属实例。
- 禁用/etc/ssh/sshd_config文件中的UseDNS选项,并注释/etc/resovle.conf文件中的DNS域名。
网关节点添加失败,如何解决?
原因
网关节点没有映射LUN设备,导致添加网关节点所选择的弹性裸金属集群无法挂载IPSAN主存储。
解决方案
灾备管理
本地备份任务失败,如何解决?
原因
进程打开的文件数超过限制。
解决方案
操作步骤
-
登录本地备份服务器,执行以下命令查看连接数:
[root@localhost ~]# lsof -p `pgrep zstore`|wc -lNote: max open files参数值为4096。若返回的连接数大于4096,表示进程打开的文件数超过了限制。 -
执行以下命令,重启zstore服务释放连接数:
[root@localhost ~]# systemctl restart zstack-imagestorebackupstorage.service
如何手动取消灾备任务?
解决方案
- 可通过重启云主机快速取消灾备任务。
-
若因业务限制不能重启云主机,可参考以下步骤:
迁移服务
如何将Hyper-V平台云主机迁移至本云平台?
解决方案
操作步骤
- 登录Hyper-V平台。
- 找到源云主机并进行导出。
- 将导出云主机的vhdx文件传输至本云平台目标物理机中。
-
进入目标物理机系统,执行以下命令检查vhdx文件完整性:
[root@localhost ~]# qemu-img check -r all 1001045.vhdxNote: 返回No errors were found on the image则表示通过文件完整性检查。 -
执行以下命令转换文件格式:
[root@localhost ~]# qemu-img convert -O qcow2 1001045.vhdx vm-1100074-disk-0.qcow2Note: 转换后的文件包含源云主机系统盘镜像以及数据盘镜像。 - 将源云主机系统盘镜像和数据盘镜像上传至本云平台,分别作为新建云主机的系统镜像和云盘镜像。
- 在本云平台使用所上传的系统镜像和云盘镜像创建云主机。
可通过以下步骤实现:
VMware双系统云主机迁移至本云平台时报错,如何解决?
原因
V2V迁移时,若云主机使用多操作系统,系统默认不会自动指定第一启动项,导致迁移报错。
解决方案
操作步骤
-
开启zstack-cli会话:
[root@localhost ~]# zstack-cli -
使用admin账户登录云平台:
admin >>> LogInByAccount accountName=admin password=xxx //密码为平台admin用户密码 -
开启系统自动指定第一启动项功能:
admin >>> UpdateGlobalConfig category=v2v name=v2v.enableRootFirst value=true
可进入管理节点系统,执行以下命令修改全局设置,开启系统自动指定第一启动项功能:
如何将KVM平台的云主机迁移至本云平台中?
解决方案
ZStack Cloud提供V2V迁移服务,支持将基于KVM的源云平台的云主机及数据完整迁移至ZStack Cloud云平台。详情请参考《迁移服务使用教程》。
云主机迁移失败,怎么办?
现象
{
"error": {
"code": "HOST.1009",
"description": "Failed to migrate vm on hypervisor",
"details": "failed to migrate vm[uuid:90bb61f55e774f5f89c9e1ea46db7661] from kvm host[uuid:e5105c61114a4efe8bcc025f744226bd, ip:10.0.247.244] to dest host[ip:10.0.197.238], unable to migrate vm[uuid:90bb61f55e774f5f89c9e1ea46db7661] to qemu+tcp://10.0.197.238/system, internal error: Attempt to migrate guest to the same host localhost.domain.com"
},
"createdTime": 1488170137857,
"type": {
"_name": "key.event.API.API_EVENT"
},
"id": "e6bcd7c33ad9446b919e11cd647fc8dc"
}原因
两台物理机hostname相同。KVM云主机在线迁移依靠hostname进行确认物理机,若hostname相同即被认定为同一台物理机。
解决方案
建议对物理机设置不同的hostname。若遇到以上报错,请联系官方技术支持获取帮助。
云主机V2V迁移失败,如何解决?
云主机V2V迁移失败一般存在多种现象和原因,可根据以下现象和原因分类,尝试参考解决方案进行排查解决:
现象
- 现象一:云主机V2V迁移失败,出现
libguestfs error: grep:/etc/selinux/disabled/contexts/files/file_contexts: No such file ordirectory报错。 - 现象二:云主机V2V迁移任务提示超时。
- 现象三:云主机V2V迁移失败,出现
operation error, because:target host cannot Access NFS报错。 - 现象四:云主机V2V迁移失败,出现
Expecting VMX entry 'numvcpus' to be an unsigned integer (1 or a multiple of 2) but found 3报错。 - 现象五:ZStack Cloud 3.1版本迁移至ZStack Cloud 3.6版本失败,出现
unsupported flags (0x4) in function qemuDomainBlockCopy报错。 - 现象六:Windows云主机迁移失败。
- 现象七:V2V迁移提示无法识别到源物理机上的云主机。
原因一
出现现象一,可能是由于selinux相关配置存在问题。
解决方案
vi
/etc/selinux/config命令,将参数修改为SELINUXTYPE=targeted即可。

原因二
出现现象二,可能是由于迁移数据量过大,导致迁移超时任务失败。
解决方案
[root@localhost ~]# zstack-cli
admin >>> LogInByAccount accountName=admin password=$password //密码为平台admin用户密码
admin >>> UpdateGlobalConfig name=longJob.api.timeout category=longJob value=xxx //xxx为超时时间
原因三
出现现象三,可能是由于源物理机qemu版本过低。
解决方案
原因四
出现现象四,可能是由于云主机CPU数量需要为1或者2的倍数。
解决方案
原因五
出现现象五,可能是由于源物理机Libvirt版本过低。
解决方案
原因六
出现现象六,可能是由于源云平台Windows云主机未关闭休眠功能。
解决方案
#cmd-->“powercfg -h off”
原因七
出现现象七,可能是由于源物理机SSH配置有访问控制。
解决方案
云主机V2V迁移后系统异常,如何解决?
现象
迁移后云主机无法打开进入系统。
原因
云主机系统未安装或不支持virtio驱动。
解决方案
云主机V2V迁移后网络异常,如何解决?
现象
使用V2V迁移Linux系统云主机后,在云主机内无法正常启动网络服务。
原因
VMware类型源云平台的网卡设备名为ens33等,而KVM类型源云平台的网卡设备名为eth0、eth1等,二者网卡设备名不一致导致配置文件不能正常识别网卡,无法启动网络服务。
解决方案
操作步骤
-
在云主机系统内执行以下命令,进入云主机网卡配置文件目录:
[root@localhost ~]# cd /etc/sysconfig/network-scripts/ -
执行以下命令,修改网卡配置文件:
[root@localhost ~]# vim ifcfg-ens33 -
修改NAME和DEVICE参数为eth0。
如图 2所示:
图 2. 修改配置文件 
-
执行以下命令,保存修改并退出:
[root@localhost ~]# mv /etc/sysconfig/network-scripts/ifcfg-ens32 /etc/sysconfig/network-scripts/ifcfg-e -
执行以下命令,重启网络服务:
[root@localhost ~]# systemctl network restartNote: 变更网络配置及重启网络服务前需确保该物理机没有业务正在运行。
云主机V2V迁移后Windows2003开机蓝屏,如何解决?
现象
云主机V2V迁移后Windows2003开机蓝屏。
原因
由于硬件配置变化导致蓝屏错误 。
解决方案
操作步骤
- vmware侧卸载guest tools,以及相关驱动。
-
云主机根盘配置为IDE。
示例:win2003编辑设置>磁盘1>虚拟设备节点,将虚拟设备节点选项卡设置为IDE 0。
-
MergeIDE iso配置。
使用V2V辅助工具:记录IDE控制器的信息, 挂载到MergeIDE iso。启动VM后,执行MergeIDE iso文件。
-
导出OVF模板。
执行路径:操作-win-2003>模板>导出OVF模板。
-
OVF模板导入ZStack Cloud。
将新导出的OVF模板导入ZStack Cloud,然后启动VM。Note: 若导入OVF失败,可通过上传VMDK文件的方式创建云主机。
V2V迁移报错“could not find domain with name 'xxxx'”,如何解决?
现象
V2V迁移过程中,源主机名字符类型问题触发报错。
原因
源云主机名字存在云平台不支持的字符 。
解决方案
修改源云主机名称为全英文,即可正常完成迁移流程。
V2V迁移报错“failed to run virt-v2v”,如何解决?
现象
V2V迁移报错:failed to run virt-v2v,because unable to mount the disk image for
writing。
原因
源云主机windows系统已开启休眠模式 。
解决方案
-
在windows内部执行:
powercfg -h off。 -
继续执行:
shutdown -s。 - 完成后关机,重新执行迁移命令。
租户管理
账户权限异常,如何解决?
现象
自定义角色无法加载负载均衡服务。
原因
自定义角色权限配置错误。
解决方案
操作步骤
- 修改自定义角色权限配置,点击,进入角色界面。在自定义角色详情页的API权限子页面中,点击修改。
-
勾选其他服务权限和ZWatch相关接口中的查询获取权限。
Note: 建议按照最小权限原则为角色赋权。如图 3所示:
图 3. 修改API权限 
租户管理项目配额无法修改,如何解决?
原因
可能是由于浏览器缓存或插件问题。
解决方案
vCenter
为什么纳管vCenter的云主机无法打开控制台?
功能说明
纳管的云主机无法挂载云盘,如何解决?
原因
不支持热加载或加载数量超过上限。
解决方案
操作步骤
- 可尝试关闭云主机后挂载云盘。
- 检查云主机是否存在CD-ROM、软驱等可卸载设备,若存在,请尝试卸载后再挂载云盘。
创建云主机异常,如何解决?
现象
纳管VMware创建云主机无法选择集群和物理机。
原因
VMware物理机空间不足。
解决方案
纳管vCenter时出现“没有系统标签与资源类型【VolumeVO】匹配”报错,怎么办?
原因
可能是由于添加vCenter时,填写的vCenter用户权限不够导致。
解决方案
- 检查用户权限,必要时可以开启全部权限。
- 重新添加vCenter,使用administrator@vsphere.local用户名。
使用AMD R7-5800H型号CPU在VMware嵌套环境创建云主机失败,如何解决?
现象
libvirt error: internal error: qemu unexpectedly closed the monitor: 2020-10-28T02:35:23.836129Z qemu-kvm: error: failed to set MSR 0x10a to 0x0 q解决方案
操作步骤
-
检查物理机dmesg日志,会发现
kvm: vcpu0 unhandled rdmsr: 0x199报错。 -
在物理机系统内执行以下命令,向KVM模块传递参数:
echo 1 > /sys/module/kvm/parameters/ignore_msrs - 完成KVM模块传参后即可解决。
vCenter云主机控制台打不开,提示需下载受信任的根CA证书后再试,如何解决?
现象
点击vCenter云主机控制台,无法打开控制台并出现以下提示信息:控制台打开异常,请使用浏览器登录vCenter并在登陆界面下载受信任的根CA证书后再试。
解决方案
操作步骤
- 打开浏览器,输入vCenter IP地址,进入vCenter主界面。
-
在vCenter主界面,右键点击下载受信任的根CA证书,选择将链接另存为。

- 下载并解压CA证书。
- 在Windows中搜索打开Internet属性。
-
在Internet属性弹窗中,点击内容选项卡,然后选择证书。

-
在证书弹窗中,点击受信任的根证书颁发机构选项卡,然后选择导入。

-
在证书导入向导弹窗中,跟随向导上传解压后的CA证书文件。

- 重启浏览器。
- 在云平台打开vCenter云主机控制台。
