Skip to main content
ONTAP tools for VMware vSphere 105
本产品推出了新版本。
简体中文版经机器翻译而成,仅供参考。如与英语版出现任何冲突,应以英语版为准。

排除 ONTAP tools 部署错误

贡献者 netapp-revathid

如果遇到部署问题,请查看日志和错误代码以诊断和解决问题。从 ONTAP tools for VMware vSphere 10.5 开始,从 Pod 收集的日志捆绑包包括来自 MongoDB、RabbitMQ 和 Vault 的日志,以及所有 Pod 的状态和描述。这些内容是在现有 ONTAP tools 服务日志的基础上提供的,增强了可支持性和故障排除能力。

收集日志文件

您可以从 ONTAP tools Manager 用户界面中提供的选项收集 ONTAP tools for VMware vSphere 的日志文件。技术支持可能会要求您收集日志文件,以帮助解决问题。

备注 从 ONTAP tools Manager 生成日志包括所有 vCenter Server 实例的所有日志。从 vCenter 客户端用户界面生成日志的作用域为选定的 vCenter Server。
步骤
  1. 从 Web 浏览器启动 ONTAP tools Manager: https://<ONTAPtoolsIP>:8443/virtualization/ui/

  2. 使用部署期间提供的 ONTAP tools for VMware vSphere 管理员凭据登录。

  3. 从侧边栏中选择 Log Bundles

    此操作可能需要几分钟时间。

  4. 选择*Generate*以生成日志文件。

  5. 输入日志捆绑包的标签,然后选择*Generate*。

    下载 tar.gz 文件并将其发送给技术支持。

按照以下步骤使用 vCenter 客户端用户界面生成日志包:

步骤
  1. 登录到 vSphere 客户端。

  2. 在 vSphere Client 主页中,转到 支持 > 日志捆绑包 > 生成

  3. 提供日志捆绑包标签并生成日志捆绑包。生成文件时,您可以看到下载选项。下载可能需要一段时间。

备注 生成的日志捆绑包将替换过去 3 天或 72 小时内生成的日志捆绑包。

部署错误代码

在 ONTAP tools for VMware vSphere 部署、重新启动和恢复操作期间,您可能会遇到错误代码。错误代码为五位数,其中前两位表示遇到问题的脚本,后三位表示该脚本中的特定工作流。

所有错误日志都记录在 /var/log 目录下的 ansible-perl-errors.log 文件中,以方便跟踪和解决问题。此日志文件包含错误代码和失败的 Ansible 任务。

备注 本页提供的错误代码仅供参考。如果错误仍然存在或没有提及解决方案,请联系客服团队。

下表列出了错误代码和相应的文件名。

错误代码

脚本名称

00

firstboot-network-config.pl,mode deploy

01

firstboot-network-config.pl,模式升级

02

firstboot-inputs-validation.pl

03

firstboot-deploy-otv-ng.pl,部署,HA

04

firstboot-deploy-otv-ng.pl,部署,非 HA

05

firstboot-deploy-otv-ng.pl, reboot

06

firstboot-deploy-otv-ng.pl,升级,HA

07

firstboot-deploy-otv-ng.pl,升级,非 HA

08

firstboot-otv-recovery.pl

09

post-deploy-upgrade.pl

错误代码的最后三位数表示脚本中的特定工作流错误:

部署错误代码

工作流

解决方案

049

对于网络和验证,perl 脚本也将很快分配它们

-

050

SSH 密钥生成失败

重新启动主虚拟机(VM)。

053

无法安装 RKE2

请运行以下命令并重新启动主虚拟机,或重新部署:sudo rke2-killall.sh(所有虚拟机)sudo rke2-uninstall.sh(所有虚拟机)。

054

设置 kubeconfig 失败

重新部署

055

无法部署注册表

如果存在注册表 pod,请等待 pod 准备就绪,然后重新启动主 VM 或重新部署。

059

KubeVip 部署失败

确保在部署期间提供的 Kubernetes 控制面的虚拟 IP 地址和 ONTAP tools IP 地址属于相同的 VLAN,并且是空闲的 IP 地址。如果前面的所有点都正确,请重新启动。否则,重新部署。

060

操作员部署失败

重新启动

061

服务部署失败

在 ntv-system 命名空间中执行基本的 Kubernetes 调试,如 get pods、get rs、get svc 等,以获取更多详细信息,并查看 /var/log/ansible-perl-errors.log 和 /var/log/ansible-run.log 中的错误日志,然后重新部署。

062

ONTAP tools 服务部署失败

有关更多详细信息和重新部署,请参见 /var/log/ansible-perl-errors.log 中的错误日志。

065

Swagger 页面 URL 不可访问

重新部署

066

网关证书的后期部署步骤失败

执行以下操作以恢复/完成升级:

  • 启用诊断 shell。

  • 运行 'sudo perl /home/maint/scripts/post-deploy-upgrade.pl --postDeploy' 命令。

  • 请检查 /var/log/post-deploy-upgrade.log 中的日志。

088

为 journald 配置日志轮换失败

检查与托管虚拟机的主机兼容的虚拟机网络设置。您可以尝试迁移到其他主机并重新启动虚拟机。

089

更改摘要日志轮转配置文件的所有权失败

重新启动主虚拟机。

096

安装动态存储资源调配器

-

108

种子设定脚本失败

-

114

MongoDB 集合中的内部证书更新失败

如果部署失败并显示错误代码 114,请完成以下步骤:

  • 启用诊断 shell。

  • 运行以下命令: sudo perl /home/maint/scripts/post-deploy-upgrade.pl --internal_cert_update_collection

  • 请查看以下位置的日志: /var/log/otvng/post-deploy-upgrade.log

重新启动错误代码

工作流

解决方案

067

等待 rke2-server 超时。

-

101

无法重置 Maint/Console 用户密码。

-

102

无法在重置维护/控制台 (Console) 用户密码期间删除密码文件。

-

103

无法在保管库中更新新维护/控制台用户密码。

-

088

为 journald 配置日志轮换失败。

检查与托管虚拟机的主机兼容的虚拟机网络设置。您可以尝试迁移到其他主机并重新启动虚拟机。

089

更改摘要日志轮转配置文件的所有权失败。

重新启动 VM。