Skip to main content
ONTAP tools for VMware vSphere 105
此產品有較新版本可以使用。
本繁體中文版使用機器翻譯,譯文僅供參考,若與英文版本牴觸,應以英文版本為準。

疑難排解 ONTAP 工具部署錯誤

貢獻者 netapp-revathid

如果遇到部署問題,請審查日誌和錯誤代碼以診斷和解決問題。從 ONTAP tools for VMware vSphere 10.5 開始,從 Pod 收集的日誌套裝組合包含 MongoDB、RabbitMQ 和 Vault 的日誌,以及所有 Pod 的狀態和描述。這些日誌是對現有 ONTAP tools 服務日誌的補充,增強了支援性和疑難排解。

收集日誌檔

您可以透過 ONTAP tools Manager 使用者介面中的選項收集 ONTAP tools for VMware vSphere 的日誌檔案。技術支援人員可能會要求您收集這些日誌檔案,以協助疑難排解問題。

註 從 ONTAP tools Manager 產生記錄包含所有 vCenter Server 執行個體的所有記錄。從 vCenter 用戶端使用者介面產生記錄的範圍僅限於所選的 vCenter Server。
步驟
  1. 透過網頁瀏覽器啟動 ONTAP tools Manager: https://<ONTAPtoolsIP>:8443/virtualization/ui/

  2. 使用您在部署期間提供的 ONTAP tools for VMware vSphere 系統管理員憑證登入。

  3. 從側邊欄選擇 Log Bundles

    此操作可能需要幾分鐘。

  4. 選擇 Generate 以產生日誌檔。

  5. 輸入日誌套裝組合的標籤,然後選擇 Generate

    下載 tar.gz 檔案並將其傳送給技術支援。

請依照以下步驟使用 vCenter 用戶端使用者介面產生日誌套裝組合:

步驟
  1. 登入 vSphere 用戶端。

  2. 從 vSphere Client 主頁,前往 支援 > Log bundle > 產生

  3. 提供日誌套裝組合標籤並產生日誌套裝組合。檔案產生後,您可以看到下載選項。下載可能需要一些時間。

註 產生的日誌套裝組合將取代最近 3 天或 72 小時內產生的日誌套裝組合。

部署錯誤程式碼

在使用 ONTAP tools for VMware vSphere 進行部署、重新開機和恢復作業時,您可能會遇到錯誤代碼。錯誤代碼為五位數,前兩位數字代表遇到問題的指令碼,後三位數字代表該指令碼中的具體工作流程。

所有錯誤日誌都記錄在 /var/log 目錄下的 ansible-perl-errors.log 日誌檔中,以便於追蹤和解決問題。此日誌檔包含錯誤代碼和失敗的 Ansible 工作。

註 本頁提供的錯誤代碼僅供參考。如果錯誤仍然存在或未提及解決方案,請聯絡支援團隊。

下表列出了錯誤代碼及其對應的檔案名稱。

錯誤代碼

指令碼名稱

00

firstboot-network-config.pl,mode deploy

01

firstboot-network-config.pl,升級模式

02

firstboot-inputs-validation.pl

03

firstboot-deploy-otv-ng.pl, 部署, HA

04

firstboot-deploy-otv-ng.pl,部署,非 HA

05

firstboot-deploy-otv-ng.pl, 重新開機

06

firstboot-deploy-otv-ng.pl, 升級, HA

07

firstboot-deploy-otv-ng.pl,升級,非高可用性

08

firstboot-otv-recovery.pl

09

post-deploy-upgrade.pl

錯誤代碼的最後三位數字表示指令碼中的特定工作流程錯誤:

部署錯誤代碼

工作流程

解決方案

049

對於網路和驗證,perl 指令碼也會很快為其指派。

-

050

SSH 金鑰產生失敗

重新啟動主要虛擬機器(VM)。

053

無法安裝 RKE2

執行以下命令並重新啟動主要虛擬機器或重新部署:sudo rke2-killall.sh (所有虛擬機器) sudo rke2-uninstall.sh (所有虛擬機器)。

054

設定 kubeconfig 失敗

重新部署

055

登錄檔部署失敗

如果登錄 pod 存在、請等待 pod 準備就緒、然後重新啟動主要 VM 或重新部署。

059

KubeVip 部署失敗

請確保部署期間提供的 Kubernetes 控制平面虛擬 IP 位址和 ONTAP tools IP 位址屬於相同 VLAN,且均為閒置 IP 位址。若以上所有條件均已滿足,請重新啟動服務。否則,請重新部署。

060

Operator 部署失敗

重新啟動

061

服務部署失敗

在 ntv-system 命名空間中執行基本的 Kubernetes 偵錯,例如 get pods、get rs、get svc 等,更多詳細資訊和錯誤日誌位於 /var/log/ansible-perl-errors.log 和 /var/log/ansible-run.log,然後重新部署。

062

ONTAP tools 服務部署失敗

請參閱 /var/log/ansible-perl-errors.log 中的錯誤日誌以取得更多詳細資訊並重新部署。

065

Swagger 頁面 URL 無法連線

重新部署

066

閘道憑證部署後步驟失敗

請執行下列步驟以恢復 / 完成升級:

  • 啟用診斷 Shell。

  • 執行 'sudo perl /home/maint/scripts/post-deploy-upgrade.pl --postDeploy' 命令。

  • 請查看 /var/log/post-deploy-upgrade.log 的記錄。

088

為 journald 設定日誌輪替失敗

檢查虛擬機器的網路設定是否與虛擬機器所在的主機相容。您可以嘗試移轉到另一台主機並重新啟動虛擬機器。

089

更改摘要日誌輪換設定檔案的所有權失敗

重新啟動主要虛擬機器。

096

安裝動態儲存設備配置器

-

108

種子指令碼失敗

-

114

MongoDB 集合中的內部憑證更新失敗

如果部署失敗並出現錯誤代碼 114、請完成下列步驟:

  • 啟用診斷 Shell。

  • 執行下列命令: sudo perl /home/maint/scripts/post-deploy-upgrade.pl --internal_cert_update_collection

  • 查看位於 /var/log/otvng/post-deploy-upgrade.log 的日誌

重新啟動錯誤代碼

工作流程

解決方案

067

等待 rke2-server 逾時。

-

101

重設維護/主控台使用者密碼失敗。

-

102

重設 Maint/Console 使用者密碼時,刪除密碼檔案失敗。

-

103

更新保存庫中新維護/主控台使用者密碼失敗。

-

088

為 journald 設定日誌輪替失敗。

檢查虛擬機器的網路設定是否與虛擬機器所在的主機相容。您可以嘗試移轉到另一台主機並重新啟動虛擬機器。

089

變更摘要日誌輪替設定檔案的所有權失敗。

重新啟動虛擬機器。