跳到主內容
版本:3.1

排除執行個體問題

請參閱本指南,以診斷 CubeCOS 實例(虛擬機器)的常見問題。 若您尚未閱讀,請先參閱 疑難排解概覽,以排除是否為整個叢集範圍的問題。

開始之前​

某些檢查需要使用 OpenStack CLI。 請從控制器節點,或從任何已載入 /etc/admin-openrc.sh 且已安裝 openstack 客戶端的宿主機上執行這些指令。

實例無法啟動​

  1. 請檢查實例狀態及故障原因。

    Check the instance status and fault reason
    openstack server show <instance-id> -c status -c fault
  2. 開啟 運算 > 執行個體,選取該執行個體,並檢視 動作日誌 索引標籤中的失敗事件。

  3. 請檢查以下常見原因:

    • 該專案的運算或儲存空間配額已用罄。
    • 來源映像或可開機磁碟區的狀態並非 Active。
    • 該可用區域中沒有任何主機具備足夠的可用 vCPU、記憶體或磁碟空間來滿足此規格的需求。
    • 所選的網路或安全群組已不存在。

某個實例卡在「建置」狀態中​

  1. 請確認 Compute 服務狀態正常。

    Check cluster service health
    controller> cluster check_repair

    請查看 Compute 行中的 FIXING 狀態。

  2. 如果您是從映像檔啟動實例,請確認該映像檔已上傳完成,且在 運算 > 映像檔 下顯示 Active 狀態。 若某張圖片卡在 儲存中 狀態,且檔案大小為 0,通常表示有兩次完全相同的上傳作業同時執行。

  3. 請檢視該執行個體上的 操作日誌 索引標籤,以確認具體的排程或配置錯誤。

某個執行個體無法停止運作或顯示錯誤的狀態​

檢查伺服器的狀態及其所排程的運算主機。

Check server state and host
openstack server show <instance-id> -c status -c vm_state -c OS-EXT-SRV-ATTR:host

若 status 與 vm_state 不一致,或報告的主機無法連線,請執行 cluster check_repair 並檢查 Compute 列,然後再重新嘗試停止或啟動操作。

主控台無法載入​

  1. 請確認執行個體的狀態為 Active。 已停止或發生錯誤的執行個體無法使用控制台。
  2. 重新開啟主控台:導航至 運算 > 執行個體,點選該執行個體的 主控台,然後點選 確認。 如需完整的操作步驟,請參閱 連線至您的 Linux 或 Windows 執行個體。
  3. 如果主控台仍無法開啟,請執行 cluster check_repair,並檢查 Compute 列是否顯示 FIXING 狀態。

調整實例大小或遷移實例失敗​

  1. 開始之前,請確認執行個體的狀態為 Active。 調整大小與即時遷移均需確保執行個體處於正常運作狀態。
  2. 變更版本後,請確認您已從 更多 > 配置更新 選單中完成 確認調整大小或遷移 步驟。 未經確認的尺寸調整將維持在「待處理」狀態。
  3. 請確認目標主機是否有足夠的可用容量來容納新的規格。
  4. 執行 cluster check_repair,並檢查 Compute 列是否顯示 FIXING 狀態。

完整的操作步驟請參閱 調整實例大小。

該執行個體無法連線至網路​

網路連線問題通常是由於網路設定所致,而非實例本身的問題。 請參閱 網路問題疑難排解。

磁碟區無法附加至或從實例中移除​

卷掛載問題通常是由於卷或儲存叢集的狀態所致,而非實例本身的問題。 請參閱 儲存問題的疑難排解。