排除執行個體問題
請參閱本指南,以診斷 CubeCOS 實例(虛擬機器)的常見問題。 若您尚未閱讀,請先參閱 疑難排解概覽,以排除是否為整個叢集範圍的問題。
開始之前
某些檢查需要使用 OpenStack CLI。 請從控制器節點,或從任何已載入 /etc/admin-openrc.sh 且已安裝 openstack 客戶端的宿主機上執行這些指令。
實例無法啟動
-
請檢查實例狀態及故障原因。
Check the instance status and fault reasonopenstack server show <instance-id> -c status -c fault -
開啟 運算 > 執行個體,選取該執行個體,並檢視 動作日誌 索引標籤中的失敗事件。
-
請檢查以下常見原因:
- 該專案的運算或儲存空間配額已用罄。
- 來源映像或可開機磁碟區的狀態並非
Active。 - 該可用區域中沒有任何主機具備足夠的可用 vCPU、記憶體或磁碟空間來滿足此規格的需求。
- 所選的網路或安全群組已不存在。
某個實例卡在「建置」狀態中
-
請確認 Compute 服務狀態正常。
Check cluster service healthcontroller> cluster check_repair請查看
Compute行中的FIXING狀態。 -
如果您是從映像檔啟動實例,請確認該映像檔已上傳完成,且在 運算 > 映像檔 下顯示
Active狀態。 若某張圖片卡在儲存中狀態,且檔案大小為0,通常表示有兩次完全相同的上傳作業同時執行。 -
請檢視該執行個體上的 操作日誌 索引標籤,以確認具體的排程或配置錯誤。
某個執行個體無法停止運作或顯示錯誤的狀態
檢查伺服器的狀態及其所排程的運算主機。
Check server state and host
openstack server show <instance-id> -c status -c vm_state -c OS-EXT-SRV-ATTR:host
若 status 與 vm_state 不一致,或報告的主機無法連線,請執行 cluster check_repair 並檢查 Compute 列,然後再重新嘗試停止或啟動操作。
主控台無法載入
- 請確認執行個體的狀態為
Active。 已停止或發生錯誤的執行個體無法使用控制台。 - 重新開啟主控台:導航至 運算 > 執行個體,點選該執行個體的 主控台,然後點選 確認。 如需完整的操作步驟,請參閱 連線至您的 Linux 或 Windows 執行個體。
- 如果主控台仍無法開啟,請執行
cluster check_repair,並檢查Compute列是否顯示FIXING狀態。
調整實例大小或遷移實例失敗
- 開始之前,請確認執行個體的狀態為
Active。 調整大小與即時遷移均需確保執行個體處於正常運作狀態。 - 變更版本後,請確認您已從 更多 > 配置更新 選單中完成 確認調整大小或遷移 步驟。 未經確認的尺寸調整將維持在「待處理」狀態。
- 請確認目標主機是否有足夠的可用容量來容納新的規格。
- 執行
cluster check_repair,並檢查Compute列是否顯示FIXING狀態。
完整的操作步驟請參閱 調整實例大小。
該執行個體無法連線至網路
網路連線問題通常是由於網路設定所致,而非實例本身的問題。 請參閱 網路問題疑難排解。
磁碟區無法附加至或從實例中移除
卷掛載問題通常是由於卷或儲存叢集的狀態所致,而非實例本身的問題。 請參閱 儲存問題的疑難排解。