

本文為英文版的機器翻譯版本，如內容有任何歧義或不一致之處，概以英文版為準。

# 疑難排解
<a name="troubleshooting"></a>

下列程序與秘訣可協助您針對 AWS 截止日期雲端陣列和資源的問題進行疑難排解。

**Topics**
+ [為什麼使用者看不到我的陣列、機群或佇列？](#troubleshooting_user_not_seeing_farm)
+ [為什麼工作者沒有挑選我的任務？](#troubleshooting_workers_not_picking_jobs)
+ [為什麼我的工作者停滯在執行中？](#troubleshooting_worker_stuck_running)
+ [對截止日期雲端任務進行故障診斷](#jobs-troubleshooting)
+ [截止日期 雲端監控桌面應用程式日誌](#troubleshooting-desktop-logs)
+ [其他資源](#troubleshooting_additional_resources)

## 為什麼使用者看不到我的陣列、機群或佇列？
<a name="troubleshooting_user_not_seeing_farm"></a>

### 使用者存取
<a name="troubleshooting_user_access"></a>

當您的使用者在截止日期雲端監視器中看不到您的陣列、機群或佇列時，他們存取您的陣列和資源可能會發生問題。

無法存取任何陣列的使用者會在截止日期雲端監視器中收到「沒有可用的陣列」訊息。

**若要確認您已將正確的使用者或群組指派給您的陣列、機群或佇列**

1. 在 AWS 截止日期雲端主控台中，尋找您的陣列、機群或佇列，然後選擇**存取管理**。

1. 預設會選取群組索引標籤。如果您依建議群組指派許可，您的群組應該會顯示在清單中，並具有指派的存取層級。

   如果群組不在清單中，請選擇**新增群組**以指派群組的許可。

1. 如果您要依使用者指派許可，請選取**使用者**索引標籤。您的使用者應該會顯示在清單中，並具有指派的存取層級。

   如果您的使用者不在清單中，請選擇**新增使用者**以為使用者指派許可。

**若要確認您已將使用者指派給您的 群組**

1. 在 AWS 截止日期雲端主控台中，尋找您的陣列、機群或佇列，然後選擇**存取管理**。

1. 預設會選取群組索引標籤。選取群組名稱以檢視其成員。

1. 如果使用者未列在群組中，則必須新增使用者。

   如果您使用的是預設身分設定，則可以直接在 Identity Center 主控台中將使用者新增至群組。如果您連線到外部身分提供者，例如 Okta或 Google Workspace，您可以將使用者新增至身分提供者中的 群組。
**注意**  
有些外部身分提供者會將使用者而非群組同步至 Identity Center。在此情況下，請考慮直接將許可指派給使用者，而不是依群組指派許可。

如需管理使用者存取截止日期雲端的詳細資訊，請參閱 [在截止日期雲端中管理使用者](managing-users.md)。

## 為什麼工作者沒有挑選我的任務？
<a name="troubleshooting_workers_not_picking_jobs"></a>

### 機群角色組態
<a name="troubleshooting_workers_fleet_role_config"></a>

有時，當工作者建立但未完成初始化且未開始處理任務時，這是因為機群角色未正確設定。

若要驗證此原因，請檢查您的 CloudTrail 日誌是否有任何存取遭拒的錯誤。確認存取遭拒問題後，請前往您的機群，並將角色組態更新為正確的許可。如需詳細資訊，請參閱《截止日期雲端開發人員指南》中的 [CloudTrail 日誌](https://docs.aws.amazon.com/deadline-cloud/latest/developerguide/logging-using-cloudtrail.html)。

## 為什麼我的工作者停滯在執行中？
<a name="troubleshooting_worker_stuck_running"></a>

### 工作者停滯退出 OpenJD 環境
<a name="troubleshooting_worker_fleet_role_config"></a>

工作者可能會卡在長時間執行的`envExit`工作階段動作中。如果您使用覆寫 OpenJD 範本並設定環境結束動作逾時超過 5 分鐘的任務範本，可能會發生此問題。Deadline Cloud Monitor 提供一些可見性，了解在這種情況下停滯的工作者，但需要針對關聯佇列中的可用工作交叉參考`RUNNING`工作者。

若要尋找停滯的工作者，請前往截止日期雲端監視器中的所有機群，並完成下列步驟：

1. 在工作者狀態欄中，尋找`RUNNING`工作者。

1. 從機群詳細資訊區段中，導覽至每個相關聯的佇列。

1. 在每個相關聯的佇列中，搜尋 `RUNNING`、 `READY`或 的任務`PENDING`。如果所有關聯的佇列在這些狀態下沒有任何任務，則工作者正在執行環境結束。

若要停止工作者停滯在此狀態，請使用下列 AWS CLI 命令：

```
aws deadline update-worker \
    --farm-id $FARM_ID     \
    --fleet-id $FLEET_ID   \
    --worker-id $WORKER_ID \
    --status STOPPED
```

執行 命令後，工作者代理程式會在程式結束時重新啟動。然後，工作者會回到線上，並從相關聯的佇列執行更多任務。如果佇列包含的環境結束動作逾時超過 5 分鐘的更多任務，工作者將會再次停滯。如果發生這種情況，您將需要重複此程序，直到不再有工作者停滯離開為止。

若要避免此問題，請在使用任務範本時，將逾時選項設定為不超過 5 分鐘。

## 對截止日期雲端任務進行故障診斷
<a name="jobs-troubleshooting"></a>

如需 AWS 在截止日期雲端中任務常見問題的相關資訊，請參閱下列主題。

### 為什麼建立我的任務失敗？
<a name="troubleshooting-create-failed"></a>

#### 配額驗證
<a name="troubleshooting-quota-validation"></a>

任務無法通過驗證檢查的一些可能原因包括：
+ 任務範本未遵循 OpenJD 規格。
+ 任務包含太多步驟。
+ 任務包含太多任務總數。
+ 發生內部服務錯誤，導致無法建立任務。

若要查看任務中步驟和任務數量上限的配額，請使用 Service Quotas 主控台。如需詳細資訊，請參閱[的配額 Deadline Cloud](deadline-cloud-quotas.md)。

#### CHUNK【INT】 任務參數錯誤
<a name="troubleshooting-task-chunking-extension"></a>

如果任務建立失敗並顯示下列錯誤訊息，您需要將`TASK_CHUNKING`延伸模組新增至任務範本。

```
The CHUNK[INT] task parameter requires the TASK_CHUNKING extension.
```

若要解決此問題，請將下列內容新增至您的任務範本：

```
extensions:
  - TASK_CHUNKING
```

如需詳細資訊，請參閱*AWS 《截止日期雲端開發人員指南*》中的將[任務區塊新增至任務範本](https://docs.aws.amazon.com/deadline-cloud/latest/developerguide/build-job-bundle-chunking-add.html)。

### 為什麼我的任務不相容？
<a name="troubleshooting-not-compatible"></a>

任務與佇列不相容的常見原因包括：
+ 沒有機群與提交任務的佇列相關聯。開啟截止日期雲端監視器，並檢查佇列是否有相關聯的機群。如需如何檢視佇列的詳細資訊，請參閱 [在截止日期雲端中檢視佇列和機群詳細資訊](view-queue-and-fleet.md)。
+ 任務的主機需求不符合任何與佇列相關聯的機群。若要檢查，請將任務範本中的`hostRequirements`項目與陣列中機群的組態進行比較。請確定其中一個機群符合主機需求。如需機群相容性的詳細資訊，請參閱[判斷機群相容性](https://docs.aws.amazon.com/deadline-cloud/latest/developerguide/build-jobs-scheduling.html#jobs-scheduling-compatibility)。若要檢視機群組態，請參閱 [在截止日期雲端中檢視佇列和機群詳細資訊](view-queue-and-fleet.md)。

截止日期 雲端會在您提交任務時檢查相容性。如果您稍後將相容的機群與佇列建立關聯，現有的`NOT_COMPATIBLE`任務不會自動重新啟動。若要執行這些任務，請重新排入佇列。如需詳細資訊，請參閱[將任務排入佇列](view-a-job.md#view-jobs-steps-tasks-requeue)。

### 為什麼我的任務卡在 中？
<a name="troubleshooting-stuck-ready"></a>

您的任務似乎卡在 `READY` 狀態的可能原因包括：
+ 與佇列相關聯的機群工作者計數上限設定為零。若要檢查，請參閱 [在截止日期雲端中檢視佇列和機群詳細資訊](view-queue-and-fleet.md)。
+ 佇列中有較高的優先順序任務。若要檢查，請參閱 [在截止日期雲端中檢視佇列和機群詳細資訊](view-queue-and-fleet.md)。
+ 對於客戶管理的機群，請檢查自動擴展組態。如需詳細資訊，請參閱*《截止日期雲端開發人員指南*》中的[使用 Amazon EC2 Auto Scaling 群組建立機群基礎設施](https://docs.aws.amazon.com/deadline-cloud/latest/developerguide/create-auto-scaling.html)。

### 為什麼我的任務失敗？
<a name="troubleshooting-job-failed"></a>

任務可能會因為許多原因而失敗。若要搜尋問題，請開啟截止日期雲端監視器，然後選擇失敗的任務。選擇失敗的任務，然後檢視任務的日誌。如需說明，請參閱[在截止日期雲端中檢視工作階段和工作者日誌](view-logs.md)。
+ 如果您看到授權錯誤，或是因為軟體沒有有效的授權而取得浮水印，請確定工作者可以連線到必要的授權伺服器。如需詳細資訊，請參閱*《截止日期雲端開發人員指南*》中的[將客戶受管機群連接至授權端點](https://docs.aws.amazon.com/deadline-cloud/latest/developerguide/cmf-ubl.html)。
+ 最後一個工作階段動作訊息或程序結束碼可能會提供有關工作失敗原因的資訊。如果您使用的是 ，Windows且您的結束代碼為負數，請嘗試搜尋未簽署版本的結束代碼：

  ```
  2,147,483,647 - |{{your exit code}}|
  ```

### 為什麼我的步驟待定？
<a name="troubleshooting-pending-failed"></a>

當一或多個相依性未完成時，步驟可能會保持在 `PENDING` 狀態。您可以使用截止日期雲端監視器來檢查相依性的狀態。如需說明，請參閱[在截止日期雲端中檢視步驟](view-a-step.md)。

## 截止日期 雲端監控桌面應用程式日誌
<a name="troubleshooting-desktop-logs"></a>

Deadline Cloud 監控桌面應用程式會寫入診斷日誌，您可以用來調查當機或其他非預期的行為。報告桌面應用程式的問題時，請包含相關的日誌檔案以協助診斷。

日誌檔案的位置取決於您的作業系統：

Windows  

```
%APPDATA%\com.amazonaws.deadline.monitor\logs
```

macOS  

```
~/Library/Logs/com.amazonaws.deadline.monitor/
```

Linux  

```
~/.config/com.amazonaws.deadline.monitor/logs
```

## 其他資源
<a name="troubleshooting_additional_resources"></a>

您可以在 [GitHub](https://github.com/aws-deadline) 上找到其他資訊和資源。