View a markdown version of this page

監控 Amazon GameLift Servers - Amazon GameLift Servers

本文為英文版的機器翻譯版本,如內容有任何歧義或不一致之處,概以英文版為準。

監控 Amazon GameLift Servers

監控是維護 Amazon GameLift Servers 和其他 AWS 解決方案的可靠性、可用性和效能的重要部分。Amazon GameLift Servers 的指標有三種主要用途:監控系統運作狀態和設定警示、追蹤遊戲伺服器效能和使用量、使用手動或自動調整規模管理容量。

AWS 提供下列監控工具來監看 Amazon GameLift Servers、回報錯誤,以及適時採取自動動作:

  • Amazon GameLift Servers 主控台 – 使用圖形界面來管理您的Amazon GameLift Servers資源並追蹤遊戲託管活動。

  • 伺服器遙測指標 – Amazon GameLift Servers可讓您透過 SDK 和外掛程式整合,直接從遊戲伺服器發出自訂指標。您可以定義和追蹤自己的遊戲特定指標,以及內建效能、網路、記憶體和計時資料。所有指標都可以發佈到 Amazon Managed Service for Prometheus,並使用完全可自訂的儀表板在 Amazon Grafana 中進行監控。您也可以發佈至 Amazon CloudWatch 以與其他 AWS 服務整合。遙測系統可完全自訂 - 您可以建立自訂 Prometheus 查詢,以衍生內建指標以外的其他指標。如需技術堆疊特定的實作指南,請參閱 使用伺服器遙測指標進行監控。

  • Amazon CloudWatch – 您可以即時監控Amazon GameLift Servers指標,以及您在 AWS 服務上執行之其他 AWS 資源和應用程式的指標。Amazon CloudWatch 提供一套監控功能,包括建立自訂儀表板的工具,以及設定在指標達到指定閾值時通知或採取動作的警示。

  • AWS CloudTrail – 會擷取由您的帳戶發出或代表 AWS 為 和其他 AWS 服務發出的所有 API 呼叫Amazon GameLift Servers和相關事件。資料會以日誌檔案形式交付至您指定的 Amazon S3 儲存貯體。您可以識別呼叫的使用者和帳戶 AWS、進行呼叫的來源 IP 地址,以及呼叫的時間。

  • 遊戲工作階段日誌 – 您可以輸出遊戲工作階段的自訂伺服器訊息,以記錄存放在 Amazon S3 中的檔案。

監控來源之間的指標比較

Amazon GameLift Servers 透過三個主要來源提供指標:Amazon GameLift Servers主控台機群活動指標、伺服器遙測指標和 Amazon CloudWatch Amazon GameLift Servers指標。每個來源都有唯一的功能。伺服器遙測提供最深入的伺服器端和作業系統層級可見性,CloudWatch 提供最廣泛的 GameLift 端機群、佇列和配對指標集,用於警示和自動化,主控台可快速顯示機群活動。下表顯示每個來源提供的指標,依指標類別整理。

依來源的指標可用性

在下表中:

  • 主控台指出指標是以原生方式顯示在Amazon GameLift Servers主控台中 (例如,在機群的活動、擴展或位置索引標籤上,或在機群資料表中)。

  • CloudWatch 表示指標已發佈至AWS/GameLift命名空間,並且可以透過 CloudWatch 進行圖形化、警示或查詢。

  • 遙測表示指標是由 Amazon GameLift Servers OpenTelemetry Collector 收集,並且可在管理入口網站和預先建置的儀表板中使用。✓* 表示指標不會直接發出,但可以透過針對收集的遙測的自訂 PromQL 查詢衍生。

執行個體指標

執行個體層級容量和生命週期指標:

執行個體指標可用性
指標 主控台 CloudWatch 遙測
使用中的執行個體 ✓ ✓ ✓*
閒置執行個體 ✓ ✓ ✓*
閒置執行個體所占百分比 ✓ ✓ ✓*
所需的執行個體 ✓ ✓
最小執行個體 ✓ ✓
執行個體上限 ✓ ✓
待定執行個體 ✓ ✓
終止執行個體 ✓ ✓
執行個體 Spot 中斷 ✓ ✓
回收執行個體 (Spot) ✓ ✓
已取代運作狀態不佳的執行個體 ✓ ✓

執行個體系統和作業系統指標

Operating-system-level執行個體指標。伺服器遙測會收集比 CloudWatch 更豐富的一組主機指標,包括詳細的記憶體、檔案系統和網路明細。EC2 機群會發出與容器機群不同的一組主機指標 – 容器機群指標列於下列容器機群指標下。

執行個體系統和作業系統指標可用性 (受管 EC2 機群)
指標 主控台 CloudWatch 遙測
CPU 使用率 ✓ ✓ ✓
依狀態的 CPU 時間 (使用者、系統、閒置、iowait) ✓
CPU 負載平均值 (1 公尺、5 公尺、15 公尺) ✓
記憶體用量和使用率 ✓
檔案系統用量和使用率 ✓
網路輸入/輸出 (位元組) ✓ ✓ ✓
網路封包、錯誤、捨棄 ✓
作用中網路連線 ✓
磁碟讀取/寫入位元組 ✓ ✓ ✓
磁碟讀取/寫入操作 ✓ ✓ ✓
磁碟操作時間和 I/O 時間 ✓
待定磁碟操作 ✓
每個程序 CPU 時間 ✓
每個程序的記憶體用量 (常駐、虛擬) ✓

遊戲工作階段和伺服器程序指標

遊戲工作階段計數和伺服器程序生命週期指標:

遊戲工作階段和伺服器程序指標可用性
指標 主控台 CloudWatch 遙測
使用中的遊戲工作階段 ✓ ✓ ✓*
啟動遊戲工作階段 ✓ ✓
可用的遊戲工作階段 (遊戲容量) ✓ ✓ ✓
可用遊戲工作階段的百分比 (容量使用量) ✓ ✓ ✓
並行可啟動的遊戲工作階段 ✓ ✓
遊戲工作階段 Spot 中斷 ✓ ✓
作用中伺服器程序 ✓ ✓ ✓
運作狀態良好的伺服器程序 ✓ ✓ ✓
運作狀態良好的伺服器程序百分比 ✓ ✓ ✓
伺服器程序啟用 ✓ ✓
伺服器程序終止 ✓ ✓
伺服器程序異常終止 ✓ ✓
損毀的遊戲工作階段 ✓

伺服器效能指標

透過 Amazon GameLift Servers SDKs 和外掛程式直接從遊戲伺服器發出的遊戲內伺服器效能指標。這些僅供伺服器遙測使用,無法在主控台或 CloudWatch 中使用。

伺服器效能指標可用性
指標 主控台 CloudWatch 遙測
伺服器差異時間 (和 p50、p90、p95) ✓
伺服器刻度時間 (和 p50、p90、p95) ✓
伺服器刻度率 ✓
伺服器世界刻度時間 (和 p50、p90、p95) ✓
伺服器啟動狀態 ✓
伺服器連線 ✓
伺服器位元組輸入/輸出 ✓
伺服器封包輸入/輸出 ✓
伺服器封包遺失輸入/輸出 ✓

玩家指標

玩家工作階段和並行使用者指標:

玩家指標可用性
指標 主控台 CloudWatch 遙測
目前玩家工作階段 ✓ ✓
可用的玩家工作階段 (上限) ✓ ✓
玩家工作階段啟用 ✓ ✓
並行使用者 (CCU)、全域和每個位置 ✓

容器機群指標

受管容器機群特定的指標。伺服器遙測會收集比 CloudWatch 更豐富的一組網路和儲存體明細,而 CloudWatch 會追蹤未透過遙測公開的容器群組生命週期計數。

容器機群指標可用性
指標 主控台 CloudWatch 遙測
作用中遊戲伺服器容器群組 ✓ ✓
閒置遊戲伺服器容器群組 ✓ ✓
待定遊戲伺服器容器群組 ✓ ✓
終止遊戲伺服器容器群組 ✓ ✓
已取代運作狀態不佳的遊戲伺服器容器群組 ✓ ✓
容器 CPU 使用率 ✓ ✓ ✓
依模式的容器 CPU 用量 (核心、使用者、系統) ✓
容器 CPU 保留 ✓ ✓
容器記憶體使用率 ✓ ✓ ✓
容器記憶體保留 ✓ ✓ ✓
容器記憶體限制和最大用量 ✓
容器網路輸入/輸出 (速率) ✓ ✓ ✓
容器網路封包輸入/輸出 ✓
容器網路錯誤和捨棄封包 ✓
容器儲存讀取/寫入位元組 ✓ ✓ ✓
ECS 任務 CPU 用量 (總計,系統) ✓
已使用和預留的 ECS 任務記憶體 ✓
ECS 任務網路速率 (rx、tx) ✓
ECS 任務儲存讀取/寫入位元組 ✓

玩家閘道指標

玩家閘道流量和限流指標,適用於使用玩家閘道的受管容器機群。玩家閘道指標專屬於 CloudWatch (並在主控台中顯示為 CloudWatch 小工具)。

玩家閘道指標可用性
指標 主控台 CloudWatch 遙測
玩家閘道封包輸入/輸出 ✓ ✓
玩家閘道位元組輸入/輸出 ✓ ✓
已調節玩家閘道封包 ✓ ✓
玩家閘道位元組已調節 ✓ ✓
玩家閘道玩家工作階段 ✓ ✓

遊戲工作階段佇列指標

遊戲工作階段置放佇列的指標。佇列指標為 CloudWatch 專用 (並在主控台中顯示為佇列指標標籤上的 CloudWatch 小工具)。

佇列指標可用性
指標 主控台 CloudWatch 遙測
平均等待時間 ✓ ✓
佇列深度 ✓ ✓
放置的遊戲工作階段 ✓ ✓
第一個選擇不可行 ✓ ✓
容量的首選 ✓ ✓
最低延遲置放 ✓
最低價格配置 ✓
放置已開始 ✓ ✓
配置成功 ✓ ✓
已取消置放 ✓ ✓
放置失敗 ✓ ✓
置放逾時 ✓ ✓

FlexMatch 配對指標

FlexMatch 配對組態和規則集的指標。CloudWatch 專屬配對指標 (在配對組態的指標索引標籤上以 CloudWatch 小工具的形式顯示在主控台中)。

配對指標可用性
指標 主控台 CloudWatch 遙測
目前票證 ✓ ✓
票證已啟動 ✓ ✓
票證失敗 ✓ ✓
票證逾時 ✓ ✓
玩家已啟動 ✓ ✓
已建立相符項目 ✓ ✓
已接受相符項目 ✓ ✓
拒絕相符項目 ✓ ✓
放置的相符項目 ✓ ✓
比對接受逾時 ✓ ✓
配對搜尋時間 ✓ ✓
比對時間 ✓ ✓
取消票證的時間 ✓ ✓
成功出票的時間 ✓ ✓
規則評估通過 ✓
規則評估失敗 ✓

選擇正確的監控來源

根據您的特定需求選取監控方法:

  • 使用伺服器遙測指標來監控遊戲伺服器的完整效能資料,並發出遊戲專屬的自訂指標。這些指標提供所有遊戲引擎和伺服器 SDKs 的伺服器效能、網路活動、記憶體用量和計時資料的詳細洞見。您可以定義遊戲事件、商業邏輯效能和應用程式特定資料點的自訂指標。所有儀表板都可以完全自訂,而且您可以建立自訂 Prometheus 查詢,從收集的資料衍生其他指標。如需詳細資訊,請參閱使用伺服器遙測指標進行監控。

  • 使用 Amazon GameLift Servers主控台進行機群管理、容量規劃和一般操作監督。主控台提供機群運作狀態和玩家活動的整合檢視。如需詳細資訊,請參閱使用 管理遊戲託管資源 Amazon GameLift Servers。

  • 使用 Amazon CloudWatch 與其他 AWS 服務進行自動監控、警示和整合。CloudWatch 啟用自訂儀表板和警示型自動化。如需詳細資訊,請參閱使用 Amazon CloudWatch 監控 Amazon GameLift Servers。

  • 使用 Amazon Managed Service for Prometheus 搭配 PromQL 查詢功能進行高效能指標收集和儲存。Prometheus 為伺服器遙測指標提供可擴展的時間序列資料儲存。

  • 使用 Amazon Managed Grafana 進行進階視覺化和完全可自訂的儀表板。Grafana 提供預先建置的 GameLift 儀表板,您可以自訂和擴展,並支援使用多個資料來源建立完全自訂的儀表板。您可以建立自訂查詢和視覺化,以追蹤對遊戲重要的任何指標。

  • 使用多個來源進行全面監控。結合主控台監督、伺服器遙測指標和自動提醒,以完全了解您的遊戲託管基礎設施。

如需其他監控功能,您也可以使用:

主題