Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
Servicekontingente von Amazon Managed Service für Prometheus
In den folgenden beiden Abschnitten werden die mit Amazon Managed Service for Prometheus verbundenen Kontingente und Limits beschrieben.
Servicekontingente
Amazon Managed Service for Prometheus hat die folgenden Kontingente. Amazon Managed Service for Prometheus verkauft CloudWatch Nutzungsmetriken, um die Nutzung der Prometheus-Ressourcen zu überwachen. Mithilfe der Alarmfunktion für CloudWatch Amazon-Nutzungskennzahlen können Sie die Ressourcen und die Nutzung von Prometheus-Ressourcen überwachen, um Limitfehler zu vermeiden.
Wenn Ihre Projekte und Workspaces wachsen, sollten Sie am häufigsten folgende Kontingente überwachen oder eine Erhöhung beantragen: Aktive Serien pro Workspace und Aufnahmerate pro Workspace.
Für alle anpassbaren Kontingente kannst du eine Kontingenterhöhung beantragen, indem du den Link in der Spalte „Anpassbar“ auswählst, oder indem du eine Kontingenterhöhung anforderst.
Das Limit für aktive Serien pro Workspace wird dynamisch angewendet. Weitere Informationen finden Sie unter Standardkontingente für aktive Serien. Die Aufnahmerate pro Workspace bestimmt, wie schnell du Daten in deinen Workspace aufnehmen kannst. Weitere Informationen finden Sie unter Drosselung der Aufnahme.
Anmerkung
Sofern nicht anders angegeben, gelten diese Kontingente pro Workspace. Der Höchstwert für aktive Serien pro Workspace liegt bei 1,5 Milliarden.
| Name | Standard | Anpassbar | Description |
|---|---|---|---|
| Aktive Metriken mit Metadaten pro Workspace | Jede unterstützte Region: 20 000 | Nein | Die Anzahl einmaliger aktiver Metriken mit Metadaten pro Workspace. Hinweis: Wenn das Limit erreicht ist, wird eine Metrikprobe aufgezeichnet, aber Metadaten, die den Grenzwert überschreiten, werden gelöscht. |
| Aktive Serien pro Workspace | Jede unterstützte Region: 50 000 000 | Ja |
Die Anzahl der eindeutigen aktiven Serien pro Workspace (bis zu einem Maximum von 1,5 Milliarden). Eine Serie ist aktiv, wenn in den letzten 2 Stunden ein Beispiel gemeldet wurde. Die Kapazität von 2 M bis 50 M wird automatisch an die letzten 30 Minuten der Nutzung angepasst. |
| Größe der Alarmaggregationsgruppe in der Alert-Manager-Definitionsdatei | Jede unterstützte Region: 1 000 | Ja |
Die maximale Größe einer Alarmaggregationsgruppe in der Alert-Manager-Definitionsdatei. Jede Labelwertkombination von group_by würde eine Aggregationsgruppe erstellen. |
| Größe der Definitionsdatei des Alert Managers | Jede unterstützte Region: 1 000 000 | Nein | Die maximale Größe einer Alert Manager-Definitionsdatei in Byte. |
| Größe der Warnungs-Payload im Alert Manager | Jede unterstützte Region: 20 000 000 | Nein | Die maximale Alert-Payload-Größe aller Alert Manager-Warnungen pro Arbeitsbereich in Byte. Die Alarmgröße hängt von den Bezeichnungen und Anmerkungen ab. |
| Warnungen im Alert Manager | Jede unterstützte Region: 1 000 | Ja |
Die maximale Anzahl gleichzeitiger Alert Manager-Warnungen pro Arbeitsbereich. |
| HA-Tracker-Cluster | Jede unterstützte Region: 500 | Nein | Die maximale Anzahl von Clustern, die der HA-Tracker für erfasste Beispiel pro Workspace verfolgt. |
| Erfassungsrate pro Workspace | Jede unterstützte Region: 1.666.666 | Ja |
Metrische Beispiel-Erfassungsrate pro Workspace pro Sekunde. Das Limit wird automatisch an das Limit 1/30 der aktiven Serie pro Workspace angepasst, also bis zu 1.666.666. |
| Unterdrückungsregeln in der Alert-Manager-Definitionsdatei | Jede unterstützte Region: 100 | Yes |
Die maximale Anzahl von Unterdrückungsregeln in der Alert-Manager-Definitionsdatei. |
| Labelgröße | Jede unterstützte Region: 7 | Nein | Die maximale Gesamtgröße aller Bezeichnungen und Labelwerte, die für eine Reihe akzeptiert werden, in Kilobyte. |
| LabelSet Grenzwerte pro Arbeitsbereich | Jede unterstützte Region: 100 | Yes |
Die maximale Anzahl von Labelset-Grenzwerten, die pro Workspace erstellt werden können. |
| Labels pro metrischer Serie | Jede unterstützte Region: 150 | Ja |
Anzahl der Etiketten pro metrischer Serie. |
| Maximale Anzahl der Buckets im systemeigenen Histogramm | Jede unterstützte Region: 200 | Nein | Die maximale Gesamtanzahl von Buckets, die in einer Stichprobe mit systemeigenem Histogramm zulässig sind. Die Auflösung eines Histogramms mit mehr Buckets wird reduziert, bis die Anzahl der Buckets innerhalb des Grenzwerts liegt. |
| Länge der Metadaten | Jede unterstützte Region: 1 | Nein | Die maximal zulässige Länge für metrische Metadaten in Kilobyte. Metadaten beziehen sich auf den Namen, den Typ, die Einheit und den Hilfetext der Metrik. |
| Metadaten pro Metrik | Jede unterstützte Region: 10 | Nein | Die Anzahl von Metadaten pro Metrik. Hinweis: Wenn das Limit erreicht ist, wird eine Metrikprobe aufgezeichnet, aber Metadaten, die das Limit überschreiten, werden gelöscht. |
| Natives Histogramm: Aktive Reihe pro Workspace | Jede unterstützte Region: 5 000 000 | Ja |
Die Anzahl der eindeutigen aktiven Reihen des systemeigenen Histogramms pro Workspace. Eine Serie ist aktiv, wenn in den letzten 2 Stunden ein Beispiel gemeldet wurde. Das Limit wird automatisch so angepasst, dass es 10 Prozent des Grenzwerts für aktive Reihen im Workspace entspricht, oder dem Standard, je nachdem, welcher Wert höher ist. |
| Rate der systemeigenen Histogrammaufnahme pro Workspace | Jede unterstützte Region: 166.666 | Ja |
Aufnahmerate der systemeigenen Histogrammproben pro Workspace pro Sekunde. Das Limit wird automatisch so angepasst, dass es 10 Prozent des Grenzwerts für die Aufnahmerate des Workspaces oder den Standardwert beträgt, je nachdem, welcher Wert höher ist. |
| Knoten im Alert-Manager-Routingbaum | Jede unterstützte Region: 100 | Yes |
Die maximale Anzahl der Knoten im Alert-Manager-Routingbaum. |
| Anzahl der API-Operationen pro Region, ausgedrückt in Transaktionen pro Sekunde | Jede unterstützte Region: 10 | Yes |
Die maximale Anzahl von API-Vorgängen pro Sekunde pro Region für alle Amazon Managed Service for Prometheus-APIs, einschließlich Workspace-CRUD-APIs, Tagging-APIs, Namespace-CRUD-APIs für Regelgruppen, Namespace-CRUD-APIs und CRUD-APIs für Alert Manager-Definitionen. |
| Anzahl der GetLabels und GetMetricMetadata API-Operationen pro GetSeries Workspace in Transaktionen pro Sekunde | Jede unterstützte Region: 10 | Nein | Die maximale Anzahl von GetSeries GetLabels und GetMetricMetadata Prometheus-compatible API-Vorgängen pro Sekunde pro Workspace. |
| Anzahl der QueryMetrics API-Operationen pro Workspace, ausgedrückt in Transaktionen pro Sekunde | Jede unterstützte Region: 300 | Nein | Die maximale Anzahl von QueryMetrics Prometheus-compatible API-Vorgängen pro Sekunde pro Workspace. |
| Anzahl der RemoteWrite API-Operationen pro Workspace in Transaktionen pro Sekunde | Jede unterstützte Region: 3 000 | Nein | Die maximale Anzahl von RemoteWrite Prometheus-compatible API-Vorgängen pro Sekunde pro Workspace. |
| Anzahl anderer Prometheus-compatible API-Operationen pro Workspace in Transaktionen pro Sekunde | Jede unterstützte Region: 100 | Nein | Die maximale Anzahl von API-Vorgängen pro Sekunde pro Workspace für alle anderen Prometheus-compatible APIs ListAlerts ListRules, einschließlich, usw. |
| Rate, die pro Workspace nicht in der richtigen Reihenfolge aufgenommen wird | Jede unterstützte Region: 83.333 | Ja |
Häufigkeit der Aufnahme von Proben, die nicht in der richtigen Reihenfolge sind, pro Workspace pro Sekunde. Sofern das Limit nicht überschrieben wird, wird es automatisch auf 5 Prozent der Aufnahmerate pro Workspace angepasst. |
| Zeitfenster außerhalb des zulässigen Zeitfensters pro Workspace | Jede unterstützte Region: 600 | Ja |
Das maximale Zeitfenster für Proben, die nicht bestellt sind, pro Arbeitsbereich, in Sekunden. Das Standardzeitfenster, in dem ein neuer Workspace erstellt wird, beträgt 60 Sekunden, und es kann bis zu einem Maximum von 600 Sekunden konfiguriert werden. |
| Bytes für sofortige Abfragen abfragen | Jede unterstützte Region: 5 | Nein | Die maximale Anzahl an Byte, die mit einer einzigen Sofortabfrage gescannt werden können, in Gigabyte. |
| Byte für Bereichsabfragen abfragen | Jede unterstützte Region: 5 | Nein | Die maximale Anzahl an Byte, die pro 24-Stunden-Intervall in einer einzelnen Bereichsabfrage gescannt werden können, in Gigabyte. |
| Abfragebeispiele | Jede unterstützte Region: 50 000 000 | Nein | Die maximale Anzahl von Samples, die pro 24-Stunden-Intervall in einer einzelnen Bereichsabfrage oder einer einzelnen Sofortabfrage gescannt werden können. |
| Abfrageserie abgerufen | Jede unterstützte Region: 12.000.000 | Nein | Die maximale Anzahl von Serien, die pro 24-Stunden-Intervall in einer einzelnen Bereichsabfrage oder einer einzelnen Sofortabfrage gescannt werden können. |
| Zeitraum für die Abfrage in Tagen | Jede unterstützte Region: 95 | Nein | Der maximale Zeitbereich von QueryMetrics GetSeries, und GetLabels APIs. |
| Anforderungsgröße | Jede unterstützte Region: 1 | Nein | Die maximale Anforderungsgröße für die Aufnahme oder Abfrage in Megabyte. |
| Bewertungsintervall für die Regel | Jede unterstützte Region: 30 | Yes |
Das Mindestintervall für die Regelbewertung einer Regelgruppe pro Workspace in Sekunden. |
| Größe der Definitionsdatei des Regelgruppen-Namespace | Jede unterstützte Region: 1 000 000 | Nein | Die maximale Größe einer Namespace-Definitionsdatei für Regelgruppen in Byte. |
| Regeln pro Workspace | Jede unterstützte Region: 2.000 | Ja |
Die maximale Anzahl von Regeln pro Workspace. |
| Stummschaltungen pro Workspace | Jede unterstützte Region: 1 000 | Ja |
Maximale Anzahl von Stummschaltungen, einschließlich abgelaufener, aktiver und ausstehender Stummschaltungen, pro Workspace. |
| Vorlagen in der Alert-Manager-Definitionsdatei | Jede unterstützte Region: 100 | Yes |
Die maximale Anzahl der Vorlagen in der Alert-Manager-Definitionsdatei. |
| Workspaces pro Region und Konto | Jede unterstützte Region: 25 | Ja |
Die maximale Anzahl von Workspaces pro Region. |
Standardkontingente für aktive Serien
Amazon Managed Service for Prometheus-Workspaces passen sich automatisch an Ihre Aufnahmemenge an. Wenn Ihre Nutzung zunimmt, erhöht der Service automatisch Ihre Zeitreihenkapazität bis zum Standardkontingent.
Ihr Amazon Managed Service for Prometheus Workspace skaliert automatisch, basierend auf Ihrer Nutzung, auf zwei Arten:
-
Wenn Ihre durchschnittliche 30-minütige Nutzung unter 5 Millionen Serien liegt, verdoppelt sich die Kapazität (z. B. erhält ein Workspace mit 3,5 Mio. Nutzung eine Kapazität von 7 Mio.).
-
Wenn die Nutzung 5 Millionen Serien überschreitet, fügt der Workspace einen Puffer von 10 Millionen hinzu (z. B. erhält ein Workspace mit 25 Mio. Nutzung eine Kapazität von 35 Mio.).
Amazon Managed Service for Prometheus weist automatisch mehr Kapazität zu, wenn Ihre Ingestion zunimmt, und zwar bis zu Ihrem Kontingent. Dadurch wird sichergestellt, dass Ihre Arbeitslast nicht dauerhaft gedrosselt wird. Eine Drosselung kann jedoch auftreten, wenn Sie den Wert Ihres vorherigen, in den letzten 30 Minuten berechneten Ausgangswerts um das Doppelte oder Überschreiten von 10 Millionen überschreiten. Um eine Drosselung zu vermeiden, empfiehlt Amazon Managed Service for Prometheus, die Aufnahme schrittweise zu erhöhen, wenn Sie Ihren vorherigen Ausgangswert überschreiten.
Anmerkung
Die Mindestkapazität für aktive Zeitreihen beträgt 2 Millionen. Bei weniger als 2 Millionen Serien erfolgt keine Drosselung.
Um Ihr Standardkontingent zu überschreiten, können Sie eine Kontingenterhöhung beantragen.
Skalierung über das Standardkontingent hinaus
Wenn Sie eine Kontingenterhöhung über das Standardkontingent für aktive Serien hinaus beantragen, passt Amazon Managed Service for Prometheus Ihre Workspace-Kapazität entsprechend an. Wenn Sie die erhöhte Kapazität nicht vollständig nutzen, fordert der Service den ungenutzten Teil im Laufe der Zeit zurück. Wenn Ihre Nutzung zunimmt, wird der Workspace automatisch wieder skaliert.
Eine Drosselung kann jedoch auftreten, wenn Sie 50 Millionen aktive Zeitreihen im Vergleich zu Ihrem vorherigen Basiswert, berechnet aus den letzten 2 Stunden, mehr als verdoppeln oder überschreiten. Beispiel:
-
Wenn Ihr Kontingent 100 Millionen beträgt und Ihr Ausgangswert 30 Millionen beträgt, können Sie innerhalb von 2 Stunden ohne Drosselung auf 60 Millionen hochskalieren.
-
Wenn Ihr Kontingent bei 100 Millionen liegt und Ihr Basiswert bei 50 Millionen liegt, können Sie innerhalb von 2 Stunden ohne Drosselung auf die vollen 100 Millionen hochskalieren.
Drosselung der Aufnahme
Amazon Managed Service für Prometheus drosselt die Aufnahme für jeden Workspace auf der Grundlage Ihrer aktuellen Grenzwerte. Dies trägt dazu bei, die Leistung des Workspace aufrechtzuerhalten. Wenn du das Limit überschreitest, wird dir das DiscardedSamples in den CloudWatch Metriken angezeigt (mit dem rate_limited Grund). Sie können CloudWatch es verwenden, um Ihre Aufnahme zu überwachen und einen Alarm auszulösen, der Sie warnt, wenn Sie sich dem Erreichen der Drosselungsgrenzen nähern. Weitere Informationen finden Sie unter Verwenden Sie CloudWatch Metriken, um die Ressourcen von Amazon Managed Service for Prometheus zu überwachen.
Amazon Managed Service for Prometheus verwendet den Token-Bucket-Algorithmus, um die Drosselung der Aufnahme zu implementieren.
Jede aufgenommene Datenprobe entfernt ein Token aus dem Bucket. Wenn Ihre Bucket-Größe (Aufnahmerate pro Workspace) 1.000.000 beträgt, kann Ihr Workspace eine Million Datenproben in einer Sekunde aufnehmen. Wenn mehr als eine Million Samples aufgenommen werden müssen, wird der Vorgang gedrosselt und es werden keine weiteren Datensätze aufgenommen. Zusätzliche Datenproben werden verworfen.
Der Eimer wird automatisch mit einer festgelegten Geschwindigkeit aufgefüllt. Wenn der Bucket seine maximale Kapazität unterschreitet, wird ihm jede Sekunde eine festgelegte Anzahl von Tokens hinzugefügt, bis er seine maximale Kapazität erreicht hat. Wenn der Eimer voll ist, wenn die Nachfüllmarken ankommen, werden sie verworfen. Der Eimer kann nicht mehr als die maximale Anzahl an Tokens aufnehmen. Die Nachfüllrate für die Probenaufnahme wird durch das Limit für die Aufnahmerate pro Workspace festgelegt. Wenn deine Aufnahmerate pro Workspace auf 170.000 festgelegt ist, beträgt die Nachfüllrate für den Bucket 170.000 Tokens pro Sekunde.
Wenn dein Workspace 1.000.000 Datenproben in einer Sekunde aufnimmt, wird dein Bucket sofort auf null Tokens reduziert. Der Bucket wird dann jede Sekunde um 170.000 Token aufgefüllt, bis er seine maximale Kapazität von 1.000.000 Token erreicht hat. Wenn keine Aufnahme mehr erfolgt, kehrt der zuvor leere Eimer in 6 Sekunden zu seiner maximalen Kapazität zurück.
Anmerkung
Die Aufnahme erfolgt in Batch-Anfragen. Wenn Sie 100 Token zur Verfügung haben und eine Anfrage mit 101 Samples senden, wird die gesamte Anfrage abgelehnt. Amazon Managed Service for Prometheus akzeptiert Anfragen nicht teilweise. Wenn Sie einen Collector schreiben, können Sie Wiederholungsversuche verwalten (mit kleineren Batches oder nach Ablauf einiger Zeit).
Sie müssen nicht warten, bis der Bucket voll ist, bevor Ihr Workspace weitere Datenproben aufnehmen kann. Sie können Token verwenden, wenn sie dem Bucket hinzugefügt werden. Wenn Sie die Refill-Token sofort verwenden, erreicht der Bucket seine maximale Kapazität nicht. Wenn Sie beispielsweise den Bucket leeren, können Sie weiterhin 170.000 Datenproben pro Sekunde aufnehmen. Der Bucket kann nur dann wieder bis zur maximalen Kapazität gefüllt werden, wenn Sie weniger als 170.000 Datenproben pro Sekunde aufnehmen.
Zusätzliche Limits für erfasste Daten
Amazon Managed Service für Prometheus verfügt über zusätzliche Anfragen für erfasste Daten, die in den Workspace aufgenommen wurden. Diese sind nicht einstellbar.
-
Metrische Beispiele, die älter als 1 Stunde sind, werden nicht erfasst.
-
Jedes Beispiel und alle Metadaten müssen einen Metriknamen haben.
-
Native Histogrammproben müssen einen Schemawert zwischen -4 und 8 aufweisen. Stichproben mit einem Schema außerhalb dieses Bereichs werden verworfen.
-
Stichproben aus systemeigenen Histogrammen dürfen eine Größe von 2048 Byte nicht überschreiten. Stichproben, die diesen Grenzwert überschreiten, werden verworfen.