Reservierungstyp auswählen

In diesem Dokument werden die Reservierungstypen beschrieben, mit denen Sie Kapazität zum Erstellen von Compute Engine-Instanzen reservieren können. Weitere Informationen zu den Ressourcen, die Sie zum Erstellen von Compute-Instanzen benötigen, finden Sie unter Compute Engine-Instanzen.

Reservierungen bieten Ihrem Projekt ein sehr hohes Maß an Sicherheit, dass zonale Ressourcen verfügbar sind, wenn Sie sie zum Erstellen von Compute-Instanzen benötigen. Sie können die Kernhardware (vCPUs und Arbeitsspeicher) und angehängte Ressourcen (GPUs, TPUs, lokale SSD-Laufwerke und Hyperdisk-Pools) reservieren. Wenn Sie eine Reservierung freigeben, erhalten bis zu 100 Projekte in Ihrer Cloud de Confiance by S3NS -Organisation dieselbe Kapazitätsgarantie. Sie können Ihre reservierten Ressourcen jederzeit verwenden, um Compute-Instanzen mit Attributen zu erstellen, die Ihrer Reservierung entsprechen.

Reservierungen bieten folgende Vorteile:

  • Hohe Kapazitätsgarantie: Sie reservieren Ressourcen in einer bestimmten Zone, um sich auf zukünftige Bedarfssteigerungen vorzubereiten, z. B. durch Wachstum, Traffic-Spitzen, große Datenbankmigrationen oder Notfallwiederherstellung.

  • Exklusiver Zugriff: Sie schränken den Zugriff auf Ihre reservierten Ressourcen ein, sodass andere Projekte innerhalb und außerhalb Ihrer Cloud de Confiance-Organisation sie nicht verwenden können. Durch die Einschränkung des Zugriffs wird sichergestellt, dass Ihre Arbeitslasten über die Ressourcen verfügen, die sie zum Ausführen benötigen.

  • Kapazitätsbeibehaltung: Sie behalten Ihre vCPUs, Ihren Arbeitsspeicher, Ihre GPUs, TPUs, lokalen SSD-Laufwerke und Ihre Speicherkapazität (falls in Ihrer Reservierung enthalten) bei, auch wenn Sie Compute-Instanzen beenden. Sie können diese Compute-Instanzen dann neu starten, ohne dass Ressourcenverfügbarkeitsfehler auftreten.

  • Einheitliche Konfigurationen: Die Compute-Instanzen, die Sie mit Ihren reservierten Ressourcen erstellen, haben identische Hardware- und Speichereinrichtungen. Dieser Ansatz trägt dazu bei, eine gleichbleibende Leistung zu gewährleisten und Verarbeitungsverzögerungen bei Ihren Compute-Instanzen zu vermeiden.

Nachdem Compute Engine Ihre reservierten Ressourcen bereitgestellt hat, zahlen Sie für sie, unabhängig davon, ob Sie sie nutzen oder nicht, und solange die Reservierung besteht. Wenn Sie Compute-Instanzen erstellen, indem Sie Ihre reservierten Ressourcen nutzen, fallen keine zusätzlichen Kosten an. Sie zahlen nur für Ressourcen, die nicht Teil der Reservierung sind, z. B. IP-Adressen.

Beschränkungen

Für alle Reservierungstypen gelten die folgenden Einschränkungen:

  • Reservierungen sind zonenspezifische Ressourcen.

  • Sie können Ihre reservierte Kapazität nicht verwenden, um die folgenden Compute Engine-Ressourcen zu erstellen:

    • Compute-Instanzen mit Maschinentypen f1-micro oder g1-small

    • Flex-Start-VMs

    • Knoten für einzelne Mandanten

    • Spot-VMs oder vorzeitig beendbare Instanzen

Reservierungstyp auswählen

Das folgende Diagramm hilft Ihnen bei der Auswahl des Reservierungstyps, der am besten zu Ihren Arbeitslastanforderungen passt. Wenn Sie die Funktionen der verschiedenen Reservierungstypen vergleichen möchten, sehen Sie sich die Vergleichstabelle in diesem Dokument an.

Ein Flussdiagramm mit den verschiedenen Reservierungsmethoden, die in Compute Engine verfügbar sind.

Die Fragen im obigen Diagramm lauten:

  1. Benötigen Sie die Kapazität sofort?

    • Ja: Fahren Sie mit der nächsten Frage fort.

    • Nein: Fahren Sie mit Frage 3 fort.

  2. Benötigen Sie Flexibilität bei der Dauer der Kapazitätsreservierung?

  3. Benötigen Sie stark nachgefragte Ressourcen wie GPUs?

  4. Benötigen Sie Ressourcen für mehr als 90 Tage?

On‑Demand-Reservierungen verwenden

Mit On-Demand-Reservierungen fordern Sie an, vCPUs, Arbeitsspeicher und angehängte Ressourcen (GPUs, TPUs und lokale SSD-Laufwerke) zu reservieren, um Compute-Instanzen zu erstellen. Wenn Ihre Anfrage erfolgreich ist, führt Compute Engine die folgenden Schritte aus:

  • Compute Engine erstellt innerhalb weniger Minuten eine On-Demand-Reservierung mit den angeforderten Ressourcen.

  • Compute Engine versucht, Ihre reservierten Ressourcen nach Best-Effort-Prinzip zuzuweisen. Wenn Sie Compute-Instanzen in unmittelbarer Nähe platzieren möchten, um die Netzwerklatenz zu minimieren, können Sie beim Erstellen der Reservierung optional eine Richtlinie für kompakte Platzierungen angeben.

Wenn Sie die Reservierung nutzen möchten, erstellen Sie Compute-Instanzen, die den Attributen der Reservierung entsprechen, und verwenden Sie das Standardbereitstellungsmodell. Sie können die Reservierung jederzeit nutzen, ändern oder löschen.

Weitere Informationen finden Sie unter Reservierungen.

Vorausschauende Reservierungen verwenden

Mit vorausschauenden Reservierungen fordern Sie an, vCPUs, Arbeitsspeicher und angehängte Ressourcen (GPUs, TPUs und lokale SSD-Laufwerke) zu reservieren, um Compute-Instanzen für einen zukünftigen Zeitpunkt zu erstellen. Nachdem Sie eine Reservierungsanfrage erstellt haben, reichen Sie sie zur Überprüfung bei Cloud de Confiance by S3NS ein. Wenn Cloud de Confiance Ihre Anfrage genehmigt, führt Compute Engine die folgenden Schritte aus:

  • Compute Engine erstellt On-Demand-Reservierungen mit der von Ihnen angeforderten Kapazität für den von Ihnen ausgewählten Liefertermin und die von Ihnen ausgewählte Lieferzeit.

  • Compute Engine versucht, Ihre reservierten Ressourcen nach Best-Effort-Prinzip zuzuweisen.

Um die Reservierungen zu nutzen, erstellen Sie Compute-Instanzen, die den Attributen der Reservierungen entsprechen, und verwenden Sie das Standardbereitstellungsmodell. Sie können die Reservierungen jederzeit ändern oder löschen. Alle Compute-Instanzen, die Sie mit der Reservierung erstellt haben, werden auch nach Ablauf des Reservierungszeitraums oder nach dem Löschen der Reservierung weiter ausgeführt.

Weitere Informationen zu Anfragen für vorausschauende Reservierungen

Vorausschauende Reservierungen im Kalendermodus verwenden

Mit vorausschauenden Reservierungen im Kalendermodus können Sie vCPUs, Arbeitsspeicher und angehängte Ressourcen (GPUs, TPUs und lokale SSD-Laufwerke) für ein zukünftiges Datum und eine zukünftige Uhrzeit und für bis zu 90 Tage reservieren. Um diesen Reservierungstyp zu erstellen, müssen Sie zuerst prüfen, wann die von Ihnen ausgewählte Anzahl und Art von Ressourcen in einer Region verfügbar sind. Anschließend erstellen und senden Sie eine Reservierungsanfrage mit den Attributen, die Sie als verfügbar bestätigt haben. Wenn Sie einen gültigen Antrag einreichen, genehmigtCloud de Confiance den Antrag innerhalb einer Minute. NachdemCloud de Confiance die Anfrage genehmigt hat, führt Compute Engine die folgenden Schritte aus:

  • Compute Engine erstellt eine On-Demand-Reservierung für das von Ihnen ausgewählte Lieferdatum und die von Ihnen ausgewählte Lieferzeit.

  • Compute Engine reserviert die angeforderten Ressourcen in unmittelbarer physischer Nähe, um die Netzwerklatenz zu minimieren. Dies ist nützlich für eng gekoppelte Arbeitslasten für künstliche Intelligenz (KI), maschinelles Lernen (ML) oder Hochleistungs-Computing (HPC).

  • Compute Engine reserviert Ressourcen mit Clusterverwaltungsfunktionen, was für große Arbeitslasten mit mehreren Knoten optimal ist.

Wenn Sie die Reservierung zu Beginn des Reservierungszeitraums nutzen möchten, erstellen Sie GPU-, H4D- oder TPU-Instanzen, die den Attributen der Reservierung entsprechen, und verwenden Sie das Bereitstellungsmodell „Reservierungsgebunden“. Am Ende des Reservierungszeitraums löscht Compute Engine die Reservierung und beendet oder löscht alle Compute-Instanzen, die die Reservierung nutzen, basierend auf der Beendigungsaktion, die Sie für die Compute-Instanzen angegeben haben.

Weitere Informationen finden Sie unter Anfragen für vorausschauende Reservierungen im Kalendermodus.

Vorausschauende Reservierungen für Kapazitätsblöcke verwenden

Mit zukünftigen Reservierungen für Kapazitätsblöcke können Sie vCPUs, Arbeitsspeicher und angehängte Ressourcen (GPUs, TPUs, lokale SSD-Laufwerke und Hyperdisk-Pools) für ein zukünftiges Datum und eine zukünftige Uhrzeit und für einen unbegrenzten Zeitraum reservieren. Wenn Sie diesen Reservierungstyp erstellen möchten, wenden Sie sich an Ihr Account-Management-Team und fordern Sie Kapazität an. Nachdem Google einen Reservierungsanfrageentwurf für Sie erstellt hat, prüfen Sie die Anfrage und senden sie. Cloud de Confiance genehmigt die Anfrage innerhalb weniger Minuten und Compute Engine führt dann die folgenden Schritte aus:

  • Compute Engine erstellt On-Demand-Reservierungen am von Ihnen ausgewählten Liefertermin und zur von Ihnen ausgewählten Lieferzeit.

  • Compute Engine reserviert die angeforderten Ressourcen in unmittelbarer physischer Nähe, um die Netzwerklatenz zu minimieren. Dies ist nützlich für eng gekoppelte KI-, ML- oder HPC-Arbeitslasten.

  • Compute Engine reserviert Ressourcen mit Clusterverwaltungsfunktionen, was für große Arbeitslasten mit mehreren Knoten optimal ist.

Wenn Sie die Reservierungen zu Beginn des Reservierungszeitraums nutzen möchten, erstellen Sie GPU-, TPU- oder H4D-Instanzen, die den Attributen der Reservierungen entsprechen, und verwenden Sie das reservierungsgebundene Bereitstellungsmodell. Am Ende des Reservierungszeitraums löscht Compute Engine die Reservierung und beendet oder löscht alle Compute-Instanzen, die die Reservierung nutzen, basierend auf der Beendigungsaktion, die Sie für die Compute-Instanzen festgelegt haben.

Weitere Informationen finden Sie in einem der folgenden Dokumente:

Reservierungstypen vergleichen

In der folgenden Tabelle können Sie die technischen Funktionen der verschiedenen Reservierungstypen vergleichen, um den für Ihre Arbeitslast geeigneten Reservierungstyp zu ermitteln:

On-Demand-Reservierungen Vorausschauende Reservierungen Vorausschauende Reservierungen im Kalendermodus Vorausschauende Reservierungen für Kapazitätsblöcke
Unterstützte Maschinenserien Alle Maschinenfamilien (außer A4X Max, A4X, A4, A3 Ultra und A3 High mit weniger als 8 GPUs) A3 Mega*, A3 High (mit 8 GPUs)*, A3 Edge*, C4, C4A, C4D, C4N, C3, C3D, G4*, H4D*, H3, M4, M4N, M3, N4, N4A, N4D, TPU7x, TPU v6e, TPU v5p, X5, X4, Z4D und Z3 A4, A3 Ultra, A3 Mega, A3 High (8 GPUs), A3 Edge, H4D, TPU7x, TPU v6e und TPU v5p A4X Max, A4X, A4, A3 Ultra, A3 Mega, A3 High (8 GPUs), A3 Edge, H4D, TPU7x, TPU v6e und TPU v5p
Speicherreservierungen Nein Nein Nein Optional (Hyperdisk-Pool)
Maximale Anzahl von Compute-Instanzen pro Anfrage 1.000‡ Kein Limit# 80 für GPU-Instanzen, 256 für H4D-Instanzen und 1.024 für TPU-Chips Kein Limit#
Maximale Dauer Unbegrenzt (bis Sie sie löschen) Unbegrenzt (bis Sie sie löschen) Bis zu 90 Tage Unbegrenzt (Vertragslaufzeit)
Zukünftige Verfügbarkeit ansehen Nein Nein Ja (bis zu 60 Tage für GPU- und H4D-Instanzen; bis zu 120 Tage für TPU-Chips) Ja (wenden Sie sich an Ihr Account-Management-Team)
Erstellungsmethode Sie erstellen die Reservierung Sie erstellen die Reservierungsanfrage Sie erstellen die Reservierungsanfrage Sie wenden sich an Ihr Account-Management-Team und Google erstellt die Reservierungsanfrage für Sie.
Lieferdauer Sofort Bestimmtes zukünftiges Datum und bestimmte zukünftige Uhrzeit Bestimmtes zukünftiges Datum und bestimmte zukünftige Uhrzeit Bestimmtes zukünftiges Datum und bestimmte zukünftige Uhrzeit
Ressourcenzuweisung Best Effort (Richtlinien für kompakte Platzierung optional) Best-Effort-Ansatz Vollbesetzt Vollbesetzt
Funktionen für die Clusterverwaltung Nein Nein Ja Ja
Bereitstellungsmodell Standard Standard Reservierungsgebunden Reservierungsgebunden
Kontingent Standardkontingent erforderlich Standardkontingent erforderlich Kein Kontingent für GPU-Instanzen oder TPU-Chips erforderlich; Standardkontingent für H4D-Instanzen erforderlich Google erhöht Ihr Kontingent automatisch vor der Auslieferung.
Preise Standardpreise (mit Zusicherungen rabattiert) Standardpreise (mit Zusicherungen rabattiert) Bis zu 53 % Rabatt (DWS-Preise) Standardpreise (mit Zusicherungen rabattiert)
Ende des Reservierungszeitraums Manuelles Löschen Manuelles Löschen Automatisches Löschen von Reservierungen; Compute-Instanzen werden entsprechend ihrer Beendigungsaktion beendet oder gelöscht Automatisches Löschen von Reservierungen und Hyperdisk-Pools; Compute-Instanzen werden entsprechend ihrer Beendigungsaktion beendet oder gelöscht

* Bevor Sie eine vorausschauende Reservierungsanfrage für A3 Mega-, A3 High- (mit 8 GPUs), A3 Edge-, G4- oder H4D-Instanzen senden, müssen Sie sich an Ihr Account-Management-Team oder das Vertriebsteam wenden. Andernfalls wird Ihre Anfrage von Cloud de Confiance wahrscheinlich abgelehnt.

‡ Wenn Sie eine Richtlinie für kompakte Platzierung mit einem maximalen Abstand von 2 auf eine On-Demand-Reservierung anwenden, können Sie maximal 256 A3 Mega-, A3 High- (mit 8 GPUs) oder A3 Edge-Instanzen oder maximal 150 Compute-Instanzen für alle anderen unterstützten Maschinenfamilien reservieren. Weitere Informationen finden Sie unter Richtlinien für kompakte Platzierung.

# Wenn Sie in einer einzelnen Reservierungsanfrage mehr als 1.000 Compute-Instanzen reservieren möchten,stellt Compute Engine die angeforderte Kapazität bereit, indem mehrere On-Demand-Reservierungen zum von Ihnen ausgewählten Lieferdatum und zur von Ihnen ausgewählten Lieferzeit erstellt werden.