In diesem Dokument werden Compute Engine-Instanzen beschrieben, die das reservierungsgebundene Bereitstellungsmodell verwenden, einschließlich ihrer Vorteile und Anforderungen an die Erstellung.
Wenn Sie eine Compute-Instanz erstellen, müssen Sie das zugrunde liegende Bereitstellungsmodell angeben, das die Verfügbarkeit, die Preise und die Lebensdauer der Ressourcen definiert, die von Ihrer Compute Instanz verwendet werden. Mit dem reservierungsgebundenen Bereitstellungsmodell können Sie Compute-Instanzen mit der reservierten Kapazität aus einer vorausschauenden Reservierung im Kalendermodus oder vorausschauenden Reservierung in AI Hypercomputererstellen.
Das reservierungsgebundene Bereitstellungsmodell bietet folgende Vorteile:
Kostenkontrolle: Wenn Sie Compute-Instanzen mit reservierter Kapazität erstellen, fallen keine zusätzlichen Kosten an. Es werden nur Kosten für Ressourcen berechnet, die nicht Teil Ihrer Reservierung sind, z. B. für Festplatten oder IP-Adressen.
Lebenszyklusverwaltung: Basierend auf der Beendigungsaktion, die Sie angeben, wenn Sie Compute-Instanzen erstellen, beendet oder löscht Compute Engine die Compute-Instanzen am Ende des Reservierungszeitraums.
Instanzen verstehen, die das reservierungsgebundene Bereitstellungsmodell verwenden
In den folgenden Abschnitten werden die Anforderungen beschrieben, die Sie beim Erstellen von Compute-Instanzen mit dem reservierungsgebundenen Bereitstellungsmodell anwenden.
Voraussetzungen für die Erstellung von Compute-Instanzen
Wenn Sie das reservierungsgebundene Bereitstellungsmodell zum Erstellen von Compute-Instanzen verwenden möchten, müssen Sie zuerst Ressourcen reservieren. So reservieren Sie Ressourcen:
Wenn Sie bis zu 80 A4-, A3 Ultra-, A3 Mega-, A3 High-Instanzen mit 8 GPUs, A3 Edge- oder H4D Instanzen für bis zu 90 Tage reservieren möchten, verwenden Sie vorausschauende Reservierungsanfragen im Kalendermodus.
Wenn Sie mehr als 80 A4X Max-, A4X-, A4-, A3 Ultra-, A3 Mega-, A3 High-Instanzen mit 8 GPUs, A3 Edge- oder H4D-Instanzen für mehr als 90 Tage reservieren möchten, verwenden Sie vorausschauende Reservierungsanfragen in AI Hypercomputer.
Wenn Cloud de Confiance by S3NS Ihre zukünftige Reservierungsanfrage genehmigt wird, erstellt Compute Engine (automatisch) eine Reservierung zu Beginn des Reservierungszeitraums. Anschließend können Sie die Reservierung verwenden, um Compute-Instanzen zu erstellen.
Anforderungen an die Erstellung von Compute-Instanzen
Wenn Sie eine Compute-Instanz mit dem reservierungsgebundenen Bereitstellungsmodell erstellen möchten, müssen Sie die folgenden Konfigurationen angeben:
Die Compute-Instanz und die Reservierung müssen übereinstimmende Attribute haben. Sie können Ihre reservierte Kapazität nur zum Erstellen von Instanzen verwenden, wenn die Attribute der Instanz und der automatisch erstellten Reservierung genau übereinstimmen. Weitere Informationen finden Sie unter den Anforderungen für die Nutzung von Reservierungen.
Die Compute-Instanz muss speziell auf die Reservierung ausgerichtet sein, um sie zu nutzen. Wenn Sie eine Compute-Instanz erstellen, müssen Sie den Namen der automatisch erstellten Reservierung angeben, die genutzt werden soll, und das Feld
reservationAffinityaufSPECIFIC_RESERVATIONsetzen. Weitere Informationen finden Sie unter siehe Eine bestimmte Reservierung nutzen.Die Compute-Instanz muss das reservierungsgebundene Bereitstellungsmodell verwenden. Wenn Sie eine Compute-Instanz erstellen, müssen Sie das reservierungsgebundene Bereitstellungsmodell so angeben:
Wenn Sie die Cloud de Confiance Console verwenden, wählen Sie in der Liste Bereitstellungsmodell die Option Reservierungsgebunden aus.
Wenn Sie die Google Cloud CLI verwenden, fügen Sie dem Befehl das Flag
--provisioning-model=RESERVATION_BOUNDhinzu.Wenn Sie die Compute Engine API verwenden, fügen Sie das
"provisioningModel": "RESERVATION_BOUND"Feld in den Anfragetext ein.
Die Compute-Instanz muss zum Ende der Reservierung beendet oder gelöscht werden. Wenn Sie eine Compute-Instanz erstellen, müssen Sie mit dem Feld
instanceTerminationActionangeben, ob die Compute-Instanz zum Ende der Reservierung beendet oder gelöscht werden soll. Weitere Informationen finden Sie unter Laufzeit einer Compute-Instanz begrenzen.
Nachdem Sie eine Compute-Instanz mit dem reservierungsgebundenen Bereitstellungsmodell erstellt haben, wird sie ausgeführt, bis Sie sie beenden oder löschen oder bis Compute Engine sie zum Ende der Reservierung beendet oder löscht.
Quota
Wenn Sie eine Compute-Instanz mit dem reservierungsgebundenen Bereitstellungsmodell erstellen, benötigen Sie kein Kontingent für die reservierten Ressourcen, die Sie zum Erstellen der Compute-Instanz verwenden. Sie benötigen nur ein Kontingent für die Ressourcen, die nicht Teil Ihrer reservierten Kapazität sind, z. B. für Festplatten und IP-Adressen. Weitere Informationen zu den verschiedenen Kontingenttypen finden Sie unter Zuweisungskontingente.
Preise
Wenn Sie eine Compute-Instanz mit dem reservierungsgebundenen Bereitstellungsmodell erstellen, fallen folgende Kosten an:
Die Kosten fallen ab dem Zeitpunkt an, an dem Sie die Compute-Instanz erstellen. Für die reservierten Ressourcen, die Sie zum Erstellen Ihrer Compute-Instanz verwenden, fallen keine zusätzlichen Kosten an. Es werden nur Kosten für Ressourcen berechnet, die nicht Teil der Reservierung sind, z. B. für Festplatten oder IP-Adressen. Weitere Informationen finden Sie unter der Abrechnung für Reservierungen.
Die Kosten fallen bis zum Ende der Reservierung an. Zu diesem Zeitpunkt löscht Compute Engine die Reservierung und beendet oder löscht Ihre Compute-Instanz basierend auf der in der Compute-Instanz angegebenen Beendigungsaktion.
Beschränkungen
Wenn Sie Compute-Instanzen mit dem reservierungsgebundenen Bereitstellungsmodell erstellen möchten, müssen Sie eine der folgenden Maschinenserien oder TPU-Versionen verwenden:
GPUs:
A4X Max
A4X
A4
A3 Ultra
A3 Mega
A3 High mit 8 GPUs
A3 Edge
Wenn Sie andere GPU-Maschinenreihen mit dem reservierungsgebundenen Bereitstellungsmodell verwenden möchten, wenden Sie sich an Ihr Account-Management-Team oder das Vertriebsteam.
TPU-Versionen:
TPU7x
v6e
v5p
H4D