Este documento descreve as instâncias do Compute Engine que usam o modelo de provisionamento vinculado à reserva, incluindo os benefícios e os requisitos de criação.
Ao criar uma instância de computação, é preciso especificar o modelo de provisionamento subjacente , que define a disponibilidade, os preços e a vida útil dos recursos usados pela instância de computação. O modelo de provisionamento vinculado à reserva permite criar instâncias de computação usando a capacidade reservada de uma reserva adiantada no modo de calendário ou reserva adiantada no Hipercomputador de IA.
O modelo de provisionamento vinculado à reserva oferece os seguintes benefícios:
Controle de custos: não há cobranças adicionais ao criar instâncias de computação usando a capacidade reservada. Você só recebe cobranças por recursos que não fazem parte da reserva, como discos ou endereços IP.
Gerenciamento do ciclo de vida: com base na ação de encerramento especificada ao criar instâncias de computação, o Compute Engine interrompe ou exclui as instâncias de computação no final do período de reserva.
Entender as instâncias que usam o modelo de provisionamento vinculado à reserva
As seções a seguir descrevem os requisitos que você aplica ao criar instâncias de computação usando o modelo de provisionamento vinculado à reserva.
Pré-requisitos para a criação de instâncias de computação
Para usar o modelo de provisionamento vinculado à reserva para criar instâncias de computação, primeiro é preciso reservar recursos. É possível reservar recursos da seguinte maneira:
Para reservar até 80 instâncias A4, A3 Ultra, A3 Mega, A3 High com 8 GPUs, A3 Edge ou H4D e por até 90 dias, use solicitações de reserva adiantada no modo de calendário.
Para reservar mais de 80 instâncias A4X Max, A4X, A4, A3 Ultra, A3 Mega, A3 High com 8 GPUs, A3 Edge ou H4D por mais de 90 dias, use solicitações de reserva adiantada no Hipercomputador de IA.
Se Cloud de Confiance by S3NS aprovar sua solicção de reserva adiantada, o Compute Engine criará automaticamente (criação automática) uma reserva no início do período de reserva. Em seguida, você poderá usar a reserva para criar instâncias de computação.
Requisitos de criação de instâncias de computação
Para criar uma instância de computação usando o modelo de provisionamento vinculado à reserva, é preciso especificar as seguintes configurações:
A instância de computação e a reserva precisam ter propriedades correspondentes. Só é possível usar a capacidade reservada para criar instâncias se as propriedades da instância e da reserva criada automaticamente forem exatamente iguais. Para mais informações, consulte os requisitos para consumir reservas.
A instância de computação precisa visar especificamente a reserva para consumo. Ao criar uma instância de computação, é preciso especificar o nome da reserva criada automaticamente para consumo, além de definir o campo
reservationAffinitycomoSPECIFIC_RESERVATION. Para mais informações, consulte Consumir uma reserva especificamente direcionada.A instância de computação precisa usar o modelo de provisionamento vinculado à reserva. Ao criar uma instância de computação, é preciso especificar o modelo de provisionamento vinculado à reserva da seguinte maneira:
Se você usar o Cloud de Confiance console, na lista Modelo de provisionamento , selecione Vinculado à reserva.
Se você usar a Google Cloud CLI, inclua a flag
--provisioning-model=RESERVATION_BOUNDno comando.Se você usar a API Compute Engine, inclua o
"provisioningModel": "RESERVATION_BOUND"campo no corpo da solicitação.
A instância de computação precisa ser interrompida ou excluída no horário de término da reserva. Ao criar uma instância de computação, é preciso especificar se ela será interrompida ou excluída no horário de término da reserva usando o campo
instanceTerminationAction. Para mais informações, consulte Como limitar o tempo de execução de uma instância de computação.
Depois de criar uma instância de computação usando o modelo de provisionamento vinculado à reserva, a instância de computação começa a ser executada e continua até que você a interrompa ou exclua, ou até que o Compute Engine a interrompa ou exclua no horário de término da reserva.
Quota
Ao criar uma instância de computação usando o modelo de provisionamento vinculado à reserva, não é necessário ter cota para os recursos reservados que você usa para criar a instância de computação. Você só precisa de cota para os recursos que não fazem parte da capacidade reservada, como discos e endereços IP. Para mais informações sobre os diferentes tipos de cota, consulte Cotas de alocação.
Preços
Ao criar uma instância de computação usando o modelo de provisionamento vinculado à reserva, você recebe cobranças da seguinte maneira:
As cobranças começam quando você cria a instância de computação. Não há cobranças adicionais pelos recursos reservados que você usa para criar a instância de computação. Você só recebe cobranças pelos recursos que não fazem parte da reserva, como discos ou endereços IP. Para mais informações, consulte o faturamento de reservas.
As cobranças param no horário de término da reserva. Nesse momento, o Compute Engine exclui a reserva e interrompe ou exclui a instância de computação com base na ação de encerramento especificada na instância de computação.
Limitações
Para criar instâncias de computação usando o modelo de provisionamento vinculado à reserva, é preciso usar uma das seguintes séries de máquinas ou versões de TPU:
GPUs:
A4X Max
A4X
A4
A3 Ultra
A3 Mega
A3 High com 8 GPUs
A3 Edge
Para saber como usar outras séries de máquinas de GPU com o modelo de provisionamento vinculado à reserva, entre em contato com a sua equipe de conta ou a equipe de vendas.
Versões de TPU:
TPU7x
v6e
v5p
H4D