Sobre instâncias que usam o modelo vinculado à reserva

Este documento descreve as instâncias do Compute Engine que usam o modelo de provisionamento vinculado à reserva, incluindo os benefícios e os requisitos de criação.

Ao criar uma instância de computação, é preciso especificar o modelo de provisionamento subjacente , que define a disponibilidade, os preços e a vida útil dos recursos usados pela instância de computação. O modelo de provisionamento vinculado à reserva permite criar instâncias de computação usando a capacidade reservada de uma reserva adiantada no modo de calendário ou reserva adiantada no Hipercomputador de IA.

O modelo de provisionamento vinculado à reserva oferece os seguintes benefícios:

  • Controle de custos: não há cobranças adicionais ao criar instâncias de computação usando a capacidade reservada. Você só recebe cobranças por recursos que não fazem parte da reserva, como discos ou endereços IP.

  • Gerenciamento do ciclo de vida: com base na ação de encerramento especificada ao criar instâncias de computação, o Compute Engine interrompe ou exclui as instâncias de computação no final do período de reserva.

Entender as instâncias que usam o modelo de provisionamento vinculado à reserva

As seções a seguir descrevem os requisitos que você aplica ao criar instâncias de computação usando o modelo de provisionamento vinculado à reserva.

Pré-requisitos para a criação de instâncias de computação

Para usar o modelo de provisionamento vinculado à reserva para criar instâncias de computação, primeiro é preciso reservar recursos. É possível reservar recursos da seguinte maneira:

Se Cloud de Confiance by S3NS aprovar sua solicção de reserva adiantada, o Compute Engine criará automaticamente (criação automática) uma reserva no início do período de reserva. Em seguida, você poderá usar a reserva para criar instâncias de computação.

Requisitos de criação de instâncias de computação

Para criar uma instância de computação usando o modelo de provisionamento vinculado à reserva, é preciso especificar as seguintes configurações:

  • A instância de computação e a reserva precisam ter propriedades correspondentes. Só é possível usar a capacidade reservada para criar instâncias se as propriedades da instância e da reserva criada automaticamente forem exatamente iguais. Para mais informações, consulte os requisitos para consumir reservas.

  • A instância de computação precisa visar especificamente a reserva para consumo. Ao criar uma instância de computação, é preciso especificar o nome da reserva criada automaticamente para consumo, além de definir o campo reservationAffinity como SPECIFIC_RESERVATION. Para mais informações, consulte Consumir uma reserva especificamente direcionada.

  • A instância de computação precisa usar o modelo de provisionamento vinculado à reserva. Ao criar uma instância de computação, é preciso especificar o modelo de provisionamento vinculado à reserva da seguinte maneira:

    • Se você usar o Cloud de Confiance console, na lista Modelo de provisionamento , selecione Vinculado à reserva.

    • Se você usar a Google Cloud CLI, inclua a flag --provisioning-model=RESERVATION_BOUND no comando.

    • Se você usar a API Compute Engine, inclua o "provisioningModel": "RESERVATION_BOUND" campo no corpo da solicitação.

  • A instância de computação precisa ser interrompida ou excluída no horário de término da reserva. Ao criar uma instância de computação, é preciso especificar se ela será interrompida ou excluída no horário de término da reserva usando o campo instanceTerminationAction. Para mais informações, consulte Como limitar o tempo de execução de uma instância de computação.

Depois de criar uma instância de computação usando o modelo de provisionamento vinculado à reserva, a instância de computação começa a ser executada e continua até que você a interrompa ou exclua, ou até que o Compute Engine a interrompa ou exclua no horário de término da reserva.

Quota

Ao criar uma instância de computação usando o modelo de provisionamento vinculado à reserva, não é necessário ter cota para os recursos reservados que você usa para criar a instância de computação. Você só precisa de cota para os recursos que não fazem parte da capacidade reservada, como discos e endereços IP. Para mais informações sobre os diferentes tipos de cota, consulte Cotas de alocação.

Preços

Ao criar uma instância de computação usando o modelo de provisionamento vinculado à reserva, você recebe cobranças da seguinte maneira:

  • As cobranças começam quando você cria a instância de computação. Não há cobranças adicionais pelos recursos reservados que você usa para criar a instância de computação. Você só recebe cobranças pelos recursos que não fazem parte da reserva, como discos ou endereços IP. Para mais informações, consulte o faturamento de reservas.

  • As cobranças param no horário de término da reserva. Nesse momento, o Compute Engine exclui a reserva e interrompe ou exclui a instância de computação com base na ação de encerramento especificada na instância de computação.

Limitações

Para criar instâncias de computação usando o modelo de provisionamento vinculado à reserva, é preciso usar uma das seguintes séries de máquinas ou versões de TPU:

  • GPUs:

    • A4X Max

    • A4X

    • A4

    • A3 Ultra

    • A3 Mega

    • A3 High com 8 GPUs

    • A3 Edge

    Para saber como usar outras séries de máquinas de GPU com o modelo de provisionamento vinculado à reserva, entre em contato com a sua equipe de conta ou a equipe de vendas.

  • Versões de TPU:

    • TPU7x

    • v6e

    • v5p

  • H4D

A seguir