Crea un'istanza G2 ottimizzata per l'AI

Questo documento descrive i passaggi per creare istanze di macchine virtuali (VM) autonome che utilizzano la serie di macchine G2. Per saperne di più su questi tipi di macchine ottimizzate per l'acceleratore, consulta Serie G2.

Per scoprire altri modi per creare VM o cluster, vedi Panoramica delle opzioni di deployment.

Limitazioni

Quando crei una VM G2 autonoma, si applicano le seguenti limitazioni:

  • Non sono previsti sconti per utilizzo sostenuto e per impegno di utilizzo flessibile per le istanze che utilizzano un tipo di macchina G2.
  • Puoi utilizzare un tipo di macchina G2 solo in alcune regioni e zone.
  • Il tipo di macchina G2 è disponibile solo sulla piattaforma Cascade Lake.
  • Il disco permanente standard (pd-standard) non è supportato nelle istanze che utilizzano il tipo di macchina G2. Per i tipi di dischi supportati, consulta Tipi di dischi supportati per G2.
  • Non puoi creare GPU multi-istanza su un'istanza che utilizza un tipo di macchina G2.
  • Se devi modificare il tipo di macchina di un'istanza G2, consulta Modifica le istanze ottimizzate per l'acceleratore.
  • Non puoi utilizzare Deep Learning VM Images come dischi di avvio per le istanze che utilizzano il tipo di macchina G2.
  • L'attuale driver predefinito per Container-Optimized OS non supporta le GPU L4 in esecuzione su tipi di macchine G2. Inoltre, Container-Optimized OS supporta solo un insieme selezionato di driver. Se vuoi utilizzare Container-Optimized OS sui tipi di macchine G2, consulta le seguenti note:
    • Utilizza una versione di Container-Optimized OS che supporti la versione minima consigliata del driver NVIDIA 525.60.13 o successive. Per ulteriori informazioni, consulta le note di rilascio di Container-Optimized OS.
    • Quando installi il driver, specifica la versione più recente disponibile adatta alle GPU L4. Ad esempio, sudo cos-extensions install gpu -- -version=525.60.13.
  • Devi utilizzare Google Cloud CLI o REST per creare istanze G2 per i seguenti scenari:
    • Specifica i valori di memoria personalizzati.
    • Personalizza il numero di core della CPU visibili.
Se vuoi utilizzare una policy di posizionamento compatto, consulta le limitazioni per le policy di posizionamento.

Prima di iniziare

Prima di creare le VM, se non l'hai ancora fatto, completa i seguenti passaggi:

  1. Scegli un'opzione di consumo: la tua scelta determina come ottenere e utilizzare le risorse GPU. Per saperne di più, consulta Scegliere un'opzione di consumo.
  2. Ottenere capacità: la procedura per ottenere capacità varia a seconda dell'opzione di consumo. Per scoprire di più sulla procedura per ottenere la capacità per l'opzione di consumo scelta, consulta Panoramica della capacità.

Seleziona la scheda relativa a come prevedi di utilizzare gli esempi in questa pagina:

Console

Quando utilizzi la console Google Cloud per accedere ai servizi Google Cloud e alle API, non devi configurare l'autenticazione.

gcloud

Installa Google Cloud CLI, quindi accedi a gcloud CLI con la tua identità federata. Dopo aver eseguito l'accesso, inizializza Google Cloud CLI eseguendo il comando seguente:

gcloud init

REST

Per utilizzare gli esempi di API REST in questa pagina in un ambiente di sviluppo locale, utilizzi le credenziali che fornisci a gcloud CLI.

    Installa Google Cloud CLI, quindi accedi a gcloud CLI con la tua identità federata.

Per saperne di più, consulta Autenticati per usare REST nella documentazione sull'autenticazione di Google Cloud .

Ruoli obbligatori

Per ottenere le autorizzazioni necessarie per creare VM, chiedi all'amministratore di concederti il ruolo IAM Compute Instance Admin (v1) (roles/compute.instanceAdmin.v1) nel progetto. Per saperne di più sulla concessione dei ruoli, consulta Gestisci l'accesso a progetti, cartelle e organizzazioni.

Questo ruolo predefinito contiene le autorizzazioni necessarie per creare VM. Per vedere quali sono esattamente le autorizzazioni richieste, espandi la sezione Autorizzazioni obbligatorie:

Autorizzazioni obbligatorie

Per creare VM sono necessarie le seguenti autorizzazioni:

  • compute.instances.create sul progetto
  • Per utilizzare un'immagine personalizzata per creare la VM: compute.images.useReadOnly sull'immagine
  • Per utilizzare uno snapshot per creare la VM: compute.snapshots.useReadOnly sullo snapshot
  • Per utilizzare un template di istanza per creare la VM: compute.instanceTemplates.useReadOnly sul template di istanza
  • Per specificare una subnet per la VM: compute.subnetworks.use sul progetto o sulla subnet scelta
  • Per specificare un indirizzo IP statico per la VM: compute.addresses.use sul progetto
  • Per assegnare un indirizzo IP esterno alla VM quando utilizzi una rete VPC: compute.subnetworks.useExternalIp sul progetto o sulla subnet scelta
  • Per assegnare una rete legacy alla VM: compute.networks.use sul progetto
  • Per assegnare un indirizzo IP esterno alla VM quando utilizzi una rete legacy: compute.networks.useExternalIp sul progetto
  • Per impostare i metadati dell'istanza VM per la VM: compute.instances.setMetadata sul progetto
  • Per impostare i tag per la VM: compute.instances.setTags sulla VM
  • Per impostare le etichette per la VM: compute.instances.setLabels sulla VM
  • Per impostare un service account che la VM possa utilizzare: compute.instances.setServiceAccount sulla VM
  • Per creare un nuovo disco per la VM: compute.disks.create sul progetto
  • Per collegare un disco esistente in modalità di sola lettura o di lettura e scrittura: compute.disks.use sul disco
  • Per collegare un disco esistente in modalità di sola lettura: compute.disks.useReadOnly sul disco

Potresti anche ottenere queste autorizzazioni con ruoli personalizzati o altri ruoli predefiniti.

Panoramica

La creazione di un'istanza con il tipo di macchina G2 include i seguenti passaggi:

  1. (Facoltativo) Crea una policy di posizionamento compatto
  2. Crea un'istanza
  3. Installa i driver della GPU

(Facoltativo) Crea una policy di posizionamento compatto

Puoi specificare il posizionamento delle VM creando una policy di posizionamento compatto. Quando applichi una policy di posizionamento compatto alle tue VM, Compute Engine tenta al meglio di creare VM il più vicine possibile tra loro. Se la tua applicazione è sensibile alla latenza e richiede la massima compattezza, specifica il campo maxDistance (anteprima) quando crei una policy di posizionamento compatto. Un valore maxDistance inferiore garantisce un posizionamento più vicino delle VM, ma aumenta anche la probabilità che alcune VM non vengano create.

Per creare una policy di posizionamento compatto, seleziona una delle seguenti opzioni:

gcloud

Per creare una policy di posizionamento compatto, utilizza il comando gcloud beta compute resource-policies create group-placement:

gcloud beta compute resource-policies create group-placement POLICY_NAME \
    --collocation=collocated \
    --max-distance=MAX_DISTANCE \
    --region=REGION

Sostituisci quanto segue:

  • POLICY_NAME: il nome della policy di posizionamento compatto.
  • MAX_DISTANCE: la configurazione della distanza massima per le VM, che può essere specificata (anteprima, consigliata) o non specificata (rimuovi il flag --max-distance). In base a ciò che supporta il tipo di macchina, puoi specificare uno dei seguenti valori:
    • Per posizionare le VM nello stesso blocco secondario: 1
    • Per posizionare le VM nello stesso blocco: 2
    • Per posizionare le VM in blocchi adiacenti: 3
    Assicurati che la configurazione della distanza massima supporti la serie di macchine e il numero di VM che prevedi di creare. Per saperne di più, consulta Informazioni sulle policy di posizionamento compatto nella documentazione di Compute Engine.
  • REGION: la regione in cui vuoi creare la policy di posizionamento compatto. Specifica la regione che contiene la zona in cui prevedi di creare istanze e verifica che il tipo di macchina che vuoi utilizzare sia disponibile in quella regione. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.

REST

Per creare una policy di posizionamento compatto, invia una richiesta POST al metodo resourcePolicies.insert beta. Nel corpo della richiesta, includi il campo collocation impostato su COLLOCATED e il campo maxDistance.

POST https://compute.googleapis.com/compute/beta/projects/PROJECT_ID/regions/REGION/resourcePolicies
  {
    "name": "POLICY_NAME",
    "groupPlacementPolicy": {
      "collocation": "COLLOCATED",
      "maxDistance": MAX_DISTANCE
    }
  }

Sostituisci quanto segue:

  • PROJECT_ID: il tuo ID progetto.
  • POLICY_NAME: il nome della policy di posizionamento compatto.
  • MAX_DISTANCE: la configurazione della distanza massima per le VM, che può essere specificata (anteprima, consigliata) o non specificata (rimuovi il campo maxDistance). In base a ciò che supporta il tipo di macchina, puoi specificare uno dei seguenti valori:
    • Per posizionare le VM nello stesso blocco secondario: 1
    • Per posizionare le VM nello stesso blocco: 2
    • Per posizionare le VM in blocchi adiacenti: 3
    Assicurati che la configurazione della distanza massima supporti la serie di macchine e il numero di VM che prevedi di creare. Per saperne di più, consulta Informazioni sulle policy di posizionamento compatto nella documentazione di Compute Engine.
  • REGION: la regione in cui vuoi creare la policy di posizionamento compatto. Specifica la regione che contiene la zona in cui prevedi di creare istanze e verifica che il tipo di macchina che vuoi utilizzare sia disponibile in quella regione. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.

Crea una VM G2

Per creare una VM G2, utilizza uno dei seguenti metodi.

I seguenti comandi impostano anche l'ambito di accesso per le tue istanze. Per semplificare la gestione delle autorizzazioni, Google consiglia di impostare l'ambito di accesso di un'istanza su cloud-platform e poi utilizzare i ruoli IAM per definire i servizi a cui l'istanza può accedere. Per saperne di più, consulta le best practice per gli ambiti.

Console

  1. Nella console Google Cloud , vai alla pagina Crea un'istanza.

    Vai a Crea un'istanza

  2. Specifica un Nome per la VM. Consulta Convenzione di denominazione delle risorse.

  3. Seleziona la Regione e la Zona in cui vuoi creare una VM. Consulta l'elenco delle regioni e zone GPU disponibili.

  4. Fai clic sulla scheda GPU e poi completa i seguenti passaggi:

    1. Per utilizzare la serie di macchine G2, nell'elenco Tipo di GPU, seleziona NVIDIA L4.
    2. Nell'elenco Numero di GPU, seleziona un numero di GPU.
    3. Nell'elenco Tipo di macchina, seleziona un tipo di macchina.
  5. In base all'opzione di consumo che vuoi utilizzare, seleziona una delle seguenti opzioni e completa i passaggi successivi.

    Prenotazione

    Le istanze G2 supportano i seguenti tipi di prenotazioni:

    • Prenotazioni on demand
    • Prenotazioni future standard

    Per utilizzare questi tipi di prenotazioni, un'istanza deve utilizzare il modello di provisioning standard. Ad esempio, utilizza i seguenti parametri di creazione.

    1. Nella sezione Modello di provisioning, seleziona Standard dall'elenco Modello di provisioning delle VM. Questa opzione è selezionata per impostazione predefinita.
    2. Per configurare le prenotazioni utilizzate da questa VM, completa i seguenti passaggi:

      1. Nel menu di navigazione, fai clic su Avanzate.
      2. Per Prenotazioni, seleziona una delle seguenti opzioni:

        • Per utilizzare facoltativamente la capacità di prenotazione, seleziona Utilizza la selezione automatica. Questa opzione è selezionata per impostazione predefinita.

          L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, il che avviene solo se è disponibile la capacità della prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.

        • Per richiedere la capacità di prenotazione, seleziona Scegli una prenotazione e poi fai clic su Scegli prenotazione per specificare quale prenotazione utilizzare.

          L'istanza è tenuta a utilizzare la capacità di una prenotazione con target specifico e non può utilizzare la capacità on demand. Se la capacità della prenotazione non è disponibile, la creazione dell'istanza non riesce.

    On demand

    1. Nella sezione Modello di provisioning, seleziona Standard dall'elenco Modello di provisioning delle VM. Questa opzione è selezionata per impostazione predefinita.
    2. (Facoltativo) Per configurare se questa VM utilizza o meno le prenotazioni, completa i seguenti passaggi:

      1. Nel menu di navigazione, fai clic su Avanzate.
      2. Per Prenotazioni, seleziona una delle seguenti opzioni:

        • Per utilizzare facoltativamente la capacità di prenotazione, seleziona Utilizza la selezione automatica. Questa opzione è selezionata per impostazione predefinita.

          L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, il che avviene solo se è disponibile la capacità della prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.

        • Per richiedere capacità on demand, seleziona Non utilizzare una prenotazione.

          L'istanza non può utilizzare la capacità di prenotazione.

    Avvio flessibile

    1. Nella sezione Modello di provisioning, seleziona Avvio flessibile dall'elenco Modello di provisioning delle VM.
    2. Nel campo Inserisci il numero di ore, inserisci il periodo di tempo massimo durante il quale vuoi che la VM venga eseguita. Il valore deve essere compreso tra 46 secondi (0.01) e sette giorni (168 o 168 ore).

    3. Seleziona Imposta un tempo di attesa per la creazione della VM.

      In base ai requisiti di zona per il tuo carico di lavoro, specifica una delle seguenti durate per aumentare le probabilità di riuscita della richiesta di creazione della VM:

      • Workload con requisiti di zona rigorosi: se il tuo workload richiede la creazione della VM in una zona specifica, specifica una durata compresa tra 90 secondi e 2 ore. Le durate più lunghe aumentano le probabilità di ottenere risorse.
      • Workload senza requisiti di zona rigorosi: se la VM può essere eseguita in qualsiasi zona della regione, specifica una durata di 0 secondi o deseleziona la casella di controllo Imposta un tempo di attesa per la creazione della VM. Questa azione specifica che Compute Engine alloca le risorse solo se sono immediatamente disponibili. Se la richiesta di creazione della VM non va a buon fine perché le risorse non sono disponibili, riprova a inviare la richiesta in un'altra zona.

    4. Nel campo Informazioni sulla terminazione delle VM, seleziona se arrestare o eliminare la VM al termine della durata di esecuzione:

      • Per eliminare la VM, seleziona Elimina.
      • Per arrestare la VM, seleziona Arresta.

    Spot

    1. Nella sezione Modello di provisioning, seleziona Spot dall'elenco Modello di provisioning delle VM.
    2. (Facoltativo) Per selezionare l'azione di terminazione che si verifica quando Compute Engine esegue il prerilascio della VM, completa i seguenti passaggi:

      1. Espandi la sezione Impostazioni avanzate del modello di provisioning delle VM.
      2. Nell'elenco Alla terminazione della VM, seleziona una delle seguenti opzioni:
        • Per arrestare la VM durante il prerilascio, seleziona Arresta (valore predefinito).
        • Per eliminare la VM durante il prerilascio, seleziona Elimina.
  6. Nel menu di navigazione, fai clic su Sistema operativo e spazio di archiviazione, quindi completa i passaggi seguenti:

    1. Fai clic su Cambia. Viene visualizzato il riquadro Configurazione del disco di avvio.
    2. Nella scheda Immagini pubbliche, seleziona un'immagine consigliata. Per un elenco di immagini consigliate, vedi Sistemi operativi.

    3. (Facoltativo) Per configurare le dimensioni del disco di avvio, consulta i limiti di dimensioni di Google Cloud Hyperdisk o i limiti di dimensioni di Persistent Disk in base al tipo di disco.

    4. Per confermare le opzioni relative al disco di avvio, fai clic su Seleziona.

    5. (Facoltativo) Se vuoi aggiungere dischi SSD locali, completa i seguenti passaggi:

      1. Fai clic su Aggiungi SSD locale. Viene visualizzato il riquadro Configura SSD locale.
      2. Nel riquadro Configura SSD locale, configura le opzioni per i dischi SSD locali. Per saperne di più, consulta Aggiungi un disco SSD locale all'istanza di computing nella documentazione di Compute Engine.
      3. Per confermare le opzioni relative al disco di avvio, fai clic su Salva.

      Dopo aver creato una VM con dischi SSD locali, devi formattare e montare ogni dispositivo prima di poterlo utilizzare.

  7. Configura il account di servizio e gli ambiti di accesso come segue. I workload in esecuzione sull'istanza utilizzano ilaccount di serviziot collegato per autorizzare le richieste ad altri servizi Google Cloud .

    1. Nel menu di navigazione, fai clic su Sicurezza.
    2. Nell'elenco Service account, seleziona un account di servizio da utilizzare.
    3. Per Ambiti di accesso, seleziona l'opzione Consenti l'accesso completo a tutte le API Cloud. Questa best practice ti consente di gestire l'accesso aggiungendo o rimuovendo i ruoli IAM dal account di servizio. Per saperne di più, consulta Collegamento di un account di servizio a un'istanza.
  8. Per creare e avviare la VM, fai clic su Crea.

gcloud

Per creare la VM, utilizza il comando gcloud compute instances create.

I parametri da specificare dipendono dall'opzione di consumo che utilizzi per questo deployment. Seleziona la scheda corrispondente all'opzione di consumo.

Prenotazione

Le istanze G2 supportano i seguenti tipi di prenotazioni:

  • Prenotazioni on demand
  • Prenotazioni future standard

Per utilizzare questi tipi di prenotazioni, un'istanza deve utilizzare il modello di provisioning standard. Ad esempio, utilizza i seguenti parametri di creazione.

Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.

gcloud compute instances create INSTANCE_NAME  \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --zone=ZONE \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY \
    --reservation=RESERVATION

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • INSTANCE_NAME: il nome della VM.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per la VM. Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo.
    • ZONE: la zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Per specificare una policy di posizionamento compatto, utilizza una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • DISK_TYPE: il tipo di disco di avvio. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:

      • any (la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, il che si verifica solo se è disponibile la capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.

      • specific (è richiesta la capacità di prenotazione): richiede che l'istanza utilizzi la capacità di una prenotazione con target specifico. L'istanza non è autorizzata a utilizzare la capacità on demand. Se la capacità di prenotazione non è disponibile, la creazione dell'istanza non riesce.

    • RESERVATION: la prenotazione da utilizzare. Specifica uno dei seguenti valori in base al valore specificato per RESERVATION_AFFINITY:

      • Se hai specificato any, sostituisci RESERVATION con una stringa vuota (""). In alternativa, puoi rimuovere completamente il flag --reservation.
      • Se hai specificato specific, sostituisci RESERVATION con quanto segue:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Sostituisci quanto segue:

        • RESERVATION_OWNER_PROJECT_ID: l'ID progetto del progetto in cui è stata creata la prenotazione.
        • RESERVATION_NAME: il nome della prenotazione.
  2. Per impostazione predefinita, l'istanza viene riavviata automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Se vuoi disattivare il riavvio automatico, aggiungi il seguente flag:

    --no-restart-on-failure
  3. (Facoltativo) Per utilizzare una policy di posizionamento compatto, aggiungi il seguente flag:

      --resource-policies=POLICY_NAME
    

    Sostituisci quanto segue:

    • POLICY_NAME: il nome della policy di posizionamento compatto.
  4. (Facoltativo) Per collegare dischi SSD locali, aggiungi il seguente flag --local-ssd per ogni disco SSD locale.

    Assicurati che il numero di dischi SSD locali che colleghi sia consentito per il tuo tipo di macchina. Per i dettagli, consulta Informazioni sui dischi SSD locali nella documentazione di Compute Engine.

    --local-ssd interface=INTERFACE_TYPE
    

    Sostituisci quanto segue:

    • INTERFACE_TYPE: il tipo di interfaccia del disco che vuoi utilizzare per il disco SSD locale. Se l'immagine del disco di avvio ha driver NVMe ottimizzati, specifica NVME. Specifica SCSI per le altre immagini.

    Dopo aver creato una VM con dischi SSD locali, per poterla utilizzare devi prima formattare e montare ogni dispositivo.

  5. (Facoltativo) Per utilizzare la workstation virtuale (vWS) NVIDIA RTX, aggiungi il seguente flag.

    Quando crei un'istanza che utilizza la workstation virtuale NVIDIA RTX, Compute Engine aggiunge automaticamente una licenza vWS. Per informazioni sui prezzi delle workstation virtuali, consulta la pagina dei prezzi delle GPU.

    --accelerator=type=nvidia-l4-vws,count=VWS_ACCELERATOR_COUNT
    

    Sostituisci VWS_ACCELERATOR_COUNT con il numero di GPU virtuali che vuoi.

  6. Esegui il comando.

On demand

Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.

gcloud compute instances create INSTANCE_NAME  \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --zone=ZONE \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • INSTANCE_NAME: il nome della VM.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per la VM. Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo.
    • ZONE: la zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Per specificare una policy di posizionamento compatto, utilizza una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • DISK_TYPE: il tipo di disco di avvio. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:

      • any (la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, il che si verifica solo se è disponibile la capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.

      • none (è necessaria la capacità on demand): impedisci all'istanza di utilizzare qualsiasi capacità di prenotazione.

  2. Per impostazione predefinita, l'istanza viene riavviata automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Se vuoi disattivare il riavvio automatico, aggiungi il seguente flag:

    --no-restart-on-failure
  3. (Facoltativo) Per utilizzare una policy di posizionamento compatto, aggiungi il seguente flag:

      --resource-policies=POLICY_NAME
    

    Sostituisci quanto segue:

    • POLICY_NAME: il nome della policy di posizionamento compatto.
  4. (Facoltativo) Per collegare dischi SSD locali, aggiungi il seguente flag --local-ssd per ogni disco SSD locale.

    Assicurati che il numero di dischi SSD locali che colleghi sia consentito per il tuo tipo di macchina. Per i dettagli, consulta Informazioni sui dischi SSD locali nella documentazione di Compute Engine.

    --local-ssd interface=INTERFACE_TYPE
    

    Sostituisci quanto segue:

    • INTERFACE_TYPE: il tipo di interfaccia del disco che vuoi utilizzare per il disco SSD locale. Se l'immagine del disco di avvio ha driver NVMe ottimizzati, specifica NVME. Specifica SCSI per le altre immagini.

    Dopo aver creato una VM con dischi SSD locali, per poterla utilizzare devi prima formattare e montare ogni dispositivo.

  5. (Facoltativo) Per utilizzare la workstation virtuale (vWS) NVIDIA RTX, aggiungi il seguente flag.

    Quando crei un'istanza che utilizza la workstation virtuale NVIDIA RTX, Compute Engine aggiunge automaticamente una licenza vWS. Per informazioni sui prezzi delle workstation virtuali, consulta la pagina dei prezzi delle GPU.

    --accelerator=type=nvidia-l4-vws,count=VWS_ACCELERATOR_COUNT
    

    Sostituisci VWS_ACCELERATOR_COUNT con il numero di GPU virtuali che vuoi.

  6. Esegui il comando.

Avvio flessibile

Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.

gcloud compute instances create INSTANCE_NAME  \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --zone=ZONE \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --reservation-affinity=none \
    --provisioning-model=FLEX_START \
    --request-valid-for-duration=REQUEST_VALID_FOR_DURATION \
    --max-run-duration=MAX_RUN_DURATION \
    --instance-termination-action=TERMINATION_ACTION \
    --maintenance-policy=TERMINATE

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • INSTANCE_NAME: il nome della VM.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per la VM. Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo.
    • ZONE: la zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Per specificare una policy di posizionamento compatto, utilizza una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • DISK_TYPE: il tipo di disco di avvio. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • REQUEST_VALID_FOR_DURATION: per quanto tempo la richiesta di creazione della VM rimane valida. Devi formattare il valore come numero di giorni, ore, minuti o secondi seguiti rispettivamente da d, h, m e s. Ad esempio, specifica 30m per 30 minuti o 1h2m3s per un'ora, due minuti e tre secondi.

      In base ai requisiti di zona per il tuo carico di lavoro, specifica una delle seguenti durate per aumentare le probabilità di riuscita della richiesta di creazione della VM:

      • Workload con requisiti di zona rigorosi: se il tuo workload richiede la creazione della VM in una zona specifica, specifica una durata compresa tra 90 secondi (90s) e due ore (2h). Durate più lunghe aumentano le probabilità di ottenere risorse.
      • Workload senza requisiti di zona rigorosi: se la VM può essere eseguita in qualsiasi zona all'interno della regione, specifica una durata di zero secondi (0s). Questa azione specifica che Compute Engine alloca le risorse solo se sono immediatamente disponibili. Se la richiesta di creazione della VM non va a buon fine perché le risorse non sono disponibili, riprova a inviare la richiesta in un'altra zona.
    • MAX_RUN_DURATION: la durata per cui vuoi eseguire le VM richieste. Devi formattare il valore come numero di giorni, ore, minuti o secondi seguito rispettivamente da d, h, m e s. Il valore deve essere compreso tra 10 minuti e sette giorni.

    • TERMINATION_ACTION: indica se Compute Engine arresta (STOP) o elimina (DELETE) la VM al termine della durata di esecuzione.

  2. (Facoltativo) Per utilizzare una policy di posizionamento compatto, aggiungi il seguente flag:

      --resource-policies=POLICY_NAME
    

    Sostituisci quanto segue:

    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. (Facoltativo) Per collegare dischi SSD locali, aggiungi il seguente flag --local-ssd per ogni disco SSD locale.

    Assicurati che il numero di dischi SSD locali che colleghi sia consentito per il tuo tipo di macchina. Per i dettagli, consulta Informazioni sui dischi SSD locali nella documentazione di Compute Engine.

    --local-ssd interface=INTERFACE_TYPE
    

    Sostituisci quanto segue:

    • INTERFACE_TYPE: il tipo di interfaccia del disco che vuoi utilizzare per il disco SSD locale. Se l'immagine del disco di avvio ha driver NVMe ottimizzati, specifica NVME. Specifica SCSI per le altre immagini.

    Dopo aver creato una VM con dischi SSD locali, per poterla utilizzare devi prima formattare e montare ogni dispositivo.

  4. (Facoltativo) Per utilizzare la workstation virtuale (vWS) NVIDIA RTX, aggiungi il seguente flag.

    Quando crei un'istanza che utilizza la workstation virtuale NVIDIA RTX, Compute Engine aggiunge automaticamente una licenza vWS. Per informazioni sui prezzi delle workstation virtuali, consulta la pagina dei prezzi delle GPU.

    --accelerator=type=nvidia-l4-vws,count=VWS_ACCELERATOR_COUNT
    

    Sostituisci VWS_ACCELERATOR_COUNT con il numero di GPU virtuali che vuoi.

  5. Esegui il comando.

Spot

Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.

gcloud compute instances create INSTANCE_NAME  \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --zone=ZONE \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --provisioning-model=SPOT \
    --instance-termination-action=TERMINATION_ACTION \
    --maintenance-policy=TERMINATE \
    --no-restart-on-failure

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • INSTANCE_NAME: il nome della VM.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per la VM. Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo.
    • ZONE: la zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Per specificare una policy di posizionamento compatto, utilizza una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • DISK_TYPE: il tipo di disco di avvio. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • TERMINATION_ACTION: l'azione da intraprendere quando Compute Engine prerilascia l'istanza, ovvero STOP (impostazione predefinita) o DELETE.

  2. (Facoltativo) Per utilizzare una policy di posizionamento compatto, aggiungi il seguente flag:

      --resource-policies=POLICY_NAME
    

    Sostituisci quanto segue:

    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. (Facoltativo) Per collegare dischi SSD locali, aggiungi il seguente flag --local-ssd per ogni disco SSD locale.

    Assicurati che il numero di dischi SSD locali che colleghi sia consentito per il tuo tipo di macchina. Per i dettagli, consulta Informazioni sui dischi SSD locali nella documentazione di Compute Engine.

    --local-ssd interface=INTERFACE_TYPE
    

    Sostituisci quanto segue:

    • INTERFACE_TYPE: il tipo di interfaccia del disco che vuoi utilizzare per il disco SSD locale. Se l'immagine del disco di avvio ha driver NVMe ottimizzati, specifica NVME. Specifica SCSI per le altre immagini.

    Dopo aver creato una VM con dischi SSD locali, per poterla utilizzare devi prima formattare e montare ogni dispositivo.

  4. (Facoltativo) Per utilizzare la workstation virtuale (vWS) NVIDIA RTX, aggiungi il seguente flag.

    Quando crei un'istanza che utilizza la workstation virtuale NVIDIA RTX, Compute Engine aggiunge automaticamente una licenza vWS. Per informazioni sui prezzi delle workstation virtuali, consulta la pagina dei prezzi delle GPU.

    --accelerator=type=nvidia-l4-vws,count=VWS_ACCELERATOR_COUNT
    

    Sostituisci VWS_ACCELERATOR_COUNT con il numero di GPU virtuali che vuoi.

  5. Esegui il comando.

REST

Per creare la VM, invia una richiesta POST al metodo instances.insert.

I parametri da specificare dipendono dall'opzione di consumo che utilizzi per questo deployment. Seleziona la scheda corrispondente all'opzione di consumo.

Prenotazione

Le istanze G2 supportano i seguenti tipi di prenotazioni:

  • Prenotazioni on demand
  • Prenotazioni future standard

Per utilizzare questi tipi di prenotazioni, un'istanza deve utilizzare il modello di provisioning standard. Ad esempio, utilizza i seguenti parametri di creazione.

Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
  "machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
  "name": "INSTANCE_NAME",
  "disks": [
    {
      "boot": true,
      "initializeParams": {
        "diskSizeGb": "DISK_SIZE",
        "diskType": "DISK_TYPE",
        "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
      },
      "mode": "READ_WRITE",
      "type": "PERSISTENT"
    }
  ],
  "serviceAccounts": [
    {
      "email": "default",
      "scopes": [
        "https://www.googleapis.com/auth/cloud-platform"
      ]
    }
  ],
  "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY",
    "key": "compute.googleapis.com/reservation-name",
    "values": [
      "RESERVATION"
    ]
  }
}

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto del progetto in cui vuoi creare la VM.
    • ZONE: la zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per la VM. Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • INSTANCE_NAME: il nome della VM.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • DISK_TYPE: il tipo di disco di avvio. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati.
    • AUTOMATIC_RESTART: se l'istanza si riavvia automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Specifica true per attivare il riavvio automatico (impostazione predefinita) o false per disattivarlo.

    • RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:

      • ANY_RESERVATION (la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, cosa che si verifica solo se è disponibile una capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.

      • SPECIFIC_RESERVATION (è richiesta la capacità di prenotazione): richiede che l'istanza utilizzi la capacità di una prenotazione con target specifico. L'istanza non è autorizzata a utilizzare la capacità on demand. Se la capacità di prenotazione non è disponibile, la creazione dell'istanza non riesce.

    • RESERVATION: la prenotazione da utilizzare. Specifica uno dei seguenti valori in base al valore specificato per RESERVATION_AFFINITY:

      • Se hai specificato ANY_RESERVATION, elimina RESERVATION in modo che il valore sia una stringa vuota (""). In alternativa, puoi rimuovere completamente i campi key e values.
      • Se hai specificato SPECIFIC_RESERVATION, sostituisci RESERVATION con quanto segue:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Sostituisci quanto segue:

        • RESERVATION_OWNER_PROJECT_ID: l'ID progetto del progetto in cui è stata creata la prenotazione.
        • RESERVATION_NAME: il nome della prenotazione.
  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente campo al corpo della richiesta:

      "resourcePolicies": [
        "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
      ]
    

    Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto della policy di posizionamento compatto.
    • REGION: la regione della policy di posizionamento compatto.
    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. (Facoltativo) Per utilizzare i dischi SSD locali, aggiungi il seguente campo al campo disks[] per ogni disco SSD locale. Separa ogni sottocampo disks[] (incluso il disco di avvio) con una virgola.

    Assicurati che il numero di dischi SSD locali che colleghi sia consentito per il tuo tipo di macchina. Per i dettagli, consulta Informazioni sui dischi SSD locali nella documentazione di Compute Engine.

        {
           "type": "SCRATCH",
           "initializeParams": {
              "diskType": "zones/ZONE/diskTypes/local-ssd"
           },
           "autoDelete": true,
           "interface": "INTERFACE_TYPE"
        }
    

    Sostituisci quanto segue:

    • ZONE: la zona specificata.
    • INTERFACE_TYPE: il tipo di interfaccia del disco che vuoi utilizzare per il disco SSD locale. Se l'immagine del disco di avvio ha driver NVMe ottimizzati, specifica NVME. Specifica SCSI per le altre immagini.

    Dopo aver creato una VM con dischi SSD locali, per poterla utilizzare devi prima formattare e montare ogni dispositivo.

  4. (Facoltativo) Per utilizzare la workstation virtuale (vWS) NVIDIA RTX, aggiungi il seguente campo.

    Quando crei un'istanza che utilizza la workstation virtuale NVIDIA RTX, Compute Engine aggiunge automaticamente una licenza vWS. Per informazioni sui prezzi delle workstation virtuali, consulta la pagina dei prezzi delle GPU.

    "guestAccelerators":
      [
        {
          "acceleratorCount": VWS_ACCELERATOR_COUNT,
          "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/nvidia-l4-vws"
        }
      ]
    

    Sostituisci VWS_ACCELERATOR_COUNT con il numero di GPU virtuali che vuoi.

  5. Invia la richiesta.

On demand

Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
  "machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
  "name": "INSTANCE_NAME",
  "disks": [
    {
      "boot": true,
      "initializeParams": {
        "diskSizeGb": "DISK_SIZE",
        "diskType": "DISK_TYPE",
        "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
      },
      "mode": "READ_WRITE",
      "type": "PERSISTENT"
    }
  ],
  "serviceAccounts": [
    {
      "email": "default",
      "scopes": [
        "https://www.googleapis.com/auth/cloud-platform"
      ]
    }
  ],
  "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY"
  }
}

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto del progetto in cui vuoi creare la VM.
    • ZONE: la zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per la VM. Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • INSTANCE_NAME: il nome della VM.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • DISK_TYPE: il tipo di disco di avvio. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati.
    • AUTOMATIC_RESTART: se l'istanza si riavvia automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Specifica true per attivare il riavvio automatico (impostazione predefinita) o false per disattivarlo.

    • RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:

      • ANY_RESERVATION (la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, cosa che si verifica solo se è disponibile una capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.

      • NO_RESERVATION (è necessaria la capacità on demand): impedisci all'istanza di utilizzare qualsiasi capacità di prenotazione.

  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente campo al corpo della richiesta:

      "resourcePolicies": [
        "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
      ]
    

    Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto della policy di posizionamento compatto.
    • REGION: la regione della policy di posizionamento compatto.
    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. (Facoltativo) Per utilizzare i dischi SSD locali, aggiungi il seguente campo al campo disks[] per ogni disco SSD locale. Separa ogni sottocampo disks[] (incluso il disco di avvio) con una virgola.

    Assicurati che il numero di dischi SSD locali che colleghi sia consentito per il tuo tipo di macchina. Per i dettagli, consulta Informazioni sui dischi SSD locali nella documentazione di Compute Engine.

        {
           "type": "SCRATCH",
           "initializeParams": {
              "diskType": "zones/ZONE/diskTypes/local-ssd"
           },
           "autoDelete": true,
           "interface": "INTERFACE_TYPE"
        }
    

    Sostituisci quanto segue:

    • ZONE: la zona specificata.
    • INTERFACE_TYPE: il tipo di interfaccia del disco che vuoi utilizzare per il disco SSD locale. Se l'immagine del disco di avvio ha driver NVMe ottimizzati, specifica NVME. Specifica SCSI per le altre immagini.

    Dopo aver creato una VM con dischi SSD locali, per poterla utilizzare devi prima formattare e montare ogni dispositivo.

  4. (Facoltativo) Per utilizzare la workstation virtuale (vWS) NVIDIA RTX, aggiungi il seguente campo.

    Quando crei un'istanza che utilizza la workstation virtuale NVIDIA RTX, Compute Engine aggiunge automaticamente una licenza vWS. Per informazioni sui prezzi delle workstation virtuali, consulta la pagina dei prezzi delle GPU.

    "guestAccelerators":
      [
        {
          "acceleratorCount": VWS_ACCELERATOR_COUNT,
          "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/nvidia-l4-vws"
        }
      ]
    

    Sostituisci VWS_ACCELERATOR_COUNT con il numero di GPU virtuali che vuoi.

  5. Invia la richiesta.

Avvio flessibile

Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
  "machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
  "name": "INSTANCE_NAME",
  "disks": [
    {
      "boot": true,
      "initializeParams": {
        "diskSizeGb": "DISK_SIZE",
        "diskType": "DISK_TYPE",
        "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
      },
      "mode": "READ_WRITE",
      "type": "PERSISTENT"
    }
  ],
  "serviceAccounts": [
    {
      "email": "default",
      "scopes": [
        "https://www.googleapis.com/auth/cloud-platform"
      ]
    }
  ],
  "reservationAffinity": {
    "consumeReservationType": "NO_RESERVATION",
  },
  "scheduling": {
    "provisioningModel": "FLEX_START",
    "requestValidForDuration": {
      "seconds": REQUEST_VALID_FOR_DURATION
    },
    "maxRunDuration": {
      "seconds": MAX_RUN_DURATION
    },
    "instanceTerminationAction": "TERMINATION_ACTION",
    "onHostMaintenance": "TERMINATE",
  }
}

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto del progetto in cui vuoi creare la VM.
    • ZONE: la zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per la VM. Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • INSTANCE_NAME: il nome della VM.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • DISK_TYPE: il tipo di disco di avvio. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati.
    • REQUEST_VALID_FOR_DURATION: la durata, in secondi, per cui la richiesta di creazione della VM rimane valida.

      In base ai requisiti di zona per il tuo carico di lavoro, specifica una delle seguenti durate per aumentare le probabilità di riuscita della richiesta di creazione della VM:

      • Workload con requisiti di zona rigorosi: se il tuo workload richiede la creazione della VM in una zona specifica, specifica una durata compresa tra 90 secondi (90) e due ore (7200). Durate più lunghe aumentano le probabilità di ottenere risorse.
      • Workload senza requisiti di zona rigorosi: se la VM può essere eseguita in qualsiasi zona all'interno della regione, specifica una durata di zero secondi (0). Questa azione specifica che Compute Engine alloca le risorse solo se sono immediatamente disponibili. Se la richiesta di creazione della VM non va a buon fine perché le risorse non sono disponibili, riprova a inviare la richiesta in un'altra zona.
    • MAX_RUN_DURATION: la durata per cui vuoi eseguire le VM richieste. Devi formattare il valore come numero di secondi. Ad esempio, specifica 86400 per 86.400 secondi (24 ore). Il valore deve essere compreso tra 10 minuti e sette giorni.

    • TERMINATION_ACTION: indica se Compute Engine arresta (STOP) o elimina (DELETE) la VM al termine della durata di esecuzione.

  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente campo al corpo della richiesta:

      "resourcePolicies": [
        "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
      ]
    

    Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto della policy di posizionamento compatto.
    • REGION: la regione della policy di posizionamento compatto.
    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. (Facoltativo) Per utilizzare i dischi SSD locali, aggiungi il seguente campo al campo disks[] per ogni disco SSD locale. Separa ogni sottocampo disks[] (incluso il disco di avvio) con una virgola.

    Assicurati che il numero di dischi SSD locali che colleghi sia consentito per il tuo tipo di macchina. Per i dettagli, consulta Informazioni sui dischi SSD locali nella documentazione di Compute Engine.

        {
           "type": "SCRATCH",
           "initializeParams": {
              "diskType": "zones/ZONE/diskTypes/local-ssd"
           },
           "autoDelete": true,
           "interface": "INTERFACE_TYPE"
        }
    

    Sostituisci quanto segue:

    • ZONE: la zona specificata.
    • INTERFACE_TYPE: il tipo di interfaccia del disco che vuoi utilizzare per il disco SSD locale. Se l'immagine del disco di avvio ha driver NVMe ottimizzati, specifica NVME. Specifica SCSI per le altre immagini.

    Dopo aver creato una VM con dischi SSD locali, per poterla utilizzare devi prima formattare e montare ogni dispositivo.

  4. (Facoltativo) Per utilizzare la workstation virtuale (vWS) NVIDIA RTX, aggiungi il seguente campo.

    Quando crei un'istanza che utilizza la workstation virtuale NVIDIA RTX, Compute Engine aggiunge automaticamente una licenza vWS. Per informazioni sui prezzi delle workstation virtuali, consulta la pagina dei prezzi delle GPU.

    "guestAccelerators":
      [
        {
          "acceleratorCount": VWS_ACCELERATOR_COUNT,
          "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/nvidia-l4-vws"
        }
      ]
    

    Sostituisci VWS_ACCELERATOR_COUNT con il numero di GPU virtuali che vuoi.

  5. Invia la richiesta.

Spot

Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
  "machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
  "name": "INSTANCE_NAME",
  "disks": [
    {
      "boot": true,
      "initializeParams": {
        "diskSizeGb": "DISK_SIZE",
        "diskType": "DISK_TYPE",
        "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
      },
      "mode": "READ_WRITE",
      "type": "PERSISTENT"
    }
  ],
  "serviceAccounts": [
    {
      "email": "default",
      "scopes": [
        "https://www.googleapis.com/auth/cloud-platform"
      ]
    }
  ],
  "scheduling":
  {
    "provisioningModel": "SPOT",
    "instanceTerminationAction": "TERMINATION_ACTION",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": false
  }
}

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto del progetto in cui vuoi creare la VM.
    • ZONE: la zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per la VM. Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • INSTANCE_NAME: il nome della VM.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • DISK_TYPE: il tipo di disco di avvio. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati.
    • TERMINATION_ACTION: l'azione da intraprendere quando Compute Engine prerilascia l'istanza, ovvero STOP (impostazione predefinita) o DELETE.

  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente campo al corpo della richiesta:

      "resourcePolicies": [
        "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
      ]
    

    Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto della policy di posizionamento compatto.
    • REGION: la regione della policy di posizionamento compatto.
    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. (Facoltativo) Per utilizzare i dischi SSD locali, aggiungi il seguente campo al campo disks[] per ogni disco SSD locale. Separa ogni sottocampo disks[] (incluso il disco di avvio) con una virgola.

    Assicurati che il numero di dischi SSD locali che colleghi sia consentito per il tuo tipo di macchina. Per i dettagli, consulta Informazioni sui dischi SSD locali nella documentazione di Compute Engine.

        {
           "type": "SCRATCH",
           "initializeParams": {
              "diskType": "zones/ZONE/diskTypes/local-ssd"
           },
           "autoDelete": true,
           "interface": "INTERFACE_TYPE"
        }
    

    Sostituisci quanto segue:

    • ZONE: la zona specificata.
    • INTERFACE_TYPE: il tipo di interfaccia del disco che vuoi utilizzare per il disco SSD locale. Se l'immagine del disco di avvio ha driver NVMe ottimizzati, specifica NVME. Specifica SCSI per le altre immagini.

    Dopo aver creato una VM con dischi SSD locali, per poterla utilizzare devi prima formattare e montare ogni dispositivo.

  4. (Facoltativo) Per utilizzare la workstation virtuale (vWS) NVIDIA RTX, aggiungi il seguente campo.

    Quando crei un'istanza che utilizza la workstation virtuale NVIDIA RTX, Compute Engine aggiunge automaticamente una licenza vWS. Per informazioni sui prezzi delle workstation virtuali, consulta la pagina dei prezzi delle GPU.

    "guestAccelerators":
      [
        {
          "acceleratorCount": VWS_ACCELERATOR_COUNT,
          "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/nvidia-l4-vws"
        }
      ]
    

    Sostituisci VWS_ACCELERATOR_COUNT con il numero di GPU virtuali che vuoi.

  5. Invia la richiesta.

Installa i driver della GPU

Dopo aver creato un'istanza, questa non può utilizzare le GPU a meno che non siano già installati i driver GPU corretti. Il driver che devi installare dipende dal fatto che l'istanza abbia attivato NVIDIA RTX Virtual Workstation (vWS). Utilizza una delle seguenti opzioni:

Passaggi successivi