Ottimizzare il provisioning di Compute

La configurazione dei carichi di lavoro in modo che si basino su un singolo tipo di macchina o zona può limitare la tua capacità di accedere alle risorse disponibili durante i picchi di domanda. Per ottimizzare il provisioning di Compute e contribuire a mantenere in esecuzione i tuoi workload durante i picchi di domanda, devi progettare un'infrastruttura Compute Engine flessibile. La flessibilità dell'infrastruttura ti consente di specificare più zone, tipi di macchine o orari di inizio anziché una configurazione fissa. Compute Engine seleziona automaticamente le opzioni preferite, aiutandoti a massimizzare la disponibilità delle risorse, migliorare il rapporto prezzo/prestazioni e adottare in sicurezza l'hardware più recente.

Questo documento spiega le dimensioni della flessibilità dell'infrastruttura, i suoi vantaggi e come scegliere l'approccio giusto per il tuo workload. Descrive inoltre le funzionalità, le considerazioni di progettazione e i passaggi per l'adozione di Compute Engine pertinenti. Questo documento è rivolto a solution architect, operatori dell'infrastruttura e cloud engineer che progettano o gestiscono l'infrastruttura di calcolo.

Flessibilità dell'infrastruttura

Puoi progettare la flessibilità dell'infrastruttura in base alle seguenti tre dimensioni:

  • Flessibilità della località (dove): distribuisci le istanze Compute Engine in più zone di una regione per massimizzare l'accesso alle risorse disponibili o seleziona automaticamente una singola zona con capacità disponibile per i carichi di lavoro sensibili alla latenza.

  • Flessibilità del tipo di macchina (cosa): specifica un elenco classificato di tipi di macchine compatibili, consentendo al tuo workload di utilizzare alternative quando necessario.

  • Flessibilità temporale (quando): metti in coda le richieste per le risorse ad alta domanda, come gli acceleratori, anziché richiedere il provisioning immediato per i workload che non devono essere avviati immediatamente.

Vantaggi di un'infrastruttura flessibile

L'adozione di un'infrastruttura Compute Engine flessibile offre i seguenti vantaggi:

  • Automatizza la gestione della capacità durante i picchi di domanda. I tuoi workload trovano e utilizzano automaticamente le risorse in più tipi di macchine e zone. Questo approccio contribuisce a garantire che le richieste di scalabilità vadano a buon fine, anche se l'hardware preferito non è temporaneamente disponibile.

  • Semplifica la gestione della capacità. Puoi ridurre l'overhead operativo della ricerca manuale dell'hardware disponibile. Compute Engine reindirizza automaticamente le richieste in base alle preferenze di fallback, riducendo i colli di bottiglia operativi.

  • Mitiga i rischi di capacità durante la transizione all'hardware più recente. Puoi configurare le implementazioni in modo da dare la priorità alle generazioni di hardware più recenti e conservare le generazioni precedenti come fallback. Questa impostazione rende meno rischioso adottare le macchine più recenti e richieste perché, se le ultime non sono disponibili, il deployment può comunque richiedere automaticamente capacità per macchine meno recenti.

  • Ottimizza i costi per il traffico di base e di picco. Puoi prenotare la capacità solo per il traffico di base noto e utilizzare i fallback del tipo di macchina per gestire picchi imprevedibili. Questo approccio riduce le spese per la capacità di backup inattiva. Puoi anche mantenere la copertura degli sconti per serie di macchine e regioni utilizzando gli sconti per impegno di utilizzo (CUD) flessibili per il calcolo, che impediscono i prezzi on demand quando il tuo workload cambia serie di macchine o regioni.

Confronto tra le dimensioni di flessibilità

Puoi combinare la flessibilità della località con la flessibilità del tipo di macchina o dell'ora. Tuttavia, la flessibilità del tipo di macchina e la flessibilità temporale sono incompatibili in un singolo deployment. Devi scegliere tra le opzioni di fallback hardware o attendere in una coda che le risorse diventino disponibili.

Per aiutarti a valutare queste opzioni, la seguente tabella mette a confronto il funzionamento di ciascuna dimensione di flessibilità. Per indicazioni su quale approccio è più adatto al tuo caso d'uso specifico, consulta Idoneità e consigli per i workload.

Flessibilità della sede (dove) Flessibilità del tipo di macchina (cosa) Flessibilità oraria (quando)
Come migliora la disponibilità Massimizza l'accesso alle risorse disponibili in più zone di una regione. Riduce le probabilità di riscontrare errori di risorse non disponibili eseguendo il failover su tipi di macchine alternativi e compatibili. Ottiene risorse ad alta richiesta inserendo le richieste in una coda in attesa che la capacità diventi disponibile.
Tempistiche del provisioning Immediata Immediata In coda
Metodo di provisioning Esegue il provisioning delle istanze di computing in base alla disponibilità nelle zone selezionate. Esegue il provisioning delle istanze di calcolo in base alla disponibilità nei tipi di macchine selezionati. Esegue il provisioning delle istanze di calcolo quando tutta la capacità richiesta è disponibile.
Supporto dei tipi di macchine Supporta uno o più tipi di macchina in più zone. Utilizza più tipi di macchine. Supporta un solo tipo di macchina.

Idoneità e consigli per il workload

L'adozione della flessibilità dell'infrastruttura dipende dall'architettura e dai requisiti di rendimento del tuo workload. Per aiutarti a scegliere l'approccio migliore, la tabella seguente riepiloga le dimensioni e le configurazioni di flessibilità consigliate per alcuni tipi di workload comuni.

Tipo di workload Suggerimento sulla flessibilità
Elaborazione batch stateless, computing ad alto throughput (HTC) disaccoppiato

Flessibilità di località e tipo di macchina: utilizza la policy di flessibilità delle istanze con una delle seguenti opzioni:

  • Un gruppo di istanze gestite (MIG) regionale con forma di distribuzione ANY
  • Una creazione collettiva di istanze di computing a livello di regione configurata con un conteggio minimo per consentire l'evasione parziale e con una forma di distribuzione ANY

Questi approcci consentono ai tuoi workload di scalare in diverse zone e tipi di macchine per massimizzare la disponibilità delle risorse.

Addestramento, ottimizzazione e job batch su larga scala AI/ML Flessibilità temporale: utilizza modelli di provisioning che utilizzano Dynamic Workload Scheduler (DWS). Questo approccio migliora l'accesso alle risorse ad alta richiesta, come gli acceleratori, inserendo le richieste in una coda anziché richiedere il provisioning immediato e on demand.
Microservizi e frontend web Flessibilità di località e tipo di macchina: utilizza i MIG regionali con la forma di distribuzione target BALANCED e una policy di flessibilità delle istanze. Seleziona tipi di macchine con conteggi di vCPU e memoria corrispondenti per uno scalabilità automatica prevedibile. Inoltre, abilita l'aggiornamento durante la riparazione in modo che qualsiasi istanza di computing ricreata utilizzi la configurazione di flessibilità dell'istanza più recente.
Database ad alta affidabilità

Flessibilità della località e del tipo di macchina: utilizza i MIG regionali con la forma di distribuzione target BALANCED per distribuire le repliche su più zone per garantire l'alta disponibilità. Evita variazioni di prestazioni tra le repliche scegliendo tipi di macchine con profili di prestazioni molto simili.

Sistemi con latenza strettamente limitata Flessibilità della località: utilizza i MIG a livello di regione con la forma di distribuzione ANY_SINGLE_ZONE. Questa forma offre flessibilità di posizione eseguendo ricerche in tutte le zone della regione per trovare capacità sufficiente, garantendo al contempo che tutte le istanze vengano inserite nella stessa zona per mantenere una bassa latenza.

Le configurazioni flessibili possono introdurre variazioni hardware che possono influire sulle prestazioni dell'applicazione. Quando progetti per la flessibilità, valuta i compromessi tra la massimizzazione della disponibilità delle risorse e il mantenimento di prestazioni coerenti. Per indicazioni, consulta la sezione seguente su Valutare e adottare un'infrastruttura flessibile.

Funzionalità principali di flessibilità in Compute Engine

Per automatizzare la gestione della capacità, puoi implementare la flessibilità in diversi livelli della tua infrastruttura. Compute Engine offre funzionalità che consentono flessibilità in termini di località, tipo di macchina e ora. Puoi configurare queste funzionalità in modo indipendente o combinarle in base ai requisiti del tuo workload.

Funzionalità di flessibilità della sede

Le funzionalità di flessibilità della località massimizzano la disponibilità delle risorse distribuendo le istanze di computing in più zone di una regione. Per massimizzare questo vantaggio, seleziona le regioni in cui i tipi di macchine preferiti sono disponibili in tutte le zone.

Puoi applicare la flessibilità della sede ai seguenti tipi di deployment:

  • MIG:i MIG regionali valutano la capacità in tempo reale durante la creazione e la manutenzione delle istanze per eseguire il provisioning delle istanze di calcolo in cui sono disponibili risorse. Se una zona non ha capacità durante la riparazione di un'istanza, i MIG che utilizzano le forme ANY o BALANCED possono ricreare automaticamente l'istanza di computing non riuscita in un'altra zona. Per ottenere risultati ottimali, configura la forma di distribuzione target in base all'obiettivo del tuo workload:

    • ANY: consigliato per la massima disponibilità. Utilizza questa forma per massimizzare la disponibilità delle risorse. Questa forma alloca le istanze di computing a qualsiasi zona con capacità disponibile e dà la priorità alle prenotazioni inutilizzate.

    • BALANCED: consigliato per l'alta affidabilità. Utilizza questa forma per i workload ad alta disponibilità. Distribuisce le istanze di computing in modo uniforme tra le zone per proteggere dalle interruzioni zonali, dando comunque la priorità alle zone in cui sono disponibili le risorse.

    • ANY_SINGLE_ZONE: consigliato per una bassa latenza. Utilizza questa forma per limiti di latenza rigorosi. Alloca tutte le istanze di calcolo in un MIG in una singola zona con il maggior numero di risorse disponibili.

    Per saperne di più, consulta Informazioni sui MIG a livello di regione.

  • Gruppi di istanze non gestite: questi gruppi non supportano in modo nativo la flessibilità della località. Crea invece istanze di computing in blocco utilizzando l'API regionInstances.bulkInsert, che può eseguire il provisioning di un massimo di 5000 istanze di computing autonome, con la forma di distribuzione target ANY_SINGLE_ZONE. Questa richiesta crea istanze di calcolo in una singola zona e puoi aggiungerle al tuo gruppo non gestito. Tieni presente che per le istanze di computing autonome, Compute Engine valuta la capacità per selezionare la zona solo durante la richiesta di creazione dell'istanza di computing.

    Per ulteriori informazioni, vedi Raggruppa le VM non gestite.

  • Istanze di calcolo autonome:utilizza la richiesta di creazione di istanze collettive regionali (API regionInstances.bulkInsert) con una forma di distribuzione target (ANY, BALANCED o ANY_SINGLE_ZONE) e imposta un conteggio minimo. Il conteggio minimo consente alla tua richiesta di eseguire il provisioning del maggior numero possibile di istanze di calcolo anziché non riuscire completamente se la capacità completa non è immediatamente disponibile. Per le istanze di calcolo autonome, Compute Engine valuta la capacità per selezionare la zona solo durante la richiesta di creazione dell'istanza.

    Per saperne di più, consulta Informazioni sulla creazione in blocco delle VM.

Funzionalità di flessibilità del tipo di macchina

Le funzionalità di flessibilità del tipo di macchina consentono al deployment di utilizzare un elenco prioritario di tipi di macchine alternativi. Se la tua scelta principale non è disponibile, Compute Engine esegue automaticamente il failover sui tipi di macchine secondari. Configuri questa funzionalità definendo un criterio di flessibilità dell'istanza, che consiste in un elenco singolo o classificato di più selezioni di istanze.

Puoi applicare una policy di flessibilità dell'istanza ai seguenti tipi di deployment:

  • Gruppi di istanze gestite:collega una policy di flessibilità delle istanze a un gruppo di istanze gestite per consentire al gruppo di eseguire automaticamente il failback all'hardware alternativo durante i picchi di domanda. Se il tuo MIG utilizza VM spot, questa policy assegna automaticamente la priorità ai tipi di macchine di fallback che offrono tempi di attività stimati più lunghi e un rischio inferiore di prerilascio. Per saperne di più, consulta Informazioni sulla flessibilità delle istanze nei MIG.

  • Gruppi di istanze non gestite:poiché questi gruppi non supportano in modo nativo i criteri di flessibilità delle istanze, puoi eseguire il provisioning delle istanze utilizzando l'API regionInstances.bulkInsert e poi aggiungerle al gruppo. Nella richiesta API, includi un criterio di flessibilità delle istanze e specifica una singola zona (locationPolicy.zones.zone) o utilizza la forma di distribuzione target ANY_SINGLE_ZONE. L'utilizzo della forma ANY_SINGLE_ZONE offre l'ulteriore vantaggio della flessibilità della posizione selezionando automaticamente la zona con il maggior numero di risorse disponibili. Tieni presente che per le istanze autonome, Compute Engine applica il criterio di flessibilità solo durante la richiesta di creazione dell'istanza.

    Per saperne di più sulla creazione di istanze di calcolo in blocco, consulta Crea VM in blocco con flessibilità delle istanze e per aggiungerle a un gruppo, consulta Raggruppa le VM non gestite.

  • Istanze di calcolo autonome:per i workload che non richiedono gruppi di istanze, come i job di elaborazione batch indipendenti, puoi utilizzare l'API regionInstances.bulkInsert con un criterio di flessibilità delle istanze per eseguire il provisioning delle istanze di calcolo. Tieni presente che per le istanze autonome, Compute Engine applica il criterio di flessibilità solo durante la richiesta di creazione dell'istanza.

    Per saperne di più, consulta Informazioni sulla flessibilità delle istanze per le VM create in blocco.

Scalabilità senza problemi su diversi tipi di macchine

Quando configuri la flessibilità del tipo di macchina, i tipi di macchina di riserva potrebbero avere architetture hardware o specifiche del disco diverse. Se queste specifiche non sono compatibili per i tipi di macchine in una selezione di istanze, il provisioning potrebbe non riuscire.

Per utilizzare tipi di macchine con specifiche incompatibili, devi definire gli override delle proprietà nella policy di flessibilità delle istanze. Questi override assicurano che quando Compute Engine esegue il failover su un tipo di macchina alternativo, applichi automaticamente l'immagine di avvio, il tipo di disco o la baseline del processore corretti richiesti per quell'hardware specifico. Questa funzionalità consente al deployment di scalare su diversi tipi di macchine senza problemi, con maggiori probabilità di provisioning riuscito.

Per saperne di più, consulta Come funzionano gli override della piattaforma disco e CPU.

Funzionalità di flessibilità oraria

Le funzionalità di flessibilità temporale consentono ai tuoi carichi di lavoro che non devono essere avviati immediatamente di attendere risorse ad alta richiesta, come gli acceleratori, anziché richiedere il provisioning immediato.

Per implementare la flessibilità temporale, a seconda dei requisiti del workload, utilizza le seguenti funzionalità che utilizzano DWS:

Valutare e adottare un'infrastruttura flessibile

Prima di configurare la flessibilità di località o tipo di macchina, devi verificare che la località e i tipi di macchina che scegli siano compatibili tra loro e con i requisiti del tuo workload. Per aiutarti a progettare e implementare correttamente la tua infrastruttura flessibile, le sezioni seguenti forniscono considerazioni chiave per la valutazione e una strategia di adozione incrementale.

Considerazioni sulla valutazione

Di seguito sono riportate alcune considerazioni chiave per valutare un'infrastruttura flessibile:

  • Flessibilità della località:la distribuzione del workload su più zone potrebbe influire sulla latenza di rete e aumentare i costi di trasferimento dei dati tra zone.

    Per saperne di più, consulta i seguenti documenti:

  • Flessibilità del tipo di macchina: il fallback a tipi di macchine alternativi può introdurre variazioni nelle prestazioni e nei costi dell'applicazione. La flessibilità del tipo di macchina tra le generazioni spesso richiede di implementare override della piattaforma CPU e del disco. Devi verificare che i tipi di macchina che vuoi utilizzare soddisfino i prerequisiti tecnici della tua applicazione.

    Per saperne di più, consulta i seguenti documenti:

Strategia di adozione

A seconda che tu stia progettando un nuovo deployment o eseguendo la migrazione di uno esistente, scegli la strategia corrispondente come segue:

  • Per un nuovo carico di lavoro:se stai progettando un nuovo deployment, ti consigliamo di adottare la flessibilità nella progettazione dell'infrastruttura. Per identificare le dimensioni di flessibilità consigliate per il tuo tipo di workload, segui le indicazioni riportate in Idoneità e consigli per i workload. Poi, scegli il tipo di deployment che supporta meglio il tuo workload. Per saperne di più sui tipi di deployment e sulle relative configurazioni di flessibilità, consulta la sezione Funzionalità di flessibilità principali.

  • Per un deployment esistente:se vuoi eseguire la migrazione di un deployment che utilizza un singolo tipo di zona o tipo di macchina a un'infrastruttura flessibile, ti consigliamo di adottare la flessibilità in modo incrementale per ridurre al minimo il rischio. Puoi utilizzare una strategia di adozione incrementale come la seguente:

    1. Aggiungi flessibilità della posizione. Esegui la migrazione dei workload a livello di zona a un MIG a livello di regione con la forma di distribuzione BALANCED o ANY. Se utilizzi un MIG a livello di regione con la forma EVEN, modificala in BALANCED. Questa modifica è importante per i gruppi di istanze gestite che vengono scalati orizzontalmente. Un vincolo di capacità temporaneo in una zona non bloccherà l'operazione di scalabilità orizzontale. In alternativa, se vuoi creare istanze di calcolo autonome, utilizza l'API regionInstances.bulkInsert.

    2. Aggiungi tipi di macchina alternativi che condividono la stessa architettura. Collega una policy di flessibilità dell'istanza che specifica i tipi di macchina che condividono la stessa architettura della CPU e lo stesso supporto del disco, ad esempio n2-standard-8 e n2d-standard-8.

    3. Aggiungi tipi di macchine alternativi di generazioni diverse e allinea gli sconti per utilizzo continuo. Incorpora le ultime generazioni di macchine, come n4-standard-8, e utilizza gli override del disco in base alle necessità. Inoltre, copri gli sconti per l'utilizzo di fallback con gli sconti per impegno di utilizzo (CUD) flessibili di Compute.

Per garantire un'adozione sicura e riuscita sia per le nuove implementazioni sia per le migrazioni incrementali, ti consigliamo il seguente flusso di lavoro di implementazione:

  • Convalida e benchmark. Testa la tua applicazione in tutte le famiglie di macchine, le combinazioni di dischi e le zone selezionate in un ambiente non di produzione.

  • Metti in produzione e scala. Implementa gradualmente le norme di flessibilità delle istanze o le forme di distribuzione dei MIG a livello di regione in un sottoinsieme del parco risorse di produzione prima di eseguire lo scale up a livello globale.

  • Monitora e ottimizza. Monitora costantemente i tassi di fallback, le metriche di rendimento e i costi per perfezionare l'elenco prioritario dei tipi di macchine. Quando utilizzi i MIG, per monitorare la distribuzione delle istanze di computing in tempo reale tra tipi di macchina e zone, utilizza il dashboard di monitoraggio della distribuzione delle istanze MIG. Per istruzioni, vedi Monitorare la distribuzione delle istanze nei MIG.

Best practice

Per massimizzare l'efficienza e la resilienza della tua infrastruttura flessibile, utilizza le best practice descritte nelle sezioni seguenti.

Best practice per la flessibilità della sede

  • Utilizza il posizionamento regionale in base alla capacità. Esegui il deployment dei carichi di lavoro utilizzando i MIG regionali o la creazione di VM in blocco a livello di regione. Seleziona la forma di distribuzione BALANCED o ANY, in quanto queste forme consentono a Compute Engine di valutare la capacità in tempo reale in tutte le zone della regione per posizionare automaticamente le istanze di computing dove sono disponibili le risorse.

  • Scegli regioni che supportano il tipo di macchina in più zone:esegui il deployment dei carichi di lavoro nelle regioni in cui i tipi di macchina selezionati sono supportati in tutte le zone. Questo approccio garantisce che le funzionalità di flessibilità della località abbiano il numero massimo di zone alternative per indirizzare le richieste durante una limitazione temporanea della capacità. Per un elenco delle regioni e delle zone, consulta Regioni e zone disponibili.

  • Controlla la disponibilità per i deployment di VM spot. Se il tuo deployment utilizza VM spot, controlla la disponibilità in tempo reale e l'uptime previsto delle VM spot in più tipi di macchine e località. Scegli una regione o una zona con una capacità disponibile elevata e un uptime adatto al tuo workload per ridurre il rischio di preempt. Per ulteriori informazioni, consulta Visualizzare la disponibilità delle VM spot (anteprima).

Best practice per la flessibilità del tipo di macchina

  • Diversifica tra le famiglie di macchine. Evita criteri che variano solo in base ai core della CPU all'interno di una singola famiglia, ad esempio n2-standard-4 e n2-standard-8. I vincoli di capacità localizzati possono influire contemporaneamente sull'intera famiglia di macchine. Per migliorare la disponibilità, utilizza più generazioni e architetture di macchine, ad esempio n4-standard-8 e n2-standard-8.

  • Adotta nuovi tipi di macchine con quelli precedenti come fallback. Incorpora le famiglie di macchine più recenti nella tua policy di flessibilità delle istanze insieme a quelle meno recenti per massimizzare la disponibilità.

  • Configura gli override della piattaforma del disco e della CPU. La combinazione di tipi di macchine di generazioni diverse può comportare differenze nelle piattaforme di dischi e CPU. Definisci gli override della piattaforma per disco e CPU nella tua policy di flessibilità per garantire che l'infrastruttura venga scalata senza problemi tra le generazioni di macchine. Ad esempio, configura Hyperdisk bilanciato per le istanze N4 e Persistent Disk per i fallback N2.

  • Dai la priorità ai tipi di macchine più piccoli. A seconda dell'idoneità del workload, utilizza tipi di macchine con meno vCPU e memoria. Ad esempio, anziché fare affidamento su un singolo tipo di macchina come n2-standard-64, valuta se il tuo workload può essere scalato su quattro istanze di computing che utilizzano ciascuna un tipo di macchina n2-standard-16. I tipi di macchina più piccoli in genere hanno una maggiore disponibilità di risorse.

  • Seleziona tipi di macchine con prestazioni simili. Specifica tipi di macchine alternativi con dimensioni simili di vCPU e memoria. Ad esempio, combina n2d-standard-8, n4-standard-8 e n4a-standard-8 nella policy di flessibilità dell'istanza. Questo approccio mantiene prestazioni dell'applicazione coerenti migliorando la disponibilità delle risorse.

  • Attiva l'aggiornamento durante la riparazione nei MIG. Per impostazione predefinita, un MIG ripara un'istanza di computing non riuscita utilizzando il tipo di macchina originale, il che può non riuscire se l'hardware non è temporaneamente disponibile. Attiva l'aggiornamento durante la riparazione in modo che le riparazioni tornino automaticamente ai tipi di macchina disponibili nella tua norma di flessibilità. Per i dettagli, vedi Flessibilità delle istanze e riparazioni delle VM.

  • Incorpora VM spot con fallback. Per i workload a tolleranza di errore, combina le VM spot con la flessibilità di località e tipo di macchina. Se Compute Engine prerilascia una VM spot, queste funzionalità di flessibilità consentono al deployment di cercare automaticamente tipi di macchine o zone alternativi. Questa strategia contribuisce a mantenere la disponibilità delle risorse per il tuo workload a un costo inferiore rispetto al provisioning standard.

Best practice per la flessibilità oraria

  • Seleziona i carichi di lavoro giusti. Implementa la flessibilità temporale per i workload che hanno orari di inizio flessibili, ma richiedono risorse ad alta richiesta come gli acceleratori. Questo requisito include il pre-addestramento di modelli di piccole dimensioni, il perfezionamento dei modelli, le simulazioni di High Performance Computing (HPC) e l'inferenza batch.

  • Seleziona la funzionalità appropriata per la tua cronologia. Utilizza il modello di provisioning con avvio flessibile per mettere in coda le richieste per i job di durata definita in esecuzione fino a sette giorni. Per ottenere risorse ad alta richiesta per un massimo di 90 giorni o più, utilizza il modello di provisioning vincolato alla prenotazione.

  • Ottimizza i tempi di attesa delle VM con avvio flessibile. Quando tenti di creare VM Flex-start, specifica un tempo di attesa più lungo se il tuo carico di lavoro deve essere eseguito in una zona specifica. Tempi di attesa più lunghi aumentano le probabilità che Compute Engine possa eseguire il provisioning delle risorse richieste. Se vuoi creare VM con avvio flessibile autonome e il tuo workload può essere avviato in qualsiasi zona di una regione, specifica un tempo di attesa di zero secondi. Se la richiesta di creazione non va a buon fine perché le risorse non sono disponibili, tenta immediatamente la richiesta di creazione in una zona diversa.

Allineare le prenotazioni e gli sconti alla flessibilità del workload

Per bilanciare la disponibilità e i costi delle risorse, abbina gli sconti per impegno di utilizzo (CUD) alla strategia di capacità scelta per il tuo workload:

  • Utilizzo costante su più tipi di macchine:se il tuo workload supporta più tipi di macchine e ha un utilizzo costante, configura la flessibilità del tipo di macchina e utilizza i CUD flessibili per il calcolo. La flessibilità del tipo di macchina migliora i tassi di successo del provisioning utilizzando hardware alternativo quando la tua scelta principale non ha capacità. I CUD flessibili di Compute sono sconti basati sulla spesa che si applicano alla spesa di calcolo idonea, indipendentemente dalla serie di macchine specifica di cui Compute Engine esegue il provisioning.

  • Base di riferimento stabile con picchi di traffico:se il tuo workload ha una base di riferimento prevedibile, ma può subire picchi imprevedibili, proteggi la base di riferimento prevedibile con prenotazioni e CUD basati sulle risorse. Per gestire i picchi di traffico, configura la flessibilità del tipo di macchina e utilizza i CUD flessibili di Compute per coprire le macchine di fallback alternative. Nella policy di flessibilità dell'istanza, assegna le preferenze nel seguente modo:

    • Preferenza più alta: tipi di macchina riservati con CUD basati sulle risorse

    • Preferenze inferiori:tipi di macchine alternativi e utilizzo di CUD flessibili per il calcolo

    Compute Engine utilizza prima gli impegni basati sulle risorse e poi gli impegni di calcolo flessibili per coprire l'utilizzo idoneo rimanente.

  • Workload hardware strettamente fissi:se il tuo workload si basa su un singolo tipo di macchina, utilizza le prenotazioni e i CUD basati sulle risorse. Le prenotazioni forniscono un'elevata garanzia di capacità per hardware specifici e devono essere prese in considerazione per i workload business critical. I CUD basati sulle risorse forniscono sconti per questo utilizzo prevedibile e in stato stazionario.

Per saperne di più, vedi Scegliere un tipo di prenotazione, e Sconti per impegno di utilizzo (CUD) per Compute Engine.

Considerazioni sulla progettazione per le prenotazioni

Se la tua strategia include prenotazioni, esamina le seguenti considerazioni di progettazione:

  • Dai la priorità ai tipi di macchine riservate. Se utilizzi le prenotazioni con flessibilità del tipo di macchina, aggiungi i tipi di macchine prenotate alla preferenza più alta nella policy di flessibilità delle istanze. Questa configurazione aiuta Compute Engine a dare la priorità alle tue prenotazioni rispetto alla capacità on demand.

  • Valuta l'ambito delle tue prenotazioni. Evita di creare prenotazioni in risposta a vincoli di capacità temporanei. Se il tuo workload utilizza la flessibilità della località, ad esempio i MIG a livello di regione, Compute Engine potrebbe distribuire le istanze in altre zone della regione. Una prenotazione di zona rigorosa in questo scenario può comportare risorse inutilizzate e inattive.

Limitazioni

Quando progetti un'infrastruttura flessibile, si applicano le seguenti limitazioni generali. Per limitazioni più dettagliate, consulta le sezioni Limitazioni nelle pagine delle rispettive funzionalità.

  • Incompatibilità delle funzionalità: non puoi combinare la flessibilità del tipo di macchina e la flessibilità temporale in un unico deployment. Le funzionalità che consentono la flessibilità temporale supportano una sola configurazione del tipo di macchina per richiesta.

  • Flessibilità durante la creazione iniziale: per le istanze di computing create in blocco, la valutazione della capacità e la policy di flessibilità delle istanze si applicano solo durante la richiesta iniziale di creazione dell'istanza di computing. Le istanze di computing create in blocco non vengono reindirizzate automaticamente a zone o tipi di macchine alternativi durante le riparazioni o quando ridimensioni l'infrastruttura.

  • Deployment in una singola zona: i MIG a livello di zona non supportano le funzionalità di flessibilità e non sono consigliati. Per adottare la flessibilità del tipo di macchina per una progettazione a zona singola, crea un MIG regionale e seleziona esplicitamente una sola zona.

Passaggi successivi