Panoramica di Compute Reliability Insights

Compute Reliability Insights offre una suite di funzionalità per migliorare l'affidabilità dei workload Compute Engine. Questo strumento fornisce visibilità sui potenziali rischi, consentendo una gestione efficace dei rischi tramite soluzioni dettagliate e consigli proattivi.

Questa pagina fornisce informazioni concettuali su Compute Reliability Insights. Per ulteriori informazioni su come visualizzare e applicare i suggerimenti per l'affidabilità, consulta Visualizza e applica i suggerimenti per l'affidabilità.

Comprendere i rischi per l'affidabilità

Un rischio per l'affidabilità è una situazione in cui la configurazione errata delle funzionalità o delle impostazioni di Compute Engine potrebbe influire negativamente sulla stabilità e sulla disponibilità dell'infrastruttura. Questo può verificarsi nei seguenti modi:

  • Errori a cascata imprevisti: un'interruzione in una zona o regione dell' infrastruttura di Google potrebbe interrompere in modo imprevisto le risorse in altre zone o regioni.
  • Dipendenze esterne: le risorse potrebbero dipendere dalla disponibilità di regioni Compute Engine specifiche situate al di fuori della località della risorsa principale.

Tipi di rischio

Compute Reliability Insights identifica un sottoinsieme di potenziali rischi nei workload:

Gravità e priorità del rischio

Compute Reliability Insights assegna la priorità ai rischi utilizzando le seguenti definizioni di gravità e priorità.

Gravità Priorità Descrizione
Alta P1 Una configurazione o un'impostazione errata che, in caso di interruzione regionale, interrompe i servizi utilizzati di frequente in più regioni (ad esempio, la creazione di VM).
Media P2 Una configurazione o un'impostazione errata che, in caso di interruzione regionale, interrompe i servizi meno critici in più regioni (ad esempio, la creazione di template di istanza).

Telemetria e latenza

Compute Reliability Insights si basa sui dati di telemetria per identificare i rischi. Tieni presente il seguente comportamento quando utilizzi questa funzionalità:

  • Nuovi progetti e risorse inattive: per i progetti creati negli ultimi 7 giorni o per i progetti con VM inattive, i suggerimenti potrebbero non essere disponibili perché la pipeline richiede più dati di telemetria.
  • Ritardo nella mitigazione: dopo aver mitigato un rischio, la Google Cloud console e l' API potrebbero continuare a mostrare il suggerimento per un massimo di 24 ore. Questo perché la pipeline di importazione viene eseguita ogni 24 ore per cancellare i suggerimenti risolti.

Passaggi successivi