Google utilizza la tecnologia AI per tradurre i contenuti nella tua lingua preferita. Le traduzioni generate dall'AI potrebbero contenere errori.
Terminologia
Mantieni tutto organizzato con le raccolte
Salva e classifica i contenuti in base alle tue preferenze.
I seguenti termini si applicano ad AI Hypercomputer.
Acceleratorlink
Un dispositivo hardware specializzato, come una GPU o una TPU, progettato per eseguire attività specifiche, come i carichi di lavoro di machine learning, in modo più efficiente rispetto a un processore per uso generico.
Blocklink
Una raccolta di sottoblocchi interconnessi da una rete non bloccante ad alta velocità che fornisce una larghezza di banda elevata per tutte le macchine host nel blocco.
Clusterlink Una raccolta di blocchi interconnessi da una struttura di rete ad alta velocità. Ogni cluster è univoco a livello globale.
Per le macchine A4X, A4, A3 Ultra, A3 Mega e A3 High (8 GPU), un cluster fornisce una struttura di rete comune e non bloccante per i blocchi di capacità dell'acceleratore. All'interno di un cluster, la comunicazione tra i nodi (traffico est-ovest) non è bloccante per l'intera raccolta di blocchi.
Clustered GPUlink Una categoria di famiglie di macchine per GPU, tra cui A4X, A4, A3 Ultra, A3 Mega e A3 High (8 GPU). Le GPU in cluster consentono ai team di eseguire il deployment e scalare migliaia di acceleratori interconnessi come un unico sistema strettamente accoppiato utilizzando strutture di rete specializzate e manutenzione sincronizzata.
Sono ideali per i carichi di lavoro che richiedono sincronizzazione di calcolo, memoria e rete ad alta velocità estreme. I casi d'uso comuni includono il pre-addestramento di modelli di base con trilioni di parametri, il serving di modelli di frontiera e le simulazioni per la scoperta di farmaci.
Emergent maintenancelink
A volte indicato come manutenzione di emergenza. Un evento di manutenzione non pianificato causato da un problema critico di hardware, software o sicurezza.
Per i tipi di macchine con acceleratore supportati, la manutenzione di emergenza fornisce una notifica anticipata anziché un'interruzione immediata. Questa notifica ti dà il tempo di svuotare con garbo i carichi di lavoro e, facoltativamente, di attivare la riparazione prima che il sistema termini le VM.
General GPUlink Una categoria di famiglie di macchine con GPU, tra cui G2, G4, A2, N1+T4 e A3 Edge.
Le GPU di uso generale consentono ai team di eseguire il deployment e scalare gli acceleratori NVIDIA con completa autonomia operativa, bypassando la complessità architetturale dei cluster di supercomputer coordinati. Sono ideali per i carichi di lavoro che danno la priorità ad alta affidabilità, provisioning self-service e scalabilità indipendente. I casi d'uso comuni includono l'inferenza in tempo reale, RAG, la prototipazione e l'addestramento di modelli di piccole e medie dimensioni.
Network fabriclink Infrastruttura di rete ad alta velocità
che fornisce larghezza di banda elevata e bassa latenza in tutti i blocchi
e i Google Cloud servizi di un cluster. La struttura utilizza l'architettura della
Jupiter. Per ottimizzare le prestazioni, la struttura utilizza la rete definita dal software e gli switch ottici.
Node or hostlink
Una singola macchina server fisica nel data center. Ogni host ha risorse di calcolo associate, come gli acceleratori. Il numero e la configurazione di queste risorse di calcolo dipendono dalla famiglia di macchine.
Le istanze di Compute Engine vengono sottoposte a provisioning su un host fisico.
NVLink domainlink
Un dominio NVLink, chiamato anche sottoblocco, è l'unità di capacità principale per le macchine A4X Max e A4X. Un dominio NVLink è costituito da 18 istanze A4X Max o A4X (72 GPU) collegate da un sistema NVLink multi-nodo.
Sub-blocklink
Un gruppo di host e hardware di connettività associato che si trovano su un singolo blocco fisico. Nel contesto delle macchine A4X Max e A4X, un sottoblocco è chiamato anche dominio NVLink.
Superblocklink
Un raggruppamento fisico di macchine interconnesse all'interno dei data center. Inserendo le macchine all'interno di un superblocco, ottieni la velocità effettiva di rete estrema e la latenza inferiore al millisecondo necessarie per eseguire carichi di lavoro di addestramento strettamente accoppiati.
I seguenti documenti forniscono ulteriori spiegazioni delle terminologie pertinenti agli argomenti corrispondenti:
Salvo quando diversamente specificato, i contenuti di questa pagina sono concessi in base alla licenza Creative Commons Attribution 4.0, mentre gli esempi di codice sono concessi in base alla licenza Apache 2.0. Per ulteriori dettagli, consulta le norme del sito di Google Developers. Java è un marchio registrato di Oracle e/o delle sue consociate.
Ultimo aggiornamento 2026-09-09 UTC.
[null,null,["Ultimo aggiornamento 2026-09-09 UTC."],[],[]]