En este documento, se describen los pasos para crear instancias de máquina virtual (VM) independientes que usan tipos de máquinas optimizados para aceleradores A3 Edge. Para obtener más información sobre los tipos de máquinas, consulta A3 Edge.
Para obtener información sobre otras formas de crear VMs o clústeres, consulta la página de Descripción general.
Limitaciones
Cuando creas una VM de A3 Edge independiente, se aplican las siguientes limitaciones:
- No recibirás descuentos por uso continuo ni descuentos por compromiso de uso flexible para las instancias que usan un tipo de máquina A3 Edge.
- Solo puedes usar un tipo de máquina A3 Edge en ciertas regiones y zonas.
- No puedes usar Persistent Disks regionales en una instancia que use un tipo de máquina A3 Edge.
- El tipo de máquina A3 Edge solo está disponible en la plataforma de CPU Sapphire Rapids.
- No se admiten cambios de tipo de máquina para el tipo de máquina A3 Edge. Para cambiar a este tipo de máquina o dejar de usarlo, debes crear una instancia nueva.
- No puedes ejecutar sistemas operativos Windows en un tipo de máquina A3 Edge.
- Los tipos de máquinas A3 Edge no admiten usuarios únicos.
Antes de comenzar
Antes de crear VMs, si aún no lo hiciste, completa los siguientes pasos:
- Elige una opción de consumo: La opción de consumo que elijas determinará cómo obtendrás y usarás los recursos de GPU. Para obtener más información, consulta Elige una opción de consumo.
- Obtén capacidad: El proceso para obtener capacidad difiere para cada opción de consumo. Para obtener información sobre el proceso para obtener capacidad para la opción de consumo que elegiste, consulta Descripción general de la capacidad.
Selecciona la pestaña que corresponda a la forma en que planeas usar las muestras de esta página:
Console
Cuando usas la consola de Google Cloud para acceder a los servicios y las APIs de Google Cloud , no necesitas configurar la autenticación.
gcloud
Instala Google Cloud CLI y, luego, accede a gcloud CLI con tu identidad federada. Después de acceder, inicializa Google Cloud CLI con el siguiente comando:
gcloud initREST
Para usar las muestras de la API de REST incluidas en esta página en un entorno de desarrollo local, debes usar las credenciales que proporciones a la gcloud CLI.
Instala Google Cloud CLI y, luego, accede a gcloud CLI con tu identidad federada.
Para obtener más información, consulta Autentícate para usar REST en la documentación de autenticación de Google Cloud .
Roles obligatorios
Para obtener los permisos que necesitas para crear VMs,
pídele a tu administrador que te otorgue el rol de IAM
Administrador de instancias de Compute (v1) (roles/compute.instanceAdmin.v1) en el proyecto.
Para obtener más información sobre cómo otorgar roles, consulta Administra el acceso a proyectos, carpetas y organizaciones.
Este rol predefinido contiene los permisos necesarios para crear VM. Para ver los permisos exactos que son necesarios, expande la sección Permisos requeridos:
Permisos necesarios
Se requieren los siguientes permisos para crear VM:
-
compute.instances.createen el proyecto -
Si deseas usar una imagen personalizada para crear la VM, sigue estos pasos:
compute.images.useReadOnlyen la imagen -
Para usar una instantánea a fin de crear la VM, haz lo siguiente:
compute.snapshots.useReadOnlyen la instantánea -
Si quieres usar una plantilla de instancias para crear la VM, sigue estos pasos:
compute.instanceTemplates.useReadOnlyen la plantilla de instancias -
A fin de especificar una subred para tu VM:
compute.subnetworks.useen el proyecto o en la subred elegida -
Si deseas especificar una dirección IP estática para la VM:
compute.addresses.useen el proyecto -
Para asignar una dirección IP externa a la VM cuando se usa una red de VPC,
compute.subnetworks.useExternalIpen el proyecto o en la subred elegida. -
Para asignar una red heredada a la VM, ejecuta
compute.networks.useen el proyecto. -
Para asignar una dirección IP externa a la VM cuando se usa una red heredada, ejecuta
compute.networks.useExternalIpen el proyecto -
Para configurar los metadatos de la instancia de VM para la VM,
compute.instances.setMetadataen el proyecto. -
Para configurar etiquetas en la VM, haz lo siguiente:
compute.instances.setTagsen la VM -
Para configurar etiquetas en la VM, haz lo siguiente:
compute.instances.setLabelsen la VM -
A fin de configurar una cuenta de servicio para que la VM use:
compute.instances.setServiceAccounten la VM -
Crear un disco nuevo para la VM:
compute.disks.createen el proyecto -
Para conectar un disco existente en modo de solo lectura o de lectura y escritura, usa
compute.disks.useen el disco. -
Para conectar un disco existente en modo de solo lectura, haz lo siguiente:
compute.disks.useReadOnlyen el disco
También puedes obtener estos permisos con roles personalizados o con otros roles predefinidos.
Descripción general
La creación de una instancia con el tipo de máquina A3 Edge incluye los siguientes pasos:
- Crea redes de VPC
- Opcional: Crea una política de posición compacta
- Crea una instancia
- Instala controladores de GPU
- Opcional: Habilita el modo de GPU de varias instancias de NVIDIA
Crea redes de VPC
Para habilitar la comunicación eficiente de tus VMs con GPU, debes crear una red de administración y una o más redes de datos. La red de administración se usa para el acceso externo, por ejemplo, SSH, y para la mayoría de las comunicaciones de red generales. Las redes de datos se usan para la comunicación de alto rendimiento entre las GPUs en diferentes VMs, por ejemplo, para el tráfico de acceso directo remoto a la memoria (RDMA).
Para estas redes de VPC, recomendamos establecer la unidad de transmisión máxima (MTU) en un valor mayor. Los valores de MTU más altos aumentan el tamaño del paquete y reducen la sobrecarga del encabezado del paquete, lo que aumenta la capacidad de procesamiento de los datos de carga útil. Para obtener más información sobre cómo crear redes de VPC, consulta Crea y verifica una red MTU de marcos jumbo.
Crea una red de administración, subred y regla de firewall
Completa los siguientes pasos para configurar la red de administración:
Crea la red de administración con el comando
networks create:gcloud compute networks create NETWORK_NAME_PREFIX-mgmt-net \ --project=PROJECT_ID \ --subnet-mode=custom \ --mtu=8244Crea la subred de administración con el comando
networks subnets create:gcloud compute networks subnets create NETWORK_NAME_PREFIX-mgmt-sub \ --project=PROJECT_ID \ --network=NETWORK_NAME_PREFIX-mgmt-net \ --region=REGION \ --range=192.168.0.0/24Crea reglas de firewall con el comando
firewall-rules create.Crea una regla de firewall para la red de administración.
gcloud compute firewall-rules create NETWORK_NAME_PREFIX-mgmt-internal \ --project=PROJECT_ID \ --network=NETWORK_NAME_PREFIX-mgmt-net \ --action=ALLOW \ --rules=tcp:0-65535,udp:0-65535,icmp \ --source-ranges=192.168.0.0/16Crea la regla de firewall
tcp:22para limitar las direcciones IP de origen que pueden conectarse a la VM mediante SSH.gcloud compute firewall-rules create NETWORK_NAME_PREFIX-mgmt-external-ssh \ --project=PROJECT_ID \ --network=NETWORK_NAME_PREFIX-mgmt-net \ --action=ALLOW \ --rules=tcp:22 \ --source-ranges=SSH_SOURCE_IP_RANGECrea la regla de firewall
icmpque se puede usar para verificar si hay problemas de transmisión de datos en la red.gcloud compute firewall-rules create NETWORK_NAME_PREFIX-mgmt-external-ping \ --project=PROJECT_ID \ --network=NETWORK_NAME_PREFIX-mgmt-net \ --action=ALLOW \ --rules=icmp \ --source-ranges=0.0.0.0/0
Reemplaza lo siguiente:
NETWORK_NAME_PREFIX: Es el prefijo del nombre que se usará para las subredes y las redes de VPC.PROJECT_ID: El ID de tu proyectoREGION: Es la región en la que deseas crear las redes.SSH_SOURCE_IP_RANGE: el rango de IP en formato CIDR. Esto especifica qué direcciones IP de origen pueden conectarse a tu VM mediante SSH.
Crea redes de datos, subredes y reglas de firewall
A3 Edge requiere cuatro redes de datos. Usa el siguiente comando para crear cuatro redes de datos, cada una con subredes y reglas de firewall.
for N in $(seq 1 4); do
gcloud compute networks create NETWORK_NAME_PREFIX-data-net-$N \
--project=PROJECT_ID \
--subnet-mode=custom \
--mtu=8244
gcloud compute networks subnets create NETWORK_NAME_PREFIX-data-sub-$N \
--project=PROJECT_ID \
--network=NETWORK_NAME_PREFIX-data-net-$N \
--region=REGION \
--range=192.168.$N.0/24
gcloud compute firewall-rules create NETWORK_NAME_PREFIX-data-internal-$N \
--project=PROJECT_ID \
--network=NETWORK_NAME_PREFIX-data-net-$N \
--action=ALLOW \
--rules=tcp:0-65535,udp:0-65535,icmp \
--source-ranges=192.168.0.0/16
done
Opcional: Crea una política de posición compacta
Puedes especificar la posición de la VM creando una política de posición compacta. Cuando aplicas una política de posición compacta a tus VMs, Compute Engine hace su mejor esfuerzo para crear VMs que estén lo más cerca posible entre sí. Si tu aplicación es sensible a la latencia y requiere la máxima compactación, especifica el campo maxDistance (versión preliminar) cuando crees una política de posición compacta. Un valor de maxDistance más bajo garantiza una colocación más cercana de las VM, pero también aumenta la probabilidad de que no se creen algunas VMs.
gcloud
Para crear una política de posición compacta, usa el
comando gcloud beta compute resource-policies create group-placement:
gcloud beta compute resource-policies create group-placement POLICY_NAME \
--collocation=collocated \
--max-distance=MAX_DISTANCE \
--region=REGION
Reemplaza lo siguiente:
POLICY_NAME: el nombre de la política de posición compacta.MAX_DISTANCE: Es la configuración de distancia máxima para tus VMs, que se puede especificar (vista previa, recomendado) o no especificar (quita la marca--max-distance). Según lo que admita tu tipo de máquina, puedes especificar uno de los siguientes valores:- Para colocar las VMs en el mismo subbloque, haz lo siguiente:
1 - Para colocar las VMs en el mismo bloque, haz lo siguiente:
2 - Para colocar VMs en bloques adyacentes:
3
- Para colocar las VMs en el mismo subbloque, haz lo siguiente:
REGION: la región en la que deseas crear la política de posición compacta. Especifica la región que contiene la zona en la que planeas crear instancias y verifica que el tipo de máquina que deseas usar esté disponible en esa región. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
REST
Para crear una política de posición compacta, realiza una solicitud POST al
método resourcePolicies.insert de la versión beta.
En el cuerpo de la solicitud, incluye el campo collocation configurado como COLLOCATED y el campo maxDistance.
POST https://compute.googleapis.com/compute/beta/projects/PROJECT_ID/regions/REGION/resourcePolicies
{
"name": "POLICY_NAME",
"groupPlacementPolicy": {
"collocation": "COLLOCATED",
"maxDistance": MAX_DISTANCE
}
}
Reemplaza lo siguiente:
PROJECT_ID: el ID de tu proyectoPOLICY_NAME: el nombre de la política de posición compacta.MAX_DISTANCE: Es la configuración de distancia máxima para tus VMs, que se puede especificar (vista previa, recomendada) o no especificar (quitar el campomaxDistance). Según lo que admita tu tipo de máquina, puedes especificar uno de los siguientes valores:- Para colocar las VMs en el mismo subbloque, haz lo siguiente:
1 - Para colocar las VMs en el mismo bloque, haz lo siguiente:
2 - Para colocar VMs en bloques adyacentes:
3
- Para colocar las VMs en el mismo subbloque, haz lo siguiente:
REGION: la región en la que deseas crear la política de posición compacta. Especifica la región que contiene la zona en la que planeas crear instancias y verifica que el tipo de máquina que deseas usar esté disponible en esa región. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.
Crea una VM de A3 Edge
Para crear una VM de Edge A3, usa uno de los siguientes métodos.
Los siguientes comandos también establecen el permiso de acceso para tus instancias. Para simplificar la administración de permisos, Google recomienda que configures el permiso de acceso en una instancia como accesocloud-platform y, luego, uses roles de IAM para definir a qué servicios puede acceder la instancia. Para obtener más información, consulta las prácticas recomendadas para los permisos.
Console
En la consola de Google Cloud , ve a la página Crear una instancia.
Especifica un Nombre para la VM. Consulta la convención de asignación de nombres de recursos.
Selecciona la región y la zona en las que deseas crear una VM. Consulta la lista de regiones y zonas de GPU disponibles.
Haz clic en la pestaña GPUs y, luego, completa los siguientes pasos:
- En la lista Tipo de GPU, selecciona
NVIDIA H100 80GB. - En la lista Cantidad de GPU, selecciona
8. - En la lista Tipo de máquina, selecciona a3-edgegpu-8g.
- En la lista Tipo de GPU, selecciona
Según la opción de consumo que quieras usar, selecciona una de las siguientes opciones y completa los pasos que se indican a continuación.
Reserva
Las instancias de A3 Edge admiten los siguientes tipos de reservas:
- Reservas según demanda
- Reservas futuras estándar
Para consumir estos tipos de reservas, una instancia debe usar el modelo de aprovisionamiento estándar. Por ejemplo, usa los siguientes parámetros de creación.
- En la sección Modelo de aprovisionamiento, en la lista Modelo de aprovisionamiento de VM, selecciona Estándar. (Esta opción está seleccionada de forma predeterminada).
Para configurar qué reservas usa esta VM, completa los siguientes pasos:
- En el menú de navegación, haz clic en Opciones avanzadas.
En Reservations, selecciona una de las siguientes opciones:
Para usar la capacidad de reserva de forma opcional, selecciona Usar selección automática. (Esta opción está seleccionada de forma predeterminada).
La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.
Para requerir capacidad de reserva, selecciona Elegir una reserva y, luego, haz clic en Elegir reserva para especificar qué reserva usar.
La instancia debe usar capacidad de una reserva específicamente segmentada y no puede usar capacidad según demanda. Si la capacidad de reserva no está disponible, la creación de la instancia fallará.
A pedido
- En la sección Modelo de aprovisionamiento, en la lista Modelo de aprovisionamiento de VM, selecciona Estándar. (Esta opción está seleccionada de forma predeterminada).
Opcional: Para configurar si esta VM usa reservas, completa los siguientes pasos:
- En el menú de navegación, haz clic en Opciones avanzadas.
En Reservations, selecciona una de las siguientes opciones:
Para usar la capacidad de reserva de forma opcional, selecciona Usar selección automática. (Esta es la opción predeterminada).
La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad bajo demanda.
Para solicitar capacidad según demanda, selecciona No usar una reserva.
La instancia no puede usar ninguna capacidad de reserva.
Inicio flexible
- En la sección Modelo de aprovisionamiento, en la lista Modelo de aprovisionamiento de VM, selecciona inicio flexible.
En el campo Ingresa la cantidad de horas, ingresa la cantidad máxima de tiempo que deseas que se ejecute la VM. El valor debe estar entre 46 segundos (
0.01) y siete días (168o 168 horas).Selecciona Establece un tiempo de espera para la creación de la VM.
Según los requisitos zonales de tu carga de trabajo, especifica una de las siguientes duraciones para aumentar las probabilidades de que se complete tu solicitud de creación de VM:
- Cargas de trabajo con requisitos zonales estrictos: Si tu carga de trabajo requiere que crees la VM en una zona específica, especifica una duración entre 90 segundos y 2 horas. Las duraciones más largas te brindan más probabilidades de obtener recursos.
- Cargas de trabajo sin requisitos zonales estrictos: Si la VM puede ejecutarse en cualquier zona de la región, especifica una duración de 0 segundos o desmarca la casilla de verificación Establecer un tiempo de espera para la creación de la VM. Esta acción especifica que Compute Engine solo asigna recursos si están disponibles de inmediato. Si la solicitud de creación de la VM falla porque los recursos no están disponibles, vuelve a intentarlo en otra zona.
En el campo Cuando se finaliza la VM, selecciona si deseas detener o borrar la VM al final de su duración de ejecución:
- Para borrar la VM, selecciona Borrar.
- Para detener la VM, selecciona Detener.
Spot
- En la sección Modelo de aprovisionamiento, selecciona Spot en la lista Modelo de aprovisionamiento de VM.
Opcional: Para seleccionar la acción de finalización que se produce cuando Compute Engine interrumpe la VM, completa los siguientes pasos:
- Expande la sección Configuración avanzada del modelo de aprovisionamiento de VMs.
- En la lista Finalización de VM, selecciona una de las siguientes opciones:
- Para detener la VM durante la interrupción, selecciona Detener (predeterminado).
- Para borrar la VM durante la interrupción, selecciona Borrar.
En el menú de navegación, haz clic en SO y almacenamiento y, luego, completa los siguientes pasos:
- Haz clic en Cambiar. Se abrirá el panel Configuración del disco de arranque.
En la pestaña Imágenes públicas, selecciona una imagen recomendada. Para obtener una lista de las imágenes recomendadas, consulta Sistemas operativos.
Opcional: Para configurar el tamaño del disco de arranque, consulta los límites de tamaño de Google Cloud Hyperdisk o los límites de tamaño de Persistent Disk, según el tipo de disco.
Para confirmar las opciones del disco de arranque, haz clic en Seleccionar.
Configura la cuenta de servicio y los permisos de acceso de la siguiente manera. Las cargas de trabajo que se ejecutan en la instancia usan la cuenta de servicio adjunta para autorizar solicitudes a otros servicios de Google Cloud .
- En el menú de navegación, haz clic en Seguridad.
- En la lista Cuenta de servicio, selecciona una cuenta de servicio para usar.
- En Permisos de acceso, selecciona la opción Permitir el acceso total a todas las APIs de Cloud. Se recomienda esta práctica recomendada porque te permite administrar el acceso agregando o quitando roles de IAM de la cuenta de servicio. Para obtener más información, consulta Cómo conectar una cuenta de servicio a una instancia.
Para crear una VM con varias NICs, completa los siguientes pasos. De lo contrario, para crear una VM con una sola NIC, omite estos pasos.
En el menú de navegación, haz clic en Herramientas de redes.
En la sección Interfaces de red, completa los siguientes pasos:
- Borra la interfaz de red predeterminada. Para borrar la interfaz, haz clic en Borrar.
- Haz clic en Agregar una interfaz de red. Usa esta opción para agregar interfaces de red que se adjunten a las redes de VPC que creaste en la sección anterior. Cuando agregues las interfaces de red, recuerda lo siguiente:
- Para una interfaz de red que se usa para la comunicación de host a host, selecciona una red de VPC y una subred normales en las listas Red y Subred, y configura la lista Tarjeta de interfaz de red en gVNIC. Para cada red, excepto la primera, establece la lista Dirección IP externa en Ninguna.
- En el caso de una interfaz de red que se usa para la comunicación de GPU a GPU con GPUDirect-TCPX, selecciona las redes de VPC y las subredes especializadas correspondientes para cada interfaz, y configura la lista Tarjeta de interfaz de red en gVNIC también para estas interfaces de red. Para cada red, excepto la primera, establece la lista Dirección IP externa en Ninguna.
Para crear y, también, iniciar la VM, haz clic en Crear.
gcloud
Para crear la VM, usa el
comando gcloud compute instances create.
Los parámetros que debes especificar dependen de la opción de consumo que uses para esta implementación. Selecciona la pestaña que corresponda a tu opción de consumo.
Reserva
Las instancias de A3 Edge admiten los siguientes tipos de reservas:
- Reservas según demanda
- Reservas futuras estándar
Para consumir estos tipos de reservas, una instancia debe usar el modelo de aprovisionamiento estándar. Por ejemplo, usa los siguientes parámetros de creación.
Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.
gcloud compute instances create INSTANCE_NAME \
--machine-type=MACHINE_TYPE \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--zone=ZONE \
--boot-disk-type=DISK_TYPE \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
--provisioning-model=STANDARD \
--maintenance-policy=TERMINATE \
--reservation-affinity=RESERVATION_AFFINITY \
--reservation=RESERVATION
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
INSTANCE_NAME: el nombre de la VM.MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles. Para la serie de máquinas A3 Edge, te recomendamos que uses la imagen de Container-Optimized OScos-121-ltso posterior y que inhabilite las actualizaciones automáticas.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO. Por ejemplo, usacos-cloudpara la imagen de Container-Optimized OScos-121-ltso posterior.ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Para especificar una política de posición compacta, usa una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.DISK_TYPE: El tipo de disco de arranque. Para esta serie de máquinas, te recomendamos que useshyperdisk-balanced. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.GVNIC_NAME_PREFIX: Es el prefijo del nombre que especificaste cuando creaste las subredes y las redes de VPC estándar que usan gVNICs.RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:any(la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.specific(Se requiere capacidad de reserva): Requiere que la instancia use capacidad de una reserva orientada específicamente. La instancia no puede usar la capacidad según demanda. Si la capacidad de reserva no está disponible, la creación de la instancia fallará.
RESERVATION: Es la reserva que se usará. Especifica una de las siguientes opciones según el valor que especificaste paraRESERVATION_AFFINITY:- Si especificaste
any, reemplazaRESERVATIONpor una cadena vacía (""). Como alternativa, puedes quitar la marca--reservationpor completo. Si especificaste
specific, reemplazaRESERVATIONpor lo siguiente:projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME
Reemplaza lo siguiente:
RESERVATION_OWNER_PROJECT_ID: Es el ID del proyecto en el que se creó la reserva.RESERVATION_NAMEpor el nombre de la reserva.
- Si especificaste
De forma predeterminada, la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Si quieres inhabilitar el reinicio automático, agrega la siguiente marca:
--no-restart-on-failure
-
Opcional: Para usar una política de posición compacta, agrega la siguiente marca:
--resource-policies=POLICY_NAME
Reemplaza lo siguiente:
POLICY_NAME: el nombre de la política de posición compacta.
- Ejecute el comando.
A pedido
Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.
gcloud compute instances create INSTANCE_NAME \
--machine-type=MACHINE_TYPE \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--zone=ZONE \
--boot-disk-type=DISK_TYPE \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
--provisioning-model=STANDARD \
--maintenance-policy=TERMINATE \
--reservation-affinity=RESERVATION_AFFINITY
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
INSTANCE_NAME: el nombre de la VM.MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles. Para la serie de máquinas A3 Edge, te recomendamos que uses la imagen de Container-Optimized OScos-121-ltso posterior y que inhabilite las actualizaciones automáticas.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO. Por ejemplo, usacos-cloudpara la imagen de Container-Optimized OScos-121-ltso posterior.ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Para especificar una política de posición compacta, usa una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.DISK_TYPE: El tipo de disco de arranque. Para esta serie de máquinas, te recomendamos que useshyperdisk-balanced. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.GVNIC_NAME_PREFIX: Es el prefijo del nombre que especificaste cuando creaste las subredes y las redes de VPC estándar que usan gVNICs.RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:any(la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva de consumo automático, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.none(Se requiere capacidad según demanda): Bloquea la instancia para que no use ninguna capacidad de reserva.
De forma predeterminada, la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Si quieres inhabilitar el reinicio automático, agrega la siguiente marca:
--no-restart-on-failure
-
Opcional: Para usar una política de posición compacta, agrega la siguiente marca:
--resource-policies=POLICY_NAME
Reemplaza lo siguiente:
POLICY_NAME: el nombre de la política de posición compacta.
- Ejecute el comando.
Inicio flexible
Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.
gcloud compute instances create INSTANCE_NAME \
--machine-type=MACHINE_TYPE \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--zone=ZONE \
--boot-disk-type=DISK_TYPE \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
--reservation-affinity=none \
--provisioning-model=FLEX_START \
--request-valid-for-duration=REQUEST_VALID_FOR_DURATION \
--max-run-duration=MAX_RUN_DURATION \
--instance-termination-action=TERMINATION_ACTION \
--maintenance-policy=TERMINATE
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
INSTANCE_NAME: el nombre de la VM.MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles. Para la serie de máquinas A3 Edge, te recomendamos que uses la imagen de Container-Optimized OScos-121-ltso posterior y que inhabilite las actualizaciones automáticas.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO. Por ejemplo, usacos-cloudpara la imagen de Container-Optimized OScos-121-ltso posterior.ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Para especificar una política de posición compacta, usa una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.DISK_TYPE: El tipo de disco de arranque. Para esta serie de máquinas, te recomendamos que useshyperdisk-balanced. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.GVNIC_NAME_PREFIX: Es el prefijo del nombre que especificaste cuando creaste las subredes y las redes de VPC estándar que usan gVNICs.REQUEST_VALID_FOR_DURATION: Es el tiempo durante el que sigue siendo válida la solicitud para crear la VM. Debes darle formato al valor como la cantidad de días, horas, minutos o segundos, seguidos ded,h,mys, respectivamente. Por ejemplo, especifica30mpara 30 minutos o1h2m3spara una hora, dos minutos y tres segundos.Según los requisitos zonales de tu carga de trabajo, especifica una de las siguientes duraciones para aumentar las probabilidades de que se complete tu solicitud de creación de VM:
- Cargas de trabajo con requisitos zonales estrictos: Si tu carga de trabajo requiere que crees la VM en una zona específica, especifica una duración entre 90 segundos (
90s) y dos horas (2h). Las duraciones más largas te brindan más posibilidades de obtener recursos. - Cargas de trabajo sin requisitos zonales estrictos: Si la VM puede ejecutarse en cualquier zona de la región, especifica una duración de cero segundos (
0s). Esta acción especifica que Compute Engine solo asigna recursos si están disponibles de inmediato. Si la solicitud de creación de la VM falla porque los recursos no están disponibles, vuelve a intentarlo en otra zona.
- Cargas de trabajo con requisitos zonales estrictos: Si tu carga de trabajo requiere que crees la VM en una zona específica, especifica una duración entre 90 segundos (
MAX_RUN_DURATION: Es el tiempo durante el cual deseas que se ejecuten las VMs solicitadas. Debes darle formato al valor como la cantidad de días, horas, minutos o segundos, seguidos ded,h,mys, respectivamente. El valor debe ser de entre 10 minutos y siete días.TERMINATION_ACTION: Indica si Compute Engine detiene (STOP) o borra (DELETE) la VM al final de su duración de ejecución.
-
Opcional: Para usar una política de posición compacta, agrega la siguiente marca:
--resource-policies=POLICY_NAME
Reemplaza lo siguiente:
POLICY_NAME: el nombre de la política de posición compacta.
- Ejecute el comando.
Spot
Antes de ejecutar el comando, revisa todos los pasos que se indican a continuación para determinar si debes incluir marcas adicionales.
gcloud compute instances create INSTANCE_NAME \
--machine-type=MACHINE_TYPE \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--zone=ZONE \
--boot-disk-type=DISK_TYPE \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
--provisioning-model=SPOT \
--instance-termination-action=TERMINATION_ACTION \
--maintenance-policy=TERMINATE \
--no-restart-on-failure
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
INSTANCE_NAME: el nombre de la VM.MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles. Para la serie de máquinas A3 Edge, te recomendamos que uses la imagen de Container-Optimized OScos-121-ltso posterior y que inhabilite las actualizaciones automáticas.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO. Por ejemplo, usacos-cloudpara la imagen de Container-Optimized OScos-121-ltso posterior.ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Para especificar una política de posición compacta, usa una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.DISK_TYPE: El tipo de disco de arranque. Para esta serie de máquinas, te recomendamos que useshyperdisk-balanced. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.GVNIC_NAME_PREFIX: Es el prefijo del nombre que especificaste cuando creaste las subredes y las redes de VPC estándar que usan gVNICs.TERMINATION_ACTION: Es la acción que se debe realizar cuando Compute Engine interrumpe la instancia, ya seaSTOP(predeterminada) oDELETE.
-
Opcional: Para usar una política de posición compacta, agrega la siguiente marca:
--resource-policies=POLICY_NAME
Reemplaza lo siguiente:
POLICY_NAME: el nombre de la política de posición compacta.
- Ejecute el comando.
REST
Para crear la VM, realiza una solicitud POST al
método instances.insert.
Los parámetros que debes especificar dependen de la opción de consumo que uses para esta implementación. Selecciona la pestaña que corresponda a tu opción de consumo.
Reserva
Las instancias de A3 Edge admiten los siguientes tipos de reservas:
- Reservas según demanda
- Reservas futuras estándar
Para consumir estos tipos de reservas, una instancia debe usar el modelo de aprovisionamiento estándar. Por ejemplo, usa los siguientes parámetros de creación.
Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
"machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
"name": "INSTANCE_NAME",
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "DISK_TYPE",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"networkInterfaces": [
{
"accessConfigs": [
{
"name": "external-nat",
"type": "ONE_TO_ONE_NAT"
}
],
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
},
"scheduling": {
"provisioningModel": "STANDARD",
"onHostMaintenance": "TERMINATE",
"automaticRestart": AUTOMATIC_RESTART
},
"reservationAffinity": {
"consumeReservationType": "RESERVATION_AFFINITY",
"key": "compute.googleapis.com/reservation-name",
"values": [
"RESERVATION"
]
}
}
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
PROJECT_ID: Es el ID del proyecto en el que deseas crear la VM.ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.INSTANCE_NAME: el nombre de la VM.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.DISK_TYPE: El tipo de disco de arranque. Para esta serie de máquinas, te recomendamos que useshyperdisk-balanced. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles. Para la serie de máquinas A3 Edge, te recomendamos que uses la imagen de Container-Optimized OScos-121-ltso posterior y que inhabilite las actualizaciones automáticas.NETWORK_PROJECT_ID: Es el ID del proyecto de la red.GVNIC_NAME_PREFIX: Es el prefijo del nombre que especificaste cuando creaste las subredes y las redes de VPC estándar que usan gVNICs.REGION: Es la región de la subred.AUTOMATIC_RESTART: Indica si la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Especificatruepara habilitar el reinicio automático (predeterminado) ofalsepara inhabilitarlo.RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:ANY_RESERVATION(la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva que se consume automáticamente, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.SPECIFIC_RESERVATION(Se requiere capacidad de reserva): Requiere que la instancia use capacidad de una reserva orientada específicamente. La instancia no puede usar la capacidad según demanda. Si la capacidad de reserva no está disponible, la creación de la instancia fallará.
RESERVATION: Es la reserva que se usará. Especifica una de las siguientes opciones según el valor que especificaste paraRESERVATION_AFFINITY:- Si especificaste
ANY_RESERVATION, borraRESERVATIONpara que el valor sea una cadena vacía (""). Como alternativa, puedes quitar por completo los camposkeyyvalues. Si especificaste
SPECIFIC_RESERVATION, reemplazaRESERVATIONpor lo siguiente:projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME
Reemplaza lo siguiente:
RESERVATION_OWNER_PROJECT_ID: Es el ID del proyecto en el que se creó la reserva.RESERVATION_NAMEpor el nombre de la reserva.
- Si especificaste
-
Opcional: Si elegiste usar una política de posición compacta, agrega el siguiente campo al cuerpo de la solicitud:
"resourcePolicies": [ "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME" ]Reemplaza lo siguiente:
PROJECT_ID: Es el ID del proyecto de la política de posición compacta.REGION: Es la región de la política de posición compacta.POLICY_NAME: el nombre de la política de posición compacta.
- Envía la solicitud.
A pedido
Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
"machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
"name": "INSTANCE_NAME",
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "DISK_TYPE",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"networkInterfaces": [
{
"accessConfigs": [
{
"name": "external-nat",
"type": "ONE_TO_ONE_NAT"
}
],
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
},
"scheduling": {
"provisioningModel": "STANDARD",
"onHostMaintenance": "TERMINATE",
"automaticRestart": AUTOMATIC_RESTART
},
"reservationAffinity": {
"consumeReservationType": "RESERVATION_AFFINITY"
}
}
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
PROJECT_ID: Es el ID del proyecto en el que deseas crear la VM.ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.INSTANCE_NAME: el nombre de la VM.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.DISK_TYPE: El tipo de disco de arranque. Para esta serie de máquinas, te recomendamos que useshyperdisk-balanced. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles. Para la serie de máquinas A3 Edge, te recomendamos que uses la imagen de Container-Optimized OScos-121-ltso posterior y que inhabilite las actualizaciones automáticas.NETWORK_PROJECT_ID: Es el ID del proyecto de la red.GVNIC_NAME_PREFIX: Es el prefijo del nombre que especificaste cuando creaste las subredes y las redes de VPC estándar que usan gVNICs.REGION: Es la región de la subred.AUTOMATIC_RESTART: Indica si la instancia se reinicia automáticamente si falla o si Compute Engine la detiene por una detención programada, como un evento de mantenimiento. Especificatruepara habilitar el reinicio automático (predeterminado) ofalsepara inhabilitarlo.RESERVATION_AFFINITY: Indica qué reservas puede consumir la instancia, si es posible. Especifica una de las siguientes opciones:ANY_RESERVATION(la capacidad de reserva es opcional): Esta es la opción predeterminada. La instancia intenta usar capacidad de una reserva que se consume automáticamente, lo que solo sucede si hay capacidad de reserva coincidente disponible. De lo contrario, la instancia usa capacidad a pedido.NO_RESERVATION(Se requiere capacidad según demanda): Bloquea la instancia para que no use ninguna capacidad de reserva.
-
Opcional: Si elegiste usar una política de posición compacta, agrega el siguiente campo al cuerpo de la solicitud:
"resourcePolicies": [ "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME" ]Reemplaza lo siguiente:
PROJECT_ID: Es el ID del proyecto de la política de posición compacta.REGION: Es la región de la política de posición compacta.POLICY_NAME: el nombre de la política de posición compacta.
- Envía la solicitud.
Inicio flexible
Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
"machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
"name": "INSTANCE_NAME",
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "DISK_TYPE",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"networkInterfaces": [
{
"accessConfigs": [
{
"name": "external-nat",
"type": "ONE_TO_ONE_NAT"
}
],
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
},
"reservationAffinity": {
"consumeReservationType": "NO_RESERVATION",
},
"scheduling": {
"provisioningModel": "FLEX_START",
"requestValidForDuration": {
"seconds": REQUEST_VALID_FOR_DURATION
},
"maxRunDuration": {
"seconds": MAX_RUN_DURATION
},
"instanceTerminationAction": "TERMINATION_ACTION",
"onHostMaintenance": "TERMINATE",
}
}
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
PROJECT_ID: Es el ID del proyecto en el que deseas crear la VM.ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.INSTANCE_NAME: el nombre de la VM.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.DISK_TYPE: El tipo de disco de arranque. Para esta serie de máquinas, te recomendamos que useshyperdisk-balanced. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles. Para la serie de máquinas A3 Edge, te recomendamos que uses la imagen de Container-Optimized OScos-121-ltso posterior y que inhabilite las actualizaciones automáticas.NETWORK_PROJECT_ID: Es el ID del proyecto de la red.GVNIC_NAME_PREFIX: Es el prefijo del nombre que especificaste cuando creaste las subredes y las redes de VPC estándar que usan gVNICs.REGION: Es la región de la subred.REQUEST_VALID_FOR_DURATION: Es la duración, en segundos, durante la que sigue siendo válida la solicitud para crear la VM.Según los requisitos zonales de tu carga de trabajo, especifica una de las siguientes duraciones para aumentar las probabilidades de que se complete tu solicitud de creación de VM:
- Cargas de trabajo con requisitos zonales estrictos: Si tu carga de trabajo requiere que crees la VM en una zona específica, especifica una duración entre 90 segundos (
90) y dos horas (7200). Las duraciones más largas te brindan más posibilidades de obtener recursos. - Cargas de trabajo sin requisitos zonales estrictos: Si la VM puede ejecutarse en cualquier zona de la región, especifica una duración de cero segundos (
0). Esta acción especifica que Compute Engine solo asigna recursos si están disponibles de inmediato. Si la solicitud de creación de la VM falla porque los recursos no están disponibles, vuelve a intentarlo en otra zona.
- Cargas de trabajo con requisitos zonales estrictos: Si tu carga de trabajo requiere que crees la VM en una zona específica, especifica una duración entre 90 segundos (
MAX_RUN_DURATION: la duración de la que deseas que se ejecuten las VMs solicitadas. Debes darle formato al valor como la cantidad de segundos. Por ejemplo, especifica86400para 86,400 segundos (24 horas). El valor debe ser de entre 10 minutos y siete días.TERMINATION_ACTION: Indica si Compute Engine detiene (STOP) o borra (DELETE) la VM al final de su duración de ejecución.
-
Opcional: Si elegiste usar una política de posición compacta, agrega el siguiente campo al cuerpo de la solicitud:
"resourcePolicies": [ "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME" ]Reemplaza lo siguiente:
PROJECT_ID: Es el ID del proyecto de la política de posición compacta.REGION: Es la región de la política de posición compacta.POLICY_NAME: el nombre de la política de posición compacta.
- Envía la solicitud.
Spot
Antes de enviar la solicitud, revisa todos los pasos que se indican a continuación para determinar si debes incluir campos adicionales.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
"machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/MACHINE_TYPE",
"name": "INSTANCE_NAME",
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "DISK_TYPE",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"networkInterfaces": [
{
"accessConfigs": [
{
"name": "external-nat",
"type": "ONE_TO_ONE_NAT"
}
],
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
},
"scheduling":
{
"provisioningModel": "SPOT",
"instanceTerminationAction": "TERMINATION_ACTION",
"onHostMaintenance": "TERMINATE",
"automaticRestart": false
}
}
Completa los siguientes pasos:
-
Reemplaza lo siguiente:
PROJECT_ID: Es el ID del proyecto en el que deseas crear la VM.ZONE: Es la zona en la que está disponible el tipo de máquina que deseas usar. Si deseas especificar una política de posición compacta, debes usar una zona en la misma región que la política de posición compacta. Para obtener información sobre las regiones, consulta Disponibilidad de GPU por regiones y zonas.MACHINE_TYPE: Es el tipo de máquina que se usará para la VM. Para obtener más información, consulta Tipos de máquinas con GPU en la documentación de Compute Engine.INSTANCE_NAME: el nombre de la VM.DISK_SIZE: Es el tamaño del disco de arranque en GB. Para obtener más información, consulta Límites de tamaño de Google Cloud Hyperdisk o Límites de tamaño de Persistent Disk, según el tipo de disco.DISK_TYPE: El tipo de disco de arranque. Para esta serie de máquinas, te recomendamos que useshyperdisk-balanced. Para obtener más información sobre los tipos de discos compatibles con tu tipo de máquina, consulta Máquinas con GPU en la familia de máquinas optimizadas para aceleradores en la documentación de Compute Engine.IMAGE_PROJECT: Es el ID del proyecto de la imagen de SO.IMAGE_FAMILY: Es la familia de imágenes de la imagen de SO que deseas usar. Para obtener una lista de todos los sistemas operativos compatibles, consulta Sistemas operativos compatibles. Para la serie de máquinas A3 Edge, te recomendamos que uses la imagen de Container-Optimized OScos-121-ltso posterior y que inhabilite las actualizaciones automáticas.NETWORK_PROJECT_ID: Es el ID del proyecto de la red.GVNIC_NAME_PREFIX: Es el prefijo del nombre que especificaste cuando creaste las subredes y las redes de VPC estándar que usan gVNICs.REGION: Es la región de la subred.TERMINATION_ACTION: Es la acción que se debe realizar cuando Compute Engine interrumpe la instancia, ya seaSTOP(predeterminada) oDELETE.
-
Opcional: Si elegiste usar una política de posición compacta, agrega el siguiente campo al cuerpo de la solicitud:
"resourcePolicies": [ "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME" ]Reemplaza lo siguiente:
PROJECT_ID: Es el ID del proyecto de la política de posición compacta.REGION: Es la región de la política de posición compacta.POLICY_NAME: el nombre de la política de posición compacta.
- Envía la solicitud.
Instalar los controladores de GPU.
Después de crear una instancia, esta no puede usar sus GPUs a menos que ya estén instalados los controladores de GPU correctos. Si no especificaste una imagen del SO que incluya controladores de GPU, consulta Instala controladores de GPU en la documentación de Compute Engine.