Regiones y zonas

Los recursos de Compute Engine se alojan en varias ubicaciones de todo el mundo, que se componen de regiones y zonas.

Las regiones son áreas geográficas independientes que están formadas por zonas. Las zonas y las regiones son abstracciones lógicas de los recursos físicos subyacentes. Para obtener más información sobre las consideraciones específicas de cada región, consulta Geografía y regiones.

Los recursos que se encuentran en una zona, como las instancias de Compute Engine o los discos de zona, se denominan recursos de zona. Otros recursos, como las direcciones IP externas estáticas, son regionales. Los recursos regionales pueden ser usados por todos los recursos de esa región, independientemente de la zona, mientras que los recursos de zona solo pueden ser usados por otros recursos de la misma zona. Por ejemplo, para montar un disco persistente de zona en una instancia, ambos recursos deben estar en la misma zona. De manera similar, si quieres asignar una dirección IP estática a una instancia, esta debe estar en la misma región que la dirección IP estática.

Si colocas los recursos en diferentes zonas de una región, se reduce el riesgo de que una interrupción de la infraestructura afecte a todos los recursos simultáneamente. Si colocas los recursos en diferentes regiones, se consigue un grado aún mayor de independencia ante fallos. Esto te permite diseñar sistemas robustos con recursos distribuidos en diferentes dominios del fallo.

Solo algunos recursos son específicos de una región o una zona. Otros recursos, como las imágenes, son recursos globales que pueden ser usados por otros recursos de cualquier ubicación. Consulta información sobre los recursos globales, regionales y de zona de Compute Engine.

Google Cloud también ofrece zonas de IA dedicadas que proporcionan GPUs y TPUs de alta capacidad para cargas de trabajo de IA y aprendizaje automático. Estas zonas tienen características únicas, como requisitos específicos de latencia de red y un destino compartido con una zona principal. Para obtener más información, consulta Zonas de IA.

Identificar una región o una zona

Cada región de Compute Engine contiene varias zonas. Los nombres de las zonas se componen de dos partes que las describen en detalle. La primera parte es la región y la segunda parte indica la zona de la región:

  • Región

    Las regiones son conjuntos de zonas. Las zonas tienen conexiones de red de gran ancho de banda y baja latencia con otras zonas de la misma región. Para desplegar aplicaciones tolerantes a fallos que tengan una alta disponibilidad, Google recomienda hacerlo en varias zonas y regiones. De esta forma, se las protege frente a fallos inesperados de los componentes, incluso en una sola zona o región.

    Elige las regiones que tengan sentido en tu caso. Por ejemplo, si solo cuentas con clientes en EE. UU. o si tienes necesidades específicas que requieren que tus datos se almacenen en ese país, lo más lógico es almacenar tus recursos en zonas de la región us-central1 o us-east1.

  • Zona

    Una zona es un área de despliegue dentro de una región. Las zonas dedicadas a cargas de trabajo de IA y aprendizaje automático se denominan zonas de IA. Las que no son de IA se denominan zonas estándar o simplemente zonas. En función de la amplitud con la que quieras distribuir tus recursos, crea instancias de computación en varias zonas de distintas regiones para disfrutar de redundancia.

    • Zona estándar

      Los nombres de las zonas estándar tienen dos partes: la región y la zona de la región. Por ejemplo, el nombre completo de la zona a de la región us-central1 es us-central1-a.

    • Zona de IA

      Las zonas de IA siguen una convención de nomenclatura ampliada para diferenciarlas de las zonas que no son de IA. En el caso de una zona de IA, la variable <zone> consta de tres partes: la cadena "ai" (para identificarla como zona de IA), un número (que representa su grupo de despliegue) y una letra (que indica la programación compartida de actualizaciones de software). Por ejemplo, el nombre completo de la zona de IA ai2b de la región us-west4 es us-west4-ai2b. Esta zona de IA comparte su fase de despliegue con la zona us-west4-b estándar.

Cuotas de recursos

Algunos recursos, como las IPs estáticas, las imágenes, las reglas de cortafuegos y las redes de VPC, tienen límites de cuota definidos para todo el proyecto y límites de cuota por región. Cuando creas estos recursos, se tienen en cuenta para tu cuota total de todo el proyecto o para tu cuota por región, si procede. Si se supera alguno de los límites de cuota afectados, no podrás añadir más recursos del mismo tipo en ese proyecto o región.

Para ver la lista completa de las cuotas que se aplican a tu proyecto, ve a la página Cuotas de la consola de Google Cloud .

Por ejemplo, si tu cuota global de grupos de destino es de 50 y creas 25 grupos de destino en región-ejemplo-1 y 25 grupos de destino en región-ejemplo-2, alcanzarás la cuota de todo el proyecto y no podrás crear más grupos de destino en ninguna región del proyecto hasta que liberes espacio. Del mismo modo, si tienes una cuota por región de 7 direcciones IP reservadas, solo puedes reservar hasta 7 direcciones IP en una sola región. Cuando alcances ese límite, tendrás que reservar direcciones IP en una nueva región o liberar algunas.

Mantenimiento transparente

Google mantiene su infraestructura periódicamente aplicando parches a los sistemas con el software más reciente, haciendo pruebas rutinarias y tareas de mantenimiento preventivo, y, en general, asegurándose de que sea lo más rápida y eficiente posible.

Por defecto, todas las instancias de computación se configuran de forma que estos eventos de mantenimiento sean transparentes para tus aplicaciones y cargas de trabajo. Google utiliza una combinación de innovaciones en centros de datos, prácticas recomendadas operativas y tecnología de migración en tiempo real para apartar las instancias de máquinas virtuales en ejecución de las tareas de mantenimiento. Tu instancia seguirá ejecutándose en la misma zona sin que tengas que hacer nada.

Por defecto, la mayoría de las máquinas virtuales están configuradas para migrarse en tiempo real, pero también puedes configurarlas para que se detengan y se reinicien. Algunas series de máquinas solo se pueden detener y reiniciar para las operaciones de mantenimiento. Las dos opciones se diferencian en los siguientes aspectos:

  • Migrar en tiempo real

    Compute Engine migra automáticamente la instancia en ejecución. El proceso de migración afectará en cierta medida al rendimiento de la máquina invitada, pero tu instancia permanecerá online durante todo el proceso. El impacto en el rendimiento de la máquina invitada y la duración exactos dependen de muchos factores, pero se espera que la mayoría de las aplicaciones y cargas de trabajo no lo noten. Consulta más información sobre la migración en tiempo real.

  • Detener y reiniciar

    Compute Engine indica automáticamente a tu instancia que se apague, espera un poco a que se apague correctamente y, a continuación, la reinicia lejos del evento de mantenimiento.

Para obtener más información sobre cómo configurar las opciones anteriores en tus instancias, consulta Definir la política de mantenimiento del host de la máquina virtual.

Elegir una región y una zona

Tú eliges la región o la zona en la que se alojan tus recursos, lo que controla dónde se almacenan y se usan tus datos. Elegir una región y una zona es importante por varios motivos:

Gestión de errores
Distribuye tus recursos en varias zonas y regiones para que sean tolerantes a las interrupciones. Google diseña las zonas para minimizar el riesgo de que se produzcan fallos correlacionados debido a cortes en la infraestructura física, como la electricidad, la refrigeración o la red. Por lo tanto, si una zona deja de estar disponible, puedes transferir el tráfico a otra zona de la misma región para que tus servicios sigan funcionando. Del mismo modo, puedes mitigar el impacto de un corte en una región en tu aplicación ejecutando servicios de respaldo en otra región. Para obtener más información sobre cómo distribuir tus recursos y diseñar un sistema robusto, consulta el artículo Diseñar sistemas resilientes.
Latencia de red reducida
Para reducir la latencia de la red, puedes elegir una región o una zona que esté cerca de tu punto de servicio. Por ejemplo, si la mayoría de tus clientes se encuentran en la costa este de EE. UU., te recomendamos elegir una región y una zona principales que estén cerca, así como una región y una zona de respaldo que también lo estén.
Aceleración optimizada de IA y aprendizaje automático
Las zonas de IA están disponibles en determinadas regiones para las cargas de trabajo que requieren aceleradores de IA de alta capacidad. Estas zonas dedicadas proporcionan recursos de GPU y TPU para el entrenamiento y la inferencia de la IA y el aprendizaje automático. Puedes seleccionar zonas de IA si necesitas una infraestructura optimizada para maximizar el rendimiento de la IA y el aprendizaje automático. Consulta más información en la sección Zonas de IA.

Para obtener más detalles sobre cómo elegir una región y una zona para tus recursos de Compute Engine, consulta Prácticas recomendadas para seleccionar regiones de Compute Engine.

Consejos para seleccionar ubicaciones

Durante la creación de instancias de computación, Compute Engine puede seleccionar automáticamente las zonas de tus instancias en función de la capacidad y la disponibilidad mediante los siguientes métodos: