Ubicación de zona automática de Dataproc

Cuando creas un clúster de Dataproc, los recursos del clúster usan extremos regionales basados en zonas de Compute Engine. Cuando eliges una región, puedes seleccionar una zona dentro de esa región o puedes omitir la zona para que la característica de zona automática de Dataproc seleccione una zona en la región que elijas. Una vez que se selecciona una zona, todos los nodos de ese clúster se implementarán en esa zona.

Reservas de recursos y Zona automática

La función Zona automática prioriza la creación de un clúster en una zona con reservas de recursos, de la siguiente manera:

  • Si los recursos del clúster solicitados se pueden satisfacer por completo con los recursos reservados y, si es necesario, con los recursos bajo demanda en una zona, Zona automática consumirá los recursos reservados y bajo demanda, y creará el clúster en esa zona.

  • La zona automática prioriza las zonas para la selección según las reservas totales de núcleos de CPU (vCPU) en una zona.

    Ejemplo: Una solicitud de creación de clúster especifica 20 n2-standard-2 y 1 n2-standard-64 (se solicitan 40 + 64 vCPUs). La zona automática priorizará las siguientes zonas para la selección según las reservas totales de CPU virtuales disponibles en la zona:

    1. Reservas disponibles en zone-c: 3 n2-standard-2 y 1 n2-standard-64 (70 vCPUs)
    2. zone-b reservas disponibles: 1 n2-standard-64 (64 vCPUs)
    3. zone-aReservas disponibles: 25 n2-standard-2 (50 vCPUs)

      Si se supone que cada una de estas zonas tiene recursos adicionales vCPU y otros recursos a pedido suficientes para satisfacer la solicitud del clúster, la función de zona automática seleccionará zone-c para la creación del clúster.

  • Si los recursos del clúster solicitados no se pueden satisfacer por completo con los recursos reservados más los recursos a pedido en una zona, Zona automática creará el clúster en una zona que probablemente satisfaga la solicitud con recursos a pedido.

Usa la ubicación de zona automática

Console

Para crear un clúster de Dataproc que use la ubicación de zona automática, haz lo siguiente:

  1. En la Google Cloud consola, abre la página Crea un clúster de Dataproc en Compute Engine. Se selecciona el panel Configura el clúster.
  2. En la sección Ubicación, haz lo siguiente:
    • Selecciona una región para tu clúster.
    • En Zona, selecciona "Cualquiera".

Comando de gcloud

Para crear un clúster de Dataproc que use la ubicación de zona automática, utiliza el comando gcloud dataproc clusters create. Establece la marca --region en una región y omite la marca --zone (o deja la marca vacía: --zone= o zone="").

gcloud dataproc clusters create cluster-name \
    --region=region \
    --zone="" \
    other args ...

API de REST

Para crear un clúster de Dataproc que use la posición de zona automática, construye una solicitud JSON clusters.create a la API y deja el campo gceClusterConfig.zoneUri vacío. En el extremo de REST, https://dataproc.googleapis.com/v1/projects/projectId/regions/region/clusters, inserta un nombre de región. La zona automática de Dataproc seleccionará una zona para el clúster dentro de la región especificada.

Usa nombres de recursos cortos con la posición de zona automática: Cuando especifiques un URI de recurso, como machineTypeUri o acceleratorTypeUri, en una solicitud de creación de clústeres de la API de REST de posición de zona automática, usa un nombre de recurso corto sin una especificación de zona, por ejemplo, "n1-standard-2" o "nvidia-tesla-t4".