Provisionierungseigenschaften für Managed Service for Apache Spark

Der Provisioner für den verwalteten Dienst für Apache Spark in Cloud Data Fusion ruft die Dataproc API auf, um Cluster in Ihren Google Cloud-Projekten zu erstellen und zu löschen. Sie können die Cluster in den Einstellungen des Bereitstellungstools konfigurieren.

Weitere Informationen zur Kompatibilität zwischen Cloud Data Fusion-Versionen und Managed Service for Apache Spark-Versionen finden Sie unter Versionskompatibilität.

Eigenschaften

Attribut Beschreibung
Projekt-ID Das Google Cloud -Projekt, in dem der Managed Service for Apache Spark-Cluster erstellt wird. Die Dataproc API muss für das Projekt aktiviert sein.
Dienstkontoschlüssel für Creator

Der dem Provisioner bereitgestellte Dienstkontoschlüssel muss die Berechtigung für den Zugriff auf die Managed Service for Apache Spark- und Compute Engine-APIs haben. Da Ihr Kontoschlüssel vertraulich ist, empfehlen wir, ihn über Secure Storage bereitzustellen.

Nachdem Sie den sicheren Schlüssel erstellt haben, können Sie ihn einem Namespace oder einem System-Compute-Profil hinzufügen. Klicken Sie für ein Namespace-Rechenprofil auf das -Schild und wählen Sie den sicheren Schlüssel aus. Geben Sie für ein System-Compute-Profil den Namen des Schlüssels im Feld Secure Account Key (Sicherer Kontoschlüssel) ein.

Region Ein geografischer Standort, an dem Sie Ihre Ressourcen hosten können, z. B. die Rechenknoten für den Managed Service for Apache Spark-Cluster.
Zone Ein isolierter Bereitstellungsbereich innerhalb einer Region.
Netzwerk Das VPC-Netzwerk in Ihrem Google Cloud -Projekt, das beim Erstellen eines Managed Service for Apache Spark-Clusters verwendet wird.
Netzwerk-Hostprojekt-ID Wenn sich das Netzwerk in einem anderen Google Cloud Projekt befindet, geben Sie die ID dieses Projekts ein. Geben Sie für eine freigegebene VPC die Hostprojekt-ID ein, in der sich das Netzwerk befindet.
Subnetz Das Subnetz, das beim Erstellen von Clustern verwendet werden soll. Sie muss sich im angegebenen Netzwerk und in der Region befinden, in der sich die Zone befindet. Wenn Sie dieses Feld leer lassen, wird ein Subnetz basierend auf dem Netzwerk und der Zone ausgewählt.
Runner-Dienstkonto Der Dienstkontoname der virtuellen Maschinen (VMs) von Managed Service for Apache Spark, die zum Ausführen von Programmen verwendet werden. Wenn Sie dieses Feld leer lassen, wird das Compute Engine-Standarddienstkonto verwendet.
Anzahl der Master

Die Anzahl der Masterknoten im Cluster. Diese Knoten enthalten den YARN Resource Manager, HDFS NameNode und alle Treiber. Muss auf 1 oder 3 festgelegt sein.

Der Standardwert ist 1.

Master-Maschinentyp

Der Typ der zu verwendenden Master-Maschine. Wählen Sie einen der folgenden Maschinentypen aus:

  • n1
  • n2
  • n2d
  • e2

In Cloud Data Fusion-Version 6.7.2 und höher ist e2 die Standardeinstellung.

In Version 6.7.1 ist der Standardwert n2.

In Version 6.7.0 und früher ist der Standardwert n1.

Master-Kerne

Anzahl der virtuellen Kerne, die einem Masterknoten zugewiesen sind.

Der Standardwert ist 2.