Der Provisioner für den verwalteten Dienst für Apache Spark in Cloud Data Fusion ruft die Dataproc API auf, um Cluster in Ihren Google Cloud-Projekten zu erstellen und zu löschen. Sie können die Cluster in den Einstellungen des Bereitstellungstools konfigurieren.
Weitere Informationen zur Kompatibilität zwischen Cloud Data Fusion-Versionen und Managed Service for Apache Spark-Versionen finden Sie unter Versionskompatibilität.
Eigenschaften
| Attribut | Beschreibung |
|---|---|
| Projekt-ID | Das Google Cloud -Projekt, in dem der Managed Service for Apache Spark-Cluster erstellt wird. Die Dataproc API muss für das Projekt aktiviert sein. |
| Dienstkontoschlüssel für Creator | Der dem Provisioner bereitgestellte Dienstkontoschlüssel muss die Berechtigung für den Zugriff auf die Managed Service for Apache Spark- und Compute Engine-APIs haben. Da Ihr Kontoschlüssel vertraulich ist, empfehlen wir, ihn über Secure Storage bereitzustellen. Nachdem Sie den sicheren Schlüssel erstellt haben, können Sie ihn einem Namespace oder einem System-Compute-Profil hinzufügen. Klicken Sie für ein Namespace-Rechenprofil auf das -Schild und wählen Sie den sicheren Schlüssel aus. Geben Sie für ein System-Compute-Profil den Namen des Schlüssels im Feld Secure Account Key (Sicherer Kontoschlüssel) ein. |
| Region | Ein geografischer Standort, an dem Sie Ihre Ressourcen hosten können, z. B. die Rechenknoten für den Managed Service for Apache Spark-Cluster. |
| Zone | Ein isolierter Bereitstellungsbereich innerhalb einer Region. |
| Netzwerk | Das VPC-Netzwerk in Ihrem Google Cloud -Projekt, das beim Erstellen eines Managed Service for Apache Spark-Clusters verwendet wird. |
| Netzwerk-Hostprojekt-ID | Wenn sich das Netzwerk in einem anderen Google Cloud Projekt befindet, geben Sie die ID dieses Projekts ein. Geben Sie für eine freigegebene VPC die Hostprojekt-ID ein, in der sich das Netzwerk befindet. |
| Subnetz | Das Subnetz, das beim Erstellen von Clustern verwendet werden soll. Sie muss sich im angegebenen Netzwerk und in der Region befinden, in der sich die Zone befindet. Wenn Sie dieses Feld leer lassen, wird ein Subnetz basierend auf dem Netzwerk und der Zone ausgewählt. |
| Runner-Dienstkonto | Der Dienstkontoname der virtuellen Maschinen (VMs) von Managed Service for Apache Spark, die zum Ausführen von Programmen verwendet werden. Wenn Sie dieses Feld leer lassen, wird das Compute Engine-Standarddienstkonto verwendet. |
| Anzahl der Master | Die Anzahl der Masterknoten im Cluster. Diese Knoten enthalten den YARN Resource Manager, HDFS NameNode und alle Treiber. Muss auf 1 oder 3 festgelegt sein. Der Standardwert ist 1. |
| Master-Maschinentyp | Der Typ der zu verwendenden Master-Maschine. Wählen Sie einen der folgenden Maschinentypen aus:
In Cloud Data Fusion-Version 6.7.2 und höher ist e2 die Standardeinstellung. In Version 6.7.1 ist der Standardwert n2. In Version 6.7.0 und früher ist der Standardwert n1. |
| Master-Kerne | Anzahl der virtuellen Kerne, die einem Masterknoten zugewiesen sind. Der Standardwert ist 2. |