Ringkasan Managed Service for Apache Spark di GKE

Managed Service untuk Apache Spark di GKE memungkinkan Anda menjalankan aplikasi Big Data menggunakan Managed Service untuk Apache Spark jobs API di cluster GKE. Gunakankonsol Google Cloud , Google Cloud CLI, atau Managed Service untuk Apache Spark API (permintaan HTTP atau Cloud Client Libraries) untuk membuat cluster virtual Managed Service untuk Apache Spark di GKE, lalu kirimkan tugas Spark, PySpark, SparkR, atau Spark-SQL ke Managed Service untuk Apache Spark layanan.

Managed Service untuk Apache Spark di GKE mendukung versi Spark 3.5.

Cara kerja Managed Service untuk Apache Spark di GKE

Managed Service untuk Apache Spark di GKE men-deploy cluster virtual Managed Service untuk Apache Spark di cluster GKE. Tidak seperti cluster Managed Service untuk Apache Spark di Compute Engine, cluster virtual Managed Service untuk Apache Spark di GKE tidak menyertakan VM master dan pekerja terpisah. Sebagai gantinya, saat Anda membuat cluster virtual Managed Service untuk Apache Spark di GKE, Managed Service untuk Apache Spark di GKE akan membuat node pool dalam cluster GKE. Tugas Managed Service untuk Apache Spark di GKE dijalankan sebagai pod di node pool ini. Node pool dan penjadwalan pod di node pool dikelola oleh GKE.