Bigtable mit Managed Service for Apache Spark

Bigtable ist der NoSQL-Big-Data-Datenbank dienst von Google. Dieselbe Datenbank wird auch für viele der Hauptdienste von Google wie etwa die Google-Suche, Analytics, Maps und Gmail verwendet. Bigtable ist darauf ausgelegt, große Datenmengen bei konstant niedriger Latenz und hohem Durchsatz zu verarbeiten. Daher eignet es sich ideal für operative und analytische Anwendungen wie etwa IoT-Anwendungen, Nutzeranalysen und die Untersuchung von Finanzdaten.

Bigtable ist eine hervorragende Option für Apache Spark oder Hadoop , die Apache HBase erfordern. Bigtable unterstützt die Apache HBase APIs ab Version 1.0 und 2.0 und bietet einen Bigtable HBase-Client in Maven, mit dem Sie Bigtable mit dem Managed Service for Apache Spark verwenden können.

Bigtable Spark-Connector verwenden

Mit dem Bigtable Spark-Connector können Sie Daten aus Bigtable lesen und in Bigtable schreiben. Sie können Daten in Ihrer Spark-Anwendung mit Spark SQL und DataFrames lesen. Für Jobs, bei denen nur Daten gelesen werden, können Sie serverloses Computing mit Data Boost verwenden. Data Boost ist auf die Leistungsanforderungen von Jobs und Abfragen mit hohem Durchsatz ausgelegt. So können Sie vermeiden, dass der Traffic Ihres Clusters, der Ihre Anwendung bereitstellt, beeinträchtigt wird, wenn diese Jobs und Abfragen ausgeführt werden.

Weitere Informationen finden Sie unter Bigtable Spark Connector verwenden.

Nächste Schritte

  • Weitere Informationen zur Verwendung von Bigtable finden Sie in der Bigtable Dokumentation.