Configura el acceso a los datos en varias nubes

Obtén información para configurar el acceso a los datos entre nubes para unificar los silos de datos en Amazon Web Services (AWS), Google Cloud, y AlloyDB para PostgreSQL sin ETL complejo.

Usas Lakehouse sin bordes como el centro de inteligencia central, AlloyDB como una fuente de datos operacionales y Managed Service para Apache Spark para el procesamiento vectorizado de alto rendimiento. Por último, usas Gemini para obtener estadísticas empresariales potentes de tu lakehouse.

Situación

En esta situación, tienes datos en las siguientes fuentes:

  • Datos transaccionales (usuarios, pedidos, artículos de pedidos) en una base de datos operacional de AlloyDB
  • Datos de productos en un bucket de AWS S3
  • Registros de eventos de clickstream en Cloud Storage

Unes estos conjuntos de datos para identificar los datos demográficos objetivo de tu próxima campaña de marketing y generar correos electrónicos de comunicación personalizados.

Qué aprenderá

En este codelab, realizarás las siguientes tareas:

  • Configurar y configurar extremos del catálogo de Lakehouse para unificar los silos de datos en AWS S3, Cloud Storage y AlloyDB
  • Ejecutar el procesamiento de consultas vectorizadas de alto rendimiento con Managed Service para Apache Spark
  • Unir conjuntos de datos transaccionales, de productos y de clickstream sin movimiento de datos ni canalizaciones de ETL complejas
  • Usar Gemini para obtener estadísticas empresariales y generar divulgación de marketing personalizada desde tu lakehouse

Realizar el codelab

Inicia el codelab paso a paso:

Comenzar el codelab de Lakehouse sin bordes

¿Qué sigue?