Ayoub Selmi
Miembro desde 2024
Liga de Oro
18545 puntos
Miembro desde 2024
Completa el curso para obtener la insignia de habilidad intermedia Realiza análisis de datos predictivos en BigQuery para demostrar habilidades en las siguientes tareas: crear conjuntos de datos en BigQuery importando archivos CSV y JSON; aprovechar la potencia de BigQuery con conceptos analíticos sofisticados de SQL, incluido el uso de BigQuery ML para entrenar un modelo de goles esperados con datos de eventos de fútbol y evaluar la espectacularidad de los goles de la Copa Mundial.
Este curso corresponde a la 1ª parte de una serie de 3 cursos llamada Procesamiento de datos sin servidores con Dataflow. Para comenzar, en el primer curso haremos un repaso de qué es Apache Beam y cómo se relaciona con Dataflow. Luego, hablaremos sobre la visión de Apache Beam y los beneficios que ofrece su framework de portabilidad. Dicho framework hace posible que un desarrollador pueda usar su lenguaje de programación favorito con su backend de ejecución preferido. Después, le mostraremos cómo Dataflow le permite separar el procesamiento y el almacenamiento y, a la vez, ahorrar dinero. También le explicaremos cómo las herramientas de identidad, acceso y administración interactúan con sus canalizaciones de Dataflow. Por último, veremos cómo implementar el modelo de seguridad adecuado en Dataflow según su caso de uso.
Completa la insignia de habilidad introductoria Prepara datos para las APIs de AA en Google Cloud y demuestra tus habilidades para realizar las siguientes actividades: limpiar datos con Dataprep de Trifacta, ejecutar canalizaciones de datos en Dataflow, crear clústeres y ejecutar trabajos de Apache Spark en Dataproc y llamar a APIs de AA, como la API de Cloud Natural Language, la API de Google Cloud Speech-to-Text y la API de Video Intelligence.
Obtén la insignia de habilidad intermedia Ingeniería de datos para crear modelos predictivos con BigQuery ML y demuestra tus capacidades para crear canalizaciones de transformación de datos en BigQuery con Dataprep de Trifacta; usar Cloud Storage, Dataflow y BigQuery para crear flujos de trabajo de extracción, transformación y carga (ETL), y crear modelos de aprendizaje automático con BigQuery ML.
Obtén una insignia de habilidad completando el curso Transmite análisis a BigQuery, en el que usarás Pub/Sub, Dataflow y BigQuery en conjunto para transmitir datos para análisis.
Obtén una insignia de habilidad completando el curso Comparte datos con la nube de datos de Google, en el que obtendrás experiencia práctica con socios de intercambio de datos de Google Cloud, que tienen conjuntos de datos propios que los clientes pueden usar para sus casos de uso de análisis. Los clientes se suscriben a estos datos y los consultan en sus propias plataformas, luego los aumentan con sus conjuntos de datos y usan sus herramientas de visualización en sus paneles para clientes.
Completa la insignia de habilidad intermedia Crea un almacén de datos con BigQuery para demostrar tus habilidades para realizar las siguientes actividades: unir datos para crear tablas nuevas, solucionar problemas de uniones, agregar datos a uniones, crear tablas particionadas por fecha, y trabajar con JSON, arrays y structs en BigQuery.
Completa la insignia de habilidad introductoria del curso Obtén estadísticas a partir de datos de BigQuery y demuestra tus habilidades para realizar las siguientes actividades: escribir consultas en SQL, consultar tablas públicas, cargar datos de muestra en BigQuery, solucionar problemas de errores de sintaxis habituales con el validador de consultas en BigQuery y crear informes en Looker Studio con la conexión a datos de BigQuery.
En este curso intermedio, aprenderás a diseñar, crear y optimizar canalizaciones de datos por lotes sólidas en Google Cloud. Más allá del manejo de datos fundamental, explorarás las transformaciones de datos a gran escala y la organización eficiente de flujos de trabajo, lo que es primordial para la inteligencia empresarial oportuna y los informes esenciales. Obtén experiencia práctica con Dataflow para Apache Beam y Serverless for Apache Spark (Dataproc Serverless) para la implementación, y aborda consideraciones cruciales respecto de la calidad de los datos, la supervisión y las alertas para garantizar la confiabilidad de la canalización y la excelencia operativa. Se recomienda tener conocimientos básicos sobre almacenamiento de datos, ETL/ELT, SQL, Python y conceptos de Google Cloud.
Si bien los enfoques tradicionales de usar data lakes y almacenes de datos pueden ser eficaces, tienen deficiencias, en particular en entornos empresariales grandes. En este curso, se presenta el concepto del data lakehouse y los productos de Google Cloud que se usan para crear uno. Una arquitectura de lakehouse usa fuentes de datos de estándares abiertos y combina las mejores funciones de los data lakes y los almacenes de datos, lo que aborda muchas de sus deficiencias.
Este curso ayuda a los participantes a crear un plan de estudio para el examen de certificación de PDE (Professional Data Engineer). Los alumnos conocerán la amplitud y el alcance de los dominios que se incluyen en el examen. Además, evaluarán su nivel de preparación para el examen y crearán un plan de estudio personal.