Dans ce deuxième volet de la série de cours sur Dataflow, nous allons nous intéresser de plus près au développement de pipelines à l'aide du SDK Beam. Nous allons commencer par passer en revue les concepts d'Apache Beam. Nous allons ensuite parler du traitement des données par flux à l'aide de fenêtres, de filigranes et de déclencheurs. Nous passerons ensuite aux options de sources et de récepteurs dans vos pipelines, aux schémas pour présenter vos données structurées, et nous verrons comment effectuer des transformations avec état à l'aide des API State et Timer. Nous aborderons ensuite les bonnes pratiques qui vous aideront à maximiser les performances de vos pipelines. Vers la fin du cours, nous présentons le langage SQL et les DataFrames pour représenter votre logique métier dans Beam, et nous expliquons comment développer des pipelines de manière itérative à l'aide des notebooks Beam.
Ce cours est le premier d'une série en trois volets sur le traitement des données sans serveur avec Dataflow. Dans ce premier cours, nous allons commencer par rappeler ce qu'est Apache Beam et sa relation avec Dataflow. Ensuite, nous aborderons la vision d'Apache Beam et les avantages de son framework de portabilité, qui permet aux développeurs d'utiliser le langage de programmation et le backend d'exécution de leur choix. Nous vous montrerons aussi comment séparer le calcul du stockage et économiser de l'argent grâce à Dataflow, puis nous examinerons les interactions entre les outils de gestion de l'identification et des accès avec vos pipelines Dataflow. Enfin, nous verrons comment implémenter le modèle de sécurité adapté à votre cas d'utilisation sur Dataflow.
Obtenez un badge de compétence en suivant le cours Partager des données avec Google Data Cloud. Vous pourrez ainsi acquérir une expérience pratique concernant les partenaires de partage de données Google Cloud, qui disposent d'ensembles de données propriétaires que les clients peuvent utiliser pour effectuer des analyses de données. Les clients s'abonnent à ces données et les interrogent dans leur propre plate-forme. Ils les enrichissent ensuite avec leurs propres ensembles de données et utilisent leurs outils de visualisation pour les tableaux de bord destinés à leur clientèle.
Terminez le cours d'introduction Préparer des données pour les API de ML sur Google Cloud pour recevoir un badge démontrant vos compétences dans les domaines suivants : le nettoyage des données avec Dataprep by Trifacta, l'exécution de pipelines de données dans Dataflow, la création de clusters et l'exécution de jobs Apache Spark dans Managed Service for Apache Spark, et l'appel d'API de ML comme l'API Cloud Natural Language, l'API Google Cloud Speech-to-Text et l'API Video Intelligence.
Terminez le cours avancé Déployer des architectures multi-agents pour recevoir un badge démontrant les compétences suivantes : créer des systèmes multi-agents avec ADK, connecter des agents avec le protocole A2A (Agent-to-Agent), intégrer des outils externes à l'aide du protocole MCP (Model Context Protocol) et déployer une solution multi-agents complète sur Agent Engine.
Obtenez un badge de compétence en suivant le cours Analyse de flux dans BigQuery, où vous utiliserez Pub/Sub, Dataflow et BigQuery ensemble pour diffuser des données afin de les analyser.
Terminez le cours intermédiaire Créer un entrepôt de données avec BigQuery pour recevoir un badge démontrant vos compétences dans les domaines suivants : la jointure de données pour créer des tables, la résolution des problèmes liés aux jointures, l'ajout de données avec des unions, la création de tables partitionnées par date, et l'utilisation d'objets JSON, ARRAY et STRUCT dans BigQuery.
Suivez le cours Déployer et gérer des applications sur Google App Engine et obtenez un badge de compétence. Dans ce cours, vous apprendrez à utiliser App Engine avec Python, Go et PHP.
Obtenez un badge de compétence en suivant le cours Google Cloud Compute : principes de base, où vous apprendrez à utiliser des machines virtuelles (VM), des disques persistants et des serveurs Web à l'aide de Compute Engine.