Running Jobs on Managed Apache Spark Reviews

46105 reviews

This code didn't work Py4JavaError on last line: from pyspark.sql import SparkSession, SQLContext, Row gcs_bucket='378837530308' spark = SparkSession.builder.appName("kdd").getOrCreate() sc = spark.sparkContext data_file = "gs://"+gcs_bucket+"//kddcup.data_10_percent.gz" raw_rdd = sc.textFile(data_file).cache() raw_rdd.take(5)

Louise O. · Reviewed حوالي 3 سنوات ago

Zaklina P. · Reviewed حوالي 3 سنوات ago

Stergios M. · Reviewed حوالي 3 سنوات ago

Zainab A. · Reviewed حوالي 3 سنوات ago

tushar s. · Reviewed حوالي 3 سنوات ago

Rhaydrick S. · Reviewed حوالي 3 سنوات ago

Rongzhi Z. · Reviewed حوالي 3 سنوات ago

Eduardo G. · Reviewed حوالي 3 سنوات ago

Provides an average understanding. Some of the button names have been updated on the tool/ dataproc compared to the instructions but was able to figure it out

Mario D. · Reviewed حوالي 3 سنوات ago

Yaozhi L. · Reviewed حوالي 3 سنوات ago

Aleksandr A. · Reviewed حوالي 3 سنوات ago

Daniel V. · Reviewed حوالي 3 سنوات ago

Fatih S. · Reviewed حوالي 3 سنوات ago

Guillaume P. · Reviewed حوالي 3 سنوات ago

complex

Maximiliano A. · Reviewed حوالي 3 سنوات ago

Ignacio V. · Reviewed حوالي 3 سنوات ago

Paweł M. · Reviewed حوالي 3 سنوات ago

Olesya S. · Reviewed حوالي 3 سنوات ago

Ajay T. · Reviewed حوالي 3 سنوات ago

Hajer D. · Reviewed حوالي 3 سنوات ago

Barış A. · Reviewed حوالي 3 سنوات ago

Gastón E. · Reviewed حوالي 3 سنوات ago

Dejan J. · Reviewed حوالي 3 سنوات ago

Yannic H. · Reviewed حوالي 3 سنوات ago

Learnt how to make use of Cloud Storage instead of HDFS to stage data

Ali H. · Reviewed حوالي 3 سنوات ago

We do not ensure the published reviews originate from consumers who have purchased or used the products. Reviews are not verified by Google.