Running Jobs on Managed Apache Spark Reviews

46105 reviews

This code didn't work Py4JavaError on last line: from pyspark.sql import SparkSession, SQLContext, Row gcs_bucket='378837530308' spark = SparkSession.builder.appName("kdd").getOrCreate() sc = spark.sparkContext data_file = "gs://"+gcs_bucket+"//kddcup.data_10_percent.gz" raw_rdd = sc.textFile(data_file).cache() raw_rdd.take(5)

Louise O. · Reviewed about 3 years ago

Zaklina P. · Reviewed about 3 years ago

Stergios M. · Reviewed about 3 years ago

Zainab A. · Reviewed about 3 years ago

tushar s. · Reviewed about 3 years ago

Rhaydrick S. · Reviewed about 3 years ago

Rongzhi Z. · Reviewed about 3 years ago

Eduardo G. · Reviewed about 3 years ago

Provides an average understanding. Some of the button names have been updated on the tool/ dataproc compared to the instructions but was able to figure it out

Mario D. · Reviewed about 3 years ago

Yaozhi L. · Reviewed about 3 years ago

Aleksandr A. · Reviewed about 3 years ago

Daniel V. · Reviewed about 3 years ago

Fatih S. · Reviewed about 3 years ago

Guillaume P. · Reviewed about 3 years ago

complex

Maximiliano A. · Reviewed about 3 years ago

Ignacio V. · Reviewed about 3 years ago

Paweł M. · Reviewed about 3 years ago

Olesya S. · Reviewed about 3 years ago

Ajay T. · Reviewed about 3 years ago

Hajer D. · Reviewed about 3 years ago

Barış A. · Reviewed about 3 years ago

Gastón E. · Reviewed about 3 years ago

Dejan J. · Reviewed about 3 years ago

Yannic H. · Reviewed about 3 years ago

Learnt how to make use of Cloud Storage instead of HDFS to stage data

Ali H. · Reviewed about 3 years ago

We do not ensure the published reviews originate from consumers who have purchased or used the products. Reviews are not verified by Google.