Running Jobs on Managed Apache Spark Reviews
46105 reviews
This code didn't work Py4JavaError on last line: from pyspark.sql import SparkSession, SQLContext, Row gcs_bucket='378837530308' spark = SparkSession.builder.appName("kdd").getOrCreate() sc = spark.sparkContext data_file = "gs://"+gcs_bucket+"//kddcup.data_10_percent.gz" raw_rdd = sc.textFile(data_file).cache() raw_rdd.take(5)
Louise O. · Reviewed about 3 years ago
Zaklina P. · Reviewed about 3 years ago
Stergios M. · Reviewed about 3 years ago
Zainab A. · Reviewed about 3 years ago
tushar s. · Reviewed about 3 years ago
Rhaydrick S. · Reviewed about 3 years ago
Rongzhi Z. · Reviewed about 3 years ago
Eduardo G. · Reviewed about 3 years ago
Provides an average understanding. Some of the button names have been updated on the tool/ dataproc compared to the instructions but was able to figure it out
Mario D. · Reviewed about 3 years ago
Yaozhi L. · Reviewed about 3 years ago
Aleksandr A. · Reviewed about 3 years ago
Daniel V. · Reviewed about 3 years ago
Fatih S. · Reviewed about 3 years ago
Guillaume P. · Reviewed about 3 years ago
complex
Maximiliano A. · Reviewed about 3 years ago
Ignacio V. · Reviewed about 3 years ago
Paweł M. · Reviewed about 3 years ago
Olesya S. · Reviewed about 3 years ago
Ajay T. · Reviewed about 3 years ago
Hajer D. · Reviewed about 3 years ago
Barış A. · Reviewed about 3 years ago
Gastón E. · Reviewed about 3 years ago
Dejan J. · Reviewed about 3 years ago
Yannic H. · Reviewed about 3 years ago
Learnt how to make use of Cloud Storage instead of HDFS to stage data
Ali H. · Reviewed about 3 years ago
We do not ensure the published reviews originate from consumers who have purchased or used the products. Reviews are not verified by Google.