Running Jobs on Managed Apache Spark Reviews

46105 reviews

This code didn't work Py4JavaError on last line: from pyspark.sql import SparkSession, SQLContext, Row gcs_bucket='378837530308' spark = SparkSession.builder.appName("kdd").getOrCreate() sc = spark.sparkContext data_file = "gs://"+gcs_bucket+"//kddcup.data_10_percent.gz" raw_rdd = sc.textFile(data_file).cache() raw_rdd.take(5)

Louise O. · Reviewed yaklaşık 3 yıl ago

Zaklina P. · Reviewed yaklaşık 3 yıl ago

Stergios M. · Reviewed yaklaşık 3 yıl ago

Zainab A. · Reviewed yaklaşık 3 yıl ago

tushar s. · Reviewed yaklaşık 3 yıl ago

Rhaydrick S. · Reviewed yaklaşık 3 yıl ago

Rongzhi Z. · Reviewed yaklaşık 3 yıl ago

Eduardo G. · Reviewed yaklaşık 3 yıl ago

Provides an average understanding. Some of the button names have been updated on the tool/ dataproc compared to the instructions but was able to figure it out

Mario D. · Reviewed yaklaşık 3 yıl ago

Yaozhi L. · Reviewed yaklaşık 3 yıl ago

Aleksandr A. · Reviewed yaklaşık 3 yıl ago

Daniel V. · Reviewed yaklaşık 3 yıl ago

Fatih S. · Reviewed yaklaşık 3 yıl ago

Guillaume P. · Reviewed yaklaşık 3 yıl ago

complex

Maximiliano A. · Reviewed yaklaşık 3 yıl ago

Ignacio V. · Reviewed yaklaşık 3 yıl ago

Paweł M. · Reviewed yaklaşık 3 yıl ago

Olesya S. · Reviewed yaklaşık 3 yıl ago

Ajay T. · Reviewed yaklaşık 3 yıl ago

Hajer D. · Reviewed yaklaşık 3 yıl ago

Barış A. · Reviewed yaklaşık 3 yıl ago

Gastón E. · Reviewed yaklaşık 3 yıl ago

Dejan J. · Reviewed yaklaşık 3 yıl ago

Yannic H. · Reviewed yaklaşık 3 yıl ago

Learnt how to make use of Cloud Storage instead of HDFS to stage data

Ali H. · Reviewed yaklaşık 3 yıl ago

We do not ensure the published reviews originate from consumers who have purchased or used the products. Reviews are not verified by Google.