Running Jobs on Managed Apache Spark Reviews
46105 reviews
This code didn't work Py4JavaError on last line: from pyspark.sql import SparkSession, SQLContext, Row gcs_bucket='378837530308' spark = SparkSession.builder.appName("kdd").getOrCreate() sc = spark.sparkContext data_file = "gs://"+gcs_bucket+"//kddcup.data_10_percent.gz" raw_rdd = sc.textFile(data_file).cache() raw_rdd.take(5)
Louise O. · Reviewed בערך 3 שנים ago
Zaklina P. · Reviewed בערך 3 שנים ago
Stergios M. · Reviewed בערך 3 שנים ago
Zainab A. · Reviewed בערך 3 שנים ago
tushar s. · Reviewed בערך 3 שנים ago
Rhaydrick S. · Reviewed בערך 3 שנים ago
Rongzhi Z. · Reviewed בערך 3 שנים ago
Eduardo G. · Reviewed בערך 3 שנים ago
Provides an average understanding. Some of the button names have been updated on the tool/ dataproc compared to the instructions but was able to figure it out
Mario D. · Reviewed בערך 3 שנים ago
Yaozhi L. · Reviewed בערך 3 שנים ago
Aleksandr A. · Reviewed בערך 3 שנים ago
Daniel V. · Reviewed בערך 3 שנים ago
Fatih S. · Reviewed בערך 3 שנים ago
Guillaume P. · Reviewed בערך 3 שנים ago
complex
Maximiliano A. · Reviewed בערך 3 שנים ago
Ignacio V. · Reviewed בערך 3 שנים ago
Paweł M. · Reviewed בערך 3 שנים ago
Olesya S. · Reviewed בערך 3 שנים ago
Ajay T. · Reviewed בערך 3 שנים ago
Hajer D. · Reviewed בערך 3 שנים ago
Barış A. · Reviewed בערך 3 שנים ago
Gastón E. · Reviewed בערך 3 שנים ago
Dejan J. · Reviewed בערך 3 שנים ago
Yannic H. · Reviewed בערך 3 שנים ago
Learnt how to make use of Cloud Storage instead of HDFS to stage data
Ali H. · Reviewed בערך 3 שנים ago
We do not ensure the published reviews originate from consumers who have purchased or used the products. Reviews are not verified by Google.