Running Jobs on Managed Apache Spark Reviews
46105 reviews
This code didn't work Py4JavaError on last line: from pyspark.sql import SparkSession, SQLContext, Row gcs_bucket='378837530308' spark = SparkSession.builder.appName("kdd").getOrCreate() sc = spark.sparkContext data_file = "gs://"+gcs_bucket+"//kddcup.data_10_percent.gz" raw_rdd = sc.textFile(data_file).cache() raw_rdd.take(5)
Louise O. · Reviewed حوالي 3 سنوات ago
Zaklina P. · Reviewed حوالي 3 سنوات ago
Stergios M. · Reviewed حوالي 3 سنوات ago
Zainab A. · Reviewed حوالي 3 سنوات ago
tushar s. · Reviewed حوالي 3 سنوات ago
Rhaydrick S. · Reviewed حوالي 3 سنوات ago
Rongzhi Z. · Reviewed حوالي 3 سنوات ago
Eduardo G. · Reviewed حوالي 3 سنوات ago
Provides an average understanding. Some of the button names have been updated on the tool/ dataproc compared to the instructions but was able to figure it out
Mario D. · Reviewed حوالي 3 سنوات ago
Yaozhi L. · Reviewed حوالي 3 سنوات ago
Aleksandr A. · Reviewed حوالي 3 سنوات ago
Daniel V. · Reviewed حوالي 3 سنوات ago
Fatih S. · Reviewed حوالي 3 سنوات ago
Guillaume P. · Reviewed حوالي 3 سنوات ago
complex
Maximiliano A. · Reviewed حوالي 3 سنوات ago
Ignacio V. · Reviewed حوالي 3 سنوات ago
Paweł M. · Reviewed حوالي 3 سنوات ago
Olesya S. · Reviewed حوالي 3 سنوات ago
Ajay T. · Reviewed حوالي 3 سنوات ago
Hajer D. · Reviewed حوالي 3 سنوات ago
Barış A. · Reviewed حوالي 3 سنوات ago
Gastón E. · Reviewed حوالي 3 سنوات ago
Dejan J. · Reviewed حوالي 3 سنوات ago
Yannic H. · Reviewed حوالي 3 سنوات ago
Learnt how to make use of Cloud Storage instead of HDFS to stage data
Ali H. · Reviewed حوالي 3 سنوات ago
We do not ensure the published reviews originate from consumers who have purchased or used the products. Reviews are not verified by Google.