Andrew Gazelka
10/08/2024, 8:59 PMAndrew Gazelka
10/08/2024, 9:00 PMAndrew Gazelka
10/08/2024, 9:00 PMAndrew Gazelka
10/08/2024, 9:00 PMAndrew Gazelka
10/08/2024, 9:14 PMAndrew Gazelka
10/08/2024, 9:14 PMDesmond Cheong
10/08/2024, 9:18 PMdf = spark.range(5)
df.write.mode("overwrite").parquet("myparquet.parquet")
is just a convenient way for you to generate a parquet file. For spark connect, let's just focus on one line:
df.filter(col("id") > 2).withColumn("id2", col("id") + 2).show()Andrew Gazelka
10/08/2024, 9:58 PMAndrew Gazelka
10/08/2024, 10:00 PMColin Ho
10/08/2024, 10:08 PMAndrew Gazelka
10/08/2024, 10:08 PMAndrew Gazelka
10/08/2024, 10:08 PM