Associate-Developer-Apache-Spark 試験問題 31
有効な実行モードは次のうちどれですか?
Associate-Developer-Apache-Spark 試験問題 32
以下に表示されているコード ブロックにはエラーが含まれています。以下のコード ブロックが実行されると、列storeId とtransactionDate (この順序) に基づいて、DataFrame のtransactionDf が 14 の部分に分割されているはずです。エラーを見つけてください。
コードブロック:
transactionDf.coalesce(14, ("storeId", "transactionDate"))
コードブロック:
transactionDf.coalesce(14, ("storeId", "transactionDate"))
Associate-Developer-Apache-Spark 試験問題 33
以下に表示されているコード ブロックにはエラーが含まれています。コード ブロックは、Python メソッド find_most_freq_letter を使用して、DataFrame itemsDf の列 itemName に最も多く存在する文字を検索し、それを新しい列 most_frequent_letter で返す必要があります。エラーを見つけてください。
コードブロック:
1. find_most_freq_letter_udf = udf(find_most_freq_letter)
2. itemsDf.withColumn("most_frequent_letter", find_most_freq_letter("itemName"))
コードブロック:
1. find_most_freq_letter_udf = udf(find_most_freq_letter)
2. itemsDf.withColumn("most_frequent_letter", find_most_freq_letter("itemName"))
Associate-Developer-Apache-Spark 試験問題 34
以下に表示されているコード ブロックにはエラーが含まれています。コード ブロックは、結合または集計のためにエグゼキューター間でデータを交換するときに、データを 20 の部分に分割するように Spark を構成する必要があります。エラーを見つけてください。
コードブロック:
スパーク.conf.set(spark.sql.shuffle.partitions, 20)
コードブロック:
スパーク.conf.set(spark.sql.shuffle.partitions, 20)
Associate-Developer-Apache-Spark 試験問題 35
ブロードキャスト変数に関する次の記述のうち、正しいものはどれですか?
