Associate-Developer-Apache-Spark-3.5 試験問題 36
与えられた条件:
パイソン
コピー編集
スパーク.sparkContext.setLogLevel("<LOG_LEVEL>")
どのセットに Spark ドライバー LOG_LEVEL に適した構成設定が含まれていますか?
パイソン
コピー編集
スパーク.sparkContext.setLogLevel("<LOG_LEVEL>")
どのセットに Spark ドライバー LOG_LEVEL に適した構成設定が含まれていますか?
Associate-Developer-Apache-Spark-3.5 試験問題 37
データエンジニアは、ファイルベースのデータソースを特定の場所に永続化する必要があります。しかし、Spark はデフォルトでウェアハウスディレクトリ(例: /user/hive/warehouse)に書き込みます。これをオーバーライドするには、エンジニアはファイルパスを明示的に定義する必要があります。
データが特定の場所に保存されることを保証するコード行はどれですか?
オプション:
データが特定の場所に保存されることを保証するコード行はどれですか?
オプション:
Associate-Developer-Apache-Spark-3.5 試験問題 38
55 件中 5 件目。
Apache Spark での実行中のジョブ、ステージ、タスク間の関係は何ですか?
Apache Spark での実行中のジョブ、ステージ、タスク間の関係は何ですか?
Associate-Developer-Apache-Spark-3.5 試験問題 39
開発者は、Spark 3.5.0で導入された組み込み関数を活用するために、古いSparkコードをリファクタリングしたいと考えています。既存のコードでは、配列操作を手動で実行しています。次のコードスニペットのうち、Spark 3.5.0の新しい組み込み関数を配列操作に利用しているのはどれですか?


Associate-Developer-Apache-Spark-3.5 試験問題 40
データ エンジニアは、2 つの DataFramesdf1 と df2 を結合する次のコードを記述します。
df1 = spark.read.csv("sales_data.csv") # 約10GB
df2 = spark.read.csv("product_data.csv") # 約 8 MB
結果 = df1.join(df2, df1.product_id == df2.product_id)

Spark はどの結合戦略を使用しますか?
df1 = spark.read.csv("sales_data.csv") # 約10GB
df2 = spark.read.csv("product_data.csv") # 約 8 MB
結果 = df1.join(df2, df1.product_id == df2.product_id)

Spark はどの結合戦略を使用しますか?

