Associate-Developer-Apache-Spark 試験問題 21

次のコード ブロックのうち、列 productId が 0 以下または 3 であるすべての行を DataFrame トランザクション Df から選択するものはどれですか?
  • Associate-Developer-Apache-Spark 試験問題 22

    アキュムレータの使用に関する問題は次のうちどれですか?
  • Associate-Developer-Apache-Spark 試験問題 23

    DataFrame itemsDf の列サプライヤーのそれぞれの値の隣にある列属性のすべての値のテーブルを作成するには、以下に示すコード ブロックをどの順序で実行する必要がありますか?
    1. itemsDf.createOrReplaceView("itemsDf")
    2.spark.sql("FROM itemsDf SELECT 'サプライヤー',explode('属性')")
    3.spark.sql("FROM itemsDf SELECT サプライヤー、爆発(属性)")
    4. itemsDf.createOrReplaceTempView("itemsDf")
  • Associate-Developer-Apache-Spark 試験問題 24

    データ スキューに関する次の記述のうち、間違っているものはどれですか?
  • Associate-Developer-Apache-Spark 試験問題 25

    以下に示すコード ブロックは、列間の区切り文字としてタブ (\t 文字) を使用し、欠損値を文字列 n/a として表現し、列名のヘッダー行を省略して、DataFrame トランザクション Df を単一の CSV ファイルとしてパス csvPath のディスクに書き込む必要があります。これを達成するには、コード ブロック内の空白を正しく埋める答えを選択してください。
    transactionsDf.__1__.write.__2__(__3__, " ").__4__.__5__(csvPath)