Associate-Developer-Apache-Spark 試験問題 11

次のコード ブロックのうち、列名と型の両方を含むデータフレームの構造をツリー状に示しているものはどれですか?
  • Associate-Developer-Apache-Spark 試験問題 12

    次のコード ブロックは、CSV ファイル ヘッダーで定義された列名を使用して、ディレクトリ filePath 内のすべての CSV ファイルを単一のデータフレームに読み取りますか?
    ディレクトリファイルパスの内容:
    1._成功
    2._committed_2754546451699747124
    3._開始_2754546451699747124
    4.part-00000-tid-2754546451699747124-10eb85bf-8d91-4dd0-b60b-2f3c02eeecaa-298-1-c000.csv.gz
    5.part-00001-tid-2754546451699747124-10eb85bf-8d91-4dd0-b60b-2f3c02eeecaa-299-1-c000.csv.gz
    6.part-00002-tid-2754546451699747124-10eb85bf-8d91-4dd0-b60b-2f3c02eeecaa-300-1-c000.csv.gz
    7.part-00003-tid-2754546451699747124-10eb85bf-8d91-4dd0-b60b-2f3c02eeecaa-301-1-c000.csv.gz spar.option("header",True).csv(filePath)
  • Associate-Developer-Apache-Spark 試験問題 13

    以下に表示されているコード ブロックにはエラーが含まれています。コード ブロックは、2 つの列の情報を使用して DataFrame トランザクション Df の行を順序どおりに配置する必要があります。最初に列の値ごとに配置し、上部に小さい数値を表示し、下部に大きい数値を表示します。次に列 predError ごとに配置し、すべての値を表示する必要があります。列値の項目の順序と逆の方法で配置されます。エラーを見つけてください。
    コードブロック:
    transactionsDf.orderBy('value', asc_nulls_first(col('predError')))
  • Associate-Developer-Apache-Spark 試験問題 14

    次のコード ブロックは、filePath に格納されている 2 つのパーティションの寄木細工ファイルを読み取り、各パーティションのスキーマが異なる場合でもすべての列が 1 回だけ含まれることを確認しますか?
    最初のパーティションのスキーマ:
    1.ルート
    2. |-- トランザクション ID: 整数 (null 許容 = true)
    3. |-- predError: 整数 (null 許容 = true)
    4. |-- 値: 整数 (null 許容 = true)
    5. |--storeId: 整数 (null 許容 = true)
    6. |-- productId: 整数 (null 許容 = true)
    7. |-- f: 整数 (null 許容 = true)
    2 番目のパーティションのスキーマ:
    1.ルート
    2. |-- トランザクション ID: 整数 (null 許容 = true)
    3. |-- predError: 整数 (null 許容 = true)
    4. |-- 値: 整数 (null 許容 = true)
    5. |--storeId: 整数 (null 許容 = true)
    6. |-- rollId: 整数 (null 許容 = true)
    7. |-- f: 整数 (null 許容 = true)
    8. |--tax_id: 整数 (null 可能 = false)
  • Associate-Developer-Apache-Spark 試験問題 15

    メモリ不足エラーの削減に関する次の記述のうち、間違っているものはどれですか?