DEA-C01 試験問題 11
データ エンジニアは、AWS eu-west-1 (アイルランド) で Snowflake のデプロイメントに取り組んでいます。エンジニアは、copy into コマンドを使用して、ステージングされたファイルからターゲット テーブルにデータをロードすることを計画しています。有効なソースはどれですか? (3 つ選択してください)
DEA-C01 試験問題 12
ある企業は AWS 上にデータレイクを持っています。データレイクはビジネスユニットからのデータソースを取り込みます。
同社ではクエリに Amazon Athena を使用しています。ストレージ層は、メタデータリポジトリとして AWS Glue データカタログを備えた Amazon S3 です。
同社は、データ サイエンティストやビジネス アナリストがデータを利用できるようにしたいと考えています。
ただし、まず企業では、ユーザーの役割と責任に基づいて、Athena のきめ細かい列レベルのデータ アクセスを管理する必要があります。
これらの要件を満たすソリューションはどれでしょうか?
同社ではクエリに Amazon Athena を使用しています。ストレージ層は、メタデータリポジトリとして AWS Glue データカタログを備えた Amazon S3 です。
同社は、データ サイエンティストやビジネス アナリストがデータを利用できるようにしたいと考えています。
ただし、まず企業では、ユーザーの役割と責任に基づいて、Athena のきめ細かい列レベルのデータ アクセスを管理する必要があります。
これらの要件を満たすソリューションはどれでしょうか?
DEA-C01 試験問題 13
小売企業は、Amazon Aurora PostgreSQL を使用してライブトランザクションデータを処理および保存しています。
同社では、データ ウェアハウスに Amazon Redshift クラスターを使用しています。
抽出、変換、ロード (ETL) ジョブが毎朝実行され、PostgreSQL データベースからの新しいデータで Redshift クラスターを更新します。会社は急速に成長しており、Redshift クラスターのコストを最適化する必要があります。
データ エンジニアは、履歴データをアーカイブするためのソリューションを作成する必要があります。データ エンジニアは、PostgreSQL のライブ トランザクション データ、Redshift の現在のデータ、アーカイブされた履歴データを効果的に組み合わせる分析クエリを実行できる必要があります。コストを削減するために、ソリューションでは、Amazon Redshift に最新の 15 か月分のデータのみを保持する必要があります。
どの手順の組み合わせがこれらの要件を満たしますか? (2 つ選択してください。)
同社では、データ ウェアハウスに Amazon Redshift クラスターを使用しています。
抽出、変換、ロード (ETL) ジョブが毎朝実行され、PostgreSQL データベースからの新しいデータで Redshift クラスターを更新します。会社は急速に成長しており、Redshift クラスターのコストを最適化する必要があります。
データ エンジニアは、履歴データをアーカイブするためのソリューションを作成する必要があります。データ エンジニアは、PostgreSQL のライブ トランザクション データ、Redshift の現在のデータ、アーカイブされた履歴データを効果的に組み合わせる分析クエリを実行できる必要があります。コストを削減するために、ソリューションでは、Amazon Redshift に最新の 15 か月分のデータのみを保持する必要があります。
どの手順の組み合わせがこれらの要件を満たしますか? (2 つ選択してください。)
DEA-C01 試験問題 14
データ エンジニアは、どのような場合に、lateral flatten の組み合わせではなく、flatten 関数を使用してテーブルを使用しますか?
DEA-C01 試験問題 15
ある会社では、Amazon S3 をデータレイクとして使用しています。この会社は、マルチノードの Amazon Redshift クラスターを使用してデータウェアハウスをセットアップします。この会社は、各データファイルのデータソースに基づいて、データレイク内のデータファイルを整理します。
同社は、データ ファイルの場所ごとに個別の COPY コマンドを使用して、すべてのデータ ファイルを Redshift クラスターの 1 つのテーブルにロードします。この方法では、すべてのデータ ファイルをテーブルにロードするのに長い時間がかかります。同社はデータ取り込みの速度を上げる必要があります。同社はプロセスのコストを増やしたくありません。
これらの要件を満たすソリューションはどれでしょうか?
同社は、データ ファイルの場所ごとに個別の COPY コマンドを使用して、すべてのデータ ファイルを Redshift クラスターの 1 つのテーブルにロードします。この方法では、すべてのデータ ファイルをテーブルにロードするのに長い時間がかかります。同社はデータ取り込みの速度を上げる必要があります。同社はプロセスのコストを増やしたくありません。
これらの要件を満たすソリューションはどれでしょうか?
