Databricks-Certified-Data-Engineer-Associate 試験問題 16
データエンジニアが、Liquid Clustering機能を有効にしたDelta管理テーブルを出力として生成するETLを開発しました。複数のユーザーがこのテーブルを読み取る際に時間遅延の問題を抱えています。データエンジニアは、OPTIMIZEコマンドが明示的に実行されたことをどのように確認できるでしょうか?
Databricks-Certified-Data-Engineer-Associate 試験問題 17
外部テーブルを使用するシナリオを特定してください。
データエンジニアは、パーケットブロンズテーブルを作成する必要があり、それが外部の場所にある特定のパスに保存されるようにしたいと考えています。
このシナリオでは、どのテーブルを作成できますか?
データエンジニアは、パーケットブロンズテーブルを作成する必要があり、それが外部の場所にある特定のパスに保存されるようにしたいと考えています。
このシナリオでは、どのテーブルを作成できますか?
Databricks-Certified-Data-Engineer-Associate 試験問題 18
Delta Live Table パイプラインには、STREAMING LIVE TABLE を使用して定義された 2 つのデータセットが含まれます。また、LIVE TABLE を使用して Delta Lake テーブルソースに対して 3 つのデータセットが定義されます。
このテーブルは、継続パイプラインモードを使用して開発モードで実行するように構成されています。
未処理のデータが存在し、すべての定義が有効であると仮定した場合、パイプラインを更新するために「開始」をクリックした後の予想される結果は何ですか?
このテーブルは、継続パイプラインモードを使用して開発モードで実行するように構成されています。
未処理のデータが存在し、すべての定義が有効であると仮定した場合、パイプラインを更新するために「開始」をクリックした後の予想される結果は何ですか?
Databricks-Certified-Data-Engineer-Associate 試験問題 19
データエンジニアが、運用上の負担を軽減するためにパイプラインタスクを移行しています。ワークスペースはUnity Catalogを使用しており、サーバーレスをサポートするリージョンにあります。エンジニアは、Databricksがインスタンスタイプの自動選択、スケーリングの管理、Photonの適用、およびジョブ実行時のランタイムアップグレードを自動的に処理することを望んでいます。
データエンジニアは、Databricksの制約を遵守しながら、この要件をどのように満たすべきでしょうか?
データエンジニアは、Databricksの制約を遵守しながら、この要件をどのように満たすべきでしょうか?
Databricks-Certified-Data-Engineer-Associate 試験問題 20
Delta Lakeテーブルのデータは、主に以下のどのファイル形式で保存されますか?
