Databricks-Certified-Data-Engineer-Professional 試験問題 91

データエンジニアがLakeflow Declarative Pipelineを使用して、ソースのBronzeテーブル(user_bronze)からターゲットのSilverテーブル(user_silver)へ行の削除を伝播させています。エンジニアは、パイプラインの実行中にuser_bronzeで削除された行がuser_silverの対応する行も自動的に削除されるようにしたいと考えています。
どの構成であれば、ブロンズテーブルでの削除がシルバーテーブルにも確実に反映されますか?
  • Databricks-Certified-Data-Engineer-Professional 試験問題 92

    データエンジニアが、Databricks SQL 上で実行される Delta Lake クエリの実行速度が遅い問題のトラブルシューティングを行っています。このクエリは複雑な結合と大規模なデータセットを含んでいます。エンジニアは、根本原因が不適切なデータスキップ、非効率的な結合戦略、または過剰なデータシャッフルに関連しているかどうかを特定する必要があります。Databricks のネイティブツールを使用して、特定のボトルネックを特定するには、どの方法を用いるべきでしょうか?
  • Databricks-Certified-Data-Engineer-Professional 試験問題 93

    マーケティングチームは集計テーブルでデータを営業組織と共有しようとしていますが、両チームが使用するフィールド名が一致しておらず、マーケティング固有のフィールドのいくつかは営業組織で承認されていません。
    以下の解決策のうち、シンプルさを重視しつつ状況に対応できるものはどれですか?
  • Databricks-Certified-Data-Engineer-Professional 試験問題 94

    本番ワークロードでは、外部の変更データキャプチャフィードからの更新をデルタレイクテーブルに段階的に適用する常時稼働の構造化ストリームジョブが実行されます。このテーブルのデータが最初に移行された際、OPTIMIZEが実行され、ほとんどのデータファイルが1GBにリサイズされました。ストリーミング本番ジョブでは、自動最適化と自動圧縮の両方が有効になっています。最近のデータファイルの確認では、ほとんどのデータファイルが64MB未満であることが判明しましたが、テーブル内の各パーティションには少なくとも1GBのデータが含まれており、テーブル全体のサイズは10TBを超えています。
    次のうち、ファイルサイズが小さくなった理由として最も可能性が高いのはどれですか?
  • Databricks-Certified-Data-Engineer-Professional 試験問題 95

    データエンジニアが、Pythonライブラリを介してOpenAIを呼び出す不正検出パイプラインを構築しており、APIを使用する際にアクセストークンを含める必要があります。データエンジニアは、シークレットを作成するためにどのDatabricks CLIコマンドを使用すべきでしょうか?