DP-600J 試験問題 81

ケーススタディ 2 - Litware, Inc
概要
Litware, Inc. は、北米全域にオフィスを構える製造会社です。Litware の分析チームには、データ エンジニア、分析エンジニア、データ アナリスト、データ サイエンティストが所属しています。
既存の環境
ファブリック環境
Litware は 3 年間 Microsoft Power BI テナントを使用しています。Litware では Fabric の機能と機能を有効にしていません。
利用可能なデータ
Litware には、次の表に示すように分析する必要があるデータがあります。

製品データには、1 つのテーブルと次の列が含まれています。

顧客満足度データには次の表が含まれています。
- 調査
- 質問
- 応答
提出された調査ごとに、次の処理が行われます。
- 調査テーブルに 1 行が追加されます。
- アンケートの質問ごとに、回答テーブルに 1 行が追加されます。
- 質問テーブルには、各アンケートの質問のテキストが含まれています。各アンケートの回答の 3 番目の質問は、全体的な満足度スコアです。顧客は、購入ごとにアンケートを送信できます。
ユーザーの問題
分析チームには大量のデータがあり、その一部は半構造化されています。チームは Fabric を使用して新しいデータ ストアを作成したいと考えています。
製品データは、多くの場合、高、中、低の 3 つの価格グループに分類されます。このロジックは、いくつかのデータベースとセマンティック モデルに実装されていますが、実装間でロジックが必ずしも一致するとは限りません。
要件
計画された変更
Litware は、既存のテナントで Fabric 機能を有効にする予定です。分析チームは、概念実証 (PoC) として新しいデータ ストアを作成します。残りの Liware ユーザーは、PoC が完了した後にのみ Fabric 機能にアクセスできるようになります。PoC は、Fabric の試用容量を使用して完了します。次の 3 つのワークスペースが作成されます。
- AnalyticsPOC: データストア、セマンティックモデル、レポートパイプライン、データフロー、およびデータストアへのデータ入力に使用されるノートブックが含まれます。
- DataEngPOC: OneLakeにデータを入力するために使用されるすべてのパイプライン、データフロー、ノートブックが含まれます
- DataSciPOC: データ サイエンティストが作成したすべてのノートブックとレポートが含まれます。AnalyticsPOC ワークスペースには次のものが作成されます。
- データストア(種類は未定)
- カスタムセマンティックモデル
- デフォルトのセマンティックモデル
インタラクティブレポート
データ エンジニアは、データ ソースに応じて、1 時間ごとまたは毎日 OneLake にデータをロードするためのデータ パイプラインを作成します。分析エンジニアは、毎日、AnalyticsPOC ワークスペースのデータ ストアにデータを取り込んで変換し、ロードするプロセスを作成します。データ エンジニアは、可能な限り、データの取り込みにローコード ツールを使用します。使用するデータ クレンジングおよび変換ツールの選択は、データ エンジニアの裁量に委ねられます。
Analytics POC ワークスペース内のすべてのセマンティック モデルとレポートは、データ ストアを唯一のデータ ソースとして使用します。
技術要件
データ ストアは以下をサポートする必要があります。
- T-SQLまたはPythonを使用した読み取りアクセス
- 半構造化データと非構造化データ
- T-SQLクエリを実行するユーザー向けの行レベルセキュリティ(RLS)
データ エンジニアが OneLake にロードするファイルは Parquet 形式で保存され、Delta Lake の仕様に準拠します。
データは、AnalyticsPOC データ ストアの 1 つの領域に変換されずにロードされます。その後、データはクレンジングされ、マージされ、ディメンション モデルに変換されます。データ ロード プロセスでは、ディメンション モデルにデータを入力する前に、生データとクレンジング済みデータが完全に更新されていることを確認する必要があります。ディメンション モデルには日付ディメンションが含まれている必要があります。日付ディメンションの既存のデータ ソースはありません。Litware の会計年度は暦年と一致します。日付ディメンションには、常に 2010 年から現在の年末までの日付が含まれている必要があります。
製品価格設定グループのロジックは、分析エンジニアが 1 か所で管理する必要があります。価格設定グループのデータは、T-SOL クエリのデータ ストアとデフォルトのセマンティック モデルで使用できるようにする必要があります。次のロジックを使用する必要があります。
- 定価が 50 以下の場合は、低価格グループに入ります。
- 定価が 50 より大きく 1,000 以下の場合は、中価格グループになります。
- 定価が 1,000 を超える場合は、高価格グループに入ります。
セキュリティ要件
PoC の一環として作成された Fabric アイテムは、Fabric 管理者と分析チームのみが表示できる必要があります。
Litware は、AnalyticsPOC ワークスペースの Fabric 項目に対して次のセキュリティ要件を特定します。
- Fabric 管理者はワークスペース管理者になります。
- データ エンジニアは、データ ストアの読み取りと書き込みができる必要があります。データセットやレポートへのアクセス権は付与しないでください。
- 分析エンジニアは、データ ストアのスキーマの読み取り、書き込み、作成ができる必要があります。また、データ アナリストとセマンティック モデルを作成して共有し、ワークスペース内のすべてのレポートを表示および変更できる必要があります。
- データサイエンティストはデータストアから読み取ることはできるが、書き込むことはできない。データサイエンティストはSparkノートブックを使用してデータにアクセスします。
- データ アナリストは、データ ストア内のディメンション モデル オブジェクトのみに対する読み取りアクセス権を持っている必要があります。また、分析エンジニアが作成したセマンティック モデルを使用して Power BI レポートを作成するためのアクセス権も持っている必要があります。
- 日付ディメンションは、データ ストアのすべてのユーザーが利用できる必要があります。
- 最小権限の原則に従う必要があります。
既定のセマンティック モデルとカスタム セマンティック モデルの両方に、データ ストア内のディメンション モデルのテーブルまたはビューのみを含める必要があります。Litware には、既に次の Microsoft Entra セキュリティ グループがあります。
FabricAdmins: ファブリック管理者
- AnalyticsTeam: 分析チームの全メンバー
- DataAnalysts: 分析チームのデータアナリスト
- データサイエンティスト: 分析チームのデータサイエンティスト
- データエンジニア: 分析チームのデータエンジニア
- AnalyticsEngineers: 分析チームの分析エンジニア
レポート要件
データ アナリストは、次の要件を満たす顧客満足度レポートを作成する必要があります。
- ユーザーが製品を選択して、顧客調査の回答をその製品を購入したユーザーのみにフィルタリングできるようにします。
- 選択した日付までの過去 12 か月間に送信されたすべてのアンケートの平均総合満足度スコアを表示します。
- データ ストアでデータが更新されるとすぐにデータが表示されます。
- レポートとセマンティック モデルに現在の年と前年のデータのみが含まれていることを確認します。
- レポートがソース データ ストアで指定されたテーブル レベルのセキュリティに準拠していることを確認します。
- レポート クエリの実行時間を最小限に抑えます。
ホットスポットに関する質問
全体的な満足度の平均スコアを計算するには、DAX メジャーを作成する必要があります。
DAX コードをどのように完成させる必要がありますか? 回答するには、回答領域で適切なオプションを選択してください。
注意: 正しい選択ごとに 1 ポイントが付与されます。

DP-600J 試験問題 82

注: この質問は、同じシナリオを提示する一連の質問の一部です。一連の質問にはそれぞれ、定められた目標を満たす独自の解決策が含まれています。質問セットによっては、正しい解決策が複数ある場合もあれば、正しい解決策がない場合もあります。
このセクションで質問に答えた後は、そのセクションに戻ることはできません。そのため、これらの質問はレビュー画面に表示されません。
Lakehouse1 という名前のレイクハウスを含む Fabric テナントがあります。Lakehouse1 には、Customer という名前の Delta テーブルが含まれています。
Customer にクエリを実行すると、クエリの実行が遅いことがわかります。テーブルでメンテナンスが実行されていないことが疑われます。
顧客に対してメンテナンス タスクが実行されたかどうかを特定する必要があります。
解決策: 次の Spark SQL ステートメントを実行します: DESCRIBE HISTORY customer これは目標を満たしていますか?
  • DP-600J 試験問題 83

    Fabric テナントがあります。
    Fabric Data Factory パイプラインを作成しています。
    アクティブ顧客の数と現在の月の平均売上を返すストアド プロシージャがあります。
    ウェアハウスでストアド プロシージャを実行するアクティビティを追加する必要があります。返された値は、パイプラインの下流のアクティビティで使用できる必要があります。
    どのような種類のアクティビティを追加する必要がありますか?
  • DP-600J 試験問題 84

    注: この質問は、同じシナリオを提示する一連の質問の一部です。一連の質問にはそれぞれ、定められた目標を満たす独自の解決策が含まれています。質問セットによっては、正しい解決策が複数ある場合もあれば、正しい解決策がない場合もあります。
    このセクションで質問に答えた後は、そのセクションに戻ることはできません。そのため、これらの質問はレビュー画面に表示されません。
    Model1 という名前のセマンティック モデルを含む Fabric テナントがあります。
    次のクエリは Model1 に対して実行が遅いことがわかります。

    クエリの実行時間を短縮する必要があります。
    解決策: 次のコードを使用して 4 行目を置き換えます。
    空ではありません ( CALCULATETABLE ( '注文品目 ' ) )
    これは目標を満たしていますか?