Professional-Data-Engineer 試験問題 171

FirebaseAnalyticsとGoogleBigQueryの無料統合を有効にしました。今すぐFirebase
BigQueryでapp_events_YYYYMMDDの形式で毎日新しいテーブルを自動的に作成します。
レガシーSQLで過去30日間のすべてのテーブルをクエリします。あなたは何をするべきか?
  • Professional-Data-Engineer 試験問題 172

    あなたの会社は1時間に20,000個のファイルを作成しています。各データファイルは、コンマ区切りの値としてフォーマットされます
    (CSV)4KB未満のファイル。すべてのファイルは、GoogleCloudPlatformで取り込む前に取り込む必要があります
    処理されました。会社のサイトは、GoogleCloudとインターネット接続に対して200ミリ秒の遅延があります
    帯域幅は50Mbpsに制限されています。現在、の仮想マシンにセキュアFTP(SFTP)サーバーを展開しています
    データ取り込みポイントとしてのGoogleComputeEngine。ローカルSFTPクライアントは、専用のマシンで実行されます。
    CSVファイルをそのまま送信します。目標は、前日のデータを含むレポートを利用できるようにすることです。
    毎日午前10時までに幹部。このデザインは、現在の音量にほとんど追いつくことができません。
    帯域幅の使用率はかなり低いですが。
    季節性のため、あなたの会社は次の3つのファイルの数が2倍になると予想していると言われています
    月。あなたはどちらの2つの行動を取るべきですか?(2つ選択してください。)
  • Professional-Data-Engineer 試験問題 173

    あなたの会社は、多数のニューロンとレイヤーを備えたTensorFlowニュートラルネットワークモデルを構築しました。モデルはトレーニングデータによく適合します。ただし、新しいデータに対してテストすると、パフォーマンスが低下します。これに対処するためにどのような方法を採用できますか?
  • Professional-Data-Engineer 試験問題 174

    データウェアハウスとしてGoogleBigQueryを使用しています。ユーザーは、クエリをいつ実行しても、次の単純なクエリの実行が非常に遅いと報告しています。
    SELECT国、州、都市FROM [myproject:mydataset.mytable] GROUP BY国クエリのクエリプランを確認すると、ステージ1の[読み取り]セクションに次の出力が表示されます。

    このクエリの遅延の最も可能性の高い原因は何ですか?
  • Professional-Data-Engineer 試験問題 175

    Dataprocクラスター内の仮想マシンがジョブを実行できるようにするために使用するサービスアカウントに、どのロールを割り当てる必要がありますか?