Professional-Data-Engineer 試験問題 136
あなたの会社では、ホリデー シーズン中にリアルタイム データを分析してさまざまなオファーを提供する、初めての動的キャンペーンを実施しています。データ サイエンティストは、30 日間のキャンペーン中に毎時間急増するテラバイト単位のデータを収集しています。彼らは Google Cloud Dataflow を使用してデータを前処理し、Google Cloud Bigtable の機械学習モデルに必要な特徴 (シグナル) データを収集しています。チームは、初期ロードの 10 TB のデータの読み取りと書き込みで、最適ではないパフォーマンスを確認しています。彼らは、コストを最小限に抑えながらこのパフォーマンスを改善したいと考えています。彼らは何をすべきでしょうか。
Professional-Data-Engineer 試験問題 137
パソコンのウェブブラウザから Cloud Dataproc クラスタにウェブ トラフィック データを安全に転送するには、_____ を使用する必要があります。
Professional-Data-Engineer 試験問題 138
Dataproc クラスタ内の仮想マシンがジョブを実行できるようにするには、どのロールをサービス アカウントに割り当てる必要がありますか?
Professional-Data-Engineer 試験問題 139
MJTelcoはデータを共有するためのカスタムインターフェースを構築しています
a. 以下の要件があります。
ペタバイト規模のデータセットを集約する必要があります。
非常に高速な応答時間 (ミリ秒) で特定の時間範囲の行をスキャンする必要があります。
Google Cloud Platform プロダクトのどの組み合わせを推奨すべきでしょうか?
a. 以下の要件があります。
ペタバイト規模のデータセットを集約する必要があります。
非常に高速な応答時間 (ミリ秒) で特定の時間範囲の行をスキャンする必要があります。
Google Cloud Platform プロダクトのどの組み合わせを推奨すべきでしょうか?
Professional-Data-Engineer 試験問題 140
オンプレミスの Hadoop システムを Cloud Dataproc に移行したいと考えています。主に使用しているツールは Hive で、データ形式は Optimized Row Columnar (ORC) です。すべての ORC ファイルは Cloud Storage バケットに正常にコピーされています。パフォーマンスを最大化するには、一部のデータをクラスタのローカル Hadoop 分散ファイル システム (HDFS) に複製する必要があります。Cloud Dataproc で Hive を使い始めるには、どのような 2 つの方法がありますか (2 つ選択してください)。

