Professional-Data-Engineer 試験問題 306
航空宇宙会社では、独自のデータ形式を使用して夜間データを保存しています。この新しいデータ ソースを BigQuery に接続し、データを BigQuery にストリーミングする必要があります。できるだけ少ないリソースで効率的にデータを BigQuery にインポートしたいと考えています。どうすればよいでしょうか。
Professional-Data-Engineer 試験問題 307
マネージド Hadoop システムをデータ レイクとして構築したいと考えています。データ変換プロセスは、順番に実行される一連の Hadoop ジョブで構成されます。ストレージとコンピューティングを分離する設計を実現するために、すべての入力データ、出力データ、中間データを格納するために Cloud Storage コネクタを使用することにしました。
a. ただし、オンプレミスのベアメタル Hadoop 環境 (100 GB RAM を搭載した 8 コア ノード) と比較すると、Cloud Dataproc では 1 つの Hadoop ジョブの実行速度が非常に遅いことに気付きました。分析の結果、この特定の Hadoop ジョブはディスク I/O を大量に消費することがわかりました。この問題を解決したいと考えています。どうすればよいですか。
a. ただし、オンプレミスのベアメタル Hadoop 環境 (100 GB RAM を搭載した 8 コア ノード) と比較すると、Cloud Dataproc では 1 つの Hadoop ジョブの実行速度が非常に遅いことに気付きました。分析の結果、この特定の Hadoop ジョブはディスク I/O を大量に消費することがわかりました。この問題を解決したいと考えています。どうすればよいですか。
Professional-Data-Engineer 試験問題 308
あなたの会社は、リアルタイムデータを分析してさまざまなオファーを提供する最初のダイナミックキャンペーンを実施しています。
ホリデーシーズン中、データサイエンティストは毎年急速に増え続けるテラバイト単位のデータを収集しています。
30日間のキャンペーン期間中、Google Cloud Dataflowを使用してデータを前処理し、
Google Cloud Bigtable の機械学習モデルに必要な特徴 (シグナル) データを収集します。
チームは、初期ロードの 10 TB のデータの読み取りと書き込みで、最適ではないパフォーマンスを確認しています。
コストを最小限に抑えながらパフォーマンスを向上したいと考えています。どうすればよいでしょうか?
ホリデーシーズン中、データサイエンティストは毎年急速に増え続けるテラバイト単位のデータを収集しています。
30日間のキャンペーン期間中、Google Cloud Dataflowを使用してデータを前処理し、
Google Cloud Bigtable の機械学習モデルに必要な特徴 (シグナル) データを収集します。
チームは、初期ロードの 10 TB のデータの読み取りと書き込みで、最適ではないパフォーマンスを確認しています。
コストを最小限に抑えながらパフォーマンスを向上したいと考えています。どうすればよいでしょうか?
Professional-Data-Engineer 試験問題 309
Pub/Sub サブスクリプションから直接データを取り込む BigQuery テーブルがあります。取り込まれたデータは、Google が管理する暗号鍵で暗号化されます。保存データを暗号化するには、一元化された Cloud Key Management Service(Cloud KMS)プロジェクトの鍵を使用する必要があるという新しい組織ポリシーを満たす必要があります。どうすればよいでしょうか。
Professional-Data-Engineer 試験問題 310
Dataproc クラスタ インスタンス上のソフトウェアをカスタマイズする方法ではないものはどれですか。

