Professional-Machine-Learning-Engineer 試験問題 31

機械学習スペシャリストは、AmazonAthenaを使用してAmazonS3上のデータセットをクエリするプロセスを構築する必要があります。データセットには、プレーンテキストのCSVファイルとして保存された800,000を超えるレコードが含まれています。各レコードには
200列で、サイズは約1.5MBです。ほとんどのクエリは5〜10列のみに及びます。
機械学習スペシャリストは、クエリの実行時間を最小限に抑えるためにデータセットをどのように変換する必要がありますか?
  • Professional-Machine-Learning-Engineer 試験問題 32

    GoogleCloudでディープニューラルネットワークモデルをトレーニングしました。モデルのトレーニングデータの損失は少ないですが、検証データのパフォーマンスが低下しています。モデルが過剰適合に対して弾力性があるようにする必要があります。モデルを再トレーニングするときに、どの戦略を使用する必要がありますか?
  • Professional-Machine-Learning-Engineer 試験問題 33

    トラック会社は、世界中のトラック群からライブ画像データを収集しています。データは急速に増加しており、毎日約100GBの新しいデータが生成されます。同社は、特定のIAMユーザーのみがデータにアクセスできるようにしながら、機械学習のユースケースを調査したいと考えています。
    どのストレージオプションが最も処理の柔軟性を提供し、IAMによるアクセス制御を可能にしますか?
  • Professional-Machine-Learning-Engineer 試験問題 34

    データサイエンティストは、複数のクラスを持つデータセットで多層知覚(MLP)をトレーニングしています。対象のターゲットクラスは、データセット内の他のクラスと比較して一意ですが、許容可能なリコールメトリックを達成していません。データサイエンティストは、MLPの非表示レイヤーの数とサイズを変更しようとしましたが、結果は大幅に改善されていません。リコールを改善するためのソリューションは、可能な限り迅速に実装する必要があります。
    これらの要件を満たすためにどの手法を使用する必要がありますか?
  • Professional-Machine-Learning-Engineer 試験問題 35

    データエンジニアは、顧客のクレジットカード情報を含むデータセットを使用してモデルを構築する必要があります。データエンジニアは、データが暗号化されたままであり、クレジットカード情報が安全であることをどのように確認できますか?