Professional-Machine-Learning-Engineer 試験問題 51

機械学習スペシャリストは、アプリケーション用のカスタムビデオレコメンデーションモデルを開発しています。このモデルのトレーニングに使用されるデータセットは非常に大きく、数百万のデータポイントがあり、AmazonS3バケットでホストされています。
スペシャリストは、移動に数時間かかり、ノートブックインスタンスに接続されている5GBのAmazonEBSボリュームを超えるため、このすべてのデータをAmazonSageMakerノートブックインスタンスにロードしないようにしたいと考えています。
スペシャリストがすべてのデータを使用してモデルをトレーニングできるようにするアプローチはどれですか?
  • Professional-Machine-Learning-Engineer 試験問題 52

    100を超える入力特徴を持ち、すべて-1から1までの値を持つ線形モデルを構築しています。多くの特徴が有益ではないと思われます。情報を提供する機能を元の形式のままにして、情報を提供しない機能をモデルから削除する必要があります。どのテクニックを使うべきですか?
  • Professional-Machine-Learning-Engineer 試験問題 53

    Compute EngineでGPUを搭載した仮想マシンを使用して、特定のイメージに存在する政府IDのタイプを予測するコンピュータービジョンモデルをトレーニングする必要があります。次のパラメータを使用します。
    *オプティマイザー:SGD
    *画像の形状= 224x224
    *バッチサイズ= 64
    *エポック= 10
    *詳細= 2
    トレーニング中に、次のエラーが発生します。ResourceExhaustedError:テンソルの割り当て時にメモリ不足(oom)。あなたは何をするべきか?
  • Professional-Machine-Learning-Engineer 試験問題 54

    あなたはモバイルアプリケーションを持っている銀行のMLエンジニアです。経営陣は、指紋に基づいて顧客のIDを検証するアプリのMLベースの生体認証を構築するように依頼しました。指紋は機密性の高い個人情報と見なされ、銀行のデータベースにダウンロードして保存することはできません。このMLモデルをトレーニングしてデプロイするために、どの学習戦略を推奨する必要がありますか?
  • Professional-Machine-Learning-Engineer 試験問題 55

    データサイエンティストは、企業のeコマースプラットフォームの不正なユーザーアカウントを特定する必要があります。同社は、新しく作成されたアカウントが以前に知られている不正なユーザーに関連付けられているかどうかを判断する機能を望んでいます。
    データサイエンティストは、AWS Glueを使用して、取り込み中に会社のアプリケーションログをクレンジングしています。
    データサイエンティストが不正なアカウントを特定できるようにする戦略はどれですか?