Q43 — AWS SAA-C03 第6章
第 43/65 問 | ← 第6章
Q408. ある研究会社では、オンプレミスのデバイスを用いて分析用のデータを生成しています。同社は、このデータ分析にAWSクラウドを活用したいと考えています。これらのデバイスは .csv ファイルを生成し、SMBファイル共有への書き込みをサポートしています。アナリストはSQLコマンドを用いてデータをクエリできる必要があります。また、アナリストは1日に複数回、定期的にクエリを実行します。 これらの要件を最もコスト効率よく満たすためには、以下のうちどの3つの手順を組み合わせればよいでしょうか?(3つ選択)
- A. オンプレミスにAWS Storage GatewayをAmazon S3 File Gatewayモードで展開する ✓
- B. オンプレミスにAWS Storage GatewayをAmazon FSx File Gatewayモードで展開する
- C. Amazon S3内にあるデータに基づいてテーブルを作成するようAWS Glueクローラーを設定する ✓
- D. Amazon S3内のデータをクエリするためのEMR File System(EMRFS)を備えたAmazon EMRクラスターを設定し、アナリストにアクセス権を付与する
- E. Amazon S3内のデータをクエリするためのAmazon Redshiftクラスターを設定し、アナリストにアクセス権を付与する
- F. Amazon S3内のデータをクエリするためのAmazon Athenaを設定し、アナリストにアクセス権を付与する ✓
正解: A. オンプレミスにAWS Storage GatewayをAmazon S3 File Gatewayモードで展開する, C. Amazon S3内にあるデータに基づいてテーブルを作成するようAWS Glueクローラーを設定する, F. Amazon S3内のデータをクエリするためのAmazon Athenaを設定し、アナリストにアクセス権を付与する
解説
要件を満たす最もコスト効果の高いアプローチは以下の3つです: ・デバイスがSMBファイル共有への書き込みをサポートしているため、AWS Storage GatewayのS3 File Gateway(オプションA)をオンプレミスに導入することで、SMB共有としてマウント可能な形でデータをAmazon S3にシームレスに送信できます。これは低コストかつ管理負荷が少なく、専用のファイルサーバー(FSx)や高価なストレージソリューションを必要としません。 ・Amazon S3に格納されたCSVデータをSQLでクエリ可能にするには、メタデータ(スキーマ)を定義する必要があります。AWS Glueクローラー(オプションC)は、S3内のデータ構造を自動検出し、Glue Data Catalogにテーブルを登録するため、Athenaや他の分析サービスとの連携に最適です。 ・アナリストが「定期的に」クエリを実行し、かつ「コスト効果」が重視される場合、サーバーレスで課金がクエリ実行量ベースのAmazon Athena(オプションF)が最も適しています。EMR(D)やRedshift(E)は常駐クラスターが必要で、継続的な稼働コストが発生するため、本ユースケースでは過剰です。また、FSx File Gateway(B)はWindowsネイティブファイルシステム向けであり、SMB経由のCSVデータをS3に転送する目的には不適切(S3 File Gatewayの方がシンプルかつ低コスト)です。