無限ノック › 試験別ガイド › DEA 練習問題一覧

DEA 練習問題一覧

AWS Certified Data Engineer – Associate

データパイプラインの実装・管理・最適化スキルを問うアソシエイト認定 全 396 問(AIオリジナル)

ドメイン1:データの取り込みと変換(114問)

Q1大量の IoT デバイスから Amazon Kinesis Data Streams へデータを送信しています。ネットワーク効率を高め、複数レコードをまとめて送…Q2あるデータエンジニアリングチームは、毎晩実行する複数ステップのデータパイプラインを構築しています。パイプラインのステップは次のとおりです。 ①AWS Glue …Q3AWS Step Functionsでデータ処理ワークフローを設計しています。入力値に応じて異なる処理経路を選択する必要があります。この要件を満たす状態タイプは…Q4マーケティングアナリティクスチームは、Google Ads・Facebook Ads・LinkedIn Adsの3つの広告プラットフォームから毎日CSVファイル…Q5あるアナリティクスチームは、Amazon S3に毎日追加される大量のJSON形式のアプリログ(1日あたり数百GB)をAmazon Athenaで分析しています。…Q6ある小売企業のマーケティングチームは、プログラミングスキルのないビジネスアナリストが、Amazon S3に保存された顧客データのクレンジングと標準化を行う必要が…Q7あるオンラインゲーム会社は、数百万人が同時接続するゲームプラットフォームから、ログイン・レベルクリア・課金などのプレイヤーイベントをAmazon Kinesis…Q8あるeコマース企業は、複数のマイクロサービスがAmazon Kinesis Data Streamsにリアルタイムで注文イベントをAvro形式で書き込んでいます…Q9Kinesis Data Streams を利用するアプリケーションを開発しています。データ送信側では高スループット化が必要で、読み取り側ではシャード管理やチェ…Q10ある EC 企業は、Salesforce を CRM として使用しており、商談(Opportunity)および顧客(Account)データを定期的に Amazo…Q11ある企業では、Salesforceに保存されている顧客情報をAmazon S3のデータレイクへ定期的に取り込み、分析処理を実行しています。開発チームは独自のAP…Q12データエンジニアは、S3にあるJSON形式の生ログデータ(数TB)から特定カラムのみ抽出し、Parquet形式に変換してパーティション化した別S3パスへ保存した…Q13あるデータエンジニアリングチームは、Amazon S3に蓄積された複数形式(CSV、JSON)の生データを分析用に準備する必要があります。以下の要件があります。…Q14データパイプラインでは、レコードの内容によって処理を分岐し、一部は並列実行、さらに各ファイルに対して同じ処理を繰り返す必要があります。AWS Step Func…Q15ある企業では、オンプレミスの Kafka 環境から Amazon MSK へ移行した後、別リージョンの MSK クラスターにも同じトピックデータを継続的に複製し…Q16データ処理ワークフローで、複数の入力ファイルを個別に変換した後、結果をまとめて後続処理へ渡す必要があります。AWS Step Functionsで利用すべき状態…Q17ある営業組織では、Salesforce CRMに蓄積された商談・取引先データを毎日Amazon S3に取り込んでAthenaで分析したい。Salesforce …Q18あるデータエンジニアリングチームは、毎晩実行されるバッチETLを構築しています。処理は「DMSによるRDSスナップショット取り込み→3つのGlueジョブの並列変…Q19ある企業では、Salesforce の商談データを毎日 Amazon S3 に取り込み、分析基盤で利用しています。運用負荷を最小化しながら、SaaS アプリケー…Q20ある映像制作会社は、インターネット接続が不安定な遠隔スタジオで制作した高解像度映像ファイル(合計800TB)を30日以内にAmazon S3へ移行する必要があり…Q21あるメディア企業のマーケティングアナリストチームは、Amazon S3に蓄積されたWebログ・CRM・広告プラットフォームの顧客行動データを分析したい。データに…Q22ある金融データ分析会社は、日次ETLパイプラインとして以下のステップを実行しています。 ①S3へのデータ到着を検知する ②AWS Glue ETLジョブでデータ…Q23あるeコマース企業は、ウェブサイトのクリックストリームデータをAmazon Data Firehoseを使ってAmazon S3に保存しています。各イベントのJ…Q24ある小売企業のデータエンジニアリングチームは、Salesforce CRMシステムの顧客データをAmazon S3データレイクに定期的に取り込む必要があります。…Q25ある医療機関では、複数の病院から毎日異なる形式のCSVファイルで患者の来院データを受信しています。データには以下の品質問題があることが判明しています。 ・日付フ…Q26あるスタートアップは、1日に数回、不定期にデータ変換のSparkジョブを実行しています。各ジョブの実行時間は数分から30分程度でばらつきがあり、ジョブが走ってい…Q27あるデータエンジニアリングチームは、Amazon S3に毎週取り込まれる売上データ(CSV形式)に対して、以下の処理を自動化したいと考えています。 (1) 欠損…Q28ある金融企業は、オンプレミスのOracleデータベースをAmazon Aurora PostgreSQLへ移行予定だが、移行作業中も本番Oracleへの書き込み…Q29eコマース企業は、Amazon Data Firehoseを使って注文イベントをリアルタイムにAmazon S3へ配信しています。各イベントのJSONペイロード…Q30ある企業はAmazon MSK(Managed Streaming for Apache Kafka)を使用して、複数のマイクロサービスからイベントデータをリア…Q31あるデータエンジニアリングチームは、以下の手順からなるデイリーバッチETLパイプラインを構築する必要があります。 ①Amazon RDSからS3へデータを抽出す…Q32あるeコマース企業は、AWS Glue ETLジョブで受注データをAmazon S3のデータレイクに書き込む前に、データ品質の自動検証を実施したい。「注文金額が…Q33ある企業は、複数のSaaSアプリケーションから日次でデータを取得し、Amazon Redshiftへロードしています。現在はLambda関数でAPI呼び出し処理…Q34ある会社では、JavaアプリケーションからAmazon RDSへ接続する処理と、BIツールからAmazon Redshiftへ接続する処理があります。それぞれの…Q35データエンジニアチームはS3に毎時追加される新しいログファイルをGlue ETLジョブで処理している。ジョブが再実行されると既処理ファイルも再度読み込まれて出力…Q36外部システムから送信される大量のJSON形式のログデータが、Amazon Data Firehoseを経由してAmazon S3にストリーミングされています。デ…Q37あるEコマース企業は、Webサイトのクリックストリームデータ(JSON形式)をAmazon Data Firehoseで直接Amazon S3に配信しています。…Q38あるIoT企業は、数千台のセンサーデバイスからJSON形式のテレメトリデータを収集し、Amazon Data Firehoseを通じてAmazon S3に配信し…Q39あるモバイルゲーム会社は、プレイヤーのリアルタイムイベントデータを処理するシステムを構築しています。以下の要件があります。 ・毎秒10,000件のゲームイベント…Q40AWS Glue ジョブ、Lambda 関数、Amazon EMR の実行を条件分岐やエラー処理を含めてオーケストレーションしたいと考えています。将来的には外部…Q41小売業のデータアナリストチームは、複数のソースシステムから収集した商品カタログデータをデータウェアハウスに取り込む前にクレンジング・標準化する必要があります。 …Q42データ分析基盤ではAmazon Kinesis Data Streamsを利用しています。現在、3つの異なる分析アプリケーションが同じストリームを読み取っていま…Q43ある気象データ分析会社は、過去10年分の気象観測データ(合計50TB)をAmazon S3に保存し、毎日バッチでApache Sparkを使ったETL処理(デー…Q44企業ではAmazon Athenaを利用して分析しています。分析対象データの一部はオンプレミスのPostgreSQLに保存されており、データ移行コストを抑えるた…Q45ある広告テクノロジー企業は、ユーザーのアクションイベント(click、impression、conversion)をJSON形式でAmazon Data Fir…Q46ある小売企業は、Amazon Kinesis Data Streamsを使ってリアルタイムの注文イベントを処理しています。ストリームは4シャードで構成されており…Q47リレーショナルデータベースであるAmazon Aurora MySQLで管理されているトランザクションデータを、Amazon Redshiftでニアリアルタイム…Q48金融機関のデータエンジニアリングチームは、オンプレミスのOracleデータベースを業務システムの主システムとして継続運用しながら、すべてのデータ変更(INSER…Q49ある小売企業のデータエンジニアリングチームは、Salesforce CRMの顧客データをAmazon S3に毎日同期するソリューションを検討しています。以下の要…Q50マーケティング部門は、Salesforceに蓄積されたリード・商談データをAmazon S3データレイクに定期的に取り込み、Amazon Athenaで分析した…Q51データエンジニアは、Amazon AthenaからオンプレミスのMySQLデータベースに保存されたデータを分析したいと考えています。データをS3へコピーせず、A…Q52ある小売企業は、Salesforce CRMに蓄積された顧客データをAmazon S3に毎日転送し、Amazon Athenaで分析したいと考えています。データ…Q53データチームは、S3データ着地→Glue ETL変換→Redshiftロードの3ステップパイプラインを構築中だ。各ステップ失敗時に自動リトライを行い、すべてのリ…Q54あるデータエンジニアリングチームは、Amazon S3上のデータレイクで顧客マスターデータを管理しています。以下の要件があります。 (1) 顧客の住所更新や退会…Q55あるeコマース企業は、ウェブサイトのクリックストリームイベントを Amazon Data Firehose で受信し、Amazon S3 に配信しています。各 …Q56あるデータ分析チームは、Amazon S3に蓄積された顧客アンケートのCSVデータに対して、欠損値の補完、列名の正規化、外れ値の除去といったクレンジングを行いた…Q57データ分析チームは、AthenaからオンプレミスのOracleデータベースに保存されたデータを分析したいと考えています。データをAmazon S3へコピーするこ…Q58ある金融機関は、Amazon MSKを使って複数のマイクロサービスからの取引イベントをKafkaトピックに集約しています。 送信側マイクロサービスのコード変更に…Q59ある医療機関のデータチームでは、PythonやSQLの経験が浅いデータアナリストが患者データの前処理を担当しています。以下の課題があります。 ・複数のCSVファ…Q60ある大手小売企業のデータエンジニアリングチームは、複数データソース(RDS・Redshift・外部REST API)を統合する数百本のDAGをオンプレミスのAp…Q61あるオンライン決済サービス会社は、不正検知システムを構築しています。要件として、同一カードで2分間のスライディングウィンドウ内に異なる5か国以上での決済が確認さ…Q62ある企業は複数のAWS Glueジョブを組み合わせた複雑なETLパイプラインを構築しています。要件は以下の通りです:(1) データ取り込みジョブの完了後にデータ…Q63あるデータエンジニアリングチームは、複数のソースから収集した顧客データをAWS Glue ETLジョブで変換してAmazon Redshiftにロードしています…Q64あるデータエンジニアリングチームは、AWS Glue ETLジョブで変換したデータをAmazon Redshiftにロードするパイプラインを運用しています。ロー…Q65あるデータエンジニアリングチームは、以下の順番で実行する複雑なETLパイプラインを構築しています。 ①AWS Glueジョブでデータを前処理してS3に出力する …Q66ある製造企業は、オンプレミスのNAS(ネットワーク接続ストレージ)に蓄積された数百TBの設計図ファイルやCADデータをAmazon S3データレイクへ移行する計…Q67あるeコマース企業は、Amazon Data Firehose を使ってクリックストリームデータをAmazon S3に保存しています。各レコードにはJSONフィ…Q68あるマーケティング分析会社では、データアナリストチーム(Python・SQL未経験)が複数データソースから収集した顧客データのクレンジングと正規化を担当していま…Q69IoTデバイスからのセンサーデータをAmazon Data Firehoseで受信し、Amazon S3に保存しています。各レコードにはdevice_typeフ…Q70ある企業ではAmazon Kinesis Data Streamsに複数のアプリケーションを接続しています。各アプリケーションは同じストリームからデータを読み取…Q71ある金融データ分析企業は、Amazon Kinesis Data Streams でリアルタイムの市場価格データを受信しています。このデータをAmazon Re…Q72ある医療機関は、オンプレミスのNASストレージ(NFS)に保存された数百TBの医療画像データをAmazon S3データレイクに移行する計画を立てています。以下の…Q73ある企業は、Salesforce、ServiceNow、Amazon S3など複数のデータソースから定期的にデータを収集し、分析基盤へ取り込む必要があります。開…Q74ある企業は、オンプレミスのNASに保存された数十TBの過去画像・ログファイルを、Amazon S3へ移行しようとしています。さらに移行後も、NAS上に日次で追加…Q75あるデータエンジニアは、Amazon S3のデータレイクに継続的に追加されるファイルをAWS Glue ETLジョブで処理しています。ジョブは毎時実行されますが…Q76ある企業は毎晩、Amazon S3に蓄積された数テラバイトの生ログデータをApache Sparkジョブで集計・変換し、結果をS3に書き込むバッチETLパイプラ…Q77データサイエンティストや非技術者のデータアナリストが、Amazon S3に保存されている大規模なデータセットの品質を評価し、欠損値の補完や異常値の正規化などのデ…Q78あるIoT企業は、工場の数千台のセンサーからJSON形式のデータをAmazon Data Firehoseで受信しています。Amazon S3に保存する前に以下…Q79あるeコマース企業は、Amazon Aurora MySQLで稼働するOLTPデータベースのデータをAmazon Redshiftにほぼリアルタイムで反映させる…Q80ある企業は、AWS Database Migration Service(AWS DMS)を使ってオンプレミスのPostgreSQLデータベースからAmazon…Q81あるモバイルゲーム会社は、プレイヤーのゲームイベント(スコア記録、アイテム取得、ログイン等)をAmazon Kinesis Data Streamsに送信してい…Q82金融サービス企業は、オンプレミスのApache Kafkaクラスターを使って高頻度の取引データをリアルタイム処理しています。このシステムをAWSに移行する際、既…Q83ある製造会社は、工場内の10,000台の機械センサーからリアルタイムのテレメトリデータを収集し、Amazon Kinesis Data Streamsに送信して…Q84あるマーケティング企業では、複数のSaaSから収集した顧客データをS3に保存している。SQLやPythonの経験がないデータアナリストが自らデータクレンジングと…Q85IOTデバイスからの毎秒数万件の小さなログデータをAmazon Kinesis Data Streamsに送信するプロデューサーアプリケーションを開発しています…Q86ある企業はAmazon Kinesis Data Streamsを使用してストリーミングデータを処理しています。現在、3つの異なるコンシューマーアプリケーション…Q87ある小売企業は、Salesforce CRMシステムに保存されている顧客データをAmazon S3データレイクに定期的に同期したいと考えています。以下の要件があ…Q88ある企業では、Amazon Athena を利用して S3 上のデータを分析しています。分析時に複数の外部データソース(Amazon RDS、Amazon Dy…Q89ある証券会社は、株式取引データをAmazon Kinesis Data Streamsにリアルタイムで送信しています。以下の処理要件があります。 ・複数の銘柄ス…Q90あるヘルスケア企業のデータアナリストチームは、Amazon S3に保存された患者データをAmazon Athenaで分析する前処理として、以下の操作が必要です。…Q91あるマーケティング企業は、Salesforce Sales Cloudに蓄積されている顧客データをAmazon S3データレイクに日次で取り込むパイプラインを構…Q92あるデータ分析基盤では、Amazon Kinesis Data Streamsに複数のコンシューマーアプリケーションが接続されています。一部のコンシューマーが大…Q93ある広告テクノロジー企業は、リアルタイムの広告インプレッションデータをAmazon Kinesis Data Streamsに毎秒100万件送信しています。5分…Q94企業は、サードパーティのSaaSアプリケーション(Salesforceなど)からAmazon S3に顧客データを毎日抽出するデータパイプラインを構築する必要があ…Q95多数のコンシューマーアプリケーションが同一の Kinesis Data Streams を読み取っています。各コンシューマーが他のコンシューマーのスループットに…Q96物流会社は、全国の配送拠点から送られる荷物スキャンイベントをAmazon Kinesis Data Streamsでリアルタイムに受信しています。 以下の要件を…Q97あるスポーツ配信サービスはライブ中継中に視聴者のバッファリングイベントを毎秒数万件収集しており、30秒ローリングウィンドウでバッファリング率が10%を超えた配信…Q98あるeコマース企業は、AWS Glue ETLジョブを使用してAmazon S3上のデータレイクに顧客の購買履歴データを蓄積しています。以下の新たな要件が追加さ…Q99ある動画ストリーミング会社は、毎日100TBを超えるユーザー視聴ログをAmazon S3に保存しています。このデータに対して、社内独自のPySparkライブラリ…Q100物流会社のデータエンジニアリングチームは、荷物の追跡イベントをAmazon Kinesis Data Streamsに送信しています。「予定配達時刻と実際のスキ…Q101企業はAmazon S3に保存されたファイルを順番に処理し、複数の変換処理を実行するデータパイプラインを構築しています。条件分岐や並列処理を含むワークフロー制御…Q102あるデータエンジニアリングチームは、Amazon Kinesis Data Streamsに流れ込むクリックストリームデータを継続的に取り込み、フィルタリングと…Q103あるモバイルゲーム会社は、ゲーム内のプレイヤーイベントデータをリアルタイムに収集しています。データストリームには毎秒約5,000件のイベントが流入し、各イベント…Q104あるデータエンジニアリングチームは、毎日S3バケットに追加される新しいCSVファイルをAWS Glueジョブで処理しています。現在のジョブは実行のたびにS3バケ…Q105ある動画配信会社は、オンプレミスでApache Kafkaクラスターを運用し、ユーザーの視聴ログをリアルタイムに処理しています。AWSへの移行にあたり、以下の要…Q106ある製造企業は、工場のIoTセンサーから毎秒5,000件のストリームデータを収集し、S3にParquet形式でセンサー種別・日付ごとにパーティション化して蓄積し…Q107製造業の企業は、複数の外部サプライヤーから毎日製品の在庫データをSFTPプロトコルで受信しています。受信したファイルはAmazon S3に自動保存され、後続のA…Q108データエンジニアリングチームは、Amazon S3バケットに継続的にアップロードされる未加工データファイルを処理するAWS Glue ETLジョブを日次で実行し…Q109あるメディア企業のデータアナリストチームは、複数のパートナー企業から毎月Amazon S3に届く視聴率レポート(CSV形式)を処理しています。ファイルには欠損値…Q110データ分析基盤では、毎日追加される大量の S3 オブジェクトを Athena で分析しています。パーティション数が非常に多く、Glue クローラーによるパーティ…Q111ある企業はAmazon Athenaを分析基盤として利用しています。分析対象データはS3だけでなく、Amazon DynamoDBにも保存されています。データを…Q112ある金融サービス企業は、月末に数千社の取引先から届く財務諸表(Financial Statement)ファイルをAmazon S3から取得し、カスタムの解析処理…Q113ある企業はオンプレミスのMySQLデータベースからAmazon S3データレイクへのデータ移行を計画しています。初期のフルロード移行後も、ソースデータベースへの…Q114ある企業はAmazon Kinesis Data Streamsへ大量のイベントデータを送信しています。データプロデューサー側でスループットを向上させ、PutR…

ドメイン2:データストアの管理(104問)

Q1医療系スタートアップは、患者データをAmazon S3上のデータレイクにParquet形式で管理しています。 GDPRおよびHIPAAのコンプライアンス要件によ…Q2Amazon RDS for PostgreSQL を使用するシステムで、毎日大量の UPDATE・DELETE 操作が発生しています。DBA が定期メンテナン…Q3ある大企業は、中央データウェアハウスとして Amazon Redshift クラスター(プロデューサー)を運用しています。 複数の事業部門がそれぞれ独立した R…Q4ある小売企業のデータエンジニアリングチームは、Amazon Redshiftで次の2つのテーブルを管理しています。 ・sales_fact テーブル(20億行)…Q5ある企業のデータレイクでは、顧客テーブルに ssn(社会保障番号)と credit_card_number カラムが含まれており、AWS Glue Data C…Q6ある IoT 企業が数千台のセンサーデバイスから毎秒数百万件の時系列データを収集しています。要件は以下の通りです。 ・直近7日間のデータ:障害検知のためにミリ秒…Q7ある大規模企業のデータプラットフォームチームは、Amazon Redshift クラスター上に中央データウェアハウスを運用しています。複数の分析チームが独立して…Q8Amazon Athenaを使用して、Amazon S3上の大規模なトランザクションデータを分析しています。データは「年/月/日/時」の形式で細かくパーティショ…Q9ある企業がAWS LambdaからAmazon RDS for PostgreSQLに接続するサーバーレスアーキテクチャを採用しています。通常時は問題ありません…Q10あるメディア企業は S3 に年/月/日でパーティション化されたクリックストリームデータを保存しています。3年分で 1,000 以上のパーティションが蓄積した結果…Q11あるデータエンジニアリングチームが、Amazon S3 にイベントログを日付別パーティション(s3://bucket/year=.../month=.../da…Q12ある企業は複数のAWS分析サービス間でデータコピーを行わずに分析処理を実行したいと考えています。Amazon AuroraとAmazon Redshift間のデ…Q13あるデータエンジニアリングチームは Amazon Redshift プロビジョニングクラスターで次の 2 種類のワークロードを実行しています。 ・ETL バッチ…Q14あるデータエンジニアは、PostgreSQLデータベースで大量のデータ削除後にインデックス性能が低下していることを確認しました。インデックス構造を再構築して検索…Q15ある製造業企業は、工場内の 10,000 台の IoT センサーから毎分 100 万件のメトリクスデータを収集しています。要件は以下の通りです。 ・直近 7 日…Q16ある組織のデータエンジニアリングチームは、一元化されたAmazon Redshiftクラスターで売上データを管理しています。マーケティングチームは独自のAWSア…Q17あるSaaS企業は、数千のカスタマー環境からアプリケーションメトリクス(CPU使用率、メモリ使用率、レイテンシー、エラー率)をリアルタイムで収集・分析するモニタ…Q18ある金融系スタートアップは、取引処理システムのセッション管理に Amazon ElastiCache for Redis を使用していましたが、以下の新要件が発…Q19ある企業は AWS Lambda 関数を使ったサーバーレスアーキテクチャを採用しており、バックエンドデータベースに Amazon Aurora MySQL 互換…Q20ある企業はAmazon Redshiftクラスターで大量のデータを更新・削除しています。最近、クエリ性能が低下し、統計情報が古い可能性があります。データベース管…Q21あるデータエンジニアがAmazon S3に保存された以下の特性を持つデータセットのストレージコストを最適化しようとしています。 ・データは機械学習モデルの学習に…Q22あるデータエンジニアリングチームは、Amazon S3上のデータレイクを管理しています。以下の要件があります。 ・複数のETLジョブによる同時書き込みでのACI…Q23ある企業は Amazon Redshift で直近3か月分の頻繁にクエリされるデータを保持し、それより古い2年分の履歴データは Parquet 形式で Amaz…Q24あるデータエンジニアリングチームが Amazon S3 上のログを Athena で分析しています。データは s3://logs/dt=YYYY-MM-DD/h…Q25ある医療系企業は、複数の病院グループが参加するデータレイクを Amazon S3 と AWS Glue Data Catalog で構築しています。患者レコード…Q26Java で開発された社内アプリケーションと、Windows ベースの BI ツールの両方から Amazon Redshift に接続する必要があります。それぞ…Q27ある小売企業がAmazon Aurora MySQL互換エディションをECサイトのバックエンドデータベースとして使用しています。以下の課題があります。 ・セール…Q28Amazon Redshift のテーブルで大量の UPDATE と DELETE が発生しています。クエリ性能低下の原因として、古いデータ領域や未整理のソート…Q29ある小売企業のデータエンジニアリングチームは、Amazon S3 上のデータレイクに日次で数億件の注文データを蓄積しています。以下の要件を満たすオープンテーブル…Q30あるフィンテック企業は、ユーザーのセッション管理システムを設計しています。要件は以下のとおりです。 ・サブミリ秒レベルの低レイテンシが必須 ・ノード障害が発生し…Q31ある企業のコンテンツ管理チームが、商品説明・仕様・マーケティングコピーなど属性数・構造が製品カテゴリごとに異なる半構造化データをAWSで管理するシステムを構築し…Q32あるセキュリティオペレーションセンター(SOC)チームが Amazon OpenSearch Service でセキュリティログの分析基盤を運用しています。ログ…Q33ある金融サービス企業は、Amazon S3にParquet形式で数百TBの取引データを蓄積するデータレイクを運用しています。GDPRへの対応として特定顧客のレコ…Q34ある大手メディア企業は、Amazon S3上に数年分のユーザー行動ログデータレイクを構築しています。今後の要件として、以下の4点すべてを満たすストレージ形式・テ…Q35あるソーシャルアプリ企業が、ユーザー間のフォロー関係・友人の友人推薦・不正アカウントのつながり検出を行う基盤を構築します。データは「誰が誰とつながっているか」と…Q36ある企業のデータエンジニアは、Amazon Redshift にホットデータ(直近3ヶ月分)を保存し、コールドデータ(3ヶ月以上前)を Amazon S3 に …Q37BI ツールから Amazon Redshift に接続して分析を行います。標準的な SQL インターフェースを利用する場合、AWS が推奨する接続方式として最…Q38ある企業のデータエンジニアは、Amazon S3 に Apache Iceberg テーブル形式でデータレイクを構築し、AWS Glue Data Catalo…Q39ある企業は中央データレイクアカウント(アカウント A)の AWS Lake Formation で管理している売上・在庫テーブルを、5つの事業部アカウント(アカ…Q40ある企業がデータレイクの S3 バケットに3種類のデータを保存しています。 ①直近30日は頻繁にアクセスし以降ほぼ参照しない大容量(1GB級)の分析ファイル群、…Q41ある SaaS 企業が Amazon OpenSearch Service でアプリケーションログの検索基盤を運用しています。 1 日あたり 500 GB のロ…Q42ある企業が、ネストされた JSON 形式の製品カタログを管理しています。各ドキュメントは可変スキーマを持ち、任意の属性に対するアドホックなクエリ、二次インデック…Q43ある大手小売企業は、同一 AWS アカウント・同一リージョン内に2つの Amazon Redshift クラスター(Cluster-A と Cluster-B)…Q44Amazon Aurora のトランザクションデータを Amazon Redshift にほぼリアルタイムで同期し、ETL ジョブの管理を不要にしたいと考えてい…Q45Amazon Redshift クラスターで大量のデータロード後にクエリ性能が低下しています。クエリオプティマイザが古い情報を利用している可能性があります。この…Q46ある企業がAmazon OpenSearch Serviceを使ってアプリケーションログをリアルタイムで保存・検索しています。 ログは毎日「logs-YYYY-…Q47あるデータプラットフォームチームが、複数の取り込みジョブが同一の Glue Data Catalog テーブルにデータを書き込む構成を運用しています。あるジョブ…Q48あるデータエンジニアは、Athena で2つのテーブルの結果を結合したいと考えています。重複する行は1件だけ返し、重複を除外した結果セットを取得する必要がありま…Q49あるコンテンツ管理企業は、記事・製品説明・メタデータを JSON 形式で管理するシステムを AWS へ移行します。データには以下の特性があります。 ・ドキュメン…Q50あるeコマース企業が Amazon Redshift でデータウェアハウスを運用しています。週次の売上集計レポートは複数の大型ファクトテーブルとディメンションテ…Q51あるスマートビル管理会社は、50,000台のセンサーから30秒ごとに温度・湿度・消費電力のメトリクスを収集するシステムを AWS 上に構築しています。以下の要件…Q52あるメディア配信企業は数百万件の動画サムネイルと処理済みコンテンツファイルを Amazon S3 に保存しています。コンテンツのアクセス頻度はタイトルごとに大き…Q53データエンジニアはAmazon S3環境のコスト最適化を検討しています。数百万オブジェクトについてストレージクラスやサイズなどの詳細情報を取得し、分析したい場合…Q54Amazon Redshift テーブルでは大量の DELETE と UPDATE が実行され、クエリ性能が低下しています。データの並び順を再整理し、統計情報も…Q55あるソーシャルメディア企業が、ユーザー間の「フォロー」「友達申請」「グループメンバーシップ」などの関係性データを管理するデータベースを設計しています。 主な要件…Q56ある小売企業は Amazon Redshift で直近13か月の売上明細をクエリしています。それ以前の数年分(数十TB)の履歴は年次監査時に数回しか参照されませ…Q57あるオンライン銀行が不正検知システムを AWS で構築しています。以下の要件があります。 ・数百万件の口座と送金取引の「関係性」を分析する ・「特定口座から3ホ…Q58あるデータエンジニアリングチームは、Amazon S3 上のペタバイト規模のデータレイクを管理しています。複数の ETL ジョブが同じデータセットに並行書き込み…Q59Amazon Redshiftで運用しているテーブルでは、大量のDELETE処理とINSERT処理が頻繁に発生しています。最近、クエリ実行時間が増加しています。…Q60データ分析チームは、Amazon S3にある過去のログデータと、Amazon DynamoDBに格納されているリアルタイムのユーザープロファイルデータを結合して…Q61Webアプリケーションから出力されるアプリケーションログがAmazon S3標準バケットに保存されています。データサイエンスチームは作成後90日間はこれらのログ…Q62ある eコマース企業が、カート情報・セッション管理・リアルタイムランキングのためにインメモリデータストアを導入しようとしています。要件は以下の通りです。 ・秒間…Q63ある企業では Amazon Aurora MySQL 互換エディションを本番データベースとして使用しています。アプリケーションのバグにより、過去4時間に大量の誤…Q64Amazon Redshiftで大量の更新処理を実行した後、クエリ性能が低下しました。管理者は不要領域の整理と、クエリ最適化に利用される統計情報の更新を実行する…Q65ある通信会社は、数十億件のユーザー通話履歴・SMSログを管理するシステムをAWSに移行しています。要件は以下の通りです。 ・既存システムはオンプレミスのApac…Q66あるグローバルな SaaS 企業は、米国・ヨーロッパ・アジアパシフィックの 3 リージョンにユーザーが存在します。ユーザーセッション管理には以下の要件があります…Q67あるデータアナリティクスチームは、Amazon Redshift を使ったアドホック分析基盤を運用しています。利用パターンは以下の通りです。 ・平日午前 9 時…Q68Athena を使用して Amazon S3 上のデータだけでなく、RDS や DynamoDB など外部データソースも単一の SQL で分析したいと考えていま…Q69あるDevOpsチームが、マイクロサービスアーキテクチャで稼働する100以上のサービスから収集されるアプリケーションメトリクス(CPU使用率、エラー率、レイテン…Q70ある小売企業がAmazon S3上のデータレイクでAWS GlueとAmazon Athenaを使った分析基盤を運用しています。 月次の在庫調整バッチ処理でデー…Q71あるIoT企業が Amazon DynamoDB にデバイスのテレメトリを保存しています。各アイテムは90日経過後に不要となり削除したい一方、削除前のデータは将…Q72ある製薬会社が、FDA 21 CFR Part 11(電子記録規制)に準拠するため、臨床試験データを Amazon S3 に保存する要件があります。 要件は以下…Q73ある企業がAmazon Redshiftでデータウェアハウスを運用しています。 5億行の売上ファクトテーブル(sales_fact)と100万行の顧客ディメンシ…Q74ある多国籍企業が us-east-1 リージョンで Amazon DynamoDB を使用した EC アプリケーションを運用しています。eu-west-1 への…Q75あるeコマース企業が商品検索機能を強化したいと考えています。要件は以下の通りです。 ・数百万件の商品カタログに対するキーワードの全文検索 ・カテゴリ・価格帯・評…Q76あるグローバルなフィンテック企業がコアバンキングシステムを Amazon Aurora MySQL 互換エディションで運用しています。以下の要件を満たすデータベ…Q77ある EC サイトが Amazon S3 データレイクに Parquet 形式で取引データを保存しています。新たな要件として以下が追加されました。 ・複数の E…Q78PostgreSQL の CLUSTER や他のデータベースでのリクラスター(Recluster)の主な目的として最も適切なものはどれですか。Q79あるモバイルゲーム会社が、オンプレミスの Apache Cassandra クラスターで以下のデータを管理しています。 ・プレイヤーのゲームイベントログ(1日あ…Q80あるゲーム会社は、プレイヤーのゲーム状態・アイテム情報・リーダーボードスコアを Amazon DynamoDB に格納しています。 リリース後のピーク時にはプレ…Q81あるフィンテック企業は、リアルタイム決済処理システムを AWS 上に構築しています。以下の要件があります。 ・決済セッションデータへのマイクロ秒オーダーの超低レ…Q82ある EC サイトが Amazon DynamoDB を使用してユーザーのセッションデータを管理しています。パーティションキーは userId、ソートキーは t…Q83ある企業では Redshift テーブルに大量の更新処理を実行しています。削除済み領域の回収とソート順の整理を行い、クエリ性能を維持したいと考えています。実行す…Q84ある小売企業は Amazon Redshift でスタースキーマのデータウェアハウスを運用しています。売上ファクトテーブルは20億行(毎日数百万行追加)、商品デ…Q85あるオンラインゲーム会社がリアルタイムランキングシステムを構築しています。以下の要件があります。 ・ミリ秒未満のレイテンシでのスコア読み取り・書き込み ・Red…Q86あるデータエンジニアリングチームが Amazon S3 にクリックストリームデータを蓄積しています(数百億行、Parquet 形式)。以下の要件が新たに追加され…Q87あるデータエンジニアは、リレーショナルデータベースの検索性能低下を調査しています。調査の結果、インデックスが断片化しており、インデックス構造を再作成する必要があ…Q88ある EC 企業は、Amazon Aurora PostgreSQL 互換エディションを us-east-1 でプライマリとして運用しています。グローバル展開に…Q89ある金融サービス企業は、Amazon S3上にParquet形式で数十TBの取引履歴データを保管しています。 GDPR対応で特定顧客の全レコードを物理削除する必…Q90ある製造業の企業は、工場内の数千台の IoT センサーから 1 秒ごとにデータを収集するシステムを AWS 上に構築しています。以下の特性があります。 ・1 日…Q91ある企業のAmazon Redshiftクラスターでは、データサイエンティストによる実行時間10〜30分の分析クエリと、ETLパイプラインによる実行時間数秒の短…Q92Amazon Redshiftクラスターを使用してデータウェアハウスを運用しています。毎晩のバッチ処理で大量の行の削除と新しいデータのロードが行われます。最近、…Q93大規模なS3環境でストレージ利用状況を分析し、組織全体のバケット容量増加や未使用データの傾向を確認したいと考えています。最適な機能はどれですか。Q94ある製造業の企業は、工場内の10,000台のIoTセンサーから毎秒メトリクスデータを収集するシステムを設計しています。要件は以下のとおりです。 ・時系列データを…Q95ある EC サイトが商品カタログデータの管理に Amazon DynamoDB を使用しています。 全読み取りリクエストの 80% が「人気商品トップ 100」…Q96PostgreSQL データベースでは、更新処理の繰り返しによりインデックスの断片化が進み、検索性能が低下しています。インデックスを再構築して性能を回復させる操…Q97Amazon Athena で S3 上のデータを分析しています。さらに RDS に保存されたトランザクションデータと結合して分析したいと考えています。データを…Q98ある金融機関は、規制要件により取引監査ログを Amazon S3 に7年間保管する必要があります。データは保存後30日間は調査のため頻繁にアクセスされますが、そ…Q99あるヘルスケア企業は患者の診察記録を Amazon DynamoDB テーブルに保存しています。以下の要件があります。 ・診察記録は作成から2年間のみ Dyna…Q100ある企業が Amazon DynamoDB テーブルに以下の特性を持つデータを保存しています。 ・過去3年分のアーカイブ済み注文履歴データ(5 TB 以上) ・…Q101ある小売企業のデータエンジニアリングチームが Amazon Redshift でレポーティング基盤を運用しています。 BI ツールから毎時数十回実行される「売上…Q102あるデータエンジニアリングチームがAmazon S3データレイクを運用しています。保存するデータのアクセスパターンは以下の通りです。 ・作成後30日間: ETL…Q103Amazon Redshiftのテーブルで大量のデータ更新が発生しています。管理者はクエリ性能を維持するため、テーブルのソート状態を改善し、データ分散やクエリ実…Q104ある企業は複数のマイクロサービスから生成されるアプリケーションログをリアルタイムで収集し、障害発生時に特定のエラーメッセージを全文検索でトラブルシューティングし…

ドメイン3:データオペレーションとサポート(94問)

Q1あるデータエンジニアリングチームは、Amazon OpenSearch Serviceを使用してアプリケーションログをほぼリアルタイムに分析しています。ログ量が…Q2あるデータエンジニアリングチームは、複数のソースシステムからAmazon S3に毎日届くデータをAmazon Redshiftにロードしています。本番データウェ…Q3あるデータエンジニアリングチームは、本番環境で複数のAWS Glue ETLジョブを運用しています。 ジョブが失敗した際に、ジョブ名・実行ID・エラーメッセージ…Q4データ処理パイプラインで、処理内容によって分岐し、一部の処理を並列実行し、複数ファイルへ同じ変換処理を適用したいと考えています。AWS Step Functio…Q5あるデータチームは毎日 ①Glue ETLによるS3データ取り込み ②RedshiftでのSQL集計 ③結果のS3エクスポート の順で実行するパイプラインを運用…Q6あるデータエンジニアリングチームは、Amazon S3 から Amazon Redshift へのデータロードに COPY コマンドを定期実行しています。 ある…Q7あるデータエンジニアリングチームは、毎日AWS GlueのETLジョブでAmazon S3のデータレイクにデータを取り込んでいる。取り込んだデータについて、列の…Q82つのテーブル「current_customers」と「past_customers」があります。両方のテーブルのスキーマは同一です。データエンジニアは、現在の…Q9あるデータエンジニアリングチームは、毎日 AWS Glue ETL ジョブを実行して販売トランザクションデータを処理し、Amazon Redshift にロード…Q10ある金融機関のデータエンジニアリングチームは、Amazon S3 上に構築したデータレイクに格納された機密ファイルへのアクセス履歴を監査するよう、コンプライアン…Q11あるデータエンジニアリングチームは、AWS Glueを使用したデイリーETLパイプラインを構築しています。このパイプラインは以下の依存関係を持っています: ・S…Q12あるデータエンジニアリングチームは、複数のAmazon S3バケットにわたって数百万個のオブジェクトを管理しています。ストレージコスト最適化のため、オブジェクト…Q13あるデータエンジニアリングチームは、AWS Glue ETLジョブを使用してAmazon S3からデータウェアハウスへデータを変換・ロードするパイプラインを運用…Q14あるデータエンジニアリングチームは、コンプライアンス要件に基づいて Amazon S3 データレイクへのアクセス監査を実施する必要があります。 要件は以下の通り…Q15あるデータエンジニアリングチームは、複数の開発チームが Amazon Athena を使ってアドホッククエリを実行する環境を管理しています。 次の要件を満たす実…Q16あるデータエンジニアリングチームは、AWS Glue ETLジョブを使用してAmazon S3からAmazon Redshiftにデータをロードするパイプライン…Q17あるログ分析チームは1日500GBのアプリケーションログをS3にフラット構造(プレフィックスなし)で保存し、Amazon Athenaでアドホッククエリを実行し…Q18あるデータエンジニアリングチームは、Amazon Redshiftクラスターで実行する月次の大規模レポートクエリの実行時間が増加していることに気づきました。テー…Q19あるチームは Amazon Kinesis Data Streams を使用してリアルタイムでイベントデータを収集し、コンシューマーアプリケーションがシャードか…Q20あるデータエンジニアリングチームは、AWS Glue ETLパイプラインにデータ品質チェックを組み込みたいと考えています。Amazon S3に格納されたCSVデ…Q21あるチームのAWS Glue Spark ETLジョブが、入力データ量の増加に伴い処理時間が不安定になり、ワーカーのメモリ不足やデータの偏り(スキュー)が疑われ…Q22あるデータエンジニアリングチームは本番環境でAWS Glue ETLジョブを1日数回実行している。ジョブ失敗を即座に検知してオンコール担当者にページング通知を送…Q23あるデータエンジニアリングチームは、AWS Glueジョブで日次ETLを実行しています。最近、入力データに欠損値や想定外の値が混入し、下流のRedshiftに不…Q24ある金融機関のデータパイプラインでは、毎日外部パートナーからS3に届くCSVファイルをAWS Glue ETLでRedshiftにロードしている。過去に欠損値・…Q25あるデータエンジニアリングチームは、Amazon Redshiftクラスターで長時間実行されるETLジョブと、BIダッシュボード向けの短い分析クエリを同一クラス…Q26あるデータエンジニアリングチームは、Amazon EMRではなくAWS Glue上のApache Sparkジョブで日次集計を実行しています。同じジョブが日によ…Q27企業はAmazon Managed Streaming for Apache Kafka (Amazon MSK) を使用して、ミッションクリティカルなデータパ…Q28あるデータエンジニアリングチームは、Amazon MSK(Managed Streaming for Apache Kafka)を使用してリアルタイムデータパイ…Q29あるデータエンジニアリングチームは、毎日深夜2時から実行される多数のAWS Glue ETLジョブを運用しています。Amazon CloudWatchのメトリク…Q30データ処理ワークフローでは、ファイル単位の変換処理を大量に並列実行し、その後に集計処理を実行する必要があります。状態管理とエラー時の再試行も必要です。最も適した…Q31ある企業はApache Sparkを使用して大規模なデータ処理ジョブを実行しています。これらのジョブは不定期に発生し、処理するデータ量も数GBから数TBまで変動…Q32あるデータエンジニアリングチームは、夜間バッチ処理にAWS Batchを使用しています。 ジョブは一時的なネットワークエラーで失敗することがあります。 チームは…Q33あるデータエンジニアリングチームは、Amazon Athenaを使って複数の分析チームがAmazon S3データレイクに対してアドホッククエリを実行できる環境を…Q34あるチームはアプリケーションログをAmazon OpenSearch Serviceに取り込み、直近7日間は高速に検索・可視化し、それ以降90日間は低頻度のアク…Q35あるデータエンジニアリングチームは、毎日Amazon S3に届く取引データをAWS Glue ETLジョブで加工しAmazon Redshiftにロードしていま…Q36あるデータエンジニアリングチームは、Amazon S3 のデータレイクを対象に AWS Glue Crawler を1時間ごとにスケジュール実行しています。 デ…Q37複数のチームが共有のAmazon Athena環境で大量データをクエリしている。各チームのデータスキャン量を制限してコストを管理しつつ、繰り返し実行される同一ク…Q38あるデータエンジニアリングチームは、パートナー企業から毎朝6:00 AMまでにAmazon S3バケットの特定プレフィックスへファイルが配信される日次バッチパイ…Q39あるデータエンジニアリングチームは、毎日新しいCSVファイルが追加されるAmazon S3バケットを対象に、AWS Glue ETLジョブを毎夜実行してデータを…Q40データエンジニアがAWS Glue向けのPySparkベースのETLスクリプトをローカル環境のJupyter Notebookで開発しています。スクリプトの開発…Q41あるデータエンジニアリングチームは、Amazon Kinesis Data Streams を使用してリアルタイムイベントデータを収集し、AWS Lambda …Q42データエンジニアが、AWS Glue ETLジョブ、Amazon EMRステップ、およびAWS Lambda関数を含む複雑なデータ処理パイプラインを構築していま…Q43あるデータエンジニアリングチームは、Amazon Data Firehose を使用してJSONストリームデータをApache Parquet形式に変換し、Am…Q44あるデータエンジニアリングチームは、Amazon Redshiftクラスターで毎朝ETLパイプラインを実行するとともに、複数のアナリストチームがアドホックなBI…Q45あるデータエンジニアリングチームは、Amazon Redshift クラスターで複数の ETL クエリが突然遅くなったという報告を受けました。 調査のために、以…Q46あるデータエンジニアリングチームは、外部パートナーがAmazon S3の特定のプレフィックスにCSVファイルをアップロードするたびに、AWS Glue ETLジ…Q47あるデータエンジニアリングチームは、AWS Glue ETLジョブを使って日次でAmazon S3からAmazon Redshiftにデータをロードしています。…Q48あるチームはAWS Database Migration Service(DMS)を使用して、オンプレミスのOracleデータベースからAmazon Auror…Q49あるデータエンジニアリングチームは、Amazon Data Firehoseを使用してストリーミングデータをAmazon S3に配信しています。配信ストリームに…Q50データエンジニアは、顧客テーブルから注文履歴テーブルに存在しない顧客のみを抽出するSQLクエリを作成する必要があります。注文履歴テーブルのcustomer_id…Q51ある企業はAmazon MSKを利用してイベント処理基盤を構築しています。新しいリージョンにも同じイベントデータを利用できる環境を作成し、障害発生時には別リージ…Q52あるデータエンジニアリングチームは、Amazon S3上に構築したデータレイクのコンプライアンス監査を実施しています。 要件として「過去90日間に、特定のS3バ…Q53あるデータエンジニアリングチームは、Amazon DynamoDB をデータパイプラインのメタデータストアとして高頻度で使用しています。 特定の時間帯に Pro…Q54あるデータエンジニアリングチームは、複数のAWS Glueクローラーと複数のGlue ETLジョブを、依存関係と条件分岐に従って順番に実行する必要があります。ジ…Q55あるデータエンジニアリングチームは、Amazon Redshiftクラスター上で多数のアナリストが同時にアドホッククエリを実行しています。一部のクエリが数時間実…Q56あるデータエンジニアリングチームは、複数の部署(マーケティング・財務・エンジニアリング)が共有するAmazon Athena環境を管理しています。部署ごとのクエ…Q57あるデータエンジニアリングチームは、Amazon S3 の特定のプレフィックスに毎時間新しい Parquet ファイルが追加される環境で、AWS Glue ET…Q58あるデータエンジニアリングチームは、Amazon MSK(Managed Streaming for Apache Kafka)クラスターを使用したリアルタイム…Q59あるデータエンジニアリングチームは、AWS Glue ETLジョブを使用して毎日顧客トランザクションデータをAmazon S3からAmazon Redshift…Q60ある IoT 企業は、50,000 台のデバイスからのセンサーデータを Amazon Kinesis Data Streams で収集し、AWS Lambda …Q61あるデータエンジニアリングチームは、毎時間Amazon S3の特定プレフィックスに追加される新しいCSVファイルをAWS Glue ETLジョブで処理して、Am…Q62あるデータエンジニアリングチームは、Amazon Managed Streaming for Apache Kafka(Amazon MSK)を使用してIoTセ…Q63あるデータエンジニアリングチームは、Amazon EMR、Amazon Redshift、Amazon Athenaを組み合わせたデータ処理パイプラインをAWS…Q64あるデータエンジニアリングチームは、AWS Glue ETLジョブが失敗した際に担当エンジニアへメール通知を送信し、最大2回まで自動的に再実行する仕組みを、最小…Q65あるデータエンジニアリングチームは、Amazon Data Firehose を使用してウェブサイトのクリックストリームデータをAmazon S3に配信していま…Q66ある企業では、アプリケーションからAmazon RDSへ接続する処理と、分析ツールからデータベースへ接続する処理があります。開発者は適切な接続方式を選択する必要…Q67グローバル展開している企業はAmazon MSKを利用しています。プライマリリージョンで発生するKafkaイベントを別リージョンへ継続的に複製し、障害発生時の復…Q68あるデータエンジニアリングチームは、複数の部門が共有するAmazon Redshiftクラスターを管理しています。特定のアドホッククエリが数時間実行され続け、業…Q69あるデータエンジニアリングチームは、Amazon Redshiftに毎時更新される販売データに対し、Amazon QuickSightで数百人の営業担当者向けダ…Q70あるデータエンジニアリングチームは、AWS Organizationsを使用して15個のAWSアカウントにまたがるデータレイクをAmazon S3で運用していま…Q71あるデータエンジニアがAmazon Athenaを使用して、Amazon S3上の過去3年分の販売データ(CSV形式、合計5TB)に対してアドホック(即興)クエ…Q72あるデータエンジニアリングチームは、AWS Database Migration Service(DMS)を使用して、オンプレミスのOracleデータベースから…Q73あるデータエンジニアリングチームは、Amazon S3に蓄積された数千万行の販売データを定期的に分析し、列ごとのNULL値率・値の分布・外れ値の割合などのデータ…Q74あるデータパイプラインは複数のAWS Glueジョブを順番に実行している。特定のGlueジョブが一時的なスロットリングで断続的に失敗するため、失敗時に指数バック…Q75あるデータエンジニアリングチームは、サードパーティのデータプロバイダーからAmazon S3に届くCSVファイルをAWS Glue ETLジョブで処理し、Ama…Q76あるデータエンジニアリングチームは、毎日Amazon S3に配信される販売データをAmazon Redshiftにロードする前に、自動的なデータ品質チェックをパ…Q77あるチームは、複数のAWS Glue ETLジョブで発生するエラーのパターンを分析したいと考えています。過去7日間のジョブ実行ログから、ジョブごとのエラー発生頻…Q78あるデータエンジニアリングチームはAmazon Redshift(ra3.4xlarge × 4ノード)を運用しています。業務時間中にデータサイエンティストによ…Q79複数リージョンで稼働する Kafka ベースのデータ基盤を構築しています。Amazon MSK クラスター間で継続的なデータ複製を行い、災害対策と低レイテンシア…Q80あるデータエンジニアリングチームは、Amazon Redshiftを使用して日次ETLパイプラインを運用しています。毎日大量のDELETEおよびUPDATE操作…Q81あるデータエンジニアリングチームは、AWS Batchを使用して数時間かかる大規模なデータ変換ジョブを実行しています。コスト削減のためスポットインスタンスを使用…Q82あるデータエンジニアリングチームは、外部システムから毎日Amazon S3に配信されるCSVファイルをAWS Glue Crawlerでカタログ化しています。 …Q83あるデータエンジニアリングチームは、Amazon Redshiftに数百のテーブルを持つデータウェアハウスを運用しています。 データのロードパターンとクエリパタ…Q84あるデータエンジニアリングチームは、Amazon EMR クラスター上で Apache Spark を使用した日次バッチ変換ジョブを運用しています。最近、特定の…Q85あるデータエンジニアリングチームは、Amazon S3 に格納された10TBのウェブアクセスログデータをAmazon Athenaでクエリしています。現在のデー…Q86ある企業はAmazon MSKを使用して複数リージョンにまたがるイベント処理基盤を構築しています。災害対策として、あるリージョンのKafkaトピックデータを別リ…Q87あるデータエンジニアリングチームは、複数のAWS GlueジョブとEMRステップから成るデータパイプラインを運用しています。各処理の実行時間・成功失敗・処理レコ…Q88あるデータパイプラインはAWS Step Functionsを使用してオーケストレーションされており、Amazon S3からデータを読み込み、AWS Glueジ…Q89あるデータエンジニアリングチームは、複数のマイクロサービスからAmazon MSK(Managed Streaming for Apache Kafka)経由で…Q90あるデータエンジニアリングチームは、毎晩Amazon S3に蓄積される新規ログファイルをAWS Glue ETLジョブで処理し、Amazon Redshiftへ…Q91あるデータエンジニアリングチームは、Amazon QuickSightを使用して数百万行のAmazon Redshiftテーブルに対するダッシュボードを提供して…Q92あるECサイトでは、毎秒2万件のユーザーアクションをAmazon Kinesis Data Streamsで受信しており、次の要件があります。①ユーザーのセッシ…Q93Amazon S3 の利用状況を分析しています。組織全体のストレージ使用量やコスト傾向を可視化したい一方、オブジェクト単位のメタデータ一覧も定期的に取得したいと…Q94あるデータエンジニアリングチームは、Amazon DynamoDB テーブルを使用してアプリケーションデータをリアルタイムで読み書きしています。 特定の時間帯に…

ドメイン4:データのセキュリティとガバナンス(84問)

Q1Amazon S3にペタバイト規模のデータを保存している企業が、コンプライアンス要件を満たすために、バケット内の全オブジェクトの暗号化ステータス、サイズ、ストレ…Q2ある医療保険会社は HIPAA 準拠のため、患者の請求データが格納された Amazon S3 バケットへのすべてのオブジェクトレベル操作(GetObject・P…Q3あるデータエンジニアリングチームは、AWS Glue ジョブから Amazon RDS for MySQL に接続してデータを処理しています。現在、データベース…Q4ある金融サービス企業は、規制要件により証券取引記録をAmazon S3に最低7年間保管する義務があります。コンプライアンス担当部門から以下の要件が提示されていま…Q5組織内の多数の S3 バケットについて、ストレージクラス、暗号化状態、オブジェクトサイズなどの情報を定期的に取得し、詳細なオブジェクト単位の分析を行いたいと考え…Q6ある医療保険会社は、保険請求データをAmazon S3の複数のバケットに保存しています。以下の要件があります。 ・バケット内に保存されたPHI(Protecte…Q7あるデータエンジニアリングチームは、Amazon S3データレイクに機密性の高い財務データを保存しています。セキュリティチームから、以下のような脅威をリアルタイ…Q8ある小売企業(企業A)と広告テクノロジー企業(企業B)は、広告キャンペーンの効果測定を共同で行いたいと考えています。以下の制約条件があります。 ・企業Aは顧客の…Q9ある証券会社は、SEC(米国証券取引委員会)規則 17a-4 に基づき、すべての取引記録を Amazon S3 に以下の条件で保存することが法的に義務付けられて…Q10ある小売企業と広告代理店は、過去のキャンペーン効果を測定するために、それぞれが保有する顧客購買データと広告配信ログを組み合わせた分析を行いたいと考えています。た…Q11ある金融サービス企業のデータエンジニアリングチームは、機密性の高い取引データを処理するためにAmazon EMRクラスターを運用しています。社内のセキュリティポ…Q12ある企業は数百の Amazon S3 バケットを保有しており、各バケットには 'confidential'、'internal'、'public' のいずれかの…Q13ある金融機関のデータエンジニアリングチームは、規制要件により取引監査ログをAmazon S3に7年間保管し、その期間中は一切の変更・削除を禁止する必要があります…Q14あるデータエンジニアリングチームは、マーケティング ・財務 ・経営企画の3部門がAmazon Athenaを共有しています。 セキュリティ部門から以下の要件が示…Q15ある金融企業の Amazon Redshift クラスターでは、誰がいつどのテーブルにアクセスし、どのような SQL を実行したかを長期間保管し、コンプライアン…Q16ある企業はデータレイクを AWS Lake Formation で管理しています。分析チームには customers テーブルへのアクセスを許可しますが、ema…Q17あるデータ分析チームは、Amazon Athena を使って S3 データレイクをクエリしています。セキュリティ部門は、すべてのクエリ結果が S3 に保存される…Q18企業のコンプライアンス部門は、数百のAmazon S3バケットを含む広範なデータレイクに対して、クレジットカード番号や社会保障番号などの個人を特定できる情報 (…Q19ある金融サービス企業のデータエンジニアリングチームは、数百のAmazon S3バケットにわたって顧客データ、取引記録、運用ログを保管しています。以下の要件があり…Q20ある金融サービス企業は、Amazon Redshiftをデータウェアハウスとして運用しています。データアナリストは顧客取引テーブルをクエリできますが、クレジット…Q21ある小売業者とデータ分析会社は、キャンペーン効果測定のために互いの顧客データを組み合わせた共同分析を実施したいと考えています。両社はプライバシー規制により、相手…Q22ある金融機関は、規制要件(SEC Rule 17a-4)に従い、取引記録をAmazon S3に保存する際に以下の要件を満たす必要があります。 ・保存期間(7年間…Q23ある医療機関のデータチームは、AWS Lake Formationを使ってS3データレイクを管理しています。患者テーブルには以下のカラムが含まれています。 ・p…Q24ある大企業のデータレイクは単一の Amazon S3 バケットに集約されており、3 つのチーム(分析、機械学習、コンプライアンス)がそれぞれ異なるプレフィックス…Q25ある医療保険会社は、AWS Organizations で管理する複数の AWS アカウントにわたって数百の Amazon S3 バケットを運用しています。規制…Q26組織内の S3 利用状況を分析しています。経営層向けにはアカウント全体のストレージ使用量やコスト傾向を確認し、運用担当者向けには各オブジェクトのサイズや暗号化状…Q27ある医療保険会社は、保険請求データや患者記録を含む数百のAmazon S3バケットを管理しています。セキュリティチームは以下の要件を満たすソリューションを構築す…Q28あるゲーム企業は、プレイヤーのプロフィールを Amazon DynamoDB の Players テーブル(パーティションキーが UserId)に保存しています…Q29ある大企業のデータプラットフォームチームは、AWS Glue Data Catalogに600以上のテーブルを管理しており、毎月新しいテーブルが追加されています…Q30ある企業は AWS Organizations を使って複数の AWS アカウントを管理しており、機密データを含むアカウントからのデータ流出リスクを防ぐ必要があ…Q31ある製薬会社は、臨床試験データを毎日複数のサードパーティベンダーからAmazon S3バケットに取り込んでいます。このデータには一般的な個人情報(氏名、メールア…Q32ある企業のデータガバナンスチームは、AWS 環境全体の Amazon S3 バケットが常にセキュリティポリシーに準拠しているか継続的に監視したいと考えています。…Q33ある金融サービス企業が AWS Lake Formation で管理されたデータレイクを構築しています。顧客ローン申請データを含むテーブルには、申請地域(reg…Q34ある企業では、複数の部門がデータをそれぞれのAmazon S3バケットに保存しています。セキュリティチームは、どのS3バケットに氏名・メールアドレス・クレジット…Q35ある SaaS 企業は、マルチテナント型のユーザープロフィール管理システムを Amazon DynamoDB で構築しています。テーブルのパーティションキーは …Q36ある大企業は AWS IAM Identity Center を使って Active Directory(AD)と連携した SSO 環境を運用しています。データ…Q37ある医療系 SaaS(Software as a Service)企業は、患者データを Amazon RDS(PostgreSQL)、Amazon S3、Ama…Q38あるデータエンジニアリングチームは、AWS GlueジョブからAmazon RDS for PostgreSQLに接続するETLパイプラインを運用しています。セ…Q39あるヘルスケア企業は患者の診療記録を Amazon DynamoDB に保管しています。HIPAA 監査要件として以下が求められています。 ・暗号化キーの使用履…Q40ある企業はAmazon S3にデータレイクを構築しています。人事部と営業部が同じデータセットにアクセスしますが、営業部には給与などの個人情報(PII)列を非表示…Q41ある医療機関は、患者の個人情報を保存するAmazon S3バケットへのオブジェクトレベルのアクセス操作(GetObject、PutObject、DeleteOb…Q42あるeコマース企業は、AWS Lake FormationとAmazon Athenaを使ってデータレイクを管理しています。`orders`テーブルには`ord…Q43ある大手金融機関は、Amazon S3上にデータレイクを構築しており、数百のIAMロールおよびAWSサービスがデータにアクセスしています。 セキュリティチームは…Q44ある保険会社は、Amazon S3 上のデータレイクを AWS Lake Formation で集中管理し、Amazon Athena から分析しています。監査…Q45ある大手小売企業(企業A)と、デジタル広告代理店(企業B)が共同でキャンペーン効果測定プロジェクトを実施しようとしています。プロジェクトには以下の制約があります…Q46ある製薬企業は患者の臨床試験データを Amazon S3 データレイクに保管し、AWS Glue Data Catalog でメタデータを管理しています。データ…Q47ある企業が複数アカウントにまたがるデータレイクを運用しています。データプロデューサーアカウントが S3 に保持するテーブルを、別アカウントのアナリストに対し「特…Q48ある企業は、複数のデータソースから収集した大量の S3 オブジェクトの中に、クレジットカード番号やマイナンバーなどの個人情報(PII)が意図せず含まれていないか…Q49ある医療関連企業は、患者データを含む可能性がある数百のAmazon S3バケットを保有しています。コンプライアンス要件として、以下の機能を自動化する必要がありま…Q50ある金融機関のコンプライアンスチームは、Amazon Redshiftクラスターで実行されるすべてのSQLクエリ、ユーザーのログイン・ログアウト、ユーザー/グル…Q51ある小売企業は、広告パートナー企業と協力して顧客の購買データと広告インプレッションデータを組み合わせた効果測定分析を実施したいと考えています。 ただし、以下の制…Q52ある保険会社は、複数の業務システムから取得した顧客データを Amazon S3 の多数のバケットに保存しています。最近のセキュリティ監査で、一部のバケットに顧客…Q53ある証券会社の DBA チームは、Amazon Redshift クラスター上で実行されるすべての SQL クエリ、ユーザーの接続・切断イベント、DDL 操作を…Q54あるデータエンジニアリングチームは、AWS Glue ETLジョブからAmazon Auroraデータベースに接続するデータパイプラインを運用しています。現在、…Q55ある企業のデータセキュリティチームは、AWS環境内のAmazon S3バケットおよびAWS KMSキーに設定されたリソースポリシーを継続的に分析したいと考えてい…Q56ある金融機関は、規制当局から取引ログを7年間にわたって変更・削除が一切できない状態(WORM:Write Once Read Many)で保管することを義務付け…Q57ある金融テクノロジー企業のセキュリティチームは、Amazon S3に保存されている機密顧客データへの不審なアクセスをリアルタイムで検出したいと考えています。 具…Q58あるスタートアップは、モバイルアプリの数百万ユーザーのプロファイルを単一の Amazon DynamoDB テーブル(パーティションキー: UserId)に保存…Q59ある企業は、AWS Glue ETL ジョブから Amazon RDS for MySQL に接続する際、データベースのユーザー名とパスワードを Glue ジョ…Q60ある証券会社は、SEC 規則 17a-4(f) に準拠するため、電子取引記録を 7 年間にわたって変更・削除不可の WORM(Write Once Read M…Q61ある金融サービス企業は、顧客の取引データをリアルタイムで処理する Amazon Kinesis Data Streams パイプラインを構築しています。コンプラ…Q62ある医療会社のデータエンジニアリングチームは、Amazon S3上のデータレイクのメタデータをAWS Glue Data Catalogで管理しています。データ…Q63ある医療サービス企業は、患者データを含む数百のAmazon S3バケットを管理しています。コンプライアンス要件を満たすために、以下の対策を実施する必要があります…Q64ある企業のデータエンジニアリングチームは、AWS Glue ETL ジョブから Amazon RDS for MySQL に接続しています。セキュリティ要件とし…Q65ある金融企業が顧客の取引データを Amazon S3 データレイクに保存し、AWS Glue Data Catalog でメタデータを管理しています。テーブルに…Q66ある金融サービス企業は、機密性の高い顧客データをAmazon S3データレイクに保管しています。セキュリティチームは以下の脅威を自動的に検出したいと考えています…Q67ある企業では、S3 バケット全体のストレージ使用状況を経営層へ報告し、同時に特定オブジェクト単位でストレージクラスや暗号化状態を確認する必要があります。適切な …Q68ある決済企業は、Amazon Redshift の transactions テーブルにクレジットカード番号を平文列で保持しています。データアナリスト(role…Q69ある大企業のデータプラットフォームチームは、AWS Glue Data Catalog に 2,000 を超えるテーブルを管理しており、毎月新しいテーブルが追加…Q70ある大企業は複数の AWS アカウントを AWS Organizations で管理しています。最近の内部監査で以下のセキュリティ問題が発覚しました。 ・一部の…Q71あるデータエンジニアリングチームは、AWS Glue ETLジョブを使ってAmazon RDS for PostgreSQLからデータを抽出しています。セキュリ…Q72ある金融サービス企業の Amazon Redshift クラスターには、クレジットカード番号・口座番号・社会保障番号を含む顧客テーブルがあります。データアナリス…Q73ある金融機関がAWS Lake Formationで管理するデータレイク上の顧客データテーブルにAmazon Athenaからアクセスしています。このテーブルに…Q74あるデータエンジニアリングチームは、プライベートサブネット内の Amazon EMR クラスターから Amazon S3 データレイクにアクセスしています。この…Q75ある企業(アカウントA)は、機密性の高い顧客データをAmazon S3に保存し、AWS KMSのカスタマーマネージドキー(CMK)で暗号化しています。別の事業部…Q76ある小売企業は、店舗の POS システムから顧客の購買データを Amazon Kinesis Data Streams にリアルタイムで送信しています。このスト…Q77ある金融サービス企業は、SEC規則17a-4(f)に準拠するため、Amazon S3に保存される取引記録を6年間、書き換えも削除もできないWORM形式で保持する…Q78ある大企業のデータプラットフォームチームは、全社データを 1 つの Amazon S3 バケットに集約しています。以下の要件があります。 ・マーケティングチーム…Q79ある大手製造業企業は、AWS上にデータレイクを構築しており、1,000以上のテーブルがAWS Glue Data Catalogに登録されています。データガバナ…Q80ある小売企業は、全国 10 地域の売上データを単一の Amazon S3 データレイクに保存しています。データは AWS Glue Data Catalog で…Q81ある小売企業は全国の販売データを Amazon Redshift の sales テーブルに統合管理しています。各地域の営業マネージャーは担当地域のデータのみ参…Q82あるデータエンジニアリングチームは、VPC内のAmazon EC2インスタンスを使ってAmazon S3にデータを書き込むETLパイプラインを運用しています。セ…Q83ある小売企業は、Amazon Redshiftに顧客の購買履歴テーブル(customer_purchases)を持ち、その中にはクレジットカード番号(card_…Q84ある大企業のデータプラットフォームチームは、AWS Glue Data Catalogで500以上のデータベースと3,000以上のテーブルを管理しています。 デ…

ドメイン別正答率・予想スコアで実力把握

無限ノックの演習モードでDEAを徹底対策

無料で演習を始める →

他の試験の練習問題

CLFAIFSAADVASOAMLASAPDOPAIPANSSCS