Google Certified Professional Data Engineer Exam (Professional-Data-Engineer日本語版) - Professional-Data-Engineer日本語 Exam Practice Test
Question 1
地震データを分析するシステムを設計します
a. 抽出、変換、ロード (ETL) プロセスは、Apache Hadoop クラスター上で一連の MapReduce ジョブとして実行されます。ETL プロセスでは、一部のステップの計算コストが高いため、データ セットの処理に数日かかります。その後、センサーの調整ステップが省略されていることがわかりました。今後、センサーの調整を体系的に実行するために、ETL プロセスをどのように変更すればよいでしょうか。
a. 抽出、変換、ロード (ETL) プロセスは、Apache Hadoop クラスター上で一連の MapReduce ジョブとして実行されます。ETL プロセスでは、一部のステップの計算コストが高いため、データ セットの処理に数日かかります。その後、センサーの調整ステップが省略されていることがわかりました。今後、センサーの調整を体系的に実行するために、ETL プロセスをどのように変更すればよいでしょうか。
Correct Answer: D
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).
Question 2
既存のオンプレミスMySQLデータベースを新しいGoogle Cloudデータウェアハウスに統合しようとしています。このデータベースには、顧客ロイヤルティの履歴データが含まれており、毎日抽出してBigQueryにロードする必要があります。セキュリティが高く、増分ロードをサポートするマネージド統合ソリューションを求めています。どうすればよいでしょうか?
Correct Answer: B
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).
Question 3
データサイエンスチームは、Cloud Storageバケット内にApache Parquet形式で保存されている大規模データセットに対して、対話型のSQLクエリを実行する必要があります。チームはApache Hiveに精通しており、既存のHiveQLクエリを活用したいと考えています。Cloud Storage内のデータに対して、チームが対話型のHiveQLクエリを直接実行できる環境を提供する必要があります。運用上のオーバーヘッドは最小限に抑えたいと考えています。どのような対策を講じるべきでしょうか?
Correct Answer: D
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).
Question 4
「person」という列の中に「city」というネストされた列を含むテーブルがあり、BigQuery で次のクエリを送信しようとするとエラーが発生するとします。
`project1.example.table1` から person を選択し、city = "London" を指定します。
どのようにしてエラーを修正しますか?
`project1.example.table1` から person を選択し、city = "London" を指定します。
どのようにしてエラーを修正しますか?
Correct Answer: A
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).
Question 5
あなたは、BigQuery でホストされている組織のデータレイクを監視しています。データ取り込みパイプラインは、Pub/Sub からデータを読み込み、BigQuery のテーブルに書き込みます。データ取り込みパイプラインの新しいバージョンがデプロイされた後、1 日あたりの保存データが 50% 増加しました。Pub/Sub のデータ量は変化せず、一部のテーブルのみ、1 日あたりのパーティションデータサイズが 2 倍になりました。データ増加の原因を調査して修正する必要があります。どうすればよいですか?
Correct Answer: A
Question 6
Bigtable アクセス ロールに関して正しくない記述は次のどれですか。
Correct Answer: B
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).
Question 7
プライベートユーザーデータを含む機密プロジェクトに取り組んでいます
a. 社内で作業を行うために、Google Cloud Platform にプロジェクトを設定しました。外部コンサルタントが、プロジェクトの Google Cloud Dataflow パイプラインで複雑な変換のコーディングを支援します。ユーザーのプライバシーをどのように維持すればよいでしょうか。
a. 社内で作業を行うために、Google Cloud Platform にプロジェクトを設定しました。外部コンサルタントが、プロジェクトの Google Cloud Dataflow パイプラインで複雑な変換のコーディングを支援します。ユーザーのプライバシーをどのように維持すればよいでしょうか。
Correct Answer: B
Question 8
リージョン内の BigQuery データセットにデータを保存するための、耐障害性アーキテクチャを設計しています。過去 7 日以内に発生したテーブルの破損イベントからアプリケーションが復旧できることを保証する必要があります。RPO が最も低く、コスト効率が最も高いマネージド サービスを採用したいと考えています。どうすればよいでしょうか?
Correct Answer: C
Question 9
あなたはBigQuery ML上で、顧客が自社製品を購入する可能性を予測する線形回帰モデルを作成しています。このモデルでは、都市名という変数を主要な予測要素として使用しています。モデルをトレーニングして提供するには、データを列に整理する必要があります。予測可能な変数を維持しながら、最小限のコーディングでデータを準備したいと考えています。どうすればよいでしょうか?
Correct Answer: D
Question 10
あなたは、個人情報(PII)データを含む可能性のあるファイルをクラウドストレージ、そして最終的にはBigQueryへとストリーミングするリアルタイム予測エンジンを構築しています。名前やメールアドレスは結合キーとしてよく使用されるため、機密データがマスキングされつつも参照整合性が維持されるようにしたいと考えています。PIIデータに権限のないユーザーがアクセスできないようにするには、クラウドデータ損失防止(Cloud DLP)APIをどのように使用すればよいでしょうか?
Correct Answer: B
Question 11
Google Cloud Bigtable インスタンスの SSD ストレージと HDD ストレージを切り替えるために推奨されるアクションは何ですか?
Correct Answer: D
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).

