Microsoft Data Engineering on Microsoft Azure (DP-203日本語版) - DP-203日本語 Exam Practice Test
Question 1
注: この質問は、同じシナリオを提示する一連の質問の一部です。シリーズの各質問には、記載された目標を達成する可能性のある独自のソリューションが含まれています。一部の質問セットには複数の正解がある場合もあれば、正解がない場合もあります。
このセクションの質問に答えた後は、その質問に戻ることはできません。その結果、これらの質問はレビュー画面に表示されません。
階層構造を持つ Azure Databricks ワークスペースを作成する予定です。ワークスペースには、次の 3 つのワークロードが含まれます。
Python と SQL を使用するデータ エンジニア向けのワークロード。
Python、Scala、および SOL を使用するノートブックを実行するジョブのワークロード。
データ サイエンティストが Scala および R でアドホック分析を実行するために使用するワークロード。
会社のエンタープライズ アーキテクチャ チームは、Databricks 環境の次の標準を識別します。
データ エンジニアはクラスターを共有する必要があります。
ジョブ クラスターは、データ サイエンティストとデータ エンジニアがクラスターに展開するためのパッケージ化されたノートブックを提供するリクエスト プロセスを使用して管理されます。
すべてのデータ サイエンティストには、非アクティブ状態が 120 分続くと自動的に終了する独自のクラスターを割り当てる必要があります。現在、データサイエンティストは3名。
ワークロード用の Databricks クラスターを作成する必要があります。
解決策: 各データ サイエンティスト用の標準クラスター、データ エンジニア用の高同時実行クラスター、およびジョブ用の標準クラスターを作成します。
これは目標を達成していますか?
このセクションの質問に答えた後は、その質問に戻ることはできません。その結果、これらの質問はレビュー画面に表示されません。
階層構造を持つ Azure Databricks ワークスペースを作成する予定です。ワークスペースには、次の 3 つのワークロードが含まれます。
Python と SQL を使用するデータ エンジニア向けのワークロード。
Python、Scala、および SOL を使用するノートブックを実行するジョブのワークロード。
データ サイエンティストが Scala および R でアドホック分析を実行するために使用するワークロード。
会社のエンタープライズ アーキテクチャ チームは、Databricks 環境の次の標準を識別します。
データ エンジニアはクラスターを共有する必要があります。
ジョブ クラスターは、データ サイエンティストとデータ エンジニアがクラスターに展開するためのパッケージ化されたノートブックを提供するリクエスト プロセスを使用して管理されます。
すべてのデータ サイエンティストには、非アクティブ状態が 120 分続くと自動的に終了する独自のクラスターを割り当てる必要があります。現在、データサイエンティストは3名。
ワークロード用の Databricks クラスターを作成する必要があります。
解決策: 各データ サイエンティスト用の標準クラスター、データ エンジニア用の高同時実行クラスター、およびジョブ用の標準クラスターを作成します。
これは目標を達成していますか?
Correct Answer: B
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).
Question 2
Sales という名前の外部テーブルを含む、Pool1 という名前の Azure Synapse Analytics 専用 SQL プールがあります。Sales には売上データが含まれます。Sales の各行には、販売員の名前を含む 1 つの販売に関するデータが含まれています。
行レベル セキュリティ (RLS) を実装する必要があります。このソリューションでは、営業担当者がそれぞれの売上のみにアクセスできるようにする必要があります。
あなたは何をするべきか?回答するには、回答エリアで適切なオプションを選択します。
注: それぞれの正しい選択は 1 ポイントの価値があります。

行レベル セキュリティ (RLS) を実装する必要があります。このソリューションでは、営業担当者がそれぞれの売上のみにアクセスできるようにする必要があります。
あなたは何をするべきか?回答するには、回答エリアで適切なオプションを選択します。
注: それぞれの正しい選択は 1 ポイントの価値があります。

Correct Answer:

Explanation:
Box 1: A security policy for sale
Here are the steps to create a security policy for Sales:
Create a user-defined function that returns the name of the current user:
CREATE FUNCTION dbo.GetCurrentUser()
RETURNS NVARCHAR(128)
AS
BEGIN
RETURN SUSER_SNAME();
END;
Create a security predicate function that filters the Sales table based on the current user:
CREATE FUNCTION dbo.SalesPredicate(@salesperson NVARCHAR(128))
RETURNS TABLE
WITH SCHEMABINDING
AS
RETURN SELECT 1 AS access_result
WHERE @salesperson = SalespersonName;
Create a security policy on the Sales table that uses the SalesPredicate function to filter the data:
CREATE SECURITY POLICY SalesFilter
ADD FILTER PREDICATE dbo.SalesPredicate(dbo.GetCurrentUser()) ON dbo.Sales WITH (STATE = ON); By creating a security policy for the Sales table, you ensure that each salesperson can only access their own sales data. The security policy uses a user-defined function to get the name of the current user and a security predicate function to filter the Sales table based on the current user.
Box 2: table-value function
to restrict row access by using row-level security, you need to create a table-valued function that returns a table of values that represent the rows that a user can access. You then use this function in a security policy that applies a predicate on the table.
Question 3
Pool1という名前のAzureSynapse Analytics ApacheSparkプールがあります。
JSONファイルをAzureData Lake StorageGen2コンテナーからPool1のテーブルにロードすることを計画しています。構造とデータ型はファイルによって異なります。
ファイルをテーブルにロードする必要があります。ソリューションは、ソースデータ型を維持する必要があります。
あなたは何をするべきか?
JSONファイルをAzureData Lake StorageGen2コンテナーからPool1のテーブルにロードすることを計画しています。構造とデータ型はファイルによって異なります。
ファイルをテーブルにロードする必要があります。ソリューションは、ソースデータ型を維持する必要があります。
あなたは何をするべきか?
Correct Answer: D
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).
Question 4
Azure Synapse Analytics でエンタープライズ データ ウェアハウスを管理します。
ユーザーは、よく使用されるクエリを実行するとパフォーマンスが遅いと報告します。ユーザーは、使用頻度が低いクエリのパフォーマンスの変化を報告しません。
パフォーマンスの問題の原因を特定するには、リソースの使用率を監視する必要があります。
どの指標を監視する必要がありますか?
ユーザーは、よく使用されるクエリを実行するとパフォーマンスが遅いと報告します。ユーザーは、使用頻度が低いクエリのパフォーマンスの変化を報告しません。
パフォーマンスの問題の原因を特定するには、リソースの使用率を監視する必要があります。
どの指標を監視する必要がありますか?
Correct Answer: C
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).
Question 5
ADF1 という Azure データファクトリーを含む Azure サブスクリプションがあります。ADF1 に Pipeline! という Azure Data Factory パイプラインをデプロイします。Pipeline! の実行中に利用できるメトリックはどれですか?
Correct Answer: C
Question 6
Azure Synapse Analytics サーバーレス SQL プールにデータベースを構築しています。
Azure Data Lake Storage Gen2 コンテナー内の Parquet ファイルにデータが格納されています。
レコードは、次のサンプルに示すように構造化されています。
{
"id": 123,
"address_housenumber": "19c",
"address_line": "Memory Lane",
"applicant1_name": "Jane",
"applicant2_name": "Dev"
}
レコードには最大 2 人の応募者が含まれます。
住所フィールドのみを含むテーブルを作成する必要があります。
Transact-SQL ステートメントをどのように完成させる必要がありますか? 回答するには、回答エリアで適切なオプションを選択します。
注: それぞれの正しい選択は 1 ポイントの価値があります。

Azure Data Lake Storage Gen2 コンテナー内の Parquet ファイルにデータが格納されています。
レコードは、次のサンプルに示すように構造化されています。
{
"id": 123,
"address_housenumber": "19c",
"address_line": "Memory Lane",
"applicant1_name": "Jane",
"applicant2_name": "Dev"
}
レコードには最大 2 人の応募者が含まれます。
住所フィールドのみを含むテーブルを作成する必要があります。
Transact-SQL ステートメントをどのように完成させる必要がありますか? 回答するには、回答エリアで適切なオプションを選択します。
注: それぞれの正しい選択は 1 ポイントの価値があります。

Correct Answer:

Explanation:
Box 1: CREATE EXTERNAL TABLE
An external table points to data located in Hadoop, Azure Storage blob, or Azure Data Lake Storage. External tables are used to read data from files or write data to files in Azure Storage. With Synapse SQL, you can use external tables to read external data using dedicated SQL pool or serverless SQL pool.
Syntax:
CREATE EXTERNAL TABLE { database_name.schema_name.table_name | schema_name.table_name | table_name } ( <column_definition> [ ,...n ] ) WITH ( LOCATION = 'folder_or_filepath', DATA_SOURCE = external_data_source_name, FILE_FORMAT = external_file_format_name Box 2. OPENROWSET When using serverless SQL pool, CETAS is used to create an external table and export query results to Azure Storage Blob or Azure Data Lake Storage Gen2.
Example:
AS
SELECT decennialTime, stateName, SUM(population) AS population
FROM
OPENROWSET(BULK 'https://azureopendatastorage.blob.core.windows.net/censusdatacontainer/release
/us_population_county/year=*/*.parquet',
FORMAT='PARQUET') AS [r]
GROUP BY decennialTime, stateName
GO
Reference:
https://docs.microsoft.com/en-us/azure/synapse-analytics/sql/develop-tables-external-tables
Question 7
Sales という名前のテーブルを含む、Pool1 という名前の Azure Synapse Analytics 専用 SQL プールがあります。Sales には行レベル セキュリティ (RLS) が適用されています。RLS は、次の述語フィルターを使用します。

SalesUser1 という名前のユーザーには、Pool1 の db_datareader ロールが割り当てられています。SalesUser1 がテーブルにクエリを実行すると、Sales テーブルのどの行が返されますか?

SalesUser1 という名前のユーザーには、Pool1 の db_datareader ロールが割り当てられています。SalesUser1 がテーブルにクエリを実行すると、Sales テーブルのどの行が返されますか?
Correct Answer: A
Question 8
オンライン注文のレコードを含むデータセットのスタースキーマを設計しています。各レコードには、注文日、注文期日、および注文出荷日が含まれます。
任意の日付範囲を照会し、会計カレンダー属性で集計する場合、設計がレコードの最速の照会時間を提供することを確認する必要があります。
どの2つのアクションを実行する必要がありますか?それぞれの正解は、解決策の一部を示しています。
注:正しい選択はそれぞれ1ポイントの価値があります。
任意の日付範囲を照会し、会計カレンダー属性で集計する場合、設計がレコードの最速の照会時間を提供することを確認する必要があります。
どの2つのアクションを実行する必要がありますか?それぞれの正解は、解決策の一部を示しています。
注:正しい選択はそれぞれ1ポイントの価値があります。
Correct Answer: D,E
Question 9
Azure SynapseAnalytics専用のSQLプールにテーブルを作成することを計画しています。
表のデータは5年間保持されます。年に一度、5年以上前のデータは削除されます。
データがパーティション間で均等に分散されていることを確認する必要があります。ソリューションでは、古いデータの削除に必要な時間を最小限に抑える必要があります。
Transact-SQLステートメントをどのように完了する必要がありますか?答えるには、適切な値を正しいターゲットにドラッグします。各値は、1回使用することも、複数回使用することも、まったく使用しないこともできます。コンテンツを表示するには、ペイン間で分割バーをドラッグするか、スクロールする必要がある場合があります。
注:正しい選択はそれぞれ1ポイントの価値があります。

表のデータは5年間保持されます。年に一度、5年以上前のデータは削除されます。
データがパーティション間で均等に分散されていることを確認する必要があります。ソリューションでは、古いデータの削除に必要な時間を最小限に抑える必要があります。
Transact-SQLステートメントをどのように完了する必要がありますか?答えるには、適切な値を正しいターゲットにドラッグします。各値は、1回使用することも、複数回使用することも、まったく使用しないこともできます。コンテンツを表示するには、ペイン間で分割バーをドラッグするか、スクロールする必要がある場合があります。
注:正しい選択はそれぞれ1ポイントの価値があります。

Correct Answer:

Explanation:
Box 1: HASH
Box 2: OrderDateKey
In most cases, table partitions are created on a date column.
A way to eliminate rollbacks is to use Metadata Only operations like partition switching for data management.
For example, rather than execute a DELETE statement to delete all rows in a table where the order_date was in October of 2001, you could partition your data early. Then you can switch out the partition with data for an empty partition from another table.
Reference:
https://docs.microsoft.com/en-us/sql/t-sql/statements/create-table-azure-sql-data-warehouse
https://docs.microsoft.com/en-us/azure/synapse-analytics/sql/best-practices-dedicated-sql-pool
Question 10
Azure SynapseAnalytics専用のSQLプールを設計しています。
次の表に示すように、グループはプール内の機密データにアクセスできます。

機密データのポリシーがあります
NS。次の表に示すように、ポリシーは地域によって異なります。

各地域の患者の表があります。テーブルには、次の潜在的に機密性の高い列が含まれています。

コンプライアンスを維持するために動的データマスキングを設計しています。
次の各ステートメントについて、ステートメントがtrueの場合は、[はい]を選択します。それ以外の場合は、[いいえ]を選択します。
注:正しい選択はそれぞれ1ポイントの価値があります。

次の表に示すように、グループはプール内の機密データにアクセスできます。

機密データのポリシーがあります
NS。次の表に示すように、ポリシーは地域によって異なります。

各地域の患者の表があります。テーブルには、次の潜在的に機密性の高い列が含まれています。

コンプライアンスを維持するために動的データマスキングを設計しています。
次の各ステートメントについて、ステートメントがtrueの場合は、[はい]を選択します。それ以外の場合は、[いいえ]を選択します。
注:正しい選択はそれぞれ1ポイントの価値があります。

Correct Answer:

Explanation:

Reference:
https://docs.microsoft.com/en-us/azure/azure-sql/database/dynamic-data-masking-overview
Question 11
Azure Active Directory(Azure AD)統合を使用して、Azure Data Lake StorageGen2に自動的に接続するAzureDatabricksクラスターを実装する必要があります。新しいクラッターをどのように構成する必要がありますか?答えるには、答えの中から適切なオプションを選択してください。注:正しい選択はそれぞれ1ポイントの価値があります。


Correct Answer:

Explanation:

https://docs.azuredatabricks.net/spark/latest/data-sources/azure/adls-passthrough.html

