Microsoft Data Engineering on Microsoft Azure (DP-203 Korean Version) - DP-203 Korean Exam Practice Test

Question 1
참고: 이 질문은 동일한 시나리오를 제시하는 일련의 질문 중 일부입니다. 시리즈의 각 질문에는 명시된 목표를 충족할 수 있는 고유한 솔루션이 포함되어 있습니다. 일부 질문 세트에는 하나 이상의 올바른 솔루션이 있을 수 있지만 다른 질문 세트에는 올바른 솔루션이 없을 수 있습니다.
이 섹션의 질문에 답한 후에는 해당 질문으로 돌아갈 수 없습니다. 결과적으로 이러한 질문은 검토 화면에 나타나지 않습니다.
100GB의 파일이 포함된 Azure Storage 계정이 있습니다. 파일에는 텍스트 행과 숫자 값이 포함되어 있습니다. 행의 75%에는 평균 길이가 1.1MB인 설명 데이터가 포함되어 있습니다.
스토리지 계정에서 Azure Synapse Analytics의 엔터프라이즈 데이터 웨어하우스로 데이터를 복사할 계획입니다.
데이터가 빠르게 복사되도록 파일을 준비해야 합니다.
해결 방법: columnstore 인덱스가 있는 테이블에 파일을 복사합니다.
이것이 목표를 달성합니까?

Correct Answer: A
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).
Question 2
참고: 이 질문은 동일한 시나리오를 제시하는 일련의 질문 중 일부입니다. 시리즈의 각 질문에는 명시된 목표를 충족할 수 있는 고유한 솔루션이 포함되어 있습니다. 일부 질문 세트에는 하나 이상의 올바른 솔루션이 있을 수 있지만 다른 질문 세트에는 올바른 솔루션이 없을 수 있습니다.
이 섹션의 질문에 답한 후에는 해당 질문으로 돌아갈 수 없습니다. 결과적으로 이러한 질문은 검토 화면에 나타나지 않습니다.
Twitter 데이터를 분석할 Azure Stream Analytics 솔루션을 설계하고 있습니다.
각 10초 창에서 트윗 수를 계산해야 합니다. 솔루션은 각 트윗이 한 번만 계산되도록 해야 합니다.
해결 방법: 텀블링 창을 사용하고 창 크기를 10초로 설정합니다.
이것이 목표를 달성합니까?

Correct Answer: B
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).
Question 3
WS1이라는 Azure Synapse Analytics 작업 영역이 있습니다.
다음 형식의 JSON 형식 파일이 포함된 Azure Data Lake Storage Gen2 컨테이너가 있습니다.

파일을 읽으려면 WS1의 서버리스 SQL 풀을 사용해야 합니다.
Transact-SQL 문을 어떻게 완성해야 합니까? 대답하려면 적절한 값을 올바른 대상으로 끌어다 놓으십시오. 각 값은 한 번, 두 번 이상 또는 전혀 사용되지 않을 수 있습니다. 창 사이의 분할 막대를 끌어다 놓거나 스크롤하여 콘텐츠를 볼 수 있습니다.
참고사항: 정답 하나당 1점입니다.
Correct Answer:

Explanation:

Box 1: openrowset
The easiest way to see to the content of your CSV file is to provide file URL to OPENROWSET function, specify csv FORMAT.
Example:
SELECT *
FROM OPENROWSET(
BULK 'csv/population/population.csv',
DATA_SOURCE = 'SqlOnDemandDemo',
FORMAT = 'CSV', PARSER_VERSION = '2.0',
FIELDTERMINATOR =',',
ROWTERMINATOR = '\n'
Box 2: openjson
You can access your JSON files from the Azure File Storage share by using the mapped drive, as shown in the following example:
SELECT book.* FROM
OPENROWSET(BULK N't:\books\books.json', SINGLE_CLOB) AS json
CROSS APPLY OPENJSON(BulkColumn)
WITH( id nvarchar(100), name nvarchar(100), price float,
pages_i int, author nvarchar(100)) AS book
Reference:
https://docs.microsoft.com/en-us/azure/synapse-analytics/sql/query-single-csv-file
https://docs.microsoft.com/en-us/sql/relational-databases/json/import-json-documents-into-sql-server
Question 4
Pipeline1!이라는 Azure Data Factory 파이프라인이 있습니다. Pipelinel에는 데이터를 Azure Data Lake Storage Gen2 계정으로 보내는 복사 작업이 포함되어 있습니다. 파이프라인 1은 일정 트리거에 의해 실행됩니다.
복사 활동 싱크를 새 스토리지 계정으로 변경하고 변경 사항을 협업 분기에 병합합니다.
Pipelinel이 실행된 후 데이터가 새 스토리지 계정에 복사되지 않음을 발견합니다.
데이터가 새 저장소 계정에 복사되었는지 확인해야 합니다.
어떻게 해야 합니까?

Correct Answer: B
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).
Question 5
다음 요구 사항을 충족하는 Azure Synapse Analytics 전용 SQL 풀을 설계해야 합니다.
지정된 시점의 직원 기록을 반환할 수 있습니다.
최신 직원 정보를 유지합니다.
쿼리 복잡성을 최소화합니다.
직원 데이터를 어떻게 모델링해야 합니까?

Correct Answer: B
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).
Question 6
다음 Azure Stream Analytics 쿼리가 있습니다.

다음 각 진술에 대해 진술이 참이면 예를 선택하십시오. 그렇지 않으면 아니요를 선택합니다.
참고: 각 올바른 선택은 1점의 가치가 있습니다.
Correct Answer:

Explanation:
Box 1: No
Note: You can now use a new extension of Azure Stream Analytics SQL to specify the number of partitions of a stream when reshuffling the data.
The outcome is a stream that has the same partition scheme. Please see below for an example:
WITH step1 AS (SELECT * FROM [input1] PARTITION BY DeviceID INTO 10),
step2 AS (SELECT * FROM [input2] PARTITION BY DeviceID INTO 10)
SELECT * INTO [output] FROM step1 PARTITION BY DeviceID UNION step2 PARTITION BY DeviceID Note: The new extension of Azure Stream Analytics SQL includes a keyword INTO that allows you to specify the number of partitions for a stream when performing reshuffling using a PARTITION BY statement.
Box 2: Yes
When joining two streams of data explicitly repartitioned, these streams must have the same partition key and partition count.
Box 3: Yes
Streaming Units (SUs) represents the computing resources that are allocated to execute a Stream Analytics job. The higher the number of SUs, the more CPU and memory resources are allocated for your job.
In general, the best practice is to start with 6 SUs for queries that don't use PARTITION BY.
Here there are 10 partitions, so 6x10 = 60 SUs is good.
Note: Remember, Streaming Unit (SU) count, which is the unit of scale for Azure Stream Analytics, must be adjusted so the number of physical resources available to the job can fit the partitioned flow. In general, six SUs is a good number to assign to each partition. In case there are insufficient resources assigned to the job, the system will only apply the repartition if it benefits the job.
Reference:
https://azure.microsoft.com/en-in/blog/maximize-throughput-with-repartitioning-in-azure-stream-analytics/
https://docs.microsoft.com/en-us/azure/stream-analytics/stream-analytics-streaming-unit-consumption
Question 7
Azure Synapse에 SQL 풀이 있습니다.
사용자가 풀에 대한 쿼리를 완료하는 데 예상보다 오래 걸린다고 보고합니다.
문제를 진단하는 데 도움이 되도록 기본 스토리지에 모니터링을 추가해야 합니다.
어떤 두 측정항목을 모니터링해야 합니까? 각 정답은 솔루션의 일부를 나타냅니다.
참고: 각 올바른 선택은 1점의 가치가 있습니다.

Correct Answer: A,D
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).
Question 8
소매점 테이블에 대리 키를 구현해야 합니다. 솔루션은 판매 거래 데이터 세트 요구 사항을 충족해야 합니다.
무엇을 만들어야 합니까?

Correct Answer: C
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).
Question 9
R을 기본 언어로 지원하지만 Scale 및 SOL도 지원하는 Azure Databricks에서 새 노트북을 만들고 있습니다. 언어 간을 전환하려면 어떤 스위치를 사용해야 합니까?

Correct Answer: A
Explanation: Only visible for Actualtests4sure members. You can sign-up / login (it's free).