DP-203 문제 91

Azure Databricks 작업 영역이 포함된 Azure 구독이 있습니다. 작업 영역에는 Notebook1이라는 노트북이 있습니다. Notebook1에서 다음 열이 포함된 df_sales라는 Apache Spark DataFrame을 만듭니다.
* 고객
* 영업사원
* 지역
* 양
HQ라는 지역에서 매출 규모 기준으로 상위 3명의 영업 사원을 파악해야 합니다.
쿼리를 어떻게 완료해야 합니까? 대답하려면 적절한 값을 올바른 대상으로 드래그합니다. 각 값은 한 번, 두 번 이상 또는 전혀 사용되지 않을 수 있습니다. 패널 사이의 분할 막대를 드래그하거나 스크롤하여 콘텐츠를 볼 수 있습니다.

DP-203 문제 92

Azure Synapse Analytics 전용 SQL 풀이 있습니다.
PDW_SHOWSPACEUSED(dbo,FactInternetSales');를 실행하면 다음 표에 나온 결과를 얻을 수 있습니다.

다음 중 dbo,FactInternetSales 테이블을 정확하게 설명하는 것은 무엇입니까?

DP-203 문제 93

Tablet이라는 이름의 Delta Lake 차원 테이블이 포함된 Azure Databricks 작업 공간이 있습니다. Table1은 Type 2 Slowly Changing Dimension(SCD) 테이블입니다. 소스 테이블에서 Table1로 업데이트를 적용해야 합니다. 어떤 Apache Spark SQL 작업을 사용해야 합니까?

DP-203 문제 94

한 회사가 Platform-as-a-Service(PaaS)를 사용하여 새로운 데이터 파이프라인 프로세스를 만들 계획입니다. 프로세스는 다음 요구 사항을 충족해야 합니다.
섭취:
여러 데이터 소스에 접근합니다.
워크플로를 조율하는 기능을 제공합니다.
SQL Server Integration Services 패키지를 실행하는 기능을 제공합니다.
가게:
빅데이터 워크로드를 위해 스토리지를 최적화합니다.
저장 중인 데이터의 암호화를 제공합니다.
크기 제한 없이 운영합니다.
준비 및 훈련:
탐색과 시각화를 위한 완벽히 관리되고 대화형인 작업 공간을 제공합니다.
R, SQL, Python, Scala, Java로 프로그래밍하는 기능을 제공합니다.
Azure Active Directory를 사용하여 원활한 사용자 인증을 제공합니다.
모델 및 서비스:
네이티브 컬럼형 저장소를 구현합니다.
SQL 언어 지원
구조화된 스트리밍에 대한 지원을 제공합니다.
데이터 통합 ​​파이프라인을 구축해야 합니다.
어떤 기술을 사용해야 합니까? 대답하려면 답변 영역에서 적절한 옵션을 선택하세요.
참고사항: 정답 하나당 1점입니다.

DP-203 문제 95

Azure Data Lake Storage Gen2 계정에 대한 폴더 구조를 디자인하고 있습니다.
다음과 같은 사용 패턴을 식별할 수 있습니다.
* 사용자는 Azure Synapse Analytics 서버리스 SQL 풀과 Azure Synapse Analytics 서버리스 Apache Spark Pod를 사용하여 데이터를 쿼리합니다.
* 대부분의 질의에는 현재 연도나 주에 대한 필터가 포함됩니다.
* 데이터는 데이터 출처에 따라 보안됩니다.
다음 요구 사항을 충족하는 폴더 구조를 추천해야 합니다.
* 사용패턴 지원
* 폴더 보안을 간소화합니다
* 쿼리 시간을 최소화합니다
어떤 폴더 구조를 추천하시나요?