DP-203 문제 171

Microsoft Azure에서 Lambda 아키텍처를 사용하여 솔루션을 개발하고 있습니다.
테스트 계층의 데이터는 다음 요구 사항을 충족해야 합니다.
데이터 저장:
* 다양한 형식의 대용량 파일을 보관하는 저장소 역할을 합니다.
* 빅데이터 분석 워크로드를 위해 최적화된 스토리지를 구현합니다.
* 계층적 구조를 사용하여 데이터를 구성할 수 있는지 확인하세요.
일괄 처리:
* 메모리 내 계산 처리를 위해 관리형 솔루션을 사용합니다.
* Scala, Python, R 프로그래밍 언어를 기본적으로 지원합니다.
* 클러스터의 크기를 자동으로 조정하고 종료하는 기능을 제공합니다.
분석 데이터 저장소:
* 병렬 처리를 지원합니다.
* 열 기반 저장을 사용합니다.
* SQL 기반 언어를 지원합니다.
람다 아키텍처를 구축하려면 올바른 기술을 식별해야 합니다.
어떤 기술을 사용해야 합니까? 답변하려면 답변 영역에서 적절한 옵션을 선택하십시오. 참고: 각 정답은 1점입니다.

DP-203 문제 172

CSV 파일에서 데이터를 수집하고, 열을 지정된 유형의 데이터로 캐스팅하고, Azure Synapse Analytic 전용 SQL 풀의 테이블에 데이터를 삽입하는 Azure Data Factory 데이터 흐름을 만들고 있습니다. CSV 파일에는 username, comment, date라는 세 개의 열이 포함되어 있습니다.
데이터 흐름에는 다음 내용이 포함되어 있습니다.
소스 변환.
적절한 데이터 유형을 설정하기 위한 파생 열 변환입니다.
데이터를 풀에 저장하기 위한 싱크 변환입니다.
데이터 흐름이 다음 요구 사항을 충족하는지 확인해야 합니다.
모든 유효한 행은 대상 테이블에 쓰여야 합니다.
댓글란의 잘림 오류는 사전에 방지해야 합니다.
삽입 시 잘림 오류를 일으킬 주석 값이 포함된 모든 행은 Blob 스토리지에 있는 파일에 기록해야 합니다.
어떤 두 가지 행동을 수행해야 합니까? 각 정답은 솔루션의 일부를 제시합니다.
참고사항: 정답 하나당 1점입니다.

DP-203 문제 173

Azure Databricks를 사용하여 DBTBL1이라는 데이터 세트를 개발합니다.
DBTBL1에는 다음과 같은 열이 포함되어 있습니다.
센서 유형 ID
지리지역ID
년도


시간

온도
윈드스피드
다른
각 GeographyRegionID에 따라 달라지는 일일 증분 로드 파이프라인을 지원하기 위해 데이터를 저장해야 합니다. 솔루션은 저장 비용을 최소화해야 합니다.
코드를 어떻게 완성해야 합니까? 대답하려면 답변 영역에서 적절한 옵션을 선택하세요.
참고사항: 정답 하나당 1점입니다.

DP-203 문제 174

다음 그림은 Azure Data Factory 파이프라인이 있는 모습입니다.

첫 번째 파이프라인 실행에 대한 실행 로그는 다음 표에 나와 있습니다.

두 번째 파이프라인 실행에 대한 실행 로그는 다음 표에 나와 있습니다.

다음 각 문장에 대해 문장이 사실이라면 예를 선택하십시오. 그렇지 않으면 아니요를 선택하십시오. 참고: 정답은 1점입니다.

DP-203 문제 175

Azure 구독이 있습니다.
Azure Data Lake Storage Gen2 Premium 계정을 배포해야 합니다. 솔루션은 다음 요구 사항을 충족해야 합니다.
* 365일이 지난 Blob은 삭제해야 합니다.
* 관리자의 노력을 최소화해야 합니다.
* 비용은 최소화되어야 합니다.
무엇을 사용해야 합니까? 대답하려면 답변 영역에서 적절한 옵션을 선택하십시오. 참고 사항 각 올바른 선택은 1점입니다.