DP-203 문제 161

Azure Event Hubs에서 수신한 데이터를 처리하고 Azure Data Lake Storage Gen2 컨테이너에 수집하는 Azure Data Factory 솔루션을 빌드하고 있습니다.
데이터는 5분마다 장치에서 JSON 파일로 수집됩니다. 파일의 명명 패턴은 다음과 같습니다.
/{deviceType}/in/{YYYY}/{MM}/{DD}/{HH}/{deviceID}_{YYYY}{MM}{DD}HH}{mm}.json 시간당 deviceType당 하나의 데이터 세트가 생성되도록 일괄 데이터 처리를 위한 데이터를 준비해야 합니다.
솔루션은 읽기 시간을 최소화해야 합니다.
복사 활동을 위해 싱크를 어떻게 구성해야 합니까? 대답하려면 답변 영역에서 적절한 옵션을 선택하세요.
참고사항: 정답 하나당 1점입니다.

DP-203 문제 162

Azure Databricks를 사용하여 Purchases라는 데이터 세트를 개발할 계획입니다. Purchases에는 다음 열이 포함됩니다.
* 제품ID
* 품목가격
* 라인 총계
* 수량
* 스토어엘디
* 분
* 월
* 시간
* 년도
* 낮
각 StoreID에 따라 달라지는 시간당 증분 로드 파이프라인을 지원하기 위해 데이터를 저장해야 합니다. 솔루션은 스토리지 비용을 최소화해야 합니다. 로드를 어떻게 완료해야 합니까? 대답하려면 적절한 옵션을 선택하세요. 답변 영역에서.
참고사항: 정답 하나당 1점입니다.

DP-203 문제 163

Azure의 메트릭을 사용하여 Azure Stream Analytics 작업을 모니터링하고 있습니다.
지난 12시간 동안 평균 워터마크 지연 시간이 구성된 지연 도착 허용 범위보다 지속적으로 크다는 것을 알게 되었습니다.
이런 행동의 원인은 무엇일까요?

DP-203 문제 164

매일 200,000개의 새 파일을 생성하는 Azure Storage 계정이 있습니다. 파일 이름은 (YYY)/(MM)/(DD)/|HH])/(CustornerID).csv 형식입니다.
매 시간마다 저장소 계정에서 Azure Data Lake로 새 데이터를 추가하는 Azure Data Factory 솔루션을 설계해야 합니다. 솔루션은 로드 시간과 비용을 최소화해야 합니다.
솔루션을 어떻게 구성해야 합니까? 대답하려면 답변 영역에서 적절한 옵션을 선택하세요.
참고사항: 정답 하나당 1점입니다.

DP-203 문제 165

한 회사에서는 Apache Spark 분석을 사용하여 침입 탐지 데이터를 분석할 계획입니다.
네트워크 및 시스템 활동 데이터를 분석하여 악성 활동 및 정책 위반을 파악하기 위한 솔루션을 추천해야 합니다. 솔루션은 관리 노력을 최소화해야 합니다.
무엇을 추천해야 할까요?