Databricks-Certified-Professional-Data-Engineer-KR 문제 16
데이터 엔지니어가 스트리밍 주문 데이터를 처리하기 위해 Lakeflow 선언적 파이프라인을 설계하고 있습니다. 이 파이프라인은 Auto Loader를 사용하여 데이터를 수집하며, customer_id와 amount 값이 0보다 큰지 확인하여 데이터 품질을 보장해야 합니다. 유효하지 않은 레코드는 삭제해야 합니다.
Lakeflow Declarative Pipelines 구성 중 어떤 구성이 Python을 사용하여 이 요구 사항을 구현합니까?
Lakeflow Declarative Pipelines 구성 중 어떤 구성이 Python을 사용하여 이 요구 사항을 구현합니까?
Databricks-Certified-Professional-Data-Engineer-KR 문제 17
다음 중 델타 호수와 레이크하우스에 대한 설명으로 옳은 것은 무엇입니까?
Databricks-Certified-Professional-Data-Engineer-KR 문제 18
Databricks를 처음 사용하는 사용자가 작업 중인 파이프라인 로직의 실행 시간이 너무 오래 걸리는 문제를 해결하려고 합니다. 현재 사용자는 display() 호출을 사용하여 코드를 셀 단위로 실행하면서 새로운 변환이 작업에 추가될 때 코드가 논리적으로 올바른 결과를 생성하는지 확인하고 있습니다. 평균 실행 시간을 측정하기 위해 각 셀을 대화형으로 여러 번 실행하고 있습니다.
다음 중 어떤 조정을 하면 실제 운영 환경에서 코드 성능을 더 정확하게 측정할 수 있을까요?
다음 중 어떤 조정을 하면 실제 운영 환경에서 코드 성능을 더 정확하게 측정할 수 있을까요?
Databricks-Certified-Professional-Data-Engineer-KR 문제 19
데이터 엔지니어는 워크스페이스에 있는 기존 파이프라인의 설정을 가져와서 이를 기반으로 JSON 파일을 생성하고 버전 관리하여 새 파이프라인을 만들어야 합니다.
Databricks CLI로 구성된 웹 터미널에서 데이터 엔지니어는 어떤 명령어를 입력해야 합니까?
Databricks CLI로 구성된 웹 터미널에서 데이터 엔지니어는 어떤 명령어를 입력해야 합니까?
Databricks-Certified-Professional-Data-Engineer-KR 문제 20
데이터 엔지니어가 Databricks의 Jobs API를 사용하여 작업 모니터링 및 복구를 자동화하려고 합니다. 모든 작업을 나열하고, 실패한 작업을 식별한 후 다시 실행해야 합니다.
데이터 엔지니어는 어떤 순서로 API 작업을 수행해야 할까요?
데이터 엔지니어는 어떤 순서로 API 작업을 수행해야 할까요?
