Databricks-Certified-Professional-Data-Engineer-KR 문제 51
뷰 업데이트는 고객 테이블에 삽입 또는 업데이트될 모든 새로 수집된 데이터의 증분 배치를 나타냅니다.
이러한 기록을 처리하는 데에는 다음과 같은 논리가 사용됩니다.

이 구현을 설명하는 문장은 무엇입니까?
이러한 기록을 처리하는 데에는 다음과 같은 논리가 사용됩니다.

이 구현을 설명하는 문장은 무엇입니까?
Databricks-Certified-Professional-Data-Engineer-KR 문제 52
뷰 업데이트는 고객 테이블에 삽입 또는 업데이트될 모든 새로 수집된 데이터의 증분 배치를 나타냅니다.
이러한 기록을 처리하는 데에는 다음과 같은 논리가 사용됩니다.
고객과 합병하세요
사용 (
SELECT updates.customer_id as merge_ey, updates .*
업데이트에서
유니온 올
merge_key로 NULL을 선택하고 업데이트를 실행합니다.
업데이트에서 참여하세요
ON updates.customer_id = customers.customer_id
WHERE customers.current = true AND updates.address < > customers.address ) staged_updates ON customers.customer_id = mergekey WHEN MATCHED AND customers. current = true AND customers.address < > staged_updates.
그런 다음 주소를 지정하세요
UPDATE SET current = false, end_date = staged_updates.effective_date
일치하지 않을 경우
고객 ID, 주소, 현재 날짜, 유효 날짜, 종료 날짜 삽입
VALUES (staged_updates.customer_id, staged_updates.address, true, staged_updates.effective_date, null) 이 구현을 설명하는 문장은 무엇입니까?
이러한 기록을 처리하는 데에는 다음과 같은 논리가 사용됩니다.
고객과 합병하세요
사용 (
SELECT updates.customer_id as merge_ey, updates .*
업데이트에서
유니온 올
merge_key로 NULL을 선택하고 업데이트를 실행합니다.
업데이트에서 참여하세요
ON updates.customer_id = customers.customer_id
WHERE customers.current = true AND updates.address < > customers.address ) staged_updates ON customers.customer_id = mergekey WHEN MATCHED AND customers. current = true AND customers.address < > staged_updates.
그런 다음 주소를 지정하세요
UPDATE SET current = false, end_date = staged_updates.effective_date
일치하지 않을 경우
고객 ID, 주소, 현재 날짜, 유효 날짜, 종료 날짜 삽입
VALUES (staged_updates.customer_id, staged_updates.address, true, staged_updates.effective_date, null) 이 구현을 설명하는 문장은 무엇입니까?
Databricks-Certified-Professional-Data-Engineer-KR 문제 53
프로덕션 환경에 배포된 구조화된 스트리밍 작업으로 인해 예상보다 높은 클라우드 스토리지 비용이 발생하고 있습니다. 현재 정상적인 실행 환경에서 각 마이크로 배치 데이터는 3초 이내에 처리되지만, 분당 최소 12회 이상 레코드가 없는 마이크로 배치가 처리되고 있습니다. 스트리밍 쓰기는 기본 트리거 설정을 사용하여 구성되었습니다. 해당 프로덕션 작업은 배치 실행 작업의 시작 시간을 단축하기 위해 인스턴스 풀이 프로비저닝된 워크스페이스에서 다른 여러 Databricks 작업과 함께 예약되어 있습니다. 다른 모든 변수를 일정하게 유지하고 레코드를 10분 이내에 처리해야 한다고 가정할 때, 어떤 조정이 요구 사항을 충족할까요?
Databricks-Certified-Professional-Data-Engineer-KR 문제 54
Databricks SQL 대시보드가 다음 쿼리 패턴을 사용하여 Delta Lake 테이블 모음에 있는 총 레코드 수를 모니터링하도록 구성되었습니다.
테이블에서 COUNT(*)를 선택합니다 -
다음 중 대시보드가 업데이트될 때마다 결과가 생성되는 방식을 설명하는 것은 무엇입니까?
테이블에서 COUNT(*)를 선택합니다 -
다음 중 대시보드가 업데이트될 때마다 결과가 생성되는 방식을 설명하는 것은 무엇입니까?
Databricks-Certified-Professional-Data-Engineer-KR 문제 55
머신러닝 팀은 델타 레이크 레이크의 레이크하우스에 있는 customer_parsams라는 테이블을 고객 이탈 예측에 사용합니다. 이 테이블에는 여러 상위 소스에서 가져온 고객 정보가 포함되어 있습니다.
현재 데이터 엔지니어링 팀은 상위 데이터 소스에서 가져온 최신 유효 값으로 테이블을 덮어쓰는 방식으로 매일 밤 이 테이블을 업데이트합니다.
데이터 엔지니어 팀은 업데이트가 완료되는 즉시 새 버전과 이전 버전 간의 차이점을 확인하고자 합니다.
현재 구현 방식을 고려할 때, 어떤 방법을 사용할 수 있을까요?
현재 데이터 엔지니어링 팀은 상위 데이터 소스에서 가져온 최신 유효 값으로 테이블을 덮어쓰는 방식으로 매일 밤 이 테이블을 업데이트합니다.
데이터 엔지니어 팀은 업데이트가 완료되는 즉시 새 버전과 이전 버전 간의 차이점을 확인하고자 합니다.
현재 구현 방식을 고려할 때, 어떤 방법을 사용할 수 있을까요?
