Databricks-Certified-Professional-Data-Engineer 문제 136

프로덕션 환경에 배포된 구조화된 스트리밍 작업이 하루 중 사용량이 가장 많은 시간대에 지연 현상을 보이고 있습니다.
현재 정상적인 실행 환경에서는 각 마이크로배치 데이터 처리 시간이 3초 미만입니다. 하지만 사용량이 많은 시간대에는 각 마이크로배치의 처리 시간이 매우 불규칙해지며, 때로는 30초를 초과하기도 합니다. 현재 스트리밍 쓰기는 10초 간격으로 트리거되도록 설정되어 있습니다.
다른 모든 변수를 일정하게 유지하고 레코드를 10초 이내에 처리해야 한다고 가정할 때, 어떤 조정이 요구 사항을 충족할까요?

Databricks-Certified-Professional-Data-Engineer 문제 137

프로덕션 환경에 구조화된 스트리밍 작업을 예약할 때, 쿼리 실패 시 자동으로 복구되고 비용을 낮게 유지하는 구성은 무엇입니까?

Databricks-Certified-Professional-Data-Engineer 문제 138

다음 SQL 키워드 중 기존 Delta 테이블에 새 행을 추가하는 데 사용할 수 있는 것은 무엇입니까?

Databricks-Certified-Professional-Data-Engineer 문제 139

외부 객체 스토리지 컨테이너가 /mnt/finance_eda_bucket 위치에 마운트되었습니다.
재무팀을 위한 데이터베이스를 생성하기 위해 다음과 같은 로직이 실행되었습니다.

데이터베이스가 성공적으로 생성되고 권한이 구성되면 재무팀 구성원이 다음 코드를 실행합니다.

재무팀의 모든 사용자가 재무 그룹의 구성원인 경우, tx_sales 테이블이 생성되는 방식을 설명하는 문장은 무엇입니까?

Databricks-Certified-Professional-Data-Engineer 문제 140

데이터 과학자 팀이 Git 통합을 통해 노트북 버전 관리 기능을 사용하고 있는 것을 확인했고, Databricks 리포지토리로 전환할 것을 권장했습니다. 팀이 Databricks 리포지토리로 전환해야 하는 이유는 다음과 같을 수 있습니다.