Professional-Data-Engineer 문제 136
BigQuery에서 비정규화된 데이터 구조를 사용하면 어떤 이점이 있나요?
Professional-Data-Engineer 문제 137
Dataflow를 사용하여 Cloud Storage에서 BigQuery로 데이터를 처리하기 위한 아키텍처를 설계하고 있습니다.
네트워크팀은 파이프라인에서 사용할 공유 VPC 네트워크와 서브네트워크를 제공했습니다.
공유 VPC 네트워크에서 파이프라인 배포를 사용 설정해야 합니다. 당신은 무엇을 해야 합니까?
네트워크팀은 파이프라인에서 사용할 공유 VPC 네트워크와 서브네트워크를 제공했습니다.
공유 VPC 네트워크에서 파이프라인 배포를 사용 설정해야 합니다. 당신은 무엇을 해야 합니까?
Professional-Data-Engineer 문제 138
데이터 파이프라인에 보안 모범 사례를 구현하고 있습니다. 현재 프로젝트 소유자로서 작업을 수동으로 실행하고 있습니다. Google Cloud Storage에서 비공개 정보가 포함된 야간 배치 파일을 가져와 Google Cloud Dataproc 클러스터에서 Spark Scala 작업으로 처리하고 결과를 Google BigQuery에 저장하여 이러한 작업을 자동화하려고 합니다.
이 워크로드를 어떻게 안전하게 실행해야 할까요?
이 워크로드를 어떻게 안전하게 실행해야 할까요?
Professional-Data-Engineer 문제 139
5년간의 로그 데이터를 Cloud Storage에 업로드했습니다. 사용자가 로그 데이터의 일부 데이터 포인트가 예상 범위를 벗어났다고 보고했습니다. 이는 오류를 나타냅니다. 이 문제를 해결하고 나중에 프로세스를 다시 실행할 수 있어야 합니다. 규정 준수를 위해 원본 데이터를 유지합니다. 당신은 무엇을 해야 합니까?
Professional-Data-Engineer 문제 140
Bigtable의 시계열 데이터에서 핫스팟을 방지하기 위해 가장 선호되는 방법은 무엇인가요?
