Professional-Data-Engineer 문제 6
거의 실시간으로 분당 10,000개의 메시지 속도로 Google BigQuery에 소셜 미디어 게시물을 저장하고 분석해야 합니다. 처음에는 개별 게시물에 스트리밍 삽입을 사용하도록 애플리케이션을 디자인합니다. 또한 애플리케이션은 스트리밍 삽입 직후에 데이터 집계를 수행합니다. 스트리밍 삽입 후 쿼리가 강력한 일관성을 나타내지 않고 쿼리 보고서에서 진행 중인 데이터가 누락될 수 있음을 발견했습니다. 애플리케이션 디자인을 어떻게 조정할 수 있습니까?
Professional-Data-Engineer 문제 7
조직 샘플에 대한 정보 데이터베이스를 사용하여 미래의 조직 샘플을 정상 또는 돌연변이로 분류하려고 합니다. 조직 샘플을 분류하기 위해 감독되지 않은 이상 탐지 방법을 평가하고 있습니다. 이 방법을 지원하는 두 가지 특성은 무엇입니까? (2개를 선택하세요.)
Professional-Data-Engineer 문제 8
귀하는 각기 다른 우선 순위와 예산을 가진 여러 사업부를 보유한 대기업의 BI 책임자입니다. 프로젝트당 2,000개의 동시 주문형 슬롯 할당량이 있는 BigQuery에 주문형 가격 책정을 사용합니다. 조직의 사용자가 쿼리를 실행할 슬롯을 얻지 못하는 경우가 있으므로 이를 수정해야 합니다. 계정에 새 프로젝트를 도입하는 것을 피하고 싶습니다.
당신은 무엇을해야합니까?
당신은 무엇을해야합니까?
Professional-Data-Engineer 문제 9
일정에 따라 Cloud Dataproc 클러스터에서 실행되는 여러 Spark 작업이 있습니다. 일부 작업은 순서대로 실행되고 일부 작업은 동시에 실행됩니다. 이 프로세스를 자동화해야 합니다. 당신은 무엇을해야합니까?
Professional-Data-Engineer 문제 10
Cloud Bigtable용 HBase 셸이란?
