Professional-Data-Engineer 문제 71
다음 조건을 충족하도록 클라우드 네이티브 기록 데이터 처리 시스템을 설계하고 있습니다.
* 분석 중인 데이터는 CSV, Avro 및 PDF 형식이며 Cloud Dataproc, BigQuery, Compute Engine을 비롯한 여러 분석 도구에서 액세스할 수 있습니다.
* 스트리밍 데이터 파이프라인은 매일 새로운 데이터를 저장합니다.
* 성능은 솔루션의 요소가 아닙니다.
* 솔루션 설계는 가용성을 극대화해야 합니다.
이 솔루션을 위한 데이터 스토리지는 어떻게 설계해야 합니까?
* 분석 중인 데이터는 CSV, Avro 및 PDF 형식이며 Cloud Dataproc, BigQuery, Compute Engine을 비롯한 여러 분석 도구에서 액세스할 수 있습니다.
* 스트리밍 데이터 파이프라인은 매일 새로운 데이터를 저장합니다.
* 성능은 솔루션의 요소가 아닙니다.
* 솔루션 설계는 가용성을 극대화해야 합니다.
이 솔루션을 위한 데이터 스토리지는 어떻게 설계해야 합니까?
Professional-Data-Engineer 문제 72
BigQuery에서 처리하는 열 수를 줄이는 데 사용할 수 있는 SQL 키워드는 무엇인가요?
Professional-Data-Engineer 문제 73
3개의 클리닉에서 수백 명의 환자를 대상으로 하는 파일럿 프로젝트로 환자 기록용 데이터베이스를 설계했습니다.
디자인에서는 단일 데이터베이스 테이블을 사용하여 모든 환자와 그들의 방문을 표시하고 자체 조인을 사용하여 보고서를 생성했습니다. 서버 리소스 사용률은 50%였습니다. 그 이후로 프로젝트의 범위가 확장되었습니다.
데이터베이스는 이제 100배 더 많은 환자 기록을 저장해야 합니다. 보고서에 시간이 너무 오래 걸리거나 컴퓨팅 리소스가 부족한 오류가 발생하기 때문에 더 이상 보고서를 실행할 수 없습니다. 데이터베이스 디자인을 어떻게 조정해야 합니까?
디자인에서는 단일 데이터베이스 테이블을 사용하여 모든 환자와 그들의 방문을 표시하고 자체 조인을 사용하여 보고서를 생성했습니다. 서버 리소스 사용률은 50%였습니다. 그 이후로 프로젝트의 범위가 확장되었습니다.
데이터베이스는 이제 100배 더 많은 환자 기록을 저장해야 합니다. 보고서에 시간이 너무 오래 걸리거나 컴퓨팅 리소스가 부족한 오류가 발생하기 때문에 더 이상 보고서를 실행할 수 없습니다. 데이터베이스 디자인을 어떻게 조정해야 합니까?
Professional-Data-Engineer 문제 74
관리형 Hadoop 시스템을 데이터 레이크로 구축하려고 합니다. 데이터 변환 프로세스는 순서대로 실행되는 일련의 Hadoop 작업으로 구성됩니다. 컴퓨팅에서 스토리지를 분리하는 설계를 달성하기 위해 Cloud Storage 커넥터를 사용하여 모든 입력 데이터, 출력 데이터 및 중간 데이터를 저장하기로 결정했습니다. 그러나 온프레미스 베어메탈 Hadoop 환경(100GB RAM이 있는 8코어 노드)과 비교할 때 하나의 Hadoop 작업이 Cloud Dataproc에서 실행되는 속도가 매우 느립니다. 분석에 따르면 이 특정 Hadoop 작업은 디스크 I/O 집약적입니다. 문제를 해결하려고 합니다. 당신은 무엇을해야합니까?
Professional-Data-Engineer 문제 75
조직에서 GCP 사용을 확대함에 따라 많은 팀에서 자체 프로젝트를 만들기 시작했습니다.
다양한 배포 단계 및 대상 고객을 수용하기 위해 프로젝트가 더욱 증가합니다.
각 프로젝트에는 고유한 액세스 제어 구성이 필요합니다. 중앙 IT 팀은 모든 프로젝트에 액세스할 수 있어야 합니다. 또한 Cloud Storage 버킷 및 BigQuery 데이터세트의 데이터는 임시 방식으로 다른 프로젝트에서 사용하기 위해 공유해야 합니다. 정책 수를 최소화하여 액세스 제어 관리를 단순화하려고 합니다. 어떤 두 단계를 취해야 합니까? 2개의 답변을 선택하세요.
다양한 배포 단계 및 대상 고객을 수용하기 위해 프로젝트가 더욱 증가합니다.
각 프로젝트에는 고유한 액세스 제어 구성이 필요합니다. 중앙 IT 팀은 모든 프로젝트에 액세스할 수 있어야 합니다. 또한 Cloud Storage 버킷 및 BigQuery 데이터세트의 데이터는 임시 방식으로 다른 프로젝트에서 사용하기 위해 공유해야 합니다. 정책 수를 최소화하여 액세스 제어 관리를 단순화하려고 합니다. 어떤 두 단계를 취해야 합니까? 2개의 답변을 선택하세요.
