Professional-Data-Engineer 문제 86

귀사는 구글 클라우드 스토리지와 구글 컴퓨트 엔진의 카산드라 클러스터에 저장된 매우 큰 데이터 세트를 대상으로 복잡한 분석을 수행하려는 새로운 데이터 과학자를 채용했습니다. 이 과학자는 주로 머신러닝 프로젝트를 위한 레이블이 지정된 데이터 세트를 생성하고 일부 시각화 작업을 진행하려고 합니다. 그녀는 자신의 노트북 성능이 작업을 수행하기에 충분하지 않아 속도가 느려진다고 보고했습니다. 당신은 그녀가 작업을 효율적으로 수행할 수 있도록 돕고 싶습니다. 어떻게 해야 할까요?

Professional-Data-Engineer 문제 87

한 항공우주 회사가 자체적인 데이터 형식을 사용하여 야간 데이터를 저장합니다. 이 새로운 데이터 소스를 BigQuery에 연결하고 데이터를 BigQuery로 스트리밍해야 합니다. 가능한 한 적은 리소스를 사용하면서 효율적으로 데이터를 BigQuery로 가져오고 싶습니다. 어떻게 해야 할까요?

Professional-Data-Engineer 문제 88

클라우드 스토리지에 데이터를 보관하려고 합니다. 일부 데이터는 매우 민감하기 때문에 클라우드 제공업체 직원이 데이터를 해독하지 못하도록 "아무도 신뢰하지 않는(Trust No One, TNO)" 암호화 방식을 사용하려고 합니다. 어떻게 해야 할까요?

Professional-Data-Engineer 문제 89

가상 머신(VM)에 배포된 Oracle 데이터베이스가 가상 사설 클라우드(VPC) 네트워크 내에 있습니다. 50개의 테이블을 BigQuery에 복제하고 지속적으로 동기화하려고 합니다. 인프라 관리 필요성을 최소화하고 싶습니다. 어떻게 해야 할까요?

Professional-Data-Engineer 문제 90

You are deploying a batch pipeline in Dataflow. This pipeline reads data from Cloud Storage, transforms the data, and then writes the data into BigQuory. The security team has enabled an organizational constraint in Google Cloud, requiring all Compute Engine instances to use only internal IP addresses and no external IP addresses. What should you do?