Professional-Data-Engineer 문제 46

세 곳의 병원에서 수백 명의 환자 기록을 저장하는 시범 프로젝트로 환자 기록 데이터베이스를 설계했습니다. 모든 환자와 진료 기록을 하나의 데이터베이스 테이블에 저장하고, 자체 조인을 사용하여 보고서를 생성했습니다. 당시 서버 자원 사용률은 50%였습니다. 이후 프로젝트 규모가 확장되어 데이터베이스에 100배 더 많은 환자 기록을 저장해야 합니다. 하지만 보고서 실행 시간이 너무 오래 걸리거나 컴퓨팅 자원 부족으로 오류가 발생하여 더 이상 보고서를 실행할 수 없습니다. 데이터베이스 설계를 어떻게 수정해야 할까요?

Professional-Data-Engineer 문제 47

BigQuery에서 처리하는 열 수를 줄이는 데 사용할 수 있는 SQL 키워드는 무엇입니까?

Professional-Data-Engineer 문제 48

Google Cloud에 있는 10TB 데이터베이스의 일부인 두 개의 관계형 테이블에 대한 스토리지를 설계하고 있습니다. 수평 확장이 가능한 트랜잭션을 지원하고 싶으며, 키가 아닌 열에 대한 범위 쿼리에 맞게 데이터를 최적화하고 싶습니다. 어떻게 해야 할까요?

Professional-Data-Engineer 문제 49

소셜 미디어 게시물을 분당 10,000개씩 거의 실시간으로 Google BigQuery에 저장하고 분석해야 합니다. 처음에는 개별 게시물을 스트리밍 방식으로 삽입하도록 애플리케이션을 설계했습니다. 또한, 스트리밍 삽입 직후 데이터 집계를 수행하도록 했습니다. 그런데 스트리밍 삽입 후 쿼리에서 데이터 일관성이 부족하고, 쿼리 결과 보고서에서 처리 중인 데이터가 누락될 수 있음을 발견했습니다. 애플리케이션 설계를 어떻게 수정해야 할까요?

Professional-Data-Engineer 문제 50

Google Cloud Bigtable 인스턴스의 SSD와 HDD 스토리지를 전환하려면 어떤 조치를 취하는 것이 권장됩니까?