Professional-Data-Engineer 문제 246
Flowlogistic의 CEO는 영업팀이 현장에서 더 나은 정보를 바탕으로 고객을 응대할 수 있도록 고객 기반에 대한 신속한 인사이트를 얻고 싶어합니다. 영업팀은 기술적인 지식이 부족하여 BigQuery 보고서 생성을 간소화하기 위해 시각화 도구를 구매했습니다. 그러나 방대한 데이터 때문에 어려움을 겪고 있으며, 필요한 데이터를 찾기 위한 쿼리 작업에 많은 비용을 지출하고 있습니다. 당신은 가장 비용 효율적인 방법으로 이 문제를 해결하고 싶습니다. 어떻게 해야 할까요?
Professional-Data-Engineer 문제 247
귀사는 미디어 스트리밍 서비스인 모바일 애플리케이션에 새로운 스토리지 시스템을 배포하고 있습니다.
최적의 솔루션으로 Google Cloud Datastore를 선택했습니다. 여러 속성을 가진 엔티티가 있으며, 일부 속성은 여러 값을 가질 수 있습니다. 예를 들어, '영화' 엔티티에는 '배우' 속성과 다른 속성이 있습니다.
`tags` 속성은 여러 값을 가질 수 있지만, `date released` 속성은 그렇지 않습니다. 일반적인 쿼리는 `actor=<actorname>`이 포함된 모든 영화를 `date_released` 순으로 정렬하거나, `tag=Comedy`가 포함된 모든 영화를 `date_released` 순으로 정렬하는 것입니다. 이러한 쿼리에서 인덱스 개수가 기하급수적으로 증가하는 것을 어떻게 방지할 수 있을까요?


최적의 솔루션으로 Google Cloud Datastore를 선택했습니다. 여러 속성을 가진 엔티티가 있으며, 일부 속성은 여러 값을 가질 수 있습니다. 예를 들어, '영화' 엔티티에는 '배우' 속성과 다른 속성이 있습니다.
`tags` 속성은 여러 값을 가질 수 있지만, `date released` 속성은 그렇지 않습니다. 일반적인 쿼리는 `actor=<actorname>`이 포함된 모든 영화를 `date_released` 순으로 정렬하거나, `tag=Comedy`가 포함된 모든 영화를 `date_released` 순으로 정렬하는 것입니다. 이러한 쿼리에서 인덱스 개수가 기하급수적으로 증가하는 것을 어떻게 방지할 수 있을까요?


Professional-Data-Engineer 문제 248
기존 데이터 웨어하우스를 BigQuery로 마이그레이션하고 있습니다. 모든 데이터를 데이터셋의 테이블로 마이그레이션했으며, 조직의 여러 사용자가 이 데이터를 사용할 예정입니다. 각 사용자는 팀 구성원에 따라 특정 테이블만 볼 수 있도록 권한을 설정해야 합니다. 사용자 권한 설정은 어떻게 해야 할까요?
Professional-Data-Engineer 문제 249
MJTelco는 하루에 기록적인 양의 스트림 데이터를 수집해야 하므로 Google BigQuery 사용 비용이 증가할 것을 우려하고 있습니다. MJTelco는 이러한 상황에 맞는 설계 솔루션을 요청했습니다. 이들은 tracking_table이라는 단일 대형 데이터 테이블을 필요로 하며, 매일 발생하는 이벤트에 대한 세밀한 분석을 수행하면서도 일일 쿼리 비용을 최소화하고자 합니다. 또한 스트리밍 데이터 수집 방식을 사용하고자 합니다. 어떤 솔루션을 설계해야 할까요?
Professional-Data-Engineer 문제 250
팀에서 공유하는 테이블들을 하나의 데이터셋에 저장하여 여러 분석가들이 쉽게 접근할 수 있도록 하고 싶습니다. 분석가들은 이 데이터를 읽을 수는 있지만 수정할 수는 없도록 하고 싶습니다. 동시에, 각 분석가들에게 동일한 프로젝트 내에서 개인 작업 공간을 제공하여, 다른 분석가들이 접근할 수 없도록 자신만의 테이블을 만들고 저장할 수 있도록 하고 싶습니다. 이러한 상황에서 어떻게 해야 할까요?
