Professional-Data-Engineer 문제 216

Flowlogistic은 실시간 재고 추적 시스템을 도입하고 있습니다. 모든 추적 장치는 패키지 추적 메시지를 전송하며, 이 메시지는 기존의 Apache Kafka 클러스터 대신 단일 Google Cloud Pub/Sub 토픽으로 전송됩니다. 구독 애플리케이션은 이 메시지를 처리하여 실시간 보고서를 생성하고, 과거 분석을 위해 Google BigQuery에 저장합니다. 따라서 패키지 데이터의 시간 경과에 따른 분석이 가능하도록 하는 것이 중요합니다.
어떤 접근 방식을 취해야 할까요?

Professional-Data-Engineer 문제 217

전 세계 수백만 대의 IoT 기기에서 센서 데이터를 수집하여 BigQuery에 저장하고 있습니다. 데이터 접근 패턴은 location_id와 device_version으로 필터링된 최근 데이터를 기반으로 하며, 다음 쿼리를 사용합니다.

비용과 성능을 최적화하기 위해 쿼리를 어떻게 구성해야 할까요?

Professional-Data-Engineer 문제 218

귀사는 6개월 동안 Google BigQuery에서 데이터를 수집 및 분석해 왔습니다. 대다수의 경우
분석된 데이터는 events_partitioned라는 이름의 시간 분할 테이블에 저장됩니다. 이를 줄이기 위해
쿼리 비용과 관련하여, 귀사에서는 최근 14일간의 데이터만 조회하는 '이벤트'라는 뷰를 생성했습니다.
데이터입니다. 뷰는 기존 SQL로 설명되어 있습니다. 다음 달에는 기존 애플리케이션이 연결될 예정입니다.
BigQuery를 사용하여 ODBC 연결을 통해 이벤트 데이터를 읽으려면 애플리케이션이 이를 지원할 수 있도록 해야 합니다.
연결하세요. 어떤 두 가지 행동을 취해야 할까요? (두 가지를 선택하세요.)

Professional-Data-Engineer 문제 219

테이블의 첫 세 열에 대해서만 사용자에게 읽기 권한을 부여하려면 어떤 접근 제어 방법을 사용해야 할까요?

Professional-Data-Engineer 문제 220

Google Data Studio 360에서 대규모 팀을 위한 중요한 보고서를 작성했습니다. 이 보고서는 Google BigQuery를 데이터 소스로 사용합니다. 그런데 시각화에 1시간 이내의 데이터가 표시되지 않는 것을 발견했습니다. 어떻게 해야 할까요?