Professional-Data-Engineer 문제 161
온라인 소매업체의 고객 서비스 효율화를 위해 챗봇을 구축하려고 합니다. 챗봇은 텍스트 및 음성 문의 모두에 응답할 수 있어야 합니다. 로우코드 또는 노코드 방식을 선호하며, 키워드에 대한 답변을 제공하도록 챗봇을 쉽게 학습시킬 수 있는 방법을 찾고 있습니다. 어떤 방법을 선택해야 할까요?
Professional-Data-Engineer 문제 162
아래와 같은 고객 데이터를 분석하기 위해 Google Dataflow SDK를 사용할 계획입니다. 프로젝트 요구 사항은 데이터 소스에서 고객 이름만 추출하여 출력 PCollection에 저장하는 것입니다.
톰, 555 X 스트리트
팀, Y 스트리트 553번지
샘, Z 스트리트 111번지
위의 데이터 처리 요구사항에 가장 적합한 연산은 무엇입니까?
톰, 555 X 스트리트
팀, Y 스트리트 553번지
샘, Z 스트리트 111번지
위의 데이터 처리 요구사항에 가장 적합한 연산은 무엇입니까?
Professional-Data-Engineer 문제 163
You want to migrate an on-premises Hadoop system to Cloud Dataproc. Hive is the primary tool in use, and the data format is Optimized Row Columnar (ORC). All ORC files have been successfully copied to a Cloud Storage bucket. You need to replicate some data to the cluster's local Hadoop Distributed File System (HDFS) to maximize performance. What are two ways to start using Hive in Cloud Dataproc? (Choose two.)
Professional-Data-Engineer 문제 164
귀사는 자체 시스템을 사용하여 6시간마다 재고 데이터를 클라우드 기반 데이터 수집 서비스로 전송합니다. 전송되는 데이터에는 여러 필드로 구성된 페이로드와 전송 타임스탬프가 포함됩니다. 전송에 문제가 있는 경우 시스템은 데이터를 재전송합니다. 이러한 데이터에서 중복을 가장 효율적으로 제거하는 방법은 무엇일까요?
Professional-Data-Engineer 문제 165
BigQuery에서 소매 거래 데이터를 저장할 데이터 모델을 구축하고 있습니다. 가장 큰 두 테이블인 sales_transation_header와 sales_transation_line은 긴밀하게 연결된 불변 관계를 가지고 있습니다. 이 테이블들은 데이터 로드 후에는 거의 수정되지 않으며, 쿼리 시에는 자주 조인됩니다. 데이터 분석 쿼리의 성능을 향상시키기 위해 sales_transation_header와 sales_transation_line 테이블을 모델링해야 합니다.
어떻게 해야 할까요?
어떻게 해야 할까요?
