Professional-Data-Engineer 문제 271
스트리밍 Cloud Dataflow 파이프라인을 운영 중입니다. 엔지니어는 다른 창 알고리즘과 트리거 전략을 사용하는 새 버전의 파이프라인을 갖게 되었습니다. 실행 중인 파이프라인을 새 버전으로 업데이트하려고 합니다. 업데이트 중에 데이터가 손실되지 않도록 하려고 합니다. 당신은 무엇을 해야 합니까?
Professional-Data-Engineer 문제 272
대규모 부동산 회사에서 근무하며 머신러닝에 사용할 6TB의 주택 판매 데이터를 준비하고 있습니다. SOL을 사용하여 데이터를 변환하고 BigQuery ML을 사용하여 머신러닝 모델을 생성합니다.
변환되지 않은 원시 데이터 세트에 대한 예측을 위해 모델을 사용할 계획입니다. 예측 시 편향을 방지하려면 워크플로를 어떻게 설정해야 합니까?
변환되지 않은 원시 데이터 세트에 대한 예측을 위해 모델을 사용할 계획입니다. 예측 시 편향을 방지하려면 워크플로를 어떻게 설정해야 합니까?
Professional-Data-Engineer 문제 273
Cloud Pub/Sub에서 Cloud Dataflow를 통해 BigQuery로 IoT 데이터를 스트리밍하기 위해 Google Cloud에 새 파이프라인을 만들고 있습니다. 데이터를 미리 보는 동안 데이터의 약 2%가 손상된 것으로 나타납니다.
이 손상된 데이터를 필터링하려면 Cloud Dataflow 파이프라인을 수정해야 합니다. 당신은 무엇을 해야 합니까?
이 손상된 데이터를 필터링하려면 Cloud Dataflow 파이프라인을 수정해야 합니다. 당신은 무엇을 해야 합니까?
Professional-Data-Engineer 문제 274
귀하의 인프라에는 일련의 YouTube 채널이 포함되어 있습니다. 귀하는 다음에 대한 프로세스를 생성하는 임무를 맡았습니다.
분석을 위해 YouTube 채널 데이터를 Google Cloud로 보냅니다. 다음을 허용하는 솔루션을 설계하고 싶습니다.
전 세계 마케팅 팀이 최신 YouTube에서 ANSI SQL 및 기타 유형의 분석을 수행합니다.
채널 로그 데이터. Google Cloud로의 로그 데이터 전송을 어떻게 설정해야 하나요?
분석을 위해 YouTube 채널 데이터를 Google Cloud로 보냅니다. 다음을 허용하는 솔루션을 설계하고 싶습니다.
전 세계 마케팅 팀이 최신 YouTube에서 ANSI SQL 및 기타 유형의 분석을 수행합니다.
채널 로그 데이터. Google Cloud로의 로그 데이터 전송을 어떻게 설정해야 하나요?
Professional-Data-Engineer 문제 275
의류 추천을 위한 모델을 구축하고 있습니다. 사용자의 패션 선호도는 시간이 지남에 따라 변할 가능성이 높다는 것을 알고 있으므로 새로운 데이터가 제공되면 모델로 다시 스트리밍하는 데이터 파이프라인을 구축합니다.
모델을 훈련하기 위해 이 데이터를 어떻게 사용해야 합니까?
모델을 훈련하기 위해 이 데이터를 어떻게 사용해야 합니까?
