Professional-Data-Engineer 문제 251

다음 중 Dataflow에서 지원하는 세 가지 주요 트리거 유형에 해당하지 않는 것은 무엇입니까?

Professional-Data-Engineer 문제 252

아래 그림과 같이 데이터가 있습니다. 두 차원은 X와 Y이며,
각 점의 음영은 해당 점이 어떤 클래스를 나타내는지 보여줍니다. 선형 회귀 분석을 사용하여 이 데이터를 정확하게 분류하려고 합니다.
이 알고리즘을 사용하려면 합성 특징을 추가해야 합니다. 그렇다면 이 합성 특징의 값은 무엇이어야 할까요?

Professional-Data-Engineer 문제 253

팀에서 공유하는 테이블들을 하나의 데이터셋에 저장하여 여러 분석가들이 쉽게 접근할 수 있도록 하고 싶습니다. 분석가들은 이 데이터를 읽을 수는 있지만 수정할 수는 없도록 하고 싶습니다. 동시에, 각 분석가들에게 동일한 프로젝트 내에서 개인 작업 공간을 제공하여, 다른 분석가들이 접근할 수 없도록 자신만의 테이블을 만들고 저장할 수 있도록 하고 싶습니다. 이러한 상황에서 어떻게 해야 할까요?

Professional-Data-Engineer 문제 254

모바일 미디어 스트리밍 서비스에 사용할 새로운 스토리지 시스템을 구축하고 있습니다. Google Cloud Datastore가 가장 적합하다고 판단했습니다. 여러 속성을 가진 엔티티가 있는데, 일부 속성은 여러 값을 가질 수 있습니다. 예를 들어, '영화' 엔티티에서 '배우'와 '태그' 속성은 여러 값을 가질 수 있지만 '개봉일' 속성은 단일 값을 가집니다. 일반적인 쿼리는 '배우=<배우 이름>'인 모든 영화를 개봉일 순으로 정렬하거나 '코미디' 태그가 있는 모든 영화를 개봉일 순으로 정렬하는 것입니다. 이러한 상황에서 인덱스 수가 기하급수적으로 증가하는 것을 어떻게 방지할 수 있을까요?

Professional-Data-Engineer 문제 255

클라우드 머신 러닝 엔진을 사용하여 자신의 컴퓨터에서 TensorFlow 학습 작업을 실행하려면 명령어를 어떻게 시작해야 할까요?