DP-100 문제 406

참고: 이 질문은 동일한 시나리오를 제시하는 일련의 질문 중 일부입니다. 이 시리즈의 각 질문에는 명시된 목표를 충족할 수 있는 고유한 솔루션이 포함되어 있습니다. 일부 질문 세트에는 두 개 이상의 정답이 있을 수 있고, 다른 세트에는 정답이 없을 수 있습니다.
이 섹션의 질문에 답한 후에는 다시 돌아갈 수 없습니다. 따라서 이러한 질문은 검토 화면에 나타나지 않습니다.
Azure Machine Learning Studio에서 새로운 실험을 만들고 있습니다.
한 클래스는 훈련 세트의 다른 클래스보다 관찰치가 훨씬 적습니다.
계층 불균형을 보상하기 위해 적절한 데이터 샘플링 전략을 선택해야 합니다.
해결책: 샘플링 모드에 계층화 분할을 사용합니다.
해결책이 목표를 충족하는가?

DP-100 문제 407

참고: 이 질문은 동일한 시나리오를 제시하는 일련의 질문 중 일부입니다. 이 시리즈의 각 질문에는 명시된 목표를 충족할 수 있는 고유한 솔루션이 포함되어 있습니다. 일부 질문 세트에는 두 개 이상의 정답이 있을 수 있고, 다른 세트에는 정답이 없을 수 있습니다.
이 섹션의 질문에 답한 후에는 다시 돌아갈 수 없습니다. 따라서 이러한 질문은 검토 화면에 나타나지 않습니다.
과거 데이터를 기반으로 날씨 상황을 예측하는 모델을 만듭니다.
데이터 저장소에서 데이터를 로드하고 처리된 데이터를 머신 러닝 모델의 학습 스크립트로 전달하는 처리 스크립트를 실행하는 파이프라인을 만들어야 합니다.
해결책: 다음 코드를 실행하세요.

해결책이 목표를 충족하는가?

DP-100 문제 408

다양한 도시의 주택 소유에 대한 인구 통계 데이터를 탐색할 계획입니다. 데이터는 다음 형식의 CSV 파일에 있습니다.
나이, 도시, 소득, 주택 소유자
21,시카고,50000,0
35, 시애틀, 120000, 1
23, 시애틀, 65000, 0
45, 시애틀, 130000, 1
18,시카고,48000,0
Azure Machine Learning 작업 영역에서 실험을 실행하여 데이터를 탐색하고 결과를 기록해야 합니다. 실험은 다음 정보를 기록해야 합니다.
데이터 세트의 관찰 수
주택 소유자별 소득에 대한 상자 그림
도시 이름과 각 도시의 평균 소득이 포함된 사전. 필요한 정보를 기록하려면 실험 실행 객체의 적절한 로깅 방법을 사용해야 합니다.
코드를 어떻게 완성해야 합니까? 대답하려면 적절한 코드 세그먼트를 올바른 위치로 드래그하세요.
각 코드 세그먼트는 한 번, 여러 번 또는 전혀 사용되지 않을 수 있습니다. 패널 사이의 분할 막대를 드래그하거나 스크롤하여 콘텐츠를 볼 수 있습니다.
참고사항: 정답 하나당 1점입니다.

DP-100 문제 409

참고: 이 질문은 동일한 시나리오를 제시하는 일련의 질문 중 일부입니다. 이 시리즈의 각 질문에는 명시된 목표를 충족할 수 있는 고유한 솔루션이 포함되어 있습니다. 일부 질문 세트에는 두 개 이상의 정답이 있을 수 있고, 다른 세트에는 정답이 없을 수 있습니다.
이 섹션의 질문에 답한 후에는 다시 돌아갈 수 없습니다. 따라서 이러한 질문은 검토 화면에 나타나지 않습니다.
Azure Machine Learning Studio에서 새로운 실험을 만들고 있습니다.
한 클래스는 훈련 세트의 다른 클래스보다 관찰치가 훨씬 적습니다.
계층 불균형을 보상하기 위해 적절한 데이터 샘플링 전략을 선택해야 합니다.
해결책: 주성분 분석(PCA) 샘플링 모드를 사용합니다.
해결책이 목표를 충족하는가?

DP-100 문제 410

짧은 문장 형식으로 작성된 12,000개의 고객 리뷰가 포함된 CSV 파일을 사용하여 감정 분석을 수행합니다. CSV 파일을 Azure Machine Learning Studio에 추가하고 실험의 시작점 데이터 세트로 구성합니다. Extract N-Gram Features from Text 모듈을 실험에 추가하여 데이터 세트의 고객 리뷰 열에서 핵심 문구를 추출합니다.
고객 리뷰 텍스트에서 새로운 n-gram 사전을 만들고 최대 n-gram 크기를 트라이그램으로 설정해야 합니다.
무엇을 선택해야 합니까? 대답하려면 답변 영역에서 적절한 옵션을 선택하세요.
참고사항: 정답 하나당 1점입니다.