SAA-C03 문제 1

한 운송 회사는 트럭에 부착된 IoT 센서를 사용하여 전 세계 배송 차량에 대한 차량 데이터를 수집합니다. 이 회사는 현재 작은 .csv 파일로 센서 데이터를 Amazon S3에 보냅니다. 그런 다음 파일은 노드당 2개의 슬라이스가 있는 10노드 Amazon Redshift 클러스터에 로드되고 Amazon Athena와 Amazon Redshift를 모두 사용하여 쿼리됩니다. 회사는 파일을 최적화하여 쿼리 비용을 줄이고 Amazon Redshift 클러스터로의 데이터 로드 속도를 향상시키려고 합니다.
이러한 요구 사항을 충족하는 솔루션은 무엇입니까?

SAA-C03 문제 2

회사는 데이터 레이크를 구축 중이며 시계열 데이터가 있는 관계형 데이터베이스에서 데이터를 수집해야 합니다.
회사는 이를 달성하기 위해 관리형 서비스를 사용하려고 합니다. 프로세스는 매일 예약되어야 하며 소스의 증분 데이터만 Amazon S3으로 가져와야 합니다.
이러한 요구 사항을 충족하기 위한 가장 비용 효율적인 접근 방식은 무엇입니까?

SAA-C03 문제 3

한 회사는 AWS Lambda 함수를 사용하여 교차 계정 AWS Glue 데이터 카탈로그에 대해 Amazon Athena 쿼리를 실행하고 있습니다. 쿼리는 다음 오류를 반환합니다.
하이브 메타스토어 오류
오류 메시지에는 응답 페이로드 크기가 허용되는 최대 페이로드 크기를 초과한다고 명시되어 있습니다. 쿼리된 테이블은 이미 분할되어 있으며 데이터는 Apache Hive 파티션 형식으로 Amazon S3 버킷에 저장됩니다.
이 오류를 해결하려면 어떤 솔루션이 필요합니까?

SAA-C03 문제 4

마케팅 회사는 클릭스트림 데이터를 수집합니다. 회사는 데이터를 Amazon Kinesis Data Firehose로 보내고 Amazon S3에 데이터를 저장합니다. 회사는 여러 부서에 걸쳐 수백 명의 사용자가 사용할 일련의 대시보드를 구축하려고 합니다. 회사는 Amazon QuickSight를 사용하여 다음을 수행할 것입니다. 이러한 대시보드 개발 회사는 리소스가 제한되어 있으며 클릭스트림 활동에 대한 일일 업데이트를 확장하고 제공할 수 있는 솔루션을 원합니다. 가장 비용 효과적인 솔루션을 제공할 옵션 조합은 무엇입니까? (2개 선택)

SAA-C03 문제 5

한 유틸리티 회사는 Amazon QuickSight에서 매일 에너지 사용량에 대한 데이터를 시각화하려고 합니다. 회사의 데이터 분석 전문가는 데이터를 수집하여 Amazon S3에 수집하기 위한 데이터 파이프라인을 구축했습니다. 매일 데이터는 개별 csv 파일에 저장됩니다. S3 버킷 이것은 이름 지정 구조의 예입니다.
20210707_datacsv 20210708_datacsv
Amazon Athena를 통해 QuickSight에서 데이터 쿼리를 허용하기 위해 전문가는 AWS Glue 크롤러를 사용하여 "s3 //powertransformer/20210707_data csv" 경로가 있는 테이블을 생성했습니다. 그러나 데이터를 쿼리하면 0행이 반환됩니다. 이 문제를 어떻게 해결할 수 있습니까? ?