DEA-C01 문제 106
데이터 엔지니어는 AWS Glue를 사용하여 자동화된 추출, 변환 및 로드(ETL) 수집 파이프라인을 구축하고 있습니다. 파이프라인은 Amazon S3 버킷에 있는 압축 파일을 수집합니다. 수집 파이프라인은 증분 데이터 처리를 지원해야 합니다.
이 요구 사항을 충족하기 위해 데이터 엔지니어는 어떤 AWS Glue 기능을 사용해야 합니까?
이 요구 사항을 충족하기 위해 데이터 엔지니어는 어떤 AWS Glue 기능을 사용해야 합니까?
DEA-C01 문제 107
올바른 문장을 표시하세요:
문장 1. ALTER DATABASE ... ENABLE FAILOVER TO ACCOUNTS 문장을 사용하여 조직의 하나 이상의 계정에 대한 기본 데이터베이스에 대한 장애 조치를 활성화합니다.
설명 2. 기본 데이터베이스에 대한 장애 조치를 활성화하는 작업은 지정된 계정에 기본 데이터베이스의 복제본이 생성되기 전이나 후에 데이터 엔지니어가 수행할 수 있습니다.
문장 1. ALTER DATABASE ... ENABLE FAILOVER TO ACCOUNTS 문장을 사용하여 조직의 하나 이상의 계정에 대한 기본 데이터베이스에 대한 장애 조치를 활성화합니다.
설명 2. 기본 데이터베이스에 대한 장애 조치를 활성화하는 작업은 지정된 계정에 기본 데이터베이스의 복제본이 생성되기 전이나 후에 데이터 엔지니어가 수행할 수 있습니다.
DEA-C01 문제 108
한 회사는 Amazon Athena를 사용하여 Create Table As Select(CTAS)를 사용하여 추출, 변환 및 로드(ETL) 작업에 대한 SQL 쿼리를 실행합니다. 이 회사는 분석을 생성하기 위해 SQL 대신 Apache Spark를 사용해야 합니다.
어떤 솔루션을 사용하면 회사가 Spark를 사용하여 Athena에 액세스할 수 있을까요?
어떤 솔루션을 사용하면 회사가 Spark를 사용하여 Athena에 액세스할 수 있을까요?
DEA-C01 문제 109
분산 컴퓨팅 프레임워크를 사용하여 대용량 데이터 세트를 처리할 때 데이터의 불균일한 분포로 인해 처리 지연이 발생할 수 있습니다. 이 현상은 일반적으로 무엇으로 알려져 있습니까?
DEA-C01 문제 110
회사는 AWS에 데이터 레이크를 구축해야 합니다. 회사는 특정 팀에 행 수준 데이터 액세스와 열 수준 데이터 액세스를 제공해야 합니다. 팀은 Amazon Athena, Amazon Redshift Spectrum, Amazon EMR의 Apache Hive를 사용하여 데이터에 액세스합니다.
어떤 솔루션이 운영 비용을 최소화하면서 이러한 요구 사항을 충족할 수 있을까요?
어떤 솔루션이 운영 비용을 최소화하면서 이러한 요구 사항을 충족할 수 있을까요?
