SPS-C01 문제 46

다음과 같은 스키마를 가진 Snowpark DataFrame이 있습니다. '(timestamp: TmestampType, sensor_id: StringType, value: FloatType)'. 전체 데이터 세트에서 평균값이 가장 높은 상위 3개 센서를 찾아야 합니다. 다음 Snowpark Python 코드 조각 중 이 요구 사항을 올바르게 구현하는 것은 무엇입니까?

SPS-C01 문제 47

다양한 파일 형식(CSV, JSON, Parquet, XML)의 파일들이 서로 다른 위치(내부 저장소, AWS S3의 외부 저장소, Azure Blob Storage)에 저장되어 있는 상황에서 Snowpark DataFrame을 생성해야 하는 데이터 과학 팀과 협업하고 있습니다. 팀은 특정 파일 형식이나 저장 위치에 대한 세부 정보를 추상화하여 DataFrame을 생성하는 통합되고 재사용 가능한 함수를 원합니다. Snowpark Python API를 사용하는 다음 접근 방식 중 어떤 것이 가장 유연하고 유지 관리가 용이한 솔루션을 제공할까요?

SPS-C01 문제 48

'customer df'라는 Snowpark 데이터프레임을 사용하고 있는데, 이 데이터프레임에는 'registration_date'라는 열이 있으며 데이터 형식은 TIMESTAMP NTZ입니다. 2023년에 등록한 고객만 포함하도록 데이터프레임을 필터링해야 합니다. 시간대 문제를 고려했을 때, 다음 Snowpark 코드 조각 중 이 필터링을 수행하는 가장 효율적이고 정확한 방법은 무엇입니까?

SPS-C01 문제 49

Snowpark DataFrame 'employees'에는 'employee_id'(INT), 'name'(STRING), 'department'(STRING), 'salary'(DOUBLE) 컬럼이 있습니다. 각 부서에서 가장 높은 연봉을 받는 직원 상위 3명을 포함하는 새로운 DataFrame을 만들고 싶습니다. Snowpark Python을 사용하여 이 작업을 수행하는 가장 효율적이고 정확한 방법은 다음 중 무엇일까요?

SPS-C01 문제 50

`.env` 파일에 정의된 환경 변수를 사용하여 Snowpark 세션을 설정하는 작업을 맡았습니다. `python-dotenv` 패키지를 성공적으로 설치했고, 필요한 Snowflake 연결 매개변수로 `.env` 파일을 구성했습니다. 그러나 Snowpark 애플리케이션이 세션을 생성하려고 할 때 연결 오류가 발생합니다. 환경 변수에 접근하기 위해 `os.getenv`를 올바르게 사용하고 있다고 가정할 때, 다음 중 오류의 가능한 원인은 무엇일까요?