SPS-C01 문제 41

대규모 데이터 세트를 처리해야 하는 Snowpark Python 애플리케이션을 개발 중입니다. Snowflake 데이터 웨어하우스 전체에서 복잡한 계산을 병렬로 수행하기 위해 사용자 정의 함수(UDF)를 활용하여 성능을 최적화하려고 합니다. 다음 중 Snowpark UDF에 대한 설명으로 옳은 것은 무엇입니까?

SPS-C01 문제 42

복잡한 데이터 변환을 수행하는 Python 함수가 있는데, 이 함수는 Snowpark SQL에서 직접 표현하기에는 너무 복잡합니다. 이 함수를 사용자 정의 테이블 함수(UDTF)로 등록하여 Snowpark DataFrame의 행을 확장하는 데 사용하려고 합니다. 이 UDTF는 ID(정수)와 문자열 두 개의 인수를 받습니다. 반환 값은 ID(정수), 문자열, 그리고 타임스탬프(timestamp) 세 개의 열로 구성된 테이블입니다. 다음 코드 조각 중 이 UDTF를 올바르게 등록하여 Snowpark에서 사용할 수 있도록 하는 것은 무엇입니까?

SPS-C01 문제 43

대규모 DataFrame을 사용하여 복잡한 데이터 변환을 수행하는 Snowpark Python 애플리케이션을 최적화해야 합니다. 애플리케이션이 예상보다 느리게 실행되고 있습니다. 데이터 편향으로 인해 Snowflake 웨어하우스 노드 간에 작업이 고르게 분산되지 않는 것이 원인이라고 의심됩니다. 다음 중 데이터 편향을 완화하고 Snowpark 애플리케이션 성능을 향상시키는 데 사용할 수 있는 기술은 무엇입니까? (두 가지를 선택하십시오)

SPS-C01 문제 44

데이터 엔지니어링 팀이 IoT 센서 데이터를 처리하기 위한 Snowpark 파이프라인을 구축하고 있습니다. 이 팀은 센서 판독값을 분석하기 위해 타사 Python 라이브러리(Snowflake의 Anaconda 채널에서는 사용할 수 없음)를 사용하는 사용자 정의 함수(UDF)를 만들고자 합니다. 이 UDF는 Snowflake 내에서 효율적으로 배포 및 관리되어야 합니다. 다음 중 Snowpark를 사용하여 이 UDF를 등록하고 배포하는 가장 강력하고 확장 가능한 방법은 무엇입니까?

SPS-C01 문제 45

복잡한 데이터 변환을 수행하는 Snowpark Python UDTF 파일이 있으며, 이 파일을 다른 Snowflake 계정과 안전하게 공유하려고 합니다. Snowflake 보안 데이터 공유를 사용하여 이 UDTF 파일을 올바르게 공유하기 위한 모든 필수 단계와 고려 사항을 선택하십시오.