Associate-Developer-Apache-Spark 문제 51

다음 코드 블록 중 filePath에 저장된 2개 파티션으로 구성된 쪽모이 세공 파일에서 읽어 각 파티션에 다른 스키마가 있더라도 모든 열이 정확히 한 번만 포함되도록 하는 코드 블록은 무엇입니까?
첫 번째 파티션의 스키마:
1.뿌리
2. |-- transactionId: 정수(null 가능 = 참)
3. |-- predError: 정수(null 가능 = 참)
4. |-- 값: 정수(null 허용 = true)
5. |-- storeId: 정수(null 허용 = true)
6. |-- productId: 정수(null 가능 = 참)
7. |-- f: 정수(널 입력 가능 = 참)
두 번째 파티션의 스키마:
1.뿌리
2. |-- transactionId: 정수(null 가능 = 참)
3. |-- predError: 정수(null 가능 = 참)
4. |-- 값: 정수(null 허용 = true)
5. |-- storeId: 정수(null 허용 = true)
6. |-- rollId: 정수(null 가능 = 참)
7. |-- f: 정수(널 입력 가능 = 참)
8. |-- tax_id: 정수(null 허용 = false)

Associate-Developer-Apache-Spark 문제 52

다음 중 Spark의 메모리 관리 방식을 설명하는 것은 무엇입니까?

Associate-Developer-Apache-Spark 문제 53

아래 표시된 코드 블록에 오류가 있습니다. 코드 블록은 DataFrame transactionDf의 숫자 및 null 허용 열 predError에 적용된 Python 함수 add_2_if_geq_3의 결과가 포함된 열 predErrorAdded가 포함된 DataFrame을 반환해야 합니다. 오류를 찾으십시오.
코드 블록:
1.def add_2_if_geq_3(x):
2. x가 없음인 경우:
3. 반환 x
4. elif x >= 3:
5. x+2 반환
6. 반환 x
7.
8.add_2_if_geq_3_udf = udf(add_2_if_geq_3)
9.
10.transactionsDf.withColumnRenamed("predErrorAdded", add_2_if_geq_3_udf(col("predError")))

Associate-Developer-Apache-Spark 문제 54

다음 코드 블록 중 이전에 캐시된 DataFrame transactionDf를 메모리와 디스크에서 즉시 제거하는 것은 무엇입니까?

Associate-Developer-Apache-Spark 문제 55

다음 중 셔플의 속성을 설명하는 것은 무엇입니까?