inflearn logo
강의

講義

知識共有

[仕事終わりの趣味] ビッグデータ分析実技 (作業型1,2,3)

第3回 既出タイプ(作業型1)

결측치가 있는 행을 제거할 때

解決済みの質問

318

dudgus4532234

投稿した質問数 23

0

df = pd.DataFrame({ '날짜': ['20220103', '20220105', None, '20230127', '20220203', '20220205', '20230210', '20230223', '20230312', '20230422', '20', '23'], '제품': ['A', 'B', None, 'B', 'A', None, 'A', 'B', 'A', 'B', 'A', 'A'], '판매수': [3, None, 5, 10, 10, 10, 15, 15, 20, None, 30, 40], '개당수익': [300, 400, 500, 600, 400, 500, 500, 600, 600, 700, 600, 600]

 

판매수 컬럼에 결측치가 있는 행을 제거하라고 할 때,

 

  1. df = df['판매수'].dropna()

  2. df = df.dropna(subset = '판매수')

1번과 2번의 차이는 무엇인가요? ㅠㅠ

python 머신러닝 빅데이터 pandas 빅데이터분석기사

回答 2

2

Jason

1번은 데이터프레임 중 '판매수' 컬럼(df['판매수'], Series)에 대해서만 결측치 처리 (결측치를 포함하고 있으면 행 삭제) 후 시리즈 형태로 출력되도록 하는 코드인거 같고,

  • 결과값이 판매수 컬럼만 보임

 

2번은 전체 데이터프레임(df, DataFrame)에 대해서 '판매수' 컬럼에 결측치가 있는 행은 삭제 처리(subset = '판매수') 후 데이터프레임 형태로 출력되도록 하는 코드인거 같습니다.

  • 결과값이 전체 데이터프레임으로 보임

0

roadmap

Jason님 답변이 맞습니다.

  1. df = df['판매수'].dropna() 는 잘못된 방식입니다. 전체 df가 아닌 df['판매수']에 대해 결측치를 처리한 결과를 반환합니다. df로 최종 대입된 값은 결측행을 제거한 판매수 컬럼만 있습니다.

     

수강 연장 문의드립니다.

0

4

1

강의 연장 문의

0

14

1

수강 신청 연장 문의드립니다.

0

27

1

작업형 1번문제... 환경관련

0

24

2

12회 기출은 언제 업데이트 될까요??

0

35

2

8/6 작성한 연장문의 질문글에 대한 재요청

0

38

2

수강기간 연장 문의

0

35

2

수강기간 연장문의

0

36

2

수강기간 연장 요청 문의드립니다

0

37

2

수강 기간 연장 문의

0

46

2

수강연장 가능 문의 (기간 약 한달반)

0

58

2

수강기간 연장 가능할까요 선생님

0

73

2

Section15. 수업에 사용하는 데이터 주소가 다 보이지 않아서 실습을 위한 데이터를 다운 받지 못하고 있습니다.

0

53

3

수강연장요청 문의

0

88

2

아무래도 다음 시험 연장은 어렵겠죠?

0

106

2

빅분기 12회 결과 관련 문의

0

111

1

책이랑 강의랑 순서나 예제가 다른것 같네요

0

80

2

수강연장 문의

0

104

2

재검토 요청 방법 좀 알려주셔요...-.-;;

0

105

2

12회 실기 질문(작업형 2)

0

91

2

뒤로가기 버튼 같은 것이 있나요?

0

66

1

강의 연장 문의

0

99

2

출력값 질문

0

71

2

수업노트가 어디에 있나요?

0

63

1