작업형1 모의문제3 문제9
101
작성한 질문수 4
작업형1 모의문제3 문제9관련 질문입니다.
해설을 보고 코드를 작성했는데, 결과값이 11이 아니라 np.int32(11)로 나옵니다.
무엇이 잘못되었을까요?
문제9
구독(subscribed) 월별로 데이터 개수를 구한 뒤
가장 작은 구독 수가 있는 월을 구하시오
# your code
import pandas as pd
df = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/main/p1/members.csv")
df['subscribed']=pd.to_datetime(df['subscribed'])
df['year']= df['subscribed'].dt.year
df['month']= df['subscribed'].dt.month
df['day'] =df['subscribed'].dt.day
df= df.groupby('month').count()
df.sort_values('subscribed').index[0]=>np.int32(11)
답변 2
0
안녕하세요, 인프런 AI 인턴입니다. 신수아님, 질문 주신 내용에 대해 설명드리겠습니다.
코드 실행 결과에서 np.int32(11)로 출력되는 것은, 정렬된 결과 중 인덱스 첫 번째 값을 가져오는 부분에서 integer 타입으로 되었기 때문입니다. 사실상 결과는 11로 동일하게 나오는 것이지만 출력된 형식이 다를 뿐입니다. Python에서는 다양한 integer 타입(예: int, np.int32)이 있으며, 이는 데이터의 저장 방식을 다르게 할 수 있습니다.
해결 방법:
int 대신 np.int32가 출력되는 것은 큰 문제는 아니며, 데이터 분석 측면에서 문제의 가장 작은 구독 수가 있는 월을 찾는 데에는 영향을 미치지 않습니다. 만약 출력 형식을 바꾸고자 한다면, 마지막 라인에서 다음과 같이 변환할 수 있습니다:
int(df.sort_values('subscribed').index[0])
이렇게 하면 일반 int 타입으로 결과를 얻을 수 있습니다.
추가 예제와 설명:
groupby('month').count()부분은 각 월별로 데이터의 개수를 세는 부분으로 적절하게 사용되었습니다.
sort_values('subscribed').index[0]는 구독 수를 오름차순으로 정렬한 후 가장 작은 값을 가진 월을 반환합니다.
자세한 이해를 위해 다음과 같은 게시물을 참고하실 수 있습니다:
- 값이 다를 때 발생하는 문제 - 데이터 형식이나 계산 중 다른 결과가 나올 때 해결책을 다룬 질문입니다.
저는 질문자님의 이해를 돕고자 지식공유자님의 기존 답변을 참고하여 유사한 답변 링크를 추천해드리고 있습니다. 현재 베타 기능으로 답변이 만족스럽지 않을 수 있는 점 양해 부탁드립니다. 🙏 추가적으로 궁금한 점이 있으시면, 이어서 질문해 주세요. 곧 지식공유자께서 답변해 주실 것입니다.
뒤로가기 버튼 같은 것이 있나요?
0
28
1
강의 연장 문의
0
32
1
출력값 질문
0
31
2
수업노트가 어디에 있나요?
0
29
1
실기시험 제출관련
0
160
2
6.20 작업형 2 과적합
0
169
3
코딩팡 장업형2 베이스 라인 인코딩 종류 질문
0
54
2
로지스틱회귀, 회귀
0
52
2
회귀 문제를 풀때 질문입니다.
0
59
1
불균형 처리 후 성능이 더 낮아졌다면,
0
66
2
실기 체험 제2유형 에러 문의
0
66
1
LIGHTGBM 으로 하면 pred값이 소수점 6자리까지 나오는게 맞나요
0
52
2
3번문제 등분산 가정
0
50
2
작업형3 target 형 변환 질문
0
38
2
[작업형1] 연습문제 섹션1 ~ 10 의 section4
0
40
3
원핫인코딩과 레이블 인코딩에서 concat
0
62
2
제2유형 질문입니다.
0
49
2
C()
0
44
2
작업형 2에서 strafity 적용 유무
0
53
2
수강 기간 연장 가능 여부 문의드립니다.
0
63
1
ols
0
44
2
2유형 작성관련 질문(일반 심화)
0
41
2
2유형 작성관련 질문
0
42
2
2유형 object컬럼 개수 다르면
0
49
2





