작업형1_연습문제 7번 관련입니다.
20번 강의 > 7번 문제를 풀던 중,
모든 나이에 1을 더하고, cond1 cond2를 설정한 뒤 각 조건의 절댓값 차이를 result 변수에 넣고 값을 확인했습니다.
값이 783.37이 나왔습니다. 선생님께서는 정답을 263.13으로 말씀 주셨습니다.
코드가 같은데, 값이 다른 이유가 궁금합니다.
제가 쓴 코드는 아래에 첨부하였습니다.
df = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/refs/heads/main/p1/type1_data1.csv") df['age'] = df['age'] +1 cond1 = (df['age']>=20) & (df['age']<30) cond2 = (df['age']>=30) & (df['age']<40) result = abs(df[cond1]['views'].mean() - df[cond2]['views'].mean()) print(result) print(round(result, 2))
답변 2
0
안녕하세요, 인프런 AI 인턴입니다. 낭낭낭님.
문의하신 코드에 대해 몇 가지 검토해보겠습니다. 주어진 코드의 주요 로직은 나이(age)를 1 증가시킨 후 특정 나이 구간에서 조회수(views)의 평균을 계산하여 두 구간의 차이를 얻는 것입니다.
코드 분석 및 문제 해결:
데이터 소스 확인: 사용하신 데이터셋(
type1_data1.csv)의 원본을 확인하고 거기서 각 조건(cond1,cond2)에 해당하는 데이터가 있는지, 그리고 그 데이터의 분포가 어떻게 되어 있는지 확인해야 합니다. 특정 데이터 분포나 이상치에 따라 평균 값이 달라질 수 있기 때문입니다.조건 확인 및 절댓값 적용:
cond1과cond2조건에 만족하는 데이터가 제대로 필터링되는지 확인해 보세요. 두 구간에 데이터가 충분히 포함되지 않아서 예상과 다른 결과를 출력할 수 있습니다.구간별 데이터 확인:
print(df[cond1])및print(df[cond2])를 사용해 필터링된 데이터의 조회수(views) 평균 값을 비교하여 갑작스러운 차이의 원인을 파악하는 것이 좋습니다.
유사한 질문과 해결 방법에 대해 도움이 될 수 있는 자료 링크를 제공하겠습니다:
- 4-2 type1 작업형1 6번 문제 문의드립니다.: 데이터 필터링과 조건 설정에서 차이가 발생할 때 참고할 수 있는 자료입니다.
- 작업형1 모의문제2 6번: 필터링 조건들을 설정하는 과정에서 어떻게 정확한 결과를 얻는지에 대한 예시가 포함된 글입니다.
저는 질문자님의 이해를 돕고자 지식공유자님의 기존 답변을 참고하여 유사한 답변 링크를 추천해드리고 있습니다. 현재 베타 기능으로 답변이 만족스럽지 않을 수 있는 점 양해 부탁드립니다. 🙏 추가적으로 궁금한 점이 있으시면, 이어서 질문해 주세요. 곧 지식공유자께서 답변해 주실 것입니다.
수강연장요청 문의
0
17
1
아무래도 다음 시험 연장은 어렵겠죠?
0
60
2
빅분기 12회 결과 관련 문의
0
79
1
책이랑 강의랑 순서나 예제가 다른것 같네요
0
65
2
수강연장 문의
0
71
2
재검토 요청 방법 좀 알려주셔요...-.-;;
0
93
2
12회 실기 질문(작업형 2)
0
79
2
뒤로가기 버튼 같은 것이 있나요?
0
53
1
강의 연장 문의
0
79
2
출력값 질문
0
58
2
수업노트가 어디에 있나요?
0
49
1
실기시험 제출관련
0
212
3
6.20 작업형 2 과적합
0
209
3
코딩팡 장업형2 베이스 라인 인코딩 종류 질문
0
71
2
로지스틱회귀, 회귀
0
60
2
회귀 문제를 풀때 질문입니다.
0
68
1
불균형 처리 후 성능이 더 낮아졌다면,
0
78
2
실기 체험 제2유형 에러 문의
0
77
1
LIGHTGBM 으로 하면 pred값이 소수점 6자리까지 나오는게 맞나요
0
67
2
3번문제 등분산 가정
0
59
2
작업형3 target 형 변환 질문
0
48
2
[작업형1] 연습문제 섹션1 ~ 10 의 section4
0
65
3
원핫인코딩과 레이블 인코딩에서 concat
0
70
2
제2유형 질문입니다.
0
58
2





