inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

묻고 답해요

172만명의 커뮤니티!! 함께 토론해봐요.

데이터 전처리 관련

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 수업을 듣다가 replace와 map의 차이를 찾아보니 map은 딕셔너리 형태에 적여 있지 않은 모든 키값을 null로 만들고 replace는 그대로 손대지 않는다고 하는데, 그러면 1과목에서 자세한 EDA가 전제 되지 않는다고 가정했을때 왠만하면 map을 피하고 replace를 해야하지 않을까? 하는 생각이 들었는데 수업에는 map을 조금 권장하는거 같기도 하여 혹시나 여기에 대해서 제가 어떻게 생각을 정리해야할지 질문드립니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
노태호 댓글 2 좋아요 0 조회수 31

시험에서 문제 불러오기

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

시험에서는 csv파일로 제공이 되나요? 그렇다면 df = pd.read_csv('aaa.csv')를 하면 될까요? 모든 문제(데이터를 불러오는 문제)에서 이 부분을 가장 먼저 실행해야 하나요? 감사합니다!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
rosana8831 댓글 2 좋아요 0 조회수 33

2번문제 출력값 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 2번문제 평균 계산하니깐 원래 25.055 였는데 강의에서는 print() , round()를 씌우니깐 25.022로 출력되던데 이유가 뭔가요??? 저는 계속 25.055로 출력이 되네요

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
강홍구 댓글 2 좋아요 0 조회수 54

pd.get_dummies()가 bool로 반환

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

23:20 위치 one-hot encoding 부분에서 pd.get_dummies()를 실행했을때, 제 실행 결과에서는 컬럼 값이 영상에서처럼 0/1로 나타나지 않고, True, False로 보여집니다. 이부분 왜그런 것이고, 어떻게 0,1로 바꿀 수 있을까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
최유진 댓글 2 좋아요 0 조회수 44

대응표본검정 레빈

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

정규성, 등분산 O: ttest_ind 정규성O, 등분산 X: ttest_ind, equal_val=False 정규성x일때 맨 휘트니라고 배웠는데, 레빈->ttest_ind, equal_val=False 하신 이유는 무엇인가요? 정규성과, 등분산 언급이 없을 때 일까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
rosana8831 댓글 3 좋아요 0 조회수 52

단일표본검정 문제 유형

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

문제 유형이 정규성 만족할때 정규성 만족하지 않을 때 샤피로 검정(문제에서 언급된다.) 윌콕슨 가 맞을까요? 감사합니다~

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
rosana8831 댓글 2 좋아요 0 조회수 44

[작업형 3] 6~7. 카이제곱 검정

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

1. 적합도 검정 문제에서 검정통계량은 22.1666이고, p-value는 0.0001856이 맞나요? 2. 적합도 검정 문제에서 검정결과에 대한 답이 없는데 pvalue값이 0.05보다 작으니 대립가설을 채택하고, 귀무가설을 기각하는게 맞는 것인가요? (정답 : 기각??)

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
  • 적합도검정
  • 카이제곱검정
벤프 댓글 2 좋아요 0 조회수 41

9회 작업형3 문제 1-1

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

1. data=df 라고 여태 적어왔어서 그냥 당연하게 df로 적었는데 어느 때에 df라 적고 어느 때에 train이라 적는건가요..? 2. 그냥 헷갈리지않게 회귀분석을 할 때에 독립변수에 C()로 싹다 해줘버려도 되는걸까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
이관형 댓글 2 좋아요 0 조회수 54

최종답안 계산 방식 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 시험이 얼마 남지 않은 시점에서 필수함수 공부 + 노가다/육안으로 직접 확인해서 계산하기를 병행하고 있습니다. 이 문제는 소수점 셋째 자리까지 계산하라고 하였기 때문에 어떤 방식을 택하든 문제가 발생하진 않습니다만, 실제 시험에서 최종 답안을 계산할 때 어떤 방식이 더 맞는지 여쭙고 싶습니다. [코드] # 스팸 메시지의 평균 단어 개수와 정상 메시지의 평균 단어 개수를 각각 구하시오. wordsdata = df.groupby(['label'])['word_count'].mean() print(wordsdata.head()) print(abs(wordsdata.iloc[0]-wordsdata.iloc[1])) # 방법 1 print(abs(10.070026-10.022919)) # 방법 2 방법 1은 나름 정석(?)으로 구하는 것이고, 방법 2는 앞서 출력해본 wordsdata.head()의 결과물에 있는 숫자들을 그대로 활용하여 계산하는 방법입니다. [출력결과] > label ham 10.070026 spam 10.022919 Name: word_count, dtype: float64 0.047106439394330124 # 방법 1 계산 결과 0.047107000000000454 # 방법 2 계산 결과 보시면 출력되는 숫자가 방법에 따라 미세하게 다름을 확인할 수 있습니다. 어떤 방법이 실전 시험에서 더 적절한지 의견 여쭙고 싶습니다. 그리고 시험 출제하시는 분들도 이런 미세한 차이를 인지하시고 소수 셋째 지점까지 구하라고 한건지도 문의드리고 싶습니다. 감사합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
2142073 댓글 1 좋아요 0 조회수 45

PROJECT_STRUCTURE.md 파일 공유좀 해주세요

해결됨

(AI 퀀트) 코드 한 줄 안 쓰고 주식 자동 분석 시스템 만들기 feat. Claude CLI

노션에 있다고 하시는데, 노션에는 첨부 파일이 없습니다.

  • python
  • flask
  • next.js
  • 인공지능(ai)
dave 댓글 2 좋아요 0 조회수 57

맥북에서 아이패드로 연결해서 보려고 하면 화면이 안뜹니다.

미해결

프로그래밍 시작하기 : 파이썬 입문 (Inflearn Original)

안녕하세요. 맥북 스크린이 작아서 아이패드에 extend해서 강의 들으려고 하는데, 그렇게하면 소리는 나오는데 화면출력이 안됩니다. 다른 inflearn 강의는 이렇게 수강했는데, 뭐가 문제인걸까요?

  • python
마음을 녹이는 사막여우 댓글 1 좋아요 0 조회수 29

시험 치기 전 급하게 질문 사항

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

다름이 아니라 실기 시험장에서 2유형 문제 풀때 만약 평가지표가 rmse가 나온다면 예전에는 mse로 바꿔가면서 0.5 곱하고 이런식으로 한거 같은데 최근에 rmse 시험장에서 되나요? 궁금합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
이광현(Lte1) 댓글 2 좋아요 0 조회수 74

노션 사용권한 불편합니다.

해결됨

(AI 퀀트) 코드 한 줄 안 쓰고 주식 자동 분석 시스템 만들기 feat. Claude CLI

주말에 빨리 작업해놓으려고 시간내놨는데 노션 사용권한을 강의마다 신청해야 하니깐 많이 불편합니다.

  • python
  • flask
  • next.js
  • 인공지능(ai)
lhh6430 댓글 2 좋아요 0 조회수 48

유형3

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

유형3번에서 문제에서 00검정을 하라고 명시를 해주나요? 아니면 문제를 보고 판단해서 검정을 알아서 해야하나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
하시윤 댓글 2 좋아요 0 조회수 52

작업형 2 연습문제 섹션 3

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

아래와 같이 학습 데이터, 테스트 데이터를 합쳐서 데이터 인코딩을 진행했을 때 칼럼명이 1267개가 나오는데 모델 학습 시 시간이 많이 걸리는 요소가 되는 건가요? 칼럼이 이 정도면 많이 있는건지, 괜찮은 건지, 그 기준도 궁금합니다. 이렇게 합쳐서 했을 시, 모델 학습 및 예측 시간이 37초 정도 걸리는데 (코랩에서) 시험 환경에서는 더 많이 걸릴 수도 있는 거죠?(반응속도의 차이로 인해서) 랜덤포레스트 모델 이용했을 때 37초 걸리고, RMSE : 3779.6769 값이 나옵니다. lightgbm 모델을 이용했을 때 5초가 걸리고, RMSE : 4070.0473 값이 나옵니다. 만약 랜덤포레스트 모델 학습 및 예측 시간이 시험 환경에서 1분을 초과한다면 성능이 좀 떨어지더라고 lightgbm 모델을 사용해서 제출하는 것이 더 나을까요? 또한, df.iloc를 쓰지 않고, 위 그림처럼 바로 df[:len(train)]을 써도 동일한 결과가 나오는 것 같은데 맞나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
  • 데이터인코딩
  • 모델학습
벤프 댓글 2 좋아요 0 조회수 36

dags_email_on_failure

미해결

Airflow 마스터 클래스

강사님, 안녕하세요! 우선 이번에 실무에서 Airflow 기술스택을 다루게 되었는데, 상세한 강의를 준비해주셔서 덕분에 많은 도움을 받았습니다. 다만 섹션 19 " 107.Email 전송 변경사항" 실습 중 다음과 같은 에러가 발생하여 질문드립니다. docker-compose.yaml의 "AIRFLOW__EMAIL__EMAIL_CONN_ID" 파라미터에 Connection에 등록한 연결 객체의 id를 정상적으로 입력했음에도 불구하고 위와 같은 에러가 발생했습니다. smtp_default라는 이름의 Connection을 별도로 등록하고 "AIRFLOW__EMAIL__EMAIL_CONN_ID" 파라미터에 smtp_default 값을 입력했더니 메일이 정상적으로 전송되었는데요. 혹시 제가 실습 중에 잘못한 것이 있어서 안된건지, 아니면 강의 찍으신 시점이후로 동작에 변경사항이 생긴건지 궁금하여 질문드립니다. 감사합니다.

  • python
  • 데이터-엔지니어링
  • airflow
yahohoho 댓글 3 좋아요 0 조회수 49

11 기출문제 ipynb파일

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

제가 잘 못찾는건진 모르겠는데 10회 11회 기출문제는 파일이 업로드가 안되어있어서요,, 어디들어가서 받아 볼 수 있을까요??

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김주현 댓글 2 좋아요 0 조회수 53

작업형 3 유형

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 작업형 3에 되게 많은 분석과 검정이 있는데 많이 나오는 기출이나 특정 유형이 있을까요? 3유형 함수나 그런것들이 너무 많아서 어떤 것이 핵심이고 자주 기출에 나오며 뭐가 출제 예상이신지 궁금합니다

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
aicoss2002 댓글 2 좋아요 0 조회수 46

session이 점점 길어지면 어떻게 대처하나요?

해결됨

실리콘밸리 엔지니어와 함께하는 Codex

안녕하세요 codex app이나 codex cli로 계속 개발을 하다가면 세션이 usage가 다 차셔 계속 사용하면 자동으로 context 압축을 하면서 동작하는 것이 보이는데요 이경우 이런식으로 계속 개발해도 문제가 없을까요? 세션의 남은 context가 100%가 다되어가면 새세션을 생성하고 다시 작업을 시작하게 되면 이전에 사용하던 세션의 내용을 codex가 모두 기억하고 있을까요? 그대로 이어서 한다고 생각하고 개발하면 되는 것일까요? 2번 질문과 관련해서 새 세션이 이전 세션의 내용을 모두 기억하고 있지 않다면 이전 세션의 중요한 정보를 저장하였다가 새로운 세션에서 불러와서 개발을 계속 이어가는 방법이 있을까요? 감사합니다.

  • python
  • openai
  • codex
  • 인공지능(ai)
  • ai-agent
  • claude
채화영 Robby 댓글 1 좋아요 1 조회수 97

인기 태그

인프런 TOP Writers

주간 인기글