inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

실전 데이터 사이언스 Part2. 데이터 전처리

시계열 선형 예측

n_step 값에 대하여

480

피카라이언

작성한 질문수 7

0

안녕하세요.

 n_step값에 대해 설명해 주 셨을때 과거 n일치 기온 데이터를 사용하여 내일 기온을 예측한다고 하셨습니다. 강의에서 본거처럼 n_step을 줄이면 큰 차이는 없지만 n_step을 계속올리고 300, 500, 700하면 R^2 값이 0.90 쯤까지 떨어지더군요. 

그러면 predicted값하고 real값하고 더 차이가 많이 납니다. 왜 그런지 알 수있을까요?? 과거 데이터가 더 많을수록 score값은 떨어질수밖에없나요? 

python

답변 1

0

김화종

좋은 질문입니다.

n_steps를 불필요하게 크게 키우면 오래전의 과거 데이터가 예측에 도움이 안되고 잡음으로 동작하기 때문입니다. 선형모델에서는 모든 입력 값들의 가중합을 사용하는데 불필요한 신호에 곱해지는 계수가 모두 0이 되지 않는 한 어떤 형태로든 (0이 아닌) 가중치가 존재하게 됩니다. 이와 같이 불필요한 신호들이 랜덤하게 (예측에 도움이 되지 않게) 더해지면 이것이 잡음으로 동작하게 되고 따라서 성능이 떨어지는 것입니다.

[클라우드 설정 중 앞 내용 문의 사항]

0

11

0

nvm버전이 변경되었습니다.

0

15

0

선생님 강의자료를 받을수 없어요! 메일보냈어요.

0

19

2

response api를 사용하는것과 codex, cluade code 에이전트를 사용하는것과의 차이

0

16

1

16강 구글 colab 에서 코드 실행이 안돼요.

0

31

1

object 컬럼이 여러 개인 경우 인코딩 전처리 방법

0

17

2

데이터 전처리 순서 관련

0

16

2

작업형2 모의문제 데이터 불러오기

0

23

2

강의 연장 부탁드립니다!

0

19

1

베개머리투자법 섹션 5를 듣고 질문드립니다.

0

22

2

[질문] 파이썬 버전 질문

0

23

1

강의자료, 코드 요청드립니다

0

36

1

모의고사 파일오류

0

60

3

미국 써머 타임 적용에 대해서 질문입니다.

0

28

1

테마분류 세부화 관련 질의

0

35

2

비만도까지 구하는 프로그램을 만들었습디나

0

38

1

결측값 처리

0

603

1

dir*.csv가 안됩니다.

0

367

1

6 시그마 이상 outlier

0

589

1

로그변환에 대하여

0

674

1

In[42] 14:50 코드 질문

0

279

1

Titanic 데이터셋 PClass cateogrical -> one hot encoding

0

423

1

표준 스케일링관련 문의

0

349

1

6:14초 dataframe 스케일링한 후 컬럼 추가에 대한 질문

0

771

1