inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

실전 데이터 사이언스 Part2. 데이터 전처리

시계열 선형 예측

n_step 값에 대하여

465

피카라이언

작성한 질문수 7

0

안녕하세요.

 n_step값에 대해 설명해 주 셨을때 과거 n일치 기온 데이터를 사용하여 내일 기온을 예측한다고 하셨습니다. 강의에서 본거처럼 n_step을 줄이면 큰 차이는 없지만 n_step을 계속올리고 300, 500, 700하면 R^2 값이 0.90 쯤까지 떨어지더군요. 

그러면 predicted값하고 real값하고 더 차이가 많이 납니다. 왜 그런지 알 수있을까요?? 과거 데이터가 더 많을수록 score값은 떨어질수밖에없나요? 

python

답변 1

0

김화종

좋은 질문입니다.

n_steps를 불필요하게 크게 키우면 오래전의 과거 데이터가 예측에 도움이 안되고 잡음으로 동작하기 때문입니다. 선형모델에서는 모든 입력 값들의 가중합을 사용하는데 불필요한 신호에 곱해지는 계수가 모두 0이 되지 않는 한 어떤 형태로든 (0이 아닌) 가중치가 존재하게 됩니다. 이와 같이 불필요한 신호들이 랜덤하게 (예측에 도움이 되지 않게) 더해지면 이것이 잡음으로 동작하게 되고 따라서 성능이 떨어지는 것입니다.

09차 네이버 영화 리뷰 수집 실습 관련 질문

0

2

0

12회 기출은 언제 업데이트 될까요??

0

3

1

알파벤티지 sleep(5) 관련 문의

0

7

0

강의 자료 및 코드 수령

0

15

2

8/6 작성한 연장문의 질문글에 대한 재요청

0

14

1

실전 계좌에서 운영하고 계신 분 계신가요?

1

21

2

수강기간 연장 문의

0

15

1

수강기간 연장문의

0

10

1

수강기간 연장 요청 문의드립니다

0

17

1

Fal.ai에 기존 AI를 끌어오는것은 안되는건가요?

0

22

1

잘못된 파일 다운로드

0

30

1

DataSet 다운 받는 방법

0

26

1

어디다가 환불요청해야돼요

0

35

1

해당 차수 영상이 짤려 나갑니다

0

35

1

수업자료는 어디서 받나요

0

31

2

Lecture19 강좌pdf파일이 없네요..

0

27

1

결측값 처리

0

589

1

dir*.csv가 안됩니다.

0

341

1

6 시그마 이상 outlier

0

575

1

로그변환에 대하여

0

658

1

In[42] 14:50 코드 질문

0

268

1

Titanic 데이터셋 PClass cateogrical -> one hot encoding

0

410

1

표준 스케일링관련 문의

0

332

1

6:14초 dataframe 스케일링한 후 컬럼 추가에 대한 질문

0

757

1