inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

파이썬 무료 강의 (활용편7) - 머신러닝

K-평균 (실습 #2)

K-평균(실습#2) 의 fit, fit_transform 질문입니다.

452

따숩게

작성한 질문수 5

0

StandardScaler()

KMeans()

객체 생성 후 fit_transform(), fit() 으로 학습데이터 만들기 하는데, 모두 훈련데이터니까...

둘다 fit(), 또는 fit_transform()으로 구분없이 사용해도 되는건가요?

아니면... 구분지어야 하는 이유가 있는건지 궁금합니다.

 

python 머신러닝 anaconda scikit-learn

답변 1

0

인프런 AI 인턴

안녕하세요, 인프런 AI 인턴입니다.
따숩게님, 질문 주셔서 감사합니다.

StandardScaler()KMeans()와 같은 사이킷런 라이브러리에서 제공하는 메서드를 사용할 때 fitfit_transform의 차이를 이해하는 것이 중요합니다.

fit 메서드는 데이터에 대한 학습만을 수행합니다. 즉, 데이터를 바탕으로 필요한 통계치(예를 들어, 평균과 표준편차 등)를 계산하고 모델을 학습시키는데 사용됩니다.
fit_transform 메서드는 학습을 수행하는 동시에, 학습된 파라미터로 데이터를 변환하는 작업도 거칩니다. 예를 들어, StandardScaler의 경우 학습 데이터를 표준화하는 과정으로, 각 특성의 평균을 0, 표준편차를 1로 만드는 변환을 수행합니다.

KMeans 알고리즘의 경우,
- fit은 클러스터 중심을 계산하고 데이터를 클러스터에 할당하는 과정을 거칩니다.
- fit_transformfit을 수행하고, 추가로 각 데이터 포인트를 클러스터 중심으로부터의 거리로 변환하는 과정을 포함합니다.

따라서 fitfit_transform을 사용할 때에는, 만약 변환된 데이터를 바로 사용하고 싶다면 fit_transform을, 단순히 모델을 학습시키기만 하고 싶다면 fit을 사용하면 됩니다. 다만, fit_transform은 일반적으로 학습 데이터에만 적용하고, 테스트 데이터는 따로 transform 메서드를 통해 변환하는 것이 일반적입니다. 이는 데이터의 정보 누설을 막고 모델의 일반화 능력을 평가하는 데 도움이 되기 때문입니다.

질문에 대한 답이 되었길 바라며, 더 궁금한 점이 있으시면 언제든지 문의해주시기 바랍니다.

13. (App 2) 기본기 훈련 에서

0

7

1

채점 프로그램 미작동

0

8

2

챌린지 시작일 문의

0

9

0

2. 어떤 도구를 사용하는 것이 가장 유리할까? 강의 중

0

15

1

안녕하세요 ppt 자료 메일로 부탁드립니다

0

7

0

11차시 Antigravity IDE 설치 후

0

17

1

링크드 리스트 중간 삽입삭제 시간복잡도 질문

0

11

1

Kaggle 노트북(predict.ipynb) 관련

0

12

0

처음 에이전트 설정을 잘못 했을 경우 수정 하는 방법

0

13

1

강의 연장 문의

0

13

1

수강 신청 연장 문의드립니다.

0

26

1

26년2회 실기기출은 언제쯤...

0

28

2

재귀함수 종료조건

0

12

1

git bash .env

1

14

1

예제 001 실행 안됩니다.

0

18

3

ipython 설치가 안되는거 같습니다.

0

13

1

이론 공부법 요약본 버전 업데이트 문의

0

26

2

피드백 내용 문의드립니다.

0

34

1

백준 서비스 종료로 인한 강의 자료 업데이트 요청드립니다.

0

28

1

머신러닝 - surprise 모듈 설치 오류

0

389

1

K-평균(실습#3) 결과 값이 왜 다르게 나올까요?

0

259

1

다항회귀(실습#2)

0

287

1

선형 회귀

0

426

0

협업(리뷰 기반)필터링#1 질문

0

925

1