안녕하세요 작업형2에서 EDA하고 바로 target = train.pop('TravelInsurance') train = pd.get_dummies(train) test = pd.get_dummies(test) 이렇게 작업하면 안되는건가요? 실행하면 target줄에 오류가 떠서요,, 데이터분리하고 합치고 스케일링 하는 부분은 아무리 봐도 이해가 안 가서 필수로 해야되는 것만 하고싶어서요ㅜㅜ 책에서도 거의 target에 넣고 바로 인코딩 하더라구요,,
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 문제번 컬럼삭제 시 df=df.drop(cols, axis=1) 을 사용한다고 하였는데, df=df.dropna(cols, axis=1)를 사용하면 에러가 나네요. drop과 dropna는 어떤 경우 사용하는 건지 궁금해요. 파이썬 완전 초보라... 너무 기초적인 부분을 질문하는 것 같아 죄송스럽네요.. 열심히 따라하고 있는 중입니다ㅠ
안녕하세요 ~코딩박사 잇잇쌤입니다! 강의문의는 sap.con.jen@gmail.com 14년차 개발 프리랜서 강사 이고, IT 용어부터 간단명료하게 쉽게 진입 장벽을 낮춰드리는 매직을 부리겠습니다! ( 아 잇잇쌤은 IT를 Eat 냠냠 하는 과정을 표현했습니다!! ) 블로그(파이썬 기초 강의가 있긴 하지만..)랑 youtube(파이썬 AI 강의가 있긴 하지만..)도 있는데 제발 들어오지 마세요! 너무 구독자 수가 적어요 😂 😂 제가 IT업계에 들어온 계기는... 19살때, 해커학원? (그때는 코딩강의가 없고 오프라인 학원이 다 해커학원이었다는.. 당시... C언어가 재밌었던 이유가 포인터때문에 ..나홀로 여자혼자 배운다..라는 자부심도 있었던 것 같음 ) C언어를 배운 것을 시작으로, 대학교때 안드로이드 1 개발 을 시작으로, 외국계 테스팅 을 위해서 인턴쉽도 경험도 쌓고, 그 이후, 2012년도에 중견 IT업계 System Integration 회사에 입사해서 밤샘도 많이 했으며, System Management 를 다년간 경험하면서 느낀 험난했던 과정 속 나도 모르게 노하우를 쌓아왔습니다. ( 좋코딩에서, 웹드라마 주인공이 과거의 딱 저라는... ) 이후 대기업에서 IT관련 강의, 지식을 공유 흥미를 느껴, 프리랜서로 나와, IT 관련 수업도 진행하면서 내가 그동안 배웠던 언어들 JAVA, Javascript, ABAP,C, Database 등을 정리하면서 코로나의 블루를 타파하고자 미니 프로젝트등을 진행 했었고, 파이썬 등, 알고리즘, AI 머신러닝 , 딥러닝 기술 등을 숨고를 통해 나눈 경험이 있습니다. 안티에이징을 위해서 마치 백신 주입하듯이 , 신기술을 배워야 살아 남는게 이 업계의 특성인데, 가장 쉽게 배우는 방법을 터득하면서 여러분들과 소통하고 싶어 졌습니다 !~!! 이후, 코로나가 끝나고 운 좋게, 강의를 촬영 해커스 HRD 에서 " Rust 기초부터 실무까지 과정" https://www.hackershrd.com/lecture_240216.php?mode=lecView_240216&pcate=cate&scate=002&product_key=01::nref%3E0%3EB007%3EM056&p_id=0000000000&s_id=Y24M062602 메가스터디아카데미 "인공지능 기초" 과정 https://megastudyacademy.co.kr/camp/lecture/801 멋사넥스트 (멋쟁이사자처럼) "AI를 활용한 파이낸셜 모델링(PF) 과정" https://www.likelion-next.com/classes/215041 한빛앤 과 다수 협업하면서 VOD강의를 출시하기도 하였습니다!! 이제는 인프런에서 여러분들과 만날 수 있게 되어 영광입니다. 저는 5시간 동안 카메라 앞에 서서 여러분들께 설명하는데 너무 즐거워서 지치지 않습니다. 저의 강의에 대한 지치지 않고 포기하지 않는 열정!열정!열정! 으로 당신이 허락한 시간 안에 모든걸 쏟아 붇겠다 라는 마음 가짐으로 항상 임해오고 있습니다. 나중에 기회되면 라이브 강의 에서 만나면! 반갑게 알아봐 주시면 너무!너무!너무! 반가울 것 같습니다 ! 인공지능이 도대체 뭐길래 배우는 거지? 🔎 비전공자 분들, 향후에 미래에 어떤 언어들이 유망한지, 현업이신데 엑셀 로만 데이터를 분석하고 계신 분들, 개발자 10년이상되셔서 좀 변화가 필요하신 분들은 PM님 C레벨 이사님들! 모두 모두 이 강의를 주목해주세요. 저도 14년차 개발자로, 일해오면서 안티에이징 (똑같은 업무에 질려 노화되는 현상) 을 위해서 많은 노력을 해왔어요. 그중에 가장 특효약이 바로 인공지능 기초과정 (머신러닝,딥러닝,신언어1개 배우기) 였어요! 제가 그동안 Java나 C++,자료구조 많이 가르쳐봤는데! Rust나 AI 과정을 준비하면서 너무 신세계인거에요! 이렇게 운영체제 모르고 코딩했구나... 이렇게 효율적인 메모리 언어를 그동안 몰랐구나, CTO가 결정한 솔루션이 사용하라는 대로 그 언어만 계속 사용해 왔구나! 밤샘으로 후회스럽더라구요! 하면서, 앞으로는 다양한 좋은 언어들 배워 봐야 겠다 라는 욕심이 생겼어요! 그래서 다양한 강의를 만들면서 가르치고 알려주고 상대방과 소통하면서 이해가 된다고 개발 커리어를 위해서 다양한 과정들을 도움이 되었다고 할 때, 너무 행복함을 느꼈답니다! 여러분들의 로드맵 참여는 저에게 큰 힘이 됩니다!!! 많은 관심 주시면 저도 다양한 강의가 준비되어있으니까 앞으로 인프런에 강의도 기회되면 올릴거고 다양하게 만날 수 있게 노력하겠습니다~ 숨고 후기보기 ! : https://soomgo.com/profile/users/1949734?from=portfolio 뭐 어쨌든 결론은 !!! 저의 로드맵에 참여해주세요~ 😍 😍 ▼▼▼▼▼▼▼▼▼ https://inf.run/9Vjfz
강의영상 - 자주 활용되는 판다스 예제 - 내장함수 백분위수, 하위 25%값 test = df['가격'].describe() test test.iloc['25%', '가격'] 한번 해봤는데 에러네요. 아직 series에 대한 이해가 부족해서...ㅠㅠ 강의 감사히 보고 있습니다.^^
선생님 안녕하세요? 좋은 강의 진심으로 감사드립니다. 이전에 질문드렸을때 part2 는 나올 계획이 없다고 답변주셨는데요 혹시 spark를 좀 더 심화해서 공부해보고 싶은데 추천해주실 만한 책이나 자료가 있으실까요? 원서도 상관이 없습니다. 물론 spark best book top 10 이런식으로 구글링하면 추천도서가 나오긴 하지만.. 혹시 선생님께서 개인적으로 좀 좋은 교재라고 생각하셨던 도서나 자료가 있으신지 궁금합니다.
데이터 전처리 강의 14:50 관련하여, X_train['workclass']의 최빈값과 X_test['workclass']의 최빈값이 달라질 수 있는데 train 데이터와 test 데이터를 서로 다른 최빈값으로 결측치를 채워도 되나요? 제 생각에는 train과 test를 합쳐서 최빈값을 찾고, 그값으로 결측치를 채워야 하지 않나 싶습니다.
0204 쇼핑 리뷰 군집화 - KMeans, Elbow, Silhouette 분석 강의 질문있습니다. 강의에서는 Silhouette 이 부분이 1과 가까워지는 부분에서 좋은 n_cluster라고 하셨는데 그러면 Elbow 차트 말고 Silhouette 만 써도 되는건가요? 0204 쇼핑 리뷰 군집화 결과 분석 - 실제 제품과 군집 교차표 분석 4분 16초에 k.meanslabel==pardict를 하는 이유가 뭔가요? 라벨링 개수와 학습한 개수를 같은지 확인하는 이유가 궁금합니다.
안녕하세요, 도움되는 강의 제공해주셔서 진심으로 감사드립니다. Harmonic Oscillator 초기값 관련하여 질문있습니다. 현재 우리는 pinn의 performance를 확인하기 위해 실제해가 알려진 경우와, pinn의 prediction을 비교하고 있는데요. loss function이 residual과 초기값에 대한 mse로 구성되어 있는데, 우리가 실제 해를 모른다고 가정하고 온전히 pinn으로만 학습한다고 가정할 경우, 초기값에 대한 mse는 어떻게 구할 수 있을까요? 제가 미분방정식에 대한 기억이 너무 오래되서 그런데 보통 초기값은 실제해를 몰라도 방정식 별로 알려진 값일까요? 미리 감사드립니다.
from datasets import load_metric ImportError: cannot import name 'load_metric' from 'datasets' (/usr/local/lib/python3.10/dist-packages/datasets/__init__.py) datasets에서 load_metric을 불러오려고 하는데 위와 같은 에러가 발생합니다. 계속 삽질하고 있는데 방법을 찾기가 쉽지가 않네요ㅠ 도움 부탁드립니다.
안녕하세요 강사님. 강사님의 강의를 토대로 kaggle, dacon에서 제공하는 데이터를 가지고 분석을 하면서 궁금한 점이 생겼습니다. 데이터를 예측할 때 가장 좋은 모델을 비교를 하지 않고 선택할 수 있는 방법이 있을까요? 예를 들어 분류에서는 boosting 알고리즘에서도 XGBoost, LightGBM, CatBoost 등 여러 모델이 있는데 이 중에서 가장 좋은 모델 즉, 해당 데이터 셋에서 가장 적절한 모델을 찾을 수 있는 방법이 있을까요?? 데이터의 크기가 현재는 모든 모델을 사용하면서 성능을 비교할 수 있는 크기지만, 나중에는 매우 많은 데이터를 다루게 된다면 비교하기에 어려울 것 같다는 생각이 들어서 이렇게 질문을 남깁니다.
물리 정보 신경망은 결국 미분방정식 해를샘플데이터를 이용해서 빠르게 찾는 것이 핵심인 것 같습니다. 그러나 현실에서는 방정식 자체를 세우기가 힘듭니다. 예를 들어 단순히 개나 고양이 사진을 구분하는 문제만 봐도 식을 세우기 힘들며, 결국 데이터에 의존해야 하는데요. 물론 문제 성격에 따라 알고리듬을 달리 적용하는 것이 맞지만, 현실 문제에 적용이 힘들어 보입니다. 미분방정식이 있는 난제에만 적용이 가능할까요? 수치해석과 비교했을 때 결국 시뮬레이션을 얼마나 빨리하는지의 차이일 뿐, 정확한 해인지는 어떻게 평가할 수 있나요? 더불어서 수치해석은 시뮬레이션 수치를 눈으로 확인할 수 있으니 말 그대로 해석이 가능한데, 인공신경망이 복잡할 경우, 어떻게 해석하나요?