안녕하세요. 좋은 강의 감사드립니다. 덕분에 잘 배우고 있습니다. 문제 2. 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 그리고 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요! 문제2를 대하고 순간 다음과 같은 고민을 했었습니다. 1번을 수행하여 'f1'컬럼의 결측치 행을 삭제한 후 2번을 하려니 'f3'컬럼의 결측치 갯수가 18개만 남더군요. 그럼 18개는 최초 데이터 100개의 20% 미만일까? 그렇지 않다. 'f1'컬럼 결측치를 제거한 후 데이터 갯수 69개의 20%~30%(14~20)에 해당한다. 그렇다면 'f3'컬럼의 최빈 값은 'f1'컬럼의 결측치를 제거하기 전의 값을 사용해야할까 아니면 결측치 제거 후의 값을 사용해야 할까? 결과적으로는 어떤 방식으로 하던 답은 56으로 일치했지만 주어진 데이터에 따라 다른 값이 나올 수도 있을 것 같습니다. 혼돈을 없애기 위해 문제 2의 문항 순서를 바꾸면 어떨까요? 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요!
안녕하세요 디버깅 실습중에 2~3번은 utf-8 인코딩에러 뜨고 한번은 정상적으로 디버깅이 되서(디버깅 아닌 실행시에는 문제없음, 아직은 한글데이터 사용도 안하는데 TT 계속 쉬프트+F9 계속 치면 한번씩 정상적으로 진행됨 TT) 인코딩 세팅도 바꿔보고( utf-16 등 다른 인코딩도 설정 해봤음) 해도 안되다가 경로(폴더명 )에 한글을 영어로 바꾸니깐 이상이 없네요(이게 원인인지는 정확하게 모르겠습니다) 참조하세요 ~~
안녕하세요 고민글은 아니고 혹시나 해서 같이 강의 들으시는 분들하고 공유하고 싶어서 글 올립니다.(아마 많이 알고 있으시겠지만 혹시나 싶어서 공유합니다. 혹시 정보공유 게시판이 있으면 알려주세요, 혹시 강사님 이글이 부적정 하다고 생각하시면 통보없이 지우셔도 무방합니다. 옮기시는 것도 자유입니다. ^^) 파이참 쓰다 보면 한 줄 자동 완성 기능 때문에 많이 당황하셨을 껍니다. (편하긴 편한데 실력 완성에 도움이 전혀 안되는 .... ) 해제하고 싶어도 보통 인터넷에 올려진 방법은 File -> Settings -> Editor -> General -> Code Completion 체크 해제인데 안되더라고요 File -> Settings -> Editor -> Inline Completion -> Enable local Full Line Completion suggestions 체크 해제 해보세요 혹시나 같이 공부하시는 분들 도움이 되셨으면 합니다. ^^
안녕하세요 강사님 올해 말 실기 시험 목표로 강의를 수강 중인 학생입니다. 강의 수강 중 문득 걱정이 되는게 있어서 문의 드립니다. 맥북 단축키 같은것도 알려주시고 당장 수강하는데는 별 문제없다고 생각하는데, 시험장에 맥북을 들고 갈 순 없는 노릇이니.. 혹시 맥북으로 공부해 갔을때 발생할 수 있는 문제와 그에 대처방법이 혹시 있을까요?
안녕하세요 비전공자 직장인입니다. 퇴근후 딴짓 님 강의를 열심히 듣고 있습니다. 현재 작업형2 모의문제 2를 혼자서 풀고 있는데, 단순한 결측치 찾고, 샘플 찾고, 그런 것들은 하겠는데 이거를 모델링 하는 거에서부터 사실 멘붕입니다. 작업형1 모의문제를 풀 때도 똑같이 강의를 듣던것보다 더 어려워서 멘붕이 왔었습니다. 일단은 모르겠는 부분은 인지한 상태로 다시 반복하겠다는 의지로 계속 강의를 듣는 게 맞겠죠? 반복이 답이겠죠??
선생님, 강의 열심히 보고 있는데 제가 5월 중순부터 시작하면서 조금 일찍 시작했는데도 불구하고 암기 할 게 너~~~~~~무 많아서 큰일입니다 ㅠㅠ 단권화 시키려고 실기용 교재를 샀는데 정말 정말 이것만큼은 꼭! 외우고 가야하는 코드나 문법같은거를 정리해주실 수 있나요? (강의나...파일로) 사실 고득점 합격은 바라지도 않고 60점 턱걸이로라도 너무 붙고싶습니다!
안녕하세요 선생님 빅데이터 분석에 관심이 있어 파이썬을 1도 모르는 상태에서 시작해 현재 선생님의 강의를 통해 많은 도움을 받고 있습니다. 현재 텍스트 마이닝 분석 방법으로 쓴 논문들을 보면 쇼핑몰 댓글 부터 해서 각종 SNS(페이스북, 인스타그램 등)의 댓글을 분석한 논문들을 많이 살펴볼 수 있는데 현재 파이썬 초보로서 데이터를 수집하는 과정(웹크롤링)이 제일 중요하고도 어려운 것 같습니다. 현재 텍스톰이나 빅카인즈 같은 웹사이트를 이용하는 것 말고 파이썬 으로 다양한 데이터를 직접 웹크롤링 해서 데이터를 수집하는 방법을 집중적으로 다룬 강의는 거의 찾아보기 어렵더라구요..ㅠㅠ 블로그 등에 검색해보면 코드가 공개된 것도 있지만 여기저기 코드 방식이 다 다양하고 막상 적용해서 실행해보면 또 에러 생기고 이유는 모르겠고 답답하더라구요. SNS 채널 및 쇼핑몰 댓글 등을 웹크롤링 하는 과정을 하나하나 다 보여주는 강의가 있으면 좋겠다고 생각하고 있는데 혹시 이렇게 여러 채널의 웹크롤링 과정만 다룬 강의를 올려주실 계획은 없으신지요?
예제로 배우는 딥러닝 자연어 처리 입문 NLP with TensorFlow - RNN부터 BERT까지
강의를 들으면 가물가물해져 가는 NLP와 BERT기본을 제대로 다지기에 참 좋은 강의 감사합니다. 좀 다른 질문 드려서 죄송합니다만 ㅠㅠ BERT는 모델을 download해서 fine tuning으로 우리가 원하는 모델을 학습시킬수 있죠. 근데 요즘 hot한 chatGPT는 아직까진 온라인 버전입니다. (제가 아직 잘 모르기도 하고..) 반응이 워낙 뜨겁다보니(?) 이걸 활용한 뭔가를 만드는 것도 각 기업에서 고민을 하는거 같은데요... 현재처럼 key를 발급받아 online에 쿼리를 날려서 response를 받아오는 형태는 끊길수도 있고 언제든 변경의 여지가 있어 제품화에 쓰기 어렵습니다. 혹시 chatGPT를 대체할만한 download가능한 딥러닝 모델을 알고 계신게 있나요? bert처럼 무료면 좋겠지만, 타협가능한 수준의 유료모델도 좀 알아놔야 할 것 같습니다. 저도 좀 찾아봤습니다만 현업에 더 가까이 계신분께 insight를 좀 얻고자 문의드립니다 ㅠㅠ 감사합니다
본 강의에서 알려주신 판다스 및 이미지 활용 예제를 알려주셔서 감사합니다. 강의 후반에 알려주신 것 처럼 활용 할 수 있는 부분이 굉장히 많아 보입니다. 판다스 예제를 views.py에 녹여 봤는데, 잘 출력됩니다 ㅎㅎ 이후 템플릿 폴더 내부 html 파일을 생성해서 디자인 좀 추가해 출력하면 분석 툴 제작도 충분히 가능할 듯 싶네요. 강의 중반까지 듣고 시도해 보겠습니다 :)