분류(Classification) 성능 평가지표 개요와 정확도(Accuracy) 소개 에서 MNIST를 모두 0으로 예측하는 코드에서 fakepred와 y_test를 비교하는데요 이때 type은 같은데 하나는 1차원 배열이고 또 다른 하나는 column을 1로 가진 2차원 배열인데 이렇게 shape이 달라도 accuracy_score를 통해 비교할 수 있나요?
코로나가 9월부터 2급 감염병에서 4급 감염병으로 전환됨(일일 확진자수를 집계하지 않음)에 따라 9월부터는 공공데이터 OpenAPI를 활용할 수 없게 됩니다. 다만, 다행(?)이도 아직까지 8월까지의 데이터를 확인할 수 있으니 강사님이 설명하시는 그대로 구현할 순 없지만 각자 커스터마이징 하여 구현하는 데엔 큰 지장은 없어 보입니다. 제가 사용하는 공공데이터포탈 OpenAPI는 다음과 같습니다.
함수에 대해 정의내릴 때 예를 들어 코랩 에서는 scaler = minmax_scale() 이렇게 정의를 내리고 scaler(data) 하는데 #코랩은 정의내릴 때 괄호를 빼면 동작안함 구름에서 테스트해보니까 scaler = minmax_scale()하고 scaler(data)하면 에러가 발생하고 괄호없이 scaler = minmax_scale 만해야 에러가 발생하지 않더라구요. 이게 구름 환경만의 특성이라서 그렇다고 보면 될까요?
안녕하세요 선생님. 우선 좋은 강의를 해주셔서 감사드립니다. 다름이 아니라 현재 섹션1,2 를 수강한 상태입니다. 섹션 1, 2를 수강하는데 수식이 굉장히 많이 등장하더라구요. 제가 수포자였어서 현재로썬 이해하는데 있어서 어려움이 많은 상태입니다.(지금은 열심히 공부하고 있습니다! 아무래도 딥러닝을 공부하는데 수학이 필수인거같아서) 그래서 작동 원리만 이해하고 우선은 넘어가는 방식으로 공부하려고 하는데 이렇게 해도 괜찮을까요?? 예를들면 경사하강법은 손실함수의 기울기가 적어지는 방향으로 학습하는 것이구나, 오차역전파는 미분을 거꾸로 하면서 가중치를 업데이트하는 것이구나, 손실함수는 이런게 있구나, 옵티마이저는 이런게 있구나 이렇게 작동하는구나 이런식으로요. 물론 언젠가는 반드시 다 이해해야겠지만 딥러닝입문자로써는 이렇게 이해만 하고 넘어가도 될까요??
[리뉴얼] 처음하는 파이썬 머신러닝 부트캠프 (쉽게! 실제 캐글 문제 풀며 정리하기) [데이터분석/과학 Part2]
train.corr().iplot(kind='heatmap', colorscale='Blues') 현재 위의 코드 수행시 에러가 발생하는데요. ValueError: could not convert string to float: 'Braund, Mr. Owen Harris' train 데이터프레임에서 문자열 데이터가 포함되어 있기 때문에 해당 에러가 발생할 수 있습니다. 이 경우, 상관 관계 행렬을 계산하기 전에 문자열 열을 제거해야합니다. 저의 경우 다음처럼 새로운 객체를 만들어 진행하였습니다. object_cols = train.select_dtypes(include=['object']).columns #열의 데이터 타입이 문자인녀석 추출 new_train = train.drop(columns=object_cols) # 열의 데이터가 문자열인 것들 제거 후 새로운 객체에 생성 new_train.corr().iplot(kind='heatmap', colorscale='Blues') 이러면 잘 나옵니다.
[리뉴얼] 처음하는 파이썬 머신러닝 부트캠프 (쉽게! 실제 캐글 문제 풀며 정리하기) [데이터분석/과학 Part2]
import plotly.io as pio pio.renderers.default='iframe' 다음 코드를 추가해주시면, iframe 을 통해 렌더링 됩니다. 저의 경우 다음 에러로 렌더링이 안됐습니다. ( F12 / Option+Command + i -> console 에서 확인 가능 .)
<강의 코드> transforms_for_train = transforms.Compose( [ transforms.Resize(feature_extractor.size), transforms.RandomHorizontalFlip(), transforms.ToTensor(), normalize, ] ) 강의 코드를 변경하지 않고 그대로 실행하면 아래와 같은 오류가 발생합니다 <오류 메시지> TypeError: Size should be int or sequence. Got <해결 방법> feature_extractor.size를 tuple(feature_extractor.size.values()) 로 변경한 뒤 실행합니다. transforms.Resize 내의 인자 뿐만 아니라 Crop 안의 인자도 함께 변경해주어야 합니다 transforms_for_train, transforms_for_val 모두 동일하게 변경한 뒤 실행하면 에러 없이 실행되는 것을 보실 수 있습니다.
쉽게 처음하는 파이썬 고급 크롤링 [Scrapy, Selenium, Headless Chrome]
안녕하세요 저는 비전공자이고 풀스택 전과정 + 고급 크롤링 강의를 듣고있는 수강생입니다. 우선 너무 좋은 강의 정말 잘 듣고 있습니다. 저는 코딩을 아예처음 접하고있어서 어느쪽으로 가고싶은지 전혀 갈피가 없었는데요. 하다보니 데이터과학이 제가 하고싶었던 분야라는것을 알게되었습니다. 항상 외주로 개발자를 구해서 돈을 주고 프로그램을 제작하는것을 자주해왔는데요. 개발비로도 2000만원이상을 쓴것 같습니다. 그런데 제가직접 해보고자 이곳을 찾아왔고, 데이터 과학이 제가 생각한 분야라는것을 고급크롤링 강의들으면서 알게되었습니다. 그런데 궁금한점은 개발자에게 외주를 맡기면서 항상 GUI 방식의 프로그램을 받아서 그것으로 크롤링 및 자동화 프로그램들을 주로 외주를 맡겨왔었는데요. 강의 내용을 계속보고있는데 GUI 에 관한건 없더라구요. 제가 못찾는건지 별도 다른강의가 있는건지 알고싶습니다. 저는 GUI에 자동화 소스를 버튼처럼만드는 그런 프로그램을 만들고 싶거든요 ! 강의내용의 질문은 아니지만, 그 강의가있다면 추가로 구매해서 수강하고싶습니다. 답변 부탁드립니다
figure, ax_list = plt.subplots(nrows=3, ncols=5) figure.set_size_inches(20,20) for i in range(len(full_column_list)): sns.regplot(data=boston_house_df, x=full_column_list[i], y='PRICE', ax=ax_list[int(i/5)][int(i%5)]) ax_list[int(i/5)][int(i%5)].set_title("regplot " + full_column_list[i]) 안녕하세요 수업 즐겁게 듣고 있습니다 : ) 여기서 ax = ax_list 부분 설명 좀 부탁 드리겠습니다. 만약 i를 안쓰고 개별 1개 칼럼에 대해 그래프를 그린다면 ax = 뒤가 뭔지 궁금합니다. 이것만 알아도 위 코드가 이해될 것 같습니다. 감사합니다.
그랩님 새해 복 많이 받으세요. 마케팅 6년차 일반직무에서 근무하고 있는데, 프론트엔드 개발자로 커리어 전환을 꿈꾸고 있는데요. 나이는 33살입니다. 퇴사를 하고 온전히 부트캠프를 통해서 프론트엔드 개발자로 커리어 전환을 시도해보고자 하는데요. 혹시 인프런 강의를 통해서 혼자 진행해보는게 나을지, 부트캠프를 통해 짜여진 커리큘럼을 통해서 진행하는게 나을지 문의 드립니다. 온전히 9-6를 개발 공부에 할애 할 수 있는 상황인데요. 기간은 6개월 정도로 생각하고 있습니다. 혹시 짧은 조언이나 얻어볼 수 있을까요..!
안녕하세요! 벌써 무더운 날씨가 지나고 쌀쌀한 날씨가 찾아오고 있는 요즘입니다. 면역력이 떨어지는 환절기 조심하시고 건강한 연말을 준비하셨으면 좋겠다는 말씀 드리면서 해당 글을 쓰게 된 계기와 함께 궁금증에 대한 내용을 조심스레 작성해보겠습니다. 현재 대략 3명 정도의 인력(백엔드+기획 / 프론트 / 기획+디자인)으로 토이 프로젝트를 진행하고 있습니다. 서비스의 개요는 특정 카테고리&내가 원하는 기준에 해당하는 "내주변"식당의 위치를 조회하는 서비스 + 여러 조건에 대해 실시간으로 선택하며 달라지는 결과들을 확인 하는 서비스를 기획하고 있습니다. 향후 예약 기능도 추가할 계획도 하고 있구요, 서비스의 전체적 느낌은 네이버 지도 + 망고플레이트 + 테이블링 정도 입니다. 조회가 많고 다양한 쿼리문이 나올 것 같고 지역/지리 정보를 빈번하게 사용할 것 같아 MySQL이 아닌 PostgreSQL에 관심이 생기기 시작했고 자연스레 많은 고민과 궁금증이 생기게 되어 이렇게 찾아와 질문드리게 되었습니다. 이에 대한 주요 질문의 내용은 아래와 같습니다. [PostgreSQL을 고려하는 이유] 참고 : https://techblog.woowahan.com/6550/ 많은 양의 지역정보 (행정동 경계 및 구역)를 빈번하게 사용할 예정 -> 데이터 타입(geometry) 이 적절하고 조회 작업이 많은 면에서 효율적일 것이라고 생각 PostGIS 를 사용해보고 싶습니다. (현재 erd 작성에 사용하고 있는 예시 : https://www.erdcloud.com/d/2mDmcrHWY3CqW4Rrp ) PostgreREST 라이브러리로 REST 방식 사용 가능 -> 오픈 API 다양한 객체 타입으로 데이터 조회하는 기능 이 많은 서비스 여러가지 조건(복잡한 쿼리 예상)을 적용 할 검색 조회 서비스 [고민하는 이유] 오픈 API를 많이 사용할 예정 ( 소셜로그인 , 행정동 경계, 소셜 공유, 지도 등) 인데 공식 문서에서는 보통 REST API 방식 의 사용법만 찾을 수 있음. 부족한 개인 역량 ..(MySQL만 사용한 적이 있습니다..) -> 충분한 학습없이 시간낭비 할 가능성이 높은데 혼자만 진행하는 프로젝트가 아닌 팀원들이 함께 진행하는 프로젝트여서 더욱 고민이 됩니다. [찾아본 결과 (확실하진.. 않습니다ㅠ)] MyBatis & Master-Slave 형식으로 각각의 Configuration 및 properties 관리 를 통해 다중 db 사용 DB Link 를 활용하여 원격으로 서로 다른 table의 정보를 받아와서 사용하는 방법 하지만 보통 MySQL과 Maria를 연결(DB 특성이 유사)의 예시만 찾아볼 수 있었고 대부분 PostSQL로 이관하는 내용이 가장 많았습니다. 생각했던 것 처럼 보안이나 운용 측면에서 관리하기 어려움이 있는 요소이다 보니 레퍼런스도 많지 않아 위와 같이 확실하지 않은 방법으로 유추하고 있습니다. 사실 프로젝트 규모나 서비스 기능 복잡도 측면에서는 이렇게까지 번거롭게 하지 않고 하나의 DB(MySQL)로도 충분히 작동하는데 문제 없겠지만 서비스에 조금 더 최적화된 DB라고 생각되기도 하고 경험해보고 싶은 마음에 이런 고민을 하고 있습니다. 혹시나 현업에서도 여러 DB를 한 서비스에서 사용하는 경우가 많은지 많다면 효율성 증진이나 개선된 사항으로 어떤 점 들이 있는지, 어떤 방식으로 연결하는지 궁금합니다 ㅠㅜㅜ 너무나도 부족한 역량과 지식을 기반으로 허술한 질문을 드려 죄송합니다..!! 직접적인 해결방법이 아니더라도 선생님께서 생각하시는 어떤 것이든 전달해주시면 적극적으로 습득하고 활용해보겠습니다..!! 감사합니다.