확장자에 따라 다른가요?
미해결
[신규 개정판] 이것이 진짜 크롤링이다 - 실전편 (인공지능 수익화)
혹시 .py & .ipynb 확장자에 따라 코드가 잘 실행되고 안되고 그럴 수 있나요?
- python
- 웹-크롤링
172만명의 커뮤니티!! 함께 토론해봐요.
미해결
[신규 개정판] 이것이 진짜 크롤링이다 - 실전편 (인공지능 수익화)
혹시 .py & .ipynb 확장자에 따라 코드가 잘 실행되고 안되고 그럴 수 있나요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
상위 10번째 값으로 대체하는 부분에서 df.iloc[:10,-1] = min_value 이렇게 하셨는데 df['views'].iloc[:10]= min_value 이렇게 풀어도 상관없을까요? 만약 2번째 풀이도 상관 없다면 첫번째 풀이로 진행하신 이유가 있을까요? 취향차이일까요?
미해결
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 정규성을 만족하지 않을 때 단일 표본과 대응 표본에서 윌콕슨을 사용하려고 합니다. 이때 단일 표본 stats.wilcoxon(df['관측치명']-평균값, alternative=) 라 했을 때 차이로(df['관측치명']-평균값) 계산하였고 대응표본은 차이로 계산이 가능하지만, 더 쉬운 방법인 df['before'], df['after'], alternative= 를 사용하였습니다. 그렇다면 단일표본에서도 df['관측치명'], 평균값으로 계산해서 될까요? 만일 안된다면, 윌콕슨은 차이 값를 기반으로 검정 통계량을 계산하는 것인데 대응표본은 두가지로 가능하면서 단일표본은 무조건 왜 -(차이)를 사용해야 하는지 궁금합니다!
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 이 부분에서 standarlize=False를 하는 이유가 궁금합니다.
해결됨
김영한의 실전 자바 - 중급 1편
[질문 템플릿] 1. 강의 내용과 관련된 질문인가요? (예/아니오) 2. 인프런의 질문 게시판과 자주 하는 질문에 없는 내용인가요? (예/아니오) 3. 질문 잘하기 메뉴얼을 읽어보셨나요? (예/아니오) [질문 내용] NetworkClient 클래스, SendException 클래스, ConnectException 클래스들의 필드를 캡슐화로 외부에서 상태 변경을 막았는데 왜 final로 정의한 이유가 궁금합니다.
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
sum은 false를 0으로 처리해서 연산에 포함시키지 않는데, count의 경우 false도 카운트가 되나요?
해결됨
김영한의 실전 자바 - 중급 2편
강의 내용중 Comparable, Comparator 파트에서 List 데이터를 정렬할 때 Collections.sort() 와 list.sort() 중 list.sort를 권장하는 이유를 조금 더 자세히 알고 싶습니다. 이 부분에서 list.sort()를 사용하는 게 더 객체지향적인 코드 라고 말씀해주셨는데 List 인터페이스에 정의된 sort() 메서드를 사용하는 게 Collections class 에 정의된 static 메서드보다 어떤 측면에서 더 객체지향적인지 느낌은 오는데 이것 때문이다 라고 정리가 잘 안돼서 질문 드립니다. Collections 의 코드를 봤을 때 내부에서 Collections.sort(list, comparator)를 보게되면 list.sort(comparator) 메서드를 사용하고 있는데 그러면 굳이 Collections.sort()를 사용해야 할 케이스가 따로 있어서 정의한 것인지 어떤 경우에 사용하는지 궁금합니다. public static <T> void sort(List<T> list, Comparator<? super T> c) { list.sort(c); }
미해결
[신규 개정판] 이것이 진짜 크롤링이다 - 실전편 (인공지능 수익화)
안녕하세요. pip install pyperclip 를 주피터노트북에 따라하니까 다음 에러가 발생합니다. ----------------- Cell In[1], line 1 pip install pyperclip ^ SyntaxError: invalid syntax ------------------ 그래서, 찾아보니까 !pip install pyperclip 로하면된다고 하여 설치는 했는데, 이번에는 다음과 같이 import pyperclip에서 에러가 발생합니다. 도움 부탁드립니다. 현재 주피터 노트북에서 python 버전은 3.12.3 입니다. ------------ ModuleNotFoundError Traceback (most recent call last) Cell In[1], line 6 4 from selenium.webdriver.common.keys import Keys 5 import time ----> 6 import pyperclip 9 #크롬 드라이브 생성 10 driver=webdriver.Chrome() ModuleNotFoundError: No module named 'pyperclip'"
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
제출형식 예시는 0,1 값으로 표시되어 있는데요. 평가지표는 roc_auc 입니다.pred_proba로 roc_auc를 산출하는것은 알겠으나 제출형식이 정수형으로 주어졌는데. 저희는 제출할때 확률값으로 제출해도 되는지요? 아니면 0.5 보다크면 1 작으면 0 으로 변환해서 제출해야 하는건가요? 실제 시험에서 확률값으로 제출하면 감점될것 같아서 평가방식에 중점을 둬서 제출해야하는지 어떤게 맞는건지 잘 모르겠습니다.
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
학습 관련 질문을 이거 결과가 다르게 나오는데 왜 그런건가요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
수업을 들으면서 1유형 같은 경우에 자주 나오는 함수나 문장 같은게 많은데 혹시 실례가 되지 않는다면 한번 마인드맵 때처럼 프린트해서 볼 수 있게 정리해주실 수 있을까요? 항상 강의와 답변 감사드립니다!
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
안녕하세요 선생님! 작업형 2유형 확률 문제를 풀다가 결과값 관련해서 문의드립니다 문제에 제시된 pred 예시형태는 소수점 형태인데 제가 코딩해서 제출한 csv 파일을 확인해보면 거의 매번 0 혹은 1로 나옵니다 스케일링은 안하고 object 인코딩만 해주고 있는데 제가 코딩을 잘못 하고 있는 것인지, 채점 관련해서 상관없을지 궁금해서 여쭤봅니다! (roc_auc score는 0.7616337491337491 나왔습니다)
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
안녕하세요, 뒤늦게 정신차리고 제대로 공부하고 있습니다. 답안작성 관련 궁금증이 있어 글 남깁니다. 섹션 10_예시문제3(신버전) 강의 4:27 예시문제 3 - 1번문제 답이 260.71702 .... 이런식으로 나왔는데, 만약에 문제에서 소숫점 4째자리까지 구하라고 하였을때, print(round(260.71702016732104, 4)) = 260.717로 나오게 됩니다. 260.717로 쓰는게 맞나요? 260.7170으로 쓰는게 맞나요? 응시자 유의사항(시험홈페이지)에서는 260.717, 260.7170을 완전 다른값으로 보는거같아 질문드립니다.
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
작업형 2에서 target을 EDA 단계에서 바로 pop으로 분리시키고 인코딩, 스케일링 해도 되나요??
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
자동차 데이터 셋에서 qsec 컬럼을 Min-Max Scale로 변환 후 0.5보다 큰 값을 가지는 레코드(row) 수는? 문제에서 qsec 컬럼만 묻고 있음 (다른 컬럼 신경 쓸 필요 없음) MinMax Scale 변환 조건 0.5보다 큰 값 제가 짜본 코드입니다. import pandas as pd a = pd.read_csv('/content/mtcars.csv') from sklearn.preprocessing import MinMaxScaler scaler = MinMaxScaler() a['qsec'] = scaler.fit_transform(a[['qsec']]) # ★[['qsec']] cond1 = a['qsec'] > 0.5 print(cond1.sum()) ★ 강의에서는 데이터프레임 형태로 해당위치에 넣어줘야한다는 내용 확인했습니다. 해당 위치에서 대괄호[]를 한번 더 해야하는 이유가 뭔가요? 기존에 제가 받아온 a(mtcars.csv)가 데이터프레임 형태라 그런건가요? 대괄호 [] 1개 - 시리즈, 대괄호 [[[]] 2개 - 데이터프레임
미해결
김영한의 실전 자바 - 중급 1편
안녕하세요. 예외 처리 질문드립니다. checked exception을 잡을 때 catch 블럭에서 임의로 발생시킨 MyCheckedException이 아닌 RuntimeException을 잡으려고 하면 여기서 예외 처리를 못하니 throws로 예외를 다시 던져줘서 코드가 에러가 없었는데, unchecked exception을 잡을 때 똑같이 catch 블럭에서 발생된 MyUncheckedException이 아닌 다른 예외를 catch로 선언하고 나서 못 잡을 경우 밖으로 예외를 던지나 보려고 했는데 catch 에서 MyUncheckedException이 아닌 예외 중 어떤 건 에러가 안 나고 어떤 건 에러가 납니다. 예를 들어 NullPointerExceptoin으로 잡으려고 하면 코드에 이상이 없고, MyCheckedException으로 잡으려고 하면 에러가 발생합니다. 어차피 둘 다 catch 블럭에서 처리할 수 없어서 밖으로 던질텐데 왜 이런 걸까요 ? public void callCatch(){ try{ client.call(); }catch(NullPointerException e){ System.out.println("예외처리, message = " + e.getMessage()); } System.out.println("정상 흐름"); } public void callCatch(){ try{ client.call(); }catch(MyCheckedException e){ System.out.println("예외처리, message = " + e.getMessage()); } System.out.println("정상 흐름"); } java: exception exception.basic.checked.MyCheckedException is never thrown in body of corresponding try statement
해결됨
실무에서 사용하는 클라우드 보안 프로그래밍 (AWS, Python, Terraform)
안녕하세요 콘솔에서 배포한 aws 리소스들을 테라폼으로 관리하려고 한다면, 배포된 모든 리소스들을 하나씩 import한 후 plan해보면서 변경점을 찾아 코드화시키는 방법밖에 없을까요? 리소스가 많으면 이런 작업도 공수가 꽤나 들어갈 것 같은데 다른 방법이나 툴같은게 있는지 궁금합니다. 찾아보니 terraformer로 가져올 수 있는거 같은데, 얘를 사용해도 일부 커스텀이 좀 필요한 것 같아 보입니다. 실제 업무에서는 어떤 식으로 해결하는지 궁금하여 질문드립니다.
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
안하고 진행하면 안디나요? 둘 다 id가지고 있는데 굳이 삭제할 필요는 없는 것 같은데....
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
import pandas as pd df = pd.read_csv('../input/titanic/train.csv') pd.set_option('display.max_columns',None) # print(df.head(3)) q1 = df['Fare'].quantile(0.25) q3 = df['Fare'].quantile(0.75) iqr = q3 - q1 cond1 = df['Fare'] < q1 - 1.5 * iqr cond2 = df['Fare'] > q1 + 1.5 * iqr df = df[cond1 | cond2] cond3 = df['Sex'] == "female" print(len(df[cond3])) 제 코드입니다. 저는 cond1 이거나 cond2 이렇게 조건을 주면 그게 모두 이상치이고 그 이상치를 df에다가 다시 덮어씌운다음에 여자인 조건 cond3을 준다음에 len을 사용해서 했는데 답이 너무 다르게 나와서 제 풀이는 왜 답이 안되는걸까요? 이해를 못하겠습니다 ㅜㅜㅜ