Chi2ContingencyResult(statistic=5.929494712103407, pvalue=0.01488951060599475, dof=1, expected_freq=array([[115., 115.], [185., 185.]])) 다음과 같이 결과가 나오는데, 여기서 expected_freq=array(남자의 합격 기대빈도(115), 남자의 불합격 기대빈도(115), 여자의 합격 기대빈도(185), 여자의 불합격 기대빈도(185)) 이 순서가 맞나요??
수업을 듣다보면 함수나 모델이나 이런것들을 가져올때 nump, sklearn, sklearn.preprocessing 등...그리고 import 해오는 것들이 어디에 속해있는 것인지? 이런 것들이 외우려니 좀 많이 혼동이 되서 잘 안외어져서 질문드립니다. 시험장에서 좀더 효율적으로 잘 기억나게 하는 방법이 있는지요? 아니면 나올때 마다 다 외워야하는지요?
안녕하세요 일코님. 저번에 visible설정을 잘 알려주셔서 무척 도움을 받았습니다! 다름이 아니고 원래는 제가 mac에서만 작업을 했는데요. 이번에 hwp 강의를 구매하면서 삼성 노트북을 구매하여 쓰고있습니다. 그런데 이 시스템 환경변수가 매번 말썽입니다. vscode + anaconda + bash터미널을 쓰고있는데요. bash 터미널에 which conda 명령어를 입력하면 $ which conda /c/Users/samsung-user/anaconda3/Scripts/conda 이렇게 잘 인식을 하고 있는데요. conda 명령어를 입력하면 $ conda bash: C:\Users\samsung-usernaconda3\Scripts: No such file or directory samsung-user/anaconda3 로 인식되어야 하는데, samsung-useraconda3 로 이렇게인식이 되고 있네요. GPT랑 아무리 씨름을 해보아도 답이 안나오더라구요. GPT가 시킨것은 ~/.bashrc 파일과 ~/.bash_profile 파일을 수정하라는 것인데, 각 파일은 아래와 같이 수정했습니다. ~/.bashrc ~/.bash_profile 시스템 환경 변수 설정도 아래와 같이 했는데요... 혹시 뭐가 문제가 있는걸까요?? 부탁드립니다 ㅠㅠㅠ 늘감사합니다!!
[리뉴얼] 파이썬입문과 크롤링기초 부트캠프 [파이썬, 웹, 데이터 이해 기본까지] (업데이트)
선생님 인프런에 있는 고급 크롤링 강의는 리뉴얼이 안되는 걸까요? ( 쉽게 처음하는 파이썬 고급 크롤링 [Scrapy, Selenium, Headless Chrome] ) 예전에 구매한 이 강의 들을 예정인데 강의 자체가 구매불가로 내려가고, 선생님이 자체 운영하는 사이트에서 새 강의가 올라온 걸로 보여서요. ㅠㅜ
ob = df.value_counts(normalize=True).sort_index() ob = ob.to _list() ex = [0.1, 0.05, 0.15, 0.7] 즉, 관찰값과 기댓값을 비율로 입력하여 관찰값 [0.2, 0.15, 0.1, 0.55] 기댓값 [0.1, 0.05, 0.15, 0.7] 으로 비교하면 안되나요? 비율은 같은데 통계량과 P-value 가 다르게 나오네요.
/usr/local/lib/python3.10/dist-packages/sklearn/linear_model/_logistic.py:458: ConvergenceWarning: lbfgs failed to converge (status=1): STOP: TOTAL NO. of ITERATIONS REACHED LIMIT. Increase the number of iterations (max_iter) or scale the data as shown in: https://scikit-learn.org/stable/modules/preprocessing.html Please also refer to the documentation for alternative solver options: https://scikit-learn.org/stable/modules/linear_model.html#logistic-regression n_iter_i = check optimize_result( 계속 이 문구가 뜨는데, 문제가 있는 걸까요??
기출2회를 풀고 있는데요 주어진 데이터셋(members.csv)의 앞에서부터 순서대로 80% 데이터만 활용해 'f1'컬럼 결측치를 중앙값으로 채우기 전 후의 표준편차를 구하고, 두 표준편차 차이 계산하기 (단, 표본표준편차 기준, 두 표준편차 차이는 절대값으로 계산) 이 문제를 시험환경에서 풀면 len(df)*0.8 df = df.iloc[:80] df before = df['f1'].std() median1 = df['f1'].median() # 20.574853076621935 import numpy as np df['f1'] = df['f1'].fillna(median1) after = df['f1'].std() # 17.010788646613268 이게 한 창 안에서 한번에 코딩이 되면서 before과 after 둘다에 17.010 어쩌고가 들어가서 print(before-after) 을 하면 0이 되더라고요 실행은 한 코딩창 안에서 진행해야 하는데 그럼 숫자를 따로 저장해서 20.574 - 17.010 을 출력해야 하나요?