코드 5줄의 마법, 5줄 머신러닝 PyCaret: 데이터 분석 프로젝트에 AutoML 날개 달기
from pycaret.datasets import get_data from pycaret.regression import * insurance_df = get_data('insurance') setup(data = insurance_df, target = 'charges', session_id = 123, fold_shuffle = True, log_experiment = True, experiment_name = 'insurance_v1') best = compare_models(sort = 'R2') 여기까지 실행하는 경우 잘 작동합니다. 다만 뒤에 tunemodel 실행 시 에러나는데 그게 모델이 튜닝이 안되는 모델이 선택되는 경우가 있는 것 같아요 # 어떤 모델이 선택되었는지 확인 print(f"선택된 모델: {best}") print(f"모델 이름: {type(best).__name__}") 선택된 모델: DummyRegressor() 모델 이름: DummyRegressor 이 경우에 pycaret이 처음부터 튜닝할 모델만 알고 가는 게 아니라서 이런 오류가 생기는건지 궁금합니다. 만약 그렇다면 처음부터 include나 exclude로 모델 지정 외에는 없나요?
💡 질문 작성 가이드 보다 빠르고 정확한 답변을 위해, 아래 사항을 참고해 질문을 작성해주세요. 1. 간단한 내용은 ChatGPT로 먼저 확인해보세요. 기본 개념이나 용어 설명은 ChatGPT를 활용하는 것이 더 빠르고 효율적일 수 있습니다. 2. 질문하실 때, 아래 내용을 함께 적어주시면 좋아요. 어느 파트인지 섹션 3 - 브루트 포스 알고리즘[문제풀이]: BOJ 1342 내가 이해한 내용 재귀 + 백트래킹을 이용해서 푸는 방법(방법2) 중 선생님께서 작성하신 dict과 set 객체를 이용한 것이 아닌 collections.Counter를 이용하여 코드를 작성했더니 시간초과가 뜹니다. from itertools import permutations from collections import Counter s = input() def sol(lev): global s, counter, choose, ans # base case if lev == len(s): ans += 1 return # recursive case for k in chars: if counter[k] == 0: continue if (not choose) or (choose[-1] != k): counter[k] -= 1 choose.append(k) sol(lev + 1) choose.pop() counter[k] += 1 counter = Counter(s) chars = tuple(counter.keys()) choose = [] ans = 0 sol(0) print(ans) 궁금한 점 dict과 set을 이용해서 for문으로 직접 주입하는 방식과 Counter 컬렉션을 이용해서 사용하는 방식에 어떤 차이점 때문에 시간초과가 나는지 궁금합니다 (참고로 python3로는 시간초과가 나지만, pypy3로는 통과가 됐습니다. 이 부분도 왜 그런지 궁금합니다.) 파이썬을 선생님 강의로 입문을 해서 그런지 파이썬 기초에 대해 지식이 많이 부족합니다. 알고리즘 본질이 아닌 파이썬에 대해 질문드려 죄송합니다
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 안녕하세요. 시험시 코드 실행이 어떻게 되는지 질문드립니다! 코랩에서는 셀별 실행이 가능해서 결과를 보면서 할 수 있었는데, 시험장에서 '코드 라인별 실행 불가' 관련해서 제가 이해한게 맞는지 확인차 질문 남깁니다. 1. 문제당 전체 실행 결과만 볼 수 있다고 보면 될까요? 최종 결과만 나오기 때문에 print로 중간중간 값을 찍어야 한다고 하신 것이라고 이해했는데 맞는지 확인부탁드립니다~ 2. 강의들으면서 colab에서 shift+enter로 실행하는 습관(?) 이들었는데 시험환경에서는 활용이 불가능한 것이겠죠? 좋은강의 감사합니다
안녕하세요. 프론트엔드 개발자에서 백엔드/풀스택 전향 중인 개발자입니다. 연휴때 해당 강의를 수강 하면서 한편으로 질문 드리고 싶어서 질문을 작성 하게 되었습니다. 혹시 사내에서도 AI 도구 활용이 늘어나서, 학습·업무에 어디까지 적용할지 기준을 잡고 싶습니다. AI 도구(Cursor/Claude 등) 활용 시 ‘효율적인 작업’과 ‘주의할 작업’을 각각 3~5개 정도로 예를 들어 주실 수 있을까요? 또한 권장하시는 최소 코드 검증 루틴이 있으신지도 궁금합니다. 읽어주셔서 감사합니다.
프론트엔드 개발을 하면서 javascript의 제네레이터 함수에 대해 학습했으나, 프론트에서는 이 함수의 실용성에 대해서 크게 공감을 받지 못했습니다. 그러던 중 파이썬을 학습하여 백엔드까지 확장을 넓혀야겠다고 생각했고 이 강의를 접하게 되었는데 제네레이터 함수의 실무에서의 사용을 잠깐 언급하신 것 같습니다. 구체적으로 어떤 사용사례가 있는지 궁금합니다.
섹션 3 퀴즈에서 헷갈리는 부분이 생겨서 질문드립니다. 문제의 일부는 아래와 같습니다. (정답은 B) 1. 배열과 링크드 리스트의 주요 성능 차이점 중 하나는 무엇일까요? A 배열은 요소 탐색 시 O(1)이 걸리지만, 링크드 리스트는 O(N)이 걸립니다. B 링크드 리스트는 중간에 요소를 삽입/삭제 시 O(1)이 걸리지만, 배열은 O(N)이 걸립니다. 제가 헷갈리는 부분 A도 정답이 될 수 있지 않을까요? (A를 선택한 경우 오답으로 처리됨) 수업과 수업 자료를 통해 이렇게 이해 했습니다. "특정 원소 조회시 배열은 O(1), 링크드 리스트는 O(N)의 시간 복잡도를 가진다" 요소 탐색과 요소 조회는 다른 개념일까요?
안녕하세요 한기용 지식공유자님. 좋은 강의 잘 듣고 있습니다. ELT를 구현할 때 SWAP 명령어를 사용한 정확한 이유가 궁금합니다. 제가 찾아본 바로는 SWAP 명령어는 포인터 교체 방식으로 '즉시' 데이터와 메타데이터가 교체되므로, 무중단 배포가 가능하다는 것이 장점인 것 같습니다. 사실, 트랜잭션을 활용해도 같은 기능을 구현할 수 있을 것 같은데 메타데이터 복제를 빠뜨리는 것을 예방하고, 트랜잭션을 활용하였을 때보다 성능이 우수하고, lock을 예방하기 때문에 SWAP 문법을 활용하는 걸까요?
from google.colab import files upload = files.upload() 위 명령어 실행없이 바로 데이터 불러올수없나요? 퇴근후딴짓님처럼 바로 df=pd.read_csv("members.csv") 로 불러오고싶은데 에러가 나네요 No such file or directory:members.csv
코드 5줄의 마법, 5줄 머신러닝 PyCaret: 데이터 분석 프로젝트에 AutoML 날개 달기
# --- [핫픽스] dask ↔ sktime 호환 패치 --- import types try: import dask.dataframe as dd # 최신 라이브러리 구조 변화에 대응하여 호환성을 맞춰주는 코드 # 상세한 내용을 이해할 필요는 없으며, 안정적인 실행을 위한 장치로 이해하세요. if not hasattr(dd, "core"): dd.core = types.SimpleNamespace() if not hasattr(dd.core, "DataFrame"): try: from dask.dataframe import frame as _frame dd.core.DataFrame = _frame.DataFrame except ImportError: class _DummyDF: pass dd.core.DataFrame = _DummyDF except ImportError: pass # dask가 설치되지 않은 환경에서는 무시합니다. 들여쓰기가 제대로 되어있지 않아 노션의 코드를 복사하여 붙여넣을 시 에러납니다.
1) 해당 부분에서 비교연산자가 이상/이하가 아니고 초과/미만을 사용하고 있는데 분위수값에 해당하는 값이 있으면 그 결과가 다를꺼 같아서요. 25% 데이터 구하세요 하는 문제는 정의자체가 분위수값 미만의 값 이런식으로 정해진건가요? 2) 하위 25% 데이터를 구하는 함수가 있다면, 상위 25%는 ~ 를 이용해서도 함수를 쓸 수 있을까요? 3) 가장 큰 값이 두개 이상인경우 더 앞선것을 불러오던데, 해결방법이 있을까요? (가장 큰 값이 동일한경우 모든 인덱스를 불러오게끔)