inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

이야기를 나눠요

173만명의 커뮤니티!! 함께 토론해봐요.

랜덤포레스트 결과가 다르게 나와요

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

랜덤포레스트 결과가 다르게 나와 요

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
심나 댓글 1 좋아요 0 조회수 247

사후 검정 투키, 본페로니 식

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

사후 검정 투키, 본페로니 식 외워야 하나요? 시험에서 사후검정도 해야하나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
wsyang 댓글 1 좋아요 0 조회수 364

안녕하세요 오픈서치 서버리스 사용해보려고 하는데요ㅠㅠ

하루만에 배우는 AWS OpenSearch

다음과 같은 양식으로 남겨주세요. 질문을 한 배경 : 알려주신 내용을 활용해보려고 생각중에 서버리스를 사용해서 비용최적화를 하려고했습니다. 그런데 대쉬보드 url로 접속하면 무한로딩이 발생하고 진입이 안됩니다. 아주 관련 있는 내용은 아니지만 여쭤볼곳이 없어서 1주일째 고생하다가 여기 여쭙습니다. 질문내용 : 위에 내용처럼 오픈서치 서버리스 사용해보려고 하는데 진입자체가 안되서 실례 무릅쓰고 여쭙습니다. aws 문의 게시판에도 같은증상이 생기는 사람만 있고 해결한 사람은 없네요 ㅠㅠ IAM 으로 모든 권한 줘서 해도 동일한 증상만 발생합니다. 혹시 해결책이 있을까요? 항상 감사합니다~

  • aws
  • backend
  • amazon-cloudsearch
  • aws-cloud9
  • amazon-opensearch
hyeonsuck han 댓글 1 좋아요 0 조회수 446

공부방법 질의드립니다.

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

정처기 실기 준비한다고 빅분기 실기 준비가 늦었는데요.... 인강 결제하고 공부한지 3일차인데, 작업형1 모의문제를 푸는데 멘탈이 탈탈 털려버렸어요 ㅜㅜ... 나름 열심히한다고 온갖 함수부터 달달 외우고는 있는데 응용이 전혀 되질 않아서 모의문제를 혼자 힘으로 1도 못풀었어요.. 계속 gpt로 코드 해석보면서 보고있는데, 이대로 계속 진도를 나가는게 맞는지 모르겠네요... 계속 지웠다 썼다 반복하고는 있는데, 단순히 답을 외우게 되는 것 같아서 나중에 응용이 될까 모르겠네요.. 이해가 안 가더라도 계속 진도를 나가고 회독을 하는게 맞는 건가요 ?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
rokkk 댓글 1 좋아요 1 조회수 276

작업형2 성별예측 문제

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

https://dataq.goorm.io/exam/116674/체험하기/quiz/4 여기서 하는 성별예측 문제에서 import pandas as pd train = pd.read _csv("data/customer_train.csv") test = pd.read _csv("data/customer_test.csv") # print(train.shape, test.shape) # print( train.info ()) # print(train.isnull().sum()) # print(test.isnull().sum()) #결측치 처리 (환불금액) train['환불금액'] = train['환불금액'].fillna(0) test['환불금액'] = test['환불금액'].fillna(0) # print(test.isnull().sum()) # print(train['성별'].value_counts()) #인코딩 target = train.pop('성별') train = pd.get_dummies(train) test = pd.get_dummies(test) #검증 데이터 분리 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size=0.2, random_state=0) # print(X_tr.shape, X_val.shape, y_tr.shape, y_val.shape) from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state=0) rf.fit (X_tr, y_tr) pred = rf.predict_proba(X_val) # print(pred) from sklearn.metrics import roc_auc_score roc = roc_auc_score(y_val, pred[:,1]) #예측 및 파일생성 pred = rf.predict_proba(test) submit = pd.DataFrame({ "pred":pred[:,1] }) submit.to _csv("result.csv", index=False) # print( pd.read _csv("result.csv")) 이렇게 코딩을 했는데 예측 및 파일 생성에서 pred = rf.predict_proba(test) 여기 부분이 오류가 뜨는데 왜 그런가요 ㅠㅠ > Makefile:6: recipe for target 'py3_run' failed make: *** [py3_run] Error 1 Traceback (most recent call last): File "/goorm/Main.out", line 43, in <module> pred = rf.predict_proba(test) File "/usr/local/lib/python3.9/dist-packages/sklearn/ensemble/_forest.py", line 674, in predict_proba X = self._validate_X_predict(X) File "/usr/local/lib/python3.9/dist-packages/sklearn/ensemble/_forest.py", line 422, in validate X_predict return self.estimators_[0]._validate_X_predict(X, check_input=True) File "/usr/local/lib/python3.9/dist-packages/sklearn/tree/_classes.py", line 407, in validate X_predict X = self._validate_data(X, dtype=DTYPE, accept_sparse="csr", File "/usr/local/lib/python3.9/dist-packages/sklearn/base.py", line 437, in validate data self._check_n_features(X, reset=reset) File "/usr/local/lib/python3.9/dist-packages/sklearn/base.py", line 365, in check n_features raise ValueError( ValueError: X has 73 features, but DecisionTreeClassifier is expecting 74 features as input. 이렇게 뜹니다,,

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
wnguswls2818 댓글 1 좋아요 0 조회수 250

문제2

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 좋은 강의 감사드립니다. 덕분에 잘 배우고 있습니다. 문제 2. 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 그리고 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요! 문제2를 대하고 순간 다음과 같은 고민을 했었습니다. 1번을 수행하여 'f1'컬럼의 결측치 행을 삭제한 후 2번을 하려니 'f3'컬럼의 결측치 갯수가 18개만 남더군요. 그럼 18개는 최초 데이터 100개의 20% 미만일까? 그렇지 않다. 'f1'컬럼 결측치를 제거한 후 데이터 갯수 69개의 20%~30%(14~20)에 해당한다. 그렇다면 'f3'컬럼의 최빈 값은 'f1'컬럼의 결측치를 제거하기 전의 값을 사용해야할까 아니면 결측치 제거 후의 값을 사용해야 할까? 결과적으로는 어떤 방식으로 하던 답은 56으로 일치했지만 주어진 데이터에 따라 다른 값이 나올 수도 있을 것 같습니다. 혼돈을 없애기 위해 문제 2의 문항 순서를 바꾸면 어떨까요? 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김우현 댓글 1 좋아요 1 조회수 320

서브쿼리

데이터 분석 SQL Fundamentals

서브쿼리만 따로 실행하면 상관 컬럼으로 참조한 컬럼은 메인쿼리에 있어서 서브쿼리 단독 실행이 안되는 바람에 문제점 파악하기도 힘들고 쿼리가 메인부터 실행되는게 아니라 서브부터 실행되기 때문에 가장 안쪽에 있는 서브쿼리부터 거꾸로 해석해야해서 직관적으로 의미를 알아내기도 어렵고... 정말 끔찍해요 안썼으면 좋겠어요... 최초 강의에 포함되지 않은 이유가 있는것같아요

  • sql
  • postgresql
  • dbms/rdbms
  • 서브쿼리
Geonu Park 댓글 1 좋아요 0 조회수 429

초기환경 설치에 관한 자료는 어디에 있나요

하트카운트와 함께 쉽게 시작하는 SQL

24년 9월 10일에 강의를 듣기 시작했습니다... 그런데 초기환경 설치 방법에 관한 자료를 못찾아서 글 남깁니다.. 어디에 있는지.. 알려 주시거나,,, 게시판에 올려 주시면 좋겠습니다.

  • sql
  • mysql
  • sql-query
M.S kang 댓글 1 좋아요 0 조회수 446

vpc, load-balancing 등 적절한 도입 시기 고민

비전공자도 이해할 수 있는 AWS 입문/실전

안녕하세요. 정말 좋은 강의덕분에 무사히 lambda에서 ec2로 클라우드 이관을 완료했습니다. 몇가지 고민 및 문의사항이 있어 글 남깁니다. 1. 지금까지 강의에서 배운 내용으로만 유저 1000명 이하인 서비스 운영이 가능할까요? - 지금까지 강의에서 다룬 프리티어 버전의 ec2, rds등에 대한 성능 측정을 어떤 식으로 진행해야 하는지 감이 안잡혀서 질문이 조금 추상적인점 양해 부탁드립니다. 2. 1번 질문이 추상적인 것 같은데, 혹시 지금 강의의 인스턴스 스펙에 대해서 성능을 측정할 수 있는 방법에는 어떤 것들이 있을까요? - ec2에 배포한 프로젝트의 아무 api를 잡고, jmeter등으로 성능 측정을 해보면 될까요? 아니면 더 정확하게 측정할 수 있는 다른 방법이 있을까요? - rds 관련해서 성능 측정은 어떤 툴이나 방법이 있는지도 궁금합니다. 3. 다른 글들을 찾아보면 vpc, elb, docker를 통해 아키텍처를 구성하는 것 같은데 각 기술에 맞는 도입시기 등은 언제일까요? 4. 이 강의를 다 들은 후에 클라우드 관련해서 어떤 걸 추가로 학습하면 좋을까요?

  • aws
  • aws-elb
  • aws-rds
  • ec2
  • s3
andrew 댓글 1 좋아요 0 조회수 466

jenkins ec2관련 질문

비전공자도 이해할 수 있는 AWS 입문/실전

안녕하세요. 현재 진행중인 사이드 프로젝트(springboot)에서 lambda를 사용해서 활용중인데, ec2로 이관하려고 해당 강의를 시청중입니다. ec2로 이관하면서 ci/cd도 다시 구축해야 하는데, jenkins를 활용하려고 합니다. 그 과정에서 아래 고민(질문)들이 있어서 문의드립니다. 1. 일반적으로 application구동할 ec2 인스턴스를 생성하고, jenkins는 별도의 ec2인스턴스를 생성해서 구축하는게 올바른걸까요? 2. 프리티어로 ec2인스턴스를 2개 생성하게 되면 과금은 어떤 방식으로 이뤄지는지에 대해서 확인할 수 있는 자료가 있을까요?

  • aws
andrew 댓글 1 좋아요 0 조회수 403

s3 버킷 생성시 설정 팁

처음 시작하는 Infrastructure as Code: AWS & 테라폼

최근에는 아래와 같이 설정하는 방법을 권장한다고 합니다. resource "aws_s3_bucket" "tfstate" { bucket = "tf101-jupiter-apne2-tfstate" } resource "aws_s3_bucket_versioning" "tfstate" { bucket = aws_s3_bucket.tfstate.id versioning_configuration { status = "Enabled" } }

  • aws
  • Terraform
buevonhun 댓글 1 좋아요 0 조회수 430

강의 기간 연장해서 더 들을 수 있을까요?

AWS Certified Solutions Architect - Associate 자격증 준비하기

안녕하세요 강사님. 강의를 잘 들었습니다. practitioner부터 SA까지 강의 듣고 자격증 취득에 큰 도움 되었습니다~ 실무단에서 소소한 영역들 적용해보기 시작하려는데, 이론으로만 보고 막상 하려니 어렵네요! 강의 내용에서 실습 내용들을 짬짬이 더 보고 싶은데, 강의 기간 연장해주실 수 있을까요?

  • 네트워크
  • aws
starbee 댓글 1 좋아요 0 조회수 429

개인 프로젝트 관련 고민이 있습니다..

자바와 스프링 부트로 생애 최초 서버 만들기, 누구나 쉽게 개발부터 배포까지! [서버 개발 올인원 패키지]

이번에 배포까지 완료 하였고, 많이 부족하지만 이 강의를 통하여 배운 것을 기반으로 응용 프로젝트를 하려고 합니다. 목표는 웹 앱 하이브리드 형식으로 웹에서는 관리자 관리 기반 기능 (책 등록, 회원 승인, 기록 관리) 앱에서는 로그인이나 ai 가 책을 추천하고, 책에 대한 소통하는 게시판, 웹에서 등록된 책을 앱에서 대출 및 반납 을 목표로 하고 있습니다. 예전에 js, css 를 다뤄서 html 을 만들어본 경험과 안드로이드 스튜디오를 통해 heidiSQL 을 사용하여 알람 앱을 만들어 본 적도 있는데, 다 까먹었지만, 다시 한번 기억을 되살려 써먹어보고 싶습니다. 문제는 일단 프론트 쪽 부터 뜯어보고 싶은데, 제가 배웠던 것은 js와 css 파일을 나누어서 그것을 이용해 body에 때려박는 무식한 방식으로 했는데 idex.html 에 있는 body 에 id="root" 만 있고 이 root 에 대한 값을 못찼겠네요... 일단 제가 알고 싶은 것은 버튼이나 여러 ui를 추가 하고 싶은데 혹시 강의에서 주신 html 을 건들려면 어떻게 해야 할지 알 수 있을까요? 서버 실행 후 index.html 에 있는 저장 버튼이 어떻게 저희가 작성한 코드와 상호작용 되는지 알 수 있을까요?

  • java
  • spring
  • aws
  • mysql
  • spring-boot
  • jpa
Frustrequiem 댓글 0 좋아요 0 조회수 516

titanic.mean() 하면 오류가 나옵니다.

데이터 분석을 위한 판다스: 기초부터 데이터 분석까지

수업을 들으면 titanic에 mean()을 적용하면 결과가 나오는데, 저는 나오지 않더군요(에러 메시지가 나옴) 그래서 numeric_only=True를 주니까 문제가 해결이 되긴 하던데, 혹시 제가 뭔가 설정이 달라서 그런건지? 하여 문의 남깁니다.

  • pandas
seocoach 댓글 0 좋아요 0 조회수 204

wordpress 접속 안됨

처음 만난 AWS

wordpress의 public ip로 접속을 할려고하는데 자꾸 안돼서 원인을 모르겟습니다

  • aws
  • lambda
  • amazon-web-services
  • cloud-computing
  • ec2
이태민 댓글 1 좋아요 0 조회수 425

혹시 쿼리를 빨리 읽는 방법이 있을까요?

데이터 분석 SQL Fundamentals

혹시 쿼리를 빨리 읽는 방법이 있을까요? 제가 실무에서 프로시저와 함수들을 주로 사용하고 있습니다. 그런데 제가 SQL 에 익숙하지 않아서 인것도 있지만 주석이 없는 프로시저와 함수들을 보고 의도를 파악하고 분석하는데 시간이 너무 오래 걸리고 있어요. 혹시 서브쿼리 join , union 등이 무분별하게 쓰여진 복잡한 쿼리에서 쿼리의 의도만을 빠르게 파악할 수 있는 방법이 있을까요? 제 나름대로 생각을 해서 SELECT 절은 일단 보지 않고 FROM 절을 먼저 보고 어떤 테이블에서 값을 가지고 오는지 판단한후 WHERE 절을 보고 마지막으로 SELECT 절을 보고 있어요 그런데 SELECT 절에서도 CASE WHEN 문이나 단일행 서브쿼리들이 있어서 실행을 시켜보아도 이게 무슨의미인지 파악하지 못할때가 많아요,, 방법이 있을까요?

  • sql
  • postgresql
  • dbms/rdbms
minhyuck WOO 댓글 1 좋아요 0 조회수 1019

docker 관련 질문

따라하며 배우는 도커와 CI환경 [2023.11 업데이트]

ec2에 개별적으로 docker run jpr파일을 띄우고 docker stop을 하고 다 지우고 통합 관리를 위해 docker compose yml에서도 같은 jpr파일을 적어서 docker compose up하면 안됩니다... ec2안데 개별적으로 docker run하면 됩니다. ..

  • aws
  • docker
  • github
  • ci/cd
  • travis-ci
  • 데이터-엔지니어링
kim1234123 댓글 0 좋아요 0 조회수 432

EC2 type upgrade

쉽게 설명하는 AWS 기초 강의

Beanstalk로 생성한 EC2 type이 t2.micro인데 memory 부족으로 업그레이드를 생각하고 있습니다. 가장 걱정되는건 업그레이드를 할때 기존 EC2와 타입이 안맞던지, 연결되어 있던 네트워크나 ELB, 도메인, 스토리지 등의 구성이 깨지면 복구를 할수있는 지식이 없기 때문에 불안해서 못 하고 있습니다. 강사님의 t 타입 영상을 봐도 잘 이해가 안가고 CloudWatch지표를 보라고 하셨는데 봐도 잘 모르겠네요 도움 부탁 드립니다.

  • aws
  • aws-vpc
  • aws-rds
  • aws-ec2
  • aws-s3
kium 댓글 1 좋아요 0 조회수 430

[1유형]

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 1유형은 부분점수가 있다고 하는데 값을 출력하고 그 때마다 제출 버튼을 눌러야지 채점이 되는건가요? 1유형에도 문제가 3개 있으면 제출 버튼을 3번 누르면 되는 건가요? 2유형은 마지막에 파일 생성하면 끝이 나는 건가요? 3유형도 궁금합니다!!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
tlsdk0284 댓글 0 좋아요 0 조회수 297

인기 태그

인프런 TOP Writers

주간 인기글