inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

묻고 답해요

173만명의 커뮤니티!! 함께 토론해봐요.

3-4 피쳐엔지니어링 인코딩 부분에서 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 3-4 피쳐엔지니어링에 인코딩 부분에서 질문이 있습니다. 파일에선 범주형 칼럼을 추출하기 위해 X_train.columns[X_train.dtypes == object] 를 사용했는데 cols = X_ train.select _dtypes(include= "O").columns 로 해도 동일하게 작업이 가능한가요? 최대한 단순하게 외우고 싶어서 이게 가능하다면 select_dtypes() 사용하는걸로 외우려고요

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
빅분기수강생 댓글 2 좋아요 0 조회수 171

Espanso 설치시 지속적으로 에러가 나서 문의드립니다.

해결됨

초보자를 위한 BigQuery(SQL) 입문

안녕하세요! Espanso 를 윈도우 버전으로 다운로드해서 설치하려고하는데 지속적으로 하기 에러가 나고있습니다. 혹시 제가 뭔가 잘못설치한건지 확인 한번 부탁드립니다!

  • sql
  • bigquery
  • 데이터-리터러시
룰루비데 댓글 1 좋아요 0 조회수 379

4회 기출 유형(작업형2)

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

4회 기출 유형(작업형2)까지 수강하였을 때, 제가 이해한 내용은 다음과 같습니다. <모델의 성능을 평가하는 방법> 데이터 분리 (X_tr, X_val, y_tr, y_val) → 모델 학습 & 하이퍼 파라미터 튜닝 → 평가 (f1 score, roc_auc_score 등) 하이퍼 파라미터 튜닝의 값을 조절해가며 평가 점수 확인 데이터 분리 없이, 모델 학습 & 하이퍼 파라미터 튜닝 → 교차검증 (cross_val_score) 이때 질문드립니다. 제가 이해한 대로, 모델의 성능을 평가하는 방법이 위의 2가지가 있는게 맞을까요? 강사님이 영상에서 교차검증을 사용한 이유는 문제에서 평가 방식을 '평가: Macro f1-score'라고 제시해주었기 때문인가요? 혹시 실제 시험 상황에서 평가 방식을 제시해주지 않는다면, 위의 2가지 방법 중 어떤 것을 사용해도 상관이 없는건가요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
yb 댓글 1 좋아요 0 조회수 215

피벗테이블 열 추가

미해결

[리뉴얼] 처음하는 파이썬 데이터 분석 (쉽게! 전처리, pandas, 시각화 전과정 익히기) [데이터분석/과학 Part1]

section 9 듣다가 피벗테이블 질문있어요 코드 : doc_covid2 = pd.pivot_table(doc_covid, index=['Country_Region'], values=['Confirmed'], aggfunc={'Confirmed': 'sum'}, fill_value=0, margins=True, margins_name='Total' ) 같은 경우 말그대로 doc_covid 에서 피벗테이블을 만드는데 Country_Region 에 대해서 Confirmed 를 더한 값을 컬럼으로 만드는 내용이잖아요 혹시 여기서 열을 추가 하는게 가능한 건가요?? Confirmed의 median 값을 컬럼으로 만드는 열을 추가 하고 싶은데 가능한건지요 ... 라고 질문글을 썼는데 혹시 몰라 그냥 구글에 검색하니까 aggfunc=['sum','median'] 이라 쓰면 됐었네요... 다른 분들에게도 도움 되시라고 그냥 남깁니다.

  • pandas
  • python
  • pivot
러시안블루 댓글 1 좋아요 0 조회수 252

시간 계산...

미해결

[백문이불여일타] 데이터 분석을 위한 중급 SQL

안녕하세요. 저는 아래와 같이 interval 앞에 연산기호 '-' 를 넣고, left join 을 이용했는데요. self join 시에 이렇게 사용하면 오답처리될 확률이 높을까요? # Write your MySQL query statement below SELECT t.id as id FROM weather t LEFT JOIN weather y on t.recordDate - interval 1 day = y.recordDate WHERE T.temperature > y.temperature;

  • sql
Chloe park 댓글 1 좋아요 0 조회수 185

7회 기출문제 원핫인코딩 관련 질문입니다.

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

원핫인코딩 시, 만약에 test 데이터에 train에서 포함하지 않은 값이 있어 컬럼이 하나 더 생기는 상황이 발생한다면 레이블인코딩으로 진행해야 하나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
석구 댓글 1 좋아요 0 조회수 257

with 문, 인라인 서브쿼리 등 사용하는 기준이 궁금합니다

미해결

데이터 분석 SQL Fundamentals

with 절이나 인라인 서브쿼리처럼 그룹을 나눠서 쓰시는 것과 그냥 한 뭉터기로 푸는 것과 기준이 감이 잡히지 않습니다 그룹을 나누는 기준이 궁금합니다 또 그룹을 나누어야 한다면 temp_01 , temp_02 처럼 몇 번을 나눠야 할지의 기준도 궁금합니다

  • sql
  • postgresql
  • dbms/rdbms
홍태경 댓글 1 좋아요 0 조회수 192

JOIN문과 서브쿼리 작성 관련

미해결

[리뉴얼] 처음하는 SQL과 데이터베이스(MySQL) 부트캠프 [입문부터 활용까지]

파이널 SQL 연습의 연습문제 1에 대한 질문입니다. (1분 38초) 포괄적인 질문이 될 수 있겠으나, 해당 연습문제에 대해 서브쿼리를 사용하여 구문을 만들어보려고 하였는데 논리적으로 짜는 것에 한계를 느꼈습니다. (애초에 연습문제1에 대해 서브쿼리를 사용하는 것이 가능한지 아닌지, 가능한데 못하고 있는 건지에 대한 판단조차 서지 않아서 여쭙고 싶었습니다.) JOIN문 작성이 어느 정도 가능하다면, 서브쿼리 단련에 그렇게 힘을 쓰지 않아도 될까요?

  • python
  • sql
  • mysql
  • dbms/rdbms
  • 데이터-엔지니어링
ㄱㄱㄱ 댓글 1 좋아요 0 조회수 236

join 질문

해결됨

데이터 분석 SQL Fundamentals

join employee b on a.key = b.key and a.fromdate betweeen b.fromdate and b.todate 여기서 질문 있습니다! join 을 할때 between 조건을 걸어주는 것과 이렇게 where 절에 조건을 걸어주는 게 어떤 차이가 있는지 궁금합니다. ~ join employee b on a.key = b.key where a.fromdate betweeen b.fromdate and b.todate 조인 조건에 조건을 추가하는 것과 where 절에 조건을 추가하는게 똑같아보이는데 차이가 있을까요

  • sql
  • postgresql
  • dbms/rdbms
hunter 댓글 2 좋아요 0 조회수 160

sum(), len(), count() 각각 언제 사용되는지 차이가 궁금합니다

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

합계, 길이, 개수 이런식으로 문제에 명시되지 않고 데이터 수를 구하여라 이런 식으로 적혀있을 때, sum이 사용된 적도 있고 len이 사용된 적도 있는데 sum(), len(), count() 각각 언제 사용되는지 궁금합니다 수치형, 범주형에 따른 사용 가능 여부 차이도 있나요??

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
soyoung an 댓글 2 좋아요 1 조회수 733

주피터 노트북 NEW 생성에서 파이썬이 안보입니다.

미해결

[리뉴얼] 처음하는 SQL과 데이터베이스(MySQL) 부트캠프 [입문부터 활용까지]

- 본 강의 영상 학습 관련 문의에 대해 답변을 드립니다. (어떤 챕터 몇분 몇초를 꼭 기재부탁드립니다) - 이외의 문의등은 평생강의이므로 양해를 부탁드립니다 - 현업과 병행하는 관계로 주말/휴가 제외 최대한 3일내로 답변을 드리려 노력하고 있습니다 - 잠깐! 인프런 서비스 운영 관련 문의는 1:1 문의하기를 이용해주세요. 파이썬 관련 생성이 안보이고 notebook terminal console new file new folder 이렇게만 보여집니다.

  • python
  • sql
  • mysql
  • dbms/rdbms
  • 데이터-엔지니어링
sjkim 댓글 1 좋아요 0 조회수 555

lead, lag로 풀이할 시 id 값이 존재하지 않는 경우의 오답

미해결

[백문이불여일타] 데이터 분석을 위한 고급 SQL

안녕하세요 선생님~ 해당 문제를 윈도우함수로 풀었는데, submit을 하니 일부 테스트케이스에서 오답으로 되어 질문드립니다. 아래 input에서 id 3이 존재하지 않아, 해당 테이블의 num컬럼을 1,1,null,1,1,2,1 로 정의하고 풀어야 할 것 같습니다.(실제로 expected output에 아무 값도 나오지 않아야 함) 강의에 나오는 쿼리로는 id가 빠져있는 경우를 처리하지 않고, 명시적으로 나와있는 데이터의 연속성만 판단하고 있습니다. 아래와 같은 예외케이스를 포괄할 수 있는 쿼리를 어떻게 짜야할지 조언주시면 감사하겠습니다. 제가 작성한 쿼리도 첨부합니다!

  • sql
김부각 댓글 2 좋아요 0 조회수 394

IBKR Desktop Global Configuration 설정

해결됨

파이썬 알고리즘 트레이딩 파트2: Interactive Brokers API를 활용한 실시간 알고리즘 트레이딩

안녕하세요 강사님 IBKR Desktop 다운로드 이후 api 설정을 해주려고 했는데요 뭔가 버전이 다른 건지 화면이 달라서 어디서 설정을 할 수 있는지가 잘 안보여서 문의드립니다! 감사합니다!

  • python
  • 객체지향
  • 퀀트
luca 댓글 2 좋아요 1 조회수 437

WITH 구문

해결됨

초보자를 위한 BigQuery(SQL) 입문

1. WITH 사용하지 않고 FROM으로 묶은 후 쿼리 작성 이어나가기 2. WITH 사용하기 안녕하세요. 위의 두 경우 모두 쿼리 결과는 동일하게 나오는데, WITH를 사용하는 정확한 이유가 오로지 가독성을 위한 것인지, 용량에도 차이가 생기는 것인지 궁금해 질문드립니다. (개인적으로는 문제를 풀 때 바로 묶는 것이 더 편하기 때문에 여쭤봅니다.!)

  • sql
  • bigquery
  • 데이터-리터러시
mini0529 댓글 1 좋아요 0 조회수 212

강의 자료 부탁드립니다

미해결

프로그래밍 시작하기 : 파이썬 입문 (Inflearn Original)

안녕하세요 파이썬 강의 자료 부탁드립니다 mhchoi933@gmail.com 감사합니다 !

  • python
댓글 1 좋아요 0 조회수 166

sql 단축키

미해결

자바와 스프링 부트로 생애 최초 서버 만들기, 누구나 쉽게 개발부터 배포까지! [서버 개발 올인원 패키지]

안녕하세요. sql에서 위와 같이 깔끔하게 정렬할 수 있게 도와주는 단축키가 뭐였나요? 답변 미리 감사합니다.

  • java
  • spring
  • aws
  • mysql
  • spring-boot
  • jpa
  • sql
이혜리 댓글 2 좋아요 0 조회수 320

Date 강의 / leetcode 1321 질문

해결됨

SQL 코딩테스트를 위한 마지막 걸음

# [Setting] USE PRACTICE; DROP TABLE Customer; CREATE TABLE Customer (customer_id int, name varchar(20), visited_on date, amount int); INSERT INTO Customer (customer_id, name, visited_on, amount) VALUES (44, 'Ashley', '2019-01-04', 160), (23, 'Sabo', '2019-01-04', 70), (38, 'Moustafa', '2019-01-05', 90), (30, 'Halley', '2019-01-06', 140), (5, 'Elvis', '2019-01-07', 160), (12, 'Leslie', '2019-01-08', 100), (23, 'Sabo', '2019-01-08', 90), (13, 'Will', '2019-01-09', 170), (20, 'Brock', '2019-01-10', 160), (29, 'Leo', '2019-01-10', 90), (33, 'Isaac', '2019-01-11', 60), (46, 'Selena', '2019-01-12', 100), (4, 'Winston', '2019-01-13', 150), (15, 'Marti', '2019-01-13', 160); SELECT * FROM Customer; # [my practice] select b.visited_on, sum(amount) as amount, round(sum(a.amount) /7, 2) as average_amount from customer a inner join (select distinct date_sub(visited_on, interval 6 day) as week_before, visited_on from customer) b on a.visited_on between b.week_before and b.visited_on group by b.visited_on having count(amount) >= 7 order by b.visited_on; 올려주신 방식 외에 inner join시 date 구간으로 조건 넣는 방식으로 시도해 보았습니다. 위 데이터로 삽입하는 경우, MySQL Workbench에서는 예상 결과대로 출력 되는데 leetcode에서 오류가 나서 혹시 제가 코드 상에서 간과하고 있는 부분이 있는지 궁금해서 질문 드립니다. leetcode 내에 PostgreSQL로 유사한 방식의 해결 법은 확인했었는데 혹시나 해서 링크 올려봅니다. https://leetcode.com/problems/restaurant-growth/solutions/5040002/well-explained-postgresql-solution-beats-99

  • sql
  • mysql
  • 코딩-테스트
이승렬 댓글 1 좋아요 1 조회수 223

중급반 결재하러 가요!! 기초반 좋았습니다

해결됨

[백문이불여일타] 데이터 분석을 위한 기초 SQL

기초반 들었는데 너무 쉽게 설명해주셔서 좋았어요중급반 들으러 갑니다

  • sql
  • 오라클
  • mysql
김태중 댓글 2 좋아요 1 조회수 189

실무에서 prefix index를 어떤 요구사항이 있을때 사용하는지 궁금합니다!

해결됨

MySQL 성능 최적화

실무 요구사항에서 blob, text, 긴 varchar와 같은 칼럼을 인덱싱하는 경우가 있을까요? 당장 기억나는건 게시글 내용 검색 밖에 생각이 안나네요.. 그리고 요 아래글에 나와있는 prefix index의 한계점도 맞는 말일까요? https://stackoverflow.com/questions/31526618/mysql-prefix-index-vs-index (아래는 챗지피티가 요약해준거라 정확하지 않을 수 있습니다 ㅠ) 인덱스를 통해 "가능한" 행들을 먼저 찾고, 이후 실제 데이터 행을 검색하여 추가 필터링을 수행(두 단계를 거치므로 인덱스를 사용하지 않을때보다 더 많은 시간 소요..?) 2.정렬(sorting)이나 그룹화(grouping) 작업에는 사용되지 않음. ORDER BY 절을 명시적으로 사용하지 않는 한 결과의 순서는 보장되지 않음 커버링 인덱스로 사용 불가

  • sql
  • mysql
  • dbms/rdbms
  • optimizing
soap 댓글 1 좋아요 0 조회수 493

Plotly을 이용해 treemap시각화시 공유사항

미해결

다양한 사례로 익히는 SQL 데이터 분석

plotly의 treemap 을 사용해서 시각화 하는 경우 Pandas 2.xxxx 버전에서 append 메소드를 지원하지 않아서 treemap api를 이용해 시각화 시도 하는 경우 append를 지원하지 않는다는 오류 메시지를 밷는 경우를 봅니다. 아마도 plotly가 append 메소드 더 이상 지원하지 않는것에 대해서 패치가 이루어지지 않는 버전이어서 그런 경우가 있습니다. 이런 경우는 plotly의 최선 버전으로 재 인스톨 해주시고 실습을 하시면 됩니다. 참고로 저의 실습 버전 plotly 5.7.0 -> 현재는 5.22.0 입니다.

  • sql
  • postgresql
  • dbms/rdbms
  • 퍼포먼스-마케팅
  • 데이터-엔지니어링
sangseo seo 댓글 2 좋아요 0 조회수 310

인기 태그

인프런 TOP Writers

주간 인기글