inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

묻고 답해요

172만명의 커뮤니티!! 함께 토론해봐요.

라이브러리 및 데이터 불러오기 그리고 EDA, 남성 중 0과 1 (인원 수)

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

강의 15:40 정도 보면 # 남성 중 0과 1 (인원수) 부분에서 코드를 똑같이 입력했는데 저는 뒤에 값이 0이 나옵니다... 뭐가 잘못된건가요,,? 는

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
dyddnjs1219 댓글 2 좋아요 0 조회수 107

4-5. 3번 시간데이터 연습문제 질문

해결됨

초보자를 위한 BigQuery(SQL) 입문

3. 각 트레이너별로 그들이 포켓몬을 포획한 첫 날(catch_date)을 찾고, 그 날짜를 'DD/MM/YYYY' 형식으로 출력해주세요. 해당 문제에서 catch_date는 UTC 기준의 데이터이므로, 한국 기준으로 하려면 catch_datetime을 사용해야 한다고 하셨는데요! 테이블을 보면, TIMESTAMP 타입인 catch_datetime만 UTC 기준의 데이터인 것으로 이해했는데 DATE 타입인 catch_date가 UTC 기준의 데이터인 이유가 무엇인가요?

  • sql
  • bigquery
  • 데이터-리터러시
댓글 2 좋아요 0 조회수 112

pyside6-uic login.ui -o login_ui.py 명령어 질문

미해결

[신규 개정판] 이것이 진짜 크롤링이다 - 실전편 (인공지능 수익화)

1 . 해당 명령어를 치려면 전역변수로 등록 하고 ui 파일 있는 위치에서 명령어를 실행하기 2 . 환경변수 등록 없이 pyside6-uic.exe 파일이있는 폴더로 터미널 경로를 이동하고 .ui 파일도 exe 폴더있는 경로로 이동시켜서 명령어 실행 위에 두가지 방법으로 했을때 .py로 컴파일이 됐었는데 pyside6-uic login.ui -o login_ ui.py 명령어 실행 할때 vscode 로 다른 방법이 있나요? 환경변수 등록을 안하고 그냥 터미널로 바로 실행하면 pyside6-uic 배치파일 에러가 떴었고 .ui 파일 있는곳에서 실행을 꼭 해야 하더라고요

  • python
  • 웹-크롤링
진용 댓글 2 좋아요 0 조회수 255

원핫인코딩

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

원핫 인코딩을 했는데 0,1 이 아닌 true false 가 나오는 이유가 궁금합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
shs4166 댓글 2 좋아요 0 조회수 121

sales 데이터 모델

미해결

실습으로 손에 잡히는 SQLD(2과목)

아직 github에서 못찾겠는데 안올려주신건가요? ㅠㅠ

  • sql
  • oracle
  • mssql
  • SQLD
allie1017 댓글 3 좋아요 0 조회수 182

빠짝스터디 2주차 윈도우 함수

미해결

BigQuery(SQL) 활용편(퍼널 분석, 리텐션 분석)

--1. 사용자별 쿼리를 실행한 총 횟수를 구하는 쿼리를 작성해주세요. 단, group by를 사용해서 집곟나ㅡㄴ 것이 아닌 query_logs의 데이터의 우측에 새로운 컬럼을 만들어주세요. select *, count(query_date) over(partition by user) as total_query_cnt from advanced.query_logs order by 1, 3 --2. 주차별로 팀 내에서 쿼리를 많이 실행한 수를 구한 후, 실행한 수를 활용해 랭킹을 구해주세요. 단, 랭킹이 1등인 사람만 결과가 보이게 해주세요 with query_cnt_by_team as( select extract(WEEK from query_date) as week_number, team, user, count(user) as query_cnt from advanced.query_logs group by all ) select *, rank() over(partition by week_number, team order by query_cnt desc ) as rk from query_cnt_by_team qualify rk = 1 order by 1, 2, 4 desc -- 3. (2번 문제에서 사용한 주차별 쿼리 사용) 쿼리를 실행한 시점 기준 1주 전에 쿼리 실행 수를 별도의 컬럼으로 확인할 수 있는 쿼리를 작성해주세요. with query_cnt_by_team as( select extract(WEEK from query_date) as week_number, team, user, count(user) as query_cnt from advanced.query_logs group by all ) select *, lag(query_cnt, 1) over(partition by user order by week_number) as prev_week_query_cnt from query_cnt_by_team -- 4. 시간의 흐름에 따라 일자별로 유저가 실행한 누적 쿼리 수를 작성해주세요. select *, sum(query_cnt) over (partition by user order by query_date rows between unbounded preceding and current row) as cumulative_sum from ( select query_date, user, count(user) as query_cnt from advanced.query_logs group by all ) order by 2, 1 -- 5. 다음 데이터는 주문 횟수를 나타낸 데이터입니다. 만약 주문 횟수가 없다면 NULL로 기록됩니다. 이런 데이터에서 NULL 값이라고 되어있는 부분을 바로 이전 날짜의 값으로 채워주는 쿼리를 작성해주세요. WITH raw_data AS ( SELECT DATE '2024-05-01' AS date, 15 AS number_of_orders UNION ALL SELECT DATE '2024-05-02', 13 UNION ALL SELECT DATE '2024-05-03', NULL UNION ALL SELECT DATE '2024-05-04', 16 UNION ALL SELECT DATE '2024-05-05', NULL UNION ALL SELECT DATE '2024-05-06', 18 UNION ALL SELECT DATE '2024-05-07', 20 UNION ALL SELECT DATE '2024-05-08', NULL UNION ALL SELECT DATE '2024-05-09', 13 UNION ALL SELECT DATE '2024-05-10', 14 UNION ALL SELECT DATE '2024-05-11', NULL UNION ALL SELECT DATE '2024-05-12', NULL ), raw_data2 as( select *, last_value(raw_data.number_of_orders ignore nulls) over(order by date) as last_value_orders from raw_data ) select * from raw_data2 WITH raw_data AS ( SELECT DATE '2024-05-01' AS date, 15 AS number_of_orders UNION ALL SELECT DATE '2024-05-02', 13 UNION ALL SELECT DATE '2024-05-03', NULL UNION ALL SELECT DATE '2024-05-04', 16 UNION ALL SELECT DATE '2024-05-05', NULL UNION ALL SELECT DATE '2024-05-06', 18 UNION ALL SELECT DATE '2024-05-07', 20 UNION ALL SELECT DATE '2024-05-08', NULL UNION ALL SELECT DATE '2024-05-09', 13 UNION ALL SELECT DATE '2024-05-10', 14 UNION ALL SELECT DATE '2024-05-11', NULL UNION ALL SELECT DATE '2024-05-12', NULL ), raw_data2 as( select *, last_value(raw_data.number_of_orders ignore nulls) over(order by date) as last_value_orders from raw_data ) --6. 5번 문제에서 NULL을 채운 후, 2일 전 ~ 현재 데이터의 평균을 구하는 쿼리를 작성해주세요(이동평균) select * except(number_of_orders), avg(last_value_orders) over (order by date rows between 2 preceding and current row) as moving_avg from raw_data2 --7. app_logs 테이블에서 Custom session을 만들어 주세요. 이전 이벤트 로그와 20초가 지나면 새로운 session을 만들어 주세요. session은 숫자로 (1, 2, 3..) 표시해도 됩니다. -- 2022-08-18의 user_pseudo_id(1997494153.8491999091)은 session_id가 4까지 나옵니다 with base as( select event_date, datetime(timestamp_micros(event_timestamp), 'Asia/Seoul') as event_datetime, event_name, user_id, user_pseudo_id from advanced.app_logs where event_date = "2022-08-18" and user_pseudo_id = "1997494153.8491999091" order by event_timestamp ), diff_data as ( select *, datetime_diff(event_datetime, prev_event_datetime, second) as second_diff from ( select *, lag(event_datetime, 1) over(partition by user_pseudo_id order by event_datetime) as prev_event_datetime from base order by event_datetime ) ) select *, sum(session_start) over(partition by user_pseudo_id order by event_datetime) as session_number from ( select *, case when prev_event_datetime is null then 1 when second_diff >= 20 then 1 else null end as session_start from diff_data )

  • sql
  • Google-Analytics
  • firebase
  • google-sheets
  • bigquery
김덕배 댓글 1 좋아요 0 조회수 106

X_train

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

X_train['age']가 아니라 X_train[X_train['age'] 인 이유가 궁금합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
shs4166 댓글 2 좋아요 0 조회수 83

drop , dropna

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

이 둘의 차이는 뭘까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
shs4166 댓글 2 좋아요 0 조회수 97

수치형 컬럼 리스트화

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

수치형 컬럼들 리스트로 만들 시, cols = list(X_train.columns[X_train.dtypes != 'object']) 시험에서 이렇게 해도 되나요? object랑 int랑 float 세개만 나오면 이렇게 해도 될 듯한데, 그 외 변수들이 나올 경우 대비해서, 수치형 컬럼들만 리스트 할 때, 어떤식으로 코딩하는 것이 나을까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
wsyang 댓글 2 좋아요 0 조회수 132

train 분리

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

[0,-1]인 이유에 대해 잘 이해하지 못하겠어요

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
shs4166 댓글 2 좋아요 0 조회수 89

5강 중 span.decompose() 관련 문의

미해결

남박사의 파이썬으로 봇 만들기 with ChatGPT

5강 기상청사이트 날씨모듈 구현1 중에서 다음과 같이 날씨 태그를 살펴보는데 <span class="tmp">4.6<small>℃</small> <span class="minmax"><span>최저</span><span>-</span><span>최고</span><span>-</span></span></span> _span_tmp.span.decompose() 을 통하여 <span class="tmp">4.6<small>℃</small></span> 남기고 모두 지우는데 제가 알기로는 span 태그가 모두 사라지는 걸로 알고 있었는데 처음 span 태그는 원래 사라지지 않는건가요?? 보통의 블로그에서는 처음부터 삭제대상 태그인 경우가 없었던지라 좀 당황스럽습니다.

  • python
  • 웹-크롤링
  • 챗봇
  • 객체지향
  • openai-api
역학자 댓글 1 좋아요 0 조회수 110

결측치 처리(fillna(method = 'bfill')) 질문입니다.

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

시험환경에서 fillna(method = 'bfill')를 사용했더니, 아래 에러코드가 발생해서 gpt로 확인했더니, train['컬럼명'] = train['컬럼명'].bfill()로도 사용할 수 있더라구요. 시험환경에서 이러한 에러코드가 발생했으니 실제 시험에서도 이렇게 사용해도 상관 없을까요 ? 에러코드 전문 /goorm/Main.out:12: FutureWarning: Series.fillna with 'method' is deprecated and will raise in a future version. Use obj.ffill() or obj.bfill() instead. train['abc'] = train['abc'].fillna(method = 'bfill')

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
rokkk 댓글 2 좋아요 0 조회수 369

섹션 6 인증 failed 질문

미해결

[리뉴얼] 처음하는 파이썬 백엔드와 웹기술 입문 (파이썬 중급, flask[플라스크] 로 이해하는 백엔드 및 웹기술 기본) [풀스택 Part1-1]

여러 방법으로 시도해봤는데 계속 failed가 뜨네요 왜그럴까요? (py311) PS C:\Users\MS> http GET http://localhost:8080/login?user_name=dave HTTP/1.1 200 OK Connection: close Content-Length: 18 Content-Type: application/json Date: Tue, 05 Nov 2024 10:13:02 GMT Server: Werkzeug/3.0.3 Python/3.12.4 { "auth": "failed" } from flask import Flask, jsonify, request, render_template app = Flask(__name__) @app.route('/login') def login(): username = request.args.get('user_name') passwd = request.args.get('pw') email = request.args.get('email_address') print (username, passwd, email) if username == 'dave': return_data = {'auth': 'success'} else: return_data = {'auth': 'failed'} return jsonify(return_data) @app.route('/html_test') def hello_html(): # html file은 templates 폴더에 위치해야 함 return render_template('login.html') if __name__ == '__main__': app.run(host="0.0.0.0", port="8080")

  • python
  • rest-api
  • flask
댓글 1 좋아요 0 조회수 182

작업형1 모의문제1 문제6

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 소수점 나이를 제거하라고 되어 있는데 이 부분을 소수점(실수형)->정수형으로 변환하도록 df1['age'] = df1['age'].astype(int) 라고 쓰면 틀린 답안이 될까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김진주 댓글 2 좋아요 0 조회수 126

docker compose 다운로드 관련 질문

미해결

실습으로 손에 잡히는 SQLD(2과목)

제가 docker-compose.yml 파일을 /Users/kimsujeong/Documents/docker-compose.yml 여기다 넣어놨는데 docker compose up -d 가 다운이 안됩니다. 영상을 보고 잘 이해가 안되어서 문의드립니다.

  • sql
  • oracle
  • mssql
  • SQLD
biroo21 댓글 2 좋아요 0 조회수 142

DBeaver에서 오라클 접속시 오류 해결 방법 문의합니다.

미해결

실습으로 손에 잡히는 SQLD(2과목)

DBeaver에서 오라클 실행 시 해당 안내문구가 계속 뜹니다. DBeaver 끝고 다시 켤때마다 알림창이 뜨는데 해결 할 수 있는 방법이 있을까요?! 답변 부탁드립니다. 감사합니다.

  • sql
  • oracle
  • mssql
  • SQLD
잭과콩나물 댓글 2 좋아요 0 조회수 1266

predict_proba에서 기초적인 것이 늘 헷갈립니다 ㅠㅠ

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

roc_auc_score 평가지표에서만 predict_proba[:,1]을 통하여 예측하는 것이라고 알고 있는데 뒤에 1과 0을 넣는 것이 늘 헷갈려서 개념이 잘 정립되질 않습니다. 양성일 확률이 주로 1, (ex. 심장마비에 걸릴 확률이 높은 사람은?) 첫번째 클래스가 1... 근데 이번 문제 같은 경우는 정시에 도착할 경우가 0으로 배정 됐으니 predict_proba[:,0]으로 하는게 아닌지 자꾸 헷갈립니다...

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
ehddls91 댓글 2 좋아요 0 조회수 314

강의연장 질의

해결됨

SW 개발자를 위한 성능 좋은 SQL 쿼리 작성법

안녕하세요. 강사님, 최근 업무가 많이 바빠 교육을 잊고 지냈는데 금일 들어와 보니 다음주면 강의가 종료 되더라구요. 아직 들어야 할 강의가 많은데 한 달 연장 가능 할까요 ? 그럼 답변 부탁 드립니다. 감사합니다.

  • sql
  • dbms/rdbms
원이주니 댓글 2 좋아요 0 조회수 144

문제 3번

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

문제 3번을 다음과 같은 코드로 풀었는데 오류가 발생합니다. # your code import pandas as pd import numpy as np df = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/main/p1/members.csv") df = df.dropna(subset='views') df = df['f3'].replace({np.nan:0,'silver':1,'gold':2,'vip':3}) print(df['f3'].sum()) 마지막 print 에서 KeyError : 'f3' 오류가 발생했는데 무엇이 문제인가요..?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김혁수 댓글 2 좋아요 0 조회수 98

파이참 임포트 문제

해결됨

실전! FastAPI 입문

안녕하세요. fastapi를 사용해서 서버를 개발하고있는데, 한가지 불편한것이 있어서 여쭤보려고 합니다. 다름이 아니라 외부에 작성해놓은 함수를 import 할 때 생기는 문제인데요. project | - src | - | - api | - | - extension | - | - exception | - | - main.py 이렇게 프로젝트 트리가 구성되어 있다고 했을때, project 경로에서 uvicorn src.main:app 으로 서버를 실행하면 ModuleNotFoundError: No module named 'extension' 이런 에러가 발생합니다. 이게 import 를 할 때 src.from extension.~ import ~ 이렇게 되어있지 않고 import 할 때, 자동으로 from extension.~ import ~ 이렇게 import가 되어서 모듈을 찾지 못해 발생하는 에러인 것 같은데요. 혹시 자동으로 임포트 할 때부터 src.from extension.~ import ~ 이렇게 소스루트부터 import 하게 하는 설정이 따로 있을까요? 하나하나 적어주기가 너무 불편해서 여쭤봅니다 ㅠ

  • python
  • 리팩토링
  • orm
  • FastAPI
  • pytest
뱅준 댓글 1 좋아요 0 조회수 294

인기 태그

인프런 TOP Writers

주간 인기글