inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

묻고 답해요

172만명의 커뮤니티!! 함께 토론해봐요.

[14강 도로명 주소db 구축(2)]관련

미해결

공공데이터 CSV 파일을 이용해 테이블 만들기

안녕하세요. 평소에 궁금했던 분야였고 업무에 활용하고 싶었는데 아무래도 sql 초급수준이다 보니 어떻게 접근을 해야 할지 몰랐는데 본 강좌가 무척 도움이 되었습니다. 이에 감사드리며 다소 기초적일 수 있는 질문 두가지를 드립니다. 아무리 생각해도 제 수준에서는 알 수가 없어서요. ㅡㅡ; 도로명주소db 활용방법 중 도로명코드의 update 쿼리문 중, rownum=1 을 사용하는 이유는 뭔가요? 어차피 where 조건으로 B.도로명코드=A.도로명 코드 AND B.읍면동일련번호 = A.읍면동일련번호 로 하면 한행만 나오지 않나요?? 간단히 쿼리문으로 조회를 해봤는데요. 조건상 1개의 행만 나와야 할 거 같은데 두개가 나오는 이유를 모르겠습니다. ( 23.10월 주소db 전체분 을 반영하였습니다.)

  • sql
  • mariadb
  • heidisql
류재안 댓글 2 좋아요 1 조회수 464

작업형1 모의문제3 7번문제

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 df = df.T df.head() mean_2001 = df[2001].mean() mean_2003 = df[2003].mean() a = sum(df[2001] > mean_2001) b = sum(df[2003] < mean_2003) print(a+b) 이렇게 작성하면 결과가 다르게 나오는데,, 어디서 잘못된 것일까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
댓글 1 좋아요 0 조회수 354

ntile 정규분포에 관하여 ... 향후 일을 하게 될 시

해결됨

다양한 사례로 익히는 SQL 데이터 분석

강의를 듣는 도중, ntile()의 경우, 분포가 skew가 심하면(정규분포가 아니라면), 순위를 매길 때, 문제가 생김을 배울 수 있었습니다. Q1. 저는 왜곡이 되어있는 걸 보자마자, 차라리 판다스나 Spark SQL로 데이터를 정규화 한뒤에, 시각화를 하는게 더 빠르지 않을까? 하는 생각이 들었는데요, 기업에서 일을 하게 될 때, 어떤 경우에 SQL을 쓰는지가 궁금합니다. 저는 강사님의 강의를 수강하며, python 데이터 분석 -> 머신러닝 -> 딥러닝 이후, 현재 SQL강의를 수강하고 있습니다. 희망직무는 데이터 사이언스트 및 데이터 엔지니어를 희망하는데, 항상 채용공고를 보면, python 능력도 중요하지만 고급 SQL 능력도 자격요건으로 되어 있는 경우가 많았습니다. Q2. 현업에서 데이터를 가공하거나 처리할 때, 오히려 프로그래밍언어보다는 SQL를 훨씬 많이 쓴다고 하는데, Q1처럼 때에 따라 유동적으로 쓰는 것인지, 아니면 앞으로 데이터 분석을 연습할 때도, (이를 테면, 캐글과 같은) 파이썬 보다는 SQL위주로 연습하는 것이 더 적합한 건지 여쭙고 싶습니다. Q3. 이건 머신러닝과 관련된 이야기지만, 이렇게까지 skew가 개선되지 않을 때는 어떻게 해야하나요? from sklearn.preprocessing import StandardScaler # OverSampling을 해도 Skew가 개선되지 않음 # UnderSampling을 하면 데이터가 줄어들기 때문에, 사용에 유의가 필요하나 skew가 # 너무 심하기 때문에 사용함. from imblearn.under_sampling import CondensedNearestNeighbour from scipy import stats import numpy as np def log_transform(column): return np.log1p(column) scaler = StandardScaler() df["freq"] = log_transform(df["freq"]) df["freq"] = scaler.fit_transform(df[["freq"]]) cnn = CondensedNearestNeighbour(sampling_strategy='majority', random_state=42) X_resampled, y_resampled = cnn.fit_resample(df[["freq"]], df["user_id"].values) resampled_df = pd.DataFrame(data=X_resampled, columns=["freq"]) print(resampled_df) ####### freq 0 -0.352373 1 -0.352373 2 -0.352373 3 -0.352373 4 2.495698 ... ... 2557 -0.352373 2558 3.642937 2559 -0.352373 2560 -0.352373 2561 -0.352373 [2562 rows x 1 columns] ######### resampled_df["freq"] = log_transform(resampled_df["freq"]) resampled_df["freq"].skew() ### 2.4721717038971214

  • sql
  • postgresql
  • dbms/rdbms
  • 퍼포먼스-마케팅
  • 데이터-엔지니어링
minsubrother 댓글 1 좋아요 0 조회수 380

웹드라이버 오류

미해결

실습으로 끝장내는 웹 크롤링과 웹 페이지 자동화 & 실전 활용

driver = webdriver.Chrome () 여기서 계속 오류가 나는데요. 혹시 최근에 바뀐게 있나요? 강의 내용 외 개인적인 실습 사이트의 질문은 답변이 제공되지 않습니다. 문제가 생긴 코드, 에러 메세지 등을 꼭 같이 올려주셔야 빠른 답변이 가능합니다. 코드를 이미지로 올려주시면 실행이 불가능하기 때문에 답변이 어렵습니다. 답변은 바로 제공되지 않을 수 있습니다. 실력 향상을 위해서는 직접 고민하고 검색해가며 해결하는 게 가장 좋습니다.

  • python
  • 웹-크롤링
  • selenium
  • beautifulsoup
니키부 댓글 3 좋아요 0 조회수 1973

설정에서 AutoIncrement를 바꿔도 수정이 되지 않습니다.

해결됨

비전공자의 전공자 따라잡기 - 데이터베이스,SQL

Row를 지운 후 auto_increment를 설정에서 1로 변경하도록 시도했습니다. 아래 사진처럼 적용 완료되었다는 말만 나오고 도로 카운트가 원상복귀 됩니다.

  • sql
  • mysql
  • dbms/rdbms
  • mysql-workbench
fable1 댓글 2 좋아요 0 조회수 1275

'' 따옴표 쓰임 관련 질문이요!

미해결

[백문이불여일타] 데이터 분석을 위한 중급 SQL

- 학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! - 먼저 유사한 질문이 있었는지 검색해보세요. - 서로 예의를 지키며 존중하는 문화를 만들어가요. - 잠깐! 인프런 서비스 운영 관련 문의는 1:1 문의하기를 이용해주세요. ''따옴표는 보통 문자 기재시, 사용하는 것으로 알고있는데 엘리아스 뒤에도 ''따옴표인가요? 어떤 책에서는 "" 쌍따옴표를 쓰고, _ 이런 특수문자사용시에 도 ""를 쓰라고해서 정확한 사용법을 알려주세요ㅜ

  • sql
404 댓글 1 좋아요 0 조회수 288

윌콕슨 검정 질문입니다!

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 무게에서 - 120을 뺀 이유가 무엇인가요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
화이팅 댓글 1 좋아요 0 조회수 320

데이터 엔지니어 되고싶은데

미해결

[리뉴얼] 처음하는 SQL과 데이터베이스(MySQL) 부트캠프 [입문부터 활용까지]

백엔드 엔지니어가 먼저 되어야 할까요? 스프링을 배워야 할까요? 데이터 엔지니어가 백엔드부터 배워야 하는 이유ㅣ4년차 현직자의 솔직한 조언 - YouTube 개발자 진로는 농업 데이터 엔지니어가 되고싶습니다 팜모닝 데이터 분석가 | 그린랩스 (greenlabs.co.kr)

  • python
  • sql
  • mysql
  • dbms/rdbms
  • 데이터-엔지니어링
조현성 댓글 1 좋아요 0 조회수 1303

한단계 더 이해하는 EDA와 데이터 타입에 따른 시각화 기법5

미해결

[리뉴얼] 처음하는 파이썬 데이터 분석 (쉽게! 전처리, pandas, 시각화 전과정 익히기) [데이터분석/과학 Part1]

위 코드를 실행하니 'could not convert string to float: 'Abbeville' 라는 에러가 전시됩니다. Abbeville를 float으로 바꿀 수가 있나요?

  • python
  • pandas
이희동 댓글 1 좋아요 0 조회수 310

강의 일시정지/ 기간연장 검토 요청

미해결

[백문이불여일타] 데이터 분석을 위한 중급 SQL 문제풀이

안녕하세요! SQL 입문 - 중급까지 강의 잘 듣고 있습니다. 감사합니다. 다름 아니라, 수강 중인 백문이불여일타 중급/고급 SQL 문제풀이, 고급 SQL 강의 일시정지나 기간 연장이 가능할지 검토를 부탁드리려고 합니다. 이 강의를 계기로 SQLD 자격증을 준비하게 되었습니다. 그런데 생각보다 이론 쪽 공부할 내용이 많아, 잠시 인프런 강의를 듣기 힘든 상황이 되어서요. 시험이 11.18이라, 기간이 촉박하다보니... 부득이 요청드리게 되었어요. 시험 응시 이후에도 강의를 듣고 싶어 요청드리니, 긍정적으로 검토 부탁드립니다. 감사합니다.

  • sql
heyokies 댓글 1 좋아요 0 조회수 390

3정규화 퀴즈에 관해 질문 드립니다.

해결됨

비전공자의 전공자 따라잡기 - 데이터베이스,SQL

제 3정규화 문제 풀이에서 서비스를 기본 키로 사용해야 한다고 설명해 주셨는데 이런 식으로 기본 키를 추가해서 사용해주는 건 안되는 걸까요?

  • sql
  • mysql
  • dbms/rdbms
  • mysql-workbench
fable1 댓글 1 좋아요 0 조회수 288

중간 테이블 관련해서 질문드립니다

미해결

비전공자의 전공자 따라잡기 - 데이터베이스,SQL

강의에서 보여주신 ERD에서는 중간 테이블들이 fk만 가지고 pk는 없다고 나오는데 원래 중간 테이블을 만들 때는 pk 없이 fk들만 사용하는 건가요?

  • sql
  • mysql
  • dbms/rdbms
  • mysql-workbench
fable1 댓글 1 좋아요 0 조회수 342

[14강]도로명주소 DB구축(1) 관련

미해결

공공데이터 CSV 파일을 이용해 테이블 만들기

안녕하세요. 이해가 잘 안가는 게 하나 있어서 질문드립니다. DB 포맷을 보면 부가정보와 지번 정보가 월변동분 포맷에 변경사유코드 필드가 없고 일변동분에만 변경사유코드가 있는데요. 이런 구조면 전체분대비 뭐가 바뀌었는 지를 모를텐데... 혹시, 지번정보, 부가정보의 경우는 월변동분 파일을 무시하고 일변동분을 누적해서 사용하라는 의미인걸까요?? 지번_변동분.TXT 에서 몇개 관리번호로 전체분의 번지_ㅇㅇ.TXT와 비교시 행전체가 동일해서 변경분이라고 생각이 안되서요.

  • sql
  • mariadb
  • heidisql
류재안 댓글 2 좋아요 1 조회수 555

[13강.zip_code_DB]변경분 처리sql관련

미해결

공공데이터 CSV 파일을 이용해 테이블 만들기

안녕하세요. 세세한 설명 감사드립니다. sql 초급이라 자세한 설명에 맞추어 잘 따라가고 있었는데요. 13강의 변경분처리 sql 에대해 loop 처리관련하여서는 전체 코드를 좀 공유해주시면 안될까요? 개념적으로는 알곘는데 아직 loop 문과 변수에 대해서 적용하는 것에는 익숙하지가 않아서 어떻게 해야 할 지를 모르겠습니다. ㅡㅡ;

  • sql
  • mariadb
  • heidisql
류재안 댓글 1 좋아요 0 조회수 274

jupiter노트북 말고 명령어 실행 할 수 있나요?

미해결

[리뉴얼] 처음하는 SQL과 데이터베이스(MySQL) 부트캠프 [입문부터 활용까지]

이걸 주피터 노트북에서 했던거처럼 python에서 실행하는건가요?

  • python
  • sql
  • mysql
  • dbms/rdbms
  • 데이터-엔지니어링
조현성 댓글 1 좋아요 0 조회수 412

join 결과 테이블 집합 레벨

미해결

데이터 분석 SQL Fundamentals

안녕하세요 [ Group by 실습 01 ] 강의를 듣다가 실습 문제에서 결과 값이 이해가 되지 않아 질문드립니다. -- 부서명 SALES와 RESEARCH 소속 직원별로 과거부터 현재까지 모든 급여를 취합한 평균 급여(with 절로 풀기) 수업 듣기 전, 위의 문제에서 with 절 안의 테이블을 만들려고 아래와 같이 적었습니다. (같은 테이블 결과값이 나오는지 확인만 하려고 select 뒤에 구체적인 컬럼을 적지 않고 * 를 적었습니다.) [수업 전 작성 답안 & 결과 테이블] select * from hr . emp a join hr . dept b on a . deptno = b . deptno join hr . emp_salary_hist c on a . empno = c . empno where b . dname in ( 'SAELS' , 'RESEARCH' ) ; --> dname 에 research 만 나타납니다. [강의 예시 답안] select * from hr . dept a join hr . emp b on a . deptno = b . deptno join hr . emp_salary_hist c on b . empno = c . empno where a . dname in ( 'SALES' , 'RESEARCH' ) ; --> 나와야 하는 결과값 잘 나옴. 위의 제가 적은 답안에서 어떤점이 잘못 되었는지 도무지 보이지않아서 질문드립니다. join 만 적을시 inner join 이 적용되므로, 집합 레벨은 모든 테이블의 join 될 수 있는 모든 컬럼값 끼리 붙을 텐데, 그러면 어떤 테이블을 먼저 적던지 순서에 상관 없이 같은 결과 값이 나와야 하는 것 아닌가요? inner join 할 시에 염두해 두어야 하는 순서나 유의점이 있을까요? 답변 부탁드립니다. 감사합니다.

  • sql
  • postgresql
  • dbms/rdbms
J20 댓글 1 좋아요 0 조회수 307

피처별 회귀계수 시각화

미해결

[개정판] 파이썬 머신러닝 완벽 가이드

강의 회귀 실습 1: 자전거 대여(공유) 수요 예측 -02에서 19분 52초 경에 나오는 선형 회귀의 피처별 회귀계수 시각화 부분에서 저 회귀계수 값들이 다르게 나올 수가 있는지, 질문드립니다. github의 주피터노트북 코드 다운로드 받아서 그대로 시행했는데 LinearRegression/Lasso/Ridge 각 회귀에 대한 RMSLE, RMSE, MAE까지는 값이 정확히 동일하게 나오는데 회귀 계수의 값을 보려고 lr_reg.coef_ 부분에서 결과가 다르게 나옵니다. 상식적으로 회귀 모형에서 이런 결과가 나올 수가 없다고 생각되는데 무슨 이유인지 모르겠어서 질문드립니다! 감사합니다

  • python
  • 머신러닝
  • 통계
aloeeola 댓글 3 좋아요 0 조회수 452

Null 값을 평균으로 채우는 방법

미해결

[개정판] 파이썬 머신러닝 완벽 가이드

안녕하세요, 선생님. 강의 15분 경에 다음과 같은 코드가 나옵니다만, 저는 분명 동일한 코드를 실행했는데 오류가 떠서 질문드립니다. house_df.fillna(house_df.mean(),inplace = True) TypeError: can only concatenate str (not "int") to str 이 코드가 Null있는 문자형 열까지 포함시켜 처리하기 때문에 오류가 나는 거 같은데, 혹시 원래 정상적으로 실행되는 코드인가요…? 책에 있는 코드도 동일한데 제가 실행시키면 에러가 나서 전 Null 있는 숫자혀여 열에 대해서만 각 열의 평균값으로 결측치를 채워서 실행했습니다. 만약 현재 버젼으로 정상적으로 실행이 되지 않는 코드라면 선생님께서 혹시 이 부분에 대해서만 새로 작성하신 코드를 여쭙고 싶습니다! 방금 확인해보니까 jupyter notebook으로는 잘 실행되는데, vscode에서는 위와 같은 오류가 뜹니다. 혹시 이 오류가 뜨는 이유를 알 수 있을까요?

  • python
  • 머신러닝
  • 통계
맹고 댓글 1 좋아요 0 조회수 589

SAKILA 폴더에서 가져온 SCHEMA와 DATA가 정확히 뭘까요

미해결

[리뉴얼] 처음하는 SQL과 데이터베이스(MySQL) 부트캠프 [입문부터 활용까지]

SCHEMA는 관계 정보고 (DESC명령어로 보는) DATA는 관계에 들어가는 데이터(SELECT 명령어로 보는) 인가요? DB정보를 넘길때는 보통 이 두개 파일을 넘기게 되나요?

  • python
  • sql
  • mysql
  • dbms/rdbms
  • 데이터-엔지니어링
조현성 댓글 1 좋아요 0 조회수 296

502 bad gateway

미해결

파이썬/장고 웹서비스 개발 완벽 가이드 with 리액트

강사님 안녕하세요 강사님 강의 덕분에 저 혼자서 페이지도 만들고 nginx 사용해서 서버까지 배포해보았습니다. 다름이 아니라 3일전 까지만 해도 느리긴 했지만 잘 되던 서버가 오늘 서버내의 기능을 사용할려고 하니 502 bad gateway를 내 뱉으면서 멈춰버립니다.(되다가 안되다가 반복함) 그래서 error 로그를 찾아보니 2023/11/01 00:20:22 [error] 10930#10930: *232 upstream prematurely closed connection while reading response header from upstream 라고 뜨네요 3일동안 해봤는데 헛발짓만 했네용.. gpt한테 물어봐도 메모리 리소스, 네트워크 문제 , 응답시간 문제 등 이라곤 하는데 메모리랑 네트워크에는 아무런 문제가 없는거 같습니다. 3일전까지만 해도 잘되던 서버가 안되니까 많이 답답하네요..

  • react
  • python
  • django
  • docker
병주 댓글 4 좋아요 0 조회수 718

인기 태그

인프런 TOP Writers

주간 인기글