12강 집계 함수 8번 연습문제 질문
미해결
초보자를 위한 BigQuery(SQL) 입문
안녕하세요, 12강 8번 연습문제의 '전체 포켓몬 수'를 구하는 쿼리를 작성하라는 문제에서요. 보여주신 내용은 포켓몬 종류의 수이지만, 만약 pokemon의 total 컬럼의 합을 구한다고 가정한다면 어떤 쿼리문이 나와야 하는 것일까요?
- sql
- bigquery
- 데이터-리터러시
172만명의 커뮤니티!! 함께 토론해봐요.
미해결
초보자를 위한 BigQuery(SQL) 입문
안녕하세요, 12강 8번 연습문제의 '전체 포켓몬 수'를 구하는 쿼리를 작성하라는 문제에서요. 보여주신 내용은 포켓몬 종류의 수이지만, 만약 pokemon의 total 컬럼의 합을 구한다고 가정한다면 어떤 쿼리문이 나와야 하는 것일까요?
미해결
김영한의 실전 데이터베이스 - 성능 최적화, 실행 계획과 인덱스 완전 정복
안녕하세요~ 강의 수강중 통계정보 갱신에 대해 여쭤보고싶은게 있습니다. 운영중에 간혹가다 옵티마이저가 실행계획을 잘못 선택해서 쿼리를 실행해서 슬로우 쿼리가 발생되는 경우가 종종있었습니다. 이때 use index 를 사용해서 주로 해결했었는데 이번 강의에서는 문제가 되는 테이블의 통계정보를 갱신하면 이런 문제들이 해결된다고 하시던데 운영중인 db 에 통계정보 갱신을 했을때 트레이드 오프같은게 없을까요? 실무에서 보통 어떻게 하셨는지 궁금하네요.
미해결
김영한의 실전 데이터베이스 - 성능 최적화, 실행 계획과 인덱스 완전 정복
안녕하세요! PK 설계와 관련하여 궁금한 점이 있어 질문드립니다. 강의에서는 AUTO_INCREMENT 를 사용하면 PK가 순차적으로 증가하기 때문에 랜덤한 위치에 데이터가 삽입되는 것을 줄이고, 페이지 분할을 최소화할 수 있어 사용을 권장한다고 이해했습니다. 그런데 한편으로는 MSA 환경에서 PK로 UUID를 많이 사용한다는 이야기를 들었습니다. UUID를 사용하면 각 서비스에서 ID를 독립적으로 생성할 수 있다는 장점이 있다고 하는데, 서비스별로 데이터베이스와 테이블이 분리되어 있다면 각 테이블의 PK는 해당 테이블 내에서만 유일하면 되기 때문에 AUTO_INCREMENT 를 사용해도 문제가 없지 않을까 생각했습니다. 그래서 다음 내용이 궁금합니다. 실제 MSA 환경에서는 일반적으로 PK로 UUID를 많이 사용하는지 UUID 사용으로 인한 인덱스 크기 증가와 페이지 분할 등의 단점보다 UUID의 장점이 더 커지는 판단 기준은 무엇인지 찾아보니까 시간 순서 특성이 있는 UUID v7 라는 것도 있는데 이를 사용하는 건지 이런 궁금증이 생기는데 시원하게 해결이 되지 않아서 질문으로 남깁니다. 항상 좋은 강의 올려주셔서 감사합니다. 다음 강의에 해당 내용에 대한 설명이 다 있는 것을 확인하였습니다. 감사합니다!
미해결
김영한의 실전 데이터베이스 - 성능 최적화, 실행 계획과 인덱스 완전 정복
커버링 인덱스가 아니라고 가정한다면 클러스터링 인덱스까지 2번의 B+Tree 탐색을 하지만 커버링 인덱스라면 이런 탐색을 한번 줄여 발생하는 IO 작업을 최적화 하는것으로 이해 했습니다 커버링 인덱스 말고도, 자주 사용되는 페이지의 위치를 자동으로 InnoDB에서 어댑티브 해시 인덱스라는 공간에 저장 하는것으로 알고 있는데 이 방식도 IO 작업을 최적화 하는 것인지 궁금 합니다
미해결
초보자를 위한 BigQuery(SQL) 입문
데이터 검증 강의에 대한 내용은 감명깊게 수강하였고, 강의의 쿼리 외적으로 질문이 있습니다ㅎㅎ 저는 이 강의의 문제만 보고 빅쿼리에서 스스로 문제 풀기를 3일간 도전하였는데, 결국 풀지 못한 채 강의를 보게 되었습니다! 제 사고 과정은 다음과 같습니다. 1. 총 배틀 횟수 계산이 난해하다. 2. '각 트레이너'의 정보를 얻으려면 battle 테이블과 trainer 테이블을 조인하여 t.trainer_id = b.player_id를 확인해야 할 것으로 예상된다. 3. trainer 테이블을 기준으로 battle 테이블을 LEFT JOIN 한다. 그런데 강의 03:57 ~ 04:03 부분을 확인해보니, player_id를 기준으로 trainer_id를 매핑시키는 방식의 쿼리를 작성하셨더라고요! Q. 제가 최초에 trainer_id 컬럼을 기준 삼았다고 가정할 때, trainer_id = player_id 이 불편함을 깨닫고 player_id = trainer_id 으로 관점을 바꾸면 좋겠다고 생각할 근거가 있다면 무엇일지 궁금합니다..! 나름 최선의 표현으로 글을 다듬었지만, 이 질문이 난해할 수 있다고 생각하고요..! 원하는 답을 얻지 못할 확률이 높다고 생각하면서도 혹시나 하여 질문드립니다. 감사합니다!
해결됨
[백문이불여일타] 데이터 분석을 위한 기초 SQL
링크 걸어두신대로 SQL 입문자를 위한 차트시트 신청을 했는데 메일이 안오네요. 파일 받을 수 있는 방법이 있을까요?
미해결
김영한의 실전 데이터베이스 - 성능 최적화, 실행 계획과 인덱스 완전 정복
컬럼의 크기가 평균 1MB 정도 된다고 했을 때DB 버퍼 풀에 전부 올라오고 나서 서비스 서버로 올라가게 되는지 궁금 합니다 ! 서비스 서버 단에서 스트림으로 처리 한다고 해서 DB 메모리 공간도 같이 효율적으로 사용 되는지도 궁금 합니다 !
미해결
BigQuery(SQL) 활용편(퍼널 분석, 리텐션 분석)
퍼널 분석을 통한 Foodie Express의 비즈니스 인사이트를 도출하는 레포트를 작성하였습니다. 아래의 노션 링크 첨부하여 드립니다. 감사합니다. https://app.notion.com/p/6-1-3a96c0de4db680fda4d5f30c3ecc0b43?source=copy_link
미해결
김영한의 실전 데이터베이스 - 성능 최적화, 실행 계획과 인덱스 완전 정복
member와 product 데이터는 각각 4분, 5분 걸렸는데 orders는 2시간이 지나도 계속 돌고 있네요. 갤럭시북2 사용중인데 다른분들도 오래 걸릴까요??
미해결
김영한의 실전 데이터베이스 - 성능 최적화, 실행 계획과 인덱스 완전 정복
쿼리 파서 기능에서 구분 분석을 통해 토큰 형식으로 분리하고, 어휘 분석을 통해서 문법 검증 및 파스 트리를 만든다고 알고 있었는데 구문 분석 부분에서 한번에 일어나는 작업인지 궁금 합니다
미해결
김영한의 실전 데이터베이스 - 설계 2편, 실무에서 반드시 마주치는 9가지 설계 패턴
안녕하세요 영한님 마스터패스 구매하고 모든 강의를 재밌게 수강하고 있는 백엔드 개발자 취업준비생입니다. 강의를 듣다가 궁금한 점이 생겨 질문남깁니다! 답변해주시면 너무 감사하겠습니다. is_deleted 와 같은 컬럼을 사용하는 soft delete 방식은 실제 삭제 시점을 알 수 없기 때문에 주로 사용하진 않고, deleted_at을 컬럼으로 두고 삭제 여부/시점을 모두 판별할 수 있게 한다고 하셨는데, 그렇다면 뒤에 설명해주신 상태 기반 관리를 통해서 ProductStatus나 OrderStatus를 관리할 경우, deleted_at이나 다른 시점을 컬럼으로 두면 나쁜 설계라고 하셨습니다. 그렇다면 결국 ProductStatus와 같은 상태를 가진 것들은 삭제 시점이나 특정 시점을 알 수 없는건 마찬가지 아닌가요? 만약 삭제 시점이나 회원의 탈퇴 시점같은 것들을 관리해야 한다면 어떻게 해야할까요? 이러한 해결 방법으로써 이력 테이블 등의 방법이 있을 것 같은데 취준생의 개인 프로젝트로 사용하기에 규모가 너무 커지지 않을까 걱정됩니다. 실제 사례를 예시로 들어보자면 UserStatus 상태값입니다. 이를 테이블의 한 컬럼으로 두고 내부에는 ACTIVE(정상), SUSPENDED(임시정지), BANNED(영구정지), WITHDRAWN(탈퇴) 등의 여러 상태를 가집니다. 이때 만약 withdrawn_at 컬럼이 존재하지 않고 상태값만으로 관리하면 탈퇴 시점이 언제인지 등을 확인할 수 없게 됩니다. 이 경우에는 withdrawn_at 컬럼을 상태값과 함께 두는 것보다 이력 테이블을 사용하는게 더 나은 설계이자, 개인 소규모 프로젝트에서도 해당되는 사항인지 궁금합니다. 작은 조언이라도 해주시면 감사하겠습니다! -- 에이전트 인프런 에이전트에 같은 내용으로 질문을 남겨봤는데 withdrawn_at 컬럼을 상태 컬럼과 함께 사용하는 것이 효율적이고 합리적인 설계라고 합니다. 실제로 이력 테이블은 개인 프로젝트 규모정도에서는 사용하기에 관리 복잡도가 증가할 가능성이 있다고 합니다. 이에 대해 어떻게 생각하시는지도 궁금합니다.
미해결
김영한의 실전 데이터베이스 - 성능 최적화, 실행 계획과 인덱스 완전 정복
안녕하세요 영한님! 강의 재밌게 잘 듣고있습니다. 아직 섹션3까지 들었는데 MySQL 아키텍처 설명을 너무 잘해주셔서 너무 재밌게 들었습니다! 개인적으로 실무에서 PostgreSQL을 사용하고 있는데 혹시 PostgreSQL 아키텍처 강의도 업데이트 예정이 있으신지 궁금합니다!
미해결
실습으로 손에 잡히는 SQLD(2과목)
실행결과가 Failed to fetch라고 뜹니다.
미해결
김영한의 실전 데이터베이스 - 기본편
[질문 템플릿] 1. 강의 내용과 관련된 질문인가요? (예/아니오) 예 2. 인프런의 질문 게시판과 자주 하는 질문에 없는 내용인가요? (예/아니오) 예 3. 질문 잘하기 메뉴얼을 읽어보셨나요? (예/아니오) 예 [질문 내용] 오류인 부분이라 신고합니다. 76강 2분 33초 부분에서 transaction 설명을 위해 계좌에서 이체되는 부분 말씀 하실 때 A고객이 1만원 이체하여 잔금이 줄어 4만원인 부분을 작성하시고 연이어 B고객 부분을 말씀하실 때 이체를 받았으니 1만원이 되어야 한다고 하며 10000원으로 적으셨습니다. 하지만 내용 상 30000원이 되어야 하는 부분으로 보입니다.
미해결
BigQuery(SQL) 활용편(퍼널 분석, 리텐션 분석)
안녕하세요. 리텐션 과제 제출합니다. 실무 기반의 문제라 그런지 역시 난이도가 있네요. 고민을 많이 해보게 되었습니다. 리텐션 유저 기준은 게임 업계 기준으로 정의하고 문제를 풀었습니다. (플랫폼에 따라서 기준도 다르고 하지만) 보시고 피드백 있으시면 말씀을 부탁드리겠습니다. https://app.notion.com/p/2b00de0d9a16809f94f5e378ee375b2f?source=copy_link
미해결
BigQuery(SQL) 활용편(퍼널 분석, 리텐션 분석)
해당 리텐션 연습과제를 아래의 노션 링크에 담아 제출합니다. 2번과 3번과제는 너무 어려워서 AI의 도움을 받아 수행하였습니다. 많이 고민하는 계기가 되었고, 덕분에 노션도 처음 사용해보았습니다. 부족한 점은 없는지 피드백 주시면 감사하겠습니다. https://app.notion.com/p/3-13-3986c0de4db68063b1b9efa55c1d4b4f?source=copy_link
미해결
김영한의 실전 데이터베이스 - 설계 1편, 현대적 데이터 모델링 완전 정복
member 테이블에서 회원의 가입일은 비즈니스 시간이라고 생각했는데, 이 컬럼은 왜 created_at 으로 시스템의 시간만을 의미하도록 되어 있는지 궁금합니다. ordered_at, paid_at 과 같이 가입일 컬럼이 따로 존재해야 하는게 아닌지 궁금합니다! 강의자료에 예시로 적어주신 것처럼 비즈니스 시간이 데이터베이스 수준에서 마이그레이션을 해야한다면 회원가입일을 보존할 수 없지 않을까요?
미해결
김영한의 실전 데이터베이스 - 기본편
[질문 템플릿] 1. 강의 내용과 관련된 질문인가요? (예) 2. 인프런의 질문 게시판과 자주 하는 질문에 없는 내용인가요? (예) 3. 질문 잘하기 메뉴얼을 읽어보셨나요? (예) [질문 내용] CASE문 단원 중 위의 '전체 GROUP BY'에서 '전체'라는 말이 오타인것 같아요~ CASE문 단원의 연습문제 4번 제시문 중 사용자 이름, 총 주문 건수, ` '전자기기' 주문 건수, '도서' 주문 건수를 각각 ~ 에서 '패션' 주문 건수라는 말이 누락되어 있는 것 같습니다. 영한님 강의 너무 잘듣고 있습니다!! 완강까지 힘내보겠습니다. 양질의 강의 진심으로 감사드립니다.
해결됨
61회차(26.5.31) 쉽다 못해 싱겁다는 평가의 최신 기출 확인하세요! - 과목별·장별 전 문항 [SQLD 기출이 답이다!]
@이정미 18번 문제, 보기2번 설명주실 때, CTAS는 물리적으로 테이블을 복사한것이기 때문에, 원본 테이블을 삭제해도 C_TAB 테이블은 남아있어서 조회가 가능하다고 말씀하셨어요. 그러므로 2번 보기도 틀린 보기인데요. 문제 역시 적절하지 않은 것을 물어보았으니, 2번 4번 두개 보기 모두 답이 되어야 하는게 아닌지요?
해결됨
BigQuery(SQL) 활용편(퍼널 분석, 리텐션 분석)
안녕하세요 강사님! 최종 과제 피드백 요청 드립니다🙇♀️ 로그 데이터 분석이 처음이라 데이터 해석부터 분석 스킬까지 부족한 점이 많습니다! 하지만, 강사님께서 처음부터 이해하기 쉽게 알려주신 덕분에 많이 배울 수 있었습니다. 저는 현재 CRM 마케터를 희망하고 있어, CRM 개선 전략을 목표로 분석을 진행해보았습니다. 바쁘시겠지만 피드백 주시면 앞으로의 역량 강화에 큰 도움이 될 것 같습니다 :) 감사합니다~! 과제 링크