안녕 하세요.. 이런 질문을 드려도 될까 모르겠습니다만.. 현재 운영 되는 사이트는 ms-sql 로 bak 파일 기준 약 50기가 정도 됩니다. 사이트를 개편 하려고 하고 있는데요..mysql 로 바꾸는 것을 논의 중 입니다. 처음 부터 데이터가 50기가 가 입력 되는 것은 아니고..운영 하면서 데이터가 늘어날텐데.. 경험 상 50기가 정도 될 것으로 예상 됩니다. 특정 테이블은 몇천만건의 데이터가 입력 될 수도 있는데요.. mysql 이나 mariadb 로 이 정도의 데이터베이스를 운영 할 수 있을지.. 사이트 속도 에는 큰 문제가 없을지.. 조언 부탁 드립니다. 감사 합니다.
[리뉴얼] 처음하는 파이썬 데이터 분석 (쉽게! 전처리, pandas, 시각화 전과정 익히기) [데이터분석/과학 Part1]
안녕하세요 강의를 잘 듣고 있는데 pandas groupby질문이 있어서 문의드립니다. 강의 내용에서는 groupby을 할 경우 이후에 sum이나 mean이 올 경우 숫자 데이터는 sum이나 mean이 수행이 되고 텍스트 데이터는 사라진다고 강의에 말씀하였는데 저같은 경우는 sum의 경우 텍스트가 단순히 합쳐지고 mean같은 경우는 아래 캡쳐 화면과 같이 에러가 발생합니다. 하지만 아래 캡쳐 화면과 같이 sum이나 mean할 항목을 명시해 주면 원하는 수행을 하게 되는데요 이럴 경우에는 앞으로는 mean이나 sum을 할 항목을 명시해주면 될까요??(파이썬 버전은 jupyter를 설치해서 3.12.4 입니다)
안녕하세요. 이제 2회차로 다시 잘 보고 있는 수강생입니다 🙂 Ep15를 보던 중 복합 인덱스의 컬럼들 중 선행컬럼을 조건에서 누락할 경우 풀 스캔이 될 수 있다고해서 직접 쿼리를 실행해봤습니다. 환경: MySQL 8.2.0 쿼리 explain select * from users where joined_at > '2022-07-24 00:00:00'; 결과 8.0.21버전부터는 인덱스 스킵 스캔을 통해 선행 컬럼이 조건에 포함되지 않아도 후속 컬럼을 이용해 인덱스 일부 활용이 가능하다고 하는데 이 때문에 위와 같은 실행 계획나 나온걸까요?
xgboost의 모델은 decision tree의 형식을 따르는 걸까요? n_estimators값 만큼의 반복 수행을 하며 decision tree의 가중치를 수정해나가는 방식으로 이해하였는데 맞는지 궁금합니다. 그리고 xgb가 왜 앙상블 기법인지에 대해서도 약간 이해가 잘 안되서 설명 부탁드립니다!
5:35초 부근 sum += n[i] 일때 왜 한번에 n 값을 다 더해주나요? n=1일때 스위치문 타고 n이 2일때 스위치문 타는 걸로 보면 안되는 이유가 궁금합니다 그리고 6:08 초에도 int가 3일때 케이스문 타는건 이해했는데요 그럼 k 값은 아무 필요가 없는걸까요?
4:32초 문제 메인 클래스 두번째 줄 A s2 = new B('Y"); 를 실행하면 B(char x) 생성자를 호출하잖아요. 여기서 원래 부모의 기본 생성자를 불러야 하는데 this();가 첫줄에 있어서 B클래스의 기본생성자를 호출한거죠?? this();때문에 B클래스의 기본생성자를 호출햇는데 B클래스의 기본생성자에 super();가 없었어도 A클래스의 기본생성자 호출 -> B클래스의 기본생성자 호출 -> B(char x)의 출력문 시행하는게 맞을까요??
고수가 되는 파이썬 : 동시성과 병렬성 문법 배우기 Feat. 멀티스레딩 vs 멀티프로세싱 (Inflearn Original)
선생님 안녕하세요 좋은 강의 감사합니다. multiprocessing(2) - Naming, Parallel processing 12분 경에서 질문이 있습니다. for i in range(1, 10): # 1 ~ 100 적절히 조절 # 생성; name은 str을 받기 때문에 형변환 t = Process(name=str(i), target=square, args=(i,)) # 배열에 담기 - 한번에 풀면서 join 하기 위해서 processes.append(t) # 시작 t.start() 이런식으로 코드가 실행될때, 왜 서브 프로세스가 순서대로 실행이 되지 않는지 잘 이해가 가지 않습니다. 분명히 for loop에서 i가 순서대로 증가하면서 t.start()를 하거든요. 예를 들어, i =1 일때 t가 정의되고 t.start()가 된다음에 다시 i=2 가 되면서 반복되는 식으로요. 그럼 "논리상" 1번째 서브 프로세스부터 순차적으로 실행되어야 하는 것 아닌가요?