bash operator 관련 문의입니다
미해결
Airflow 마스터 클래스
airflow에서 example_complex에 dag 코드가 이렇게 적혀있던데 수업꺼랑 좀 코드 차이가 있어서요! 스케쥴이나 import하는거나 변경을 어떻게해야할지 몰라서 문의드립니다
- python
- 데이터-엔지니어링
- airflow
- 카카오공채-개발
173만명의 커뮤니티!! 함께 토론해봐요.
미해결
Airflow 마스터 클래스
airflow에서 example_complex에 dag 코드가 이렇게 적혀있던데 수업꺼랑 좀 코드 차이가 있어서요! 스케쥴이나 import하는거나 변경을 어떻게해야할지 몰라서 문의드립니다
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
인덱스와 문자의 순서가 잘못 출력되는 것 같아요... 원인이 뭘까요ㅠㅠㅠ?
해결됨
38군데 합격 비법, 2026 코딩테스트 필수 알고리즘
강의 들으면서 linkedList, stack, deque 처럼 알고리즘 공부를 하면서 차근차근 알아가는 방식이 좋다고 생각합니다. 근데 실무에서 사용하기엔 대부분 import 로 모듈구현을 활용하는 방식으로 진행될텐데, 실무에서 사용하기 좋은 모듈들을 모아놓은 자료가 있는지 궁금합니다! 감사합니다 😃
미해결
[신규 개정판] 코딩 입문자를 위한 파이썬 완벽가이드
그 이름이랑 레벨등을 변수에 저장해서 출력하는 문제였는데요. 거기서 print할때 강의에선 +를 쓰셨는데 print("이름-" + name) 저는 +안쓰고 그냥 print("이름-",name) 이런식으로 적었는데 문제가 있을까요..?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
체험환경 작업형3의 3번 소문제에 ' 독립표본 t-검정을 수행하고 p-값을 구하여라 .' 라고 되어있으므로, a) ' stats.ttest_ind '를 사용하는 것을 이해하였고, b) 소문제 1~2번의 문제 흐름상 '등분산성을 가진다.'라고 가정되어 ' equal_var=True '(dafault 값이지만)를 입력하신 것도 이해하였습니다. 궁금한 점은, 제가 문제 풀이 후에, 궁금해서 아래와 같이 shapiro 정규성 검정 과 levene 등분산성 검정 을 해보았는데, shapiro 정규성 검정에서 정상 그룹 데이터가 정규성을 따르지 않는 결과가 나왔습니다. 그렇다면 원래는 비모수 검정(만위트니유) 를 해야한다고 생각되는데, 그냥 문제에서 요구한 대로 ttest_ind를 사용해서 푸는 게 맞는건지 헷갈립니다. [실행했던 코드] a = df.loc[df['Classification'] == 1]['log'] b = df.loc[df['Classification'] == 2]['log'] print(stats.shapiro(a)) print(stats.shapiro(b)) print(stats.levene(a,b)) print(stats.ttest_ind(a, b)) [출력 값] ShapiroResult(statistic=np.float64(0.9521376332731428), pvalue=np.float64( 0.03589547584091299 )) ShapiroResult(statistic=np.float64(0.9801637075675661), pvalue=np.float64(0.3916017054819772)) LeveneResult(statistic=np.float64(1.8175868256604175), pvalue=np.float64(0.18027345425360713)) TtestResult(statistic=np.float64(-3.0286077921788532), pvalue=np.float64(0.003039226943143319), df=np.float64(114.0))
해결됨
38군데 합격 비법, 2026 코딩테스트 필수 알고리즘
현재 자바로 코딩테스트 준비 중인데, 속도나 문법 난이도 때문에 파이썬으로 바꿔볼까 고민 중입니다. 이미 자바 문법은 어느 정도 익숙하지만 문제 풀이 속도가 느리고 구현이 복잡하게 느껴져요. 언어를 파이썬으로 바꾸는 게 현실적으로 도움이 될까요, 아니면 자바를 계속 잡고 가는 게 나을까요?
미해결
[아파치 카프카 애플리케이션 프로그래밍] 개념부터 컨슈머, 프로듀서, 커넥트, 스트림즈까지!
메시지 키가 있을 경우 전달되는 파티션이 변경되는 것을 방지하기 위해 충분히 큰 파티션으로 생성 을 해야한다. 해당 부분에 대해 궁금한 점이 생겨 질문올립니다. 여기서의 충분히 큰 파티션은 어떻게 산정을 하면 좋을까요? Spring Application으로 Consumer를 구현한다고 했을 때, 충분히 큰 파티션 생성 시 Consumer : Kafka Topic = 1 : N 구조로 구독을 하는 방향으로 만들면 되는 건 지 궁금합니다.
미해결
삼각형의 실전! OpenAI Triton 초급
다른 강의에 올라온다고 되어있는데 vulcan 일 것 같지는 않고... 여기 아직 안 올라온 건가요?
미해결
Airflow 마스터 클래스
안녕하세요 김현진 선생님 강의 잘 듣고 있습니다. 아래의 퀴즈를 풀다가 궁금한 점이 생겨서 질문을 남깁니다. 스케줄러의 DAG 파일 파싱 부하를 줄이기 위해 권장되는 코드 작성 방법은 무엇일까요? --> 라이브러리 import 문을 Python callable 함수 내부로 옮긴다. 위 설명을 이해하기 위해서 상황을 가정해보았는데요, python callable 함수 외부에 선언된 API 호출문이 있는 경우를 피해야하고, 만약 그렇게 되면 스케쥴러가 DAG을 파싱할 때마다 실행되는 상황이 되는 것이 맞을까요?
미해결
삼각형의 실전! OpenAI Triton 초급
어떤 상황에 쓰면 좋은지 궁금합니다.
해결됨
스프링부트로 직접 만들면서 배우는 대규모 시스템 설계 - 게시판
게시글 조회 기능을 확장하려고 할 때 댓글을 조회하는 방향에 대해 고민이 있어서 질문 남깁니다. 게시글 하나를 보는 페이지로 사용자가 이동해서, 게시글의 내용과 댓글들까지 이동한 페이지에서 그려야 할 때 게시글 정보와 해당 게시글의 모든 댓글을 가져오는 기능을 신규로 추가하려고 합니다. 해당 기능의 구현에 대해 2 가지 방향을 고민해봤습니다. 게시글처럼 댓글까지 캐싱하는 방법 Hot data 로 캐싱된 게시글들의 댓글들을 캐싱하는 것을 고민했을 때, 댓글은 게시글보다 훨씬 많은 양이기 때문에 캐싱에 대한 비용이 너무 커지는 것에 부담이 생기는 문제가 있다고 생각합니다. 댓글에 대한 조회는 매번 댓글 서비스에서 조회하는 방법 실시간으로 게시물의 댓글을 계속 조회한다면, 조회 서비스에 읽기 부하가 크게 걸릴 것으로 생각합니다. 두 방식 다 장단점이 있다고 생각하는데, 강사님께선 어떤 방식으로 게시글 + 댓글 조회 기능을 구현하실지 의견이 궁금합니다!
해결됨
스프링부트로 직접 만들면서 배우는 대규모 시스템 설계 - 게시판
해당 강의를 수강하기 전에 사전 학습으로 준비하면 좋은 내용들(MySQL, Redis, Kafka, 시스템 설계 등)에 대해 추천해주실 만한 책이나 강의가 있을까요? 저에게는 이 강의가 다소 어렵게 느껴져서, 관련 내용을 따로 공부한 후 다시 수강하고 싶습니다. 혹시 강의 내용과 연관되어 쿠케님께서 좋다고 느끼셨던 자료나 도움이 되었던 책, 강의 등이 있다면 공유 부탁드립니다!
미해결
대용랑 채팅 TPS에 대한 stateful 서비스 구축하기
이전 강의를 듣지않고 수강하고 있습니다. 이전 강의에 대한 정보가 없어서 간혹 영상에 보이는대로 따라서 메우고 있는데, response 함수에 대한 정보는 아직 화면에 나온 적이 없는거 같아서요. 어차피 JSON으로 응답이 오는거 같아서 c.JSON 을 통해 처리했습니다. 아직 완강하기 전이라 후반부에 나오는지는 잘 모르겠지만 뼈대가 되는 코드에 대한 정보가 조금 더 있었으면 좋겠습니다. 강의 잘 듣고 있습니다. 감사합니다.
미해결
모두의 한국어 텍스트 분석과 자연어처리 with 파이썬
LDA나 NMF 에서 component 수를 어떤 것을 참고해서 최적의 수를 찾을 수 있을까요? 군집에서 엘보우플롯이나, 실루엣 스코어를 참고했는데, 혹시 이렇게 참고할 만한 것이 있을까 궁금합니다.
미해결
Kafka & Spark 활용한 Realtime Datalake
github에는 actions탭에 정상적으로 워크플로우가 런 됩니다. 하지만 code-deploy 탭으로 이동해 확인하면 배포상태가 번번히 실패로 뜹니다. 강의안대로 잘 따라갔습니다. 원인을 찾아보려했지만 찾아지지 않아 글 남깁니다. 감사합니다.
미해결
코딩 테스트 합격자 되기 - 파이썬 편
안녕하세요. 강의에서 딕셔너리로 표현한다는 부분이 {1: 1, 2: 2, 3: 3, 4: 99999999} 이렇게 하나의 배열대신 하나의 딕셔너리로 표현한다는 의미가 맞을까요? 감사합니다.
미해결
파이썬 동시성 프로그래밍 : 데이터 수집부터 웹 개발까지 (feat. FastAPI, async, await)
asyncio.gather() 를 사용해 여러 요청을 동시에 처리하는데, 실제 프로덕션 환경에서는 어떻게 다루는지 궁금합니다. 예를 들어, 페이지를 1,000개 크롤링하거나 이미지를 수천 장 다운로드할 때 서버에 부하가 생기거나 IP 차단 같은 문제가 발생할 것 같습니다. 해결 방법으로 동시 요청 수를 제한하는 게 좋을까요? 만약 그렇다면 적절한 동시성 수준(5개? 10개? 50개?)은 어떤 기준으로 결정하나요?
해결됨
회사에서 바로 쓰는 업무자동화 AI 에이전트 (w. n8n, LangGraph)
현업에서 보통 n8n 워크플로우를 Python 노드로 어느 정도 수준까지 전처리를 진행하나요? Python 환경과 n8n 환경을 sync를 맞춰서 연동하는 좋은 꿀팁 혹은 구조가 있는지 궁금합니다.
해결됨
확률과 통계 101
표본의 분위수를 구하는 방법에 대한 설명이 조금 헷갈렸습니다. 데이터를 오름차순으로 정렬하고, 'α 분위수는 α * 100% 위치의 값이다'라고 하셨는데, '위치'가 단순히 데이터의 개수로 따져서 n * α 를 가리키는 건지, 아니면 데이터 범위 안에서 {x_(n) - x_(1)} * α + x_(1) 에 가까운 값의 sub index를 찾고자 하는 건지 혼동됩니다.
해결됨
스프링부트로 직접 만들면서 배우는 대규모 시스템 설계 - 게시판
안녕하세요, 강의를 통해 대규모 시스템 설계에 대한 다양하고 실무적인 방법을 배우게 되어 감사히 수강하고 있습니다! 수강중 Transactional Outbox 테이블 관련하여 궁금한 부분이 있어 질문드립니다. 실무에서는 보통 "Outbox 테이블에 Insert -> kafka send 후 Outbox 상태 Update" 하는 방식으로 쓰일까요? 강의에서는 간단히 Delete로 구현한다고 말씀주셔서 질문드려봅니다! Update 하는 방식도 자주 쓰인다면 Outbox 테이블은 파티셔닝(p20251001 와 같이)하여 관리하고 주기적으로 삭제하는 방식일지도 궁금하여 질문드립니다!