inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

묻고 답해요

173만명의 커뮤니티!! 함께 토론해봐요.

시험 및 문제 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 이번 12월달에 있는 빅데이터분석기사 실기 시험을 준비중인 학생입니다. 비전공자에다가 파이썬을 이번 강의 수강하면서 처음 접해봤는데 강의만 열심히 듣고 따라해도 합격하는데 있어서는 문제가 없을까요?! 그리고 강의 수강하면서 궁금점도 있습니다. 문자변경시에 replace를 사용해서 하는 경우는 df = df.replace('아메리카노','룽고') 이런 식으로 df= <-이부분 에다 대입해서 하시고 loc를 사용하신 경우에는 df= 을 적지 않고 바로df.loc[3,'원두'] 를 사용하셨는데 df= 에다 대입하는 경우의 차이가 있을까요? 그리고 '' , "" (작은 따옴표, 큰 따옴표)는 문자 사용 시 아무거나 사용해도 괜찮나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
빅분초보 댓글 1 좋아요 0 조회수 396

airflow tasks test error

미해결

실리콘밸리 엔지니어와 함께하는 Apache Airflow

안녕하세요. 강의 실습중에 'airflow tasks test postgres_loader execute_sql_query 2023-01-01 ' 터미널에서 실행후 아래와 같은 오류가 발생해서 여쭤보고자 질문드립니다. Error 본문 DB 연결 정보 DB Table 생성 정보 Airflow UI 실행 환경 Mac 14 pro Python 3.11.5 pip freeze aiohttp==3.8.5 aiosignal==1.3.1 alembic==1.11.3 anyio==3.7.1 apache-airflow==2.7.0 apache-airflow-providers-common-sql==1.7.0 apache-airflow-providers-ftp==3.5.0 apache-airflow-providers-http==4.5.0 apache-airflow-providers-imap==3.3.0 apache-airflow-providers-postgres==5.6.0 apache-airflow-providers-sqlite==3.4.3 apispec==6.3.0 argcomplete==3.1.1 asgiref==3.7.2 async-timeout==4.0.3 attrs==23.1.0 autobahn==23.1.2 Automat==22.10.0 Babel==2.12.1 backoff==1.10.0 blinker==1.6.2 cachelib==0.9.0 cachetools==5.3.1 cattrs==23.1.2 certifi==2023.7.22 cffi==1.15.1 channels==4.0.0 charset-normalizer==3.2.0 click==8.1.7 clickclick==20.10.2 colorama==0.4.6 colorlog==4.8.0 ConfigUpdater==3.1.1 connexion==2.14.2 constantly==15.1.0 cron-descriptor==1.4.0 croniter==1.4.1 cryptography==41.0.3 daphne==4.0.0 Deprecated==1.2.14 dill==0.3.1.1 distlib==0.3.5 Django==4.1.4 djangorestframework==3.11.2 dnspython==2.4.2 docutils==0.20.1 email-validator==1.3.1 exceptiongroup==1.1.3 filelock==3.8.0 Flask==2.2.5 Flask-AppBuilder==4.3.3 Flask-Babel==2.0.0 Flask-Caching==2.0.2 Flask-JWT-Extended==4.5.2 Flask-Limiter==3.3.1 Flask-Login==0.6.2 Flask-Session==0.5.0 Flask-SQLAlchemy==2.5.1 Flask-WTF==1.1.1 frozenlist==1.4.0 google-auth==2.22.0 google-re2==1.1 googleapis-common-protos==1.60.0 graphviz==0.20.1 grpcio==1.57.0 gunicorn==21.2.0 h11==0.14.0 httpcore==0.16.3 httpx==0.23.3 hyperlink==21.0.0 idna==3.4 importlib-resources==6.0.1 incremental==22.10.0 inflection==0.5.1 itsdangerous==2.1.2 Jinja2==3.1.2 jsonschema==4.19.0 jsonschema-specifications==2023.7.1 kubernetes==27.2.0 lazy-object-proxy==1.9.0 limits==3.5.0 linkify-it-py==2.0.2 lockfile==0.12.2 Mako==1.2.4 Markdown==3.4.4 markdown-it-py==3.0.0 MarkupSafe==2.1.3 marshmallow==3.20.1 marshmallow-oneofschema==3.0.1 marshmallow-sqlalchemy==0.26.1 mdit-py-plugins==0.4.0 mdurl==0.1.2 multidict==6.0.4 oauthlib==3.2.2 opentelemetry-api==1.15.0 opentelemetry-exporter-otlp==1.15.0 opentelemetry-exporter-otlp-proto-grpc==1.15.0 opentelemetry-exporter-otlp-proto-http==1.15.0 opentelemetry-proto==1.15.0 opentelemetry-sdk==1.15.0 opentelemetry-semantic-conventions==0.36b0 ordered-set==4.1.0 packaging==23.1 pathspec==0.11.2 pendulum==2.1.2 platformdirs==2.5.2 pluggy==1.2.0 prison==0.2.1 protobuf==4.21.12 psutil==5.9.5 psycopg2-binary==2.9.7 pyasn1==0.4.8 pyasn1-modules==0.2.8 pycparser==2.21 pydantic==1.10.12 Pygments==2.16.1 PyJWT==2.8.0 pyOpenSSL==23.0.0 python-daemon==3.0.1 python-dateutil==2.8.2 python-nvd3==0.15.0 python-slugify==8.0.1 pytz==2023.3 pytzdata==2020.1 PyYAML==6.0.1 referencing==0.30.2 requests==2.31.0 requests-oauthlib==1.3.1 requests-toolbelt==1.0.0 rfc3339-validator==0.1.4 rfc3986==1.5.0 rich==13.5.2 rich-argparse==1.2.0 rpds-py==0.9.2 rsa==4.9 service-identity==21.1.0 setproctitle==1.3.2 six==1.16.0 sniffio==1.3.0 SQLAlchemy==1.4.49 SQLAlchemy-JSONField==1.0.1.post0 SQLAlchemy-Utils==0.41.1 sqlparse==0.4.4 tabulate==0.9.0 tenacity==8.2.3 termcolor==2.3.0 text-unidecode==1.3 Twisted==22.10.0 txaio==23.1.1 typing_extensions==4.7.1 uc-micro-py==1.0.2 unicodecsv==0.14.1 urllib3==1.26.16 virtualenv==20.16.3 websocket-client==1.6.2 Werkzeug==2.2.3 wrapt==1.15.0 WTForms==3.0.1 yarl==1.9.2 zope.interface==5.5.2 제가 생각하는 에러 원인 오류 본문을 보고 DB 연결 문제라 생각이 들어 DB를 재생성 하여지만 아직도 원인은 똑같았습니다. 제가 작성한 코드는 아래 github에 올렸습니다. https://github.com/saohwan/learn-airflow

  • python
  • 빅데이터
  • 데이터-엔지니어링
  • airflow
Cooper Ben 댓글 1 좋아요 2 조회수 596

후속 강의 계획 질문드립니다.

미해결

스파크 머신러닝 완벽 가이드 - Part 1

혹시 part2 는 언제쯤 계획하고 계신지 그리고 다음 강의는 어떤 강의 준비하고 계신지 궁금합니다!

  • 머신러닝
  • 빅데이터
  • apache-spark
  • 데이터-엔지니어링
nathan 댓글 1 좋아요 0 조회수 382

Selenium 실습_chromedriver 에러 문의

해결됨

빅데이터 파이프라인 마스터; 성공을 위한 도구와 기술

안녕하세요 실습1강 팔로우중 문의사항이 생겨 글 드립니다. chrome 과 chrome driver 설치하여 selenium 실행 시, 아래와 같은 에러로 실행이 되지않습니다. 해당 에러를 해결하기위해 chrome/chrome-driver 버전 맞춰서 설치 selenium 다운그레이드 및 재설치 등 버전별 검토 chromedriver 경로: find 명령어 사용하여 조회 기타 코드 추가 chrome_options = webdriver.ChromeOptions() chrome_options.add_argument('--headless') ... 어떤 수정이 필요한건지 알 수 있을까요? 에러메세지 Traceback (most recent call last): File "/home/ian/2023_BIGDATA/5_selenium.py", line 11, in <module> driver = webdriver.Chrome ('/home/ian/2023_BIGDATA/chromedriver') File "/home/ian/2023_BIGDATA/venv2023/lib/python3.10/site-packages/selenium/webdriver/chrome/webdriver.py", line 76, in init RemoteWebDriver.__init__( File "/home/ian/2023_BIGDATA/venv2023/lib/python3.10/site-packages/selenium/webdriver/remote/webdriver.py", line 157, in init self.start_session(capabilities, browser_profile) File "/home/ian/2023_BIGDATA/venv2023/lib/python3.10/site-packages/selenium/webdriver/remote/webdriver.py", line 252, in start_session response = self.execute( Command.NEW _SESSION, parameters) File "/home/ian/2023_BIGDATA/venv2023/lib/python3.10/site-packages/selenium/webdriver/remote/webdriver.py", line 321, in execute self.error_handler.check_response(response) File "/home/ian/2023_BIGDATA/venv2023/lib/python3.10/site-packages/selenium/webdriver/remote/errorhandler.py", line 242, in check_response raise exception_class(message, screen, stacktrace) selenium.common.exceptions.WebDriverException: Message: unknown error: Chrome failed to start: exited abnormally. (unknown error: DevToolsActivePort file doesn't exist) (The process started from chrome location /usr/bin/google-chrome is no longer running, so ChromeDriver is assuming that Chrome has crashed.) 실습 코드 from selenium.webdriver.common.by import By from selenium import webdriver chrome_options = webdriver.ChromeOptions() chrome_options.add_argument('--headless') chrome_options.add_argument('--no-sandbox') chrome_options.add_argument("--single-process") chrome_options.add_argument("--disable-dev-shm-usage") driver = webdriver.Chrome ('/home/ian/2023_BIGDATA/chromedriver') driver.implicitly_wait(2) driver.get(' https://www.daum.net/ ')

  • 빅데이터
  • hadoop
  • elasticsearch
  • logstash
  • Kibana
  • apache-spark
  • s3-bucket
댓글 2 좋아요 1 조회수 1186

질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

개정 시험 반영된 것 맞나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
MJ 댓글 1 좋아요 0 조회수 301

필기 1~2 수업자료 통합본 발송 요청

미해결

[핵집] 2025 빅데이터 분석기사(필기)_과목 1~2

- 학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! - 먼저 유사한 질문이 있었는지 검색해보세요. - 서로 예의를 지키며 존중하는 문화를 만들어가요. - 잠깐! 인프런 서비스 운영 관련 문의는 1:1 문의하기를 이용해주세요. 안녕하세요 필기 1~2 수업자료 통합본 발송이 가능할까요? 부탁 드립니다..! 이메일 주소는 kimjiji8105@gmail.com 입니다. 감사합니다!

  • 빅데이터
김지윤 댓글 1 좋아요 0 조회수 283

블로그에 글을 올려도 되나요?

미해결

실리콘밸리 엔지니어와 함께하는 Apache Airflow

강의 내용들을 정리하여 까먹지 않고 앞으로도 찾아서 사용할 수 있게 블로그에 올리고 싶은데 가능할까요? 가능하다면 적절한 정도가 어느정도 될지, 그이외에 주의할 점으로 링크등을 남긴다는 점등이 필요할지가 궁금합니다 감사합니다

  • python
  • 빅데이터
  • 데이터-엔지니어링
  • airflow
머피 댓글 2 좋아요 0 조회수 514

1-2 3-4 통합교안 요청

미해결

[핵집] 2025 빅데이터 분석기사(필기)_과목 3~4

안녕하세요. 1~2 강의에 이어 3~4 강의도 수강하고 있습니다. 1~2와 3~4 통합교안 보내주시면 감사하겠습니다. e-mail : jyh1004jw@gmail.com 감사합니다 :)

  • 빅데이터
inyh 댓글 2 좋아요 0 조회수 267

하둡 명령어 실행시 오류 문의

미해결

Data Engineering Course (1) : 빅데이터 하둡 직접 설치하기

~/hadoop$ hadoop fs -ls 2023-08-29 12:55:53,700 WARN util.NativeCodeLoader: Unable to load native-hadoop library for your platform... using builtin-java classes where applicable 이 에러로 문의드렸습니다. 네 가지 설정파일 캡처 첨부해 재문의드립니다. 참고로 저는 계정명을 hadoop으로 설정하여 neuavenue를 hadoop으로 바꿔서 입력하였습니다. 제발 답변 부탁드려요.. 같은 부분에서 막혀 지우고 재설치만 세번째입니다 ㅠㅠ

  • 빅데이터
  • hadoop
  • 데이터-엔지니어링
lojo03078 댓글 2 좋아요 0 조회수 532

하둡 명령어 실행시 오류

미해결

Data Engineering Course (1) : 빅데이터 하둡 직접 설치하기

~/hadoop$ hadoop fs -ls 2023-08-29 12:55:53,700 WARN util.NativeCodeLoader: Unable to load native-hadoop library for your platform... using builtin-java classes where applicable fs 명령어를 실행하면 native-hadoop library를 load할 수 없다는 경고가 뜨면서 명령이 실행되지 않습니다. 하둡 설치 및 설정 과정은 제공해주신 문서 두세번씩 훑으면서 제대로 설정했는데, 어떻게 해야 고칠 수 있을까요 ㅠㅠ? 혹시 우분투를 22.04.3 LTS로 설치하였는데 버전이 달라서 생기는 문제인가요..? 참고로 하둡 설치할 때 강의에 나온 링크는 존재하지 않는다고 나와서 $wget https://archive.apache.org/dist/hadoop/common/hadoop-3.2.1/hadoop-3.2.1.tar.gz 여기서 설치하였습니다. 자바는 동일한 버전인 8u271을 설치하였는데, 강의와 다르게 Linux ARM 64 Compressed Archive로 설치했어요.

  • 빅데이터
  • hadoop
  • 데이터-엔지니어링
lojo03078 댓글 1 좋아요 0 조회수 631

통합교안 요청 건

미해결

[핵집] 2025 빅데이터 분석기사(필기)_과목 3~4

안녕하십니까? 하기 메일로 강의 통합교안 파일을 받을 수 있을까 하여 문의 남깁니다. w8292w@naver.com 감사합니다.

  • 빅데이터
장 경인 댓글 1 좋아요 0 조회수 227

우지 설치중 오류가 뜹니다

미해결

15일간의 빅데이터 파일럿 프로젝트

어떤 식으로 해결해야할 지 잘 모르겠습니다 ㅠ 밑 캡처본은 Assign Roles 현황입니다

  • 빅데이터
  • hadoop
  • kafka
  • zookeeper
  • redis
  • flume
  • impala
  • 데이터-엔지니어링
난바로 댓글 1 좋아요 0 조회수 426

블로그 코드 기록

해결됨

빅데이터 파이프라인 마스터; 성공을 위한 도구와 기술

안녕하세요 실습 1강을 듣고 있는 수강생입니다. 오늘 블로그를 개설하여 수업 내용을 기록하였는데요, 제가 실습 코드를 자세하게 서술하는건 아닌지 걱정되어 여쭤보게 되었습니다. 게시글 상단에 해당 인프런 강의 링크를 기재하였는데요, 데이터 스크래핑 데이터 크롤링 환경세팅 실습 코드 기록하는 것에 대해 의견 주시면 코드 수정하겠습니다! 감사합니다.

  • 빅데이터
  • hadoop
  • elasticsearch
  • logstash
  • Kibana
  • apache-spark
  • s3-bucket
미누 댓글 1 좋아요 1 조회수 369

수업자료 통합본 공유 요청 드립니다 :)

미해결

[핵집] 2025 빅데이터 분석기사(필기)_과목 1~2

안녕하세요. [핵집] 2023 빅데이터 분석기사(필기)_과목 1~2 를 수강하고 있고, 3-4 및 실기도 신청 완료 했습니다. 보다보니 한과목별로 따로 따로 다운 받아야 하더라구요. 필기 1~2 및 3~4 수업자료 통합본 발송이 가능할까요? 부탁 드립니다 :) 이메일 주소는 happyeris@naver.com 입니다. 더위가 꺾이지 않네요~ 더위 조심하세요~ 감사합니다 :)

  • 빅데이터
최혜민 댓글 1 좋아요 0 조회수 287

Replica Placement 질문

해결됨

빅데이터 파이프라인 마스터; 성공을 위한 도구와 기술

안녕하세요. 영상 7분 30초 경에 있는 ppt가 Replica Placement 를 설명해주고 있는데요. 1번 단계에서 local rack에 replica를 하나 생성한다고 되어있는데 생성 위치가 same node of local rack 인가요? 아니면 different node of local rack 인가요? 그림을 보면 same node of local rack 인데, 같은 노드에 replica를 배치하면 어떤 의미가 있나 궁금해서 질문 드립니다. 감사합니다.

  • 빅데이터
  • hadoop
  • elasticsearch
  • logstash
  • Kibana
  • apache-spark
  • s3-bucket
하루종일 댓글 1 좋아요 1 조회수 432

스파크에 대해

미해결

15일간의 빅데이터 파일럿 프로젝트

안녕하세요 강사님! 먼저 좋은 강의 만들어주셔서 진심으로 감사드립니다. 다름이 아니라 궁금한 점이 있는데요, 많은 사람들이 이야기하는 것이 hadoop과 스파크에 대한 비교인데요. 스파크의 인메모리 처리를 통한 속도 향상으로 인해 하둡을 넘어섰다(?) 이런 얘기가 많이 있는 것 같습니다. 그런데 본 강의에서는 스파크가 하이브와 비교되고 sql 언어를 맵리듀스로 처리하게 해주는 용도로 설명해주신 것으로 이해했습니다. 스파크는 하둡과 같은 데이터베이스가 아닌것인지 궁금합니다!

  • 빅데이터
  • hadoop
  • kafka
  • zookeeper
  • redis
  • flume
  • impala
  • 데이터-엔지니어링
박주현 댓글 1 좋아요 0 조회수 482

실습 1과 Virtualbox 질문

해결됨

빅데이터 파이프라인 마스터; 성공을 위한 도구와 기술

안녕하세요! 제 OS는 윈도우인데요, 강의 섹션 1을 듣다가 궁금한 점이 있어서 질문을 올리게 되었습니다. 강의 소개에 [OS] 우분투 or 리눅스 [머신사양] - Aws t2.medium 2 Core 4GB // ec2 free.tier 참석은 가능 - Virtualbox 이용하여 위 OS로 참석가능 이라고 안내되어 있는데요, 섹션 1 Data Acquisition [Basic] Crawling and Scraping(Urlib, BS4, Selenuim)을 실습할때부터 virtualbox 설치 후 우분투 환경에서 실습해야되는건지 궁금합니다. 즉, 강의(섹션 15개) 중에서 어떤 섹션부터 리눅스와 그 Virtualbox 가 필요한지 궁금합니다! 섹션 1의 이론강의를 본 후 실습영상을 보고 따라하려고 하는데, 이때 윈도우에서도 가능한건지 아니면 지금부터 virtualbox상에서 우분투로 진행해야 되는건지 궁금합니다. 감사합니다!

  • 빅데이터
  • hadoop
  • elasticsearch
  • logstash
  • Kibana
  • apache-spark
  • s3-bucket
미누 댓글 1 좋아요 1 조회수 349

25. LDA 분석3 강의에서

미해결

[실전]텍스톰 TEXTOM 실전 강의: 빅데이터 논문 작성을 위한 텍스트 분석/텍스트마이닝

Coherence Score가 높을수록, Perplexity score가 낮을수록 좋다고 하셨는데, 왜 토픽수가 2가 아닌 4가 좋다고 하신건가요? Perplexity score는 비슷비슷해보이니까, 확실히 Coherence Score가 높은걸 고르는게 맞지 않나요..?

  • 빅데이터
  • 텍스트마이닝
  • textom
driedmango365 댓글 1 좋아요 0 조회수 479

빅데이터분석기사

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

더운여름 잘 지내시는지요? 새롭게 추가된 작업형3 유형과 1유형 통계 관련 또는 6회 기출 풀이 영상 강의 추가 계획은 없으신지요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
윈벅스 댓글 1 좋아요 1 조회수 320

수강 기간 연장 부탁드립니다.

미해결

15일간의 빅데이터 파일럿 프로젝트

안녕하세요 강사님 ! 좋은 강의를 꾸준하게 들어 성장하고 싶지만, 항상 마음과 달리 쉽지가 않네요 수강 신청하고 얼마 듣지도 못 했는데 벌써 기간이 얼마 남지 않아 수강 기간을 연장을 요청드리고자 합니다. 좋은 강의 감사드립니다 강사님 !

  • 빅데이터
  • hadoop
  • kafka
  • zookeeper
  • redis
  • flume
  • impala
  • 데이터-엔지니어링
민식 댓글 1 좋아요 0 조회수 327

인기 태그

인프런 TOP Writers

주간 인기글