pd.read_html(url) 시 에러가 납니다
5570
投稿した質問数 7
아래와 같이 코드 실행 시 에러가 납니다
pd.read_html(url) 부분입니다
ValueError Traceback (most recent call last)
<ipython-input-28-5d8f83db45ac> in <module>()
----> 1 pd.read_html(url)
5 frames
/usr/local/lib/python3.6/dist-packages/pandas/io/html.py in _parse_tables(self, doc, match, attrs)
545
546 if not tables:
--> 547 raise ValueError("No tables found")
548
549 result = []
回答 1
1
판다스 내장함수인 read_html의 경우, 읽어올 html 문서 내에 <table> 태그가 있어야 수집이 가능합니다.
위에서 설정하신 url 변수를 참조하시어, 마우스 우클릭 > 검사 (혹은 Inspect)를 눌렀을 때 <table>태그가 나오는 지 확인해보시기 바랍니다 =)
0
라이브 강의 이후 변경사항
-
네이버 증권 일별 시세의 웹페이지가 변경되어 기존의 방법으로는 불러올 수 없습니다.
-
일별 시세 페이지에서 브라우저가 아닐 때 응답을 하지 않기 때문인데 이 때 requests 라는 라이브러리를 통해 HTTP 요청을 보내고 웹사이트의 소스코드를 받아와서 table 태그를 찾는 방법으로 받아올 수 있습니다.
-
아래의 코드를 보면 requests를 통해 HTTP 통신을 보내고 beautifulsoup을 통해 HTML 페이지 내에서 table 태그를 찾습니다.
-
table 태그를 read_html로 불러오면 판다스의 데이터프레임으로 읽어올 수 있습니다.
requests를 통한 HTTP 요청
- Requests: HTTP for Humans™ — Requests documentation
- Quickstart — Requests documentation # custom-headers
BeautifulSoup 을 통한 table 태그 찾기
페이지별 데이터 수집 함수 만들기
프롬프트의 영문 버전을 만들 때, 출력 규칙에 포함된 한글 부분은 영어로 번역하지 않고 그대로 유지하면서, 영문 편과 한글 편을 한 번에 함께 출력하려면 어떤 워크플로우로 구성하면 좋을까요?
0
6
0
프로그램은 뭘 사용하시는 건가요??
1
10
2
수업자료와 노션 공유 문제
0
16
3
python run.py 실행시 에러 문제
1
27
2
조건 반복문 질문: for 문 ?
0
21
0
54강 4분 41초에서 질문 있어요.
0
18
1
커서창
1
30
2
강의 제작
1
34
1
23강 질문드립니다, 강사님.
0
22
1
import
0
17
1
45강 예제4번에서 질문 있어요!
0
28
1
45강 강의 10분 03초 내용에서 x + 1 을 하는 이유는 뭔가요?
0
23
1
Json.stringify 관련 오류일까요?
0
23
2
3강, 7강 화면이 안나옵니다. 그냥 검은화면으로만 노출되요;;
0
27
1
cursor 환경
1
36
2
Gradio 실행 시 에러 발생 문의
0
33
2
Gradio 실행 시 Jinja2 / ASGI TypeError: unhashable type: 'dict' 에러 문의
0
37
2
안녕하세요, 강의자료 요청드립니다
0
25
1
개발 환경 준비와 프로젝트 구조 강의 관련
1
30
2
자료실 문의합니다. AIDU 툴 다운받으려고합니다.
0
21
1
수강연장요청 문의
0
38
1
저장 공간
1
38
2
수업자료 안열림
0
28
1
구글 Collab 접속 불가능
0
421
3

