2.2 retrieval PDF 변환시 cp949 error
124
작성한 질문수 3
markdown(md) 을 text(txt) 로 변환한 다음에 load 하고 split 을 해줘야함
txt 로 변환된 건 langchain 의 textloader 를 써서 load 해야함이때, utf-8로 encoding 된 txt 파일을 langchain_community 로 TextLoader 하려고 할때 encoding 을 안쓰게 되면 cp949 에러가 나게 됩니다.
너무 기초적인 질문이라 질문글에 없는 것 같아 혹시 저같은 초보를 위해 기록을 남겨 둡니다.^^
(참고로 저는 윈도우 환경으로 따라 하고 있는 중 입니다)
from langchain_community.document_loaders import TextLoader
loader = TextLoader(text_path, encoding='utf-8') # ✅ 인코딩 명시
document_list = loader.load_and_split(text_splitter)또한 윈도우에서 uv.lock 을 읽어들일수가 없었는데요...
혹시 윈도우에서도 가능하셔서 하신분 계시면 노하우(?) 부탁드릴게요~
[ReadMe]영상에 나온거랑 깃이랑 다르네요
0
52
2
import Hub Error
0
48
2
코드 최종 결과 질문드립니다.
0
46
2
AgentState의 messages 확인해주세요.
0
51
2
2.3 Agentic RAG 관련 질문이 있습니다.
0
49
2
깃허브 레포지토리 확인 요청
0
68
2
제공해주신 레포가 Windows 환경에 너무 비친화적입니다.
0
96
2
마크다운을 텍스트 파일로 변환하기
0
109
1
max token을 제한하는게 왜 성능을 개선하게 되는걸까요?
0
100
2
pyzerox 유니코드 에러
0
118
2
영상 메타데이터 생성 관련 LLM 활용 질문
0
105
1
종합부동산세 부분 tool 사용 질문 드립니다.
0
99
2
uv sync 파이썬 버전문제 onnxruntime
-1
171
2
MCP를 활용해서 간단한 에이전트를 만들어보세요
0
133
1
PDF 형식
0
97
1
5.3 langchain-mcp-adpater를 활용한 MCP 도구 사용 tool_list 지연 사유
0
129
2
3.6 human_in_the_loop 3rd case
0
105
1
summary 를. 시스템메세지에 추가하는 부분에 관하여
0
115
3
병렬 처리 중 retrieve 관련 궁금한 사항
0
103
1
query 에 대한 answer 결과값이 나오지 않습니다.
0
118
2
사람과 관련된 표현이 없는데 rewrite 로 이동하지 않는경우
0
89
1
retriever 관련 질문
0
78
1
인터룹 관련 질문
0
63
2
2.4 Self-RAG 결과가 달라요!
0
101
2





