2.2 retrieval PDF 변환시 cp949 error
128
작성한 질문수 3
markdown(md) 을 text(txt) 로 변환한 다음에 load 하고 split 을 해줘야함
txt 로 변환된 건 langchain 의 textloader 를 써서 load 해야함이때, utf-8로 encoding 된 txt 파일을 langchain_community 로 TextLoader 하려고 할때 encoding 을 안쓰게 되면 cp949 에러가 나게 됩니다.
너무 기초적인 질문이라 질문글에 없는 것 같아 혹시 저같은 초보를 위해 기록을 남겨 둡니다.^^
(참고로 저는 윈도우 환경으로 따라 하고 있는 중 입니다)
from langchain_community.document_loaders import TextLoader
loader = TextLoader(text_path, encoding='utf-8') # ✅ 인코딩 명시
document_list = loader.load_and_split(text_splitter)또한 윈도우에서 uv.lock 을 읽어들일수가 없었는데요...
혹시 윈도우에서도 가능하셔서 하신분 계시면 노하우(?) 부탁드릴게요~
입력언어의 차이에 대해 질문있습니다
0
50
1
[ReadMe]영상에 나온거랑 깃이랑 다르네요
0
93
2
import Hub Error
0
63
2
코드 최종 결과 질문드립니다.
0
70
2
AgentState의 messages 확인해주세요.
0
94
2
2.3 Agentic RAG 관련 질문이 있습니다.
0
63
2
깃허브 레포지토리 확인 요청
0
93
2
제공해주신 레포가 Windows 환경에 너무 비친화적입니다.
0
142
2
마크다운을 텍스트 파일로 변환하기
0
142
1
max token을 제한하는게 왜 성능을 개선하게 되는걸까요?
0
124
2
pyzerox 유니코드 에러
0
155
2
영상 메타데이터 생성 관련 LLM 활용 질문
0
118
1
종합부동산세 부분 tool 사용 질문 드립니다.
0
118
2
uv sync 파이썬 버전문제 onnxruntime
-1
214
2
MCP를 활용해서 간단한 에이전트를 만들어보세요
0
160
1
PDF 형식
0
114
1
5.3 langchain-mcp-adpater를 활용한 MCP 도구 사용 tool_list 지연 사유
0
151
2
3.6 human_in_the_loop 3rd case
0
123
1
summary 를. 시스템메세지에 추가하는 부분에 관하여
0
137
3
병렬 처리 중 retrieve 관련 궁금한 사항
0
119
1
query 에 대한 answer 결과값이 나오지 않습니다.
0
137
2
사람과 관련된 표현이 없는데 rewrite 로 이동하지 않는경우
0
103
1
retriever 관련 질문
0
90
1
인터룹 관련 질문
0
76
2





