agent 평가 관련 문의 드립니다.
33
4 câu hỏi đã được viết
안녕하세요. 좋은 강의 잘 들었습니다.
몇가지 문의 드립니다.
aevaluate 이 정상적이지 않아서 evaluate를 사용하는데, evaluate를 사용할때 wrapper 를 안쓰면 최종결과를 얻지 못할수 있어서 wrapper 를 사용한다고 하셨는데요. evaluate 의 첫번째 파라미터는 함수를 넘겨야 하니 run_agent_to_completion 를 자연스럽게 만들게 되지 않나요? run_agent_to_completion 를 안쓴다면 어떤식으로 evaluate 코드를 작성하게 되는지 궁금합니다.
agent 에 따라, 질문에 대해 바로 답을 주는게 아니라 HITL 을 발생시키고, 사용자의 추가 정보에 따라 최종 답변을 주는 agent 가 있을수 있습니다. 이 경우 어떤식으로 평가를 하면 좋을까요?
강의에 사용하셨던 영상에서 몇몇 부분 링크를 참고하라고 하셨는데, 링크 정보를 어디서 얻을수 있을까요? 예를들면 아래와 같은 부분 입니다. (강의소개에 적어주신 노션과 깃헙에서는 못찾아서 여쭤봅니다.)
2강 - 4분 10초 경 Amazon 링크
4강 - 1분 8초 경 세일즈포스트 링크
" '운영에 배포할만한 가치가 있는 agent 인가?'를 평가한다 "는 말이 기억에 남습니다.
감사합니다.
Câu trả lời 1
0
안녕하세요! 좋은 질문 감사합니다. 답변을 드려보자면
별도의 함수를 선언하지 않는다면 lambda를 쓰는게 가장 파이썬스러운게 아닌가 생각합니다. 다만 코드가 오히려 지저분해지지 않을까 싶네요. 공식문서에도 함수를 쓰는 걸로 업데이트가 된 걸 보면, 별도의 함수를 선언하는 것이 가장 적합한 것 같습니다 https://docs.langchain.com/langsmith/evaluate-llm-application#reference-code
저라면 답변의 정확도를 기본적으로 평가하고
대신 평가 데이터셋을 사람의 답변에 따라 여러가지로 구현해서 다양한 시나리오를 평가하는 식으로 구현할 것 같습니다(만약 사람의 답변이 중요하다면)
그리고
human-in-the-loop를 제대로 실행 하는지 (trajectory)를 추가로 평가할 것 같아요
제가 강의 슬라이드를 공유하지 않았군요, 덕분에 강의자료를 수정했습니다 감사합니다.
좋은 피드백 감사합니다!
안녕하세요, 강의자료 요청드립니다
0
2
1
개발 환경 준비와 프로젝트 구조 강의 관련
1
4
2
자료실 문의합니다. AIDU 툴 다운받으려고합니다.
0
3
0
수강연장요청 문의
0
5
1
저장 공간
1
16
2
수업자료 안열림
0
11
0
41강 1분 39초 영상에서 import test_module이 조회 안 돼요.
0
14
1
실습파일이 제대로 올라와 있지 않습니다.
0
10
1
정처기 26-2회. 9번 질문드립니다!
0
26
1
1-11 소수 나열하기 (에라토스테네스의 체)
0
15
0
이론 보면서 질문이 있습니다.
0
31
2
테마 개발의 한계, 업종이 대체 할 수 있을까요?
0
17
2
정보처리기사 실기 26년 2회 SRT 스케줄링 문제 단위 질문
0
38
2
유튜브(정보처리기사 실기 | 26년 2회 기출문제 코드 해설)
0
53
2
262 정처기 실기 C언어코딩
0
24
1
정보처리기사 262 실기 Hash(해시) 질문
0
44
2
static 변수 질문입니다.
0
35
2
파이썬 4강 질문입니다.
0
47
2
colab 코드 실행시 error
1
31
2
모의고사 1회 3번문제
0
75
3
41강 30:10
0
51
2
multi_tool_agent.py 에서 arxiv tool 에러
0
30
1
강의자료 오류
0
72
1
Golden Dataset 권장사항 부분 질문
0
91
2

