라마로 모델 스위칭 하고, 인사했는데.. 아래 처럼 에러 메시지가 떴어요.
28
1 asked
API call failed (attempt 1/3): BadRequestError [HTTP 400]
🔌 Provider: custom Model: llama3.2-3b-64k:latest
🌐 Endpoint: http://127.0.0.1:11434/v1
📝 Error: HTTP 400: "llama3.2-3b-64k:latest" does not support thinking
📋 Details: {'message': '"llama3.2-3b-64k:latest" does not support thinking', 'type': 'invalid_request_error', 'param': None, 'code': None}
⏱ Elapsed: 0.27s Context: 2 msgs, ~5,870 tokens
⚠ Non-retryable error (HTTP 400) — trying fallback...
❌ Non-retryable error (HTTP 400): HTTP 400: "llama3.2-3b-64k:latest" does not support thinking
❌ Non-retryable client error (HTTP 400). Aborting.
🔌 Provider: custom Model: llama3.2-3b-64k:latest
🌐 Endpoint: http://127.0.0.1:11434/v1
💡 This type of error won't be fixed by retrying.
Answer 1
0
안녕하세요, 인프런 AI 인턴입니다.
안상평님, 해당 오류는 라마 모델 자체의 문제가 아니라 요청에 포함된 thinking 옵션을 해당 모델이 지원하지 않아서 발생한 오류입니다.
현재 사용 중인 모델은 다음과 같습니다.
llama3.2-3b-64k:latest
오류의 핵심 내용은 다음과 같습니다.
"llama3.2-3b-64k:latest" does not support thinking
즉, Hermes 또는 Codex 설정에서 모델에 사고 과정 기능을 활성화한 상태로 요청하고 있지만, llama3.2-3b-64k:latest 모델은 thinking 기능을 지원하지 않습니다.
다음과 같이 조치해 보세요.
- Hermes 또는 Codex의 모델 설정에서
thinking또는reasoning옵션을 비활성화합니다.
{
"model": "llama3.2-3b-64k:latest",
"thinking": false
}
다만 사용하는 클라이언트가 thinking: false를 지원하지 않는다면, 해당 필드 자체를 삭제해야 합니다.
{
"model": "llama3.2-3b-64k:latest",
"messages": [
{
"role": "user",
"content": "안녕하세요"
}
]
}
- 설정 파일에 아래와 같은 항목이 있다면 제거하거나
false로 변경해 주세요.
thinking: true
reasoning: true
reasoning_effort: high
enable_thinking: true
예를 들어 다음과 같이 변경합니다.
thinking: false
reasoning_effort: none
또는 해당 옵션을 완전히 삭제합니다.
- thinking 기능을 반드시 사용해야 한다면, 해당 기능을 지원하는 모델로 변경해야 합니다.
현재 모델: llama3.2-3b-64k:latest
문제: thinking 미지원
해결: thinking 비활성화 또는 thinking 지원 모델 사용
또한 Ollama의 OpenAI 호환 엔드포인트를 사용하는 경우, 클라이언트가 자동으로 thinking 관련 파라미터를 추가할 수 있으므로 모델 설정뿐 아니라 API 호출 코드도 확인해 보셔야 합니다.
이번 오류는 HTTP 400 오류이므로 재시도해도 해결되지 않는 정상적인 요청 형식 오류입니다. thinking 옵션을 제거하거나 비활성화한 뒤 다시 실행하시면 됩니다.
Ollama의 OpenAI 호환 API 엔드포인트는 다음 문서에서도 확인할 수 있습니다.
헤르메스 활용을 위한 PC최소 사양
0
9
0
슬랙에 멀티프로필 추가시 명령어 중복
0
12
1
Unit 4.1-웹훅: 웹훅 설정 파일의 저장 위치는?
0
13
1
/persona-interview 스킬 위치 문의
0
12
1
systemd 셋팅
0
38
1
혹시 Windows에서 Docker Desktop을 설치하는 이유가
0
46
1
gws auth setup 승인오류
0
55
1
6:13 부근에서 끝나버립니다 그 다음 진행부터는 다음 진행창이 나오지 않아요
1
61
6
hermess agent 어떤것을 사용해야 하는지?
0
55
1
hermess agent 어떤것을 사용해야 하는지?
0
44
2
수강생 전용관 링크 부탁해요
0
48
2
별도로 llama3.2-3b-64k 모델을 만드신 이유가 궁금합니다.
0
52
1
VPS 환경에서 webhook 구성시 차이점.
0
74
2
Search를 들어가면 brave search가 없습니다.
0
45
2
텔레그램에 메세지 보내기
0
58
1
8.2 절 칸반보드 실행 결과에 대한 질문입니다.
0
50
2
isolated dashboard 관련 문의
0
53
2
8.1. 키움증권 연동하는 내용 잘문입니다.
0
63
2
혼자 이거저것하다보니..
0
73
2
wave 터미널, 마우스 우클릭 "File Browser" 없네요
0
51
2
Unit3.8-칸반 작업 관련
0
56
2
Unit 6.4. 영상에 있는 ethan에게 주는 블로그 콘텐츠 파이프라인 프롬프트는 어디있어요? 강의자료에서 찾기가 어려워요
0
48
2
섹션8 수업자료
0
54
1
DM에서 스레드로 답변이 오지 않습니다
0
52
2

