inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

[단테랩스] Hermes × Codex 로 세우는 나만의 AI 가상 오피스 (8주 마스터 과정)

Unit 2.6 — 모델 선택하기: 직원마다 다른 두뇌 (2) — 로컬 LLM (Ollama)

라마로 모델 스위칭 하고, 인사했는데.. 아래 처럼 에러 메시지가 떴어요.

27

안상평

작성한 질문수 1

0

API call failed (attempt 1/3): BadRequestError [HTTP 400]

🔌 Provider: custom Model: llama3.2-3b-64k:latest

🌐 Endpoint: http://127.0.0.1:11434/v1

📝 Error: HTTP 400: "llama3.2-3b-64k:latest" does not support thinking

📋 Details: {'message': '"llama3.2-3b-64k:latest" does not support thinking', 'type': 'invalid_request_error', 'param': None, 'code': None}

Elapsed: 0.27s Context: 2 msgs, ~5,870 tokens

Non-retryable error (HTTP 400) — trying fallback...

Non-retryable error (HTTP 400): HTTP 400: "llama3.2-3b-64k:latest" does not support thinking

Non-retryable client error (HTTP 400). Aborting.

🔌 Provider: custom Model: llama3.2-3b-64k:latest

🌐 Endpoint: http://127.0.0.1:11434/v1

💡 This type of error won't be fixed by retrying.

인공지능(ai) ai-agent

답변 1

0

인프런 AI 인턴

안녕하세요, 인프런 AI 인턴입니다.

안상평님, 해당 오류는 라마 모델 자체의 문제가 아니라 요청에 포함된 thinking 옵션을 해당 모델이 지원하지 않아서 발생한 오류입니다.

현재 사용 중인 모델은 다음과 같습니다.

llama3.2-3b-64k:latest

오류의 핵심 내용은 다음과 같습니다.

"llama3.2-3b-64k:latest" does not support thinking

즉, Hermes 또는 Codex 설정에서 모델에 사고 과정 기능을 활성화한 상태로 요청하고 있지만, llama3.2-3b-64k:latest 모델은 thinking 기능을 지원하지 않습니다.

다음과 같이 조치해 보세요.

  1. Hermes 또는 Codex의 모델 설정에서 thinking 또는 reasoning 옵션을 비활성화합니다.
{
  "model": "llama3.2-3b-64k:latest",
  "thinking": false
}

다만 사용하는 클라이언트가 thinking: false를 지원하지 않는다면, 해당 필드 자체를 삭제해야 합니다.

{
  "model": "llama3.2-3b-64k:latest",
  "messages": [
    {
      "role": "user",
      "content": "안녕하세요"
    }
  ]
}
  1. 설정 파일에 아래와 같은 항목이 있다면 제거하거나 false로 변경해 주세요.
thinking: true
reasoning: true
reasoning_effort: high
enable_thinking: true

예를 들어 다음과 같이 변경합니다.

thinking: false
reasoning_effort: none

또는 해당 옵션을 완전히 삭제합니다.

  1. thinking 기능을 반드시 사용해야 한다면, 해당 기능을 지원하는 모델로 변경해야 합니다.
현재 모델: llama3.2-3b-64k:latest
문제: thinking 미지원
해결: thinking 비활성화 또는 thinking 지원 모델 사용

또한 Ollama의 OpenAI 호환 엔드포인트를 사용하는 경우, 클라이언트가 자동으로 thinking 관련 파라미터를 추가할 수 있으므로 모델 설정뿐 아니라 API 호출 코드도 확인해 보셔야 합니다.

이번 오류는 HTTP 400 오류이므로 재시도해도 해결되지 않는 정상적인 요청 형식 오류입니다. thinking 옵션을 제거하거나 비활성화한 뒤 다시 실행하시면 됩니다.

Ollama의 OpenAI 호환 API 엔드포인트는 다음 문서에서도 확인할 수 있습니다.

https://github.com/ollama/ollama/blob/main/docs/openai.md

헤르메스 활용을 위한 PC최소 사양

0

9

0

슬랙에 멀티프로필 추가시 명령어 중복

0

12

1

Unit 4.1-웹훅: 웹훅 설정 파일의 저장 위치는?

0

13

1

/persona-interview 스킬 위치 문의

0

12

1

systemd 셋팅

0

38

1

혹시 Windows에서 Docker Desktop을 설치하는 이유가

0

46

1

gws auth setup 승인오류

0

55

1

6:13 부근에서 끝나버립니다 그 다음 진행부터는 다음 진행창이 나오지 않아요

1

61

6

hermess agent 어떤것을 사용해야 하는지?

0

55

1

hermess agent 어떤것을 사용해야 하는지?

0

44

2

수강생 전용관 링크 부탁해요

0

48

2

별도로 llama3.2-3b-64k 모델을 만드신 이유가 궁금합니다.

0

52

1

VPS 환경에서 webhook 구성시 차이점.

0

74

2

Search를 들어가면 brave search가 없습니다.

0

45

2

텔레그램에 메세지 보내기

0

58

1

8.2 절 칸반보드 실행 결과에 대한 질문입니다.

0

50

2

isolated dashboard 관련 문의

0

53

2

8.1. 키움증권 연동하는 내용 잘문입니다.

0

63

2

혼자 이거저것하다보니..

0

73

2

wave 터미널, 마우스 우클릭 "File Browser" 없네요

0

51

2

Unit3.8-칸반 작업 관련

0

56

2

Unit 6.4. 영상에 있는 ethan에게 주는 블로그 콘텐츠 파이프라인 프롬프트는 어디있어요? 강의자료에서 찾기가 어려워요

0

48

2

섹션8 수업자료

0

54

1

DM에서 스레드로 답변이 오지 않습니다

0

52

2