inflearn logo
강의

Khóa học

Chia sẻ kiến thức

[Dante Labs] Xây dựng văn phòng ảo AI của riêng tôi bằng Hermes × Codex (Khóa học chuyên sâu 8 tuần)

Unit 2.6 — Lựa chọn mô hình: Mỗi nhân viên một bộ não khác nhau (2) — LLM cục bộ (Ollama)

라마로 모델 스위칭 하고, 인사했는데.. 아래 처럼 에러 메시지가 떴어요.

28

aspyung6828

1 câu hỏi đã được viết

0

API call failed (attempt 1/3): BadRequestError [HTTP 400]

🔌 Provider: custom Model: llama3.2-3b-64k:latest

🌐 Endpoint: http://127.0.0.1:11434/v1

📝 Error: HTTP 400: "llama3.2-3b-64k:latest" does not support thinking

📋 Details: {'message': '"llama3.2-3b-64k:latest" does not support thinking', 'type': 'invalid_request_error', 'param': None, 'code': None}

Elapsed: 0.27s Context: 2 msgs, ~5,870 tokens

Non-retryable error (HTTP 400) — trying fallback...

Non-retryable error (HTTP 400): HTTP 400: "llama3.2-3b-64k:latest" does not support thinking

Non-retryable client error (HTTP 400). Aborting.

🔌 Provider: custom Model: llama3.2-3b-64k:latest

🌐 Endpoint: http://127.0.0.1:11434/v1

💡 This type of error won't be fixed by retrying.

인공지능(ai) ai-agent

Câu trả lời 1

0

communityai8509

안녕하세요, 인프런 AI 인턴입니다.

안상평님, 해당 오류는 라마 모델 자체의 문제가 아니라 요청에 포함된 thinking 옵션을 해당 모델이 지원하지 않아서 발생한 오류입니다.

현재 사용 중인 모델은 다음과 같습니다.

llama3.2-3b-64k:latest

오류의 핵심 내용은 다음과 같습니다.

"llama3.2-3b-64k:latest" does not support thinking

즉, Hermes 또는 Codex 설정에서 모델에 사고 과정 기능을 활성화한 상태로 요청하고 있지만, llama3.2-3b-64k:latest 모델은 thinking 기능을 지원하지 않습니다.

다음과 같이 조치해 보세요.

  1. Hermes 또는 Codex의 모델 설정에서 thinking 또는 reasoning 옵션을 비활성화합니다.
{
  "model": "llama3.2-3b-64k:latest",
  "thinking": false
}

다만 사용하는 클라이언트가 thinking: false를 지원하지 않는다면, 해당 필드 자체를 삭제해야 합니다.

{
  "model": "llama3.2-3b-64k:latest",
  "messages": [
    {
      "role": "user",
      "content": "안녕하세요"
    }
  ]
}
  1. 설정 파일에 아래와 같은 항목이 있다면 제거하거나 false로 변경해 주세요.
thinking: true
reasoning: true
reasoning_effort: high
enable_thinking: true

예를 들어 다음과 같이 변경합니다.

thinking: false
reasoning_effort: none

또는 해당 옵션을 완전히 삭제합니다.

  1. thinking 기능을 반드시 사용해야 한다면, 해당 기능을 지원하는 모델로 변경해야 합니다.
현재 모델: llama3.2-3b-64k:latest
문제: thinking 미지원
해결: thinking 비활성화 또는 thinking 지원 모델 사용

또한 Ollama의 OpenAI 호환 엔드포인트를 사용하는 경우, 클라이언트가 자동으로 thinking 관련 파라미터를 추가할 수 있으므로 모델 설정뿐 아니라 API 호출 코드도 확인해 보셔야 합니다.

이번 오류는 HTTP 400 오류이므로 재시도해도 해결되지 않는 정상적인 요청 형식 오류입니다. thinking 옵션을 제거하거나 비활성화한 뒤 다시 실행하시면 됩니다.

Ollama의 OpenAI 호환 API 엔드포인트는 다음 문서에서도 확인할 수 있습니다.

https://github.com/ollama/ollama/blob/main/docs/openai.md

헤르메스 활용을 위한 PC최소 사양

0

10

0

슬랙에 멀티프로필 추가시 명령어 중복

0

14

1

Unit 4.1-웹훅: 웹훅 설정 파일의 저장 위치는?

0

13

1

/persona-interview 스킬 위치 문의

0

12

1

systemd 셋팅

0

38

1

혹시 Windows에서 Docker Desktop을 설치하는 이유가

0

46

1

gws auth setup 승인오류

0

55

1

6:13 부근에서 끝나버립니다 그 다음 진행부터는 다음 진행창이 나오지 않아요

1

62

6

hermess agent 어떤것을 사용해야 하는지?

0

55

1

hermess agent 어떤것을 사용해야 하는지?

0

44

2

수강생 전용관 링크 부탁해요

0

48

2

별도로 llama3.2-3b-64k 모델을 만드신 이유가 궁금합니다.

0

52

1

VPS 환경에서 webhook 구성시 차이점.

0

74

2

Search를 들어가면 brave search가 없습니다.

0

45

2

텔레그램에 메세지 보내기

0

59

1

8.2 절 칸반보드 실행 결과에 대한 질문입니다.

0

51

2

isolated dashboard 관련 문의

0

53

2

8.1. 키움증권 연동하는 내용 잘문입니다.

0

63

2

혼자 이거저것하다보니..

0

73

2

wave 터미널, 마우스 우클릭 "File Browser" 없네요

0

51

2

Unit3.8-칸반 작업 관련

0

56

2

Unit 6.4. 영상에 있는 ethan에게 주는 블로그 콘텐츠 파이프라인 프롬프트는 어디있어요? 강의자료에서 찾기가 어려워요

0

48

2

섹션8 수업자료

0

54

1

DM에서 스레드로 답변이 오지 않습니다

0

52

2