# 모델 고르기

> 에이전트가 돌아갈 모델을 고르고, 추론에 얼마나 힘을 쓸지 정하고, 메시지 하나에 대해서만 둘 다 바꿔 씁니다.

모든 [실행](/ko/docs/work/runs/)은 모델이 굴립니다. Endue 는 여러 제공자의 카탈로그를 제공하고, 에이전트가 어느 모델을 쓸지는 사용자가 고릅니다. 기본값으로 정할 수도, 메시지 하나에만 적용할 수도 있습니다.

## 언제 쓰는가

문제가 에이전트의 *추론*일 때 모델을 바꿉니다. 긴 작업에서 단계를 빠뜨리거나, 정말 단순한 일에 느리고 비싸게 굴 때입니다. 일을 못하는 게 아니라 엉뚱한 일을 하고 있다면 [시스템 프롬프트](/ko/docs/build/system-prompt/)를 먼저 고치세요. 더 큰 모델도 흐릿한 지시는 똑같이 충실하게 따릅니다.

## 카탈로그

모델 선택기는 쓸 수 있는 모델과 함께, 선택을 실제로 좌우하는 정보를 보여줍니다. 컨텍스트 창, 백만 토큰당 입력·출력 가격, 받아들이는 입력(텍스트·이미지·파일), 그리고 도구 호출 지원 여부입니다.

**확인할 것은 도구 호출입니다.** Endue 의 에이전트는 도구를 불러 일합니다. 도구 호출을 지원하지 않는 모델은 이미 아는 것으로 답할 수는 있어도 메일을 검색하거나, 아웃풋을 쓰거나, 커넥터를 쓰지 못합니다. 그런 모델은 선택기에 표시돼 있습니다.

## 추론 강도

일부 모델은 **추론 강도** 설정을 제공합니다. 답하기 전에 얼마나 생각할지입니다. 강도가 높으면 토큰을 더 쓰고 시간도 더 걸립니다. 대신 초반의 잘못된 판단이 실행의 나머지를 버리게 만드는 다단계 작업에서 값을 합니다.

대략의 기준입니다.

| 작업 | 강도 |
| --- | --- |
| 형식 변환, 정보 추출, 분류, 짧은 답 | 낮음 |
| 도구 호출 몇 번이 끼는 일상적인 다단계 작업 | 보통 |
| 초반 실수가 누적되는 긴 사슬 — 조사, 계획, 디버깅 | 높음 |

<Screenshot
  name="studio-model"
  alt="모델 섹션 — 지정하지 않으면 플랫폼 기본값으로 내려가는 기본 채팅 모델과, 꺼져 있는 별도의 폴백 모델 스위치."
/>

## 에이전트별 · 메시지별 · 루틴별

모델을 정하는 곳은 셋이고, 아래로 갈수록 위를 덮어씁니다.

- **에이전트 기본값** — [에이전트 빌더](/ko/docs/build/agent-builder/)에서 정합니다. 달리 지정하지 않으면 이것을 씁니다.
- **메시지 하나** — 입력창에서 바꿉니다. 값싼 에이전트와의 대화 중 어려운 질문 하나에 쓰기 좋습니다. 매번 손으로 바꾸는 대신 [요청에 맞춰 자동으로 고르게](#요청에-맞춰-자동으로-고르기) 둘 수도 있습니다.
- **[루틴](/ko/docs/automate/routines/)** — 자기 모델을 고정할 수 있어서, 에이전트를 다시 손봐도 예약된 작업의 비용이 흔들리지 않습니다.

<Aside type="tip" title="값싼 에이전트에 가끔 승급">
  빠른 모델을 에이전트 기본값으로 두고 필요한 몇 메시지에만 더 강한 모델을 쓰는 편이, 모든 것을
  가장 강한 모델로 돌리는 것보다 대개 쌉니다. 일상적인 90% 에서는 에이전트가 더 빠르게 느껴지기도
  합니다.
</Aside>

## 요청에 맞춰 자동으로 고르기

에이전트의 **자동 선택**을 켜면 메시지마다 모델을 고르지 않아도 됩니다. 메시지가 오면 판단 모델이 그 요청이 얼마나 어려운지를 세 단계로 가르고, 단계마다 어느 모델을 쓸지는 사용자가 정해 둡니다.

[에이전트 빌더](/ko/docs/build/agent-builder/)의 모델 섹션에서 설정합니다.

| 단계 | 쓰는 모델 |
| --- | --- |
| 가벼운 요청 — 인사, 짧은 사실 확인, 한두 문장 고치기 | 가벼운 요청에 고른 모델 |
| 보통 요청 — 설명, 요약, 일상적인 글과 코드 | 에이전트의 기본 모델 |
| 어려운 요청 — 여러 단계의 분석, 길고 정밀한 글, 복잡한 코드 | 어려운 요청에 고른 모델 |

두 칸 중 하나만 채워도 됩니다. 비운 단계는 기본 모델로 갑니다.

방식은 셋입니다.

- **끔** — 판단하지 않습니다.
- **관찰** — 판단은 하되 모델은 바꾸지 않습니다. 답 아래에 "자동이었다면" 과 모델 이름이 붙어서, 켜기 전에 어떻게 갈릴지 볼 수 있습니다.
- **켬** — 판단대로 모델을 고릅니다. 입력창의 모델 선택이 **자동**으로 시작하고, 답 아래에 "자동" 과 실제로 답한 모델 이름이 붙습니다.

저장하기 전에 **시험해 보기**에 문장을 넣으면 그 문장이 어느 단계로 읽히고 어느 모델로 가는지 보여줍니다.

다음 경우에는 기본 모델로 답합니다.

- 판단이 애매할 때. 확신도가 정해 둔 기준에 못 미치면 고르지 않습니다.
- 판단이 제때 오지 않을 때. 답이 판단을 기다리느라 늦어지지 않습니다.
- 고른 모델을 요금제나 남은 한도 때문에 쓸 수 없을 때.

첨부가 있는 메시지와 어려운 요청에 바로 이어지는 메시지는 가벼운 모델로 내리지 않습니다. "계속해줘" 는 혼자 보면 가볍지만 하던 일은 그렇지 않기 때문입니다.

입력창에서 모델을 직접 고르면 그 대화는 고른 모델로 갑니다. 다시 **자동**을 고르면 풀립니다. 기본 모델이 정해진 프로젝트의 대화는 프로젝트 모델을 따릅니다.

<Aside type="note" title="판단을 위해 메시지가 전송됩니다">
  관찰이나 켬으로 두면 에이전트가 받는 메시지(이번 메시지와 직전 메시지의 앞부분)가 OpenRouter 를 거쳐
  미국의 TypeSafe 로 전송됩니다. 난이도를 가르는 데만 쓰입니다. 끔에서 켜는 쪽으로 바꿀 때 화면이
  이 점을 확인받습니다.
</Aside>

## 비용

요금제의 사용량을 소모하는 것은 모델 사용이고, 카탈로그 안에서도 가격은 열 배 넘게 차이 납니다. 선택기가 모델별 입력·출력 가격을 보여줍니다. 사용량을 어떻게 재고 어디서 보는지는 [요금제와 사용량](/ko/docs/account/plans-and-usage/)을, 제공자에게 직접 결제하고 싶다면 [내 API 키 사용](/ko/docs/account/bring-your-own-key/)을 보세요.

## 한계

- 모든 모델이 모든 기능을 지원하지는 않습니다. 도구 호출, 이미지 입력, 추론 강도는 모델마다 다르고 선택기가 그 기준입니다.
- 모델을 바꿔도 에이전트의 프롬프트·메모리·바인딩은 바뀌지 않습니다.
- 돌고 있는 실행은 시작할 때의 모델을 유지합니다. 모델 변경은 다음 실행부터입니다.
- 자동 선택은 사람이 보낸 메시지에만 걸립니다. [루틴](/ko/docs/automate/routines/)과 음성 대화는 고르지 않고 정해진 모델로 돕니다.
- 컨텍스트 창이 모델마다 다릅니다. 한 모델에는 들어가는 아주 긴 대화가 다른 모델에는 들어가지 않을 수 있습니다.

## 관련 문서

<CardGrid>
  <LinkCard
    title="요금제와 사용량"
    href="/ko/docs/account/plans-and-usage/"
    description="무엇이 사용량을 소모하고, 얼마나 썼는지 어디서 보는지."
  />
  <LinkCard
    title="내 API 키 사용"
    href="/ko/docs/account/bring-your-own-key/"
    description="Endue 의 자격증명 대신 내 모델 자격증명 쓰기."
  />
  <LinkCard
    title="Endue 의 동작 방식"
    href="/ko/docs/get-started/how-it-works/"
    description="모델이 굴리는 루프, 그리고 선택이 중요한 이유."
  />
</CardGrid>
