> AI 에이전트용: 단계별 설정 안내 — [`/docs/agents.md`](https://gate.joingonka.ai/docs/agents.md), 문서 인덱스 — [`/llms.txt`](https://gate.joingonka.ai/llms.txt).

# 모델

게이트웨이를 통해 사용할 수 있는 Gonka 네트워크의 모델: `model`에 넣을 식별자, 컨텍스트 윈도우, 출력 한도, 가격, 상태.

## 모델 및 가격

모델 구성은 Gonka 네트워크의 투표로 바뀌기 때문에, 표는 게이트웨이의 실시간 데이터로 생성됩니다. 가격은 현재 GNK 환율 기준 100만 토큰당 달러입니다. 청구는 GNK로 이루어지며, 자세한 내용은 [요금제 및 계정](https://gate.joingonka.ai/ko/docs/billing) 섹션을 참고하세요.

| 모델 | 컨텍스트 | 출력 | 입력, `$/1M` | 출력, `$/1M` | 상태 |
| --- | ---: | ---: | ---: | ---: | --- |
| **MiniMax** `MiniMaxAI/MiniMax-M2.7` | 200K | 8K | $0.0083 | $0.025 | 성능 저하 |
| **DeepSeek** `deepseek-ai/DeepSeek-V4-Flash-0731` | 380K | 33K | $0.0083 | $0.025 | 성능 저하 |
| **Z.ai** `zai-org/GLM-5.3-Flash` | 390K | 8K | $0.0083 | $0.025 | 작동 중 |

식별자는 `model`에 입력하세요. 대소문자는 구분하지 않습니다. 상태는 [네트워크 상태](https://gate.joingonka.ai/ko/status) 페이지와 마찬가지로 성공적으로 처리된 요청 비율로 계산됩니다.

## 모델 선택 방법

- 무엇부터 시작할지 모르겠다면 `MiniMaxAI/MiniMax-M2.7`을 선택하세요. 문서 예제와 설치 프로그램 명령이 이를 기준으로 합니다.
- 가장 긴 컨텍스트는 `zai-org/GLM-5.3-Flash`: 390K 토큰. 대규모 코드베이스와 긴 문서에 적합합니다.
- 가장 긴 출력은 `deepseek-ai/DeepSeek-V4-Flash-0731`: 한 번에 최대 33K 토큰. 큰 파일을 통째로 생성할 때 유용합니다.

네트워크가 모델 서비스를 중단하면 해당 모델은 `GET /v1/models`에서 사라지고, 요청에는 에러 유형 `model_unavailable`의 503이 반환됩니다. 에러 메시지에는 전환할 수 있는 모델이 표시됩니다.

## 출력 길이

출력 길이는 `max_tokens` 또는 `max_completion_tokens`로 지정합니다. 게이트웨이는 두 필드를 모두 인식합니다. 각 모델에는 상한이 있어 이를 초과하는 `max_tokens`는 게이트웨이가 조용히 잘라냅니다. `max_tokens`를 지정하지 않으면 `stream: true`에서는 상한이, 비스트리밍에서는 더 작은 기본값이 적용됩니다.

추론 모델은 `max_tokens`의 일부를 답변 전 사고에 사용하므로 여유를 두세요.

| `model` | 상한 | 기본값, `stream: true` | 기본값, 비스트리밍 |
| --- | ---: | ---: | ---: |
| `MiniMaxAI/MiniMax-M2.7` | 8192 | 8192 | 1500 |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | 32768 | 32768 | 1500 |
| `zai-org/GLM-5.3-Flash` | 8192 | 8192 | 3000 |

동일한 수치를 기계 판독 가능한 형태로: 응답 `GET /v1/capabilities`의 `limits.models` 필드.

## 기본 모델

`model`가 없는 요청은 게이트웨이가 기본 모델로 보냅니다. 현재는 `MiniMaxAI/MiniMax-M2.7`입니다.

Claude Code와 Anthropic SDK는 `/v1/messages`에 Anthropic 모델 이름(`claude-*`)을 보내지만, 게이트웨이는 이를 동일한 기본 모델로 대체합니다.

다른 모델을 사용하려면 위 표의 식별자를 지정하세요. 설치 프로그램에서는 플래그 `--model`입니다.

## API를 통한 구성 및 상태

모델 구성은 Gonka 네트워크의 투표로 바뀌므로 목록을 코드에 하드코딩하지 말고 API에서 가져오세요. 이 요청에는 키가 필요하지 않습니다.

| 요청 | 반환 내용 |
| --- | --- |
| `GET /v1/models` | 현재 사용 가능한 모델: 식별자, 컨텍스트, 출력 한도, 달러 기준 토큰 가격. 네트워크가 현재 서비스하지 않는 모델은 목록에 없습니다. |
| `GET /v1/models/{model}` | 동일한 형식의 단일 모델. 식별자의 슬래시는 그대로 또는 `%2F`로 전달하세요. 알 수 없거나 비공개 모델은 `model_not_found` 코드와 함께 `404`, 비공개 모델에 대한 요청은 `503 model_unavailable`을 반환합니다. |
| `GET /v1/capabilities` | 게이트웨이 기능: 프로토콜, 요청 파라미터, `limits` 필드(키의 요청 제한, 타임아웃, 모델별 `max_tokens` 상한). |
| `GET /v1/network-status` | 각 모델의 상태와 인시던트: [네트워크 상태](https://gate.joingonka.ai/ko/status) 페이지와 동일한 데이터. |
| `GET /health` | 게이트웨이 자체의 응답 여부: `{"status":"ok"}`. 이 요청은 모델 상태를 확인하지 않습니다. |
