AI 에이전트용: 단계별 설정 안내 — /docs/agents.md, 문서 인덱스 — /llms.txt.
모델
게이트웨이를 통해 사용할 수 있는 Gonka 네트워크의 모델: model에 넣을 식별자, 컨텍스트 윈도우, 출력 한도, 가격, 상태.
모델 및 가격#
모델 구성은 Gonka 네트워크의 투표로 바뀌기 때문에, 표는 게이트웨이의 실시간 데이터로 생성됩니다. 가격은 현재 GNK 환율 기준 100만 토큰당 달러입니다. 청구는 GNK로 이루어지며, 자세한 내용은 요금제 및 계정 섹션을 참고하세요.
| 모델 | 컨텍스트 | 출력 | 입력, $/1M | 출력, $/1M | 상태 |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | 성능 저하 |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | 성능 저하 |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | 작동 중 |
식별자는 model에 입력하세요. 대소문자는 구분하지 않습니다. 상태는 네트워크 상태 페이지와 마찬가지로 성공적으로 처리된 요청 비율로 계산됩니다.
모델 선택 방법#
- 무엇부터 시작할지 모르겠다면
MiniMaxAI/MiniMax-M2.7을 선택하세요. 문서 예제와 설치 프로그램 명령이 이를 기준으로 합니다. - 가장 긴 컨텍스트는
zai-org/GLM-5.3-Flash: 390K 토큰. 대규모 코드베이스와 긴 문서에 적합합니다. - 가장 긴 출력은
deepseek-ai/DeepSeek-V4-Flash-0731: 한 번에 최대 33K 토큰. 큰 파일을 통째로 생성할 때 유용합니다.
네트워크가 모델 서비스를 중단하면 해당 모델은 GET /v1/models에서 사라지고, 요청에는 에러 유형 model_unavailable의 503이 반환됩니다. 에러 메시지에는 전환할 수 있는 모델이 표시됩니다.
출력 길이#
출력 길이는 max_tokens 또는 max_completion_tokens로 지정합니다. 게이트웨이는 두 필드를 모두 인식합니다. 각 모델에는 상한이 있어 이를 초과하는 max_tokens는 게이트웨이가 조용히 잘라냅니다. max_tokens를 지정하지 않으면 stream: true에서는 상한이, 비스트리밍에서는 더 작은 기본값이 적용됩니다.
추론 모델은 max_tokens의 일부를 답변 전 사고에 사용하므로 여유를 두세요.
model | 상한 | 기본값, stream: true | 기본값, 비스트리밍 |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
동일한 수치를 기계 판독 가능한 형태로: 응답 GET /v1/capabilities의 limits.models 필드.
기본 모델#
model가 없는 요청은 게이트웨이가 기본 모델로 보냅니다. 현재는 MiniMaxAI/MiniMax-M2.7입니다.
Claude Code와 Anthropic SDK는 /v1/messages에 Anthropic 모델 이름(claude-*)을 보내지만, 게이트웨이는 이를 동일한 기본 모델로 대체합니다.
다른 모델을 사용하려면 위 표의 식별자를 지정하세요. 설치 프로그램에서는 플래그 --model입니다.
API를 통한 구성 및 상태#
모델 구성은 Gonka 네트워크의 투표로 바뀌므로 목록을 코드에 하드코딩하지 말고 API에서 가져오세요. 이 요청에는 키가 필요하지 않습니다.
| 요청 | 반환 내용 |
|---|---|
GET /v1/models | 현재 사용 가능한 모델: 식별자, 컨텍스트, 출력 한도, 달러 기준 토큰 가격. 네트워크가 현재 서비스하지 않는 모델은 목록에 없습니다. |
GET /v1/models/{model} | 동일한 형식의 단일 모델. 식별자의 슬래시는 그대로 또는 %2F로 전달하세요. 알 수 없거나 비공개 모델은 model_not_found 코드와 함께 404, 비공개 모델에 대한 요청은 503 model_unavailable을 반환합니다. |
GET /v1/capabilities | 게이트웨이 기능: 프로토콜, 요청 파라미터, limits 필드(키의 요청 제한, 타임아웃, 모델별 max_tokens 상한). |
GET /v1/network-status | 각 모델의 상태와 인시던트: 네트워크 상태 페이지와 동일한 데이터. |
GET /health | 게이트웨이 자체의 응답 여부: {"status":"ok"}. 이 요청은 모델 상태를 확인하지 않습니다. |