AI 에이전트용: 단계별 설정 안내 — /docs/agents.md, 문서 인덱스 — /llms.txt.

모델

게이트웨이를 통해 사용할 수 있는 Gonka 네트워크의 모델: model에 넣을 식별자, 컨텍스트 윈도우, 출력 한도, 가격, 상태.

모델 및 가격#

모델 구성은 Gonka 네트워크의 투표로 바뀌기 때문에, 표는 게이트웨이의 실시간 데이터로 생성됩니다. 가격은 현재 GNK 환율 기준 100만 토큰당 달러입니다. 청구는 GNK로 이루어지며, 자세한 내용은 요금제 및 계정 섹션을 참고하세요.

모델컨텍스트출력입력, $/1M출력, $/1M상태
MiniMax MiniMaxAI/MiniMax-M2.7200K8K$0.0083$0.025성능 저하
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731380K33K$0.0083$0.025성능 저하
Z.ai zai-org/GLM-5.3-Flash390K8K$0.0083$0.025작동 중

식별자는 model에 입력하세요. 대소문자는 구분하지 않습니다. 상태는 네트워크 상태 페이지와 마찬가지로 성공적으로 처리된 요청 비율로 계산됩니다.

모델 선택 방법#

  • 무엇부터 시작할지 모르겠다면 MiniMaxAI/MiniMax-M2.7을 선택하세요. 문서 예제와 설치 프로그램 명령이 이를 기준으로 합니다.
  • 가장 긴 컨텍스트는 zai-org/GLM-5.3-Flash: 390K 토큰. 대규모 코드베이스와 긴 문서에 적합합니다.
  • 가장 긴 출력은 deepseek-ai/DeepSeek-V4-Flash-0731: 한 번에 최대 33K 토큰. 큰 파일을 통째로 생성할 때 유용합니다.

네트워크가 모델 서비스를 중단하면 해당 모델은 GET /v1/models에서 사라지고, 요청에는 에러 유형 model_unavailable의 503이 반환됩니다. 에러 메시지에는 전환할 수 있는 모델이 표시됩니다.

출력 길이#

출력 길이는 max_tokens 또는 max_completion_tokens로 지정합니다. 게이트웨이는 두 필드를 모두 인식합니다. 각 모델에는 상한이 있어 이를 초과하는 max_tokens는 게이트웨이가 조용히 잘라냅니다. max_tokens를 지정하지 않으면 stream: true에서는 상한이, 비스트리밍에서는 더 작은 기본값이 적용됩니다.

추론 모델은 max_tokens의 일부를 답변 전 사고에 사용하므로 여유를 두세요.

model상한기본값, stream: true기본값, 비스트리밍
MiniMaxAI/MiniMax-M2.7819281921500
deepseek-ai/DeepSeek-V4-Flash-073132768327681500
zai-org/GLM-5.3-Flash819281923000

동일한 수치를 기계 판독 가능한 형태로: 응답 GET /v1/capabilities의 limits.models 필드.

기본 모델#

model가 없는 요청은 게이트웨이가 기본 모델로 보냅니다. 현재는 MiniMaxAI/MiniMax-M2.7입니다.

Claude Code와 Anthropic SDK는 /v1/messages에 Anthropic 모델 이름(claude-*)을 보내지만, 게이트웨이는 이를 동일한 기본 모델로 대체합니다.

다른 모델을 사용하려면 위 표의 식별자를 지정하세요. 설치 프로그램에서는 플래그 --model입니다.

API를 통한 구성 및 상태#

모델 구성은 Gonka 네트워크의 투표로 바뀌므로 목록을 코드에 하드코딩하지 말고 API에서 가져오세요. 이 요청에는 키가 필요하지 않습니다.

요청반환 내용
GET /v1/models현재 사용 가능한 모델: 식별자, 컨텍스트, 출력 한도, 달러 기준 토큰 가격. 네트워크가 현재 서비스하지 않는 모델은 목록에 없습니다.
GET /v1/models/{model}동일한 형식의 단일 모델. 식별자의 슬래시는 그대로 또는 %2F로 전달하세요. 알 수 없거나 비공개 모델은 model_not_found 코드와 함께 404, 비공개 모델에 대한 요청은 503 model_unavailable을 반환합니다.
GET /v1/capabilities게이트웨이 기능: 프로토콜, 요청 파라미터, limits 필드(키의 요청 제한, 타임아웃, 모델별 max_tokens 상한).
GET /v1/network-status각 모델의 상태와 인시던트: 네트워크 상태 페이지와 동일한 데이터.
GET /health게이트웨이 자체의 응답 여부: {"status":"ok"}. 이 요청은 모델 상태를 확인하지 않습니다.