업데이트 및 상태
현재 추론 상태 및 게이트웨이 변경 이력입니다.
현재 상태
- MiniMax M2.7Gonka 네트워크: 운영 중
- Kimi K2.6Gonka 네트워크: 운영 중
- DeepSeek V4 FlashGonka 네트워크: 운영 중
활성 모델 세트는 Gonka 네트워크 투표에 의해 결정되며 변경될 수 있습니다. 일부 모델은 일시적으로 사용이 제한될 수 있으나 나중에 복구됩니다. 최신 목록은 위를 참조하세요.
상세 상태 및 가동 시간 →업데이트 기록
DeepSeek V4 Flash의 단일 응답 최대 길이가 4배 증가했습니다: 8,192에서 32,768 토큰(max_tokens 매개변수). 이제 대용량 파일과 에이전트 도구의 긴 응답을 한 번의 호출로 처리할 수 있습니다. 추가적으로, 도구 호출 도중 제한에 도달할 경우, 게이트웨이는 잘린 호출 대신 정확한 finish_reason="length"를 반환하므로 에이전트 클라이언트(Cursor 등)가 구문 분석 오류로 멈추지 않고 올바르게 작업을 계속할 수 있습니다.
Gonka 네트워크에 세 번째 활성 모델인 DeepSeek V4 Flash 0731이 추가되었습니다. 380,000 토큰 컨텍스트(네트워크 내 최장 길이, 381K 실제 요청으로 검증됨), reasoning 및 tool calling을 지원합니다. 식별자는 deepseek-ai/DeepSeek-V4-Flash-0731이며, 가격은 기존 모델과 동일합니다. 초기 테스트 단계이지만 완전하게 이용 가능합니다. 대시보드 채팅에서 선택하거나 API 요청의 model 필드에 지정하여 사용하세요.
8월 3일부터 추론 비용이 입력 22 nGNK, 출력 66 nGNK(토큰당)로 변경됩니다(기존 11/33의 두 배). 게이트웨이 수수료는 10%로 동일합니다. 데모 모드는 무료로 유지됩니다. 모든 모델의 최신 가격은 Pricing 페이지와 GET /api/pricing에서 확인할 수 있습니다.
Gonka 네트워크가 요청을 수신했으나 응답하지 않는 경우(300초 타임아웃), 게이트웨이는 이제 조용한 재시도 대신 즉시 504 오류를 반환합니다. 과금 관련 중요 사항: 네트워크가 수락한 요청은 취소할 수 없으며 노드가 처리하므로, 타임아웃 발생 시 프롬프트 처리 예상 비용이 차감됩니다(completion은 과금되지 않음). 권장 사항: 긴 생성을 위해서는 stream:true를 사용하세요. 스트리밍은 타임아웃에 더 안정적이며 진행 상황을 즉시 확인할 수 있습니다.
USDT 입금 수수료가 금액에 따라 낮아집니다: 기본 5%, $25 이상 — 4.5%, $50 이상 — 4%, $100 이상 — 3.5%, $250 이상 — 3%, $500 이상 — 2.75%, $1000 이상 — 2.5%. 입금 대화 상자에 인터랙티브 래더가 추가되어 금액 조절 슬라이더, 각 단계별 GNK 보너스 및 절약 금액을 확인할 수 있습니다. 할인은 입금 시 자동으로 적용됩니다.
자식 키에 대해 전체(누적) 소비 한도를 설정할 수 있으며, 이는 일일 또는 월간 한도와 달리 재설정되지 않는 전용 쿼터입니다. 쿼터가 소진되면 해당 키를 사용하는 요청은 거부됩니다. 한도는 대시보드에서 (nanogonka 단위의 정밀도로) 설정하거나 API의 POST/PATCH /api/management/keys/{id}/children 내 limit_total_ngonka 필드를 사용하여 설정할 수 있습니다. 누적 사용량은 "Reset usage" 버튼(또는 POST /api/management/keys/{id}/children/{childId}/reset-usage)을 통해 초기화할 수 있습니다.
추론 비용이 실제 Gonka 네트워크 토큰 가격과 동기화되었습니다. 가격은 시장 최저 수준을 유지하고 있으며, 동일한 open-source 모델 사용 시 OpenAI나 Anthropic보다 수백 배 저렴한 100만 토큰당 소액의 비용으로 이용 가능합니다. 대부분의 제공업체와 마찬가지로 출력 토큰은 입력 토큰보다 비싸게(×3) 책정됩니다.
활성 모델의 실제 컨텍스트 제한이 최대 200,000 토큰임을 확인했습니다(기존에는 보수적인 수치인 131,072가 게시되었습니다). 이제 더 긴 문서와 대화 기록을 보낼 수 있습니다. 각 모델의 현재 사양은 '네트워크 상태(Network Status)' 섹션에서 확인할 수 있습니다.
각 요청 비용은 API 응답(usage.total_cost_usd 필드) 및 '사용량' 섹션에서 달러 단위로 확인할 수 있어 비용 관리에 용이합니다.
도구에서 자동으로 API 접근을 설정하세요: npx @joingonka/setup을 실행하십시오. Claude Code, OpenClaw, Cline, Continue, opencode, Aider 등을 지원합니다.
모델이 응답 중 인터넷을 검색하고 소스 링크를 추가합니다. 활성화 방법: 요청 본문에 plugins: [{ "id": "web", "max_results": 5 }]를 전달하세요. OpenAI 및 Anthropic 호환 API에서 작동합니다.
최대 응답 길이는 8192 토큰까지 지원하며, max_tokens 매개변수로 제어 가능합니다(기본값: 스트리밍 응답 시 1024, 일반 응답 시 1500).
'채팅' 페이지에서 목록 중 모델을 선택하십시오(/v1/models에서 로드). 선택 사항은 저장되며 새 대화에 적용됩니다.
속도가 필요하신가요? 요청에 x-joingonka-meta: 1 헤더를 추가하면 스트리밍 응답 시 ttft_ms(첫 토큰까지 시간)와 tokens_per_sec가 포함됩니다.
관리 키를 생성(POST /api/management/keys)하고 POST /api/management/keys/{id}/children을 통해 제한이 있는(일일/월간 쿼터, 속도 제한, 만료일) 하위 키를 발급할 수 있습니다.
plugins 매개변수로 플러그인을 연결하세요: response-healing은 잘린 JSON을 복구하고, privacy-sanitization은 개인정보를 마스킹하며, file-parser는 PDF 및 문서에서 텍스트를 추출합니다.
OpenAI: base_url https://gate.joingonka.ai/v1, 헤더 Authorization: Bearer {당신의 키} . Anthropic (Claude Code): base_url https://gate.joingonka.ai, 헤더 x-api-key, 엔드포인트 /v1/messages.
GNK: 주소와 memo를 확인하여 온체인 토큰을 전송하세요. USDT: 1~10,000달러 범위의 금액을 지정하고 OxaPay를 통해 결제하면 자동으로 GNK로 환전됩니다.