Mga Update at Status
Kasalukuyang estado ng inference at kasaysayan ng mga pagbabago sa gateway.
Kasalukuyang status
- MiniMax M2.7Gonka Network: Pinababang Pagganap
- DeepSeek V4 FlashGonka Network: Pinababang Pagganap
- GLM 5.3 FlashGonka Network: Operational
Ang hanay ng mga aktibong modelo ay tinutukoy sa pamamagitan ng pagboto ng network ng Gonka at maaaring magbago: ang ilang mga modelo ay pansamantalang hindi available at babalik sa ibang pagkakataon. Ang kasalukuyang listahan ay nasa itaas.
Detalyadong status at uptime →Kasaysayan ng mga update
Maaari mong i-top up ang iyong balance gamit ang WGNK token — ito ay GNK sa Ethereum network. Sa iyong account: Mag-top up → GNK → Ethereum · WGNK; ilagay ang address kung saan mo ipapadala ang mga token — ang transfer ay awtomatikong mai-credit, karaniwang sa loob ng 15–20 minuto.
Ang npx @joingonka/setup ay nagko-configure na ngayon ng 25 na tool. Mga bago: Codex CLI, Kimi Code, omp, MiniMax Code, Goose, MiMo Code, Qwen Code, Factory Droid, Crush at Zoo Code. Ang model ay pinipili gamit ang --model flag (minimax, deepseek, o glm), kung saan ang default ay DeepSeek V4 Flash. Sa huli, nagpapadala ang installer ng verification request at ipinapakita agad kung gumagana ang key.
Mula Setyembre 16, ang bawat bagong account ay makakatanggap ng 100,000,000 nGNK (0.1 GNK) sa halip na 50,000,000 — sa kasalukuyang presyo ng network, ito ay humigit-kumulang 3 milyong tokens para sa testing nang hindi nangangailangan ng deposito. Ang bonus ay awtomatikong ipapasok sa account pagkatapos ng pagpaparehistro, walang kailangang i-input; ang kasalukuyang halaga ay laging makikita sa GET /api/pricing (field na welcome_bonus_ngonka) at sa pahina ng pagpaparehistro.
Ang mga node ng network ng Gonka ay nagsasara ng anumang stream pagkatapos ng mga 5 minuto ng pag-generate (para sa GLM 5.3 Flash, ito ay mga 8,000 token). Dati, ang pagputol na ito ay mukhang normal na pagtatapos: ang stream ay natatapos sa [DONE] nang walang finish_reason, at itinuturing ng client ang putol na bahagi bilang kumpletong sagot. Ngayon, nagpapadala na ang gateway ng chunk na may finish_reason="length" — sa parehong stream at normal na response, at sa format na Anthropic, ito ay stop_reason="max_tokens". Ano ang dapat gawin sa mga mahahabang sagot: gamitin ang stream:true at kapag may finish_reason="length", ipagpatuloy ang generation sa susunod na request, sa pamamagitan ng pagpasa sa bahaging natanggap na sa konteksto. Ang mga detalye ay nasa seksyong “Limits” ng dokumentasyon.
Available na sa network ng Gonka ang GLM 5.3 Flash mula sa Z.ai: 320B parameters (MoE, 18B active), FP8, lisensyang MIT, kontekstong 390,000 tokens. Ang modelo ay nangangatwiran bago sumagot: ang pangangatwiran ay dumarating sa field na reasoning_content at gumagamit ng badyet ng sagot, kaya magtakda ng max_tokens na hindi bababa sa 600 o gumamit ng stream:true; para sa mga maiikling gawain — reasoning_effort: "low". Gumagana ang tool calling at JSON-mode. Identifier — zai-org/GLM-5.3-Flash, ang presyo ay pareho sa ibang mga modelo ng network. Hindi na suportado ng network ang Kimi K2.6 — ilipat ang iyong mga integration sa MiniMax M2.7, DeepSeek V4 Flash o GLM 5.3 Flash.
Ang pahina ng "Paggamit" ay nagpapakita ng konsumo para sa bawat modelo: mga request, input/output token, gastos sa nGNK at dolyar, average na presyo bawat 1M token, at bilis ng tugon. Ang "Ngayon" ay ipinapakita kada oras, at idinagdag ang "90 araw" na preset. Para sa mga integration: GET /api/usage/by-model.
Ang gateway ngayon ay tumatanggap na ng mga request sa /v1/completions — ang "text" endpoint ng OpenAI: tumatanggap ito ng prompt string bilang input at nagbabalik ng choices[].text bilang output. Ginagamit ito ng mga editor plugin para sa autocomplete at inline code editing (Continue.dev at iba pa). Ang Base URL ay nananatiling: https://gate.joingonka.ai/v1. Ang streaming at mga standard parameter (max_tokens, temperature, stop) ay suportado, na may parehong gastos at limitasyon gaya ng sa /v1/chat/completions. Ang mga field na logprobs at best_of ay hindi suportado.
Simula Agosto 22, ang halaga ng inference ay: input — 33 nGNK, output — 99 nGNK bawat token (dati ay 22/66). Ang komisyon sa gateway ay hindi nagbabago — 10%. Ang demo mode ay mananatiling libre. Bakit tumaas: ang request sa network ng Gonka ay pinoproseso gamit ang redundancy — ito ay bahagi ng protocol at devshards code, na kinakailangan para sa maayos na serbisyo. Ang container ay maaaring magpadala ng request sa isang host, tapos sa isa pa kung hindi nakayanan ng una, at kung kinakailangan — sa maraming host nang sabay-sabay. Binabayaran ang bawat pagsubok: presyo ng network ay 10 nGNK bawat token, na pinarami ng redundancy ng request (average na ×1—2.5). Dati, ang cost na ito ay hindi umaabot sa amin dahil sa hindi gumaganang price finalization API, at nagbabayad kami para sa isang host lang; ngayon, ito ay kinakalkula nang actual at inililipat namin ito sa taripa. Ang inference ay nananatiling daan-daang beses na mas mura kaysa sa mga vendor API. Ang mga kasalukuyang presyo ng lahat ng modelo ay nasa pahina ng Pricing at GET /api/pricing.
Ang gateway ay tumatanggap ng mga request sa format na Responses — isang bagong protocol ng OpenAI na ginagamit na ng mga bagong SDK at kung saan gumagana ang Codex CLI. Ang address ay pareho pa rin: base URL https://gate.joingonka.ai/v1, ang client ay kusa nang tatawag sa /v1/responses. Gumagana ang streaming, function tools, at structured output (text.format); ang gastos at limitasyon ay pareho sa /v1/chat/completions. Hindi kami nagtatago ng mga dialog, kaya ang store ay binabalewala at ang previous_response_id ay magbabalik ng error — ipasa ang buong history sa field na input. Ang mga built-in na server tool ng OpenAI (web_search, file_search, code_interpreter) ay hindi suportado; ang aming web search ay mananatiling accessible sa pamamagitan ng web plugin sa /v1/chat/completions.
Dati, ang mga network error ng Gonka sa stream:true mode ay bumabalik na may code 200, at ang error ay makikita lamang sa loob ng SSE-chunk: ang mga agent client ay itinuturing ang sagot na ito na isang matagumpay na walang laman na tugon at hindi na nag-re-retry. Ngayon, bago magsimula ang sagot mula sa network, ang error ay ipinapadala na may standard HTTP code — 429 kapag overloaded ang model (may kasamang Retry-After header), 504 sa timeout, 503 kung walang natitirang libreng node. Kung ang error ay nangyari sa gitna ng stream, hindi na mababago ang status: mayroon pa ring chunk na may field na error, ngunit hindi na ipinapadala ang pangwakas na [DONE], para hindi magmukhang normal na natapos ang naturang stream.
Ang npx @joingonka/setup ay nag-o-configure na ngayon ng 15 agent tools: Claude Code, OpenClaw, Cursor, Cline, opencode, Aider, Kilo Code, Roo Code, Continue, Hermes, Pi, Zed, ZCode, JetBrains AI Assistant at GitHub Copilot BYOK. Para sa pito sa mga ito, ang config ay isinusulat at maayos na ipinagsasama sa iyong sarili (ang mga komento at existing settings ay napananatili), habang para sa iba na kailangan lang i-configure sa pamamagitan ng interface, ipinapakita ang mga ready-to-paste na values. Maaari mong piliin agad ang tool na kailangan: npx @joingonka/setup --tool zed. Ang bawat pagtakbo ay nagtatapos sa isang live query sa gateway na nagkukumpirma na ang key, address, at model ay tinanggap.
Ang maximum na haba ng isang response para sa DeepSeek V4 Flash ay itinaas nang 4 na beses: mula 8,192 hanggang 32,768 tokens (max_tokens parameter). Ang mga malalaking file at mahabang response mula sa mga agent tools ay kasya na ngayon sa isang tawag. Karagdagan: kung ang response ay umabot sa limit sa gitna ng tawag sa tool, ang gateway ay nagbabalik ng tamang finish_reason="length" sa halip na putol na tawag — ang mga agent client (Cursor at iba pa) ay nagpapatuloy sa paggana nang tama sa halip na mag-hang sa parsing error.
May pangatlong active na modelo na sa network ng Gonka — DeepSeek V4 Flash 0731: 380,000 token context (pinakamahaba sa network, na-verify ng totoong 381K request), reasoning, at tool calling. Ang identifier ay deepseek-ai/DeepSeek-V4-Flash-0731, at ang presyo ay pareho sa ibang mga modelo. Ang modelo ay nasa early testing pa lang pero fully available na: piliin ito sa dashboard chat o ilagay sa model field ng iyong API request.
Mula Agosto 3, ang gastos sa inference ay: input — 22 nGNK, output — 66 nGNK bawat token (dobleng mas mataas kaysa sa naunang 11/33). Ang bayad sa gateway ay hindi nagbago sa 10%. Ang demo mode ay mananatiling libre. Ang mga kasalukuyang presyo para sa lahat ng modelo ay nasa pahina ng Pricing at GET /api/pricing.
Kung ang network ng Gonka ay nakatanggap ng kahilingan ngunit hindi sumagot (timeout na 300s), ang gateway ay agad na nagbabalik ng 504 error sa halip na serye ng mga tahimik na retry. Mahalagang paalala sa bayarin: ang kahilingang natanggap ng network ay hindi na maaaring kanselahin — ipoproseso pa rin ito ng node, kaya sa oras ng timeout, ang estimate para sa pag-proseso ng prompt ay ibabawas (ang completion ay hindi binabayaran). Rekomendasyon: para sa mahabang generation, gamitin ang stream:true — ang streaming ay mas matatag sa mga timeout at ipinapakita agad ang progress.
Ang bayad sa deposito sa pamamagitan ng USDT ay bumababa na ngayon habang lumalaki ang halaga: base 5%, mula $25 — 4.5%, mula $50 — 4%, mula $100 — 3.5%, mula $250 — 3%, mula $500 — 2.75%, mula $1000 — 2.5%. Ang dialog ng deposito ay may interactive na ladder: slider ng halaga, GNK bonus para sa bawat lebel, at ang iyong matitipid. Ang diskwento ay awtomatikong inilalapat kapag pumasok na ang pondo.
Maaari kang magtakda ng kabuuang (cumulative) limitasyon sa paggastos para sa mga child key — isang nakalaang quota na hindi nagre-reset, hindi tulad ng pang-araw-araw o buwanang limitasyon. Kapag naubos na ang quota, tatanggihan ang mga request gamit ang key. Itinatakda ang limitasyon sa dashboard (na may precision na nanogonka) o sa pamamagitan ng API gamit ang field na limit_total_ngonka sa POST/PATCH /api/management/keys/{id}/children; ang naipong paggamit ay nire-reset gamit ang "Reset usage" na button (o POST /api/management/keys/{id}/children/{childId}/reset-usage).
Ang gastos sa inferenced ay naka-synchronize sa aktwal na presyo ng Gonka network kada token. Ang mga presyo ay nananatiling isa sa pinakamababa sa merkado – maliit na bahagi ng isang sentimo kada milyong token, daan-daang beses na mas mura kaysa sa OpenAI at Anthropic gamit ang parehong open-source models. Ang mga output token ay mas mahal kumpara sa input tokens (×3), gaya ng ginagawa ng karamihan sa mga provider.
Kinumpirma namin ang totoong limitasyon ng context ng mga aktibong modelo – hanggang 200 000 tokens (dati ay 131 072 ang ipinapakita). Maaari ka nang magpadala ng mas mahabang dokumento at kasaysayan ng usapan; ang mga kasalukuyang detalye ng bawat modelo ay matatagpuan sa seksyong «Katayuan ng Network».
Ang gastos ng bawat request ay makikita sa dolyar — sa response ng API (field na usage.total_cost_usd) at sa section na "Paggamit" (Usage). Maginhawa ito para sa pagpaplano ng budget.
I-setup ang access sa API sa iyong tool nang awtomatiko: patakbuhin ang npx @joingonka/setup. Suportado ang Claude Code, OpenClaw, Cline, Continue, opencode, Aider at iba pa.
Ang modelo ay naghahanap sa internet habang nagreresponse at nagdadagdag ng mga source link. Paano i-enable: ilagay sa body ng request ang plugins: [{ "id": "web", "max_results": 5 }] — gumagana sa OpenAI- at Anthropic-compatible na API.
Ang maximum na haba ng response ay hanggang 8192 tokens; kontrolin gamit ang parametrong max_tokens (default ay 1024 para sa streaming response at 1500 para sa normal).
Sa pahina ng "Chat", pumili ng modelo mula sa listahan (naglo-load mula sa /v1/models) — ang napiling modelo ay mase-save at ilalapat sa mga bagong dialog.
Kailangan ng bilis? Magdagdag ng header na x-joingonka-meta: 1 sa iyong request — sa streaming response, lalabas ang ttft_ms (time to first token) at tokens_per_sec.
Gumawa ng management key (POST /api/management/keys) at gumawa ng mga child key na may mga limitasyon (daily at monthly quota, rate limit, duration) sa pamamagitan ng POST /api/management/keys/{id}/children.
Gumamit ng mga plugin gamit ang parametrong plugins: ang response-healing ay nag-aayos ng putol na JSON, ang privacy-sanitization ay nagtatakip ng pribadong data, ang file-parser ay kumukuha ng text mula sa mga PDF at dokumento.
OpenAI: base_url https://gate.joingonka.ai/v1, header Authorization: Bearer iyong-key. Anthropic (Claude Code): base_url https://gate.joingonka.ai, header x-api-key, endpoint /v1/messages.
GNK: kunin ang address at memo, at ipadala ang tokens on-chain. USDT: ilagay ang halaga mula 1 hanggang 10,000 dolyar at magbayad sa pamamagitan ng OxaPay — awtomatiko ang conversion sa GNK.