Mga Update at Status
Kasalukuyang estado ng inference at kasaysayan ng mga pagbabago sa gateway.
Kasalukuyang status
- MiniMax M2.7Gonka Network: Operational
- Kimi K2.6Gonka Network: Operational
- DeepSeek V4 FlashGonka Network: Operational
Ang hanay ng mga aktibong modelo ay tinutukoy sa pamamagitan ng pagboto ng network ng Gonka at maaaring magbago: ang ilang mga modelo ay pansamantalang hindi available at babalik sa ibang pagkakataon. Ang kasalukuyang listahan ay nasa itaas.
Detalyadong status at uptime →Kasaysayan ng mga update
Ang maximum na haba ng isang response para sa DeepSeek V4 Flash ay itinaas nang 4 na beses: mula 8,192 hanggang 32,768 tokens (max_tokens parameter). Ang mga malalaking file at mahabang response mula sa mga agent tools ay kasya na ngayon sa isang tawag. Karagdagan: kung ang response ay umabot sa limit sa gitna ng tawag sa tool, ang gateway ay nagbabalik ng tamang finish_reason="length" sa halip na putol na tawag — ang mga agent client (Cursor at iba pa) ay nagpapatuloy sa paggana nang tama sa halip na mag-hang sa parsing error.
May pangatlong active na modelo na sa network ng Gonka — DeepSeek V4 Flash 0731: 380,000 token context (pinakamahaba sa network, na-verify ng totoong 381K request), reasoning, at tool calling. Ang identifier ay deepseek-ai/DeepSeek-V4-Flash-0731, at ang presyo ay pareho sa ibang mga modelo. Ang modelo ay nasa early testing pa lang pero fully available na: piliin ito sa dashboard chat o ilagay sa model field ng iyong API request.
Mula Agosto 3, ang gastos sa inference ay: input — 22 nGNK, output — 66 nGNK bawat token (dobleng mas mataas kaysa sa naunang 11/33). Ang bayad sa gateway ay hindi nagbago sa 10%. Ang demo mode ay mananatiling libre. Ang mga kasalukuyang presyo para sa lahat ng modelo ay nasa pahina ng Pricing at GET /api/pricing.
Kung ang network ng Gonka ay nakatanggap ng kahilingan ngunit hindi sumagot (timeout na 300s), ang gateway ay agad na nagbabalik ng 504 error sa halip na serye ng mga tahimik na retry. Mahalagang paalala sa bayarin: ang kahilingang natanggap ng network ay hindi na maaaring kanselahin — ipoproseso pa rin ito ng node, kaya sa oras ng timeout, ang estimate para sa pag-proseso ng prompt ay ibabawas (ang completion ay hindi binabayaran). Rekomendasyon: para sa mahabang generation, gamitin ang stream:true — ang streaming ay mas matatag sa mga timeout at ipinapakita agad ang progress.
Ang bayad sa deposito sa pamamagitan ng USDT ay bumababa na ngayon habang lumalaki ang halaga: base 5%, mula $25 — 4.5%, mula $50 — 4%, mula $100 — 3.5%, mula $250 — 3%, mula $500 — 2.75%, mula $1000 — 2.5%. Ang dialog ng deposito ay may interactive na ladder: slider ng halaga, GNK bonus para sa bawat lebel, at ang iyong matitipid. Ang diskwento ay awtomatikong inilalapat kapag pumasok na ang pondo.
Maaari kang magtakda ng kabuuang (cumulative) limitasyon sa paggastos para sa mga child key — isang nakalaang quota na hindi nagre-reset, hindi tulad ng pang-araw-araw o buwanang limitasyon. Kapag naubos na ang quota, tatanggihan ang mga request gamit ang key. Itinatakda ang limitasyon sa dashboard (na may precision na nanogonka) o sa pamamagitan ng API gamit ang field na limit_total_ngonka sa POST/PATCH /api/management/keys/{id}/children; ang naipong paggamit ay nire-reset gamit ang "Reset usage" na button (o POST /api/management/keys/{id}/children/{childId}/reset-usage).
Ang gastos sa inferenced ay naka-synchronize sa aktwal na presyo ng Gonka network kada token. Ang mga presyo ay nananatiling isa sa pinakamababa sa merkado – maliit na bahagi ng isang sentimo kada milyong token, daan-daang beses na mas mura kaysa sa OpenAI at Anthropic gamit ang parehong open-source models. Ang mga output token ay mas mahal kumpara sa input tokens (×3), gaya ng ginagawa ng karamihan sa mga provider.
Kinumpirma namin ang totoong limitasyon ng context ng mga aktibong modelo – hanggang 200 000 tokens (dati ay 131 072 ang ipinapakita). Maaari ka nang magpadala ng mas mahabang dokumento at kasaysayan ng usapan; ang mga kasalukuyang detalye ng bawat modelo ay matatagpuan sa seksyong «Katayuan ng Network».
Ang gastos ng bawat request ay makikita sa dolyar — sa response ng API (field na usage.total_cost_usd) at sa section na "Paggamit" (Usage). Maginhawa ito para sa pagpaplano ng budget.
I-setup ang access sa API sa iyong tool nang awtomatiko: patakbuhin ang npx @joingonka/setup. Suportado ang Claude Code, OpenClaw, Cline, Continue, opencode, Aider at iba pa.
Ang modelo ay naghahanap sa internet habang nagreresponse at nagdadagdag ng mga source link. Paano i-enable: ilagay sa body ng request ang plugins: [{ "id": "web", "max_results": 5 }] — gumagana sa OpenAI- at Anthropic-compatible na API.
Ang maximum na haba ng response ay hanggang 8192 tokens; kontrolin gamit ang parametrong max_tokens (default ay 1024 para sa streaming response at 1500 para sa normal).
Sa pahina ng "Chat", pumili ng modelo mula sa listahan (naglo-load mula sa /v1/models) — ang napiling modelo ay mase-save at ilalapat sa mga bagong dialog.
Kailangan ng bilis? Magdagdag ng header na x-joingonka-meta: 1 sa iyong request — sa streaming response, lalabas ang ttft_ms (time to first token) at tokens_per_sec.
Gumawa ng management key (POST /api/management/keys) at gumawa ng mga child key na may mga limitasyon (daily at monthly quota, rate limit, duration) sa pamamagitan ng POST /api/management/keys/{id}/children.
Gumamit ng mga plugin gamit ang parametrong plugins: ang response-healing ay nag-aayos ng putol na JSON, ang privacy-sanitization ay nagtatakip ng pribadong data, ang file-parser ay kumukuha ng text mula sa mga PDF at dokumento.
OpenAI: base_url https://gate.joingonka.ai/v1, header Authorization: Bearer iyong-key. Anthropic (Claude Code): base_url https://gate.joingonka.ai, header x-api-key, endpoint /v1/messages.
GNK: kunin ang address at memo, at ipadala ang tokens on-chain. USDT: ilagay ang halaga mula 1 hanggang 10,000 dolyar at magbayad sa pamamagitan ng OxaPay — awtomatiko ang conversion sa GNK.