اپ ڈیٹس اور اسٹیٹس

انفرنس کی موجودہ حالت اور گیٹ وے کی تبدیلیوں کی تاریخ۔

موجودہ اسٹیٹس

گونکا نیٹ ورک: خراب کارکردگی
نیٹ ورک ماڈلز
  • MiniMax M2.7گونکا نیٹ ورک: خراب کارکردگی
  • DeepSeek V4 Flashگونکا نیٹ ورک: خراب کارکردگی
  • GLM 5.3 Flashگونکا نیٹ ورک: آپریشنل

فعال ماڈلز کا سیٹ Gonka نیٹ ورک کی ووٹنگ سے طے ہوتا ہے اور یہ تبدیل ہو سکتا ہے: کچھ ماڈلز بعض اوقات دستیاب نہیں ہوتے اور بعد میں واپس آ جاتے ہیں۔ موجودہ فہرست اوپر دی گئی ہے۔

تفصیلی اسٹیٹس اور اپ ٹائم →

اپ ڈیٹ ہسٹری

ستمبر 2026
نیا
Ethereum سے WGNK ڈپازٹ23 ستمبر

آپ WGNK ٹوکن کے ساتھ اپنا بیلنس ریچارج کر سکتے ہیں — یہ Ethereum نیٹ ورک پر GNK ہے۔ اپنے اکاؤنٹ میں: ٹاپ اپ → GNK → Ethereum · WGNK؛ وہ ایڈریس بتائیں جہاں سے آپ ٹوکن بھیجیں گے — ٹرانسفر خود بخود کریڈٹ ہو جائے گا، عام طور پر 15–20 منٹ میں۔

نیا
انسٹالر: 25 ٹولز21 ستمبر

npx @joingonka/setup اب 25 ٹولز کو کنفیگر کرتا ہے۔ نئے: Codex CLI, Kimi Code, omp, MiniMax Code, Goose, MiMo Code, Qwen Code, Factory Droid, Crush اور Zoo Code۔ ماڈل کا انتخاب --model فلیگ (minimax, deepseek یا glm) کے ذریعے کیا جاتا ہے، ڈیفالٹ DeepSeek V4 Flash ہے۔ آخر میں، انسٹالر ایک تصدیقی درخواست بھیجتا ہے اور فوراً دکھاتا ہے کہ کیا کلید کام کر رہی ہے۔

بہتری
ویلکم بونس دوگنا: نئے اکاؤنٹس کے لیے 100,000,000 nGNK16 ستمبر

16 ستمبر سے، ہر نیا اکاؤنٹ 50,000,000 کے بجائے 100,000,000 nGNK (0.1 GNK) حاصل کرتا ہے — نیٹ ورک کی موجودہ قیمت کے مطابق، یہ بغیر ڈپازٹ کیے ٹیسٹ کرنے کے لیے تقریباً 3 ملین ٹوکنز کے برابر ہے۔ بونس رجسٹریشن کے وقت خود بخود کریڈٹ ہو جاتا ہے، کچھ بھی ان پٹ کرنے کی ضرورت نہیں ہے؛ موجودہ رقم ہمیشہ GET /api/pricing (فیلڈ welcome_bonus_ngonka) اور رجسٹریشن کے صفحے پر دیکھی جا سکتی ہے۔

بہتری
لمبی جنریشن کا کٹ جانا — ایماندار finish_reason=length16 ستمبر

Gonka نیٹ ورک کے نوڈز تقریباً 5 منٹ کی جنریشن کے بعد کسی بھی اسٹریم کو بند کر دیتے ہیں (GLM 5.3 Flash کے لیے یہ تقریباً 8,000 token ہیں)۔ پہلے ایسا کٹ آف عام اختتام جیسا دکھائی دیتا تھا: اسٹریم بغیر کسی finish_reason کے [DONE] پر ختم ہو جاتی تھی، اور کلائنٹ ادھورے جواب کو مکمل جواب سمجھ لیتا تھا۔ اب گیٹ وے finish_reason="length" کے ساتھ ایک chunk بھیجتا ہے — اسٹریم اور عام جواب دونوں میں، اور Anthropic فارمیٹ میں یہ stop_reason="max_tokens" ہے۔ لمبے جوابات کے ساتھ کیا کریں: stream:true استعمال کریں اور finish_reason="length" ملنے پر، پہلے سے موصول شدہ حصے کو کنٹیکسٹ میں پاس کرتے ہوئے اگلے ریکوسٹ کے ساتھ جنریشن جاری رکھیں۔ تفصیلات ڈاکومنٹیشن کے “Limits” سیکشن میں ہیں۔

نیا
نیا ماڈل: GLM 5.3 Flash — Z.ai کی طرف سے reasoning16 ستمبر

Gonka نیٹ ورک پر Z.ai کا GLM 5.3 Flash دستیاب ہے: 320B پیرامیٹرز (MoE, 18B ایکٹو)، FP8، MIT لائسنس، 390,000 ٹوکنز کا کانٹیکسٹ۔ ماڈل جواب دینے سے پہلے استدلال کرتا ہے: استدلال reasoning_content فیلڈ میں آتا ہے اور جواب کا بجٹ استعمال کرتا ہے، اس لیے max_tokens کم از کم 600 سیٹ کریں یا stream:true استعمال کریں؛ چھوٹے کاموں کے لیے — reasoning_effort: "low"۔ Tool calling اور JSON-موڈ کام کرتے ہیں۔ شناخت کنندہ — zai-org/GLM-5.3-Flash، قیمت نیٹ ورک کے دوسرے ماڈلز کے برابر ہے۔ Kimi K2.6 اب نیٹ ورک کی طرف سے سپورٹڈ نہیں ہے — اپنے انٹیگریشنز کو MiniMax M2.7, DeepSeek V4 Flash یا GLM 5.3 Flash پر سوئچ کریں۔

نیا
ماڈل کے لحاظ سے استعمال کے اعدادوشمار15 ستمبر

"استعمال" کا صفحہ ہر ماڈل کے لیے کھپت کو ظاہر کرتا ہے: درخواستیں، ان پٹ/آؤٹ پٹ token، nGNK اور ڈالر میں لاگت، فی 1M token اوسط قیمت اور ردعمل کی رفتار۔ "آج" کو گھنٹہ وار دکھایا جاتا ہے، اور "90 دن" کا پیش سیٹ شامل کیا گیا ہے۔ انٹیگریشنز کے لیے: GET /api/usage/by-model۔

اگست 2026
نیا
legacy OpenAI Completions کے لیے سپورٹ24 اگست

گیٹ وے اب /v1/completions کے لیے درخواستیں قبول کرتا ہے — OpenAI کا "text" اینڈ پوائنٹ: یہ ان پٹ کے طور پر ایک prompt اسٹرنگ لیتا ہے اور آؤٹ پٹ کے طور پر choices[].text واپس کرتا ہے۔ یہ ایڈیٹر پلگ انز کے ذریعہ آٹو مکمل اور ان لائن کوڈ ایڈیٹنگ (Continue.dev اور اس جیسی) کے لیے استعمال ہوتا ہے۔ Base URL وہی ہے: https://gate.joingonka.ai/v1۔ اسٹریمنگ اور معیاری پیرامیٹرز (max_tokens, temperature, stop) تعاون یافتہ ہیں، جس کی لاگت اور حدود /v1/chat/completions کے جیسی ہی ہیں۔ logprobs اور best_of فیلڈز تعاون یافتہ نہیں ہیں۔

بہتری
انفرنس ٹیرف اپ ڈیٹ22 اگست

22 اگست سے انفرنس (inference) کی لاگت: ان پٹ — 33 nGNK، آؤٹ پٹ — 99 nGNK فی ٹوکن (پہلے 22/66 تھی)۔ گیٹ وے کمیشن میں کوئی تبدیلی نہیں ہے — 10%۔ ڈیمو موڈ مفت رہے گا۔ اضافہ کیوں ہوا: Gonka نیٹ ورک میں ایک درخواست (request) redundancy کے ساتھ پروسیس کی جاتی ہے — یہ پروٹوکول اور devshards کوڈ کا حصہ ہے، جو سروس کی روانی کے لیے ضروری ہے۔ ایک کنٹینر درخواست کو ایک ہوسٹ پر بھیج سکتا ہے، پھر دوسرے پر اگر پہلا کامیاب نہ ہو، اور ضرورت پڑنے پر ایک ساتھ کئی ہوسٹس پر بھیج سکتا ہے۔ ہر کوشش کی ادائیگی ہوتی ہے: نیٹ ورک کی قیمت 10 nGNK فی ٹوکن ہے، جسے درخواست کی redundancy سے ضرب دیا جاتا ہے (اوسطاً ×1—2.5)۔ پہلے، یہ لاگت ہم تک نہیں پہنچتی تھی کیونکہ پرائس فائنلائزیشن API کام نہیں کر رہا تھا اور ہم صرف ایک ہوسٹ کے لیے ادائیگی کر رہے تھے؛ اب یہ اصل استعمال کے حساب سے گنی جاتی ہے اور ہم اسے ٹیرف میں شامل کر رہے ہیں۔ انفرنس اب بھی وینڈر API کے مقابلے میں سینکڑوں گنا سستا ہے۔ تمام ماڈلز کی موجودہ قیمتیں Pricing صفحہ اور GET /api/pricing پر دستیاب ہیں۔

نیا
OpenAI Responses API سپورٹ22 اگست

گیٹ وے Responses فارمیٹ میں درخواستیں قبول کرتا ہے — جو OpenAI کا ایک نیا پروٹوکول ہے جسے حالیہ SDKs نے اپنا لیا ہے اور جس کے ذریعے Codex CLI کام کرتا ہے۔ ایڈریس وہی ہے: base URL https://gate.joingonka.ai/v1، کلائنٹ خود بخود /v1/responses سے رابطہ کرے گا۔ سٹریمنگ، function tools اور سٹرکچرڈ آؤٹ پٹ (text.format) کام کرتے ہیں، اخراجات اور حدود /v1/chat/completions جیسی ہی ہیں۔ ہم ڈائیلاگز کو محفوظ نہیں کرتے ہیں، اس لیے store کو نظر انداز کر دیا جاتا ہے اور previous_response_id ایک ایرر واپس کرے گا — براہ کرم پوری ہسٹری input فیلڈ میں پاس کریں۔ OpenAI کے بلٹ ان سرور ٹولز (web_search, file_search, code_interpreter) سپورٹڈ نہیں ہیں؛ ہماری ویب سرچ اب بھی /v1/chat/completions پر web پلگ ان کے ذریعے دستیاب ہے۔

اصلاح
درست HTTP کوڈ کے ساتھ اسٹریم کی غلطیاں20 اگست

پہلے stream:true موڈ میں Gonka نیٹ ورک کی غلطیاں 200 کوڈ کے ساتھ آتی تھیں اور غلطی صرف SSE-chunk کے اندر دکھائی دیتی تھی: ایجنٹ کلائنٹ اسے ایک خالی کامیاب جواب سمجھ لیتے تھے اور دوبارہ کوشش نہیں کرتے تھے۔ اب، نیٹ ورک سے جواب شروع ہونے سے پہلے، غلطی کو عام HTTP کوڈ کے ساتھ بھیجا جاتا ہے - ماڈل اوورلوڈ ہونے پر 429 (Retry-After ہیڈر کے ساتھ)، ٹائم آؤٹ پر 504، اور اگر کوئی نوڈ خالی نہ ہو تو 503۔ اگر غلطی اسٹریم کے درمیان میں ہوتی ہے، تو اسٹیٹس تبدیل نہیں کیا جا سکتا: وہاں error فیلڈ کے ساتھ ایک chunk موجود رہتا ہے، لیکن آخری [DONE] اب نہیں بھیجا جاتا، تاکہ ایسی اسٹریم عام طور پر مکمل نہ دکھائی دے۔

نیا
انسٹالر: ایک کمانڈ میں 15 ٹولز20 اگست

npx @joingonka/setup اب 15 ایجنٹ ٹولز کو کنفیگر کرتا ہے: Claude Code, OpenClaw, Cursor, Cline, opencode, Aider, Kilo Code, Roo Code, Continue, Hermes, Pi, Zed, ZCode, JetBrains AI Assistant اور GitHub Copilot BYOK۔ ان میں سے سات کے لیے کنفیگریشن لکھی جاتی ہے اور اسے آپ کی کنفیگریشن کے ساتھ صفائی سے ضم کر دیا جاتا ہے (تبصرے اور موجودہ ترتیبات محفوظ رہتی ہیں)، باقی جو صرف انٹرفیس کے ذریعے کنفیگر کیے جا سکتے ہیں، ان کے لیے کاپی پیسٹ کرنے کے لیے تیار اقدار پرنٹ کی جاتی ہیں۔ مطلوبہ ٹول فوری طور پر منتخب کیا جا سکتا ہے: npx @joingonka/setup --tool zed۔ ہر رن ایک لائیو گیٹ وے کوئری کے ساتھ ختم ہوتا ہے، جو تصدیق کرتا ہے کہ کلید، پتہ اور ماڈل قبول کر لیے گئے ہیں۔

بہتری
DeepSeek ریسپانس لمٹ — 32,768 ٹوکن17 اگست

DeepSeek V4 Flash کے لیے ایک واحد ریسپانس کی زیادہ سے زیادہ لمبائی 4 گنا بڑھا دی گئی ہے: 8,192 سے 32,768 ٹوکن (max_tokens پیرامیٹر) تک۔ بڑی فائلیں اور ایجنٹ ٹولز کے طویل ریسپانس اب ایک ہی کال میں فٹ ہو جاتے ہیں۔ مزید برآں: اگر ریسپانس ٹول کال کے درمیان میں لمٹ تک پہنچ جاتا ہے، تو گیٹ وے ٹوٹی ہوئی کال کے بجائے ایک درست finish_reason="length" واپس بھیجتا ہے — ایجنٹ کلائنٹس (Cursor اور دیگر) پارسنگ ایرر پر ہینگ ہونے کے بجائے درست طریقے سے کام جاری رکھتے ہیں۔

نیا
نیا ماڈل: 380K سیاق و سباق (context) کے ساتھ DeepSeek V4 Flash13 اگست

Gonka نیٹ ورک میں تیسرا فعال ماڈل آ گیا ہے — DeepSeek V4 Flash 0731: 380,000 ٹوکن سیاق و سباق (نیٹ ورک میں سب سے طویل، 381K کی حقیقی درخواست سے تصدیق شدہ)، reasoning اور tool calling۔ اس کا شناخت کنندہ (identifier) deepseek-ai/DeepSeek-V4-Flash-0731 ہے، اور قیمت دیگر ماڈلز جیسی ہی ہے۔ یہ ماڈل ابتدائی ٹیسٹنگ میں ہے لیکن مکمل طور پر دستیاب ہے: ڈیش بورڈ چیٹ میں اسے منتخب کریں یا اپنی API درخواست کے model فیلڈ میں اس کی وضاحت کریں۔

بہتری
انفرنس قیمتوں میں اپ ڈیٹ3 اگست

3 اگست سے، انفرنس کی قیمت یہ ہے: ان پٹ — 22 nGNK، آؤٹ پٹ — 66 nGNK فی ٹوکن (پچھلے 11/33 سے دگنی)۔ گیٹ وے فیس 10% پر برقرار ہے۔ ڈیمو موڈ مفت رہتا ہے۔ تمام ماڈلز کی موجودہ قیمتیں Pricing صفحہ اور GET /api/pricing پر دستیاب ہیں۔

جولائی 2026
بہتری
منصفانہ ٹائم آؤٹ: 5 منٹ کے تعطل کے بجائے فوری 50423 جولائی

اگر Gonka نیٹ ورک کو درخواست موصول ہوتی ہے لیکن جواب نہیں دیتا (300 سیکنڈ کا ٹائم آؤٹ)، تو گیٹ وے اب خاموش ری ٹرائز کی سیریز کے بجائے فوری طور پر 504 ایرر واپس کرتا ہے۔ بلنگ کے بارے میں اہم نوٹ: نیٹ ورک کی طرف سے قبول کردہ درخواست کو منسوخ نہیں کیا جا سکتا — نوڈ ہر حال میں اسے پروسیس کرتا ہے، اس لیے ٹائم آؤٹ ہونے پر پرامپٹ پروسیسنگ کا تخمینہ منہا کر دیا جاتا ہے (completion پر معاوضہ نہیں لیا جاتا)۔ تجویز: طویل جنریشنز کے لیے، stream:true استعمال کریں — سٹریمنگ ٹائم آؤٹس کے خلاف زیادہ لچکدار ہے اور پیشرفت کو فوری دکھاتی ہے۔

نیا
USDT ڈیپازٹ فیس میں کمی کا نظام — 50% تک9 جولائی

USDT کے ذریعے ڈیپازٹ فیس اب رقم بڑھنے کے ساتھ کم ہوتی ہے: بنیادی 5%، $25 سے — 4.5%، $50 سے — 4%، $100 سے — 3.5%، $250 سے — 3%، $500 سے — 2.75%، $1000 سے — 2.5%۔ ڈیپازٹ ڈائیلاگ میں ایک انٹرایکٹو سیڑھی موجود ہے: رقم کا سلائیڈر، ہر مرحلے پر GNK بونس اور آپ کی بچت۔ رعایت خود بخود ڈیپازٹ ہونے پر لاگو ہو جاتی ہے۔

جون 2026
نیا
کلیدی کل خرچ کی حد28 جون

آپ چائلڈ کیز کے لیے کل (مجموعی) اخراجات کی حد مقرر کر سکتے ہیں — ایک مخصوص کوٹہ جو روزانہ یا ماہانہ حدود کے برعکس ری سیٹ نہیں ہوتا ہے۔ کوٹہ ختم ہونے پر، کلید استعمال کرنے والی درخواستوں کو مسترد کر دیا جاتا ہے۔ حد ڈیش بورڈ میں (nanogonka کی درستگی کے ساتھ) یا API کے ذریعے POST/PATCH /api/management/keys/{id}/children میں limit_total_ngonka فیلڈ کا استعمال کرتے ہوئے سیٹ کی जाती ہے؛ مجموعی استعمال کو "Reset usage" بٹن (یا POST /api/management/keys/{id}/children/{childId}/reset-usage) سے ری سیٹ کیا جاتا ہے۔

بہتری
قیمت کا تعین — اصلی نیٹ ورک قیمت پر27 جون

inferenced کی لاگت کو اصل Gonka نیٹ ورک کی فی ٹوکن قیمت کے ساتھ ہم آہنگ کیا گیا ہے۔ قیمتیں مارکیٹ میں سب سے کم ہیں – فی ملین ٹوکن پر سینٹ کا ایک حصہ، جو کہ انہی open-source ماڈلز کے لیے OpenAI اور Anthropic سے سیکڑوں گنا سستا ہے۔ آؤٹ پٹ ٹوکنز (output tokens) کی چارجنگ ان پٹ ٹوکنز (input tokens) سے زیادہ ہے (×3)، جیسا کہ زیادہ تر فراہم کنندگان کرتے ہیں۔

بہتری
200 000 ٹوکنز تک کا کنٹیکسٹ (context)27 جون

ہم نے فعال ماڈلز کی حقیقی کنٹیکسٹ حد کی تصدیق کی ہے – 200 000 ٹوکنز تک (پہلے کم 131 072 بتائی گئی تھی)۔ اب آپ لمبے دستاویزات اور گفتگو کی ہسٹری بھیج سکتے ہیں؛ ہر ماڈل کی موجودہ خصوصیات «نیٹ ورک اسٹیٹس» سیکشن میں دستیاب ہیں۔

بہتری
ڈالر میں درخواستوں کی قیمت23 جون

ہر درخواست کی قیمت ڈالر میں دیکھی جا سکتی ہے — API جواب میں (usage.total_cost_usd فیلڈ میں) اور "استعمال" کے سیکشن میں۔ اخراجات کا منصوبہ بنانا آسان ہے۔

نیا
ایک کمانڈ سے کنکشن23 جون

اپنے ٹول میں API تک رسائی خود بخود سیٹ اپ کریں: npx @joingonka/setup چلائیں۔ Claude Code، OpenClaw، Cline، Continue، opencode، Aider اور دیگر معاون ہیں۔

نیا
ریئل ٹائم ویب سرچ17 جون

ماڈل جواب دیتے وقت انٹرنیٹ پر تلاش کرتا ہے اور ذرائع کے لنکس شامل کرتا ہے۔ فعال کرنے کا طریقہ: ریکوسٹ باڈی میں plugins: [{ "id": "web", "max_results": 5 }] پاس کریں — یہ OpenAI اور Anthropic کے ساتھ ہم آہنگ API پر کام کرتا ہے۔

مئی 2026
بہتری
8192 ٹوکن تک طویل جوابات25 مئی

جواب کی زیادہ سے زیادہ لمبائی 8192 ٹوکن تک؛ max_tokens پیرامیٹر کو کنٹرول کریں (ڈیفالٹ 1024 اسٹریمنگ جواب کے لیے اور 1500 عام کے لیے)۔

نیا
چیٹ میں ماڈل کا انتخاب5 مئی

"چیٹ" کے صفحے پر فہرست سے ماڈل منتخب کریں (/v1/models سے لوڈ ہوتا ہے) — آپ کا انتخاب محفوظ رہے گا اور نئی گفتگو پر لاگو ہوگا۔

بہتری
رسپانس اسپیڈ میٹرکس5 مئی

رفتار چاہیے؟ اپنی ریکوسٹ میں x-joingonka-meta: 1 ہیڈر شامل کریں — اسٹریمنگ جواب میں ttft_ms (پہلے ٹوکن تک کا وقت) اور tokens_per_sec موصول ہوں گے۔

مارچ 2026
نیا
ری سیل کے لیے مینجمنٹ کیز24 مارچ

ایک مینجمنٹ کی بنائیں (POST /api/management/keys) اور POST /api/management/keys/{id}/children کے ذریعے حدود (روزانہ اور ماہانہ کوٹہ، rate limit، میعاد) کے ساتھ چائلڈ کیز بنائیں۔

نیا
ریکوسٹ پروسیسنگ پلگ انز24 مارچ

plugins پیرامیٹر کے ساتھ پلگ انز شامل کریں: response-healing کٹے ہوئے JSON کو ٹھیک کرتا ہے، privacy-sanitization نجی ڈیٹا کو ماسک کرتا ہے، file-parser پی ڈی ایف اور دستاویزات سے ٹیکسٹ نکالتا ہے۔

نیا
OpenAI اور Anthropic کے ساتھ ہم آہنگ API19 مارچ

OpenAI: base_url https://gate.joingonka.ai/v1، ہیڈر Authorization: Bearer آپ-کی-کی۔ Anthropic (Claude Code): base_url https://gate.joingonka.ai، ہیڈر x-api-key، اینڈ پوائنٹ /v1/messages۔

نیا
GNK اور USDT میں ڈپازٹ18 مارچ

GNK: ایڈریس اور memo حاصل کریں اور آن چین ٹوکن بھیجیں۔ USDT: 1 سے 10,000 ڈالر تک کی رقم بتائیں اور OxaPay کے ذریعے ادائیگی کریں — یہ خود بخود GNK میں تبدیل ہو جائے گا۔