التحديثات والحالة
حالة الـ inferenced الحالية وسجل تغييرات الجيت واي.
الحالة الحالية
- MiniMax M2.7شبكة Gonka: أداء متدهور
- DeepSeek V4 Flashشبكة Gonka: أداء متدهور
- GLM 5.3 Flashشبكة Gonka: قيد التشغيل
يتم تحديد مجموعة النماذج النشطة من خلال تصويت شبكة Gonka ويمكن أن تتغير: بعض النماذج قد تكون غير متاحة مؤقتاً وتعود لاحقاً. القائمة المحدثة أعلاه.
الحالة التفصيلية ووقت التشغيل →سجل التحديثات
يمكنك شحن رصيدك باستخدام رمز WGNK — وهو عبارة عن GNK على شبكة Ethereum. في حسابك: إيداع → GNK → Ethereum · WGNK; حدد العنوان الذي سترسل منه الرموز المميزة — سيتم إضافة التحويل تلقائياً، عادةً في غضون 15–20 دقيقة.
يقوم npx @joingonka/setup الآن بتهيئة 25 أداة. الإضافات الجديدة: Codex CLI, Kimi Code, omp, MiniMax Code, Goose, MiMo Code, Qwen Code, Factory Droid, Crush و Zoo Code. يتم اختيار النموذج عبر علامة --model (minimax, deepseek أو glm)، والافتراضي هو DeepSeek V4 Flash. في النهاية، يرسل المثبت طلب تحقق ويظهر فوراً ما إذا كان المفتاح يعمل.
اعتباراً من 16 سبتمبر، يحصل كل حساب جديد على 100,000,000 nGNK (0.1 GNK) بدلاً من 50,000,000 — وهذا يعادل، وفقاً لسعر الشبكة الحالي، حوالي 3 ملايين رمز لاختبارها دون الحاجة إلى إيداع. تُضاف المكافأة تلقائياً عند التسجيل، ولا يلزم إدخال أي شيء؛ والمبلغ الحالي متاح دائماً في GET /api/pricing (حقل welcome_bonus_ngonka) وعلى صفحة التسجيل.
تقوم وسطاء شبكة Gonka بإنهاء أي تدفق بعد حوالي 5 دقائق من التوليد (بالنسبة لـ GLM 5.3 Flash، هذا حوالي 8000 توكن). سابقاً، كان هذا القطع يبدو وكأنه إنهاء طبيعي: ينتهي التدفق بـ [DONE] بدون finish_reason، وكان العميل يخطئ في اعتبار الجزء المبتور استجابة كاملة. الآن، تقوم البوابة بإرسال chunk مع finish_reason="length" في كل من التدفق والاستجابة العادية، و stop_reason="max_tokens" في تنسيق Anthropic. ماذا تفعل مع الاستجابات الطويلة: استخدم stream:true وعند حدوث finish_reason="length"، استمر في التوليد بالطلب التالي عن طريق تمرير الجزء المستلم مسبقاً في السياق. التفاصيل موجودة في قسم "الحدود" في الوثائق.
ظهر نموذج GLM 5.3 Flash من Z.ai في شبكة Gonka: يحتوي على 320B بارامتر (MoE، 18B نشط)، FP8، ترخيص MIT، وسياق 390 000 توكن. يقوم النموذج بالاستدلال قبل الإجابة: يأتي الاستدلال في حقل reasoning_content ويستهلك من ميزانية الإجابة، لذا يرجى ضبط max_tokens على 600 على الأقل أو استخدام stream:true؛ للمهام القصيرة استخدم reasoning_effort: "low". خاصية Tool calling ووضع JSON يعملان بشكل صحيح. المعرف هو zai-org/GLM-5.3-Flash، والسعر هو نفس سعر النماذج الأخرى في الشبكة. لم يعد Kimi K2.6 مدعوماً في الشبكة — يرجى تحويل التكاملات إلى MiniMax M2.7 أو DeepSeek V4 Flash أو GLM 5.3 Flash.
تعرض صفحة "الاستخدام" الاستهلاك لكل نموذج: الطلبات، ورموز الإدخال/الإخراج، والتكلفة بـ nGNK والدولار، ومتوسط السعر لكل 1M رمز، وسرعة الاستجابة. يتم عرض "اليوم" حسب الساعة، وتمت إضافة إعداد "90 يوماً" مسبقاً. لعمليات التكامل: GET /api/usage/by-model.
أصبح البوابة الآن تقبل طلبات إلى /v1/completions — نقطة نهاية "النص" في OpenAI: تأخذ سلسلة prompt كمدخل وترجع choices[].text كمخرج. تُستخدم هذه من قبل إضافات المحرر للإكمال التلقائي وتعديل الكود المضمن (Continue.dev وما شابه ذلك). لا يزال Base URL كما هو: https://gate.joingonka.ai/v1. يتم دعم البث والمعايير القياسية (max_tokens, temperature, stop)، بنفس التكاليف والحدود الخاصة بـ /v1/chat/completions. لا يتم دعم حقلي logprobs و best_of.
اعتباراً من 22 أغسطس، أصبحت تكلفة الاستدلال: المدخلات 33 nGNK، والمخرجات 99 nGNK لكل توكن (كانت سابقاً 22/66). تظل عمولة البوابة دون تغيير عند 10%. لا يزال وضع العرض التجريبي مجانياً. سبب الزيادة: يتم معالجة الطلبات في شبكة Gonka مع وجود فائض (redundancy) - وهذا جزء من البروتوكول وكود devshards اللازم لضمان سلاسة الخدمة. يمكن للحاوية إرسال طلب إلى مضيف واحد، ثم إلى آخر إذا فشل الأول، أو إلى عدة مضيفين في آن واحد إذا لزم الأمر. يتم دفع تكلفة كل محاولة: سعر الشبكة هو 10 nGNK لكل توكن، مضروباً في فائض الطلب (في المتوسط ×1—2.5). في السابق، لم تكن هذه التكلفة تصل إلينا بسبب عدم عمل API تحديد السعر، وكنا ندفع مقابل مضيف واحد؛ الآن يتم احتسابها بناءً على التكلفة الفعلية وقمنا بنقلها إلى التعرفة. لا يزال الاستدلال أرخص بمئات المرات من API الموردين. تتوفر الأسعار الحالية لجميع النماذج على صفحة Pricing وعبر GET /api/pricing.
تقبل البوابة الطلبات بتنسيق Responses — وهو بروتوكول جديد من OpenAI اعتمدته حزم SDK الحديثة ويستخدمه Codex CLI. العنوان لا يزال كما هو: base URL https://gate.joingonka.ai/v1، وسيقوم العميل تلقائيًا بالاتصال بـ /v1/responses. يتم دعم البث المباشر (streaming) و function tools والمخرجات المهيكلة (text.format)، والتكاليف والقيود هي نفسها المطبقة على /v1/chat/completions. نحن لا نخزن المحادثات، لذا يتم تجاهل store، وسيعيد previous_response_id خطأ — يرجى تمرير سجل المحادثة بالكامل في حقل input. أدوات خادم OpenAI المدمجة (web_search, file_search, code_interpreter) غير مدعومة؛ لا يزال البحث عبر الويب الخاص بنا متاحًا عبر الملحق web في /v1/chat/completions.
سابقاً، كانت أعطال شبكة Gonka في وضع stream:true تعيد رمز 200، وكان الخطأ مرئياً فقط داخل جزء SSE: كانت عملاء الوكيل يخطئون في اعتبار هذه الردود ناجحة وفارغة ولا يقومون بإعادة المحاولة. الآن، إذا لم يبدأ رد الشبكة بعد، يتم إرجاع الخطأ برمز HTTP قياسي — 429 عند تحميل زائد للنموذج (مع ترويسة Retry-After)، و 504 عند انتهاء المهلة، و 503 إذا لم تكن هناك عقد متاحة. إذا حدث الفشل في منتصف التدفق، لا يمكن تغيير الحالة: لا يزال هناك جزء يحتوي على حقل error، ولكن لم يعد يتم إرسال [DONE] النهائي حتى لا يبدو التدفق وكأنه اكتمل بنجاح.
يقوم npx @joingonka/setup الآن بتهيئة 15 أداة وكيل: Claude Code, OpenClaw, Cursor, Cline, opencode, Aider, Kilo Code, Roo Code, Continue, Hermes, Pi, Zed, ZCode, JetBrains AI Assistant و GitHub Copilot BYOK. بالنسبة لسبع منها، تتم كتابة الإعدادات ودمجها بدقة مع إعداداتك (يتم الاحتفاظ بالتعليقات والإعدادات الحالية)؛ أما البقية، التي يتم تهيئتها عبر الواجهة فقط، فيتم طباعة قيم جاهزة للصق. يمكنك اختيار أداة محددة على الفور: npx @joingonka/setup --tool zed. ينتهي كل تشغيل بطلب مباشر إلى البوابة، للتأكد من قبول المفتاح والعنوان والنموذج.
تمت زيادة الحد الأقصى لطول الاستجابة الواحدة لـ DeepSeek V4 Flash بمقدار 4 مرات: من 8,192 إلى 32,768 توكن (معامل max_tokens). أصبحت الملفات الكبيرة والردود الطويلة من أدوات الوكيل (agent tools) تتسع الآن في استدعاء واحد. بالإضافة إلى ذلك: إذا وصلت الاستجابة إلى الحد الأقصى في منتصف استدعاء الأداة، فإن البوابة (gateway) تعيد finish_reason="length" صحيح بدلاً من استدعاء مبتور، مما يسمح لعملاء الوكلاء (مثل Cursor وغيره) بمتابعة العمل بشكل صحيح بدلاً من التوقف بسبب خطأ في التحليل.
ظهر نموذج ثالث نشط في شبكة Gonka وهو DeepSeek V4 Flash 0731: سياق 380,000 توكن (الأطول في الشبكة، تم التحقق منه بطلب حقيقي بحجم 381K)، مع دعم reasoning و tool calling. المعرف هو deepseek-ai/DeepSeek-V4-Flash-0731، والسعر هو نفسه الخاص بالنماذج الأخرى. النموذج في مرحلة الاختبار المبكر ولكنه متاح بالكامل: اختره من دردشة لوحة التحكم أو حدده في حقل model الخاص بطلب API الخاص بك.
اعتباراً من 3 أغسطس، تكلفة الاستنتاج هي: المدخلات — 22 nGNK، المخرجات — 66 nGNK لكل توكن (ضعف الـ 11/33 السابقة). رسوم البوابة ظلت كما هي بنسبة 10%. وضع العرض التجريبي يظل مجانياً. الأسعار الحالية لجميع النماذج متاحة على صفحة Pricing و GET /api/pricing.
إذا استقبلت شبكة Gonka طلباً ولم تستجب (مهلة 300 ثانية)، يقوم الغيتواي الآن بإرجاع خطأ 504 فوراً بدلاً من سلسلة من المحاولات الصامتة. ملاحظة هامة حول الرسوم: لا يمكن إلغاء الطلب الذي قبلته الشبكة — حيث يقوم النود بمعالجته في كل الأحوال، لذا عند حدوث مهلة زمنية، يتم خصم تكلفة معالجة البرومبت (لا يتم محاسبة الـ completion). نصيحة: للعمليات الطويلة، استخدم stream:true — فالبث (stream) أكثر استقراراً تجاه المهلات ويظهر التقدم فوراً.
تنخفض الآن رسوم الإيداع عبر USDT مع زيادة المبلغ: الأساس 5%، بدءًا من $25 — 4.5%، من $50 — 4%، من $100 — 3.5%، من $250 — 3%، من $500 — 2.75%، من $1000 — 2.5%. تحتوي نافذة الإيداع على تدرج تفاعلي: شريط تمرير للمبلغ، ومكافأة GNK لكل مستوى، ومقدار ما تدخره. يتم تطبيق الخصم تلقائياً عند الإيداع.
يمكنك تعيين حد إنفاق إجمالي (تراكمي) للمفاتيح الفرعية، وهو حصة مخصصة لا يتم إعادة تعيينها، على عكس الحدود اليومية أو الشهرية. عند استنفاد الحصة، يتم رفض الطلبات التي تستخدم المفتاح. يتم تعيين الحد في لوحة التحكم (بدقة nanogonka) أو عبر API باستخدام حقل limit_total_ngonka في POST/PATCH /api/management/keys/{id}/children؛ يتم إعادة تعيين الاستهلاك التراكمي باستخدام زر "Reset usage" (أو POST /api/management/keys/{id}/children/{childId}/reset-usage).
تمت مزامنة تكاليف الاستدلال (inference) مع سعر شبكة Gonka الفعلي لكل توكن. تظل الأسعار من بين الأقل في السوق — أجزاء من السنت لكل مليون توكن، مما يجعلها أرخص بمئات المرات من OpenAI و Anthropic عند استخدام نفس نماذج open-source. يتم تسعير توكنات المخرجات بسعر أعلى من توكنات المدخلات (×3)، كما هو الحال مع معظم المزودين.
لقد قمنا بتأكيد حد السياق الفعلي للنماذج النشطة — يصل إلى 200,000 توكن (سابقاً تم نشر أرقام تحفظية بلغت 131,072). يمكنك الآن إرسال مستندات وتاريخ محادثات أطول؛ يمكن العثور على المواصفات الحالية لكل نموذج في قسم "Network Status".
تكلفة كل طلب تظهر بالدولار — في استجابة الـ API (حقل usage.total_cost_usd) وفي قسم «الاستخدام». وسيلة مريحة لتخطيط النفقات.
قم بإعداد الوصول إلى الـ API في أداتك تلقائيًا: قم بتنفيذ npx @joingonka/setup. دعم لـ Claude Code و OpenClaw و Cline و Continue و opencode و Aider وغيرها.
يقوم النموذج بالبحث في الإنترنت أثناء الاستجابة وإضافة روابط للمصادر. لكيفية التفعيل: قم بتمرير plugins: [{ "id": "web", "max_results": 5 }] في جسم الطلب — يعمل في الـ API المتوافق مع OpenAI و Anthropic.
الحد الأقصى لطول الاستجابة هو 8192 توكن؛ يمكنك التحكم في بارامتر max_tokens (الافتراضي 1024 للاستجابة المتدفقة و 1500 للاستجابة العادية).
في صفحة «الدردشة»، اختر نموذجاً من القائمة (يتم تحميلها من /v1/models) — يتم حفظ الاختيار وتطبيقه على المحادثات الجديدة.
هل تحتاج إلى سرعة؟ أضف هيدر x-joingonka-meta: 1 إلى طلبك — ستصلك في الاستجابة المتدفقة قيم ttft_ms (الوقت حتى أول توكن) و tokens_per_sec.
قم بإنشاء مفتاح إدارة (POST /api/management/keys) وأنشئ مفاتيح فرعية بحدود محددة (حصة يومية وشهرية، rate limit، مدة) عبر POST /api/management/keys/{id}/children.
قم بربط الإضافات باستخدام بارامتر plugins: response-healing لإصلاح الـ JSON المقطوع، و privacy-sanitization لإخفاء البيانات الخاصة، و file-parser لاستخراج النص من ملفات PDF والمستندات.
OpenAI: base_url https://gate.joingonka.ai/v1، الهيدر Authorization: Bearer مفتاحك. Anthropic (Claude Code): base_url https://gate.joingonka.ai، الهيدر x-api-key، الـ endpoint هو /v1/messages.
GNK: احصل على العنوان و memo وأرسل التوكنز on-chain. USDT: حدد مبلغاً من 1 إلى 10,000 دولار وادفع عبر OxaPay — التحويل إلى GNK تلقائي.