আপডেট এবং স্ট্যাটাস
ইনফারেন্সের বর্তমান অবস্থা এবং গেটওয়ে পরিবর্তনের ইতিহাস।
বর্তমান স্ট্যাটাস
- MiniMax M2.7গনকা নেটওয়ার্ক: কর্মক্ষমতা হ্রাস
- DeepSeek V4 Flashগনকা নেটওয়ার্ক: কর্মক্ষমতা হ্রাস
- GLM 5.3 Flashগনকা নেটওয়ার্ক: কর্মক্ষম
সক্রিয় মডেলের সেট Gonka নেটওয়ার্ক ভোটের মাধ্যমে নির্ধারিত হয় এবং এটি পরিবর্তন হতে পারে: কিছু মডেল মাঝে মাঝে অনুপলব্ধ থাকে এবং পরে আবার ফিরে আসে। বর্তমান তালিকা উপরে দেওয়া হয়েছে।
বিস্তারিত স্ট্যাটাস এবং আপটাইম →আপডেট ইতিহাস
আপনি WGNK টোকেন দিয়ে আপনার ব্যালেন্স রিচার্জ করতে পারেন — এটি Ethereum নেটওয়ার্কের GNK। আপনার অ্যাকাউন্টে: টপ আপ → GNK → Ethereum · WGNK; যে ঠিকানা থেকে টোকেন পাঠাবেন সেটি উল্লেখ করুন — ট্রান্সফার স্বয়ংক্রিয়ভাবে ক্রেডিট হবে, সাধারণত 15–20 মিনিটের মধ্যে।
npx @joingonka/setup এখন ২৫টি টুল কনফিগার করে। নতুন সংযোজন: Codex CLI, Kimi Code, omp, MiniMax Code, Goose, MiMo Code, Qwen Code, Factory Droid, Crush এবং Zoo Code। মডেলটি --model ফ্ল্যাগ (minimax, deepseek বা glm) এর মাধ্যমে নির্বাচন করা হয়, যার ডিফল্ট হলো DeepSeek V4 Flash। শেষে, ইন্সটলার একটি ভেরিফিকেশন রিকোয়েস্ট পাঠায় এবং সাথে সাথে দেখায় যে কী (key) কাজ করছে কি না।
১৬ সেপ্টেম্বর থেকে, প্রতিটি নতুন অ্যাকাউন্ট ৫০,০০০,০০০ এর পরিবর্তে ১০০,০০০,০০০ nGNK (0.1 GNK) পাবে — বর্তমান নেটওয়ার্ক মূল্য অনুযায়ী, এটি কোনো ডিপোজিট ছাড়াই পরীক্ষার জন্য প্রায় ৩ মিলিয়ন টোকেনের সমান। বোনাসটি রেজিস্ট্রেশনের সময় স্বয়ংক্রিয়ভাবে ক্রেডিট হয়ে যায়, কোনো ইনপুটের প্রয়োজন নেই; বর্তমান বোনাসের পরিমাণ সবসময় GET /api/pricing (welcome_bonus_ngonka ফিল্ড) এবং রেজিস্ট্রেশন পেজে দেখা যাবে।
Gonka নেটওয়ার্কের নোডগুলি প্রায় ৫ মিনিট জেনারেশনের পর যেকোনো স্ট্রিম বন্ধ করে দেয় (GLM 5.3 Flash-এর জন্য এটি প্রায় ৮,০০০ token)। আগে এই ধরনের কাট-অফ সাধারণ সমাপ্তির মতো মনে হতো: স্ট্রিমটি কোনো finish_reason ছাড়াই [DONE] দিয়ে শেষ হতো এবং ক্লায়েন্ট কাটা অংশটিকে সম্পূর্ণ উত্তর হিসেবে ধরে নিত। এখন গেটওয়ে একটি chunk পাঠায় যাতে finish_reason="length" থাকে — স্ট্রিম এবং সাধারণ প্রতিক্রিয়া উভয় ক্ষেত্রেই, আর Anthropic ফরম্যাটে এটি stop_reason="max_tokens"। দীর্ঘ উত্তরের ক্ষেত্রে কী করবেন: stream:true ব্যবহার করুন এবং finish_reason="length" হলে, ইতিমধ্যেই প্রাপ্ত অংশটি কনটেক্সটে রেখে পরবর্তী রিকোয়েস্টের মাধ্যমে জেনারেশন চালিয়ে যান। বিস্তারিত তথ্যের জন্য ডকুমেন্টেশনের “Limits” সেকশনটি দেখুন।
Gonka নেটওয়ার্কে Z.ai-এর GLM 5.3 Flash এসেছে: 320B প্যারামিটার (MoE, 18B অ্যাক্টিভ), FP8, MIT লাইসেন্স, ৩৯০,০০০ টোকেনের কনটেক্সট। মডেলটি উত্তর দেওয়ার আগে যুক্তি তৈরি করে: যুক্তিটি reasoning_content ফিল্ডে আসে এবং উত্তরের বাজেট খরচ করে, তাই max_tokens অন্তত 600 সেট করুন অথবা stream:true ব্যবহার করুন; ছোট কাজের জন্য — reasoning_effort: "low"। Tool calling এবং JSON-মোড কাজ করে। আইডেন্টিফায়ার — zai-org/GLM-5.3-Flash, দাম নেটওয়ার্কের অন্যান্য মডেলের সমান। Kimi K2.6 আর নেটওয়ার্ক দ্বারা সমর্থিত নয় — আপনার ইন্টিগ্রেশনগুলোকে MiniMax M2.7, DeepSeek V4 Flash বা GLM 5.3 Flash-এ সুইচ করুন।
"ব্যবহার" পৃষ্ঠায় প্রতিটি মডেলের খরচ দেখানো হয়: অনুরোধ, ইনপুট/আউটপুট token, nGNK এবং ডলারে খরচ, প্রতি 1M token এর গড় মূল্য এবং প্রতিক্রিয়ার গতি। "আজ" প্রতি ঘণ্টা হিসেবে দেখানো হয় এবং "90 দিন" প্রিসেট যোগ করা হয়েছে। ইন্টিগ্রেশনের জন্য: GET /api/usage/by-model।
গেটওয়ে এখন /v1/completions এ অনুরোধ গ্রহণ করে — OpenAI এর "text" এন্ডপয়েন্ট: এটি ইনপুট হিসেবে একটি prompt স্ট্রিং গ্রহণ করে এবং আউটপুট হিসেবে choices[].text ফেরত দেয়। এটি এডিটর প্লাগিন দ্বারা অটোকমপ্লিট এবং ইনলাইন কোড এডিটিংয়ের (Continue.dev এবং সমজাতীয়) জন্য ব্যবহৃত হয়। Base URL একই আছে: https://gate.joingonka.ai/v1। স্ট্রিমিং এবং স্ট্যান্ডার্ড প্যারামিটার (max_tokens, temperature, stop) সমর্থিত, যার খরচ এবং সীমাবদ্ধতা /v1/chat/completions এর মতোই। logprobs এবং best_of ফিল্ডগুলি সমর্থিত নয়।
২২শে আগস্ট থেকে ইনফারেন্স-এর খরচ: ইনপুট — ৩৩ nGNK, আউটপুট — ৯৯ nGNK প্রতি টোকেন (আগের ২২/৬৬)। গেটওয়ে কমিশন অপরিবর্তিত — ১০%। ডেমো মোড বিনামূল্যে থাকবে। দাম বাড়ার কারণ: Gonka নেটওয়ার্কে প্রতিটি রিকোয়েস্ট redundancy-র সাথে প্রসেস করা হয় — এটি প্রোটোকল এবং devshards কোডের অংশ, যা পরিষেবার মসৃণতা বজায় রাখার জন্য প্রয়োজন। একটি কন্টেইনার রিকোয়েস্টটি একটি হোস্টে পাঠাতে পারে, প্রথমটি সফল না হলে অন্যটিতে, এবং প্রয়োজনে একসাথে একাধিক হোস্টে পাঠাতে পারে। প্রতিটি প্রচেষ্টার জন্য পেমেন্ট করতে হয়: নেটওয়ার্কের দাম ১০ nGNK প্রতি টোকেন, যা রিকোয়েস্টের redundancy দিয়ে গুণ করা হয় (গড়ে ×১—২.৫)। আগে এই খরচটি আমাদের কাছে আসত না কারণ প্রাইস ফাইনাল্যাইজেশন API কাজ করছিল না এবং আমরা একটি হোস্টের দাম দিতাম; এখন এটি প্রকৃত ব্যবহারের ভিত্তিতে হিসাব করা হয় এবং আমরা এটি ট্যারিফে স্থানান্তর করছি। ইনফারেন্স ভেন্ডর API-এর তুলনায় কয়েকশো গুণ সস্তা। সমস্ত মডেলের বর্তমান দাম Pricing পেজে এবং GET /api/pricing-এ উপলব্ধ।
গেটওয়ে Responses ফরম্যাটে অনুরোধ গ্রহণ করে — যা OpenAI-এর একটি নতুন প্রোটোকল, নতুন SDK-গুলি এই প্রোটোকলে স্থানান্তরিত হয়েছে এবং Codex CLI এর মাধ্যমে কাজ করে। ঠিকানা আগের মতোই: base URL https://gate.joingonka.ai/v1, ক্লায়েন্ট নিজে থেকেই /v1/responses এ কল করবে। স্ট্রিমিং, function tools এবং স্ট্রাকচার্ড আউটপুট (text.format) কাজ করে, খরচ এবং লিমিট /v1/chat/completions এর মতোই। আমরা ডায়ালগ সংরক্ষণ করি না, তাই store উপেক্ষা করা হয় এবং previous_response_id একটি ত্রুটি প্রদান করবে — অনুগ্রহ করে সম্পূর্ণ ইতিহাস input ফিল্ডে পাঠান। OpenAI-এর ইন-বিল্ট সার্ভার টুলস (web_search, file_search, code_interpreter) সমর্থিত নয়; আমাদের ওয়েব অনুসন্ধান এখনও /v1/chat/completions এ web প্লাগইন এর মাধ্যমে উপলব্ধ।
আগে stream:true মোডে Gonka নেটওয়ার্ক ত্রুটিগুলো 200 কোডের সাথে আসত এবং ত্রুটিটি শুধুমাত্র SSE-chunk এর ভেতরে দেখা যেত: এজেন্ট ক্লায়েন্টরা এটিকে একটি সফল কিন্তু ফাঁকা রেসপন্স মনে করত এবং কোনো retry করত না। এখন নেটওয়ার্ক থেকে রেসপন্স শুরু হওয়ার আগে, ত্রুটিটি সাধারণ HTTP কোডের মাধ্যমে পাঠানো হয় – মডেল ওভারলোডের ক্ষেত্রে 429 (Retry-After হেডার সহ), টাইমআউটের জন্য 504, এবং কোনো নোড খালি না থাকলে 503। যদি স্ট্রিমের মাঝপথে ত্রুটি ঘটে, তবে স্ট্যাটাস পরিবর্তন করা সম্ভব নয়: সেখানে error ফিল্ডসহ একটি chunk থাকে, কিন্তু চূড়ান্ত [DONE] আর পাঠানো হয় না, যাতে স্ট্রিমটি স্বাভাবিকভাবে সফল হয়েছে বলে মনে না হয়।
npx @joingonka/setup এখন ১৫টি এজেন্ট টুল কনফিগার করে: Claude Code, OpenClaw, Cursor, Cline, opencode, Aider, Kilo Code, Roo Code, Continue, Hermes, Pi, Zed, ZCode, JetBrains AI Assistant এবং GitHub Copilot BYOK। এর মধ্যে সাতটির কনফিগ লেখা হয় এবং আপনার কনফিগের সাথে সুন্দরভাবে মার্জ করা হয় (মন্তব্য এবং বিদ্যমান সেটিংস সংরক্ষিত থাকে), বাকিগুলোর জন্য যেগুলো শুধুমাত্র ইন্টারফেসের মাধ্যমে কনফিগার করা যায়, সেগুলোর জন্য কপি-পেস্ট করার মতো ভ্যালু প্রিন্ট করা হয়। প্রয়োজনীয় টুলটি সরাসরি নির্বাচন করা যায়: npx @joingonka/setup --tool zed। প্রতিটি রান একটি লাইভ গেটওয়ে কোয়েরি দিয়ে শেষ হয়, যা নিশ্চিত করে যে কি (key), ঠিকানা এবং মডেল গৃহীত হয়েছে।
DeepSeek V4 Flash-এর জন্য একটি একক রেসপন্সের সর্বোচ্চ দৈর্ঘ্য ৪ গুণ বাড়ানো হয়েছে: ৮,১৯২ থেকে ৩২,৭৬৮ টোকেন (max_tokens প্যারামিটার)। বড় ফাইল এবং এজেন্ট টুলের দীর্ঘ রেসপন্স এখন একটি সিঙ্গেল কলে ধরে যায়। অতিরিক্ত: যদি রেসপন্স টুল কলের মাঝখানে লিমিটে পৌঁছে যায়, গেটওয়ে একটি অসম্পূর্ণ কলের পরিবর্তে একটি সঠিক finish_reason="length" প্রদান করে — এজেন্ট ক্লায়েন্টরা (Cursor এবং অন্যান্য) পার্সিং এররের কারণে হ্যাং না হয়ে সঠিকভাবে কাজ চালিয়ে যেতে পারে।
Gonka নেটওয়ার্কে তৃতীয় সক্রিয় মডেল যুক্ত হয়েছে — DeepSeek V4 Flash 0731: 380,000 টোকেন কনটেক্সট (নেটওয়ার্কের দীর্ঘতম, 381K রিয়েল রিকোয়েস্ট দ্বারা যাচাইকৃত), reasoning এবং tool calling সাপোর্ট করে। এর আইডেন্টিফায়ার হলো deepseek-ai/DeepSeek-V4-Flash-0731, এবং এর মূল্য অন্যান্য মডেলের মতোই। মডেলটি প্রাথমিক পরীক্ষার পর্যায়ে আছে, তবে পুরোপুরি ব্যবহারযোগ্য: ড্যাশবোর্ড চ্যাটে এটি নির্বাচন করুন অথবা আপনার API রিকোয়েস্টের model ফিল্ডে এটি উল্লেখ করুন।
৩রা আগস্ট থেকে, ইনফারেন্সের খরচ: ইনপুট — ২২ nGNK, আউটপুট — ৬৬ nGNK প্রতি টোকেন (আগের ১১/৩৩ এর দ্বিগুণ)। গেটওয়ে ফি ১০% অপরিবর্তিত রয়েছে। ডেমো মোড বিনামূল্যে থাকছে। সমস্ত মডেলের বর্তমান মূল্য Pricing পেজে এবং GET /api/pricing-এ উপলব্ধ।
যদি Gonka নেটওয়ার্ক একটি অনুরোধ পায় কিন্তু সাড়া না দেয় (৩০০s টাইমআউট), তবে গেটওয়ে এখন নিরব রিট্রাইয়ের পরিবর্তে সাথে সাথে ৫০৪ এরর রিটার্ন করে। বিলিং সংক্রান্ত গুরুত্বপূর্ণ তথ্য: নেটওয়ার্ক দ্বারা গৃহীত অনুরোধ বাতিল করা সম্ভব নয় — নোড এটি প্রক্রিয়া করে, তাই টাইমআউটের ক্ষেত্রে প্রম্পট প্রসেসিংয়ের অনুমান কাটা হয় (completion-এর জন্য চার্জ করা হয় না)। পরামর্শ: দীর্ঘ জেনারেশনের জন্য, stream:true ব্যবহার করুন — স্ট্রিমিং টাইমআউটের ক্ষেত্রে আরও স্থিতিশীল এবং তাৎক্ষণিকভাবে প্রগ্রেস দেখায়।
USDT-এর মাধ্যমে ডিপোজিট ফি এখন পরিমাণের বৃদ্ধির সাথে সাথে কমে যায়: প্রাথমিক ৫%, $২৫ থেকে — ৪.৫%, $৫০ থেকে — ৪%, $১০০ থেকে — ৩.৫%, $২৫০ থেকে — ৩%, $৫০০ থেকে — ২.৭৫%, $১০০০ থেকে — ২.৫%। ডিপোজিট ডায়লগে একটি ইন্টারঅ্যাক্টিভ সোপান রয়েছে: অ্যামাউন্ট স্লাইডার, প্রতিটি ধাপের GNK বোনাস এবং আপনার সাশ্রয়। ডিপোজিট ক্রেডিট হওয়ার সময় ডিসকাউন্ট স্বয়ংক্রিয়ভাবে কার্যকর হয়।
আপনি চাইল্ড কী-গুলোর জন্য মোট (ক্রমবর্ধমান) খরচের সীমা নির্ধারণ করতে পারেন — এটি একটি নিবেদিত কোটা যা দৈনিক বা মাসিক সীমার মতো রিসেট হয় না। কোটা শেষ হয়ে গেলে, কী ব্যবহার করা অনুরোধগুলো প্রত্যাখ্যান করা হয়। এই সীমাটি ড্যাশবোর্ডে (nanogonka সূক্ষ্মতার সাথে) বা API-এর মাধ্যমে POST/PATCH /api/management/keys/{id}/children-এ limit_total_ngonka ফিল্ড ব্যবহার করে সেট করা হয়; জমানো ব্যবহার "Reset usage" বোতাম (বা POST /api/management/keys/{id}/children/{childId}/reset-usage) দিয়ে রিসেট করা হয়।
inferenced-এর খরচ প্রতি টোকেন প্রকৃত Gonka নেটওয়ার্ক মূল্যের সাথে সিনক্রোনাইজ করা হয়েছে। আমাদের দাম বাজারের সর্বনিম্নগুলোর মধ্যে একটি – প্রতি মিলিয়ন টোকেনে সেন্টের ভগ্নাংশ, যা একই open-source মডেলের ক্ষেত্রে OpenAI এবং Anthropic-এর চেয়ে কয়েকশো গুণ সস্তা। অধিকাংশ প্রোভাইডারের মতো, আউটপুট টোকেন (output tokens)-এর চার্জ ইনপুট টোকেন (input tokens)-এর চেয়ে বেশি (×3)।
আমরা সক্রিয় মডেলগুলোর প্রকৃত কনটেক্সট লিমিট নিশ্চিত করেছি – ২০০,০০০ টোকেন পর্যন্ত (আগে ১৩১,০৭২ হিসেবে প্রকাশ করা হয়েছিল)। এখন আপনি আরও দীর্ঘ ডকুমেন্ট এবং চ্যাট হিস্ট্রি পাঠাতে পারবেন; প্রতিটি মডেলের বর্তমান বৈশিষ্ট্যগুলো «নেটওয়ার্ক স্ট্যাটাস» সেকশনে দেখুন।
প্রতিটি অনুরোধের খরচ ডলারে দেখা যাবে — API রেসপন্সে (usage.total_cost_usd ফিল্ডে) এবং "ব্যবহার" বিভাগে। খরচের পরিকল্পনা করা সহজ।
আপনার টুলটিতে স্বয়ংক্রিয়ভাবে API অ্যাক্সেস সেটআপ করুন: npx @joingonka/setup চালান। Claude Code, OpenClaw, Cline, Continue, opencode, Aider এবং অন্যান্য সমর্থিত।
মডেলটি উত্তরের সময় ইন্টারনেট সার্চ করে এবং উৎসের লিঙ্ক যোগ করে। চালু করার নিয়ম: রিকোয়েস্ট বডিতে plugins: [{ "id": "web", "max_results": 5 }] পাস করুন — এটি OpenAI এবং Anthropic-সামঞ্জস্যপূর্ণ API তে কাজ করে।
সর্বোচ্চ উত্তরের দৈর্ঘ্য ৮১৯২ টোকেন পর্যন্ত; max_tokens প্যারামিটার নিয়ন্ত্রণ করুন (ডিফল্ট স্ট্রিমিং উত্তরের জন্য ১০২৪ এবং স্বাভাবিকের জন্য ১৫০০)।
“চ্যাট” পৃষ্ঠায় তালিকা থেকে মডেল নির্বাচন করুন (/v1/models থেকে লোড হয়) — আপনার নির্বাচন সংরক্ষিত থাকবে এবং নতুন ডায়ালগে প্রয়োগ করা হবে।
গতি প্রয়োজন? রিকোয়েস্টে x-joingonka-meta: 1 হেডার যোগ করুন — স্ট্রিমিং রেসপন্সে ttft_ms (প্রথম টোকেন পর্যন্ত সময়) এবং tokens_per_sec পাওয়া যাবে।
একটি ম্যানেজমেন্ট কি তৈরি করুন (POST /api/management/keys) এবং POST /api/management/keys/{id}/children এর মাধ্যমে লিমিটসহ (দৈনিক এবং মাসিক কোটা, rate limit, মেয়াদ) চাইল্ড কি তৈরি করুন।
plugins প্যারামিটার দিয়ে প্লাগইন যুক্ত করুন: response-healing কাটা JSON ঠিক করে, privacy-sanitization ব্যক্তিগত তথ্য মাস্ক করে, file-parser পিডিএফ এবং ডকুমেন্ট থেকে টেক্সট বের করে।
OpenAI: base_url https://gate.joingonka.ai/v1, হেডার Authorization: Bearer আপনার-কি। Anthropic (Claude Code): base_url https://gate.joingonka.ai, হেডার x-api-key, এন্ডপয়েন্ট /v1/messages।
GNK: অ্যাড্রেস এবং memo সংগ্রহ করুন এবং অন-চেইন টোকেন পাঠান। USDT: ১ থেকে ১০,০০০ ডলারের মধ্যে পরিমাণ উল্লেখ করুন এবং OxaPay দিয়ে পেমেন্ট করুন — GNK-এ অটোমেটিক কনভার্ট হবে।