আপডেট এবং স্ট্যাটাস
ইনফারেন্সের বর্তমান অবস্থা এবং গেটওয়ে পরিবর্তনের ইতিহাস।
বর্তমান স্ট্যাটাস
- MiniMax M2.7গনকা নেটওয়ার্ক: কর্মক্ষম
- Kimi K2.6গনকা নেটওয়ার্ক: কর্মক্ষম
- DeepSeek V4 Flashগনকা নেটওয়ার্ক: কর্মক্ষম
সক্রিয় মডেলের সেট Gonka নেটওয়ার্ক ভোটের মাধ্যমে নির্ধারিত হয় এবং এটি পরিবর্তন হতে পারে: কিছু মডেল মাঝে মাঝে অনুপলব্ধ থাকে এবং পরে আবার ফিরে আসে। বর্তমান তালিকা উপরে দেওয়া হয়েছে।
বিস্তারিত স্ট্যাটাস এবং আপটাইম →আপডেট ইতিহাস
DeepSeek V4 Flash-এর জন্য একটি একক রেসপন্সের সর্বোচ্চ দৈর্ঘ্য ৪ গুণ বাড়ানো হয়েছে: ৮,১৯২ থেকে ৩২,৭৬৮ টোকেন (max_tokens প্যারামিটার)। বড় ফাইল এবং এজেন্ট টুলের দীর্ঘ রেসপন্স এখন একটি সিঙ্গেল কলে ধরে যায়। অতিরিক্ত: যদি রেসপন্স টুল কলের মাঝখানে লিমিটে পৌঁছে যায়, গেটওয়ে একটি অসম্পূর্ণ কলের পরিবর্তে একটি সঠিক finish_reason="length" প্রদান করে — এজেন্ট ক্লায়েন্টরা (Cursor এবং অন্যান্য) পার্সিং এররের কারণে হ্যাং না হয়ে সঠিকভাবে কাজ চালিয়ে যেতে পারে।
Gonka নেটওয়ার্কে তৃতীয় সক্রিয় মডেল যুক্ত হয়েছে — DeepSeek V4 Flash 0731: 380,000 টোকেন কনটেক্সট (নেটওয়ার্কের দীর্ঘতম, 381K রিয়েল রিকোয়েস্ট দ্বারা যাচাইকৃত), reasoning এবং tool calling সাপোর্ট করে। এর আইডেন্টিফায়ার হলো deepseek-ai/DeepSeek-V4-Flash-0731, এবং এর মূল্য অন্যান্য মডেলের মতোই। মডেলটি প্রাথমিক পরীক্ষার পর্যায়ে আছে, তবে পুরোপুরি ব্যবহারযোগ্য: ড্যাশবোর্ড চ্যাটে এটি নির্বাচন করুন অথবা আপনার API রিকোয়েস্টের model ফিল্ডে এটি উল্লেখ করুন।
৩রা আগস্ট থেকে, ইনফারেন্সের খরচ: ইনপুট — ২২ nGNK, আউটপুট — ৬৬ nGNK প্রতি টোকেন (আগের ১১/৩৩ এর দ্বিগুণ)। গেটওয়ে ফি ১০% অপরিবর্তিত রয়েছে। ডেমো মোড বিনামূল্যে থাকছে। সমস্ত মডেলের বর্তমান মূল্য Pricing পেজে এবং GET /api/pricing-এ উপলব্ধ।
যদি Gonka নেটওয়ার্ক একটি অনুরোধ পায় কিন্তু সাড়া না দেয় (৩০০s টাইমআউট), তবে গেটওয়ে এখন নিরব রিট্রাইয়ের পরিবর্তে সাথে সাথে ৫০৪ এরর রিটার্ন করে। বিলিং সংক্রান্ত গুরুত্বপূর্ণ তথ্য: নেটওয়ার্ক দ্বারা গৃহীত অনুরোধ বাতিল করা সম্ভব নয় — নোড এটি প্রক্রিয়া করে, তাই টাইমআউটের ক্ষেত্রে প্রম্পট প্রসেসিংয়ের অনুমান কাটা হয় (completion-এর জন্য চার্জ করা হয় না)। পরামর্শ: দীর্ঘ জেনারেশনের জন্য, stream:true ব্যবহার করুন — স্ট্রিমিং টাইমআউটের ক্ষেত্রে আরও স্থিতিশীল এবং তাৎক্ষণিকভাবে প্রগ্রেস দেখায়।
USDT-এর মাধ্যমে ডিপোজিট ফি এখন পরিমাণের বৃদ্ধির সাথে সাথে কমে যায়: প্রাথমিক ৫%, $২৫ থেকে — ৪.৫%, $৫০ থেকে — ৪%, $১০০ থেকে — ৩.৫%, $২৫০ থেকে — ৩%, $৫০০ থেকে — ২.৭৫%, $১০০০ থেকে — ২.৫%। ডিপোজিট ডায়লগে একটি ইন্টারঅ্যাক্টিভ সোপান রয়েছে: অ্যামাউন্ট স্লাইডার, প্রতিটি ধাপের GNK বোনাস এবং আপনার সাশ্রয়। ডিপোজিট ক্রেডিট হওয়ার সময় ডিসকাউন্ট স্বয়ংক্রিয়ভাবে কার্যকর হয়।
আপনি চাইল্ড কী-গুলোর জন্য মোট (ক্রমবর্ধমান) খরচের সীমা নির্ধারণ করতে পারেন — এটি একটি নিবেদিত কোটা যা দৈনিক বা মাসিক সীমার মতো রিসেট হয় না। কোটা শেষ হয়ে গেলে, কী ব্যবহার করা অনুরোধগুলো প্রত্যাখ্যান করা হয়। এই সীমাটি ড্যাশবোর্ডে (nanogonka সূক্ষ্মতার সাথে) বা API-এর মাধ্যমে POST/PATCH /api/management/keys/{id}/children-এ limit_total_ngonka ফিল্ড ব্যবহার করে সেট করা হয়; জমানো ব্যবহার "Reset usage" বোতাম (বা POST /api/management/keys/{id}/children/{childId}/reset-usage) দিয়ে রিসেট করা হয়।
inferenced-এর খরচ প্রতি টোকেন প্রকৃত Gonka নেটওয়ার্ক মূল্যের সাথে সিনক্রোনাইজ করা হয়েছে। আমাদের দাম বাজারের সর্বনিম্নগুলোর মধ্যে একটি – প্রতি মিলিয়ন টোকেনে সেন্টের ভগ্নাংশ, যা একই open-source মডেলের ক্ষেত্রে OpenAI এবং Anthropic-এর চেয়ে কয়েকশো গুণ সস্তা। অধিকাংশ প্রোভাইডারের মতো, আউটপুট টোকেন (output tokens)-এর চার্জ ইনপুট টোকেন (input tokens)-এর চেয়ে বেশি (×3)।
আমরা সক্রিয় মডেলগুলোর প্রকৃত কনটেক্সট লিমিট নিশ্চিত করেছি – ২০০,০০০ টোকেন পর্যন্ত (আগে ১৩১,০৭২ হিসেবে প্রকাশ করা হয়েছিল)। এখন আপনি আরও দীর্ঘ ডকুমেন্ট এবং চ্যাট হিস্ট্রি পাঠাতে পারবেন; প্রতিটি মডেলের বর্তমান বৈশিষ্ট্যগুলো «নেটওয়ার্ক স্ট্যাটাস» সেকশনে দেখুন।
প্রতিটি অনুরোধের খরচ ডলারে দেখা যাবে — API রেসপন্সে (usage.total_cost_usd ফিল্ডে) এবং "ব্যবহার" বিভাগে। খরচের পরিকল্পনা করা সহজ।
আপনার টুলটিতে স্বয়ংক্রিয়ভাবে API অ্যাক্সেস সেটআপ করুন: npx @joingonka/setup চালান। Claude Code, OpenClaw, Cline, Continue, opencode, Aider এবং অন্যান্য সমর্থিত।
মডেলটি উত্তরের সময় ইন্টারনেট সার্চ করে এবং উৎসের লিঙ্ক যোগ করে। চালু করার নিয়ম: রিকোয়েস্ট বডিতে plugins: [{ "id": "web", "max_results": 5 }] পাস করুন — এটি OpenAI এবং Anthropic-সামঞ্জস্যপূর্ণ API তে কাজ করে।
সর্বোচ্চ উত্তরের দৈর্ঘ্য ৮১৯২ টোকেন পর্যন্ত; max_tokens প্যারামিটার নিয়ন্ত্রণ করুন (ডিফল্ট স্ট্রিমিং উত্তরের জন্য ১০২৪ এবং স্বাভাবিকের জন্য ১৫০০)।
“চ্যাট” পৃষ্ঠায় তালিকা থেকে মডেল নির্বাচন করুন (/v1/models থেকে লোড হয়) — আপনার নির্বাচন সংরক্ষিত থাকবে এবং নতুন ডায়ালগে প্রয়োগ করা হবে।
গতি প্রয়োজন? রিকোয়েস্টে x-joingonka-meta: 1 হেডার যোগ করুন — স্ট্রিমিং রেসপন্সে ttft_ms (প্রথম টোকেন পর্যন্ত সময়) এবং tokens_per_sec পাওয়া যাবে।
একটি ম্যানেজমেন্ট কি তৈরি করুন (POST /api/management/keys) এবং POST /api/management/keys/{id}/children এর মাধ্যমে লিমিটসহ (দৈনিক এবং মাসিক কোটা, rate limit, মেয়াদ) চাইল্ড কি তৈরি করুন।
plugins প্যারামিটার দিয়ে প্লাগইন যুক্ত করুন: response-healing কাটা JSON ঠিক করে, privacy-sanitization ব্যক্তিগত তথ্য মাস্ক করে, file-parser পিডিএফ এবং ডকুমেন্ট থেকে টেক্সট বের করে।
OpenAI: base_url https://gate.joingonka.ai/v1, হেডার Authorization: Bearer আপনার-কি। Anthropic (Claude Code): base_url https://gate.joingonka.ai, হেডার x-api-key, এন্ডপয়েন্ট /v1/messages।
GNK: অ্যাড্রেস এবং memo সংগ্রহ করুন এবং অন-চেইন টোকেন পাঠান। USDT: ১ থেকে ১০,০০০ ডলারের মধ্যে পরিমাণ উল্লেখ করুন এবং OxaPay দিয়ে পেমেন্ট করুন — GNK-এ অটোমেটিক কনভার্ট হবে।