AI এজেন্টদের জন্য: সেটআপের ধাপে ধাপে নির্দেশিকা — /docs/agents.md, ডকুমেন্টেশন ইনডেক্স — /llms.txt।

মডেল

গেটওয়ের মাধ্যমে উপলব্ধ Gonka নেটওয়ার্কের মডেল: model ফিল্ডের জন্য আইডেন্টিফায়ার, কনটেক্সট উইন্ডো, রেসপন্স লিমিট, দাম ও স্ট্যাটাস।

মডেল ও দাম#

মডেলের তালিকা Gonka নেটওয়ার্কের ভোটে পরিবর্তিত হয়, তাই টেবিলটি গেটওয়ের লাইভ ডেটা থেকে তৈরি। দাম — চলতি GNK রেটে প্রতি 1M টোকেনে ডলারে; কাটা হয় GNK-তে, বিস্তারিত মূল্য ও অ্যাকাউন্ট বিভাগে।

মডেলপ্রসঙ্গরেসপন্সইনপুট, $/1Mআউটপুট, $/1Mস্থিতি
MiniMax MiniMaxAI/MiniMax-M2.7200K8K$0.0083$0.025হ্রাসপ্রাপ্ত
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731380K33K$0.0083$0.025হ্রাসপ্রাপ্ত
Z.ai zai-org/GLM-5.3-Flash390K8K$0.0083$0.025চালু

আইডেন্টিফায়ার model ফিল্ডে বসান; বড়-ছোট হাতের অক্ষরে পার্থক্য নেই। স্ট্যাটাস সফলভাবে প্রসেস হওয়া অনুরোধের অনুপাত থেকে গণনা করা হয়, নেটওয়ার্ক স্ট্যাটাস পেজের মতো।

মডেল কীভাবে বাছবেন#

  • কোথা থেকে শুরু করবেন বুঝতে না পারলে MiniMaxAI/MiniMax-M2.7 নিন: ডকুমেন্টেশনের উদাহরণ ও ইনস্টলারের কমান্ড এটির জন্য তৈরি।
  • সবচেয়ে বড় কনটেক্সট — zai-org/GLM-5.3-Flash: 390K টোকেন। বড় কোডবেস ও লম্বা ডকুমেন্টের জন্য।
  • সবচেয়ে লম্বা রেসপন্স — deepseek-ai/DeepSeek-V4-Flash-0731: একবারে 33K টোকেন পর্যন্ত। বড় ফাইল সম্পূর্ণ জেনারেট করতে।

নেটওয়ার্ক কোনো মডেল পরিবেশন বন্ধ করলে সেটি GET /v1/models থেকে বাদ পড়ে, আর তার প্রতি অনুরোধ 503 এরর টাইপ model_unavailable নিয়ে উত্তর পায়। এরর টেক্সটে কোন মডেলে স্যুইচ করা যায় তা থাকবে।

রেসপন্সের দৈর্ঘ্য#

রেসপন্সের দৈর্ঘ্য নির্ধারণ করে max_tokens — বা max_completion_tokens, গেটওয়ে দুটি ফিল্ডই বোঝে। প্রতিটি মডেলের একটি সিলিং আছে: তার চেয়ে বড় max_tokens গেটওয়ে নীরবে কেটে সিলিংয়ে নামায়। max_tokens না দিলে stream: true-এ সিলিং বসে, আর নন-স্ট্রিমে — ছোট একটি ডিফল্ট মান।

রিজনিং মডেলগুলো উত্তরের আগে ভাবতে max_tokens-এর একটি অংশ খরচ করে — বাফার রাখুন।

modelসিলিংডিফল্ট, stream: trueডিফল্ট, নন-স্ট্রিম
MiniMaxAI/MiniMax-M2.7819281921500
deepseek-ai/DeepSeek-V4-Flash-073132768327681500
zai-org/GLM-5.3-Flash819281923000

একই সংখ্যা মেশিন-রিডেবল আকারে — GET /v1/capabilities রেসপন্সে, limits.models ফিল্ডে।

ডিফল্ট মডেল#

model ফিল্ড ছাড়া অনুরোধ গেটওয়ে ডিফল্ট মডেলে পাঠায় — এখন সেটি MiniMaxAI/MiniMax-M2.7।

Claude Code ও Anthropic SDK /v1/messages-এ Anthropic মডেলের নাম পাঠায় (claude-*) — গেটওয়ে সেগুলো একই ডিফল্ট মডেল দিয়ে প্রতিস্থাপন করে।

অন্য মডেলে কাজ করতে উপরের টেবিল থেকে তার আইডেন্টিফায়ার দিন; ইনস্টলারে এটি --model ফ্ল্যাগ।

API-র মাধ্যমে তালিকা ও স্ট্যাটাস#

মডেলের তালিকা Gonka নেটওয়ার্কের ভোটে পরিবর্তিত হয় — কোডে তালিকা হার্ডকোড করবেন না, API থেকে নিন। এই অনুরোধগুলোর জন্য কী লাগে না।

অনুরোধকী ফেরায়
GET /v1/modelsএখন উপলব্ধ মডেল: আইডেন্টিফায়ার, কনটেক্সট, রেসপন্স লিমিট এবং ডলারে টোকেনের দাম। নেটওয়ার্ক যে মডেলটি এখন পরিবেশন করছে না, তা তালিকায় নেই।
GET /v1/models/{model}একই ফরম্যাটে একটি মডেল। আইডেন্টিফায়ারে স্ল্যাশ যেমন আছে তেমনই বা %2F হিসেবে পাঠান। অজানা বা লুকানো মডেল — 404 কোড model_not_found সহ, আর লুকানো মডেলের প্রতি অনুরোধ পায় 503 model_unavailable।
GET /v1/capabilitiesগেটওয়ের ক্ষমতা: প্রোটোকল, অনুরোধ প্যারামিটার এবং limits ফিল্ড — কী-র রেট লিমিট, টাইমআউট ও মডেলভিত্তিক max_tokens সিলিং।
GET /v1/network-statusপ্রতিটি মডেলের স্ট্যাটাস ও ইনসিডেন্ট — নেটওয়ার্ক স্ট্যাটাস পেজের মতো একই ডেটা।
GET /healthগেটওয়ে নিজে সাড়া দিচ্ছে কি না: {"status":"ok"}। এই অনুরোধ মডেলের অবস্থা যাচাই করে না।