AI এজেন্টদের জন্য: সেটআপের ধাপে ধাপে নির্দেশিকা — /docs/agents.md, ডকুমেন্টেশন ইনডেক্স — /llms.txt।
মডেল
গেটওয়ের মাধ্যমে উপলব্ধ Gonka নেটওয়ার্কের মডেল: model ফিল্ডের জন্য আইডেন্টিফায়ার, কনটেক্সট উইন্ডো, রেসপন্স লিমিট, দাম ও স্ট্যাটাস।
মডেল ও দাম#
মডেলের তালিকা Gonka নেটওয়ার্কের ভোটে পরিবর্তিত হয়, তাই টেবিলটি গেটওয়ের লাইভ ডেটা থেকে তৈরি। দাম — চলতি GNK রেটে প্রতি 1M টোকেনে ডলারে; কাটা হয় GNK-তে, বিস্তারিত মূল্য ও অ্যাকাউন্ট বিভাগে।
| মডেল | প্রসঙ্গ | রেসপন্স | ইনপুট, $/1M | আউটপুট, $/1M | স্থিতি |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | হ্রাসপ্রাপ্ত |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | হ্রাসপ্রাপ্ত |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | চালু |
আইডেন্টিফায়ার model ফিল্ডে বসান; বড়-ছোট হাতের অক্ষরে পার্থক্য নেই। স্ট্যাটাস সফলভাবে প্রসেস হওয়া অনুরোধের অনুপাত থেকে গণনা করা হয়, নেটওয়ার্ক স্ট্যাটাস পেজের মতো।
মডেল কীভাবে বাছবেন#
- কোথা থেকে শুরু করবেন বুঝতে না পারলে
MiniMaxAI/MiniMax-M2.7নিন: ডকুমেন্টেশনের উদাহরণ ও ইনস্টলারের কমান্ড এটির জন্য তৈরি। - সবচেয়ে বড় কনটেক্সট —
zai-org/GLM-5.3-Flash: 390K টোকেন। বড় কোডবেস ও লম্বা ডকুমেন্টের জন্য। - সবচেয়ে লম্বা রেসপন্স —
deepseek-ai/DeepSeek-V4-Flash-0731: একবারে 33K টোকেন পর্যন্ত। বড় ফাইল সম্পূর্ণ জেনারেট করতে।
নেটওয়ার্ক কোনো মডেল পরিবেশন বন্ধ করলে সেটি GET /v1/models থেকে বাদ পড়ে, আর তার প্রতি অনুরোধ 503 এরর টাইপ model_unavailable নিয়ে উত্তর পায়। এরর টেক্সটে কোন মডেলে স্যুইচ করা যায় তা থাকবে।
রেসপন্সের দৈর্ঘ্য#
রেসপন্সের দৈর্ঘ্য নির্ধারণ করে max_tokens — বা max_completion_tokens, গেটওয়ে দুটি ফিল্ডই বোঝে। প্রতিটি মডেলের একটি সিলিং আছে: তার চেয়ে বড় max_tokens গেটওয়ে নীরবে কেটে সিলিংয়ে নামায়। max_tokens না দিলে stream: true-এ সিলিং বসে, আর নন-স্ট্রিমে — ছোট একটি ডিফল্ট মান।
রিজনিং মডেলগুলো উত্তরের আগে ভাবতে max_tokens-এর একটি অংশ খরচ করে — বাফার রাখুন।
model | সিলিং | ডিফল্ট, stream: true | ডিফল্ট, নন-স্ট্রিম |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
একই সংখ্যা মেশিন-রিডেবল আকারে — GET /v1/capabilities রেসপন্সে, limits.models ফিল্ডে।
ডিফল্ট মডেল#
model ফিল্ড ছাড়া অনুরোধ গেটওয়ে ডিফল্ট মডেলে পাঠায় — এখন সেটি MiniMaxAI/MiniMax-M2.7।
Claude Code ও Anthropic SDK /v1/messages-এ Anthropic মডেলের নাম পাঠায় (claude-*) — গেটওয়ে সেগুলো একই ডিফল্ট মডেল দিয়ে প্রতিস্থাপন করে।
অন্য মডেলে কাজ করতে উপরের টেবিল থেকে তার আইডেন্টিফায়ার দিন; ইনস্টলারে এটি --model ফ্ল্যাগ।
API-র মাধ্যমে তালিকা ও স্ট্যাটাস#
মডেলের তালিকা Gonka নেটওয়ার্কের ভোটে পরিবর্তিত হয় — কোডে তালিকা হার্ডকোড করবেন না, API থেকে নিন। এই অনুরোধগুলোর জন্য কী লাগে না।
| অনুরোধ | কী ফেরায় |
|---|---|
GET /v1/models | এখন উপলব্ধ মডেল: আইডেন্টিফায়ার, কনটেক্সট, রেসপন্স লিমিট এবং ডলারে টোকেনের দাম। নেটওয়ার্ক যে মডেলটি এখন পরিবেশন করছে না, তা তালিকায় নেই। |
GET /v1/models/{model} | একই ফরম্যাটে একটি মডেল। আইডেন্টিফায়ারে স্ল্যাশ যেমন আছে তেমনই বা %2F হিসেবে পাঠান। অজানা বা লুকানো মডেল — 404 কোড model_not_found সহ, আর লুকানো মডেলের প্রতি অনুরোধ পায় 503 model_unavailable। |
GET /v1/capabilities | গেটওয়ের ক্ষমতা: প্রোটোকল, অনুরোধ প্যারামিটার এবং limits ফিল্ড — কী-র রেট লিমিট, টাইমআউট ও মডেলভিত্তিক max_tokens সিলিং। |
GET /v1/network-status | প্রতিটি মডেলের স্ট্যাটাস ও ইনসিডেন্ট — নেটওয়ার্ক স্ট্যাটাস পেজের মতো একই ডেটা। |
GET /health | গেটওয়ে নিজে সাড়া দিচ্ছে কি না: {"status":"ok"}। এই অনুরোধ মডেলের অবস্থা যাচাই করে না। |