> AI এজেন্টদের জন্য: সেটআপের ধাপে ধাপে নির্দেশিকা — [`/docs/agents.md`](https://gate.joingonka.ai/docs/agents.md), ডকুমেন্টেশন ইনডেক্স — [`/llms.txt`](https://gate.joingonka.ai/llms.txt)।

# মডেল

গেটওয়ের মাধ্যমে উপলব্ধ Gonka নেটওয়ার্কের মডেল: `model` ফিল্ডের জন্য আইডেন্টিফায়ার, কনটেক্সট উইন্ডো, রেসপন্স লিমিট, দাম ও স্ট্যাটাস।

## মডেল ও দাম

মডেলের তালিকা Gonka নেটওয়ার্কের ভোটে পরিবর্তিত হয়, তাই টেবিলটি গেটওয়ের লাইভ ডেটা থেকে তৈরি। দাম — চলতি GNK রেটে প্রতি 1M টোকেনে ডলারে; কাটা হয় GNK-তে, বিস্তারিত [মূল্য ও অ্যাকাউন্ট](https://gate.joingonka.ai/bn/docs/billing) বিভাগে।

| মডেল | প্রসঙ্গ | রেসপন্স | ইনপুট, `$/1M` | আউটপুট, `$/1M` | স্থিতি |
| --- | ---: | ---: | ---: | ---: | --- |
| **MiniMax** `MiniMaxAI/MiniMax-M2.7` | 200K | 8K | $0.0083 | $0.025 | হ্রাসপ্রাপ্ত |
| **DeepSeek** `deepseek-ai/DeepSeek-V4-Flash-0731` | 380K | 33K | $0.0083 | $0.025 | হ্রাসপ্রাপ্ত |
| **Z.ai** `zai-org/GLM-5.3-Flash` | 390K | 8K | $0.0083 | $0.025 | চালু |

আইডেন্টিফায়ার `model` ফিল্ডে বসান; বড়-ছোট হাতের অক্ষরে পার্থক্য নেই। স্ট্যাটাস সফলভাবে প্রসেস হওয়া অনুরোধের অনুপাত থেকে গণনা করা হয়, [নেটওয়ার্ক স্ট্যাটাস](https://gate.joingonka.ai/bn/status) পেজের মতো।

## মডেল কীভাবে বাছবেন

- কোথা থেকে শুরু করবেন বুঝতে না পারলে `MiniMaxAI/MiniMax-M2.7` নিন: ডকুমেন্টেশনের উদাহরণ ও ইনস্টলারের কমান্ড এটির জন্য তৈরি।
- সবচেয়ে বড় কনটেক্সট — `zai-org/GLM-5.3-Flash`: 390K টোকেন। বড় কোডবেস ও লম্বা ডকুমেন্টের জন্য।
- সবচেয়ে লম্বা রেসপন্স — `deepseek-ai/DeepSeek-V4-Flash-0731`: একবারে 33K টোকেন পর্যন্ত। বড় ফাইল সম্পূর্ণ জেনারেট করতে।

নেটওয়ার্ক কোনো মডেল পরিবেশন বন্ধ করলে সেটি `GET /v1/models` থেকে বাদ পড়ে, আর তার প্রতি অনুরোধ 503 এরর টাইপ `model_unavailable` নিয়ে উত্তর পায়। এরর টেক্সটে কোন মডেলে স্যুইচ করা যায় তা থাকবে।

## রেসপন্সের দৈর্ঘ্য

রেসপন্সের দৈর্ঘ্য নির্ধারণ করে `max_tokens` — বা `max_completion_tokens`, গেটওয়ে দুটি ফিল্ডই বোঝে। প্রতিটি মডেলের একটি সিলিং আছে: তার চেয়ে বড় `max_tokens` গেটওয়ে নীরবে কেটে সিলিংয়ে নামায়। `max_tokens` না দিলে `stream: true`-এ সিলিং বসে, আর নন-স্ট্রিমে — ছোট একটি ডিফল্ট মান।

রিজনিং মডেলগুলো উত্তরের আগে ভাবতে `max_tokens`-এর একটি অংশ খরচ করে — বাফার রাখুন।

| `model` | সিলিং | ডিফল্ট, `stream: true` | ডিফল্ট, নন-স্ট্রিম |
| --- | ---: | ---: | ---: |
| `MiniMaxAI/MiniMax-M2.7` | 8192 | 8192 | 1500 |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | 32768 | 32768 | 1500 |
| `zai-org/GLM-5.3-Flash` | 8192 | 8192 | 3000 |

একই সংখ্যা মেশিন-রিডেবল আকারে — `GET /v1/capabilities` রেসপন্সে, `limits.models` ফিল্ডে।

## ডিফল্ট মডেল

`model` ফিল্ড ছাড়া অনুরোধ গেটওয়ে ডিফল্ট মডেলে পাঠায় — এখন সেটি `MiniMaxAI/MiniMax-M2.7`।

Claude Code ও Anthropic SDK `/v1/messages`-এ Anthropic মডেলের নাম পাঠায় (`claude-*`) — গেটওয়ে সেগুলো একই ডিফল্ট মডেল দিয়ে প্রতিস্থাপন করে।

অন্য মডেলে কাজ করতে উপরের টেবিল থেকে তার আইডেন্টিফায়ার দিন; ইনস্টলারে এটি `--model` ফ্ল্যাগ।

## API-র মাধ্যমে তালিকা ও স্ট্যাটাস

মডেলের তালিকা Gonka নেটওয়ার্কের ভোটে পরিবর্তিত হয় — কোডে তালিকা হার্ডকোড করবেন না, API থেকে নিন। এই অনুরোধগুলোর জন্য কী লাগে না।

| অনুরোধ | কী ফেরায় |
| --- | --- |
| `GET /v1/models` | এখন উপলব্ধ মডেল: আইডেন্টিফায়ার, কনটেক্সট, রেসপন্স লিমিট এবং ডলারে টোকেনের দাম। নেটওয়ার্ক যে মডেলটি এখন পরিবেশন করছে না, তা তালিকায় নেই। |
| `GET /v1/models/{model}` | একই ফরম্যাটে একটি মডেল। আইডেন্টিফায়ারে স্ল্যাশ যেমন আছে তেমনই বা `%2F` হিসেবে পাঠান। অজানা বা লুকানো মডেল — `404` কোড `model_not_found` সহ, আর লুকানো মডেলের প্রতি অনুরোধ পায় `503 model_unavailable`। |
| `GET /v1/capabilities` | গেটওয়ের ক্ষমতা: প্রোটোকল, অনুরোধ প্যারামিটার এবং `limits` ফিল্ড — কী-র রেট লিমিট, টাইমআউট ও মডেলভিত্তিক `max_tokens` সিলিং। |
| `GET /v1/network-status` | প্রতিটি মডেলের স্ট্যাটাস ও ইনসিডেন্ট — [নেটওয়ার্ক স্ট্যাটাস](https://gate.joingonka.ai/bn/status) পেজের মতো একই ডেটা। |
| `GET /health` | গেটওয়ে নিজে সাড়া দিচ্ছে কি না: `{"status":"ok"}`। এই অনুরোধ মডেলের অবস্থা যাচাই করে না। |
