> สำหรับเอเจนต์ AI: คำแนะนำการตั้งค่าทีละขั้นตอน — [`/docs/agents.md`](https://gate.joingonka.ai/docs/agents.md), ดัชนีเอกสาร — [`/llms.txt`](https://gate.joingonka.ai/llms.txt).

# โมเดล

โมเดลของเครือข่าย Gonka ที่ใช้ได้ผ่านเกตเวย์: ตัวระบุสำหรับฟิลด์ `model`, หน้าต่างคอนเท็กซ์, ลิมิตการตอบกลับ, ราคา และสถานะ

## โมเดลและราคา

องค์ประกอบของโมเดลเปลี่ยนแปลงตามการโหวตของเครือข่าย Gonka ดังนั้นตารางจึงสร้างจากข้อมูลสดของเกตเวย์ ราคาเป็นดอลลาร์ต่อ 1M โทเคนตามอัตราแลกเปลี่ยน GNK ปัจจุบัน; การหักเงินเป็น GNK, รายละเอียดเพิ่มเติม — ในส่วน [แพ็กเกจและบัญชี](https://gate.joingonka.ai/th/docs/billing)

| โมเดล | บริบท | คำตอบ | อินพุต, `$/1M` | เอาต์พุต, `$/1M` | สถานะ |
| --- | ---: | ---: | ---: | ---: | --- |
| **MiniMax** `MiniMaxAI/MiniMax-M2.7` | 200K | 8K | $0.0083 | $0.025 | ลดลง |
| **DeepSeek** `deepseek-ai/DeepSeek-V4-Flash-0731` | 380K | 33K | $0.0083 | $0.025 | ลดลง |
| **Z.ai** `zai-org/GLM-5.3-Flash` | 390K | 8K | $0.0083 | $0.025 | ใช้งานได้ |

ใส่ตัวระบุในฟิลด์ `model`; ตัวพิมพ์เล็กใหญ่ไม่สำคัญ สถานะคำนวณจากสัดส่วนคำขอที่ประมวลผลสำเร็จ เหมือนในหน้า [สถานะเครือข่าย](https://gate.joingonka.ai/th/status)

## วิธีเลือกโมเดล

- ไม่รู้จะเริ่มจากอะไร — เลือก `MiniMaxAI/MiniMax-M2.7`: ตัวอย่างในเอกสารและคำสั่งของตัวติดตั้งคำนวณไว้สำหรับโมเดลนี้
- คอนเท็กซ์ยาวที่สุด — `zai-org/GLM-5.3-Flash`: 390K โทเคน เหมาะกับโค้ดเบสขนาดใหญ่และเอกสารยาว
- คำตอบยาวที่สุด — `deepseek-ai/DeepSeek-V4-Flash-0731`: สูงสุด 33K โทเคนต่อครั้ง เพื่อสร้างไฟล์ขนาดใหญ่ได้ครบทั้งไฟล์

ถ้าเครือข่ายหยุดให้บริการโมเดลนั้น โมเดลจะหายไปจาก `GET /v1/models` และคำขอจะได้การตอบกลับ 503 พร้อมประเภทข้อผิดพลาด `model_unavailable` ในข้อความข้อผิดพลาดจะระบุโมเดลที่สามารถสลับไปใช้ได้

## ความยาวคำตอบ

ความยาวคำตอบกำหนดด้วย `max_tokens` — หรือ `max_completion_tokens` เกตเวย์เข้าใจทั้งสองฟิลด์ แต่ละโมเดลมีเพดาน: ถ้า `max_tokens` มากกว่านั้น เกตเวย์จะตัดลงถึงเพดานโดยไม่แจ้ง ถ้าไม่ได้ระบุ `max_tokens` เมื่อ `stream: true` จะใช้ค่าเพดาน และแบบไม่สตรีมจะใช้ค่าเริ่มต้นที่ต่ำกว่า

โมเดลที่มีการคิดวิเคราะห์จะใช้ส่วนหนึ่งของ `max_tokens` ในการคิดก่อนตอบ — เผื่อไว้ด้วย

| `model` | เพดาน | ค่าเริ่มต้น, `stream: true` | ค่าเริ่มต้น, ไม่สตรีม |
| --- | ---: | ---: | ---: |
| `MiniMaxAI/MiniMax-M2.7` | 8192 | 8192 | 1500 |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | 32768 | 32768 | 1500 |
| `zai-org/GLM-5.3-Flash` | 8192 | 8192 | 3000 |

ตัวเลขเดียวกันในรูปแบบเครื่อง — ในการตอบกลับ `GET /v1/capabilities` ฟิลด์ `limits.models`

## โมเดลเริ่มต้น

คำขอที่ไม่มีฟิลด์ `model` เกตเวย์จะส่งไปยังโมเดลเริ่มต้น — ตอนนี้คือ `MiniMaxAI/MiniMax-M2.7`

Claude Code และ Anthropic SDK ส่งชื่อโมเดลของ Anthropic (`claude-*`) มาใน `/v1/messages` — เกตเวย์จะแทนที่ด้วยโมเดลเริ่มต้นเดียวกัน

หากต้องการใช้โมเดลอื่น ให้ระบุตัวระบุจากตารางด้านบน; ในตัวติดตั้งคือแฟล็ก `--model`

## องค์ประกอบและสถานะผ่าน API

องค์ประกอบของโมเดลเปลี่ยนแปลงตามการโหวตของเครือข่าย Gonka — อย่าฮาร์ดโค้ดรายการในโค้ด ให้ดึงจาก API ไม่ต้องใช้คีย์สำหรับคำขอเหล่านี้

| คำขอ | สิ่งที่ส่งกลับ |
| --- | --- |
| `GET /v1/models` | โมเดลที่ใช้ได้ตอนนี้: ตัวระบุ, คอนเท็กซ์, ลิมิตการตอบกลับ และราคาต่อโทเคนเป็นดอลลาร์ โมเดลที่เครือข่ายไม่ให้บริการอยู่ในขณะนี้จะไม่อยู่ในรายการ |
| `GET /v1/models/{model}` | โมเดลเดียวในรูปแบบเดียวกัน สแลชในตัวระบุให้ส่งตามเดิมหรือเป็น `%2F` โมเดลที่ไม่รู้จักหรือถูกซ่อน — `404` พร้อมรหัส `model_not_found` และคำขอไปยังโมเดลที่ถูกซ่อนจะได้ `503 model_unavailable` |
| `GET /v1/capabilities` | ความสามารถของเกตเวย์: โปรโตคอล, พารามิเตอร์คำขอ และฟิลด์ `limits` — ลิมิตคำขอของคีย์, ไทม์เอาต์ และเพดาน `max_tokens` ตามโมเดล |
| `GET /v1/network-status` | สถานะของแต่ละโมเดลและเหตุการณ์ — ข้อมูลเดียวกับในหน้า [สถานะเครือข่าย](https://gate.joingonka.ai/th/status) |
| `GET /health` | เกตเวย์เองตอบหรือไม่: `{"status":"ok"}` คำขอนี้ไม่ได้ตรวจสอบสถานะของโมเดล |
