สำหรับเอเจนต์ AI: คำแนะนำการตั้งค่าทีละขั้นตอน — /docs/agents.md, ดัชนีเอกสาร — /llms.txt.
โมเดล
โมเดลของเครือข่าย Gonka ที่ใช้ได้ผ่านเกตเวย์: ตัวระบุสำหรับฟิลด์ model, หน้าต่างคอนเท็กซ์, ลิมิตการตอบกลับ, ราคา และสถานะ
โมเดลและราคา#
องค์ประกอบของโมเดลเปลี่ยนแปลงตามการโหวตของเครือข่าย Gonka ดังนั้นตารางจึงสร้างจากข้อมูลสดของเกตเวย์ ราคาเป็นดอลลาร์ต่อ 1M โทเคนตามอัตราแลกเปลี่ยน GNK ปัจจุบัน; การหักเงินเป็น GNK, รายละเอียดเพิ่มเติม — ในส่วน แพ็กเกจและบัญชี
| โมเดล | บริบท | คำตอบ | อินพุต, $/1M | เอาต์พุต, $/1M | สถานะ |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | ลดลง |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | ลดลง |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | ใช้งานได้ |
ใส่ตัวระบุในฟิลด์ model; ตัวพิมพ์เล็กใหญ่ไม่สำคัญ สถานะคำนวณจากสัดส่วนคำขอที่ประมวลผลสำเร็จ เหมือนในหน้า สถานะเครือข่าย
วิธีเลือกโมเดล#
- ไม่รู้จะเริ่มจากอะไร — เลือก
MiniMaxAI/MiniMax-M2.7: ตัวอย่างในเอกสารและคำสั่งของตัวติดตั้งคำนวณไว้สำหรับโมเดลนี้ - คอนเท็กซ์ยาวที่สุด —
zai-org/GLM-5.3-Flash: 390K โทเคน เหมาะกับโค้ดเบสขนาดใหญ่และเอกสารยาว - คำตอบยาวที่สุด —
deepseek-ai/DeepSeek-V4-Flash-0731: สูงสุด 33K โทเคนต่อครั้ง เพื่อสร้างไฟล์ขนาดใหญ่ได้ครบทั้งไฟล์
ถ้าเครือข่ายหยุดให้บริการโมเดลนั้น โมเดลจะหายไปจาก GET /v1/models และคำขอจะได้การตอบกลับ 503 พร้อมประเภทข้อผิดพลาด model_unavailable ในข้อความข้อผิดพลาดจะระบุโมเดลที่สามารถสลับไปใช้ได้
ความยาวคำตอบ#
ความยาวคำตอบกำหนดด้วย max_tokens — หรือ max_completion_tokens เกตเวย์เข้าใจทั้งสองฟิลด์ แต่ละโมเดลมีเพดาน: ถ้า max_tokens มากกว่านั้น เกตเวย์จะตัดลงถึงเพดานโดยไม่แจ้ง ถ้าไม่ได้ระบุ max_tokens เมื่อ stream: true จะใช้ค่าเพดาน และแบบไม่สตรีมจะใช้ค่าเริ่มต้นที่ต่ำกว่า
โมเดลที่มีการคิดวิเคราะห์จะใช้ส่วนหนึ่งของ max_tokens ในการคิดก่อนตอบ — เผื่อไว้ด้วย
model | เพดาน | ค่าเริ่มต้น, stream: true | ค่าเริ่มต้น, ไม่สตรีม |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
ตัวเลขเดียวกันในรูปแบบเครื่อง — ในการตอบกลับ GET /v1/capabilities ฟิลด์ limits.models
โมเดลเริ่มต้น#
คำขอที่ไม่มีฟิลด์ model เกตเวย์จะส่งไปยังโมเดลเริ่มต้น — ตอนนี้คือ MiniMaxAI/MiniMax-M2.7
Claude Code และ Anthropic SDK ส่งชื่อโมเดลของ Anthropic (claude-*) มาใน /v1/messages — เกตเวย์จะแทนที่ด้วยโมเดลเริ่มต้นเดียวกัน
หากต้องการใช้โมเดลอื่น ให้ระบุตัวระบุจากตารางด้านบน; ในตัวติดตั้งคือแฟล็ก --model
องค์ประกอบและสถานะผ่าน API#
องค์ประกอบของโมเดลเปลี่ยนแปลงตามการโหวตของเครือข่าย Gonka — อย่าฮาร์ดโค้ดรายการในโค้ด ให้ดึงจาก API ไม่ต้องใช้คีย์สำหรับคำขอเหล่านี้
| คำขอ | สิ่งที่ส่งกลับ |
|---|---|
GET /v1/models | โมเดลที่ใช้ได้ตอนนี้: ตัวระบุ, คอนเท็กซ์, ลิมิตการตอบกลับ และราคาต่อโทเคนเป็นดอลลาร์ โมเดลที่เครือข่ายไม่ให้บริการอยู่ในขณะนี้จะไม่อยู่ในรายการ |
GET /v1/models/{model} | โมเดลเดียวในรูปแบบเดียวกัน สแลชในตัวระบุให้ส่งตามเดิมหรือเป็น %2F โมเดลที่ไม่รู้จักหรือถูกซ่อน — 404 พร้อมรหัส model_not_found และคำขอไปยังโมเดลที่ถูกซ่อนจะได้ 503 model_unavailable |
GET /v1/capabilities | ความสามารถของเกตเวย์: โปรโตคอล, พารามิเตอร์คำขอ และฟิลด์ limits — ลิมิตคำขอของคีย์, ไทม์เอาต์ และเพดาน max_tokens ตามโมเดล |
GET /v1/network-status | สถานะของแต่ละโมเดลและเหตุการณ์ — ข้อมูลเดียวกับในหน้า สถานะเครือข่าย |
GET /health | เกตเวย์เองตอบหรือไม่: {"status":"ok"} คำขอนี้ไม่ได้ตรวจสอบสถานะของโมเดล |