สำหรับเอเจนต์ AI: คำแนะนำการตั้งค่าทีละขั้นตอน — /docs/agents.md, ดัชนีเอกสาร — /llms.txt.

โมเดล

โมเดลของเครือข่าย Gonka ที่ใช้ได้ผ่านเกตเวย์: ตัวระบุสำหรับฟิลด์ model, หน้าต่างคอนเท็กซ์, ลิมิตการตอบกลับ, ราคา และสถานะ

โมเดลและราคา#

องค์ประกอบของโมเดลเปลี่ยนแปลงตามการโหวตของเครือข่าย Gonka ดังนั้นตารางจึงสร้างจากข้อมูลสดของเกตเวย์ ราคาเป็นดอลลาร์ต่อ 1M โทเคนตามอัตราแลกเปลี่ยน GNK ปัจจุบัน; การหักเงินเป็น GNK, รายละเอียดเพิ่มเติม — ในส่วน แพ็กเกจและบัญชี

โมเดลบริบทคำตอบอินพุต, $/1Mเอาต์พุต, $/1Mสถานะ
MiniMax MiniMaxAI/MiniMax-M2.7200K8K$0.0083$0.025ลดลง
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731380K33K$0.0083$0.025ลดลง
Z.ai zai-org/GLM-5.3-Flash390K8K$0.0083$0.025ใช้งานได้

ใส่ตัวระบุในฟิลด์ model; ตัวพิมพ์เล็กใหญ่ไม่สำคัญ สถานะคำนวณจากสัดส่วนคำขอที่ประมวลผลสำเร็จ เหมือนในหน้า สถานะเครือข่าย

วิธีเลือกโมเดล#

  • ไม่รู้จะเริ่มจากอะไร — เลือก MiniMaxAI/MiniMax-M2.7: ตัวอย่างในเอกสารและคำสั่งของตัวติดตั้งคำนวณไว้สำหรับโมเดลนี้
  • คอนเท็กซ์ยาวที่สุด — zai-org/GLM-5.3-Flash: 390K โทเคน เหมาะกับโค้ดเบสขนาดใหญ่และเอกสารยาว
  • คำตอบยาวที่สุด — deepseek-ai/DeepSeek-V4-Flash-0731: สูงสุด 33K โทเคนต่อครั้ง เพื่อสร้างไฟล์ขนาดใหญ่ได้ครบทั้งไฟล์

ถ้าเครือข่ายหยุดให้บริการโมเดลนั้น โมเดลจะหายไปจาก GET /v1/models และคำขอจะได้การตอบกลับ 503 พร้อมประเภทข้อผิดพลาด model_unavailable ในข้อความข้อผิดพลาดจะระบุโมเดลที่สามารถสลับไปใช้ได้

ความยาวคำตอบ#

ความยาวคำตอบกำหนดด้วย max_tokens — หรือ max_completion_tokens เกตเวย์เข้าใจทั้งสองฟิลด์ แต่ละโมเดลมีเพดาน: ถ้า max_tokens มากกว่านั้น เกตเวย์จะตัดลงถึงเพดานโดยไม่แจ้ง ถ้าไม่ได้ระบุ max_tokens เมื่อ stream: true จะใช้ค่าเพดาน และแบบไม่สตรีมจะใช้ค่าเริ่มต้นที่ต่ำกว่า

โมเดลที่มีการคิดวิเคราะห์จะใช้ส่วนหนึ่งของ max_tokens ในการคิดก่อนตอบ — เผื่อไว้ด้วย

modelเพดานค่าเริ่มต้น, stream: trueค่าเริ่มต้น, ไม่สตรีม
MiniMaxAI/MiniMax-M2.7819281921500
deepseek-ai/DeepSeek-V4-Flash-073132768327681500
zai-org/GLM-5.3-Flash819281923000

ตัวเลขเดียวกันในรูปแบบเครื่อง — ในการตอบกลับ GET /v1/capabilities ฟิลด์ limits.models

โมเดลเริ่มต้น#

คำขอที่ไม่มีฟิลด์ model เกตเวย์จะส่งไปยังโมเดลเริ่มต้น — ตอนนี้คือ MiniMaxAI/MiniMax-M2.7

Claude Code และ Anthropic SDK ส่งชื่อโมเดลของ Anthropic (claude-*) มาใน /v1/messages — เกตเวย์จะแทนที่ด้วยโมเดลเริ่มต้นเดียวกัน

หากต้องการใช้โมเดลอื่น ให้ระบุตัวระบุจากตารางด้านบน; ในตัวติดตั้งคือแฟล็ก --model

องค์ประกอบและสถานะผ่าน API#

องค์ประกอบของโมเดลเปลี่ยนแปลงตามการโหวตของเครือข่าย Gonka — อย่าฮาร์ดโค้ดรายการในโค้ด ให้ดึงจาก API ไม่ต้องใช้คีย์สำหรับคำขอเหล่านี้

คำขอสิ่งที่ส่งกลับ
GET /v1/modelsโมเดลที่ใช้ได้ตอนนี้: ตัวระบุ, คอนเท็กซ์, ลิมิตการตอบกลับ และราคาต่อโทเคนเป็นดอลลาร์ โมเดลที่เครือข่ายไม่ให้บริการอยู่ในขณะนี้จะไม่อยู่ในรายการ
GET /v1/models/{model}โมเดลเดียวในรูปแบบเดียวกัน สแลชในตัวระบุให้ส่งตามเดิมหรือเป็น %2F โมเดลที่ไม่รู้จักหรือถูกซ่อน — 404 พร้อมรหัส model_not_found และคำขอไปยังโมเดลที่ถูกซ่อนจะได้ 503 model_unavailable
GET /v1/capabilitiesความสามารถของเกตเวย์: โปรโตคอล, พารามิเตอร์คำขอ และฟิลด์ limits — ลิมิตคำขอของคีย์, ไทม์เอาต์ และเพดาน max_tokens ตามโมเดล
GET /v1/network-statusสถานะของแต่ละโมเดลและเหตุการณ์ — ข้อมูลเดียวกับในหน้า สถานะเครือข่าย
GET /healthเกตเวย์เองตอบหรือไม่: {"status":"ok"} คำขอนี้ไม่ได้ตรวจสอบสถานะของโมเดล