อัปเดตและสถานะ
สถานะปัจจุบันของ inferenced และประวัติการเปลี่ยนแปลงของ gateway
สถานะปัจจุบัน
- MiniMax M2.7เครือข่าย Gonka: ใช้งานได้
- Kimi K2.6เครือข่าย Gonka: ใช้งานได้
- DeepSeek V4 Flashเครือข่าย Gonka: ใช้งานได้
ชุดโมเดลที่ใช้งานอยู่จะถูกกำหนดโดยการโหวตจากเครือข่าย Gonka และอาจมีการเปลี่ยนแปลงได้ โมเดลบางส่วนอาจไม่สามารถใช้งานได้ในบางช่วงเวลาและจะกลับมาใช้งานได้ในภายหลัง รายการล่าสุดแสดงอยู่ด้านบน
สถานะโดยละเอียดและอัปไทม์ →ประวัติการอัปเดต
ความยาวสูงสุดของการตอบสนองเดียวสำหรับ DeepSeek V4 Flash ถูกเพิ่มขึ้นเป็น 4 เท่า: จาก 8,192 เป็น 32,768 โทเค็น (พารามิเตอร์ max_tokens) ไฟล์ขนาดใหญ่และการตอบสนองที่ยาวจากเครื่องมือเอเจนต์ตอนนี้สามารถใส่ได้ในการเรียกครั้งเดียว นอกจากนี้: หากการตอบสนองถึงขีดจำกัดระหว่างการเรียกใช้เครื่องมือ เกตเวย์จะส่งคืน finish_reason="length" ที่ถูกต้องแทนที่จะเป็นการเรียกที่ถูกตัดทอน ซึ่งช่วยให้เอเจนต์ไคลเอนต์ (Cursor และอื่นๆ) ทำงานต่อไปได้อย่างถูกต้องแทนที่จะค้างอยู่ที่ข้อผิดพลาดในการแยกวิเคราะห์
เครือข่าย Gonka มีโมเดลใหม่ที่ใช้งานได้ลำดับที่ 3 แล้ว — DeepSeek V4 Flash 0731: รองรับบริบท 380,000 โทเค็น (ยาวที่สุดในเครือข่าย ผ่านการตรวจสอบด้วยคำขอจริงที่ 381K) พร้อมรองรับ reasoning และ tool calling ตัวระบุคือ deepseek-ai/DeepSeek-V4-Flash-0731 ราคาเท่ากับโมเดลอื่นๆ โมเดลนี้อยู่ในช่วงทดสอบเบื้องต้นแต่สามารถใช้งานได้เต็มรูปแบบ: เลือกได้ในแชทของแดชบอร์ดหรือระบุในฟิลด์ model ของคำขอ API ของคุณ
ตั้งแต่วันที่ 3 สิงหาคม ค่าใช้จ่ายในการทำ inference คือ: input — 22 nGNK, output — 66 nGNK ต่อ token (สูงขึ้นเป็นสองเท่าจากเดิม 11/33) ค่าธรรมเนียมเกตเวย์ยังคงไม่เปลี่ยนแปลงที่ 10% โหมดทดลองใช้งานยังคงฟรี ราคาล่าสุดของทุกโมเดลสามารถดูได้ที่หน้า Pricing และ GET /api/pricing
หากเครือข่าย Gonka ได้รับคำขอแต่ไม่ตอบกลับ (timeout 300 วินาที) ตอนนี้ gateway จะส่งคืนข้อผิดพลาด 504 ทันทีแทนการลองใหม่แบบเงียบๆ หมายเหตุสำคัญเรื่องการเรียกเก็บเงิน: คำขอที่ยอมรับโดยเครือข่ายไม่สามารถยกเลิกได้ — node จะประมวลผลคำขอนั้นในทุกกรณี ดังนั้นหากเกิด timeout จะมีการหักค่าประมวลผล prompt (ส่วน completion ไม่คิดค่าใช้จ่าย) คำแนะนำ: สำหรับการสร้างที่ยาว ให้ใช้ stream:true — stream จะทนทานต่อ timeout มากกว่าและแสดงความคืบหน้าได้ทันที
ค่าธรรมเนียมการฝากผ่าน USDT จะลดลงตามจำนวนเงินที่ฝาก: พื้นฐาน 5%, ตั้งแต่ $25 — 4.5%, ตั้งแต่ $50 — 4%, ตั้งแต่ $100 — 3.5%, ตั้งแต่ $250 — 3%, ตั้งแต่ $500 — 2.75%, ตั้งแต่ $1000 — 2.5%. หน้าต่างการฝากมีระบบขั้นบันไดแบบโต้ตอบ: แถบเลื่อนจำนวนเงิน, โบนัส GNK ในแต่ละระดับ และยอดเงินที่คุณประหยัดได้ ส่วนลดจะถูกนำไปใช้โดยอัตโนมัติเมื่อฝากเงินสำเร็จ
คุณสามารถกำหนดขีดจำกัดการใช้จ่ายรวม (สะสม) สำหรับคีย์ลูกได้ ซึ่งเป็นโควตาเฉพาะที่ไม่รีเซ็ตเมื่อเทียบกับขีดจำกัดรายวันหรือรายเดือน เมื่อโควตาหมดลง คำขอที่ใช้คีย์นี้จะถูกปฏิเสธ โดยสามารถตั้งค่าขีดจำกัดได้ที่แดชบอร์ด (ความละเอียดระดับ nanogonka) หรือผ่าน API โดยใช้ฟิลด์ limit_total_ngonka ใน POST/PATCH /api/management/keys/{id}/children และสามารถรีเซ็ตการใช้งานสะสมได้ด้วยปุ่ม "Reset usage" (หรือ POST /api/management/keys/{id}/children/{childId}/reset-usage)
ค่าใช้จ่ายในการ inferenced ถูกซิงโครไนซ์กับราคาจริงของเครือข่าย Gonka ต่อโทเค็น ราคายังคงอยู่ในระดับที่ต่ำที่สุดในตลาด คิดเป็นเศษส่วนของเซนต์ต่อล้านโทเค็น ซึ่งถูกกว่า OpenAI และ Anthropic หลายร้อยเท่าเมื่อใช้ open-source โมเดลเดียวกัน โทเค็นขาออก (output tokens) จะมีราคาแพงกว่าโทเค็นขาเข้า (input tokens) (×3) เหมือนกับผู้ให้บริการส่วนใหญ่
เราได้ยืนยันขีดจำกัดบริบทจริงของโมเดลที่ใช้งานอยู่แล้วว่าสูงถึง 200 000 โทเค็น (ก่อนหน้านี้ระบุไว้ที่ 131 072) คุณสามารถส่งเอกสารและประวัติการสนทนาที่ยาวขึ้นได้ โดยข้อมูลจำเพาะปัจจุบันของแต่ละโมเดลสามารถดูได้ที่ส่วน «สถานะเครือข่าย»
ต้นทุนของแต่ละคำขอจะแสดงเป็นดอลลาร์ใน API response (ฟิลด์ usage.total_cost_usd) และในส่วน "การใช้งาน" เพื่อช่วยให้วางแผนค่าใช้จ่ายได้สะดวก
ตั้งค่าการเข้าถึง API ในเครื่องมือของคุณโดยอัตโนมัติด้วยการรัน npx @joingonka/setup รองรับ Claude Code, OpenClaw, Cline, Continue, opencode, Aider และอื่นๆ
โมเดลสามารถค้นหาอินเทอร์เน็ตระหว่างการตอบกลับและเพิ่มลิงก์แหล่งที่มาได้ วิธีเปิดใช้งาน: ส่งค่า plugins: [{ "id": "web", "max_results": 5 }] ใน body ของคำขอ ซึ่งใช้งานได้ทั้งใน API ที่รองรับ OpenAI และ Anthropic
ความยาวสูงสุดของคำตอบสามารถตั้งค่าได้ถึง 8192 tokens โดยควบคุมผ่านพารามิเตอร์ max_tokens (ค่าเริ่มต้นคือ 1024 สำหรับการตอบกลับแบบ streaming และ 1500 สำหรับคำขอทั่วไป)
ในหน้า "แชท" คุณสามารถเลือกโมเดลจากรายการ (โหลดจาก /v1/models) ซึ่งระบบจะจดจำการตั้งค่านี้ไว้ใช้สำหรับบทสนทนาใหม่
ต้องการความเร็ว? เพิ่ม header x-joingonka-meta: 1 ไปที่คำขอของคุณ ในการตอบกลับแบบ streaming คุณจะได้รับค่า ttft_ms (เวลาจนถึงโทเค็นแรก) และ tokens_per_sec
สร้างคีย์จัดการ (POST /api/management/keys) และสร้างคีย์ลูกพร้อมจำกัดสิทธิ์ (โควตารายวัน/รายเดือน, rate limit, วันหมดอายุ) ผ่าน POST /api/management/keys/{id}/children
เชื่อมต่อปลั๊กอินผ่านพารามิเตอร์ plugins: response-healing แก้ไข JSON ที่ถูกตัด, privacy-sanitization ปิดบังข้อมูลส่วนตัว, file-parser สกัดข้อความจาก PDF และเอกสาร
OpenAI: ใช้ base_url https://gate.joingonka.ai/v1 และ header Authorization: Bearer คีย์ของคุณ สำหรับ Anthropic (Claude Code): ใช้ base_url https://gate.joingonka.ai และ header x-api-key ที่ endpoint /v1/messages
GNK: รับที่อยู่และ memo แล้วโอนโทเค็น on-chain USDT: ระบุจำนวนตั้งแต่ 1 ถึง 10,000 ดอลลาร์และชำระผ่าน OxaPay ระบบจะแปลงเป็น GNK โดยอัตโนมัติ