อัปเดตและสถานะ
สถานะปัจจุบันของ inferenced และประวัติการเปลี่ยนแปลงของ gateway
สถานะปัจจุบัน
- MiniMax M2.7เครือข่าย Gonka: ประสิทธิภาพลดลง
- DeepSeek V4 Flashเครือข่าย Gonka: ประสิทธิภาพลดลง
- GLM 5.3 Flashเครือข่าย Gonka: ใช้งานได้
ชุดโมเดลที่ใช้งานอยู่จะถูกกำหนดโดยการโหวตจากเครือข่าย Gonka และอาจมีการเปลี่ยนแปลงได้ โมเดลบางส่วนอาจไม่สามารถใช้งานได้ในบางช่วงเวลาและจะกลับมาใช้งานได้ในภายหลัง รายการล่าสุดแสดงอยู่ด้านบน
สถานะโดยละเอียดและอัปไทม์ →ประวัติการอัปเดต
คุณสามารถเติมยอดคงเหลือด้วยโทเค็น WGNK ซึ่งก็คือ GNK บนเครือข่าย Ethereum ในบัญชีของคุณ: เติมเงิน → GNK → Ethereum · WGNK ระบุที่อยู่ที่จะส่งโทเค็นจากนั้น — การโอนจะถูกบันทึกโดยอัตโนมัติ โดยปกติจะใช้เวลา 15–20 นาที
npx @joingonka/setup ปัจจุบันรองรับการตั้งค่า 25 เครื่องมือ สิ่งที่เพิ่มมาใหม่: Codex CLI, Kimi Code, omp, MiniMax Code, Goose, MiMo Code, Qwen Code, Factory Droid, Crush และ Zoo Code สามารถเลือกโมเดลได้ผ่าน flag --model (minimax, deepseek หรือ glm) โดยค่าเริ่มต้นคือ DeepSeek V4 Flash ในตอนท้าย โปรแกรมติดตั้งจะส่งคำขอตรวจสอบและแสดงผลทันทีว่าคีย์ใช้งานได้หรือไม่
ตั้งแต่วันที่ 16 กันยายน เป็นต้นไป บัญชีใหม่ทุกบัญชีจะได้รับ 100,000,000 nGNK (0.1 GNK) จากเดิม 50,000,000 — ตามราคาเครือข่ายปัจจุบัน นี่เทียบเท่ากับประมาณ 3 ล้านโทเค็นสำหรับการทดสอบโดยไม่ต้องฝากเงิน โบนัสจะถูกเครดิตให้โดยอัตโนมัติเมื่อลงทะเบียน ไม่จำเป็นต้องกรอกข้อมูลใดๆ; จำนวนโบนัสปัจจุบันสามารถดูได้ที่ GET /api/pricing (ช่อง welcome_bonus_ngonka) และบนหน้าลงทะเบียน
โหนดของเครือข่าย Gonka จะปิดสตรีมใดๆ หลังจากสร้างไปประมาณ 5 นาที (สำหรับ GLM 5.3 Flash จะอยู่ที่ประมาณ 8,000 token) ก่อนหน้านี้การตัดการเชื่อมต่อแบบนี้จะดูเหมือนการสิ้นสุดปกติ: สตรีมจบลงด้วย [DONE] โดยไม่มี finish_reason และไคลเอ็นต์จะเข้าใจผิดว่าส่วนที่ถูกตัดเป็นคำตอบที่สมบูรณ์ ตอนนี้เกตเวย์จะส่ง chunk ที่มี finish_reason="length" มาให้ ทั้งในสตรีมและในการตอบกลับปกติ ส่วนในรูปแบบ Anthropic จะเป็น stop_reason="max_tokens" สิ่งที่ควรทำเมื่อพบคำตอบที่ยาว: ให้ใช้ stream:true และเมื่อพบ finish_reason="length" ให้ดำเนินการสร้างต่อในคำขอถัดไปโดยส่งส่วนที่ได้รับไปแล้วไว้ในบริบท รายละเอียดเพิ่มเติมดูได้ที่หัวข้อ “Limits” ในเอกสารประกอบ
ในเครือข่าย Gonka มี GLM 5.3 Flash จาก Z.ai ให้ใช้งานแล้ว: 320B พารามิเตอร์ (MoE, 18B ใช้งานจริง), FP8, ใบอนุญาต MIT, context 390 000 tokens โมเดลจะคิดก่อนตอบ: การคิดจะอยู่ในฟิลด์ reasoning_content และใช้ budget ของการตอบ ดังนั้นให้ตั้งค่า max_tokens ไม่น้อยกว่า 600 หรือใช้ stream:true; สำหรับงานสั้นๆ ให้ใช้ reasoning_effort: "low" ระบบ Tool calling และโหมด JSON ใช้งานได้ตามปกติ รหัสคือ zai-org/GLM-5.3-Flash ราคาเท่ากับโมเดลอื่นๆ ในเครือข่าย Kimi K2.6 ไม่รองรับการใช้งานในเครือข่ายแล้ว — ให้เปลี่ยน integration ของคุณไปที่ MiniMax M2.7, DeepSeek V4 Flash หรือ GLM 5.3 Flash
หน้า "การใช้งาน" จะแสดงการบริโภคของแต่ละโมเดล ได้แก่ จำนวนคำขอ, token ขาเข้า/ขาออก, ค่าใช้จ่ายในสกุล nGNK และดอลลาร์, ราคาเฉลี่ยต่อ 1M token และความเร็วในการตอบสนอง "วันนี้" จะแสดงแบบรายชั่วโมง และเพิ่มค่าเริ่มต้น "90 วัน" สำหรับการรวมระบบ: GET /api/usage/by-model
Gateway รองรับการเรียกใช้งาน /v1/completions แล้ว — ซึ่งเป็น endpoint แบบ "text" ของ OpenAI โดยรับค่า input เป็น prompt string และส่งค่า output กลับมาเป็น choices[].text ปลั๊กอินของตัวแก้ไขโค้ดต่าง ๆ (เช่น Continue.dev) จะใช้งาน endpoint นี้สำหรับการเติมคำอัตโนมัติและการแก้ไขโค้ดแบบ inline สำหรับ Base URL ยังคงเหมือนเดิมคือ https://gate.joingonka.ai/v1 รองรับการทำ streaming และพารามิเตอร์มาตรฐาน (max_tokens, temperature, stop) โดยมีค่าใช้จ่ายและข้อจำกัดเช่นเดียวกับ /v1/chat/completions สำหรับฟิลด์ logprobs และ best_of จะไม่ได้รับการรองรับ
ตั้งแต่วันที่ 22 สิงหาคม เป็นต้นไป ค่าบริการ inference คือ ขาเข้า — 33 nGNK, ขาออก — 99 nGNK ต่อโทเค็น (จากเดิม 22/66) ค่าธรรมเนียมเกตเวย์ยังคงเท่าเดิมที่ 10% โหมดทดลองใช้งานยังคงฟรี เหตุผลที่ปรับราคาขึ้น: การส่งคำขอในเครือข่าย Gonka จะได้รับการประมวลผลด้วย redundancy ซึ่งเป็นส่วนหนึ่งของโปรโตคอลและโค้ด devshards ที่จำเป็นเพื่อความลื่นไหลในการให้บริการ คอนเทนเนอร์อาจส่งคำขอไปยังโฮสต์หนึ่ง แล้วส่งต่อไปยังโฮสต์อื่นหากโฮสต์แรกไม่ตอบสนอง หรือส่งไปยังหลายโฮสต์พร้อมกันหากจำเป็น ทุกครั้งที่มีการพยายามจะถูกคิดค่าบริการ: ราคาเครือข่ายอยู่ที่ 10 nGNK ต่อโทเค็น คูณด้วย redundancy ของคำขอนั้น (เฉลี่ย ×1—2.5) ก่อนหน้านี้ต้นทุนนี้ไม่ถึงเราเนื่องจาก API การสรุปราคายังไม่ทำงาน และเราจ่ายในราคาโฮสต์เดียว ตอนนี้ต้นทุนถูกคำนวณตามจริงและเราได้นำมาปรับรวมในอัตราค่าบริการแล้ว Inference ยังคงมีราคาถูกกว่า Vendor API อื่นๆ อยู่หลายร้อยเท่า ราคาล่าสุดของทุกโมเดลสามารถดูได้ที่หน้า Pricing และ GET /api/pricing
เกตเวย์รองรับคำขอในรูปแบบ Responses ซึ่งเป็นโปรโตคอลใหม่ของ OpenAI ที่ SDK เวอร์ชันล่าสุดใช้งานอยู่และเป็นสิ่งที่ Codex CLI ใช้ทำงาน โดยใช้ที่อยู่เดิมคือ base URL https://gate.joingonka.ai/v1 และไคลเอ็นต์จะเรียกใช้งาน /v1/responses เอง การสตรีม, function tools และการส่งออกแบบมีโครงสร้าง (text.format) ใช้งานได้ปกติ ค่าใช้จ่ายและขีดจำกัดเท่ากับ /v1/chat/completions เราไม่ได้จัดเก็บประวัติการสนทนา ดังนั้นค่า store จะถูกละเว้นและ previous_response_id จะส่งคืนข้อผิดพลาด โปรดส่งประวัติทั้งหมดผ่านฟิลด์ input สำหรับเครื่องมือเซิร์ฟเวอร์ในตัวของ OpenAI (web_search, file_search, code_interpreter) ไม่รองรับในขณะนี้ แต่ระบบค้นหาเว็บของเรายังคงใช้งานได้ผ่านปลั๊กอิน web ที่ /v1/chat/completions
ก่อนหน้านี้ ข้อผิดพลาดของเครือข่าย Gonka ในโหมด stream:true จะส่งรหัส 200 กลับมา โดยที่ข้อผิดพลาดจะเห็นได้เฉพาะใน SSE-chunk เท่านั้น ทำให้เอเจนต์ไคลเอนต์เข้าใจผิดว่าเป็นผลลัพธ์ที่สำเร็จแต่ว่างเปล่าและไม่ได้ทำการลองใหม่ ตอนนี้ก่อนที่การตอบกลับจากเครือข่ายจะเริ่มขึ้น ระบบจะส่งข้อผิดพลาดด้วยรหัส HTTP ปกติ ได้แก่ 429 เมื่อโมเดลโหลดเกิน (พร้อมส่วนหัว Retry-After), 504 เมื่อเกิด timeout, 503 หากไม่มี node ว่าง หากข้อผิดพลาดเกิดขึ้นระหว่างการ stream สถานะจะไม่สามารถเปลี่ยนได้ โดยจะมี chunk ที่มีฟิลด์ error อยู่ แต่จะไม่ส่ง [DONE] ปิดท้าย เพื่อไม่ให้ stream ดังกล่าวดูเหมือนเสร็จสมบูรณ์ตามปกติ
npx @joingonka/setup ตอนนี้รองรับการตั้งค่า 15 เครื่องมือเอเจนต์: Claude Code, OpenClaw, Cursor, Cline, opencode, Aider, Kilo Code, Roo Code, Continue, Hermes, Pi, Zed, ZCode, JetBrains AI Assistant และ GitHub Copilot BYOK สำหรับ 7 เครื่องมือแรก ระบบจะเขียนไฟล์ config และผสานรวมเข้ากับของคุณอย่างปลอดภัย (คงคอมเมนต์และการตั้งค่าเดิมไว้) ส่วนเครื่องมืออื่นๆ ที่ต้องตั้งค่าผ่านอินเทอร์เฟซเท่านั้น ระบบจะแสดงค่าพร้อมใช้สำหรับการคัดลอก คุณสามารถเลือกเครื่องมือที่ต้องการได้ทันทีด้วย npx @joingonka/setup --tool zed การทำงานแต่ละครั้งจะปิดท้ายด้วยการส่งคำขอแบบสดไปยังเกตเวย์ เพื่อยืนยันว่าคีย์ ที่อยู่ และโมเดลได้รับการยอมรับแล้ว
ความยาวสูงสุดของการตอบสนองเดียวสำหรับ DeepSeek V4 Flash ถูกเพิ่มขึ้นเป็น 4 เท่า: จาก 8,192 เป็น 32,768 โทเค็น (พารามิเตอร์ max_tokens) ไฟล์ขนาดใหญ่และการตอบสนองที่ยาวจากเครื่องมือเอเจนต์ตอนนี้สามารถใส่ได้ในการเรียกครั้งเดียว นอกจากนี้: หากการตอบสนองถึงขีดจำกัดระหว่างการเรียกใช้เครื่องมือ เกตเวย์จะส่งคืน finish_reason="length" ที่ถูกต้องแทนที่จะเป็นการเรียกที่ถูกตัดทอน ซึ่งช่วยให้เอเจนต์ไคลเอนต์ (Cursor และอื่นๆ) ทำงานต่อไปได้อย่างถูกต้องแทนที่จะค้างอยู่ที่ข้อผิดพลาดในการแยกวิเคราะห์
เครือข่าย Gonka มีโมเดลใหม่ที่ใช้งานได้ลำดับที่ 3 แล้ว — DeepSeek V4 Flash 0731: รองรับบริบท 380,000 โทเค็น (ยาวที่สุดในเครือข่าย ผ่านการตรวจสอบด้วยคำขอจริงที่ 381K) พร้อมรองรับ reasoning และ tool calling ตัวระบุคือ deepseek-ai/DeepSeek-V4-Flash-0731 ราคาเท่ากับโมเดลอื่นๆ โมเดลนี้อยู่ในช่วงทดสอบเบื้องต้นแต่สามารถใช้งานได้เต็มรูปแบบ: เลือกได้ในแชทของแดชบอร์ดหรือระบุในฟิลด์ model ของคำขอ API ของคุณ
ตั้งแต่วันที่ 3 สิงหาคม ค่าใช้จ่ายในการทำ inference คือ: input — 22 nGNK, output — 66 nGNK ต่อ token (สูงขึ้นเป็นสองเท่าจากเดิม 11/33) ค่าธรรมเนียมเกตเวย์ยังคงไม่เปลี่ยนแปลงที่ 10% โหมดทดลองใช้งานยังคงฟรี ราคาล่าสุดของทุกโมเดลสามารถดูได้ที่หน้า Pricing และ GET /api/pricing
หากเครือข่าย Gonka ได้รับคำขอแต่ไม่ตอบกลับ (timeout 300 วินาที) ตอนนี้ gateway จะส่งคืนข้อผิดพลาด 504 ทันทีแทนการลองใหม่แบบเงียบๆ หมายเหตุสำคัญเรื่องการเรียกเก็บเงิน: คำขอที่ยอมรับโดยเครือข่ายไม่สามารถยกเลิกได้ — node จะประมวลผลคำขอนั้นในทุกกรณี ดังนั้นหากเกิด timeout จะมีการหักค่าประมวลผล prompt (ส่วน completion ไม่คิดค่าใช้จ่าย) คำแนะนำ: สำหรับการสร้างที่ยาว ให้ใช้ stream:true — stream จะทนทานต่อ timeout มากกว่าและแสดงความคืบหน้าได้ทันที
ค่าธรรมเนียมการฝากผ่าน USDT จะลดลงตามจำนวนเงินที่ฝาก: พื้นฐาน 5%, ตั้งแต่ $25 — 4.5%, ตั้งแต่ $50 — 4%, ตั้งแต่ $100 — 3.5%, ตั้งแต่ $250 — 3%, ตั้งแต่ $500 — 2.75%, ตั้งแต่ $1000 — 2.5%. หน้าต่างการฝากมีระบบขั้นบันไดแบบโต้ตอบ: แถบเลื่อนจำนวนเงิน, โบนัส GNK ในแต่ละระดับ และยอดเงินที่คุณประหยัดได้ ส่วนลดจะถูกนำไปใช้โดยอัตโนมัติเมื่อฝากเงินสำเร็จ
คุณสามารถกำหนดขีดจำกัดการใช้จ่ายรวม (สะสม) สำหรับคีย์ลูกได้ ซึ่งเป็นโควตาเฉพาะที่ไม่รีเซ็ตเมื่อเทียบกับขีดจำกัดรายวันหรือรายเดือน เมื่อโควตาหมดลง คำขอที่ใช้คีย์นี้จะถูกปฏิเสธ โดยสามารถตั้งค่าขีดจำกัดได้ที่แดชบอร์ด (ความละเอียดระดับ nanogonka) หรือผ่าน API โดยใช้ฟิลด์ limit_total_ngonka ใน POST/PATCH /api/management/keys/{id}/children และสามารถรีเซ็ตการใช้งานสะสมได้ด้วยปุ่ม "Reset usage" (หรือ POST /api/management/keys/{id}/children/{childId}/reset-usage)
ค่าใช้จ่ายในการ inferenced ถูกซิงโครไนซ์กับราคาจริงของเครือข่าย Gonka ต่อโทเค็น ราคายังคงอยู่ในระดับที่ต่ำที่สุดในตลาด คิดเป็นเศษส่วนของเซนต์ต่อล้านโทเค็น ซึ่งถูกกว่า OpenAI และ Anthropic หลายร้อยเท่าเมื่อใช้ open-source โมเดลเดียวกัน โทเค็นขาออก (output tokens) จะมีราคาแพงกว่าโทเค็นขาเข้า (input tokens) (×3) เหมือนกับผู้ให้บริการส่วนใหญ่
เราได้ยืนยันขีดจำกัดบริบทจริงของโมเดลที่ใช้งานอยู่แล้วว่าสูงถึง 200 000 โทเค็น (ก่อนหน้านี้ระบุไว้ที่ 131 072) คุณสามารถส่งเอกสารและประวัติการสนทนาที่ยาวขึ้นได้ โดยข้อมูลจำเพาะปัจจุบันของแต่ละโมเดลสามารถดูได้ที่ส่วน «สถานะเครือข่าย»
ต้นทุนของแต่ละคำขอจะแสดงเป็นดอลลาร์ใน API response (ฟิลด์ usage.total_cost_usd) และในส่วน "การใช้งาน" เพื่อช่วยให้วางแผนค่าใช้จ่ายได้สะดวก
ตั้งค่าการเข้าถึง API ในเครื่องมือของคุณโดยอัตโนมัติด้วยการรัน npx @joingonka/setup รองรับ Claude Code, OpenClaw, Cline, Continue, opencode, Aider และอื่นๆ
โมเดลสามารถค้นหาอินเทอร์เน็ตระหว่างการตอบกลับและเพิ่มลิงก์แหล่งที่มาได้ วิธีเปิดใช้งาน: ส่งค่า plugins: [{ "id": "web", "max_results": 5 }] ใน body ของคำขอ ซึ่งใช้งานได้ทั้งใน API ที่รองรับ OpenAI และ Anthropic
ความยาวสูงสุดของคำตอบสามารถตั้งค่าได้ถึง 8192 tokens โดยควบคุมผ่านพารามิเตอร์ max_tokens (ค่าเริ่มต้นคือ 1024 สำหรับการตอบกลับแบบ streaming และ 1500 สำหรับคำขอทั่วไป)
ในหน้า "แชท" คุณสามารถเลือกโมเดลจากรายการ (โหลดจาก /v1/models) ซึ่งระบบจะจดจำการตั้งค่านี้ไว้ใช้สำหรับบทสนทนาใหม่
ต้องการความเร็ว? เพิ่ม header x-joingonka-meta: 1 ไปที่คำขอของคุณ ในการตอบกลับแบบ streaming คุณจะได้รับค่า ttft_ms (เวลาจนถึงโทเค็นแรก) และ tokens_per_sec
สร้างคีย์จัดการ (POST /api/management/keys) และสร้างคีย์ลูกพร้อมจำกัดสิทธิ์ (โควตารายวัน/รายเดือน, rate limit, วันหมดอายุ) ผ่าน POST /api/management/keys/{id}/children
เชื่อมต่อปลั๊กอินผ่านพารามิเตอร์ plugins: response-healing แก้ไข JSON ที่ถูกตัด, privacy-sanitization ปิดบังข้อมูลส่วนตัว, file-parser สกัดข้อความจาก PDF และเอกสาร
OpenAI: ใช้ base_url https://gate.joingonka.ai/v1 และ header Authorization: Bearer คีย์ของคุณ สำหรับ Anthropic (Claude Code): ใช้ base_url https://gate.joingonka.ai และ header x-api-key ที่ endpoint /v1/messages
GNK: รับที่อยู่และ memo แล้วโอนโทเค็น on-chain USDT: ระบุจำนวนตั้งแต่ 1 ถึง 10,000 ดอลลาร์และชำระผ่าน OxaPay ระบบจะแปลงเป็น GNK โดยอัตโนมัติ