อัปเดตและสถานะ

สถานะปัจจุบันของ inferenced และประวัติการเปลี่ยนแปลงของ gateway

สถานะปัจจุบัน

เครือข่าย Gonka: ประสิทธิภาพลดลง
โมเดลของเครือข่าย
  • MiniMax M2.7เครือข่าย Gonka: ประสิทธิภาพลดลง
  • DeepSeek V4 Flashเครือข่าย Gonka: ประสิทธิภาพลดลง
  • GLM 5.3 Flashเครือข่าย Gonka: ใช้งานได้

ชุดโมเดลที่ใช้งานอยู่จะถูกกำหนดโดยการโหวตจากเครือข่าย Gonka และอาจมีการเปลี่ยนแปลงได้ โมเดลบางส่วนอาจไม่สามารถใช้งานได้ในบางช่วงเวลาและจะกลับมาใช้งานได้ในภายหลัง รายการล่าสุดแสดงอยู่ด้านบน

สถานะโดยละเอียดและอัปไทม์ →

ประวัติการอัปเดต

กันยายน 2569
ฟีเจอร์ใหม่
การฝาก WGNK จาก Ethereum23 ก.ย.

คุณสามารถเติมยอดคงเหลือด้วยโทเค็น WGNK ซึ่งก็คือ GNK บนเครือข่าย Ethereum ในบัญชีของคุณ: เติมเงิน → GNK → Ethereum · WGNK ระบุที่อยู่ที่จะส่งโทเค็นจากนั้น — การโอนจะถูกบันทึกโดยอัตโนมัติ โดยปกติจะใช้เวลา 15–20 นาที

ฟีเจอร์ใหม่
โปรแกรมติดตั้ง: 25 เครื่องมือ21 ก.ย.

npx @joingonka/setup ปัจจุบันรองรับการตั้งค่า 25 เครื่องมือ สิ่งที่เพิ่มมาใหม่: Codex CLI, Kimi Code, omp, MiniMax Code, Goose, MiMo Code, Qwen Code, Factory Droid, Crush และ Zoo Code สามารถเลือกโมเดลได้ผ่าน flag --model (minimax, deepseek หรือ glm) โดยค่าเริ่มต้นคือ DeepSeek V4 Flash ในตอนท้าย โปรแกรมติดตั้งจะส่งคำขอตรวจสอบและแสดงผลทันทีว่าคีย์ใช้งานได้หรือไม่

การปรับปรุง
โบนัสต้อนรับเพิ่มเป็นสองเท่า: 100,000,000 nGNK สำหรับบัญชีใหม่16 ก.ย.

ตั้งแต่วันที่ 16 กันยายน เป็นต้นไป บัญชีใหม่ทุกบัญชีจะได้รับ 100,000,000 nGNK (0.1 GNK) จากเดิม 50,000,000 — ตามราคาเครือข่ายปัจจุบัน นี่เทียบเท่ากับประมาณ 3 ล้านโทเค็นสำหรับการทดสอบโดยไม่ต้องฝากเงิน โบนัสจะถูกเครดิตให้โดยอัตโนมัติเมื่อลงทะเบียน ไม่จำเป็นต้องกรอกข้อมูลใดๆ; จำนวนโบนัสปัจจุบันสามารถดูได้ที่ GET /api/pricing (ช่อง welcome_bonus_ngonka) และบนหน้าลงทะเบียน

การปรับปรุง
การตัดการสร้างข้อความที่ยาว — finish_reason=length ที่ตรงไปตรงมา16 ก.ย.

โหนดของเครือข่าย Gonka จะปิดสตรีมใดๆ หลังจากสร้างไปประมาณ 5 นาที (สำหรับ GLM 5.3 Flash จะอยู่ที่ประมาณ 8,000 token) ก่อนหน้านี้การตัดการเชื่อมต่อแบบนี้จะดูเหมือนการสิ้นสุดปกติ: สตรีมจบลงด้วย [DONE] โดยไม่มี finish_reason และไคลเอ็นต์จะเข้าใจผิดว่าส่วนที่ถูกตัดเป็นคำตอบที่สมบูรณ์ ตอนนี้เกตเวย์จะส่ง chunk ที่มี finish_reason="length" มาให้ ทั้งในสตรีมและในการตอบกลับปกติ ส่วนในรูปแบบ Anthropic จะเป็น stop_reason="max_tokens" สิ่งที่ควรทำเมื่อพบคำตอบที่ยาว: ให้ใช้ stream:true และเมื่อพบ finish_reason="length" ให้ดำเนินการสร้างต่อในคำขอถัดไปโดยส่งส่วนที่ได้รับไปแล้วไว้ในบริบท รายละเอียดเพิ่มเติมดูได้ที่หัวข้อ “Limits” ในเอกสารประกอบ

ฟีเจอร์ใหม่
โมเดลใหม่: GLM 5.3 Flash — reasoning จาก Z.ai16 ก.ย.

ในเครือข่าย Gonka มี GLM 5.3 Flash จาก Z.ai ให้ใช้งานแล้ว: 320B พารามิเตอร์ (MoE, 18B ใช้งานจริง), FP8, ใบอนุญาต MIT, context 390 000 tokens โมเดลจะคิดก่อนตอบ: การคิดจะอยู่ในฟิลด์ reasoning_content และใช้ budget ของการตอบ ดังนั้นให้ตั้งค่า max_tokens ไม่น้อยกว่า 600 หรือใช้ stream:true; สำหรับงานสั้นๆ ให้ใช้ reasoning_effort: "low" ระบบ Tool calling และโหมด JSON ใช้งานได้ตามปกติ รหัสคือ zai-org/GLM-5.3-Flash ราคาเท่ากับโมเดลอื่นๆ ในเครือข่าย Kimi K2.6 ไม่รองรับการใช้งานในเครือข่ายแล้ว — ให้เปลี่ยน integration ของคุณไปที่ MiniMax M2.7, DeepSeek V4 Flash หรือ GLM 5.3 Flash

ฟีเจอร์ใหม่
สถิติการใช้งานตามโมเดล15 ก.ย.

หน้า "การใช้งาน" จะแสดงการบริโภคของแต่ละโมเดล ได้แก่ จำนวนคำขอ, token ขาเข้า/ขาออก, ค่าใช้จ่ายในสกุล nGNK และดอลลาร์, ราคาเฉลี่ยต่อ 1M token และความเร็วในการตอบสนอง "วันนี้" จะแสดงแบบรายชั่วโมง และเพิ่มค่าเริ่มต้น "90 วัน" สำหรับการรวมระบบ: GET /api/usage/by-model

สิงหาคม 2569
ฟีเจอร์ใหม่
รองรับ legacy OpenAI Completions24 ส.ค.

Gateway รองรับการเรียกใช้งาน /v1/completions แล้ว — ซึ่งเป็น endpoint แบบ "text" ของ OpenAI โดยรับค่า input เป็น prompt string และส่งค่า output กลับมาเป็น choices[].text ปลั๊กอินของตัวแก้ไขโค้ดต่าง ๆ (เช่น Continue.dev) จะใช้งาน endpoint นี้สำหรับการเติมคำอัตโนมัติและการแก้ไขโค้ดแบบ inline สำหรับ Base URL ยังคงเหมือนเดิมคือ https://gate.joingonka.ai/v1 รองรับการทำ streaming และพารามิเตอร์มาตรฐาน (max_tokens, temperature, stop) โดยมีค่าใช้จ่ายและข้อจำกัดเช่นเดียวกับ /v1/chat/completions สำหรับฟิลด์ logprobs และ best_of จะไม่ได้รับการรองรับ

การปรับปรุง
อัปเดตค่าบริการ Inference22 ส.ค.

ตั้งแต่วันที่ 22 สิงหาคม เป็นต้นไป ค่าบริการ inference คือ ขาเข้า — 33 nGNK, ขาออก — 99 nGNK ต่อโทเค็น (จากเดิม 22/66) ค่าธรรมเนียมเกตเวย์ยังคงเท่าเดิมที่ 10% โหมดทดลองใช้งานยังคงฟรี เหตุผลที่ปรับราคาขึ้น: การส่งคำขอในเครือข่าย Gonka จะได้รับการประมวลผลด้วย redundancy ซึ่งเป็นส่วนหนึ่งของโปรโตคอลและโค้ด devshards ที่จำเป็นเพื่อความลื่นไหลในการให้บริการ คอนเทนเนอร์อาจส่งคำขอไปยังโฮสต์หนึ่ง แล้วส่งต่อไปยังโฮสต์อื่นหากโฮสต์แรกไม่ตอบสนอง หรือส่งไปยังหลายโฮสต์พร้อมกันหากจำเป็น ทุกครั้งที่มีการพยายามจะถูกคิดค่าบริการ: ราคาเครือข่ายอยู่ที่ 10 nGNK ต่อโทเค็น คูณด้วย redundancy ของคำขอนั้น (เฉลี่ย ×1—2.5) ก่อนหน้านี้ต้นทุนนี้ไม่ถึงเราเนื่องจาก API การสรุปราคายังไม่ทำงาน และเราจ่ายในราคาโฮสต์เดียว ตอนนี้ต้นทุนถูกคำนวณตามจริงและเราได้นำมาปรับรวมในอัตราค่าบริการแล้ว Inference ยังคงมีราคาถูกกว่า Vendor API อื่นๆ อยู่หลายร้อยเท่า ราคาล่าสุดของทุกโมเดลสามารถดูได้ที่หน้า Pricing และ GET /api/pricing

ฟีเจอร์ใหม่
รองรับ OpenAI Responses API22 ส.ค.

เกตเวย์รองรับคำขอในรูปแบบ Responses ซึ่งเป็นโปรโตคอลใหม่ของ OpenAI ที่ SDK เวอร์ชันล่าสุดใช้งานอยู่และเป็นสิ่งที่ Codex CLI ใช้ทำงาน โดยใช้ที่อยู่เดิมคือ base URL https://gate.joingonka.ai/v1 และไคลเอ็นต์จะเรียกใช้งาน /v1/responses เอง การสตรีม, function tools และการส่งออกแบบมีโครงสร้าง (text.format) ใช้งานได้ปกติ ค่าใช้จ่ายและขีดจำกัดเท่ากับ /v1/chat/completions เราไม่ได้จัดเก็บประวัติการสนทนา ดังนั้นค่า store จะถูกละเว้นและ previous_response_id จะส่งคืนข้อผิดพลาด โปรดส่งประวัติทั้งหมดผ่านฟิลด์ input สำหรับเครื่องมือเซิร์ฟเวอร์ในตัวของ OpenAI (web_search, file_search, code_interpreter) ไม่รองรับในขณะนี้ แต่ระบบค้นหาเว็บของเรายังคงใช้งานได้ผ่านปลั๊กอิน web ที่ /v1/chat/completions

การแก้ไข
ข้อผิดพลาดของ Stream ด้วยรหัส HTTP ที่ถูกต้อง20 ส.ค.

ก่อนหน้านี้ ข้อผิดพลาดของเครือข่าย Gonka ในโหมด stream:true จะส่งรหัส 200 กลับมา โดยที่ข้อผิดพลาดจะเห็นได้เฉพาะใน SSE-chunk เท่านั้น ทำให้เอเจนต์ไคลเอนต์เข้าใจผิดว่าเป็นผลลัพธ์ที่สำเร็จแต่ว่างเปล่าและไม่ได้ทำการลองใหม่ ตอนนี้ก่อนที่การตอบกลับจากเครือข่ายจะเริ่มขึ้น ระบบจะส่งข้อผิดพลาดด้วยรหัส HTTP ปกติ ได้แก่ 429 เมื่อโมเดลโหลดเกิน (พร้อมส่วนหัว Retry-After), 504 เมื่อเกิด timeout, 503 หากไม่มี node ว่าง หากข้อผิดพลาดเกิดขึ้นระหว่างการ stream สถานะจะไม่สามารถเปลี่ยนได้ โดยจะมี chunk ที่มีฟิลด์ error อยู่ แต่จะไม่ส่ง [DONE] ปิดท้าย เพื่อไม่ให้ stream ดังกล่าวดูเหมือนเสร็จสมบูรณ์ตามปกติ

ฟีเจอร์ใหม่
ตัวติดตั้ง: 15 เครื่องมือในคำสั่งเดียว20 ส.ค.

npx @joingonka/setup ตอนนี้รองรับการตั้งค่า 15 เครื่องมือเอเจนต์: Claude Code, OpenClaw, Cursor, Cline, opencode, Aider, Kilo Code, Roo Code, Continue, Hermes, Pi, Zed, ZCode, JetBrains AI Assistant และ GitHub Copilot BYOK สำหรับ 7 เครื่องมือแรก ระบบจะเขียนไฟล์ config และผสานรวมเข้ากับของคุณอย่างปลอดภัย (คงคอมเมนต์และการตั้งค่าเดิมไว้) ส่วนเครื่องมืออื่นๆ ที่ต้องตั้งค่าผ่านอินเทอร์เฟซเท่านั้น ระบบจะแสดงค่าพร้อมใช้สำหรับการคัดลอก คุณสามารถเลือกเครื่องมือที่ต้องการได้ทันทีด้วย npx @joingonka/setup --tool zed การทำงานแต่ละครั้งจะปิดท้ายด้วยการส่งคำขอแบบสดไปยังเกตเวย์ เพื่อยืนยันว่าคีย์ ที่อยู่ และโมเดลได้รับการยอมรับแล้ว

การปรับปรุง
ขีดจำกัดการตอบสนองของ DeepSeek — 32,768 โทเค็น17 ส.ค.

ความยาวสูงสุดของการตอบสนองเดียวสำหรับ DeepSeek V4 Flash ถูกเพิ่มขึ้นเป็น 4 เท่า: จาก 8,192 เป็น 32,768 โทเค็น (พารามิเตอร์ max_tokens) ไฟล์ขนาดใหญ่และการตอบสนองที่ยาวจากเครื่องมือเอเจนต์ตอนนี้สามารถใส่ได้ในการเรียกครั้งเดียว นอกจากนี้: หากการตอบสนองถึงขีดจำกัดระหว่างการเรียกใช้เครื่องมือ เกตเวย์จะส่งคืน finish_reason="length" ที่ถูกต้องแทนที่จะเป็นการเรียกที่ถูกตัดทอน ซึ่งช่วยให้เอเจนต์ไคลเอนต์ (Cursor และอื่นๆ) ทำงานต่อไปได้อย่างถูกต้องแทนที่จะค้างอยู่ที่ข้อผิดพลาดในการแยกวิเคราะห์

ฟีเจอร์ใหม่
โมเดลใหม่: DeepSeek V4 Flash พร้อมบริบท 380K13 ส.ค.

เครือข่าย Gonka มีโมเดลใหม่ที่ใช้งานได้ลำดับที่ 3 แล้ว — DeepSeek V4 Flash 0731: รองรับบริบท 380,000 โทเค็น (ยาวที่สุดในเครือข่าย ผ่านการตรวจสอบด้วยคำขอจริงที่ 381K) พร้อมรองรับ reasoning และ tool calling ตัวระบุคือ deepseek-ai/DeepSeek-V4-Flash-0731 ราคาเท่ากับโมเดลอื่นๆ โมเดลนี้อยู่ในช่วงทดสอบเบื้องต้นแต่สามารถใช้งานได้เต็มรูปแบบ: เลือกได้ในแชทของแดชบอร์ดหรือระบุในฟิลด์ model ของคำขอ API ของคุณ

การปรับปรุง
อัปเดตราคาการทำ Inference3 ส.ค.

ตั้งแต่วันที่ 3 สิงหาคม ค่าใช้จ่ายในการทำ inference คือ: input — 22 nGNK, output — 66 nGNK ต่อ token (สูงขึ้นเป็นสองเท่าจากเดิม 11/33) ค่าธรรมเนียมเกตเวย์ยังคงไม่เปลี่ยนแปลงที่ 10% โหมดทดลองใช้งานยังคงฟรี ราคาล่าสุดของทุกโมเดลสามารถดูได้ที่หน้า Pricing และ GET /api/pricing

กรกฎาคม 2569
การปรับปรุง
Timeout ที่เป็นธรรม: ตอบกลับ 504 ทันทีแทนการค้าง 5 นาที23 ก.ค.

หากเครือข่าย Gonka ได้รับคำขอแต่ไม่ตอบกลับ (timeout 300 วินาที) ตอนนี้ gateway จะส่งคืนข้อผิดพลาด 504 ทันทีแทนการลองใหม่แบบเงียบๆ หมายเหตุสำคัญเรื่องการเรียกเก็บเงิน: คำขอที่ยอมรับโดยเครือข่ายไม่สามารถยกเลิกได้ — node จะประมวลผลคำขอนั้นในทุกกรณี ดังนั้นหากเกิด timeout จะมีการหักค่าประมวลผล prompt (ส่วน completion ไม่คิดค่าใช้จ่าย) คำแนะนำ: สำหรับการสร้างที่ยาว ให้ใช้ stream:true — stream จะทนทานต่อ timeout มากกว่าและแสดงความคืบหน้าได้ทันที

ฟีเจอร์ใหม่
ขั้นบันไดค่าธรรมเนียมการฝาก USDT — สูงสุด −50%9 ก.ค.

ค่าธรรมเนียมการฝากผ่าน USDT จะลดลงตามจำนวนเงินที่ฝาก: พื้นฐาน 5%, ตั้งแต่ $25 — 4.5%, ตั้งแต่ $50 — 4%, ตั้งแต่ $100 — 3.5%, ตั้งแต่ $250 — 3%, ตั้งแต่ $500 — 2.75%, ตั้งแต่ $1000 — 2.5%. หน้าต่างการฝากมีระบบขั้นบันไดแบบโต้ตอบ: แถบเลื่อนจำนวนเงิน, โบนัส GNK ในแต่ละระดับ และยอดเงินที่คุณประหยัดได้ ส่วนลดจะถูกนำไปใช้โดยอัตโนมัติเมื่อฝากเงินสำเร็จ

มิถุนายน 2569
ฟีเจอร์ใหม่
ขีดจำกัดการใช้จ่ายรวมสำหรับคีย์28 มิ.ย.

คุณสามารถกำหนดขีดจำกัดการใช้จ่ายรวม (สะสม) สำหรับคีย์ลูกได้ ซึ่งเป็นโควตาเฉพาะที่ไม่รีเซ็ตเมื่อเทียบกับขีดจำกัดรายวันหรือรายเดือน เมื่อโควตาหมดลง คำขอที่ใช้คีย์นี้จะถูกปฏิเสธ โดยสามารถตั้งค่าขีดจำกัดได้ที่แดชบอร์ด (ความละเอียดระดับ nanogonka) หรือผ่าน API โดยใช้ฟิลด์ limit_total_ngonka ใน POST/PATCH /api/management/keys/{id}/children และสามารถรีเซ็ตการใช้งานสะสมได้ด้วยปุ่ม "Reset usage" (หรือ POST /api/management/keys/{id}/children/{childId}/reset-usage)

การปรับปรุง
การกำหนดราคา — ตามราคาจริงของเครือข่าย27 มิ.ย.

ค่าใช้จ่ายในการ inferenced ถูกซิงโครไนซ์กับราคาจริงของเครือข่าย Gonka ต่อโทเค็น ราคายังคงอยู่ในระดับที่ต่ำที่สุดในตลาด คิดเป็นเศษส่วนของเซนต์ต่อล้านโทเค็น ซึ่งถูกกว่า OpenAI และ Anthropic หลายร้อยเท่าเมื่อใช้ open-source โมเดลเดียวกัน โทเค็นขาออก (output tokens) จะมีราคาแพงกว่าโทเค็นขาเข้า (input tokens) (×3) เหมือนกับผู้ให้บริการส่วนใหญ่

การปรับปรุง
บริบท (context) สูงสุด 200 000 โทเค็น27 มิ.ย.

เราได้ยืนยันขีดจำกัดบริบทจริงของโมเดลที่ใช้งานอยู่แล้วว่าสูงถึง 200 000 โทเค็น (ก่อนหน้านี้ระบุไว้ที่ 131 072) คุณสามารถส่งเอกสารและประวัติการสนทนาที่ยาวขึ้นได้ โดยข้อมูลจำเพาะปัจจุบันของแต่ละโมเดลสามารถดูได้ที่ส่วน «สถานะเครือข่าย»

การปรับปรุง
ราคาคำขอเป็นดอลลาร์23 มิ.ย.

ต้นทุนของแต่ละคำขอจะแสดงเป็นดอลลาร์ใน API response (ฟิลด์ usage.total_cost_usd) และในส่วน "การใช้งาน" เพื่อช่วยให้วางแผนค่าใช้จ่ายได้สะดวก

ฟีเจอร์ใหม่
เชื่อมต่อด้วยคำสั่งเดียว23 มิ.ย.

ตั้งค่าการเข้าถึง API ในเครื่องมือของคุณโดยอัตโนมัติด้วยการรัน npx @joingonka/setup รองรับ Claude Code, OpenClaw, Cline, Continue, opencode, Aider และอื่นๆ

ฟีเจอร์ใหม่
การค้นหาเว็บแบบเรียลไทม์17 มิ.ย.

โมเดลสามารถค้นหาอินเทอร์เน็ตระหว่างการตอบกลับและเพิ่มลิงก์แหล่งที่มาได้ วิธีเปิดใช้งาน: ส่งค่า plugins: [{ "id": "web", "max_results": 5 }] ใน body ของคำขอ ซึ่งใช้งานได้ทั้งใน API ที่รองรับ OpenAI และ Anthropic

พฤษภาคม 2569
การปรับปรุง
คำตอบยาวสูงสุด 8192 tokens25 พ.ค.

ความยาวสูงสุดของคำตอบสามารถตั้งค่าได้ถึง 8192 tokens โดยควบคุมผ่านพารามิเตอร์ max_tokens (ค่าเริ่มต้นคือ 1024 สำหรับการตอบกลับแบบ streaming และ 1500 สำหรับคำขอทั่วไป)

ฟีเจอร์ใหม่
เลือกโมเดลในแชท5 พ.ค.

ในหน้า "แชท" คุณสามารถเลือกโมเดลจากรายการ (โหลดจาก /v1/models) ซึ่งระบบจะจดจำการตั้งค่านี้ไว้ใช้สำหรับบทสนทนาใหม่

การปรับปรุง
เมทริกซ์ความเร็วการตอบกลับ5 พ.ค.

ต้องการความเร็ว? เพิ่ม header x-joingonka-meta: 1 ไปที่คำขอของคุณ ในการตอบกลับแบบ streaming คุณจะได้รับค่า ttft_ms (เวลาจนถึงโทเค็นแรก) และ tokens_per_sec

มีนาคม 2569
ฟีเจอร์ใหม่
คีย์จัดการสำหรับการขายต่อ24 มี.ค.

สร้างคีย์จัดการ (POST /api/management/keys) และสร้างคีย์ลูกพร้อมจำกัดสิทธิ์ (โควตารายวัน/รายเดือน, rate limit, วันหมดอายุ) ผ่าน POST /api/management/keys/{id}/children

ฟีเจอร์ใหม่
ปลั๊กอินประมวลผลคำขอ24 มี.ค.

เชื่อมต่อปลั๊กอินผ่านพารามิเตอร์ plugins: response-healing แก้ไข JSON ที่ถูกตัด, privacy-sanitization ปิดบังข้อมูลส่วนตัว, file-parser สกัดข้อความจาก PDF และเอกสาร

ฟีเจอร์ใหม่
API ที่รองรับ OpenAI และ Anthropic19 มี.ค.

OpenAI: ใช้ base_url https://gate.joingonka.ai/v1 และ header Authorization: Bearer คีย์ของคุณ สำหรับ Anthropic (Claude Code): ใช้ base_url https://gate.joingonka.ai และ header x-api-key ที่ endpoint /v1/messages

ฟีเจอร์ใหม่
เติมเงินด้วย GNK และ USDT18 มี.ค.

GNK: รับที่อยู่และ memo แล้วโอนโทเค็น on-chain USDT: ระบุจำนวนตั้งแต่ 1 ถึง 10,000 ดอลลาร์และชำระผ่าน OxaPay ระบบจะแปลงเป็น GNK โดยอัตโนมัติ