Cập nhật và Trạng thái

Trạng thái inferenced hiện tại và lịch sử thay đổi của cổng.

Trạng thái hiện tại

Mạng Gonka: Hiệu suất giảm sút
Các mô hình mạng lưới
  • MiniMax M2.7Mạng Gonka: Hiệu suất giảm sút
  • DeepSeek V4 FlashMạng Gonka: Hiệu suất giảm sút
  • GLM 5.3 FlashMạng Gonka: Đang hoạt động

Tập hợp các mô hình hoạt động được xác định bởi bỏ phiếu mạng lưới Gonka và có thể thay đổi: một số mô hình đôi khi không khả dụng và sẽ quay lại sau. Danh sách hiện tại nằm ở trên.

Trạng thái chi tiết và thời gian hoạt động →

Lịch sử cập nhật

tháng 9 năm 2026
Tính năng mới
Nạp WGNK từ Ethereum23 thg 9

Bạn có thể nạp số dư bằng token WGNK — đây là GNK trên mạng Ethereum. Trong tài khoản: Nạp tiền → GNK → Ethereum · WGNK; chỉ định địa chỉ mà bạn sẽ gửi token từ đó — giao dịch sẽ được ghi có tự động, thường trong vòng 15–20 phút.

Tính năng mới
Trình cài đặt: 25 công cụ21 thg 9

npx @joingonka/setup hiện cấu hình 25 công cụ. Mới: Codex CLI, Kimi Code, omp, MiniMax Code, Goose, MiMo Code, Qwen Code, Factory Droid, Crush và Zoo Code. Mô hình được chọn thông qua flag --model (minimax, deepseek hoặc glm), mặc định là DeepSeek V4 Flash. Cuối cùng, trình cài đặt sẽ gửi một yêu cầu xác thực và hiển thị ngay lập tức liệu khóa có hoạt động hay không.

Cải tiến
Thưởng chào mừng tăng gấp đôi: 100,000,000 nGNK cho tài khoản mới16 thg 9

Kể từ ngày 16 tháng 9, mỗi tài khoản mới sẽ nhận được 100,000,000 nGNK (0.1 GNK) thay vì 50,000,000 như trước đây — theo giá mạng lưới hiện tại, con số này tương đương khoảng 3 triệu token để thử nghiệm mà không cần nạp tiền. Tiền thưởng được ghi có tự động khi đăng ký, không cần nhập liệu gì thêm; mức thưởng hiện tại luôn được hiển thị trong GET /api/pricing (trường welcome_bonus_ngonka) và trên trang đăng ký.

Cải tiến
Cắt ngắn tạo nội dung dài — finish_reason=length trung thực16 thg 9

Các broker của mạng lưới Gonka sẽ kết thúc bất kỳ luồng nào sau khoảng 5 phút tạo (đối với GLM 5.3 Flash, khoảng 8.000 token). Trước đây, việc cắt này trông giống như kết thúc bình thường: luồng kết thúc bằng [DONE] mà không có finish_reason, và client nhầm phần bị cắt là câu trả lời đầy đủ. Bây giờ, gateway sẽ gửi kèm một chunk với finish_reason="length" trong cả luồng và phản hồi thông thường, và stop_reason="max_tokens" trong định dạng Anthropic. Cách xử lý các phản hồi dài: sử dụng stream:true và khi gặp finish_reason="length", hãy tiếp tục tạo bằng yêu cầu tiếp theo bằng cách chuyển phần đã nhận vào ngữ cảnh. Chi tiết xem trong phần "Giới hạn" trong tài liệu.

Tính năng mới
Mô hình mới: GLM 5.3 Flash — reasoning từ Z.ai16 thg 9

GLM 5.3 Flash từ Z.ai đã xuất hiện trên mạng lưới Gonka: 320B tham số (MoE, 18B hoạt động), FP8, giấy phép MIT, context 390 000 token. Mô hình suy luận trước khi trả lời: quá trình suy luận nằm trong trường reasoning_content và tiêu tốn ngân sách trả lời, vì vậy hãy đặt max_tokens ít nhất là 600 hoặc sử dụng stream:true; cho các tác vụ ngắn — reasoning_effort: "low". Hỗ trợ Tool calling và chế độ JSON. Định danh là zai-org/GLM-5.3-Flash, giá tương đương với các mô hình khác trong mạng lưới. Kimi K2.6 không còn được hỗ trợ bởi mạng lưới — hãy chuyển các tích hợp sang MiniMax M2.7, DeepSeek V4 Flash hoặc GLM 5.3 Flash.

Tính năng mới
Thống kê sử dụng theo mô hình15 thg 9

Trang "Sử dụng" hiển thị mức tiêu thụ cho từng mô hình: yêu cầu, token đầu vào/đầu ra, chi phí bằng nGNK và USD, giá trung bình cho mỗi 1M token và tốc độ phản hồi. "Hôm nay" hiển thị theo giờ và đã thêm cài đặt "90 ngày". Đối với tích hợp: GET /api/usage/by-model.

tháng 8 năm 2026
Tính năng mới
Hỗ trợ legacy OpenAI Completions24 thg 8

Gateway hiện đã chấp nhận các yêu cầu tới /v1/completions — endpoint "text" của OpenAI: nhận một chuỗi prompt làm đầu vào và trả về choices[].text làm đầu ra. Các plugin trình soạn thảo sử dụng endpoint này để tự động hoàn thành và chỉnh sửa code inline (như Continue.dev). Base URL vẫn giữ nguyên: https://gate.joingonka.ai/v1. Hỗ trợ streaming và các tham số chuẩn (max_tokens, temperature, stop), với chi phí và giới hạn giống như /v1/chat/completions. Các trường logprobs và best_of không được hỗ trợ.

Cải tiến
Cập nhật giá suy luận22 thg 8

Kể từ ngày 22 tháng 8, chi phí suy luận là: đầu vào — 33 nGNK, đầu ra — 99 nGNK cho mỗi token (trước đây là 22/66). Phí cổng thanh toán không đổi ở mức 10%. Chế độ demo vẫn miễn phí. Lý do tăng giá: yêu cầu trong mạng Gonka được xử lý với tính dư thừa (redundancy) — đây là một phần của giao thức và mã devshards, cần thiết để dịch vụ được trôi chảy. Một container có thể gửi yêu cầu đến một host, sau đó đến host khác nếu cái đầu tiên thất bại, hoặc gửi đồng thời cho nhiều host nếu cần thiết. Mỗi lần thử đều phải trả phí: giá mạng là 10 nGNK cho mỗi token, nhân với độ dư thừa của yêu cầu (trung bình ×1—2.5). Trước đây, chi phí này không đến được chúng tôi do API hoàn tất giá không hoạt động, và chúng tôi chỉ trả tiền như cho một host; hiện tại nó được tính dựa trên thực tế và chúng tôi đưa nó vào biểu giá. Suy luận vẫn rẻ hơn hàng trăm lần so với API của các nhà cung cấp. Giá hiện tại của tất cả các mô hình có trên trang Pricing và thông qua GET /api/pricing.

Tính năng mới
Hỗ trợ OpenAI Responses API22 thg 8

Gateway hiện chấp nhận các yêu cầu theo định dạng Responses — một giao thức mới của OpenAI đã được áp dụng trong các SDK gần đây và Codex CLI. Địa chỉ vẫn như cũ: base URL https://gate.joingonka.ai/v1, client sẽ tự động gọi đến /v1/responses. Hỗ trợ streaming, function tools và output có cấu trúc (text.format); chi phí và giới hạn tương tự như /v1/chat/completions. Chúng tôi không lưu trữ hội thoại, vì vậy store sẽ bị bỏ qua và previous_response_id sẽ trả về lỗi — vui lòng truyền toàn bộ lịch sử vào trường input. Các công cụ server tích hợp sẵn của OpenAI (web_search, file_search, code_interpreter) không được hỗ trợ; tính năng tìm kiếm web của chúng tôi vẫn khả dụng thông qua plugin web tại /v1/chat/completions.

Sửa lỗi
Lỗi stream — thông qua mã trạng thái HTTP tiêu chuẩn20 thg 8

Trước đây, các lỗi mạng Gonka ở chế độ stream:true trả về mã 200 và lỗi chỉ hiển thị bên trong SSE chunk: các agent client coi những phản hồi này là thành công nhưng trống và không thực hiện thử lại. Bây giờ, nếu phản hồi mạng chưa bắt đầu, lỗi sẽ được trả về bằng mã HTTP tiêu chuẩn — 429 khi quá tải mô hình (kèm header Retry-After), 504 khi timeout, và 503 nếu không còn node trống. Nếu lỗi xảy ra giữa chừng, trạng thái không thể thay đổi: vẫn có một chunk chứa trường error, nhưng [DONE] cuối cùng sẽ không được gửi nữa để stream không bị coi là đã hoàn tất thành công.

Tính năng mới
Trình cài đặt: 15 công cụ với một lệnh duy nhất20 thg 8

npx @joingonka/setup hiện hỗ trợ cấu hình 15 công cụ đại lý: Claude Code, OpenClaw, Cursor, Cline, opencode, Aider, Kilo Code, Roo Code, Continue, Hermes, Pi, Zed, ZCode, JetBrains AI Assistant và GitHub Copilot BYOK. Với 7 trong số đó, tệp cấu hình được ghi và hợp nhất gọn gàng với tệp của bạn (các chú thích và cài đặt hiện có được giữ nguyên); đối với các công cụ còn lại chỉ cấu hình qua giao diện, các giá trị sẵn sàng để dán sẽ được in ra. Bạn có thể chọn công cụ cụ thể ngay lập tức: npx @joingonka/setup --tool zed. Mỗi lần chạy kết thúc bằng một yêu cầu trực tiếp tới cổng, xác nhận rằng khóa, địa chỉ và mô hình đã được chấp nhận.

Cải tiến
Giới hạn phản hồi DeepSeek — 32,768 token17 thg 8

Độ dài tối đa cho một phản hồi của DeepSeek V4 Flash đã được tăng lên gấp 4 lần: từ 8,192 lên 32,768 token (tham số max_tokens). Các tệp lớn và phản hồi dài từ các công cụ agent giờ đây có thể nằm gọn trong một lần gọi. Ngoài ra: nếu phản hồi chạm ngưỡng giới hạn ở giữa quá trình gọi công cụ, cổng gateway sẽ trả về finish_reason="length" chính xác thay vì một cuộc gọi bị cắt — các agent client (Cursor và những phần mềm khác) sẽ tiếp tục hoạt động chính xác thay vì bị treo do lỗi phân tích cú pháp.

Tính năng mới
Mô hình mới: DeepSeek V4 Flash với ngữ cảnh 380K13 thg 8

Mạng lưới Gonka đã có thêm mô hình hoạt động thứ ba — DeepSeek V4 Flash 0731: ngữ cảnh 380.000 token (dài nhất trong mạng lưới, đã được xác minh bằng yêu cầu thực tế 381K), hỗ trợ reasoning và tool calling. Mã định danh là deepseek-ai/DeepSeek-V4-Flash-0731, giá cả tương đương các mô hình khác. Mô hình đang trong giai đoạn thử nghiệm sớm nhưng đã có sẵn đầy đủ: hãy chọn nó trong chat của bảng điều khiển hoặc chỉ định trong trường model của yêu cầu API của bạn.

Cải tiến
Cập nhật giá inferenced3 thg 8

Kể từ ngày 3 tháng 8, chi phí inferenced là: đầu vào — 22 nGNK, đầu ra — 66 nGNK mỗi token (gấp đôi mức 11/33 trước đây). Phí cổng thanh toán không thay đổi, vẫn là 10%. Chế độ demo vẫn miễn phí. Giá hiện tại của tất cả các mô hình có trên trang Pricing và GET /api/pricing.

tháng 7 năm 2026
Cải tiến
Timeouts công bằng: phản hồi 504 nhanh thay vì treo 5 phút23 thg 7

Nếu mạng Gonka nhận yêu cầu nhưng không phản hồi (timeout 300s), gateway hiện sẽ trả về lỗi 504 ngay lập tức thay vì thử lại liên tục một cách âm thầm. Lưu ý quan trọng về tính phí: yêu cầu đã được mạng chấp nhận không thể hủy — node vẫn sẽ xử lý yêu cầu đó, do đó khi xảy ra timeout, phí ước tính xử lý prompt sẽ bị trừ (completion không bị tính phí). Khuyến nghị: đối với tạo nội dung dài, hãy sử dụng stream:true — stream ổn định hơn trước các lỗi timeout và hiển thị tiến trình ngay lập tức.

Tính năng mới
Bậc thang phí nạp USDT — lên tới −50%9 thg 7

Phí nạp tiền qua USDT nay giảm dần theo số tiền: cơ bản 5%, từ $25 — 4.5%, từ $50 — 4%, từ $100 — 3.5%, từ $250 — 3%, từ $500 — 2.75%, từ $1000 — 2.5%. Hộp thoại nạp tiền có tính năng bậc thang tương tác: thanh trượt số tiền, phần thưởng GNK cho mỗi cấp và số tiền tiết kiệm của bạn. Ưu đãi được tự động áp dụng khi tiền vào tài khoản.

tháng 6 năm 2026
Tính năng mới
Giới hạn chi tiêu tổng cho khóa28 thg 6

Bạn có thể đặt giới hạn chi tiêu tổng (lũy kế) cho các khóa con — một hạn mức riêng biệt không được đặt lại, không giống như giới hạn hàng ngày hoặc hàng tháng. Khi hạn mức đã hết, các yêu cầu sử dụng khóa sẽ bị từ chối. Giới hạn được đặt trong bảng điều khiển (với độ chính xác đến nanogonka) hoặc thông qua API sử dụng trường limit_total_ngonka trong POST/PATCH /api/management/keys/{id}/children; mức tiêu thụ tích lũy được đặt lại bằng nút "Reset usage" (hoặc POST /api/management/keys/{id}/children/{childId}/reset-usage).

Cải tiến
Định giá — theo chi phí thực của mạng lưới27 thg 6

Chi phí suy luận đã được đồng bộ hóa với giá thực tế của mạng lưới Gonka trên mỗi token. Mức giá vẫn nằm trong nhóm thấp nhất thị trường — chỉ tốn một phần nhỏ của xu cho mỗi triệu token, rẻ hơn hàng trăm lần so với OpenAI và Anthropic khi cùng sử dụng các model open-source. Token đầu ra được định giá cao hơn token đầu vào (×3), tương tự như hầu hết các nhà cung cấp.

Cải tiến
Ngữ cảnh lên đến 200,000 token27 thg 6

Chúng tôi đã xác nhận giới hạn ngữ cảnh thực tế của các model đang hoạt động — lên đến 200,000 token (trước đó con số công bố là 131,072 một cách thận trọng). Giờ đây, bạn có thể gửi các tài liệu và lịch sử đối thoại dài hơn; thông số hiện tại của từng model có trong phần "Network Status".

Cải tiến
Chi phí yêu cầu bằng USD23 thg 6

Chi phí của mỗi yêu cầu được hiển thị bằng USD — trong phản hồi API (trường usage.total_cost_usd) và trong phần «Sử dụng». Thuận tiện để lập kế hoạch chi tiêu.

Tính năng mới
Kết nối bằng một lệnh23 thg 6

Thiết lập quyền truy cập API trong công cụ của bạn một cách tự động: chạy npx @joingonka/setup. Hỗ trợ Claude Code, OpenClaw, Cline, Continue, opencode, Aider và các công cụ khác.

Tính năng mới
Tìm kiếm web thời gian thực17 thg 6

Mô hình tìm kiếm trên internet trong khi phản hồi và thêm các liên kết nguồn. Cách bật: truyền trong phần thân yêu cầu plugins: [{ "id": "web", "max_results": 5 }] — hoạt động trong API tương thích với OpenAI và Anthropic.

tháng 5 năm 2026
Cải tiến
Phản hồi dài lên tới 8192 token25 thg 5

Độ dài phản hồi tối đa là 8192 token; quản lý bằng tham số max_tokens (mặc định là 1024 cho phản hồi streaming và 1500 cho phản hồi bình thường).

Tính năng mới
Chọn mô hình trong chat5 thg 5

Trên trang «Chat», chọn mô hình từ danh sách (được tải từ /v1/models) — lựa chọn sẽ được lưu và áp dụng cho các cuộc hội thoại mới.

Cải tiến
Số liệu tốc độ phản hồi5 thg 5

Cần tốc độ? Thêm tiêu đề x-joingonka-meta: 1 vào yêu cầu — phản hồi streaming sẽ trả về ttft_ms (thời gian đến token đầu tiên) và tokens_per_sec.

tháng 3 năm 2026
Tính năng mới
Khóa quản lý để bán lại24 thg 3

Tạo khóa quản lý (POST /api/management/keys) và tạo các khóa con kèm giới hạn (hạn mức ngày và tháng, rate limit, thời hạn) thông qua POST /api/management/keys/{id}/children.

Tính năng mới
Plugin xử lý yêu cầu24 thg 3

Kết nối các plugin với tham số plugins: response-healing sửa JSON bị cắt bớt, privacy-sanitization che giấu dữ liệu riêng tư, file-parser trích xuất văn bản từ PDF và tài liệu.

Tính năng mới
API tương thích với OpenAI và Anthropic19 thg 3

OpenAI: base_url https://gate.joingonka.ai/v1, tiêu đề Authorization: Bearer your-key. Anthropic (Claude Code): base_url https://gate.joingonka.ai, tiêu đề x-api-key, endpoint /v1/messages.

Tính năng mới
Nạp tiền bằng GNK và USDT18 thg 3

GNK: nhận địa chỉ và memo rồi gửi token on-chain. USDT: nhập số tiền từ 1 đến 10.000 USD và thanh toán qua OxaPay — tự động chuyển đổi sang GNK.