Pembaruan dan Status
Status inferensi saat ini dan riwayat perubahan gateway.
Status Saat Ini
- MiniMax M2.7Jaringan Gonka: Kinerja Menurun
- DeepSeek V4 FlashJaringan Gonka: Kinerja Menurun
- GLM 5.3 FlashJaringan Gonka: Beroperasi
Kumpulan model aktif ditentukan oleh pemungutan suara jaringan Gonka dan dapat berubah: sebagian model terkadang tidak tersedia dan akan kembali nanti. Daftar terbaru ada di atas.
Status terperinci dan uptime →Riwayat Pembaruan
Anda dapat mengisi saldo dengan token WGNK — ini adalah GNK di jaringan Ethereum. Di akun Anda: Isi Saldo → GNK → Ethereum · WGNK; masukkan alamat asal pengiriman token Anda — transfer akan diproses secara otomatis, biasanya dalam 15–20 menit.
npx @joingonka/setup kini mengonfigurasi 25 alat. Tambahan baru: Codex CLI, Kimi Code, omp, MiniMax Code, Goose, MiMo Code, Qwen Code, Factory Droid, Crush, dan Zoo Code. Model dipilih melalui flag --model (minimax, deepseek, atau glm), dengan DeepSeek V4 Flash sebagai default. Di akhir, penginstal mengirimkan permintaan verifikasi dan langsung menunjukkan apakah kunci berfungsi.
Mulai 16 September, setiap akun baru menerima 100.000.000 nGNK (0,1 GNK) dari sebelumnya 50.000.000 — berdasarkan harga jaringan saat ini, ini setara dengan sekitar 3 juta token untuk pengujian tanpa deposit. Bonus dikreditkan secara otomatis saat pendaftaran, tidak perlu input apa pun; jumlah saat ini selalu terlihat di GET /api/pricing (kolom welcome_bonus_ngonka) dan di halaman pendaftaran.
Broker jaringan Gonka menghentikan aliran data apa pun setelah sekitar 5 menit pembuatan (untuk GLM 5.3 Flash, ini sekitar 8.000 token). Sebelumnya, pemotongan seperti itu terlihat seperti penyelesaian normal: aliran berakhir dengan [DONE] tanpa finish_reason, dan klien menganggap potongan tersebut sebagai respons lengkap. Sekarang, gateway mengirimkan potongan dengan finish_reason="length" baik di aliran maupun respons biasa, dan stop_reason="max_tokens" dalam format Anthropic. Apa yang harus dilakukan dengan respons panjang: gunakan stream:true dan saat finish_reason="length" terjadi, lanjutkan pembuatan dengan permintaan berikutnya dengan meneruskan bagian yang sudah diterima di dalam konteks. Detailnya ada di bagian "Batasan" dalam dokumentasi.
GLM 5.3 Flash dari Z.ai kini hadir di jaringan Gonka: 320B parameter (MoE, 18B aktif), FP8, lisensi MIT, konteks 390 000 token. Model melakukan penalaran sebelum menjawab: proses penalaran masuk ke field reasoning_content dan memakan anggaran jawaban, jadi atur max_tokens minimal 600 atau gunakan stream:true; untuk tugas singkat gunakan reasoning_effort: "low". Tool calling dan mode JSON berfungsi normal. Identifier-nya adalah zai-org/GLM-5.3-Flash, harganya sama dengan model lain di jaringan. Kimi K2.6 tidak lagi didukung oleh jaringan — harap pindahkan integrasi Anda ke MiniMax M2.7, DeepSeek V4 Flash, atau GLM 5.3 Flash.
Halaman "Penggunaan" menampilkan konsumsi untuk setiap model: permintaan, token input/output, biaya dalam nGNK dan dolar, harga rata-rata per 1M token, dan kecepatan respons. "Hari ini" ditampilkan per jam, dan prasetel "90 hari" telah ditambahkan. Untuk integrasi: GET /api/usage/by-model.
Gateway sekarang menerima permintaan ke /v1/completions — endpoint "text" OpenAI: mengambil string prompt sebagai input dan mengembalikan choices[].text sebagai output. Ini digunakan oleh plugin editor untuk pelengkapan otomatis dan pengeditan kode inline (Continue.dev dan sejenisnya). Base URL tetap sama: https://gate.joingonka.ai/v1. Streaming dan parameter standar (max_tokens, temperature, stop) didukung, dengan biaya dan batasan yang sama dengan /v1/chat/completions. Field logprobs dan best_of tidak didukung.
Mulai 22 Agustus, biaya inferensi adalah: input — 33 nGNK, output — 99 nGNK per token (sebelumnya 22/66). Biaya gateway tetap tidak berubah sebesar 10%. Mode demo tetap gratis. Mengapa naik: permintaan di jaringan Gonka diproses dengan redundansi — ini adalah bagian dari protokol dan kode devshards, yang diperlukan agar layanan berjalan lancar. Container dapat mengirim permintaan ke satu host, lalu ke host lain jika yang pertama gagal, atau ke beberapa host sekaligus jika perlu. Setiap percobaan akan dikenakan biaya: harga jaringan adalah 10 nGNK per token, dikalikan dengan redundansi permintaan (rata-rata ×1—2.5). Sebelumnya, biaya ini tidak sampai ke kami karena API finalisasi harga tidak berfungsi, dan kami membayar seolah untuk satu host; sekarang biaya dihitung berdasarkan aktual dan kami memasukkannya ke dalam tarif. Inferensi tetap ratusan kali lebih murah daripada API vendor. Harga terkini untuk semua model ada di halaman Pricing dan melalui GET /api/pricing.
Gateway menerima permintaan dalam format Responses — protokol baru dari OpenAI yang diadopsi oleh SDK terbaru dan digunakan oleh Codex CLI. Alamatnya tetap sama: base URL https://gate.joingonka.ai/v1, klien akan secara otomatis memanggil /v1/responses. Streaming, function tools, dan output terstruktur (text.format) didukung; biaya dan batasan sama dengan /v1/chat/completions. Kami tidak menyimpan dialog, jadi store diabaikan, dan previous_response_id akan mengembalikan error — harap kirimkan seluruh riwayat di kolom input. Alat server bawaan OpenAI (web_search, file_search, code_interpreter) tidak didukung; pencarian web kami masih tersedia melalui plugin web di /v1/chat/completions.
Sebelumnya, kegagalan jaringan Gonka dalam mode stream:true mengembalikan kode 200, dan kesalahan hanya terlihat di dalam chunk SSE: klien agen menganggap respons tersebut sebagai respons sukses yang kosong dan tidak melakukan percobaan ulang. Sekarang, jika respons jaringan belum dimulai, kesalahan dikembalikan dengan kode HTTP standar — 429 saat model kelebihan beban (dengan header Retry-After), 504 saat timeout, dan 503 jika tidak ada node yang tersedia. Jika kegagalan terjadi di tengah stream, status tidak dapat diubah: tetap ada chunk dengan field error, tetapi [DONE] akhir tidak lagi dikirim agar stream tersebut tidak terlihat telah selesai dengan sukses.
npx @joingonka/setup sekarang mengonfigurasi 15 alat agen: Claude Code, OpenClaw, Cursor, Cline, opencode, Aider, Kilo Code, Roo Code, Continue, Hermes, Pi, Zed, ZCode, JetBrains AI Assistant, dan GitHub Copilot BYOK. Untuk tujuh di antaranya, konfigurasi ditulis dan digabungkan secara rapi dengan milik Anda (komentar dan pengaturan yang ada dipertahankan); untuk sisanya, yang hanya dapat dikonfigurasi melalui antarmuka, nilai siap tempel akan dicetak. Anda dapat memilih alat tertentu secara langsung: npx @joingonka/setup --tool zed. Setiap eksekusi diakhiri dengan permintaan langsung ke gateway, mengonfirmasi bahwa kunci, alamat, dan model telah diterima.
Panjang maksimum untuk satu respons DeepSeek V4 Flash telah ditingkatkan 4 kali lipat: dari 8.192 menjadi 32.768 token (parameter max_tokens). File besar dan respons panjang dari alat agen sekarang muat dalam satu panggilan. Selain itu: jika respons mencapai batas di tengah panggilan alat, gateway mengembalikan finish_reason="length" yang jujur alih-alih panggilan yang terpotong — klien agen (Cursor dan lainnya) terus bekerja dengan benar alih-alih macet karena kesalahan penguraian.
Jaringan Gonka kini memiliki model aktif ketiga — DeepSeek V4 Flash 0731: konteks 380.000 token (terpanjang di jaringan, telah diverifikasi dengan permintaan nyata 381K), reasoning, dan tool calling. Pengenalnya adalah deepseek-ai/DeepSeek-V4-Flash-0731, harganya sama dengan model lainnya. Model ini dalam tahap pengujian awal namun sudah tersedia sepenuhnya: pilih di chat dasbor atau tentukan di bidang model pada permintaan API Anda.
Mulai 3 Agustus, biaya inferensi adalah: input — 22 nGNK, output — 66 nGNK per token (dua kali lipat dari 11/33 sebelumnya). Biaya gateway tetap tidak berubah sebesar 10%. Mode demo tetap gratis. Harga terkini untuk semua model tersedia di halaman Pricing dan GET /api/pricing.
Jika jaringan Gonka menerima permintaan tetapi tidak merespons (timeout 300s), gateway sekarang langsung mengembalikan error 504 alih-alih serangkaian percobaan ulang senyap. Catatan penting tentang penagihan: permintaan yang diterima oleh jaringan tidak dapat dibatalkan — node memprosesnya bagaimanapun juga, sehingga jika terjadi timeout, estimasi pemrosesan prompt akan dipotong (completion tidak dikenakan biaya). Rekomendasi: untuk generasi panjang, gunakan stream:true — streaming lebih tahan terhadap timeout dan menampilkan progres secara langsung.
Biaya deposit lewat USDT kini menurun seiring bertambahnya jumlah: dasar 5%, mulai $25 — 4.5%, mulai $50 — 4%, mulai $100 — 3.5%, mulai $250 — 3%, mulai $500 — 2.75%, mulai $1000 — 2.5%. Dialog deposit kini dilengkapi tangga interaktif: penggeser jumlah, bonus GNK setiap tingkatan, dan penghematan Anda. Diskon diterapkan secara otomatis saat deposit masuk.
Anda dapat menetapkan batas pengeluaran total (kumulatif) untuk kunci pendukung — kuota khusus yang tidak disetel ulang, tidak seperti batas harian atau bulanan. Setelah kuota habis, permintaan menggunakan kunci tersebut akan ditolak. Batas ditetapkan di dasbor (dengan presisi nanogonka) atau melalui API menggunakan kolom limit_total_ngonka di POST/PATCH /api/management/keys/{id}/children; penggunaan akumulasi disetel ulang menggunakan tombol "Reset usage" (atau POST /api/management/keys/{id}/children/{childId}/reset-usage).
Biaya inferenced sekarang disinkronkan dengan harga jaringan Gonka yang sebenarnya per token. Harga tetap menjadi salah satu yang terendah di pasar — hanya sebagian kecil sen per juta token, ratusan kali lebih murah daripada OpenAI dan Anthropic untuk model open-source yang sama. Token output dihargai lebih mahal daripada token input (×3), seperti halnya dengan kebanyakan penyedia lain.
Kami telah mengonfirmasi batas konteks aktual untuk model yang aktif — hingga 200.000 token (sebelumnya angka konservatif 131.072 yang dipublikasikan). Sekarang Anda dapat mengirim dokumen dan riwayat percakapan yang lebih panjang; spesifikasi terkini untuk setiap model dapat dilihat di bagian "Network Status".
Biaya setiap permintaan terlihat dalam dolar — di dalam respons API (bidang usage.total_cost_usd) dan di bagian « Penggunaan ». Memudahkan perencanaan pengeluaran.
Konfigurasikan akses ke API di alat Anda secara otomatis: jalankan npx @joingonka/setup. Mendukung Claude Code, OpenClaw, Cline, Continue, opencode, Aider, dan lainnya.
Model mencari di internet saat menjawab dan menambahkan tautan ke sumbernya. Cara mengaktifkan: masukkan dalam isi permintaan plugins: [{ "id": "web", "max_results": 5 }] — berfungsi di API yang kompatibel dengan OpenAI dan Anthropic.
Panjang respons maksimum hingga 8192 token; kelola parameter max_tokens (default 1024 untuk respons streaming dan 1500 untuk normal).
Di halaman « Obrolan », pilih model dari daftar (dimuat dari /v1/models) — pilihan akan disimpan dan diterapkan ke percakapan baru.
Butuh kecepatan? Tambahkan header x-joingonka-meta: 1 ke permintaan — dalam respons streaming, Anda akan menerima ttft_ms (waktu hingga token pertama) dan tokens_per_sec.
Buat kunci manajemen (POST /api/management/keys) dan hasilkan kunci anak dengan batas (kuota harian dan bulanan, rate limit, durasi) melalui POST /api/management/keys/{id}/children.
Hubungkan plugin dengan parameter plugins: response-healing memperbaiki JSON yang terpotong, privacy-sanitization menyamarkan data pribadi, file-parser mengekstrak teks dari PDF dan dokumen.
OpenAI: base_url https://gate.joingonka.ai/v1, header Authorization: Bearer kunci-anda. Anthropic (Claude Code): base_url https://gate.joingonka.ai, header x-api-key, endpoint /v1/messages.
GNK: dapatkan alamat dan memo, lalu kirim token secara on-chain. USDT: masukkan jumlah dari 1 hingga 10 000 dolar dan bayar melalui OxaPay — konversi ke GNK otomatis.