Pembaruan dan Status
Status inferensi saat ini dan riwayat perubahan gateway.
Status Saat Ini
- MiniMax M2.7Jaringan Gonka: Beroperasi
- Kimi K2.6Jaringan Gonka: Beroperasi
- DeepSeek V4 FlashJaringan Gonka: Beroperasi
Kumpulan model aktif ditentukan oleh pemungutan suara jaringan Gonka dan dapat berubah: sebagian model terkadang tidak tersedia dan akan kembali nanti. Daftar terbaru ada di atas.
Status terperinci dan uptime →Riwayat Pembaruan
Panjang maksimum untuk satu respons DeepSeek V4 Flash telah ditingkatkan 4 kali lipat: dari 8.192 menjadi 32.768 token (parameter max_tokens). File besar dan respons panjang dari alat agen sekarang muat dalam satu panggilan. Selain itu: jika respons mencapai batas di tengah panggilan alat, gateway mengembalikan finish_reason="length" yang jujur alih-alih panggilan yang terpotong — klien agen (Cursor dan lainnya) terus bekerja dengan benar alih-alih macet karena kesalahan penguraian.
Jaringan Gonka kini memiliki model aktif ketiga — DeepSeek V4 Flash 0731: konteks 380.000 token (terpanjang di jaringan, telah diverifikasi dengan permintaan nyata 381K), reasoning, dan tool calling. Pengenalnya adalah deepseek-ai/DeepSeek-V4-Flash-0731, harganya sama dengan model lainnya. Model ini dalam tahap pengujian awal namun sudah tersedia sepenuhnya: pilih di chat dasbor atau tentukan di bidang model pada permintaan API Anda.
Mulai 3 Agustus, biaya inferensi adalah: input — 22 nGNK, output — 66 nGNK per token (dua kali lipat dari 11/33 sebelumnya). Biaya gateway tetap tidak berubah sebesar 10%. Mode demo tetap gratis. Harga terkini untuk semua model tersedia di halaman Pricing dan GET /api/pricing.
Jika jaringan Gonka menerima permintaan tetapi tidak merespons (timeout 300s), gateway sekarang langsung mengembalikan error 504 alih-alih serangkaian percobaan ulang senyap. Catatan penting tentang penagihan: permintaan yang diterima oleh jaringan tidak dapat dibatalkan — node memprosesnya bagaimanapun juga, sehingga jika terjadi timeout, estimasi pemrosesan prompt akan dipotong (completion tidak dikenakan biaya). Rekomendasi: untuk generasi panjang, gunakan stream:true — streaming lebih tahan terhadap timeout dan menampilkan progres secara langsung.
Biaya deposit lewat USDT kini menurun seiring bertambahnya jumlah: dasar 5%, mulai $25 — 4.5%, mulai $50 — 4%, mulai $100 — 3.5%, mulai $250 — 3%, mulai $500 — 2.75%, mulai $1000 — 2.5%. Dialog deposit kini dilengkapi tangga interaktif: penggeser jumlah, bonus GNK setiap tingkatan, dan penghematan Anda. Diskon diterapkan secara otomatis saat deposit masuk.
Anda dapat menetapkan batas pengeluaran total (kumulatif) untuk kunci pendukung — kuota khusus yang tidak disetel ulang, tidak seperti batas harian atau bulanan. Setelah kuota habis, permintaan menggunakan kunci tersebut akan ditolak. Batas ditetapkan di dasbor (dengan presisi nanogonka) atau melalui API menggunakan kolom limit_total_ngonka di POST/PATCH /api/management/keys/{id}/children; penggunaan akumulasi disetel ulang menggunakan tombol "Reset usage" (atau POST /api/management/keys/{id}/children/{childId}/reset-usage).
Biaya inferenced sekarang disinkronkan dengan harga jaringan Gonka yang sebenarnya per token. Harga tetap menjadi salah satu yang terendah di pasar — hanya sebagian kecil sen per juta token, ratusan kali lebih murah daripada OpenAI dan Anthropic untuk model open-source yang sama. Token output dihargai lebih mahal daripada token input (×3), seperti halnya dengan kebanyakan penyedia lain.
Kami telah mengonfirmasi batas konteks aktual untuk model yang aktif — hingga 200.000 token (sebelumnya angka konservatif 131.072 yang dipublikasikan). Sekarang Anda dapat mengirim dokumen dan riwayat percakapan yang lebih panjang; spesifikasi terkini untuk setiap model dapat dilihat di bagian "Network Status".
Biaya setiap permintaan terlihat dalam dolar — di dalam respons API (bidang usage.total_cost_usd) dan di bagian « Penggunaan ». Memudahkan perencanaan pengeluaran.
Konfigurasikan akses ke API di alat Anda secara otomatis: jalankan npx @joingonka/setup. Mendukung Claude Code, OpenClaw, Cline, Continue, opencode, Aider, dan lainnya.
Model mencari di internet saat menjawab dan menambahkan tautan ke sumbernya. Cara mengaktifkan: masukkan dalam isi permintaan plugins: [{ "id": "web", "max_results": 5 }] — berfungsi di API yang kompatibel dengan OpenAI dan Anthropic.
Panjang respons maksimum hingga 8192 token; kelola parameter max_tokens (default 1024 untuk respons streaming dan 1500 untuk normal).
Di halaman « Obrolan », pilih model dari daftar (dimuat dari /v1/models) — pilihan akan disimpan dan diterapkan ke percakapan baru.
Butuh kecepatan? Tambahkan header x-joingonka-meta: 1 ke permintaan — dalam respons streaming, Anda akan menerima ttft_ms (waktu hingga token pertama) dan tokens_per_sec.
Buat kunci manajemen (POST /api/management/keys) dan hasilkan kunci anak dengan batas (kuota harian dan bulanan, rate limit, durasi) melalui POST /api/management/keys/{id}/children.
Hubungkan plugin dengan parameter plugins: response-healing memperbaiki JSON yang terpotong, privacy-sanitization menyamarkan data pribadi, file-parser mengekstrak teks dari PDF dan dokumen.
OpenAI: base_url https://gate.joingonka.ai/v1, header Authorization: Bearer kunci-anda. Anthropic (Claude Code): base_url https://gate.joingonka.ai, header x-api-key, endpoint /v1/messages.
GNK: dapatkan alamat dan memo, lalu kirim token secara on-chain. USDT: masukkan jumlah dari 1 hingga 10 000 dolar dan bayar melalui OxaPay — konversi ke GNK otomatis.