Güncellemeler ve Durum
Çıkarım (inference) durumu ve ağ geçidi geçmişi bilgileri.
Güncel durum
- MiniMax M2.7Gonka Ağı: Performans düşüşü
- DeepSeek V4 FlashGonka Ağı: Performans düşüşü
- GLM 5.3 FlashGonka Ağı: Çalışır durumda
Aktif modeller kümesi Gonka ağ oylaması ile belirlenir ve değişebilir: bazı modeller zaman zaman kullanılamaz olabilir ve daha sonra geri dönebilir. Güncel liste yukarıdadır.
Detaylı durum ve çalışma süresi →Güncelleme geçmişi
Bakiyenizi WGNK tokeni ile yükleyebilirsiniz — bu, Ethereum ağındaki GNK'dır. Hesabınızda: Para Yatır → GNK → Ethereum · WGNK; tokenleri göndereceğiniz adresi belirtin — transfer otomatik olarak yansıtılacaktır, genellikle 15–20 dakika içinde.
npx @joingonka/setup artık 25 aracı yapılandırıyor. Yenilikler: Codex CLI, Kimi Code, omp, MiniMax Code, Goose, MiMo Code, Qwen Code, Factory Droid, Crush ve Zoo Code. Model --model bayrağı (minimax, deepseek veya glm) aracılığıyla seçilir, varsayılan değer DeepSeek V4 Flash'tır. Sonunda, yükleyici bir doğrulama isteği gönderir ve anahtarın çalışıp çalışmadığını hemen gösterir.
16 Eylül'den itibaren her yeni hesap, 50.000.000 yerine 100.000.000 nGNK (0,1 GNK) alıyor — mevcut ağ fiyatına göre bu, para yatırmadan test yapmak için yaklaşık 3 milyon token'a denk geliyor. Bonus kayıt sırasında otomatik olarak tanımlanır, herhangi bir giriş yapmanız gerekmez; mevcut miktar her zaman GET /api/pricing (welcome_bonus_ngonka alanı) kısmında ve kayıt sayfasında görülebilir.
Gonka ağı düğümleri, her akışı yaklaşık 5 dakikalık üretimden sonra sonlandırır (GLM 5.3 Flash için bu yaklaşık 8.000 token'dır). Eskiden bu kesinti normal bir bitiş gibi görünüyordu: akış finish_reason olmadan [DONE] ile biterdi ve istemci kesilen kısmı tam yanıt sanırdı. Artık ağ geçidi, hem akışta hem de normal yanıtta finish_reason="length" içeren bir chunk gönderiyor; Anthropic formatında ise bu stop_reason="max_tokens" şeklindedir. Uzun yanıtlarla ne yapılmalı: stream:true kullanın ve finish_reason="length" olduğunda, alınan kısmı bağlam içinde ileterek bir sonraki istekte üretimi sürdürün. Detaylar dokümantasyondaki “Limitler” bölümündedir.
Gonka ağında Z.ai'den GLM 5.3 Flash kullanıma sunuldu: 320B parametre (MoE, 18B aktif), FP8, MIT lisansı, 390 000 token bağlamı. Model cevap vermeden önce düşünür: düşünme süreci reasoning_content alanında gelir ve cevap bütçesini harcar, bu yüzden max_tokens değerini en az 600 yapın veya stream:true kullanın; kısa görevler için — reasoning_effort: "low". Tool calling ve JSON modu çalışmaktadır. Kimlik — zai-org/GLM-5.3-Flash, fiyat ağdaki diğer modellerle aynıdır. Kimi K2.6 artık ağ tarafından desteklenmemektedir — entegrasyonlarınızı MiniMax M2.7, DeepSeek V4 Flash veya GLM 5.3 Flash'a geçirin.
"Kullanım" sayfası her model için tüketimi gösterir: istekler, giriş/çıkış token'ları, nGNK ve dolar cinsinden maliyet, 1M token başına ortalama fiyat ve yanıt hızı. "Bugün" saatlik olarak gösterilir ve "90 gün" ön ayarı eklendi. Entegrasyonlar için: GET /api/usage/by-model.
Gateway artık /v1/completions adresine gelen istekleri kabul ediyor — OpenAI'ın "text" endpoint'i: giriş olarak bir prompt dizisi alır ve çıkış olarak choices[].text döndürür. Bu, otomatik tamamlama ve satır içi kod düzenleme için editör eklentileri tarafından kullanılır (Continue.dev ve benzerleri). Base URL aynı kalmaktadır: https://gate.joingonka.ai/v1. Streaming ve standart parametreler (max_tokens, temperature, stop) desteklenmekte olup, maliyetler ve limitler /v1/chat/completions ile aynıdır. logprobs ve best_of alanları desteklenmemektedir.
22 Ağustos'tan itibaren çıkarım (inference) maliyetleri: giriş — 33 nGNK, çıkış — 99 nGNK (önceki 22/66). Ağ geçidi komisyonu değişmiyor — %10. Demo modu ücretsiz kalmaya devam ediyor. Neden arttı: Gonka ağındaki bir istek, hizmet sürekliliği için gerekli olan protokolün ve devshards kodunun bir parçası olarak redundancy ile işlenir. Bir konteyner isteği bir sunucuya, ilki başaramazsa diğerine, gerekirse aynı anda birkaçına gönderebilir. Her deneme ücretlendirilir: ağ fiyatı token başına 10 nGNK, isteğin redundancy çarpanı ile çarpılır (ortalama ×1—2.5). Eskiden fiyat finalizasyon API'si çalışmadığı için bu maliyet bize yansımıyordu ve tek bir sunucu fiyatı ödüyorduk; artık gerçek kullanım hesaplanıyor ve bunu tarifeye yansıtıyoruz. Inference, vendor API'lerinden yüzlerce kat daha ucuz kalmaya devam ediyor. Tüm modellerin güncel fiyatları Pricing sayfasında ve GET /api/pricing adresinde mevcuttur.
Ağ geçidi, güncel SDK'ların geçtiği ve Codex CLI'nın çalıştığı yeni bir OpenAI protokolü olan Responses formatındaki istekleri kabul eder. Adres aynıdır: base URL https://gate.joingonka.ai/v1, istemci otomatik olarak /v1/responses adresine yönlenir. Streaming, function tools ve yapılandırılmış çıktı (text.format) çalışır; maliyet ve limitler /v1/chat/completions ile aynıdır. Diyalogları saklamıyoruz, bu nedenle store göz ardı edilir ve previous_response_id bir hata döndürür; tüm geçmişi input alanına aktarın. Yerleşik OpenAI sunucu araçları (web_search, file_search, code_interpreter) desteklenmemektedir; web aramamız, /v1/chat/completions altında web eklentisi aracılığıyla hala mevcuttur.
Daha önce stream:true modundaki Gonka ağ hataları 200 kodu ile dönüyordu ve hata yalnızca SSE-chunk içinde görülebiliyordu: ajan istemciler bu yanıtı boş ve başarılı sayıp tekrar deneme yapmıyordu. Artık ağdan yanıt başlamadan önce hata standart HTTP kodu ile iletiliyor; model aşırı yüklenmesinde 429 (Retry-After başlığı ile), zaman aşımında 504, uygun node kalmadığında 503. Eğer hata akışın ortasında gerçekleşirse durum değiştirilemez: orada hala error alanlı bir chunk bulunur, ancak akışın başarıyla tamamlanmış gibi görünmemesi için artık son [DONE] gönderilmez.
npx @joingonka/setup artık 15 ajan aracını yapılandırıyor: Claude Code, OpenClaw, Cursor, Cline, opencode, Aider, Kilo Code, Roo Code, Continue, Hermes, Pi, Zed, ZCode, JetBrains AI Assistant ve GitHub Copilot BYOK. Bunların yedisi için yapılandırma yazılır ve sizinkiyle düzgün bir şekilde birleştirilir (yorumlar ve mevcut ayarlar korunur), sadece arayüz üzerinden yapılandırılan diğerleri için ise yapıştırmaya hazır değerler basılır. İstenen araç hemen seçilebilir: npx @joingonka/setup --tool zed. Her çalıştırma, anahtar, adres ve modelin kabul edildiğini doğrulayan bir canlı ağ geçidi sorgusu ile sona erer.
DeepSeek V4 Flash için tek bir yanıtın maksimum uzunluğu 4 kat artırıldı: 8.192'den 32.768 token'a (max_tokens parametresi). Büyük dosyalar ve aracı araçlarından (agent tools) gelen uzun yanıtlar artık tek bir çağrıya sığıyor. Ayrıca: Eğer yanıt, araç çağrısının ortasında sınıra ulaşırsa, ağ geçidi kesilmiş bir çağrı yerine düzgün bir finish_reason="length" döndürür; böylece aracı istemcileri (Cursor ve diğerleri), ayrıştırma hatası yüzünden takılmak yerine düzgün bir şekilde çalışmaya devam eder.
Gonka ağında üçüncü bir aktif model belirdi — DeepSeek V4 Flash 0731: 380.000 token bağlam (ağdaki en uzun bağlam, 381K'lık gerçek bir istek ile doğrulandı), reasoning ve tool calling desteği. Tanımlayıcısı deepseek-ai/DeepSeek-V4-Flash-0731 olup fiyatlandırması diğer modellerle aynıdır. Model erken test aşamasındadır ancak tamamen kullanıma açıktır: paneli sohbetinden seçebilir veya API isteğinizin model alanında belirtebilirsiniz.
3 Ağustos'tan itibaren çıkarım maliyeti: girdi — 22 nGNK, çıktı — token başına 66 nGNK (önceki 11/33'ün iki katı). Ağ geçidi ücreti %10 olarak değişmeden kaldı. Demo modu ücretsiz kalmaya devam ediyor. Tüm modellerin güncel fiyatları Pricing sayfasında ve GET /api/pricing adresinde mevcuttur.
Gonka ağı bir istek alır ancak yanıt vermezse (300sn zaman aşımı), ağ geçidi artık sessiz denemeler yerine hemen 504 hatası döndürür. Ücretlendirme hakkında önemli not: ağ tarafından kabul edilen bir istek iptal edilemez — node bunu her halükarda işler, bu nedenle zaman aşımı durumunda prompt işleme tahmini düşülür (completion ücretlendirilmez). Tavsiye: uzun üretimler için stream:true kullanın — stream, zaman aşımlarına karşı daha dayanıklıdır ve ilerlemeyi hemen gösterir.
USDT ile para yatırma komisyonu artık tutar arttıkça azalıyor: baz %5, $25'ten itibaren — %4.5, $50'den itibaren — %4, $100'den itibaren — %3.5, $250'den itibaren — %3, $500'den itibaren — %2.75, $1000'den itibaren — %2.5. Yatırma ekranında interaktif bir kademe sistemi bulunur: tutar kaydırıcısı, her kademe için GNK bonusu ve tasarrufunuz. İndirim, para hesaba geçtiğinde otomatik olarak uygulanır.
Alt anahtarlar için toplam (kümülatif) bir harcama limiti belirleyebilirsiniz; bu, günlük veya aylık limitlerin aksine sıfırlanmayan özel bir kotadır. Kota tükendiğinde, anahtarı kullanan isteklere izin verilmez. Limit, panel üzerinden (nanogonka hassasiyetiyle) veya POST/PATCH /api/management/keys/{id}/children içindeki limit_total_ngonka alanı kullanılarak API aracılığıyla ayarlanır; birikmiş tüketim "Reset usage" butonu (veya POST /api/management/keys/{id}/children/{childId}/reset-usage) ile sıfırlanır.
inferenced maliyeti, gerçek Gonka ağ token fiyatı ile senkronize edildi. Fiyatlar piyasadaki en düşük seviyelerden biri olmaya devam ediyor; milyon token başına sentin kesirleri, aynı open-source modellerle OpenAI ve Anthropic'ten yüzlerce kat daha ucuz. Çıkış tokenları (output tokens), çoğu sağlayıcıda olduğu gibi giriş tokenlarından (input tokens) daha pahalı (×3) ücretlendirilir.
Aktif modellerin gerçek bağlam limitinin 200 000 tokene kadar olduğunu doğruladık (daha önce 131 072 olarak belirtilmişti). Artık daha uzun belgeler ve sohbet geçmişleri gönderebilirsiniz; her modelin güncel özellikleri için «Ağ Durumu» bölümüne bakın.
Her bir sorgunun maliyeti - API yanıtında (usage.total_cost_usd alanı) ve "Kullanım" bölümünde - dolar olarak görülebilir. Harcamaları planlamak kolaylaşır.
API erişimini aracınızda otomatik olarak yapılandırın: npx @joingonka/setup komutunu çalıştırın. Claude Code, OpenClaw, Cline, Continue, opencode, Aider ve diğerlerini destekler.
Model yanıt sırasında internette arama yapar ve kaynaklara bağlantılar ekler. Nasıl etkinleştirilir: sorgu gövdesinde plugins: [{ "id": "web", "max_results": 5 }] parametresini geçin — OpenAI ve Anthropic uyumlu API'lerde çalışır.
Maksimum yanıt uzunluğu 8192 tokene kadardır; max_tokens parametresini yöneterek ayarlayabilirsiniz (varsayılan: akış yanıtları için 1024, normal yanıtlar için 1500).
Sohbet sayfasında listeden bir model seçin (/v1/models üzerinden yüklenir) — seçim kaydedilir ve yeni diyaloglara uygulanır.
Hız lazım mı? Sorguya x-joingonka-meta: 1 başlığını ekleyin — akış yanıtında ttft_ms (ilk tokene kadar geçen süre) ve tokens_per_sec bilgileri gelecektir.
Bir yönetim anahtarı oluşturun (POST /api/management/keys) ve POST /api/management/keys/{id}/children üzerinden limitli (günlük ve aylık kota, rate limit, geçerlilik süresi) alt anahtarlar oluşturun.
plugins parametresiyle eklentileri bağlayın: response-healing kesilmiş JSON'u onarır, privacy-sanitization özel verileri maskeler, file-parser PDF ve belgelerden metin çıkarır.
OpenAI: base_url https://gate.joingonka.ai/v1, başlık Authorization: Bearer anahtarınız. Anthropic (Claude Code): base_url https://gate.joingonka.ai, başlık x-api-key, endpoint /v1/messages.
GNK: adresi ve memo bilgisini alın ve tokenları on-chain gönderin. USDT: 1 ila 10.000 dolar arası bir tutar belirtin ve OxaPay üzerinden ödeyin — GNK'ye dönüştürme otomatiktir.