アップデートとステータス
インフェレンスの現在の状況とゲートウェイの更新履歴。
現在のステータス
- MiniMax M2.7Gonkaネットワーク:パフォーマンス低下
- DeepSeek V4 FlashGonkaネットワーク:パフォーマンス低下
- GLM 5.3 FlashGonkaネットワーク:稼働中
アクティブなモデルのセットはGonkaネットワークの投票によって決定され、変更される可能性があります:一部のモデルは一時的に利用不可となる場合がありますが、後で復帰します。最新リストは上記の通りです。
詳細なステータスとアップタイム →更新履歴
WGNKトークンで残高をチャージできます。これはEthereumネットワーク上のGNKです。マイページにて:入金 → GNK → Ethereum · WGNK を選択し、送信元のウォレットアドレスを指定してください。転送は通常15〜20分で自動的に反映されます。
npx @joingonka/setup が25個のツールを構成できるようになりました。追加:Codex CLI, Kimi Code, omp, MiniMax Code, Goose, MiMo Code, Qwen Code, Factory Droid, Crush, Zoo Code。モデルは --model フラグ(minimax, deepseek, glm)で選択し、デフォルトは DeepSeek V4 Flash です。最後に、インストーラーが検証リクエストを送信し、キーが有効かどうかを即座に表示します。
9月16日より、すべての新規アカウントは従来の50,000,000 nGNKではなく、100,000,000 nGNK (0.1 GNK) を受け取ります。現在のネットワーク価格では、入金不要でテスト用に約300万トークン分に相当します。ボーナスは登録時に自動的に付与されるため、入力は不要です。現在の付与額は常に GET /api/pricing (フィールド名 welcome_bonus_ngonka) および登録ページで確認できます。
Gonka ネットワークのブローカーは、約 5 分の生成後にストリームを終了します(GLM 5.3 Flash の場合、これは約 8,000 トークンに相当します)。以前は、このような切り捨ては通常の終了のように見えていました:ストリームは finish_reason なしで [DONE] となり、クライアントは切り捨てられた出力を完全な応答と誤認していました。現在、ゲートウェイはストリームと通常応答の両方に finish_reason="length" を含むチャンクを追加し、Anthropic 形式では stop_reason="max_tokens" を追加します。長い応答への対処法:stream:true を使用し、finish_reason="length" が発生した場合は、既に受信した部分をコンテキストに含めて次のリクエストで生成を継続してください。詳細はドキュメントの「制限」セクションを参照してください。
Gonka ネットワークに Z.ai の GLM 5.3 Flash が登場しました: 320B パラメータ (MoE, アクティブ 18B)、FP8、MIT ライセンス、390,000 トークンのコンテキストウィンドウ。モデルは回答前に推論を行い、その内容は reasoning_content フィールドに入り、応答予算を消費します。そのため、max_tokens は 600 以上に設定するか、stream:true を使用してください。短いタスクには reasoning_effort: "low" を推奨します。Tool calling および JSON モードがサポートされています。識別子は zai-org/GLM-5.3-Flash で、価格はネットワーク内の他のモデルと同じです。Kimi K2.6 はネットワークによるサポートが終了しました。統合先を MiniMax M2.7、DeepSeek V4 Flash、または GLM 5.3 Flash に変更してください。
「使用状況」ページでは、各モデルのリクエスト数、入力/出力トークン、nGNKおよびドルでのコスト、1Mトークンあたりの平均価格、応答速度などの消費状況を確認できます。「今日」は時間単位で表示され、「90日間」のプリセットが追加されました。統合用:GET /api/usage/by-model。
ゲートウェイが /v1/completions (OpenAIの「テキスト」エンドポイント)へのリクエストを受け付けるようになりました。入力としてプロンプト文字列を受け取り、出力として choices[].text を返します。これは、オートコンプリートやインラインコード編集(Continue.devなど)のエディタプラグインで使用されます。Base URL は変更ありません: https://gate.joingonka.ai/v1。ストリーミングおよび標準パラメータ(max_tokens, temperature, stop)がサポートされており、コストと制限は /v1/chat/completions と同じです。logprobs と best_of フィールドはサポートされていません。
8月22日より、推論コストを以下の通り変更します:入力 33 nGNK、出力 99 nGNK/token(以前は 22/66)。ゲートウェイ手数料は 10% で変更ありません。デモモードは引き続き無料です。値上げの理由:Gonka ネットワークでのリクエスト処理には冗長性(redundancy)があり、これはサービスを円滑に行うために必要なプロトコルおよび devshards コードの一部です。コンテナは1つのホストにリクエストを送信し、失敗した場合は別のホストへ、必要に応じて複数のホストへ同時に送信することがあります。試行ごとに料金が発生します。ネットワーク価格は 10 nGNK/token にリクエストの冗長度(平均 ×1—2.5)を乗じたものです。以前は価格確定 API が機能していなかったため、このコストは請求されず、単一ホスト分のみを支払っていましたが、現在は実コストに基づいて計算されるため、料金に反映させることとなりました。推論コストは依然としてベンダーの API より数百倍安価です。各モデルの最新価格は Pricing ページおよび GET /api/pricing で確認できます。
ゲートウェイはResponses形式のリクエストを受け入れるようになりました。これはOpenAIの新しいプロトコルで、最新のSDKやCodex CLIで採用されています。アドレスは変更ありません:base URL https://gate.joingonka.ai/v1、クライアントは自動的に /v1/responses を呼び出します。ストリーミング、function tools、および構造化出力 (text.format) がサポートされており、コストと制限は /v1/chat/completions と同じです。対話履歴は保存されないため store は無視され、previous_response_id はエラーを返します。履歴全体は input フィールドに渡してください。OpenAIの組み込みサーバーツール (web_search, file_search, code_interpreter) はサポートされていません。当社のウェブ検索機能は、引き続き /v1/chat/completions の web プラグインから利用可能です。
以前は、Gonkaネットワークのstream:trueモードでの障害はコード200で返され、エラーはSSEチャンク内でのみ確認可能でした。そのため、エージェントクライアントはこれを空の成功応答と誤認し、再試行を行いませんでした。現在は、ネットワーク応答が開始される前にエラーが発生した場合、標準のHTTPコードが返されます(モデル過負荷時は429(Retry-Afterヘッダー付き)、タイムアウト時は504、利用可能なノードがない場合は503)。ストリームの途中で障害が発生した場合、ステータスは変更できません。エラーフィールドを含むチャンクは引き続き送信されますが、終了の[DONE]は送信されなくなったため、ストリームが正常に完了したようには見えなくなります。
npx @joingonka/setup は、Claude Code, OpenClaw, Cursor, Cline, opencode, Aider, Kilo Code, Roo Code, Continue, Hermes, Pi, Zed, ZCode, JetBrains AI Assistant, GitHub Copilot BYOK の15個のエージェントツールを構成できるようになりました。そのうち7つについては、設定ファイルが書き込まれ、既存の設定とクリーンにマージされます(コメントや既存の設定は保持されます)。GUIのみで設定可能な残りのツールについては、貼り付け可能な値を表示します。ツールを個別に選択することも可能です:npx @joingonka/setup --tool zed。実行終了時には、ゲートウェイへのライブリクエストを通じて、キー、アドレス、モデルが受け入れられたことを確認します。
DeepSeek V4 Flashの単一応答の最大長が4倍に増加しました:8,192から32,768トークン(max_tokensパラメータ)。大きなファイルやエージェントツールの長い応答が1回の呼び出しに収まるようになりました。さらに、ツール呼び出しの途中で制限に達した場合、ゲートウェイは不完全な呼び出しではなく、正しいfinish_reason="length"を返します。これにより、エージェントクライアント(Cursorなど)は解析エラーでハングアップすることなく、正常に処理を継続できます。
Gonkaネットワークに3つ目のアクティブなモデル「DeepSeek V4 Flash 0731」が登場しました。38万トークンのコンテキスト(ネットワーク最長、381Kの実際のリクエストで検証済み)、reasoning、tool callingをサポートしています。識別子は deepseek-ai/DeepSeek-V4-Flash-0731 で、価格は他のモデルと同じです。本モデルは早期テスト中ですが、完全に利用可能です。ダッシュボードのチャットから選択するか、APIリクエストの model フィールドで指定してください。
8月3日より、推論コストは入力 22 nGNK、出力 66 nGNK/token となります(以前の 11/33 から2倍)。ゲートウェイ手数料は 10% で変更ありません。デモモードは引き続き無料です。全モデルの最新価格は、Pricing ページおよび GET /api/pricing をご確認ください。
Gonkaネットワークがリクエストを受信したが応答しない場合(タイムアウト300秒)、ゲートウェイはサイレントリトライを繰り返すのではなく、直ちに504エラーを返すようになりました。課金に関する重要事項:ネットワークが受け付けたリクエストはキャンセルできません。ノードは処理を続行するため、タイムアウトが発生した場合でもプロンプト処理の見積り分は差し引かれます(completionは課金対象外です)。推奨事項:長い生成を行う場合は stream:true を使用してください。ストリーミングはタイムアウトに強く、進行状況がすぐに表示されます。
USDTによる入金手数料が金額に応じて減少するようになりました:基本5%、$25以上で4.5%、$50以上で4%、$100以上で3.5%、$250以上で3%、$500以上で2.75%、$1000以上で2.5%。入金画面には対話型のテーブルが表示され、金額スライダー、各段階のGNKボーナス、節約額を確認できます。割引は入金時に自動的に適用されます。
子キーに対して設定可能な合計(累積)支出制限です。日次や月次の制限とは異なり、リセットされない専用のクォータです。クォータを使い切ると、そのキーを使用したリクエストは拒否されます。制限はダッシュボードで(nanogonka単位の精度で)設定するか、POST/PATCH /api/management/keys/{id}/children の limit_total_ngonka フィールドを介してAPIで設定できます。累積使用量は「Reset usage」ボタン(または POST /api/management/keys/{id}/children/{childId}/reset-usage)からリセット可能です。
推論コストが、Gonka ネットワークの実際の中間価格(トークン単価)と同期されました。価格は依然として市場で最も低い水準にあり、100万トークンあたりわずか数セント相当です。これは同じ open-source モデルを使用した場合、OpenAI や Anthropic よりも数百倍安価です。他の多くのプロバイダーと同様に、出力トークンは入力トークンよりも高い単価(×3)で設定されています。
アクティブなモデルの実際のコンテキスト制限が最大 200,000 トークンであることを確認しました(以前は控えめに 131,072 と公表されていました)。より長いドキュメントや対話履歴を送信可能になりました。各モデルの最新の仕様は「ネットワークステータス」セクションで確認できます。
各リクエストのコストは、APIレスポンス(usage.total_cost_usdフィールド)および「使用状況」セクションで米ドル単位で確認できます。予算管理に便利です。
ツール内でAPIアクセスを自動的に設定します:npx @joingonka/setup を実行してください。Claude Code、OpenClaw、Cline、Continue、opencode、Aiderなどをサポートしています。
モデルは応答中にインターネットを検索し、ソースへのリンクを追加します。有効方法:リクエストボディに plugins: [{ "id": "web", "max_results": 5 }] を渡してください。OpenAIおよびAnthropic互換APIで動作します。
応答の最大長は8192トークンまで対応。max_tokensパラメータで調整可能です(デフォルトはストリーミング応答で1024、通常応答で1500)。
「チャット」ページでリストからモデルを選択してください(/v1/modelsから読み込み)。選択内容は保存され、新しい対話に適用されます。
速度が必要ですか?リクエストにヘッダー x-joingonka-meta: 1 を追加すると、ストリーミング応答に ttft_ms(最初のトークンまでの時間)と tokens_per_sec が含まれます。
管理キーを作成(POST /api/management/keys)し、POST /api/management/keys/{id}/children を通じて制限付き(日次・月次クォータ、レート制限、有効期限)の子キーを発行できます。
pluginsパラメータでプラグインを接続:response-healingは切り捨てられたJSONを修復し、privacy-sanitizationは個人データをマスクし、file-parserはPDFやドキュメントからテキストを抽出します。
OpenAI: base_url https://gate.joingonka.ai/v1、ヘッダー Authorization: Bearer {あなたのキー}。Anthropic (Claude Code): base_url https://gate.joingonka.ai、ヘッダー x-api-key、エンドポイント /v1/messages。
GNK:アドレスとmemoを取得し、オンチェーンでトークンを送金してください。USDT:1〜10,000ドルの範囲で金額を指定し、OxaPay経由で支払うと自動的にGNKへ変換されます。