AI エージェント向け:セットアップの手順ガイド — /docs/agents.md、ドキュメントのインデックス — /llms.txt。

モデル

ゲートウェイ経由で利用できるGonkaネットワークのモデル:modelに入れる識別子、コンテキストウィンドウ、出力上限、価格、ステータス。

モデルと価格#

モデルの構成はGonkaネットワークの投票で変わるため、テーブルはゲートウェイのライブデータから生成されます。価格は現在のGNKレートによる100万トークンあたりのドル建てです。請求はGNKで行われ、詳細は料金とアカウントセクションをご覧ください。

モデルコンテキスト出力入力、$/1M出力、$/1Mステータス
MiniMax MiniMaxAI/MiniMax-M2.7200K8K$0.0083$0.025性能低下
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731380K33K$0.0083$0.025性能低下
Z.ai zai-org/GLM-5.3-Flash390K8K$0.0083$0.025稼働中

識別子はmodelに入力してください。大文字小文字は区別されません。ステータスはネットワークステータスページと同様、正常に処理されたリクエストの割合で算出されます。

モデルの選び方#

  • どれから始めればいいかわからない場合はMiniMaxAI/MiniMax-M2.7をおすすめします。ドキュメントの例やインストーラーのコマンドはこれを前提としています。
  • 最長のコンテキストはzai-org/GLM-5.3-Flash:390Kトークン。大規模なコードベースや長いドキュメントに。
  • 最長の出力はdeepseek-ai/DeepSeek-V4-Flash-0731:一度に最大33Kトークン。大きなファイルを一括生成するのに。

ネットワークがモデルの提供を停止すると、そのモデルはGET /v1/modelsから消え、リクエストにはエラータイプmodel_unavailableの503が返ります。エラーメッセージには切り替え可能なモデルが示されます。

出力の長さ#

出力の長さはmax_tokensまたはmax_completion_tokensで指定します。ゲートウェイは両方のフィールドを認識します。各モデルには上限があり、それを超えるmax_tokensはゲートウェイが黙って切り捨てます。max_tokensを指定しない場合、stream: trueでは上限が、非ストリーミングではより小さいデフォルト値が適用されます。

推論モデルはmax_tokensの一部を回答前の思考に使うため、余裕を持たせてください。

model上限デフォルト、stream: trueデフォルト、非ストリーミング
MiniMaxAI/MiniMax-M2.7819281921500
deepseek-ai/DeepSeek-V4-Flash-073132768327681500
zai-org/GLM-5.3-Flash819281923000

同じ数値を機械可読な形式で:レスポンスGET /v1/capabilitiesのlimits.modelsフィールド。

デフォルトモデル#

modelを含まないリクエストは、ゲートウェイがデフォルトモデルに送信します。現在はMiniMaxAI/MiniMax-M2.7です。

Claude CodeとAnthropic SDKは/v1/messagesにAnthropicのモデル名(claude-*)を送信しますが、ゲートウェイはそれらを同じデフォルトモデルに置き換えます。

別のモデルを使うには、上のテーブルの識別子を指定してください。インストーラーではフラグ--modelです。

APIによる構成とステータス#

モデルの構成はGonkaネットワークの投票で変わるため、リストをコードに埋め込まずAPIから取得してください。これらのリクエストにキーは不要です。

リクエスト返される内容
GET /v1/models現在利用可能なモデル:識別子、コンテキスト、出力上限、ドル建てのトークン価格。ネットワークが現在提供していないモデルはリストに含まれません。
GET /v1/models/{model}同じ形式の単一モデル。識別子内のスラッシュはそのまま、または%2Fとして渡してください。不明または非公開のモデルはmodel_not_foundコード付きの404、非公開モデルへのリクエストは503 model_unavailableを返します。
GET /v1/capabilitiesゲートウェイの機能:プロトコル、リクエストパラメータ、limitsフィールド(キーのレート制限、タイムアウト、モデルごとのmax_tokens上限)。
GET /v1/network-status各モデルのステータスとインシデント:ネットワークステータスページと同じデータ。
GET /healthゲートウェイ自体が応答しているか:{"status":"ok"}。このリクエストはモデルの状態をチェックしません。