AI エージェント向け:セットアップの手順ガイド — /docs/agents.md、ドキュメントのインデックス — /llms.txt。
モデル
ゲートウェイ経由で利用できるGonkaネットワークのモデル:modelに入れる識別子、コンテキストウィンドウ、出力上限、価格、ステータス。
モデルと価格#
モデルの構成はGonkaネットワークの投票で変わるため、テーブルはゲートウェイのライブデータから生成されます。価格は現在のGNKレートによる100万トークンあたりのドル建てです。請求はGNKで行われ、詳細は料金とアカウントセクションをご覧ください。
| モデル | コンテキスト | 出力 | 入力、$/1M | 出力、$/1M | ステータス |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | 性能低下 |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | 性能低下 |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | 稼働中 |
識別子はmodelに入力してください。大文字小文字は区別されません。ステータスはネットワークステータスページと同様、正常に処理されたリクエストの割合で算出されます。
モデルの選び方#
- どれから始めればいいかわからない場合は
MiniMaxAI/MiniMax-M2.7をおすすめします。ドキュメントの例やインストーラーのコマンドはこれを前提としています。 - 最長のコンテキストは
zai-org/GLM-5.3-Flash:390Kトークン。大規模なコードベースや長いドキュメントに。 - 最長の出力は
deepseek-ai/DeepSeek-V4-Flash-0731:一度に最大33Kトークン。大きなファイルを一括生成するのに。
ネットワークがモデルの提供を停止すると、そのモデルはGET /v1/modelsから消え、リクエストにはエラータイプmodel_unavailableの503が返ります。エラーメッセージには切り替え可能なモデルが示されます。
出力の長さ#
出力の長さはmax_tokensまたはmax_completion_tokensで指定します。ゲートウェイは両方のフィールドを認識します。各モデルには上限があり、それを超えるmax_tokensはゲートウェイが黙って切り捨てます。max_tokensを指定しない場合、stream: trueでは上限が、非ストリーミングではより小さいデフォルト値が適用されます。
推論モデルはmax_tokensの一部を回答前の思考に使うため、余裕を持たせてください。
model | 上限 | デフォルト、stream: true | デフォルト、非ストリーミング |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
同じ数値を機械可読な形式で:レスポンスGET /v1/capabilitiesのlimits.modelsフィールド。
デフォルトモデル#
modelを含まないリクエストは、ゲートウェイがデフォルトモデルに送信します。現在はMiniMaxAI/MiniMax-M2.7です。
Claude CodeとAnthropic SDKは/v1/messagesにAnthropicのモデル名(claude-*)を送信しますが、ゲートウェイはそれらを同じデフォルトモデルに置き換えます。
別のモデルを使うには、上のテーブルの識別子を指定してください。インストーラーではフラグ--modelです。
APIによる構成とステータス#
モデルの構成はGonkaネットワークの投票で変わるため、リストをコードに埋め込まずAPIから取得してください。これらのリクエストにキーは不要です。
| リクエスト | 返される内容 |
|---|---|
GET /v1/models | 現在利用可能なモデル:識別子、コンテキスト、出力上限、ドル建てのトークン価格。ネットワークが現在提供していないモデルはリストに含まれません。 |
GET /v1/models/{model} | 同じ形式の単一モデル。識別子内のスラッシュはそのまま、または%2Fとして渡してください。不明または非公開のモデルはmodel_not_foundコード付きの404、非公開モデルへのリクエストは503 model_unavailableを返します。 |
GET /v1/capabilities | ゲートウェイの機能:プロトコル、リクエストパラメータ、limitsフィールド(キーのレート制限、タイムアウト、モデルごとのmax_tokens上限)。 |
GET /v1/network-status | 各モデルのステータスとインシデント:ネットワークステータスページと同じデータ。 |
GET /health | ゲートウェイ自体が応答しているか:{"status":"ok"}。このリクエストはモデルの状態をチェックしません。 |