> 面向 AI 智能体：配置分步指南 — [`/docs/agents.md`](https://gate.joingonka.ai/docs/agents.md)，文档索引 — [`/llms.txt`](https://gate.joingonka.ai/llms.txt)。

# 模型

通过网关可用的 Gonka 网络模型：`model` 字段所用的标识符、上下文窗口、输出上限、价格与状态。

## 模型与价格

模型阵容由 Gonka 网络投票决定，因此表格基于网关的实时数据生成。价格按当前 GNK 汇率以每 1M token 的美元数计；实际扣费以 GNK 结算，详见 [定价与账户](https://gate.joingonka.ai/zh/docs/billing) 章节。

| 模型 | 上下文 | 输出 | 输入，`$/1M` | 输出，`$/1M` | 状态 |
| --- | ---: | ---: | ---: | ---: | --- |
| **MiniMax** `MiniMaxAI/MiniMax-M2.7` | 200K | 8K | $0.0083 | $0.025 | 性能下降 |
| **DeepSeek** `deepseek-ai/DeepSeek-V4-Flash-0731` | 380K | 33K | $0.0083 | $0.025 | 性能下降 |
| **Z.ai** `zai-org/GLM-5.3-Flash` | 390K | 8K | $0.0083 | $0.025 | 正常运行 |

将标识符填入 `model` 字段；字母大小写不敏感。状态按成功处理的请求占比计算，与 [网络状态](https://gate.joingonka.ai/zh/status) 页面一致。

## 如何选择模型

- 不知从何入手？选 `MiniMaxAI/MiniMax-M2.7` 就好：文档示例和安装命令都是围绕它设计的。
- 最长上下文——`zai-org/GLM-5.3-Flash`：390K token。适合大型代码库和长文档。
- 最长输出——`deepseek-ai/DeepSeek-V4-Flash-0731`：单次最多 33K token。适合一次性生成大文件。

如果网络停止服务某个模型，它会从 `GET /v1/models` 中消失，对其发起的请求将返回 503，错误类型为 `model_unavailable`。错误信息中会给出可切换的模型。

## 输出长度

输出长度由 `max_tokens` 设定——也可用 `max_completion_tokens`，网关两个字段都能识别。每个模型都有上限：更大的 `max_tokens` 会被网关静默截断到该上限。若未设置 `max_tokens`，在 `stream: true` 时会套用上限，非流式则用较小的默认值。

推理模型会把部分 `max_tokens` 用于回答前的思考——请留出余量。

| `model` | 上限 | 默认，`stream: true` | 默认，非流式 |
| --- | ---: | ---: | ---: |
| `MiniMaxAI/MiniMax-M2.7` | 8192 | 8192 | 1500 |
| `deepseek-ai/DeepSeek-V4-Flash-0731` | 32768 | 32768 | 1500 |
| `zai-org/GLM-5.3-Flash` | 8192 | 8192 | 3000 |

同样的数值以机器可读形式出现在 `GET /v1/capabilities` 响应的 `limits.models` 字段中。

## 默认模型

不带 `model` 字段的请求会被网关发送到默认模型——目前是 `MiniMaxAI/MiniMax-M2.7`。

Claude Code 和 Anthropic SDK 会在 `/v1/messages` 中传入 Anthropic 的模型名（`claude-*`）——网关会将其替换为同一个默认模型。

要使用其他模型，请从上表中指定其标识符；在安装器中对应 `--model` 参数。

## 通过 API 获取阵容与状态

模型阵容由 Gonka 网络投票决定——不要把列表写死在代码里，请从 API 获取。这些请求无需密钥。

| 请求 | 返回内容 |
| --- | --- |
| `GET /v1/models` | 当前可用的模型：标识符、上下文、输出上限和以美元计的 token 价格。网络当前不服务的模型不会出现在列表中。 |
| `GET /v1/models/{model}` | 单个模型，格式相同。标识符中的斜杠请按原样或写作 `%2F`。未知或隐藏模型返回 `404`，错误码 `model_not_found`；对隐藏模型的请求会得到 `503 model_unavailable`。 |
| `GET /v1/capabilities` | 网关能力：协议、请求参数以及 `limits` 字段——密钥的请求限流、超时和各模型的 `max_tokens` 上限。 |
| `GET /v1/network-status` | 各模型状态与故障事件——与 [网络状态](https://gate.joingonka.ai/zh/status) 页面相同的数据。 |
| `GET /health` | 网关本身是否在响应：`{"status":"ok"}`。该请求不检查模型状态。 |
