面向 AI 智能体:配置分步指南 — /docs/agents.md,文档索引 — /llms.txt。
模型
通过网关可用的 Gonka 网络模型:model 字段所用的标识符、上下文窗口、输出上限、价格与状态。
模型与价格#
模型阵容由 Gonka 网络投票决定,因此表格基于网关的实时数据生成。价格按当前 GNK 汇率以每 1M token 的美元数计;实际扣费以 GNK 结算,详见 定价与账户 章节。
| 模型 | 上下文 | 输出 | 输入,$/1M | 输出,$/1M | 状态 |
|---|---|---|---|---|---|
MiniMax MiniMaxAI/MiniMax-M2.7 | 200K | 8K | $0.0083 | $0.025 | 性能下降 |
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 33K | $0.0083 | $0.025 | 性能下降 |
Z.ai zai-org/GLM-5.3-Flash | 390K | 8K | $0.0083 | $0.025 | 正常运行 |
将标识符填入 model 字段;字母大小写不敏感。状态按成功处理的请求占比计算,与 网络状态 页面一致。
如何选择模型#
- 不知从何入手?选
MiniMaxAI/MiniMax-M2.7就好:文档示例和安装命令都是围绕它设计的。 - 最长上下文——
zai-org/GLM-5.3-Flash:390K token。适合大型代码库和长文档。 - 最长输出——
deepseek-ai/DeepSeek-V4-Flash-0731:单次最多 33K token。适合一次性生成大文件。
如果网络停止服务某个模型,它会从 GET /v1/models 中消失,对其发起的请求将返回 503,错误类型为 model_unavailable。错误信息中会给出可切换的模型。
输出长度#
输出长度由 max_tokens 设定——也可用 max_completion_tokens,网关两个字段都能识别。每个模型都有上限:更大的 max_tokens 会被网关静默截断到该上限。若未设置 max_tokens,在 stream: true 时会套用上限,非流式则用较小的默认值。
推理模型会把部分 max_tokens 用于回答前的思考——请留出余量。
model | 上限 | 默认,stream: true | 默认,非流式 |
|---|---|---|---|
MiniMaxAI/MiniMax-M2.7 | 8192 | 8192 | 1500 |
deepseek-ai/DeepSeek-V4-Flash-0731 | 32768 | 32768 | 1500 |
zai-org/GLM-5.3-Flash | 8192 | 8192 | 3000 |
同样的数值以机器可读形式出现在 GET /v1/capabilities 响应的 limits.models 字段中。
默认模型#
不带 model 字段的请求会被网关发送到默认模型——目前是 MiniMaxAI/MiniMax-M2.7。
Claude Code 和 Anthropic SDK 会在 /v1/messages 中传入 Anthropic 的模型名(claude-*)——网关会将其替换为同一个默认模型。
要使用其他模型,请从上表中指定其标识符;在安装器中对应 --model 参数。
通过 API 获取阵容与状态#
模型阵容由 Gonka 网络投票决定——不要把列表写死在代码里,请从 API 获取。这些请求无需密钥。
| 请求 | 返回内容 |
|---|---|
GET /v1/models | 当前可用的模型:标识符、上下文、输出上限和以美元计的 token 价格。网络当前不服务的模型不会出现在列表中。 |
GET /v1/models/{model} | 单个模型,格式相同。标识符中的斜杠请按原样或写作 %2F。未知或隐藏模型返回 404,错误码 model_not_found;对隐藏模型的请求会得到 503 model_unavailable。 |
GET /v1/capabilities | 网关能力:协议、请求参数以及 limits 字段——密钥的请求限流、超时和各模型的 max_tokens 上限。 |
GET /v1/network-status | 各模型状态与故障事件——与 网络状态 页面相同的数据。 |
GET /health | 网关本身是否在响应:{"status":"ok"}。该请求不检查模型状态。 |