面向 AI 智能体:配置分步指南 — /docs/agents.md,文档索引 — /llms.txt。

模型

通过网关可用的 Gonka 网络模型:model 字段所用的标识符、上下文窗口、输出上限、价格与状态。

模型与价格#

模型阵容由 Gonka 网络投票决定,因此表格基于网关的实时数据生成。价格按当前 GNK 汇率以每 1M token 的美元数计;实际扣费以 GNK 结算,详见 定价与账户 章节。

模型上下文输出输入,$/1M输出,$/1M状态
MiniMax MiniMaxAI/MiniMax-M2.7200K8K$0.0083$0.025性能下降
DeepSeek deepseek-ai/DeepSeek-V4-Flash-0731380K33K$0.0083$0.025性能下降
Z.ai zai-org/GLM-5.3-Flash390K8K$0.0083$0.025正常运行

将标识符填入 model 字段;字母大小写不敏感。状态按成功处理的请求占比计算,与 网络状态 页面一致。

如何选择模型#

  • 不知从何入手?选 MiniMaxAI/MiniMax-M2.7 就好:文档示例和安装命令都是围绕它设计的。
  • 最长上下文——zai-org/GLM-5.3-Flash:390K token。适合大型代码库和长文档。
  • 最长输出——deepseek-ai/DeepSeek-V4-Flash-0731:单次最多 33K token。适合一次性生成大文件。

如果网络停止服务某个模型,它会从 GET /v1/models 中消失,对其发起的请求将返回 503,错误类型为 model_unavailable。错误信息中会给出可切换的模型。

输出长度#

输出长度由 max_tokens 设定——也可用 max_completion_tokens,网关两个字段都能识别。每个模型都有上限:更大的 max_tokens 会被网关静默截断到该上限。若未设置 max_tokens,在 stream: true 时会套用上限,非流式则用较小的默认值。

推理模型会把部分 max_tokens 用于回答前的思考——请留出余量。

model上限默认,stream: true默认,非流式
MiniMaxAI/MiniMax-M2.7819281921500
deepseek-ai/DeepSeek-V4-Flash-073132768327681500
zai-org/GLM-5.3-Flash819281923000

同样的数值以机器可读形式出现在 GET /v1/capabilities 响应的 limits.models 字段中。

默认模型#

不带 model 字段的请求会被网关发送到默认模型——目前是 MiniMaxAI/MiniMax-M2.7。

Claude Code 和 Anthropic SDK 会在 /v1/messages 中传入 Anthropic 的模型名(claude-*)——网关会将其替换为同一个默认模型。

要使用其他模型,请从上表中指定其标识符;在安装器中对应 --model 参数。

通过 API 获取阵容与状态#

模型阵容由 Gonka 网络投票决定——不要把列表写死在代码里,请从 API 获取。这些请求无需密钥。

请求返回内容
GET /v1/models当前可用的模型:标识符、上下文、输出上限和以美元计的 token 价格。网络当前不服务的模型不会出现在列表中。
GET /v1/models/{model}单个模型,格式相同。标识符中的斜杠请按原样或写作 %2F。未知或隐藏模型返回 404,错误码 model_not_found;对隐藏模型的请求会得到 503 model_unavailable。
GET /v1/capabilities网关能力:协议、请求参数以及 limits 字段——密钥的请求限流、超时和各模型的 max_tokens 上限。
GET /v1/network-status各模型状态与故障事件——与 网络状态 页面相同的数据。
GET /health网关本身是否在响应:{"status":"ok"}。该请求不检查模型状态。