本文最后核验于 2026-08-03。OpenAI 当前官方资料列出的是六档推理强度,而不是五档:none、low、medium、high、xhigh、max。

一分钟结论

GPT-5.6 是一个由三款模型组成的系列。gpt-5.6 当前会路由到旗舰版 Sol;Terra 更强调能力与成本平衡;Luna 面向成本敏感的大规模任务。三款模型都支持文本和图像输入、文本输出、流式响应、结构化输出、函数调用,以及 Responses、Chat Completions 与 Batch API。

模型官方定位适合场景
GPT-5.6 Sol复杂专业工作的旗舰模型高难度代码、研究、复杂代理任务
GPT-5.6 Terra智能、速度与成本的平衡日常生产、编码助手、内容与分析
GPT-5.6 Luna成本敏感的高吞吐模型分类、抽取、批处理与轻量代理

上下文与输出上限

三款模型当前都提供 1,050,000 token 上下文窗口、922,000 token 最大输入和 128,000 token 最大输出。知识截止日期为 2026-02-16。超长上下文很强,但不要把“能放进去”误解为“应该全部放进去”:生产环境仍应做检索、裁剪和缓存。

六档推理强度

通过 reasoning.effort 选择 none、low、medium、high、xhigh 或 max,默认值是 medium。强度越高,通常会消耗更多推理 token,并增加响应时间。简单提取可从 none/low 开始;复杂编码与多约束规划再逐步升高。

OpenAI 还提供独立的 reasoning.mode:standard 为默认模式,pro 会用更多计算换取更强的复杂任务表现,也会带来更高延迟和 token 使用。它不是另一条模型 ID。

标准价格(USD / 100 万 token)

模型输入缓存输入缓存写入输出
Sol$5.00$0.50$6.25$30.00
Terra$2.00$0.20$2.50$12.00
Luna$0.20$0.02$0.25$1.20

当请求输入超过 272K token 时,官方会对整次请求使用长上下文价格:输入为标准价 2 倍,输出为标准价 1.5 倍。Batch 与 Flex 的表格价格为标准价的 50%;Fast 短上下文价格为标准价的 2 倍。符合条件的数据驻留区域端点还可能有 10% 上浮。实际结算前,请以 OpenAI 官方价格页和 OpenTokenRouter 的实时价格为准。

怎么选

  • 先用 Terra 做默认模型,再用真实任务评测质量、延迟和成本。
  • 只有复杂专业任务确实得到明显收益时,才升级到 Sol。
  • 结构化抽取、分类和大批量轻任务优先评测 Luna。
  • 把推理强度当成可调参数,不要给所有请求固定 max。

Responses API 示例

curl "$OPEN_TOKEN_ROUTER_BASE_URL/v1/responses" \
  -H "Authorization: Bearer $OPEN_TOKEN_ROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-terra",
    "reasoning": {"effort": "medium"},
    "input": "为这个 Go 服务设计一份发布前检查清单"
  }'

额度与速率限制不是一个固定的公开数字,会随账户层级、项目和模型变化;请在供应商控制台的 Limits 页面核对,不要把单一额度写进长期文档。

官方来源