> ## Documentation Index
> Fetch the complete documentation index at: https://docs.momoapi.top/llms.txt
> Use this file to discover all available pages before exploring further.

# GPT 系列模型

> OpenAI GPT-5.6、GPT-5.5、GPT-5.4 系列及配套工具模型的使用说明

# GPT 系列模型

> 本页按 OpenAI 当前公开模型资料整理。实际可调用模型和计费以 Momoapi 控制台为准。

Momoapi 已新增 `gpt-5.6`，并保留 GPT-5.5、GPT-5.4、GPT-5.4 mini、图片生成和代码审查工具模型。`gpt-5.6` 是 OpenAI 最新预览系列，重点提升复杂推理、长周期 coding agent、专业工作流和更稳定的安全防护。

## 已上架模型

| 模型                  | 类型       | 定位                            |
| ------------------- | -------- | ----------------------------- |
| `gpt-5.6`           | 文本 / 多模态 | **最新预览系列**，复杂推理、代码、长期代理任务优先测试 |
| `gpt-5.5`           | 文本 / 多模态 | 旗舰通用模型，复杂推理和代码主力              |
| `gpt-5.4`           | 文本 / 多模态 | 主力通用模型，质量、速度、成本平衡             |
| `gpt-5.4-mini`      | 文本 / 多模态 | 精简快速，适合低延迟和高频调用               |
| `codex-auto-review` | 工具       | 自动化代码审查                       |
| `gpt-image-2`       | 图片       | 文生图 / 图像编辑                    |

<Note>
  已删除旧的 Plus 增强版模型。后续选型统一按模型本身、延迟、成本和调用场景区分。
</Note>

## `gpt-5.6` 新特性

OpenAI 将 GPT-5.6 设计为 Sol、Terra、Luna 三个能力层级：Sol 偏最高能力，Terra 偏日常均衡，Luna 偏速度和成本。Momoapi 文档统一使用 `gpt-5.6` 作为新增模型入口；如果控制台展示更细分的模型名，以控制台为准。

重点能力：

* **更强复杂推理**: 适合多步骤规划、代码任务、科研分析和复杂业务判断
* **更强 coding agent 能力**: 面向终端工作流、计划-执行-修正循环和多工具协作
* **新增更高推理档位**: OpenAI 在 GPT-5.6 中引入 `max` reasoning effort，用于更深推理任务
* **Ultra 模式方向**: 官方说明 GPT-5.6 引入可通过子代理增强复杂工作的 `ultra` 模式能力方向
* **更明确的缓存机制**: 支持更可预测的 prompt caching，包括显式 cache breakpoint 和至少 30 分钟缓存生命周期
* **更强安全防护**: 对高风险请求、敏感安全任务和重复滥用做了更强分层防护

<Warning>
  OpenAI 官方仍将 GPT-5.6 标记为 limited preview / select trusted partners preview。生产环境接入前，请先在 Momoapi 控制台确认账号是否已开通。
</Warning>

## 文本模型详解

### `gpt-5.6`

最新预览系列，适合优先追求能力上限的任务。

* **适合**: 复杂代码、长周期代理、专业研究、复杂安全防护分析、困难推理
* **优点**: 能力上限更高，复杂任务更稳，缓存和推理档位更清晰
* **注意**: 预览阶段可能存在权限、价格、速率或稳定性差异

### `gpt-5.5`

旗舰通用模型，适合复杂推理和代码任务，是稳定生产场景的主力选择。

* **适合**: 复杂业务逻辑、代码生成、架构设计、数学推理、严肃内容生成
* **优点**: 能力强，适合质量优先的任务

### `gpt-5.4`

主力通用模型，质量、速度和成本更均衡。

* **适合**: 日常对话、内容生成、一般代码任务、批量业务处理
* **优点**: 成本和效果平衡，适合默认生产模型

### `gpt-5.4-mini`

低延迟、低成本版本。

* **适合**: 简单问答、摘要、分类、轻量代码解释、高频调用
* **优点**: 响应快、成本低，适合批量任务

## 工具模型

### `codex-auto-review`

代码自动审查工具模型。它不是通用聊天模型，适合集成到代码提交流程或 CI/CD 中做自动 review。

* **适合**: 自动化代码审查、PR 检查、CI 流水线辅助
* **注意**: 不建议用于普通问答或内容生成

### `gpt-image-2`

图片生成和编辑模型。

* **适合**: 文生图、图片编辑、视觉创意素材生成
* **更多说明**: 见 [图片与视频生成](/models/media)

## 选型建议

| 场景            | 推荐                  |
| ------------- | ------------------- |
| 最新能力体验 / 复杂任务 | `gpt-5.6`           |
| 稳定旗舰 / 复杂代码   | `gpt-5.5`           |
| 日常通用 / 生产默认   | `gpt-5.4`           |
| 最快最省钱 / 高频调用  | `gpt-5.4-mini`      |
| 自动化代码审查       | `codex-auto-review` |
| 图片生成          | `gpt-image-2`       |

## 调用示例

### 基础对话

```bash theme={null}
curl https://momoapi.top/v1/chat/completions \
  -H "Authorization: Bearer sk-你的Token" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6",
    "messages": [{"role": "user", "content": "帮我设计一个支持百万并发的限流方案"}],
    "stream": false
  }'
```

### 用 OpenAI SDK 调用

```python theme={null}
from openai import OpenAI

client = OpenAI(
    api_key="sk-你的Token",
    base_url="https://momoapi.top/v1"
)

response = client.chat.completions.create(
    model="gpt-5.6",
    messages=[{"role": "user", "content": "审查这个系统设计的扩展性风险"}]
)
print(response.choices[0].message.content)
```

<Warning>
  复杂推理任务响应时间可能较长，请确保客户端超时设置足够，建议不低于 600 秒。详见 [环境检查](/cli-config/env-check)。
</Warning>

## 资料依据

* [OpenAI API Models](https://developers.openai.com/api/docs/models)
* [OpenAI: Previewing GPT-5.6 Sol](https://openai.com/index/previewing-gpt-5-6-sol/)
