Skip to main content

GPT 系列模型

本页按 OpenAI 当前公开模型资料整理。实际可调用模型和计费以 Momoapi 控制台为准。
Momoapi 已新增 gpt-5.6,并保留 GPT-5.5、GPT-5.4、GPT-5.4 mini、图片生成和代码审查工具模型。gpt-5.6 是 OpenAI 最新预览系列,重点提升复杂推理、长周期 coding agent、专业工作流和更稳定的安全防护。

已上架模型

已删除旧的 Plus 增强版模型。后续选型统一按模型本身、延迟、成本和调用场景区分。

gpt-5.6 新特性

OpenAI 将 GPT-5.6 设计为 Sol、Terra、Luna 三个能力层级:Sol 偏最高能力,Terra 偏日常均衡,Luna 偏速度和成本。Momoapi 文档统一使用 gpt-5.6 作为新增模型入口;如果控制台展示更细分的模型名,以控制台为准。 重点能力:
  • 更强复杂推理: 适合多步骤规划、代码任务、科研分析和复杂业务判断
  • 更强 coding agent 能力: 面向终端工作流、计划-执行-修正循环和多工具协作
  • 新增更高推理档位: OpenAI 在 GPT-5.6 中引入 max reasoning effort,用于更深推理任务
  • Ultra 模式方向: 官方说明 GPT-5.6 引入可通过子代理增强复杂工作的 ultra 模式能力方向
  • 更明确的缓存机制: 支持更可预测的 prompt caching,包括显式 cache breakpoint 和至少 30 分钟缓存生命周期
  • 更强安全防护: 对高风险请求、敏感安全任务和重复滥用做了更强分层防护
OpenAI 官方仍将 GPT-5.6 标记为 limited preview / select trusted partners preview。生产环境接入前,请先在 Momoapi 控制台确认账号是否已开通。

文本模型详解

gpt-5.6

最新预览系列,适合优先追求能力上限的任务。
  • 适合: 复杂代码、长周期代理、专业研究、复杂安全防护分析、困难推理
  • 优点: 能力上限更高,复杂任务更稳,缓存和推理档位更清晰
  • 注意: 预览阶段可能存在权限、价格、速率或稳定性差异

gpt-5.5

旗舰通用模型,适合复杂推理和代码任务,是稳定生产场景的主力选择。
  • 适合: 复杂业务逻辑、代码生成、架构设计、数学推理、严肃内容生成
  • 优点: 能力强,适合质量优先的任务

gpt-5.4

主力通用模型,质量、速度和成本更均衡。
  • 适合: 日常对话、内容生成、一般代码任务、批量业务处理
  • 优点: 成本和效果平衡,适合默认生产模型

gpt-5.4-mini

低延迟、低成本版本。
  • 适合: 简单问答、摘要、分类、轻量代码解释、高频调用
  • 优点: 响应快、成本低,适合批量任务

工具模型

codex-auto-review

代码自动审查工具模型。它不是通用聊天模型,适合集成到代码提交流程或 CI/CD 中做自动 review。
  • 适合: 自动化代码审查、PR 检查、CI 流水线辅助
  • 注意: 不建议用于普通问答或内容生成

gpt-image-2

图片生成和编辑模型。

选型建议

调用示例

基础对话

用 OpenAI SDK 调用

复杂推理任务响应时间可能较长,请确保客户端超时设置足够,建议不低于 600 秒。详见 环境检查

资料依据