Skip to main content

Claude系列模型

本页按 Anthropic 当前公开模型能力整理。实际可调用模型和计费以 Momoapi 控制台为准。
Claude 系列适合长上下文分析、复杂代码、企业级知识工作和多轮代理任务。新一代 Claude 模型重点强化了长周期代理、代码执行、工具调用、视觉理解和更稳定的指令遵循。

推荐模型

如果新项目没有历史兼容要求,优先从 claude-fable-5claude-opus-4-8claude-sonnet-5 开始测试;只有需要固定旧行为时再选择 4-7 / 4-6。

新模型亮点

claude-fable-5

Fable 5 是 Anthropic 当前公开资料中能力最高的广泛发布模型,适合长时间、多步骤、强代理式任务。
  • 默认 1M token 上下文,适合大型代码库、长合同、长论文和多文件资料包
  • 支持最高 128k 输出,适合长报告、完整重构方案和批量生成
  • 自适应思考常开,模型会按任务复杂度分配推理强度
  • 适合需要最高质量的代理、研究、代码和专业知识工作

claude-opus-4-8

Opus 4.8 面向复杂 agentic coding 和企业工作流,是 Opus 系列当前主力旗舰。
  • 适合多小时编码代理、大规模重构、复杂系统设计和高要求知识工作
  • 支持 1M token 上下文和 128k 输出
  • 指令遵循、工具调用、长会话协作和不确定性提示更稳定
  • 可通过 effort 参数调节能力、延迟和成本;代码/高自主任务建议测试 xhigh

claude-sonnet-5

Sonnet 5 是速度、质量和成本更平衡的选择,适合大多数生产任务。
  • 面向编码、代理、企业工作流和内容生成
  • 支持 1M token 上下文和 128k 输出
  • 相比 Opus 更适合高频生产调用
  • 适合从 claude-opus-4-8 向更低成本方案优化时做 A/B 测试

claude-haiku-4-5

Haiku 4.5 是低延迟、低成本路线,适合先跑通流程和高并发任务。
  • 适合快速问答、分类、摘要、批量清洗、简单代码解释
  • 支持 200k token 上下文和 64k 输出
  • 可作为复杂代理里的子任务模型,降低整体成本

怎么选

调用示例

OpenAI 兼容格式

Anthropic 原生格式

Momoapi 同时支持 OpenAI 兼容格式(/v1/chat/completions)和 Anthropic 原生格式(/v1/messages)。Claude Code 等原生客户端通常使用 Anthropic 原生格式。

Claude Code 用户

Claude Code 原生使用 Anthropic 协议,配置时需要:
  • ANTHROPIC_BASE_URL: https://momoapi.top
  • ANTHROPIC_AUTH_TOKEN: 你的 Token
详细配置见 Claude Code CLI配置使用教程

资料依据