Claude系列模型
本页按 Anthropic 当前公开模型能力整理。实际可调用模型和计费以 Momoapi 控制台为准。Claude 系列适合长上下文分析、复杂代码、企业级知识工作和多轮代理任务。新一代 Claude 模型重点强化了长周期代理、代码执行、工具调用、视觉理解和更稳定的指令遵循。
推荐模型
如果新项目没有历史兼容要求,优先从
claude-fable-5、claude-opus-4-8 或 claude-sonnet-5 开始测试;只有需要固定旧行为时再选择 4-7 / 4-6。新模型亮点
claude-fable-5
Fable 5 是 Anthropic 当前公开资料中能力最高的广泛发布模型,适合长时间、多步骤、强代理式任务。
- 默认 1M token 上下文,适合大型代码库、长合同、长论文和多文件资料包
- 支持最高 128k 输出,适合长报告、完整重构方案和批量生成
- 自适应思考常开,模型会按任务复杂度分配推理强度
- 适合需要最高质量的代理、研究、代码和专业知识工作
claude-opus-4-8
Opus 4.8 面向复杂 agentic coding 和企业工作流,是 Opus 系列当前主力旗舰。
- 适合多小时编码代理、大规模重构、复杂系统设计和高要求知识工作
- 支持 1M token 上下文和 128k 输出
- 指令遵循、工具调用、长会话协作和不确定性提示更稳定
- 可通过 effort 参数调节能力、延迟和成本;代码/高自主任务建议测试
xhigh
claude-sonnet-5
Sonnet 5 是速度、质量和成本更平衡的选择,适合大多数生产任务。
- 面向编码、代理、企业工作流和内容生成
- 支持 1M token 上下文和 128k 输出
- 相比 Opus 更适合高频生产调用
- 适合从
claude-opus-4-8向更低成本方案优化时做 A/B 测试
claude-haiku-4-5
Haiku 4.5 是低延迟、低成本路线,适合先跑通流程和高并发任务。
- 适合快速问答、分类、摘要、批量清洗、简单代码解释
- 支持 200k token 上下文和 64k 输出
- 可作为复杂代理里的子任务模型,降低整体成本
怎么选
调用示例
OpenAI 兼容格式
Anthropic 原生格式
Momoapi 同时支持 OpenAI 兼容格式(
/v1/chat/completions)和 Anthropic 原生格式(/v1/messages)。Claude Code 等原生客户端通常使用 Anthropic 原生格式。Claude Code 用户
Claude Code 原生使用 Anthropic 协议,配置时需要:ANTHROPIC_BASE_URL:https://momoapi.topANTHROPIC_AUTH_TOKEN: 你的 Token