首页 / Claude Code 入门教程 / 模型配置

Claude Code 入门教程

模型配置

本教程共 34 篇 · 第 15 篇 · 更新于 2026-07-26 · 约 8 分钟阅读

Claude CodeClaude Code 入门教程模型Opus 5Sonnet推理强度effort level

15. 模型配置

本节目标:搞懂 Claude Code 怎么选模型、怎么切换、推理强度怎么调、扩展思考和百万上下文怎么用。学完你能为不同活儿配对模型,该省的省、该猛的猛。

先认清模型家族

Claude Code 背后是 Claude 系列模型。版本基准 v2.1.220 下,默认模型是 Claude Opus 5(从 v2.1.219 起成为默认 Opus 模型,支持 100 万 token 上下文)。

打个比方理解这几代模型的关系:

  • Opus 系列:旗舰,复杂推理、架构设计、难题深挖的首选。贵但聪明。
  • Sonnet 系列:日常编码主力,速度和智能平衡得好,性价比高。
  • Haiku 系列:轻量快马,简单任务(改名、格式化、查个东西)用它最省。
  • Fable 系列:顶配,能撑超长自主会话,适合跨多会话的大任务。不是默认,要手动选。
Note

别名指向的版本会随时间更新。今天 opus 别名解析到 Opus 5,过段时间出新版可能就解析到 Opus 6。想固定版本,用完整模型名(如 claude-opus-5)或设环境变量 ANTHROPIC_DEFAULT_OPUS_MODEL

模型别名速查

不用记一长串版本号,Claude Code 给了一组别名

别名行为
default特殊值,清掉覆盖,回到你账户类型推荐的模型
best组织有权限就用 Fable 5,否则用最新 Opus
fable用 Fable 5,专门啃最难最耗时的活
opus用最新 Opus,复杂推理任务
sonnet用最新 Sonnet,日常编码
haiku用 Haiku,简单任务图快图省
sonnet[1m]Sonnet + 100 万 token 上下文
opus[1m]Opus + 100 万 token 上下文
opusplan混合模式:Plan 阶段用 Opus,执行阶段切 Sonnet

opusplan 这个挺有意思—规划时用 Opus 想清楚,写代码时切 Sonnet 干活,两全其美。

Tip

别名解析到哪个具体版本,跟你的提供商有关。Anthropic API 上 opus 解析到的版本通常最新;走 Amazon Bedrock、Google Cloud、Microsoft Foundry 这些企业渠道,可能解析到稍旧的版本。想要更新的,显式写完整模型名或设环境变量。

怎么选模型:四种方式

按优先级从高到低:

  1. 会话中切换/model <别名> 立刻切,或 /model 不带参数打开选择器
  2. 启动时指定claude --model <别名> 启动
  3. 环境变量:设 ANTHROPIC_MODEL=<别名>
  4. 设置文件settings.json 里写 model 字段,永久默认
# 用 Opus 启动
claude --model opus

# 会话中切到 Sonnet
/model sonnet

设置文件里这么写:

{
  "model": "opus"
}

从 v2.1.153 起,/model 会把你的选择存进用户设置当默认值。选择器里:

  • Enter:切换并保存为默认
  • s:只本次会话用,不保存

直接 /model sonnet 的效果跟 Enter 一样—既切又存。

Warning

--model 标志和 ANTHROPIC_MODEL 环境变量只对本次会话生效。想在两个终端同时跑不同模型,各自用 --model 启动,别用 /model 切(/model 会改全局默认,影响另一个终端)。

推理强度(Effort Level)

这是个省钱出活的关键配置。推理强度控制模型在每一步思考多少—低强度快而省,高强度深而准。

可用的级别(从低到高):

级别何时用
low短期、范围小、对延迟敏感、不需要高智力的活
medium成本敏感,可以牺牲一点智能
high平衡,大多数编码任务的默认值
xhigh更深入推理,token 花得更多
max啃硬骨头可能有用,但容易过度思考,收益递减
ultracode特殊:发 xhigh + 为实质性任务编排动态工作流,仅限会话

Opus 5、Sonnet 5、Fable 5 这些新一代模型默认就是 high。Opus 4.7 默认 xhigh

Note

级别是按模型校准的,同名级别在不同模型里不代表相同基础值。maxultracode仅限会话的,不能写进 settings.json 持久化(effortLevel 设置只接受 low/medium/high/xhigh)。

怎么调推理强度

  • /effort:不带参数开滑块,/effort high 直接设,/effort auto 重置为模型默认
  • /model:选模型时用左右箭头调滑块
  • --effort 标志:启动时传,如 claude --effort xhigh
  • 环境变量CLAUDE_CODE_EFFORT_LEVEL 设级别名或 auto
  • 设置文件effortLevel 字段
  • 技能/子代理 frontmatter:写 effort 字段,运行时覆盖

环境变量优先级最高,其次是你配的级别,最后是模型默认。

ultrathink:一次性深推理

不想改整个会话的强度,只想让这一轮想深一点?在提示里随便哪个位置加个词:

帮我看下这个并发 bug,ultrathink

Claude Code 识别 ultrathink 关键字,给这轮加深入推理指令,不改会话设置。注意只有 ultrathink 管用,“think”、“think hard” 这些不会被识别。

扩展思考(Extended Thinking)

扩展思考是模型回复前发出的推理过程。在新一代模型(Opus 5、Sonnet 5、Fable 5)上,推理强度是控制思考的主要方式;下面的设置管的是开关和显示。

控制怎么设
当前会话开关macOS 按 Option+T,Windows/Linux 按 Alt+T
全局默认/config 里切,存为 alwaysThinkingEnabled
无论强度都关掉MAX_THINKING_TOKENS=0(Fable 5 例外,关不掉)

思考输出默认是折叠的。按 Ctrl+O 切详细模式,能看到灰色斜体的推理过程。

Warning

思考 token 是要付费的,哪怕它被折叠或被编辑过。觉得贵就调低推理强度,或用 MAX_THINKING_TOKENS=0 关掉(Fable 5 不行)。Fable 5 根据强度自己决定每步思考多少,关不掉。

百万上下文(1M Context)

Opus 5、Sonnet 5、Fable 5 这些新一代模型支持 100 万 token 的上下文窗口(Context Window),能塞下大型代码库的长会话。

怎么用:

  • 显式选 opus[1m]sonnet[1m] 别名
  • 在 Max、Team、Enterprise 订阅上,Opus 会自动升级到 1M 上下文,不用额外配置
Note

1M 上下文的可用性跟模型和套餐都有关。Anthropic API 上 Opus 5、Sonnet 5、Fable 5 始终用 1M 跑。订阅套餐上有些模型需要消耗额外额度。具体看官方的套餐对照表。

模型回退链(Fallback)

主模型过载或不可用时,Claude Code 能自动切到备用模型,不至于直接报错挂掉。

命令行指定一个会话的回退链:

claude --fallback-model sonnet,haiku

主模型挂了先试 Sonnet,再不行试 Haiku。切换只持续当前轮次,下一条消息又会先试主模型。

想持久化,写进 settings.json

{
  "fallbackModel": ["claude-sonnet-5", "claude-haiku-4-5"]
}

链去重后最多保留三个模型,多了忽略。

Tip

回退只针对服务器过载/不可用这类情况。认证、计费、速率限制、请求太大这些错误不会触发回退,走正常的重试和报错流程。

限制能选哪些模型

企业管理员能用 availableModels 限制用户可选的模型:

{
  "availableModels": ["sonnet", "haiku"]
}

条目能匹配模型系列(sonnet)、版本前缀(claude-sonnet-4-5)或完整模型 ID。配了 enforceAvailableModels: true 后,连默认模型也得在这个列表里。

这是企业管控成本和合规的常用手段。个人用户一般用不上。

选模型的实战建议

不同活儿配不同模型,是省钱的精髓:

任务类型推荐配置
日常改 bug、写小功能sonnet + high 强度
架构设计、复杂重构、难题深挖opusopusplan + xhigh
跨多会话的大任务、长调查fable + high
批量重命名、格式化、简单查询haiku + low
一次性想让某轮想深点任意模型 + 提示里加 ultrathink
Tip

我自己的习惯:默认 sonnet 干日常,遇到难啃的骨头临时 /model opus 切过去,啃完再切回来。长任务用 fable 挂着,它能自己调查、自己验证,不用我老盯着。

小结

  • 别名opus/sonnet/haiku/fable/best/opusplan,加 [1m] 拿百万上下文
  • 切换/model 会话中切、--model 启动时切、settings.json 永久默认
  • 推理强度lowmax 五档加 ultracode/effort 调,环境变量优先级最高
  • 扩展思考Option+T/Alt+T 切,MAX_THINKING_TOKENS=0 关(Fable 5 除外),思考 token 要付费
  • 回退链--fallback-modelfallbackModel 设置,主模型挂了自动切备用
  • 限制availableModels 让管理员卡住可选范围

下一章讲环境变量—API Key、代理、超时这些怎么配。