模型配置
本教程共 34 篇 · 第 15 篇 · 更新于 2026-07-26 · 约 8 分钟阅读
15. 模型配置
本节目标:搞懂 Claude Code 怎么选模型、怎么切换、推理强度怎么调、扩展思考和百万上下文怎么用。学完你能为不同活儿配对模型,该省的省、该猛的猛。
先认清模型家族
Claude Code 背后是 Claude 系列模型。版本基准 v2.1.220 下,默认模型是 Claude Opus 5(从 v2.1.219 起成为默认 Opus 模型,支持 100 万 token 上下文)。
打个比方理解这几代模型的关系:
- Opus 系列:旗舰,复杂推理、架构设计、难题深挖的首选。贵但聪明。
- Sonnet 系列:日常编码主力,速度和智能平衡得好,性价比高。
- Haiku 系列:轻量快马,简单任务(改名、格式化、查个东西)用它最省。
- Fable 系列:顶配,能撑超长自主会话,适合跨多会话的大任务。不是默认,要手动选。
Note别名指向的版本会随时间更新。今天
opus别名解析到 Opus 5,过段时间出新版可能就解析到 Opus 6。想固定版本,用完整模型名(如claude-opus-5)或设环境变量ANTHROPIC_DEFAULT_OPUS_MODEL。
模型别名速查
不用记一长串版本号,Claude Code 给了一组别名:
| 别名 | 行为 |
|---|---|
default | 特殊值,清掉覆盖,回到你账户类型推荐的模型 |
best | 组织有权限就用 Fable 5,否则用最新 Opus |
fable | 用 Fable 5,专门啃最难最耗时的活 |
opus | 用最新 Opus,复杂推理任务 |
sonnet | 用最新 Sonnet,日常编码 |
haiku | 用 Haiku,简单任务图快图省 |
sonnet[1m] | Sonnet + 100 万 token 上下文 |
opus[1m] | Opus + 100 万 token 上下文 |
opusplan | 混合模式:Plan 阶段用 Opus,执行阶段切 Sonnet |
opusplan 这个挺有意思—规划时用 Opus 想清楚,写代码时切 Sonnet 干活,两全其美。
Tip别名解析到哪个具体版本,跟你的提供商有关。Anthropic API 上
opus解析到的版本通常最新;走 Amazon Bedrock、Google Cloud、Microsoft Foundry 这些企业渠道,可能解析到稍旧的版本。想要更新的,显式写完整模型名或设环境变量。
怎么选模型:四种方式
按优先级从高到低:
- 会话中切换:
/model <别名>立刻切,或/model不带参数打开选择器 - 启动时指定:
claude --model <别名>启动 - 环境变量:设
ANTHROPIC_MODEL=<别名> - 设置文件:
settings.json里写model字段,永久默认
# 用 Opus 启动
claude --model opus
# 会话中切到 Sonnet
/model sonnet
设置文件里这么写:
{
"model": "opus"
}
从 v2.1.153 起,/model 会把你的选择存进用户设置当默认值。选择器里:
Enter:切换并保存为默认s:只本次会话用,不保存
直接 /model sonnet 的效果跟 Enter 一样—既切又存。
Warning
--model标志和ANTHROPIC_MODEL环境变量只对本次会话生效。想在两个终端同时跑不同模型,各自用--model启动,别用/model切(/model会改全局默认,影响另一个终端)。
推理强度(Effort Level)
这是个省钱出活的关键配置。推理强度控制模型在每一步思考多少—低强度快而省,高强度深而准。
可用的级别(从低到高):
| 级别 | 何时用 |
|---|---|
low | 短期、范围小、对延迟敏感、不需要高智力的活 |
medium | 成本敏感,可以牺牲一点智能 |
high | 平衡,大多数编码任务的默认值 |
xhigh | 更深入推理,token 花得更多 |
max | 啃硬骨头可能有用,但容易过度思考,收益递减 |
ultracode | 特殊:发 xhigh + 为实质性任务编排动态工作流,仅限会话 |
Opus 5、Sonnet 5、Fable 5 这些新一代模型默认就是 high。Opus 4.7 默认 xhigh。
Note级别是按模型校准的,同名级别在不同模型里不代表相同基础值。
max和ultracode是仅限会话的,不能写进settings.json持久化(effortLevel设置只接受low/medium/high/xhigh)。
怎么调推理强度
/effort:不带参数开滑块,/effort high直接设,/effort auto重置为模型默认/model里:选模型时用左右箭头调滑块--effort标志:启动时传,如claude --effort xhigh- 环境变量:
CLAUDE_CODE_EFFORT_LEVEL设级别名或auto - 设置文件:
effortLevel字段 - 技能/子代理 frontmatter:写
effort字段,运行时覆盖
环境变量优先级最高,其次是你配的级别,最后是模型默认。
ultrathink:一次性深推理
不想改整个会话的强度,只想让这一轮想深一点?在提示里随便哪个位置加个词:
帮我看下这个并发 bug,ultrathink
Claude Code 识别 ultrathink 关键字,给这轮加深入推理指令,不改会话设置。注意只有 ultrathink 管用,“think”、“think hard” 这些不会被识别。
扩展思考(Extended Thinking)
扩展思考是模型回复前发出的推理过程。在新一代模型(Opus 5、Sonnet 5、Fable 5)上,推理强度是控制思考的主要方式;下面的设置管的是开关和显示。
| 控制 | 怎么设 |
|---|---|
| 当前会话开关 | macOS 按 Option+T,Windows/Linux 按 Alt+T |
| 全局默认 | /config 里切,存为 alwaysThinkingEnabled |
| 无论强度都关掉 | 设 MAX_THINKING_TOKENS=0(Fable 5 例外,关不掉) |
思考输出默认是折叠的。按 Ctrl+O 切详细模式,能看到灰色斜体的推理过程。
Warning思考 token 是要付费的,哪怕它被折叠或被编辑过。觉得贵就调低推理强度,或用
MAX_THINKING_TOKENS=0关掉(Fable 5 不行)。Fable 5 根据强度自己决定每步思考多少,关不掉。
百万上下文(1M Context)
Opus 5、Sonnet 5、Fable 5 这些新一代模型支持 100 万 token 的上下文窗口(Context Window),能塞下大型代码库的长会话。
怎么用:
- 显式选
opus[1m]或sonnet[1m]别名 - 在 Max、Team、Enterprise 订阅上,Opus 会自动升级到 1M 上下文,不用额外配置
Note1M 上下文的可用性跟模型和套餐都有关。Anthropic API 上 Opus 5、Sonnet 5、Fable 5 始终用 1M 跑。订阅套餐上有些模型需要消耗额外额度。具体看官方的套餐对照表。
模型回退链(Fallback)
主模型过载或不可用时,Claude Code 能自动切到备用模型,不至于直接报错挂掉。
命令行指定一个会话的回退链:
claude --fallback-model sonnet,haiku
主模型挂了先试 Sonnet,再不行试 Haiku。切换只持续当前轮次,下一条消息又会先试主模型。
想持久化,写进 settings.json:
{
"fallbackModel": ["claude-sonnet-5", "claude-haiku-4-5"]
}
链去重后最多保留三个模型,多了忽略。
Tip回退只针对服务器过载/不可用这类情况。认证、计费、速率限制、请求太大这些错误不会触发回退,走正常的重试和报错流程。
限制能选哪些模型
企业管理员能用 availableModels 限制用户可选的模型:
{
"availableModels": ["sonnet", "haiku"]
}
条目能匹配模型系列(sonnet)、版本前缀(claude-sonnet-4-5)或完整模型 ID。配了 enforceAvailableModels: true 后,连默认模型也得在这个列表里。
这是企业管控成本和合规的常用手段。个人用户一般用不上。
选模型的实战建议
不同活儿配不同模型,是省钱的精髓:
| 任务类型 | 推荐配置 |
|---|---|
| 日常改 bug、写小功能 | sonnet + high 强度 |
| 架构设计、复杂重构、难题深挖 | opus 或 opusplan + xhigh |
| 跨多会话的大任务、长调查 | fable + high |
| 批量重命名、格式化、简单查询 | haiku + low |
| 一次性想让某轮想深点 | 任意模型 + 提示里加 ultrathink |
Tip我自己的习惯:默认
sonnet干日常,遇到难啃的骨头临时/model opus切过去,啃完再切回来。长任务用fable挂着,它能自己调查、自己验证,不用我老盯着。
小结
- 别名:
opus/sonnet/haiku/fable/best/opusplan,加[1m]拿百万上下文 - 切换:
/model会话中切、--model启动时切、settings.json永久默认 - 推理强度:
low到max五档加ultracode,/effort调,环境变量优先级最高 - 扩展思考:
Option+T/Alt+T切,MAX_THINKING_TOKENS=0关(Fable 5 除外),思考 token 要付费 - 回退链:
--fallback-model或fallbackModel设置,主模型挂了自动切备用 - 限制:
availableModels让管理员卡住可选范围
下一章讲环境变量—API Key、代理、超时这些怎么配。