站长自营 API 中转

正在比较模型套餐?可以把多个 AI API 接到一个网关里

ZZSwitch 是我自己运营的统一 API 网关,适合需要国内支付、兑换码充值、多模型切换和 OpenAI 兼容接口的开发者。不是 OpenCode 官方服务。

Fast Mode 是 Opus 4.7(v2.1.142+ 默认)和 Opus 4.6 的高速配置,响应速度提升 2.5 倍,但 token 费用更高(输入 $30/MTok,输出 $150/MTok)。本质上不是换模型,而是同一个 Opus 换了优先速度的 API 配置——质量和能力完全相同。用 /fast 命令或设置文件 "fastMode": true 切换。适合快速迭代、实时调试;需要已开通使用额度,不支持第三方云(Bedrock/Vertex/Foundry),Team/Enterprise 需管理员明确启用。

Claude Code Fast Mode 怎么用:/fast 命令、成本和限流处理

Fast Mode 是 Claude Opus 的高速 API 配置,响应速度提升 2.5 倍,代价是更高的 token 费用。用 /fast 在需要速度时开启,不需要时关闭。

Fast Mode 不是换模型——使用的是同一个 Opus,只是 API 配置优先了速度而非成本效率。质量和能力与标准 Opus 完全相同,只是响应更快。支持 Opus 4.7 和 Opus 4.6,不支持 Sonnet、Haiku 或其他模型。

Fast Mode 是研究预览功能,功能、定价和可用性可能根据反馈调整。

需要 Claude Code v2.1.36 或更高版本。用 claude --version 查看版本。


怎么配置 Fast Mode:/fast 命令与设置文件

两种开启方式:

  • 输入 /fast 再按 Tab,切换开或关。(VS Code 扩展中也支持 /fast)
  • 在用户设置文件中写入 "fastMode": true

默认情况下,Fast Mode 跨会话保持启用状态。管理员可以配置为每次会话重置,见下文的「要求每次会话手动开启」。

最佳成本做法:在会话开始时启用 Fast Mode,而不是中途切换。见下文的「成本权衡」。

开启后会发生什么:

  • 如果当前不是 Opus,自动切换到 Opus
  • 显示确认消息:“Fast mode ON”
  • 提示符旁出现 ↯ 小图标
  • 随时运行 /fast 可查看当前 Fast Mode 状态

关闭 Fast Mode 后,你保留在 Opus 上,不会自动切回之前的模型。要切换模型,使用 /model。

固定到 Opus 4.6:Claude Code v2.1.142 及更高版本默认使用 Opus 4.7 作为 Fast Mode。要改用 Opus 4.6,设置环境变量 CLAUDE_CODE_OPUS_4_6_FAST_MODE_OVERRIDE=1。


成本权衡

Fast Mode 的每 token 价格高于标准 Opus:

模式 输入(每百万 token) 输出(每百万 token)
Fast Mode $30 $150

Fast Mode 定价在整个 100 万 token 上下文窗口内统一计算。

重要:如果在会话中途开启 Fast Mode,整个已有上下文都会按 Fast Mode 未缓存的输入 token 价格重新计费——这比从会话开始就启用要贵很多。建议在会话开始时就决定是否需要 Fast Mode,不要中途切换。


什么时候用 Fast Mode

适合:

  • 快速迭代代码变更
  • 实时调试会话
  • 时间紧迫的高压工作

更适合标准模式:

  • 长时间自主运行的任务(速度不是首要考虑)
  • 批处理或 CI/CD 管道
  • 注重成本控制的工作

Fast Mode 与降低推理力度

两者都影响响应速度,但效果不同:

设置 效果
Fast Mode 模型质量不变,延迟更低,费用更高
降低推理力度 减少思考时间,响应更快,但复杂任务质量可能下降

两者可以组合:Fast Mode + 低推理力度 = 极致速度,适合不需要深度思考的简单任务。


使用前提条件

Fast Mode 需要同时满足以下所有条件:

  • 不支持第三方云:不可用于 Amazon Bedrock、Google Vertex AI 或 Microsoft Azure Foundry。仅支持 Anthropic Console API 和订阅计划(Pro/Max/Team/Enterprise)的使用额度。
  • 开启使用额度:账号必须已开通使用额度(usage credits),允许超出套餐包含用量后继续计费。个人账号在 Console 账单设置 中开启;Team/Enterprise 需管理员为组织开启。
    • Fast Mode 直接消耗使用额度,即使你的套餐还有剩余用量。这意味着 Fast Mode token 不计入套餐包含用量,从第一个 token 开始就按 Fast Mode 费率计费。
  • Team/Enterprise 需管理员明确启用(默认关闭):Fast Mode 对 Team/Enterprise 组织默认关闭,管理员必须显式启用后用户才能使用。
    • 如果管理员未启用,运行 /fast 会提示 “Fast mode has been disabled by your organization.”

管理员如何启用

管理员可通过以下路径启用:

完全禁用 Fast Mode:设置环境变量 CLAUDE_CODE_DISABLE_FAST_MODE=1,详见环境变量。

要求每次会话手动开启

默认情况下,Fast Mode 跨会话持久保存。Team/Enterprise 管理员可以阻止这种行为,让每次会话从关闭状态开始,要求用户显式开启:

{
  "fastModePerSessionOptIn": true
}

在托管设置或服务端托管设置中配置。用户仍可通过 /fast 在需要时开启,但每次新会话都会重置。这有助于控制用户运行多个并发会话时的费用。用户的 Fast Mode 偏好仍然保存,移除该设置后会恢复默认的持久行为。


触发限流后的自动回退

Fast Mode 有独立的速率限制,与标准 Opus 不同。Opus 4.7 和 Opus 4.6 的 Fast Mode 共享同一限流池:使用任一模型都从同一个限制中扣除。

触发限流或使用额度耗尽后:

  1. 自动回退到标准速度
  2. ↯ 图标变灰,表示冷却中
  3. 继续以标准速度和标准费率工作
  4. 冷却期结束后,Fast Mode 自动重新开启

不想等冷却?运行 /fast 手动关闭。


研究预览说明

Fast Mode 是研究预览功能,这意味着:

  • 功能可能根据反馈调整
  • 可用性和定价可能变化
  • 底层 API 配置可能演进

通过你的 Anthropic 支持渠道报告问题或反馈。


相关文档

常见问题

Fast Mode 开启后模型质量会变吗?

不会。Fast Mode 使用的是同一个 Opus 模型(Opus 4.7 或 Opus 4.6),只是 API 配置优先了速度。质量、能力和标准 Opus 完全相同。

为什么不建议在会话中途开启 Fast Mode?

因为开启时整个已有上下文会按 Fast Mode 未缓存的输入价格重新计费,比从会话开始就启用要贵很多。建议在会话开始时决定是否需要 Fast Mode。

Fast Mode 触发限流后还能继续用 Claude Code 吗?

可以。触发限流后自动回退到标准速度继续工作,↯ 图标变灰表示冷却期,冷却结束后 Fast Mode 自动恢复。

Fast Mode 能用在第三方云平台吗?

不能。Amazon Bedrock、Google Vertex AI、Microsoft Azure Foundry 都不支持 Fast Mode。只能通过 Anthropic Console API 和 Claude 订阅计划使用额度使用。

站长自营 API 中转

ZZSwitch API 中转

统一接入多家模型,支持兑换码充值。

打开 ZZSwitch