21</h3>21</h3>
22 22
23<Note>23<Note>
24 `/usage` 中的 Session 块显示 API 令牌使用情况,适用于 API 用户。Claude Max 和 Pro 订阅者的使用情况包含在订阅中,因此会话成本数据与计费无关。订阅者在同一屏幕上看到计划使用条和活动统计以及使用情况明细。24 `/usage` 中的 Session 块显示 API 令牌使用情况,适用于 API 用户。Claude Max 和 Pro 订阅者的使用情况包含在订阅中,因此会话成本数据与计费无关。订阅者在同一屏幕上看到计划使用条、活动统计以及使用情况明细。
25</Note>25</Note>
26 26
27`/usage` 顶部的 Session 块显示当前会话的详细令牌使用统计。美元数字是从令牌计数本地计算的估计值,可能与您的实际账单不同。有关权威计费,请参阅 [Claude Console](https://platform.claude.com/usage) 中的使用情况页面。27`/usage` 顶部的 Session 块显示当前会话的详细令牌使用统计。Claude Code 从令牌计数本地计算美元数字,按列表价格计算,除非 [`modelPricing`](/docs/zh-CN/settings-reference#modelpricing) 表生效。管理员在您组织的托管设置中设置一个表,以便该数字使用您的合同费率,当表生效时,`Total cost` 行会带有注释 `at your organization's configured rates`。该数字是估计值,有关权威计费,请参阅 [Claude Console](https://platform.claude.com/usage) 中的使用情况页面。
28 28
29```text theme={null}29```text theme={null}
30Total cost: $0.5530Total cost: $0.55
31Total duration (API): 6m 19.7s31Total duration (API): 6m 20s
32Total duration (wall): 6h 33m 10.2s32Total duration (wall): 6h 33m 10s
33Total code changes: 0 lines added, 0 lines removed33Total code changes: 0 lines added, 0 lines removed
34Usage by model:
35 claude-sonnet-4-6: 1.2k input, 5.3k output, 940.0k cache read, 50.0k cache write ($0.55)
34```36```
35 37
36在 Pro、Max、Team 或 Enterprise 计划上,`/usage` 还显示计入您的计划限制的内容明细。它将最近的使用情况归属于 skills、subagents、plugins 和各个 MCP 服务器,每个都显示为总数的百分比。按 `d` 或 `w` 在过去 24 小时和过去 7 天之间切换。这些数据是近似值,从此机器上的本地会话历史记录计算,因此不包括来自其他设备或 claude.ai 的使用情况。38这些总计在 `/clear` 启动新会话时重置,因此下一个会话的总成本从 \$0 开始。在 v2.1.211 之前,它们在 `/clear` 后继续累积,直到 Claude Code 进程的生命周期结束。
37 39
38当您的计划限制请求失败时(通常是因为使用情况端点受到速率限制),`/usage` 会显示它在过去 60 分钟内在此机器上加载的最后一个使用情况条,以及一个 `Showing last-known usage` 注释,说明该数据是多久前获取的。按 `r` 重试;成功重试会用新数据替换最后已知的条。如果没有过去 60 分钟内的快照,`/usage` 会报告使用情况端点受到速率限制,并提供相同的重试快捷方式。在 v2.1.208 之前,在尚未加载使用情况的会话中受速率限制的请求始终显示错误,没有条。40对于以 1.1× [数据驻留费率](https://platform.claude.com/docs/en/about-claude/pricing#data-residency-pricing) 计费的 Claude API 响应,Claude Code 在会话成本数字中将该响应令牌的列表价格乘以 1.1。Claude Code 在[状态行的成本字段](/docs/zh-CN/statusline#cost-and-duration-tracking)中报告相同的总计,并将其与 [`--max-budget-usd`](/docs/zh-CN/cli-reference#cli-flags) 进行比较。在 v2.1.239 之前,Claude Code 没有对这些响应应用 1.1×,因此会话成本数字低于账单。
41
42<h4 id="prompt-cache-statistics">
43 Prompt cache 统计
44</h4>
45
46在主对话的第一个 API 响应之后,Claude Code 还会向 Session 块添加一个 `Prompt cache (main)` 行,总结会话的 [prompt cache](/docs/zh-CN/prompt-caching) 使用情况:请求计数、从缓存提供的输入令牌份额、缓存未命中,以及缓存现在是否处于热状态。需要 Claude Code v2.1.251 或更高版本。
47
48```text theme={null}
49Prompt cache (main): 14 requests · 91% of input tokens from cache · 2 misses (last 6m 10s ago, 310.2k tokens re-cached) · 1 expected rebuild (compaction or tool-result clearing) · warm (1h TTL, last activity 40s ago)
50```
51
52该行中的未命中、预期重建以及热或冷部分的含义如下:
53
54* **Misses(未命中)**:重新处理缓存已保存内容的请求,包括最后一次未命中的时间以及这些请求写回缓存的令牌数。当请求重新处理了超过 5% 且至少 2,000 个令牌的内容时,Claude Code 会将请求计为未命中,这些内容本可以从缓存中读取。[使缓存失效的操作](/docs/zh-CN/prompt-caching#actions-that-invalidate-the-cache)列出了常见原因。当 Claude Code 能够识别最后一次未命中的可能原因时,该行也会命名它,例如 `likely cause: tool definitions changed`。可能原因文本需要 Claude Code v2.1.260 或更高版本。
55* **Expected rebuilds(预期重建)**:当 Claude Code 本身刚刚重写对话时,通过[压缩](/docs/zh-CN/prompt-caching#compacting-the-conversation)或从上下文中清除旧工具结果,它会将相同类型的未命中计为预期重建。此部分仅在至少发生过一次预期重建后出现。
56* **Warm or cold(热或冷)**:缓存的前缀是否仍在其[缓存生命周期](/docs/zh-CN/prompt-caching#cache-lifetime)内,以及生效的 TTL。当缓存冷时,该行显示会话已空闲多长时间。当没有响应报告缓存令牌时,该行以 `no prompt caching reported by the API` 结尾。
57
58计数来自 API 响应中的缓存令牌字段,因此该行适用于每个提供商和网关。它仅覆盖主对话,不包括子代理。`/clear` 与 Session 块的其余部分一起重置它。
59
60状态行脚本可以从 [`prompt_cache` 对象](/docs/zh-CN/statusline#prompt-cache-fields)读取相同的数字。
61
62<h4 id="plan-usage-breakdown">
63 计划使用情况明细
64</h4>
65
66在 Pro、Max、Team 或 Enterprise 计划上,`/usage` 还显示计入您的计划限制的内容明细:
67
68* **Attribution(归属)**:最近使用情况归属于 skills、subagents、plugins 和各个 MCP 服务器,每个都显示为总数的百分比。MCP 服务器的份额仅计算消耗其工具结果之一的请求。在 v2.1.222 之前,在调用 MCP 服务器一次后,Claude Code 将每个后续请求归属于该服务器,高估了其份额。
69* **Behavior flags(行为标志)**:行为,例如长上下文或缓存未命中,当其占最近使用情况的 10% 或更多时标记。
70* **Loops(循环)**:最近运行的每个最重的 [`/loop` 或其他计划任务](/docs/zh-CN/scheduled-tasks) 的行,按总令牌排序,其余的计数。Claude Code 报告每个任务触发的频率、运行次数、其总令牌和每次运行令牌,以及最后一次运行的时间。Claude Code 通过任务的提示键入行,因此您停止并重新创建的循环保持为一行。需要 Claude Code v2.1.242 或更高版本。
71
72按 `d` 或 `w` 在过去 24 小时和过去 7 天之间切换。这些数据是近似值,从此机器上的本地会话历史记录计算,因此不包括来自其他设备或 claude.ai 的使用情况。
73
74在 [VS Code 扩展](/docs/zh-CN/vs-code#check-account-and-usage)中,归属份额和行为标志显示在"账户和使用情况"对话框中,带有"日"和"周"切换,不包括"循环"行。需要 Claude Code v2.1.174 或更高版本。
75
76<h4 id="check-your-usage-credits-spend">
77 检查您的使用额度支出
78</h4>
79
80`/usage` 还在[使用额度](#add-usage-credits-to-your-subscription)开启时显示使用额度行。该行显示的内容取决于您的计划:
81
82* **Pro 和 Max**:当前月份的支出,与您设置的每月支出限制进行比较(如果您设置了一个)。当您未设置限制时,该行显示 `Unlimited`,没有支出数字。
83* **Team 和 Enterprise**:当前月份的您自己的支出,与您的组织设置的任何[限制](#claude-for-teams-and-enterprise)进行比较,该限制适用于您。覆盖整个组织的限制不会出现在该行中。当您没有自己的限制时,该行显示您的支出,旁边没有限制。当使用额度对您关闭时,`/usage` 不显示使用额度行。
84
85当您有支出限制时,该行在使用额度开启后立即出现,并显示 0%,直到您首次支出使用额度。在 v2.1.236 之前,`/usage` 仅在 Pro 和 Max 计划上显示该行,带有支出限制的行在您支出某些内容之前保持隐藏。
86
87<h4 id="when-the-usage-request-fails">
88 当使用情况请求失败时
89</h4>
39 90
40在 [VS Code 扩展](/zh-CN/vs-code#check-account-and-usage) 中,相同的明细显示在"账户和使用情况"对话框中,带有"日"和"周"切换。需要 Claude Code v2.1.174 或更高版本。91当您的计划限制请求失败时(通常是因为使用情况端点受到速率限制),`/usage` 会显示它在过去 60 分钟内在此机器上加载的最后一个使用情况条,以及一个 `Showing last-known usage` 注释,说明该数据是多久前获取的。按 `r` 重试;成功重试会用新数据替换最后已知的条。如果没有过去 60 分钟内的快照,`/usage` 会报告使用情况端点受到速率限制,并提供相同的重试快捷方式。在 v2.1.208 之前,在尚未加载使用情况的会话中受速率限制的请求始终显示错误,没有条。
41 92
42<h3 id="set-a-spend-limit-on-pro-and-max">93<h3 id="analyze-your-usage-patterns">
43 在 Pro 和 Max 上设置支出限制94 分析您的使用情况模式
44</h3>95</h3>
45 96
46在 Pro 和 Max 计划上,`/usage-credits` 命令在 CLI 中打开一个对话框,您可以在其中管理 [使用额度](https://support.claude.com/en/articles/12429409-extra-usage-for-paid-claude-plans)。从对话框中,您可以:97运行 [`/insights`](/docs/zh-CN/commands#all-commands) 以获取关于您如何工作而不是您使用了多少令牌的报告。它分析此机器上的最近会话,并编写一份 HTML 报告,涵盖您处理的内容、摩擦点(例如误解的请求或有缺陷的代码)以及有关更有效地使用 Claude Code 的建议。单次运行分析最多 200 个它之前未见过的会话,并跳过非常短的会话。当会话被遗漏时,报告标题显示分析的计数,括号中显示总数,例如 `200 sessions (412 total)`。
98
99Claude Code 将最新报告写入 `~/.claude/usage-data/report.html`,并在同一目录中保存每次运行的时间戳副本,因此早期报告不会被覆盖。Claude Code 按与其余会话数据相同的计划删除报告:在启动时,它删除早于 [`cleanupPeriodDays`](/docs/zh-CN/claude-directory#cleaned-up-automatically) 的文件,默认为 30 天。
47 100
48* 为您的账户启用使用额度101您可以在任何计划和任何提供商上运行 `/insights`。分析通过与您的常规会话相同的提供商和账户运行,令牌计入您的计划或 API 使用情况。不包括来自其他设备和 claude.ai 的会话。
49* 购买更多使用额度,可以是列出的套餐或自定义金额
50* 设置、更改或移除您的每月支出限制
51* 配置自动重新加载,当您的余额低于您设置的阈值时自动购买更多使用额度
52 102
53在 Claude Code v2.1.207 之前的版本以及 CLI 内对话框不可用的账户上,`/usage-credits` 会在您的浏览器中打开使用额度计费页面。在 Team 和 Enterprise 计划上,具有计费访问权限的成员获得相同的浏览器页面,没有计费访问权限的成员从 CLI 发送请求,要求其管理员启用使用额度或提高限制。103<h3 id="add-usage-credits-to-your-subscription">
104 向您的订阅添加使用额度
105</h3>
106
107[使用额度](https://support.claude.com/en/articles/12429409-extra-usage-for-paid-claude-plans)让您可以在计划的使用限制之外继续工作。要管理它们,请在通过 `/login` 使用您的 claude.ai 订阅登录后运行 `/usage-credits`;该命令不适用于 API 密钥身份验证。在自助服务 Enterprise 组织、Enterprise 试用版和通过 AWS Marketplace 计费的 Enterprise 组织中,该命令需要 Claude Code v2.1.248 或更高版本;早期版本会以 [`Unknown command: /usage-credits`](/docs/zh-CN/errors#unknown-command) 拒绝它。它打开的内容取决于您的角色:
54 108
55更改每月支出限制需要账户的计费访问权限。如果您在仍有使用额度可用时达到该限制,Claude Code 会提示您提高或移除该限制,以便您可以继续使用而无需离开 CLI。109| 您的角色 | `/usage-credits` 的作用 |
110| :----------------------------- | :---------------------------------------------------------------------------------------------------------------------------------------- |
111| Pro 或 Max 订阅者 | 在浏览器中打开 claude.ai 上的 [**Settings > Usage**](https://claude.ai/settings/usage)。在其 **Usage credits** 部分中,您可以打开或关闭使用额度,并检查您的额度余额、本月支出和每月支出限制 |
112| 具有计费访问权限的 Team 或 Enterprise 成员 | 在浏览器中打开您的组织的使用情况设置 [**Admin settings > Usage**](https://claude.ai/admin-settings/usage) |
113| 没有计费访问权限的 Team 或 Enterprise 成员 | 要求您确认,然后向您的组织管理员发送请求。在 v2.1.211 之前,Claude Code 在没有确认步骤的情况下发送请求 |
56 114
57您输入到对话框中的金额,例如自定义购买金额、每月支出限制或自动重新加载阈值和目标,必须是数字,可选地后跟一个句号和一到两个小数位,例如 `20` 或 `20.50`。任何其他输入(包括逗号)都会显示内联错误,不会被保存。v2.1.207 之前的版本不显示对话框,而是打开计费页面。115对于没有计费访问权限的 Team 和 Enterprise 成员,确认仅在交互式会话中出现:在使用 `-p` 标志的非交互式模式和从[远程控制](/docs/zh-CN/remote-control)中,该命令不发送请求,并告诉您在交互式会话中运行它。
58 116
59Claude Code 要求您输入 `yes` 来确认每次购买和每次自动重新加载更改,无论金额多少,购买确认显示您批准的税后总额。更改每月支出限制仅在超过 \$1,000 或非美元计费货币的 1,000 个单位时要求相同的输入确认。在 v2.1.208 之前,购买和自动重新加载更改也使用该阈值,因此较小的金额通过标准对话框流程进行,没有额外的输入 `yes` 步骤。117如果您在早期请求等待管理员时再次运行 `/usage-credits`,Claude Code 会告诉您已经发送了请求,而不是发送重复请求。在管理员驳回您的请求后,再次运行该命令会发送新请求。在 v2.1.222 之前,被驳回的请求也会阻止新请求。
60 118
61金额字段打开时预填充建议值,您输入的第一个数字替换建议而不是追加到它。启用使用额度的屏幕打开时选中"取消",因此启用它需要刻意选择而不是误按 Enter。两者都需要 Claude Code v2.1.208 或更高版本。119在 Pro 和 Max 计划上,当您达到支出限制且仍有使用额度可用时,Claude Code 会提示您提高或移除限制,而无需离开 CLI。如果服务器拒绝更改,请参阅[无法更新您的支出限制](/docs/zh-CN/errors#could-not-update-your-spend-limit)。
62 120
63<h2 id="manage-costs-for-your-organization">121<h2 id="manage-costs-for-your-organization">
64 管理组织的成本122 管理组织的成本
66 124
67您对 Claude Code 的控制方式取决于您的组织如何访问 Claude Code:通过 Claude for Teams 或 Enterprise 计划、Claude Console 或云提供商。在 Teams 和 Enterprise 计划中,使用情况从每个成员的座位额度中扣除。在 Console 和云提供商上,使用情况按令牌计费到您的组织。如果您的组织混合使用登录方法,每个开发者将根据他们进行身份验证的方法进行计量。125您对 Claude Code 的控制方式取决于您的组织如何访问 Claude Code:通过 Claude for Teams 或 Enterprise 计划、Claude Console 或云提供商。在 Teams 和 Enterprise 计划中,使用情况从每个成员的座位额度中扣除。在 Console 和云提供商上,使用情况按令牌计费到您的组织。如果您的组织混合使用登录方法,每个开发者将根据他们进行身份验证的方法进行计量。
68 126
69该表将每种设置映射到您查看支出的位置、您限制支出的位置以及如何提取每用户数字。127该表将每种设置映射到您查看支出的位置、您限制支出的位置以及如何提取每用户数字。在个人 Pro 或 Max 计划中,您没有组织可管理,因此请跟踪您自己的使用额度支出,包括[快速模式](/docs/zh-CN/fast-mode#see-where-fast-mode-spend-appears),在[向您的订阅添加使用额度](#add-usage-credits-to-your-subscription)下。
70 128
71| 您的设置 | 查看支出 | 限制支出 | 每用户报告 |129| 您的设置 | 查看支出 | 限制支出 | 每用户报告 |
72| :----------------------------------------------------------------------------------- | :--------------------------------------------------------------------------------------------------------------- | :---------- | :--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |130| :----------------------------------------------------------------------------------- | :--------------------------------------------------------------------------------------------------------------- | :---------- | :--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
73| [Claude for Teams 或 Enterprise](#claude-for-teams-and-enterprise) | [组织分析中的支出报告](https://support.claude.com/en/articles/12883420-view-usage-analytics-for-team-and-enterprise-plans) | 管理员设置中的支出限制 | [支出报告 CSV](https://support.claude.com/en/articles/12883420-view-usage-analytics-for-team-and-enterprise-plans);Enterprise 上的 [Enterprise Analytics API](https://platform.claude.com/docs/en/api/admin/analytics) |131| [Claude for Teams 或 Enterprise](#claude-for-teams-and-enterprise) | [组织分析中的支出报告](https://support.claude.com/en/articles/12883420-view-usage-analytics-for-team-and-enterprise-plans) | 管理员设置中的支出限制 | [支出报告 CSV](https://support.claude.com/en/articles/12883420-view-usage-analytics-for-team-and-enterprise-plans);Enterprise 上的 [Enterprise Analytics API](https://platform.claude.com/docs/en/api/admin/analytics) |
74| [Claude Console (API)](#claude-console) | [Console 使用情况页面](https://platform.claude.com/usage) | 工作区支出限制 | [Console 仪表板](https://platform.claude.com/claude-code)、[Claude Code Analytics API](https://platform.claude.com/docs/en/build-with-claude/claude-code-analytics-api) |132| [Claude Console (API)](#claude-console) | [Console 使用情况页面](https://platform.claude.com/usage) | 工作区支出限制 | [Console 仪表板](https://platform.claude.com/claude-code)、[Claude Code Analytics API](https://platform.claude.com/docs/en/build-with-claude/claude-code-analytics-api) |
75| [Amazon Bedrock、Google Cloud 的 Agent Platform 或 Microsoft Foundry](#cloud-providers) | 您的云计费控制台 | 您的云预算控制 | [OpenTelemetry](/zh-CN/monitoring-usage) 或 [LLM gateway](/zh-CN/llm-gateway) |133| [Amazon Bedrock、Google Cloud 的 Agent Platform 或 Microsoft Foundry](#cloud-providers) | 您的云计费控制台 | 您的云预算控制 | [OpenTelemetry](/docs/zh-CN/monitoring-usage) 或 [LLM gateway](/docs/zh-CN/llm-gateway) |
134
135[OpenTelemetry 导出](/docs/zh-CN/monitoring-usage)适用于每种设置,是唯一能够以近实时方式将每用户令牌和成本指标流式传输到您自己的可观测性堆栈的选项。
136
137<h3 id="report-spend-at-your-contracted-rates">
138 按您的合同费率报告支出
139</h3>
140
141默认情况下,Claude Code 按列表价格计算它向开发者显示的每个成本数字,因此如果您的组织支付合同费率,`/usage`、状态行和 OpenTelemetry 中的数字与您的账单不匹配。为了使它们匹配,请将 [`modelPricing`](/docs/zh-CN/settings-reference#modelpricing) 托管设置设置为您的费率。该设置改变 Claude Code 报告的内容,而不是 Anthropic 收费的内容。需要 Claude Code v2.1.242 或更高版本。
142
143<Steps>
144 <Step title="从您的合同中获取费率">
145 输入您的合同中的每百万令牌费率。Claude Code 不会从 Claude Console 获取它们,因此在合同更改时更新设置。
146 </Step>
147
148 <Step title="编写设置">
149 为列表价格设置 `multiplier` 以获得固定百分比折扣,在 `overrides` 下列出每个模型的四个每令牌费率,或两者都做。[`modelPricing` 条目](/docs/zh-CN/settings-reference#modelpricing)具有形状和粘贴就用的示例。
150 </Step>
151
152 <Step title="通过托管设置部署它">
153 将其作为[托管设置](/docs/zh-CN/managed-settings)交付:服务器管理的设置、MDM 策略、`managed-settings.json` 或[策略助手](/docs/zh-CN/managed-settings#compute-the-policy-with-a-helper-program)。Claude Code 忽略用户、项目和本地设置以及 `--settings` 中的密钥。
154 </Step>
155</Steps>
76 156
77[OpenTelemetry 导出](/zh-CN/monitoring-usage)适用于每种设置,是唯一能够以近实时方式将每用户令牌和成本指标流式传输到您自己的可观测性堆栈的选项。157要确认费率生效,请在已[接收托管设置](/docs/zh-CN/managed-settings#read-the-source-in-%2Fstatus)的会话中运行 `/usage`:Session 块的 `Total cost` 行带有注释 `at your organization's configured rates`。这些数字仍然是估计值,而不是发票。`/model` 选择器中的每百万令牌价格保持在列表价格。
78 158
79<h3 id="claude-for-teams-and-enterprise">159<h3 id="claude-for-teams-and-enterprise">
80 Claude for Teams 和 Enterprise160 Claude for Teams 和 Enterprise
83在 Claude for Teams 和 Enterprise 计划中,每个成员的 Claude Code 使用情况从按座位额度中扣除,该额度在滚动五小时窗口和每周窗口上重置。该额度与 Claude chat 和 Cowork 共享,其大小取决于成员的[座位等级](https://support.claude.com/en/articles/11845131-use-claude-code-with-your-team-or-enterprise-plan)(Standard 或 Premium)。您的控制位于 claude.ai 管理控制台中,而不是 Claude Console。163在 Claude for Teams 和 Enterprise 计划中,每个成员的 Claude Code 使用情况从按座位额度中扣除,该额度在滚动五小时窗口和每周窗口上重置。该额度与 Claude chat 和 Cowork 共享,其大小取决于成员的[座位等级](https://support.claude.com/en/articles/11845131-use-claude-code-with-your-team-or-enterprise-plan)(Standard 或 Premium)。您的控制位于 claude.ai 管理控制台中,而不是 Claude Console。
84 164
85* **查看支出**:[组织分析中的支出报告](https://support.claude.com/en/articles/12883420-view-usage-analytics-for-team-and-enterprise-plans)显示每个用户和每个模型的估计支出,带有 CSV 导出,每日更新。该报告涵盖使用额度支出,并在启用使用额度后出现。座位额度内的使用情况不以美元计量。165* **查看支出**:[组织分析中的支出报告](https://support.claude.com/en/articles/12883420-view-usage-analytics-for-team-and-enterprise-plans)显示每个用户和每个模型的估计支出,带有 CSV 导出,每日更新。该报告涵盖使用额度支出,并在启用使用额度后出现。座位额度内的使用情况不以美元计量。
86* **查看采用情况**:[分析仪表板](https://claude.ai/analytics/claude-code)显示每日活跃用户、会话和贡献指标,带有贡献数据的 CSV 导出。请参阅[使用分析跟踪团队使用情况](/zh-CN/analytics)。166* **查看采用情况**:[分析仪表板](https://claude.ai/analytics/claude-code)显示每日活跃用户、会话和贡献指标,带有贡献数据的 CSV 导出。请参阅[使用分析跟踪团队使用情况](/docs/zh-CN/analytics)。
87* **限制支出**:座位额度是默认上限。要让成员继续超过它,请启用[使用额度](https://support.claude.com/en/articles/12429409-extra-usage-for-paid-claude-plans)并在组织、组或个人成员级别设置支出限制。167* **限制支出**:座位额度是默认上限。要让成员继续超过它,请启用[使用额度](https://support.claude.com/en/articles/12429409-extra-usage-for-paid-claude-plans)并在组织、组或个人成员级别设置支出限制。
88* **提取每用户数字**:在 Enterprise 计划中,[Enterprise Analytics API](https://platform.claude.com/docs/en/api/admin/analytics) 返回跨 Claude 表面(包括 Claude Code)的每用户使用情况和成本报告。主所有者在 [claude.ai/analytics/api-keys](https://claude.ai/analytics/api-keys) 处使用 `read:analytics` 范围创建密钥。在 Teams 计划中,导出[支出报告 CSV](https://support.claude.com/en/articles/12883420-view-usage-analytics-for-team-and-enterprise-plans),其中列出了每个用户和每个模型的令牌使用情况和估计支出。168* **提取每用户数字**:在 Enterprise 计划中,[Enterprise Analytics API](https://platform.claude.com/docs/en/api/admin/analytics) 返回跨 Claude 表面(包括 Claude Code)的每用户使用情况和成本报告。主所有者在 [claude.ai/analytics/api-keys](https://claude.ai/analytics/api-keys) 处使用 `read:analytics` 范围创建密钥。在 Teams 计划中,导出[支出报告 CSV](https://support.claude.com/en/articles/12883420-view-usage-analytics-for-team-and-enterprise-plans),其中列出了每个用户和每个模型的令牌使用情况和估计支出。
89 169
98<Note>178<Note>
99 当您首次使用 Claude Console 账户对 Claude Code 进行身份验证时,会自动为您创建一个名为"Claude Code"的工作区。此工作区为您的组织中的所有 Claude Code 使用情况提供集中式成本跟踪和管理。您无法为此工作区创建 API 密钥;它专门用于 Claude Code 身份验证和使用。179 当您首次使用 Claude Console 账户对 Claude Code 进行身份验证时,会自动为您创建一个名为"Claude Code"的工作区。此工作区为您的组织中的所有 Claude Code 使用情况提供集中式成本跟踪和管理。您无法为此工作区创建 API 密钥;它专门用于 Claude Code 身份验证和使用。
100 180
101 对于具有自定义速率限制的组织,此工作区中的 Claude Code 流量计入您的组织整体 API 速率限制。您可以在 Claude Console 的此工作区的 Limits 页面上设置[工作区速率限制](https://platform.claude.com/docs/zh-CN/api/rate-limits#setting-lower-limits-for-workspaces),以限制 Claude Code 的份额并保护其他生产工作负载。181 对于具有自定义速率限制的组织,此工作区中的 Claude Code 流量计入您的组织整体 API 速率限制。您可以在 Claude Console 的此工作区的 Limits 页面上设置[工作区速率限制](https://platform.claude.com/docs/en/api/rate-limits#setting-lower-limits-for-workspaces),以限制 Claude Code 的份额并保护其他生产工作负载。
102</Note>182</Note>
103 183
104对于每用户报告,[Console 仪表板](https://platform.claude.com/claude-code)显示每个成员的支出和接受的行数,[Claude Code Analytics API](https://platform.claude.com/docs/en/build-with-claude/claude-code-analytics-api)使用[管理员 API 密钥](https://platform.claude.com/settings/admin-keys)以编程方式返回相同的每日每用户指标。请参阅[API 客户的分析](/zh-CN/analytics#access-analytics-for-api-customers)。184对于每用户报告,[Console 仪表板](https://platform.claude.com/claude-code)显示每个成员的支出和接受的行数,[Claude Code Analytics API](https://platform.claude.com/docs/en/build-with-claude/claude-code-analytics-api)使用[管理员 API 密钥](https://platform.claude.com/settings/admin-keys)以编程方式返回相同的每日每用户指标。请参阅[API 客户的分析](/docs/zh-CN/analytics#access-analytics-for-api-customers)。
105 185
106<h4 id="rate-limit-recommendations">186<h4 id="rate-limit-recommendations">
107 速率限制建议187 速率限制建议
130 云提供商210 云提供商
131</h3>211</h3>
132 212
133在 Amazon Bedrock、Google Cloud 的 Agent Platform 和 Microsoft Foundry 上,Claude Code 按令牌计费到您的云账户,支出控制位于您的云提供商的计费控制台中。Claude Code 不会从您的云向 Anthropic 发送指标,因此[分析仪表板](/zh-CN/analytics)和 Claude Code Analytics API 不涵盖此使用情况。213在 Amazon Bedrock、Google Cloud 的 Agent Platform 和 Microsoft Foundry 上,Claude Code 按令牌计费到您的云账户,支出控制位于您的云提供商的计费控制台中。Claude Code 不会从您的云向 Anthropic 发送指标,因此[分析仪表板](/docs/zh-CN/analytics)和 Claude Code Analytics API 不涵盖此使用情况。
134 214
135对于每用户成本归因,您有三个选项:215对于每用户成本归因,您有三个选项:
136 216
137* **OpenTelemetry**:[导出指标](/zh-CN/monitoring-usage)从每个开发者的机器到您自己的可观测性堆栈。这为您提供每用户令牌计数、成本和工具活动,无论提供商如何。217* **OpenTelemetry**:[导出指标](/docs/zh-CN/monitoring-usage)从每个开发者的机器到您自己的可观测性堆栈。这为您提供每用户令牌计数、成本和工具活动,无论提供商如何。
138* **Claude apps gateway**:自托管的 [Claude apps gateway](/zh-CN/claude-apps-gateway)提供每用户使用情况归因、带有令牌计数的 OTLP 指标,以及这些提供商上的[每用户支出限制](/zh-CN/claude-apps-gateway-spend-limits)。218* **Claude apps gateway**:自托管的 [Claude apps gateway](/docs/zh-CN/claude-apps-gateway)提供每用户使用情况归因、带有令牌计数的 OTLP 指标,以及这些提供商上的[每用户支出限制](/docs/zh-CN/claude-apps-gateway-spend-limits)。
139* **LLM gateway**:通过代理路由所有 Claude Code 流量,该代理按密钥跟踪支出。几个大型企业报告使用[LiteLLM](/zh-CN/llm-gateway),一个开源工具,可以[按密钥跟踪支出](https://docs.litellm.ai/docs/proxy/virtual_keys#tracking-spend)。此项目与 Anthropic 无关,尚未进行安全审计。219* **LLM gateway**:通过代理路由所有 Claude Code 流量,该代理按密钥跟踪支出。几个大型企业报告使用[LiteLLM](/docs/zh-CN/llm-gateway),一个开源工具,可以[按密钥跟踪支出](https://docs.litellm.ai/docs/proxy/virtual_keys#tracking-spend)。此项目与 Anthropic 无关,尚未进行安全审计。
140 220
141<h3 id="when-a-developer-asks-about-a-limit">221<h3 id="when-a-developer-asks-about-a-limit">
142 当开发者询问限制时222 当开发者询问限制时
143</h3>223</h3>
144 224
145开发者通常会向他们的管理员提出限制问题,因此了解他们遇到的上限会很有帮助。这三种情况意味着不同的事情:225开发者通常会向他们的管理员提出限制问题,因此了解他们遇到的上限会很有帮助。这四种情况意味着不同的事情:
146 226
147* **"您已达到会话限制"或"您已达到每周限制"**:订阅计划上基于座位的使用窗口。这些窗口在所有模型中共享,因此使用 `/model` 切换模型不会恢复访问权限,尽管在模型特定的"您已达到 Opus 限制"消息之后它确实让开发者继续工作。该消息显示窗口何时重置,开发者可以运行 `/usage-credits` 来请求超过额度的使用情况(如果您已启用[使用额度](https://support.claude.com/en/articles/12429409-extra-usage-for-paid-claude-plans))。请参阅[使用限制错误](/zh-CN/errors#youve-hit-your-session-limit)。227* **"您已达到会话限制"或"您已达到每周限制"**:订阅计划上基于座位的使用窗口,在所有模型中共享,因此开发者无法通过使用 `/model` 切换模型来恢复访问权限。该消息显示窗口何时重置。在模型特定的"您已达到 Opus 限制"或"您已达到 Sonnet 限制"消息之后,使用 `/model` 切换到该系列之外的模型确实会让开发者继续工作。请参阅[使用限制错误](/docs/zh-CN/errors#youve-hit-your-session-limit)。开发者在此期间可以做什么:
148* **上下文或自动压缩警告**:不是使用限制。对话已接近模型的最大输入大小,Claude Code 总结较早的历史以释放空间。将开发者指向[减少令牌使用](#reduce-token-usage)。228 * 运行 `/usage-credits` 以请求超过额度的使用情况,如果您已启用[使用额度](https://support.claude.com/en/articles/12429409-extra-usage-for-paid-claude-plans)。
229 * 在 Claude Code v2.1.234 或更高版本上,[在重置后自动等待并继续中断的任务](/docs/zh-CN/interactive-mode#wait-for-a-usage-limit-to-reset);该部分列出了 Claude Code 何时自动启动等待以及开发者何时从 `/rate-limit-options` 中选择它。要控制您的车队 Claude Code 是否自动启动该等待,请在[托管设置](/docs/zh-CN/settings#settings-precedence)中设置 [`autoContinueAtUsageLimit`](/docs/zh-CN/settings-reference#autocontinueatusagelimit)。
230* **来自 [Claude apps gateway](/docs/zh-CN/claude-apps-gateway) 的支出限制消息**:开发者超过了您在自托管网关上设置的支出上限,网关会阻止他们的请求,直到该期间重置或您提高上限。请参阅[网关支出限制](/docs/zh-CN/claude-apps-gateway-spend-limits)以了解上限、重置计划和开发者看到的消息。
231* **上下文或自动压缩警告**:不是使用限制。对话已接近会话的[自动压缩窗口](/docs/zh-CN/model-config#set-the-auto-compact-window),这是 Claude Code 总结较早历史以释放空间的阈值。将开发者指向[减少令牌使用](#reduce-token-usage)。
149* **API 或云提供商计划上的意外高支出**:通常可以追溯到从未清除的长会话或将 Opus 作为默认模型。要分享的最高影响习惯是在不相关的任务之间清除和将模型与工作相匹配,两者都在[减少令牌使用](#reduce-token-usage)中涵盖。232* **API 或云提供商计划上的意外高支出**:通常可以追溯到从未清除的长会话或将 Opus 作为默认模型。要分享的最高影响习惯是在不相关的任务之间清除和将模型与工作相匹配,两者都在[减少令牌使用](#reduce-token-usage)中涵盖。
150 233
151<h3 id="agent-team-token-costs">234<h3 id="agent-team-token-costs">
152 Agent 团队令牌成本235 Agent 团队令牌成本
153</h3>236</h3>
154 237
155[Agent 团队](/zh-CN/agent-teams)生成多个 Claude Code 实例,每个实例都有自己的上下文窗口。令牌使用情况随活跃队友的数量和每个队友运行的时间长度而扩展。238[Agent 团队](/docs/zh-CN/agent-teams)生成多个 Claude Code 实例,每个实例都有自己的上下文窗口。令牌使用情况随活跃队友的数量和每个队友运行的时间长度而扩展。
156 239
157为了保持 agent 团队成本可控:240为了保持 agent 团队成本可控:
158 241
160* 保持团队规模小。每个队友运行自己的上下文窗口,因此令牌使用大致与团队规模成正比。243* 保持团队规模小。每个队友运行自己的上下文窗口,因此令牌使用大致与团队规模成正比。
161* 保持生成提示的重点。队友会自动加载 CLAUDE.md、MCP servers 和 skills,但生成提示中的所有内容都会从一开始就添加到其上下文中。244* 保持生成提示的重点。队友会自动加载 CLAUDE.md、MCP servers 和 skills,但生成提示中的所有内容都会从一开始就添加到其上下文中。
162* 工作完成后关闭队友。每个活跃的队友会继续消耗令牌,直到它退出或会话结束。245* 工作完成后关闭队友。每个活跃的队友会继续消耗令牌,直到它退出或会话结束。
163* Agent 团队默认被禁用。在您的[settings.json](/zh-CN/settings)或环境中设置 `CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1` 以启用它们。请参阅[启用 agent 团队](/zh-CN/agent-teams#enable-agent-teams)。246* Agent 团队默认被禁用。在您的[settings.json](/docs/zh-CN/settings)或环境中设置 `CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1` 以启用它们。请参阅[启用 agent 团队](/docs/zh-CN/agent-teams#enable-agent-teams)。
164 247
165<h2 id="reduce-token-usage">248<h2 id="reduce-token-usage">
166 减少令牌使用249 减少令牌使用
167</h2>250</h2>
168 251
169令牌成本随上下文大小而扩展:Claude 处理的上下文越多,您使用的令牌就越多。Claude Code 通过 [prompt caching](/zh-CN/prompt-caching)(减少重复内容(如系统提示)的成本)和 auto-compact(在接近上下文限制时总结对话历史)自动优化成本。252令牌成本随上下文大小而扩展:Claude 处理的上下文越多,您使用的令牌就越多。Claude Code 通过 [prompt caching](/docs/zh-CN/prompt-caching)(减少重复内容(如系统提示)的成本)和 auto-compact(在接近上下文限制时总结对话历史)自动优化成本。
170 253
171以下策略可帮助您保持上下文较小并降低每条消息的成本。254以下策略可帮助您保持上下文较小并降低每条消息的成本。
172 255
174 主动管理上下文257 主动管理上下文
175</h3>258</h3>
176 259
177使用 `/usage` 检查您当前的令牌使用情况,或[配置您的状态行](/zh-CN/statusline#context-window-usage)以连续显示它。260使用 `/usage` 检查您当前的令牌使用情况,或[配置您的状态行](/docs/zh-CN/statusline#context-window-usage)以连续显示它。
178 261
179* **在任务之间清除**:使用 `/clear` 在切换到不相关的工作时重新开始。陈旧的上下文会在随后的每条消息上浪费令牌。在清除之前使用 `/rename` 以便您稍后可以轻松找到会话,然后使用 `/resume` 返回到它。262* **在任务之间清除**:使用 `/clear` 在切换到不相关的工作时重新开始。陈旧的上下文会在随后的每条消息上浪费令牌。在清除之前使用 `/rename` 以便您稍后可以轻松找到会话,然后使用 `/resume` 返回到它。
180* **添加自定义 compaction 指令**:`/compact Focus on code samples and API usage` 告诉 Claude 在总结期间保留什么。263* **添加自定义 compaction 指令**:`/compact Focus on code samples and API usage` 告诉 Claude 在总结期间保留什么。在新会话中,`/compact` 打印 `Not enough messages to compact.`,因为还没有对话历史可以总结。
181 264
182您还可以在项目根目录的 CLAUDE.md 文件中自定义 compaction 行为:265您还可以在项目根目录的 CLAUDE.md 文件中自定义 compaction 行为:
183 266
191 选择正确的模型274 选择正确的模型
192</h3>275</h3>
193 276
194Sonnet 处理大多数编码任务效果很好,成本低于 Opus。为复杂的架构决策或多步推理保留 Opus。使用 `/model` 在会话中途切换模型,或在 `/config` 中设置默认值。对于简单的 subagent 任务,在您的 [subagent 配置](/zh-CN/sub-agents#choose-a-model)中指定 `model: haiku`。277Sonnet 处理大多数编码任务效果很好,成本低于 Opus。为复杂的架构决策或多步推理保留 Opus。使用 `/model` 在会话中途切换模型,或在 `/config` 中设置默认值。对于简单的 subagent 任务,在您的 [subagent 配置](/docs/zh-CN/sub-agents#choose-a-model)中指定 `model: haiku`。
195 278
196<h3 id="reduce-mcp-server-overhead">279<h3 id="reduce-mcp-server-overhead">
197 减少 MCP server 开销280 减少 MCP server 开销
198</h3>281</h3>
199 282
200MCP 工具定义[默认被延迟](/zh-CN/mcp#scale-with-mcp-tool-search),因此只有工具名称进入上下文,直到 Claude 使用特定工具。运行 `/context` 查看占用空间的内容。283MCP 工具定义[默认被延迟](/docs/zh-CN/mcp#scale-with-mcp-tool-search),因此只有工具名称和服务器指令进入上下文,直到 Claude 使用特定工具。运行 `/context` 查看占用空间的内容。
201 284
202* **在可用时优先使用 CLI 工具**:`gh`、`aws`、`gcloud` 和 `sentry-cli` 等工具比 MCP servers 更节省上下文,因为它们不添加任何每工具列表。Claude 可以直接运行 CLI 命令。285* **在可用时优先使用 CLI 工具**:`gh`、`aws`、`gcloud` 和 `sentry-cli` 等工具比 MCP servers 更节省上下文,因为它们不添加任何每工具列表。Claude 可以直接运行 CLI 命令。
203* **禁用未使用的 servers**:运行 `/mcp` 查看配置的 servers 并禁用您未积极使用的任何 servers。286* **禁用未使用的 servers**:运行 `/mcp` 查看配置的 servers 并禁用您未积极使用的任何 servers。
206 为类型化语言安装代码智能插件289 为类型化语言安装代码智能插件
207</h3>290</h3>
208 291
209[代码智能插件](/zh-CN/discover-plugins#code-intelligence)为 Claude 提供精确的符号导航,而不是基于文本的搜索,减少在探索不熟悉的代码时不必要的文件读取。单个"转到定义"调用替代了可能需要的 grep 后跟读取多个候选文件。已安装的语言服务器还会在编辑后自动报告类型错误,因此 Claude 无需运行编译器即可捕获错误。292[代码智能插件](/docs/zh-CN/discover-plugins#code-intelligence)为 Claude 提供精确的符号导航,而不是基于文本的搜索,减少在探索不熟悉的代码时不必要的文件读取。单个"转到定义"调用替代了可能需要的 grep 后跟读取多个候选文件。已安装的语言服务器还会在编辑后自动报告类型错误,因此 Claude 无需运行编译器即可捕获错误。
210 293
211<h3 id="offload-processing-to-hooks-and-skills">294<h3 id="offload-processing-to-hooks-and-skills">
212 将处理卸载到 hooks 和 skills295 将处理卸载到 hooks 和 skills
213</h3>296</h3>
214 297
215自定义 [hooks](/zh-CN/hooks)可以在 Claude 看到数据之前对其进行预处理。Claude 不是读取 10,000 行日志文件来查找错误,hook 可以 grep `ERROR` 并仅返回匹配的行,将上下文从数万个令牌减少到数百个。298自定义 [hooks](/docs/zh-CN/hooks)可以在 Claude 看到数据之前对其进行预处理。Claude 不是读取 10,000 行日志文件来查找错误,hook 可以 grep `ERROR` 并仅返回匹配的行,将上下文从数万个令牌减少到数百个。
216 299
217[skill](/zh-CN/skills)可以为 Claude 提供领域知识,这样它就不必进行探索。例如,"codebase-overview" skill 可以描述您的项目架构、关键目录和命名约定。当 Claude 调用该 skill 时,它会立即获得此上下文,而不是花费令牌读取多个文件来理解结构。300[skill](/docs/zh-CN/skills)可以为 Claude 提供领域知识,这样它就不必进行探索。例如,"codebase-overview" skill 可以描述您的项目架构、关键目录和命名约定。当 Claude 调用该 skill 时,它会立即获得此上下文,而不是花费令牌读取多个文件来理解结构。
218 301
219例如,此 PreToolUse hook 过滤测试输出以仅显示失败:302例如,此 PreToolUse hook 过滤测试输出以仅显示失败:
220 303
221<Tabs>304<Tabs>
222 <Tab title="settings.json">305 <Tab title="settings.json">
223 将此添加到您的 [settings.json](/zh-CN/settings#settings-files)以在每个 Bash 命令之前运行 hook:306 将此添加到您的 [settings.json](/docs/zh-CN/settings#where-settings-live)以在每个 Bash 命令之前运行 hook:
224 307
225 ```json theme={null}308 ```json theme={null}
226 {309 {
252 # If running tests, filter to show only failures335 # If running tests, filter to show only failures
253 if [[ "$cmd" =~ ^(npm test|pytest|go test) ]]; then336 if [[ "$cmd" =~ ^(npm test|pytest|go test) ]]; then
254 filtered_cmd="$cmd 2>&1 | grep -A 5 -E '(FAIL|ERROR|error:)' | head -100"337 filtered_cmd="$cmd 2>&1 | grep -A 5 -E '(FAIL|ERROR|error:)' | head -100"
255 echo "{\"hookSpecificOutput\":{\"hookEventName\":\"PreToolUse\",\"permissionDecision\":\"allow\",\"updatedInput\":{\"command\":\"$filtered_cmd\"}}}"338 echo "$input" | jq --arg filtered "$filtered_cmd" \
339 '{hookSpecificOutput: {hookEventName: "PreToolUse", permissionDecision: "allow", updatedInput: (.tool_input + {command: $filtered})}}'
256 else340 else
257 echo "{}"341 echo "{}"
258 fi342 fi
260 </Tab>344 </Tab>
261</Tabs>345</Tabs>
262 346
347要验证设置,运行 `/hooks` 并检查 hook 是否出现在 PreToolUse 下。您也可以使用 `claude --debug-file ./claude-debug.txt` 启动 Claude Code 并要求 Claude 运行 `npm test`。当 hook 重写命令时,该日志文件包含一个 `modified tool input keys` 行,列出 `command` 和其他 Bash 输入字段。
348
263<h3 id="move-instructions-from-claude-md-to-skills">349<h3 id="move-instructions-from-claude-md-to-skills">
264 将指令从 CLAUDE.md 移动到 skills350 将指令从 CLAUDE.md 移动到 skills
265</h3>351</h3>
266 352
267您的 [CLAUDE.md](/zh-CN/memory)文件在会话开始时加载到上下文中。如果它包含特定工作流的详细指令(如 PR 审查或数据库迁移),即使您在做不相关的工作时,这些令牌也会存在。[Skills](/zh-CN/skills)仅在调用时按需加载,因此将专门指令移动到 skills 中可以保持您的基础上下文较小。目标是通过仅包含必要内容来将 CLAUDE.md 保持在 200 行以下。353您的 [CLAUDE.md](/docs/zh-CN/memory)文件在会话开始时加载到上下文中。如果它包含特定工作流的详细指令(如 PR 审查或数据库迁移),即使您在做不相关的工作时,这些令牌也会存在。[Skills](/docs/zh-CN/skills)仅在调用时按需加载,因此将专门指令移动到 skills 中可以保持您的基础上下文较小。目标是通过仅包含必要内容来将 CLAUDE.md 保持在 200 行以下。
268 354
269<h3 id="adjust-extended-thinking">355<h3 id="adjust-extended-thinking">
270 调整扩展思考356 调整扩展思考
271</h3>357</h3>
272 358
273扩展思考默认启用,因为它显著改进了复杂规划和推理任务的性能。思考令牌作为输出令牌计费,默认预算可能是每个请求数万个令牌,具体取决于模型。对于不需要深度推理的更简单任务,您可以通过在 `/effort` 中或在 `/model` 中降低 [effort level](/zh-CN/model-config#adjust-effort-level)、在 `/config` 中禁用思考或在具有[固定思考预算](/zh-CN/model-config#adaptive-reasoning-and-fixed-thinking-budgets)的模型上通过设置 `MAX_THINKING_TOKENS` [环境变量](/zh-CN/env-vars)(例如 `MAX_THINKING_TOKENS=8000`)来降低预算来降低成本。自适应推理模型忽略非零预算,因此请改用 effort levels。Fable 5 上不提供禁用思考,它始终使用扩展思考。359扩展思考默认启用,因为它显著改进了复杂规划和推理任务的性能。思考令牌作为输出令牌计费,默认预算可能是每个请求数万个令牌,具体取决于模型。
360
361对于不需要深度推理的更简单任务,您可以通过在 `/effort` 中或在 `/model` 中降低 [effort level](/docs/zh-CN/model-config#adjust-effort-level)、或在 `/config` 中禁用思考来降低成本。您无法在 Fable 模型上关闭思考,它们始终使用扩展思考。
362
363在具有[固定思考预算](/docs/zh-CN/model-config#adaptive-reasoning-and-fixed-thinking-budgets)的模型上,您也可以通过设置 `MAX_THINKING_TOKENS` [环境变量](/docs/zh-CN/env-vars)(例如 `MAX_THINKING_TOKENS=8000`)来降低预算。自适应推理模型忽略非零预算,因此请改用 effort levels。
274 364
275<h3 id="delegate-verbose-operations-to-subagents">365<h3 id="delegate-verbose-operations-to-subagents">
276 将冗长的操作委托给 subagents366 将冗长的操作委托给 subagents
277</h3>367</h3>
278 368
279运行测试、获取文档或处理日志文件可能会消耗大量上下文。将这些委托给 [subagents](/zh-CN/sub-agents#isolate-high-volume-operations),以便冗长的输出保留在 subagent 的上下文中,而只有摘要返回到您的主对话。369运行测试、获取文档或处理日志文件可能会消耗大量上下文。将这些委托给 [subagents](/docs/zh-CN/sub-agents#isolate-high-volume-operations),以便冗长的输出保留在 subagent 的上下文中,而只有摘要返回到您的主对话。
280 370
281<h3 id="manage-agent-team-costs">371<h3 id="manage-agent-team-costs">
282 管理 agent 团队成本372 管理 agent 团队成本
283</h3>373</h3>
284 374
285当队友在 plan mode 中运行时,Agent 团队使用的令牌大约是标准会话的 7 倍,因为每个队友维护自己的上下文窗口并作为单独的 Claude 实例运行。保持团队任务小且独立,以限制每个队友的令牌使用。有关详细信息,请参阅 [agent 团队](/zh-CN/agent-teams)。375当队友在 plan mode 中运行时,Agent 团队使用的令牌大约是标准会话的 7 倍,因为每个队友维护自己的上下文窗口并作为单独的 Claude 实例运行。保持团队任务小且独立,以限制每个队友的令牌使用。有关详细信息,请参阅 [agent 团队](/docs/zh-CN/agent-teams)。
286 376
287<h3 id="write-specific-prompts">377<h3 id="write-specific-prompts">
288 编写具体的提示378 编写具体的提示
296 386
297对于较长或更复杂的工作,这些习惯有助于避免因走错路而浪费的令牌:387对于较长或更复杂的工作,这些习惯有助于避免因走错路而浪费的令牌:
298 388
299* **对复杂任务使用 plan mode**:按 Shift+Tab 进入 [plan mode](/zh-CN/permission-modes#analyze-before-you-edit-with-plan-mode),然后再进行实现。Claude 探索代码库并提出一个方法供您批准,防止当初始方向错误时的昂贵返工。389* **对复杂任务使用 plan mode**:按 Shift+Tab 进入 [plan mode](/docs/zh-CN/permission-modes#analyze-before-you-edit-with-plan-mode),然后再进行实现。Claude 探索代码库并提出一个方法供您批准,防止当初始方向错误时的昂贵返工。
300* **尽早纠正方向**:如果 Claude 开始朝错误的方向发展,按 Escape 立即停止。使用 `/rewind` 或双击 Escape 将对话和代码恢复到之前的 checkpoint。390* **尽早纠正方向**:如果 Claude 开始朝错误的方向发展,按 Escape 立即停止。使用 `/rewind` 或双击 Escape 将对话和代码恢复到之前的 checkpoint。
301* **给出验证目标**:在您的提示中包含测试用例、粘贴屏幕截图或定义预期输出。当 Claude 可以验证自己的工作时,它会在您需要请求修复之前捕获问题。391* **给出验证目标**:在您的提示中包含测试用例、粘贴屏幕截图或定义预期输出。当 Claude 可以验证自己的工作时,它会在您需要请求修复之前捕获问题。
302* **增量测试**:编写一个文件,测试它,然后继续。这会在问题便宜时尽早捕获问题。392* **增量测试**:编写一个文件,测试它,然后继续。这会在问题便宜时尽早捕获问题。
312 402
313这些后台进程即使没有活跃交互也会消耗少量令牌(通常每个会话不到 \$0.04)。403这些后台进程即使没有活跃交互也会消耗少量令牌(通常每个会话不到 \$0.04)。
314 404
405<h2 id="why-usage-climbs-in-a-long-session">
406 为什么长时间会话中使用量会增加
407</h2>
408
409一个已经打开数小时的会话可能会使用远超你的活动量所暗示的计划限额,通常是由于以下原因之一:
410
411* **长上下文**:Claude Code 在每个请求中发送你与它的完整对话,每当 Claude 使用工具时,它会发送另一个请求,其中包含该批工具结果。使用 [prompt caching](/docs/zh-CN/prompt-caching),Claude Code 以 [缓存令牌速率](https://platform.claude.com/docs/en/about-claude/pricing) 重新读取该历史记录,因此即使在已打开一整天的会话中提出一行问题,仍然会为整个对话消耗使用量。请参阅 [主动管理上下文](#manage-context-proactively) 了解保持上下文较小的方法
412* **缓存未命中**:在超过 [缓存生命周期](/docs/zh-CN/prompt-caching#cache-lifetime) 的中断后的第一条消息会错过缓存并重新处理你的完整上下文。在订阅上生命周期为一小时,一旦你开始使用 [使用额度](https://support.claude.com/en/articles/12429409-extra-usage-for-paid-claude-plans),生命周期会降至五分钟;在 API 密钥或云提供商上,默认为五分钟。要在使用使用额度时保持一小时的生命周期,[自己选择 TTL](/docs/zh-CN/prompt-caching#choose-the-ttl-yourself)。在 Pro 和 Max 计划上,当你在长时间中断后恢复大型会话时,Claude Code [提供从摘要恢复](/docs/zh-CN/sessions#resume-from-a-summary) 的选项,以便后续请求不会携带完整历史记录
413* **计划任务**:[计划任务](/docs/zh-CN/scheduled-tasks) 按其间隔触发,即使会话处于空闲状态,每次都发送你的完整上下文
414* **跨会话消息**:当此会话处于空闲状态时,Claude Code 将 [来自你另一个会话的消息](/docs/zh-CN/cross-session-messaging) 作为新轮次传递,每次都发送你的完整上下文。要保留入站消息而不是传递它们,请将 [`crossSessionInbound`](/docs/zh-CN/settings-reference#crosssessioninbound) 设置为 `hold`
415* **目标检查**:当后台工作使活跃的 [目标](/docs/zh-CN/goal) 保持等待时,Claude Code [要求 Claude 检查该工作](/docs/zh-CN/goal#background-work-defers-evaluation),即使会话处于空闲状态,启动发送你完整上下文的新轮次。Claude Code 在你的提示之间每个目标最多启动三个空闲检查。在 v2.1.246 之前,空闲检查是无限制的。要关闭检查,请将 [`CLAUDE_CODE_GOAL_CHECKIN_MINUTES`](/docs/zh-CN/env-vars) 设置为 `0`。空闲检查需要 Claude Code v2.1.236 或更高版本
416* **代理队友**:每个活跃的 [队友](#agent-team-token-costs) 会继续消耗令牌,直到它退出
417* **压缩**:`/compact` 读取它总结的对话,因此 [压缩大型上下文](/docs/zh-CN/prompt-caching#compacting-the-conversation) 本身就是一个大型请求。当你想要全新开始而不是连续性时,`/clear` 不消耗任何成本
418
419在 Pro、Max、Team 或 Enterprise 计划上,`/usage` 分解会标记占你最近使用量 10% 或更多的行为,例如长上下文或缓存未命中,每个都附带减少它的提示。
420
315<h2 id="understanding-changes-in-claude-code-behavior">421<h2 id="understanding-changes-in-claude-code-behavior">
316 了解 Claude Code 行为的变化422 了解 Claude Code 行为的变化
317</h2>423</h2>
318 424
319Claude Code 定期接收可能改变功能工作方式的更新,包括成本报告。运行 `claude --version` 检查您的当前版本。如有具体计费问题,请通过您的[Console 账户](https://platform.claude.com/login)联系 Anthropic 支持。425Claude Code 定期接收更新,这些更新可能会改变功能的工作方式,包括成本报告。运行 `claude --version` 来检查您当前的版本。
426
427有关您特定账户的计费问题,请通过产品内信使联系 Anthropic 支持:
428
429* **订阅计划**(Pro、Max、Team、Enterprise):在 [claude.ai](https://claude.ai) 登录,点击左下角的您的首字母缩写,然后选择**获取帮助**
430* **Console(API)计费**:在 [platform.claude.com](https://platform.claude.com) 登录,点击您的首字母缩写,然后选择**获取帮助**
431
432请参阅[如何获取支持](https://support.claude.com/en/articles/9015913-how-to-get-support)了解完整流程,包括每个计划中谁可以联系人工代理。