Modellkonfiguration
Konfigurieren Sie, welches Modell Claude Code verwendet, Aufwandsstufen, erweiterten Kontext und das Auto-Compact-Fenster
Verfügbare Modelle
Für die model-Einstellung in Claude Code können Sie entweder konfigurieren:
- Einen Modellalias
- Einen Modellnamen
- Anthropic API: einen vollständigen Modellnamen
- Amazon Bedrock: ein Inference-Profil-ARN
- Microsoft Foundry: einen Bereitstellungsnamen
- Google Cloud's Agent Platform: einen Versionsnamen
Hinweise dazu, welches Modell und welche Effort-Stufe für verschiedene Arten von Arbeit geeignet sind, finden Sie unter Choosing a Claude model and effort level in Claude Code im Blog.
ANTHROPIC_BASE_URL ändert, wohin Anfragen gesendet werden, nicht welches Modell sie beantwortet. Um Claude durch ein LLM-Gateway zu leiten, siehe LLM gateways.
Modellaliase
Verwenden Sie einen Modellalias, um Modelleinstellungen auszuwählen, ohne sich genaue Versionsnummern merken zu müssen:
| Modellalias | Verhalten |
|---|---|
default |
Spezialwert, der jede Modellüberschreibung löscht und auf den Laufzeit-Standard für Ihr Konto zurücksetzt. Ist selbst kein Modellalias |
best |
Verwendet das Modell, zu dem der fable-Alias aufgelöst wird, wenn Fable für Sie verfügbar ist, andernfalls das gleiche Modell wie opus |
fable |
Verwendet das Fable-Modell für Ihren Anbieter für Ihre schwierigsten und längsten Aufgaben |
sonnet |
Verwendet das neueste Sonnet-Modell für tägliche Codierungsaufgaben |
opus |
Verwendet das neueste Opus-Modell für komplexe Denkaufgaben |
haiku |
Verwendet das schnelle und effiziente Haiku-Modell für einfache Aufgaben |
sonnet[1m] |
Verwendet Sonnet mit einem Kontextfenster von 1 Million Token für lange Sitzungen. Keine Auswirkung, wenn sonnet bereits zu Sonnet 5.5 oder Sonnet 5 mit ihrem nativen 1M-Fenster aufgelöst wird |
opus[1m] |
Verwendet Opus mit einem Kontextfenster von 1 Million Token für lange Sitzungen. Keine Auswirkung, wenn opus bereits zu Opus 4.7 oder später mit seinem nativen 1M-Fenster aufgelöst wird |
opusplan |
Spezialmodus, der opus während des Plan-Modus verwendet und dann zu sonnet für die Ausführung wechselt |
Die Aliase opus, sonnet und haiku werden auf der Anthropic API zur neuesten Version und bei einigen anderen Anbietern zu einer früheren Version aufgelöst:
| Anbieter | opus |
sonnet |
haiku |
|---|---|---|---|
| Anthropic API | Opus 5.5 | Sonnet 5.5 | Haiku 5.5 |
| Claude Platform on AWS | Opus 5.5 | Sonnet 4.6 | Haiku 4.5 |
| Amazon Bedrock, Google Cloud's Agent Platform | Opus 5.5 | Sonnet 4.5 | Haiku 4.5 |
| Microsoft Foundry | Opus 4.6 | Sonnet 4.5 | Haiku 4.5 |
Sofern Sie ANTHROPIC_DEFAULT_FABLE_MODEL nicht festlegen, wird der fable-Alias zu Fable 5.1 aufgelöst, außer in Claude apps gateway-Sitzungen, wo fable und best zu Fable 5 aufgelöst werden.
Ein Gateway, das nicht für die Bereitstellung von claude-fable-5-1 konfiguriert ist, lehnt Anfragen für dieses Modell ab. Um Fable 5.1 über ein Gateway zu verwenden, das es bereitstellt, wählen Sie es mit /model claude-fable-5-1 aus.
Wenn opus oder sonnet zu einem älteren Modell aufgelöst wird, sind neuere Modelle verfügbar, indem Sie den vollständigen Modellnamen explizit auswählen oder ANTHROPIC_DEFAULT_OPUS_MODEL oder ANTHROPIC_DEFAULT_SONNET_MODEL festlegen.
Frühere Versionen lösen diese Aliase zu älteren Modellen auf. Für die Version, in der sich jeder Alias geändert hat, siehe Versionsverlauf.
Aliase verweisen auf die empfohlene Version für Ihren Anbieter und werden im Laufe der Zeit aktualisiert. Um eine bestimmte Version zu fixieren, verwenden Sie den vollständigen Modellnamen, z. B. claude-opus-5-5, oder legen Sie die entsprechende Umgebungsvariable wie ANTHROPIC_DEFAULT_OPUS_MODEL fest.
Sonnet 5.5 erfordert Claude Code v2.1.284 oder später, und Opus 5.5 erfordert v2.1.280 oder später. Wenn eine Anfrage für eines von ihnen von einer älteren Version fehlschlägt, siehe Claude Code does not support this model. Verwenden Sie v2.1.293 oder später mit Haiku 5.5. Führen Sie claude update aus, um zu aktualisieren.
Mit Fable arbeiten
Claude Fable 5.1 und Claude Fable 5 sind die leistungsfähigsten Modelle in Claude Code, geeignet für Aufgaben, die größer als eine einzelne Sitzung sind. Sie halten lange autonome Sitzungen, untersuchen vor dem Handeln und überprüfen ihre Arbeit häufiger als kleinere Modelle. Fable 5.1 ist die neuere Version.
Keines der Fable-Modelle ist der Standard für den Kontotyp auf einem Plan oder Anbieter. Wählen Sie eines explizit aus:
- Fable 5.1: Führen Sie
/model fableaus oder starten Sie mitclaude --model fable. In Claude apps gateway-Sitzungen, wo der Alias zu Fable 5 aufgelöst wird, führen Sie stattdessen/model claude-fable-5-1aus. - Fable 5: Wählen Sie es nach Modell-ID aus. Auf der Anthropic API führen Sie
/model claude-fable-5aus oder starten Sie mitclaude --model claude-fable-5. Bei anderen Anbietern verwenden Sie die Fable-5-Modell-ID Ihres Anbieters oder fixieren Sie sie mitANTHROPIC_DEFAULT_FABLE_MODEL.
Wenn Sie sich direkt mit der Anthropic API verbinden und Ihre Benutzereinstellungen claude-fable-5 oder claude-fable-5[1m] als Modell enthalten, z. B. weil Sie Fable in der /model-Auswahl vor v2.1.257 ausgewählt haben, ändert Claude Code diesen gespeicherten Wert beim ersten Ausführen von v2.1.257 oder später in den fable- oder fable[1m]-Alias. Die Startmodellzeile zeigt (auto-updated) einmal an. Ein claude-fable-5-Wert in Projekt-, Lokal- oder verwalteten Einstellungen bleibt unverändert.
Anfragen, die die Sicherheitsklassifikatoren eines Fable-Modells kennzeichnen, meist in Cybersicherheits- und Biologie-Bereichen, lösen einen automatischen Modell-Fallback aus.
Um das Beste aus Fable herauszuholen:
- Beschreiben Sie das Ergebnis, nicht die Schritte: Geben Sie ihm das Ergebnis, das Sie möchten, und lassen Sie es den Weg planen. Um es auf dieses Ergebnis hinarbeiten zu lassen, setzen Sie ein Ziel.
- Geben Sie ihm mehrdeutige Probleme: Ursachenuntersuchungen, Ausfall-Debugging und Architekturentscheidungen sind Bereiche, in denen die zusätzliche Untersuchung und Überprüfung sich auszahlt.
- Überspringen Sie die Überprüfungserinnerungen: Es überprüft seine eigene Arbeit mit weniger Anleitung, daher sind Erinnerungen zum Testen oder Überprüfen normalerweise unnötig.
- Größere Aufgaben einschätzen: Geben Sie ihm Arbeit, die Sie normalerweise in Teile aufteilen würden. Es hält lange Sitzungen, ohne den Faden zu verlieren.
Fable 5.1 erfordert Claude Code v2.1.257 oder später. Wenn eine Anfrage dafür von einer älteren Version fehlschlägt, siehe Claude Code does not support this model. Führen Sie claude update aus, um zu aktualisieren. Zur Verfügbarkeit unter Null-Datenspeicherung siehe Model availability under ZDR.
Auf der Anthropic API wird ein Fable-Modell in der /model-Auswahl angezeigt, sofern availableModels oder Organisationsmodellbeschränkungen es nicht ausschließen. Wenn Ihre Organisation Fable überhaupt nicht verwenden kann, z. B. unter Null-Datenspeicherung, bleibt die Zeile in der Auswahl ausgegraut mit einer Notiz zum Grund.
Fable und Nutzungsguthaben
Je nach Plan und Seat-Tier kann die Fable-Nutzung über Nutzungsguthaben abgerechnet werden, anstatt auf die im Plan enthaltenen Limits zu ziehen. Wenn dies der Fall ist, zeigt die /model-Auswahl „Requires usage credits“ in der Fable-Zeile an. Um Nutzungsguthaben zu verwalten, siehe Add usage credits to your subscription.
In interaktiven Sitzungen zeigt Claude Code eine Zustimmungsabfrage an, bevor eine Fable-Anfrage Nutzungsguthaben abrechnet. Mitglieder von Enterprise-Plänen mit Organisationsabrechnung sehen die Abfrage nicht. Sie können auf Fable mit Nutzungsguthaben fortfahren oder zu Ihrem Standardmodell wechseln. Sie können die Abfrage auch verwerfen:
- Wenn Sie ein Fable-Modell mit
/modelauswählen, behalten Sie Ihr aktuelles Modell. - Während der Sitzung setzt Claude Code den Turn auf Ihrem Standardmodell fort.
Nachdem Sie sich entschieden haben, auf Fable mit Nutzungsguthaben fortzufahren, zeigt Claude Code die Abfrage nicht erneut an.
In einer Sitzung mit verbundenem Remote Control, einer Hintergrund-Sitzung oder der Sitzung eines Teammitglieds in einem Agent-Team ist möglicherweise niemand am Terminal, daher hält Claude Code die Zustimmungsabfrage während der Sitzung bis zur dialogExpiry-Frist offen, standardmäßig fünf Minuten. Wenn bis zur Frist niemand geantwortet hat, beendet Claude Code den Turn ohne Senden der Anfrage und fügt dem Transkript einen Hinweis hinzu, den auch der Remote-Control-Client anzeigt. Ihre Modellauswahl ist unverändert, und Claude Code fragt bei Ihrer nächsten Nachricht erneut nach Zustimmung.
Was Sie tun können, während die Abfrage wartet, hängt von der Sitzung ab:
- Mit verbundenem Remote Control oder in der Sitzung eines Teammitglieds drücken Sie eine beliebige Taste am Terminal, um die Frist aufzuheben, und Claude Code wartet auf Ihre Antwort.
- In einer Hintergrund-Sitzung antworten Sie vor der Frist.
- Wenn Sie eine neue Nachricht vom Remote-Client senden, bevor jemand am Terminal etwas eingegeben hat, beendet Claude Code den Turn auf die gleiche Weise, und Ihre neue Nachricht startet den nächsten Turn. Nachdem jemand am Terminal etwas eingegeben hat, wartet Claude Code weiter auf die Antwort und reiht Ihre neue Nachricht dahinter ein.
In einer Sitzung, die eine andere Anwendung über das Agent SDK hostet, hängt es von dieser Anwendung ab, ob die Abfrage angezeigt wird. Wenn sie angezeigt wird und niemand vor der gleichen dialogExpiry-Frist antwortet, beendet Claude Code den Turn ohne Senden der Anfrage.
Im nicht interaktiven Modus mit dem -p-Flag und in einer Agent SDK-Anwendung, die die Abfrage nicht anzeigt, fragt Claude Code nie nach Zustimmung. Wenn eine Fable-Anfrage dort über Nutzungsguthaben abgerechnet würde, rechnet Claude Code sie ohne Nachfrage ab.
Ihr Modell einstellen
Sie können Ihr Modell auf mehrere Arten konfigurieren, aufgelistet nach Priorität:
- Während der Sitzung: Verwenden Sie
/model <alias|name>, um sofort zu wechseln, oder führen Sie/modelohne Argument aus, um die Auswahl zu öffnen. Siehe wann Claude Code Sie bittet, den Wechsel zu bestätigen - Beim Start: Starten Sie mit
claude --model <alias|name> - Umgebungsvariable: Legen Sie
ANTHROPIC_MODEL=<alias|name>fest - Einstellungen: Konfigurieren Sie dauerhaft in Ihrer Einstellungsdatei mit dem
model-Feld - Standard für neue Sitzungen: Legen Sie
ANTHROPIC_DEFAULT_MODEL=<alias|name>fest
/model speichert Ihre Auswahl als Standard für neue Sitzungen, indem das model-Feld in Ihren Benutzereinstellungen geschrieben wird. In der Auswahl:
Enter: Modell wechseln und als Standard speicherns: Modell nur für diese Sitzung wechseln und Standard unverändert lassen. Um eine andere Taste zu verwenden, binden SiemodelPicker:thisSessionOnlyneu
Wenn Sie /model <name> direkt eingeben, verhält es sich wie Enter. Um nur für diese Sitzung zu wechseln, öffnen Sie die Auswahl mit /model und drücken Sie s in der Modellzeile.
Auf einem Enterprise-Plan, wenn Sie mit Ihrem claude.ai-Konto angemeldet sind und einen Standard mit /model speichern, zeichnet Claude Code die Auswahl auch auf diesem Konto auf. Dies erfordert Claude Code v2.1.280 oder später.
- Wenn Ihr Admin kein Organisationsstandardmodell festgelegt hat, kann die Standard-Option zu dem aufgezeichneten Modell aufgelöst werden, und wenn dies der Fall ist, zeigt die Standard-Zeile der Auswahl den Namen dieses Modells.
- Wenn Modellbeschränkungen das aufgezeichnete Modell ausschließen oder es nicht für Ihr Konto verfügbar ist, und Ihr Admin kein Organisationsstandardmodell festgelegt hat, wird die Standard-Option aufgelöst, als ob nichts aufgezeichnet worden wäre.
- Wenn Sie Standard oder
opusplanin/modelauswählen, ändert sich die aufgezeichnete Auswahl nicht.
Wenn Sie Modelle mit /model wechseln, erreicht der Wechsel auch Subagenten, die das Modell der Hauptkonversation erben, da Claude Code ihr Modell von dem auflöst, das Ihre Sitzung verwendet, wenn Claude sie startet. Wechseln Sie zu Opus, bevor Claude Recherche oder Testläufe an einen von ihnen delegiert, und diese Arbeit läuft auch auf Opus. Um einen benutzerdefinierten Subagenten auf einem kleineren Modell zu halten, legen Sie model in seiner Definition fest.
Wenn Sie ein Modell mit /model im nicht interaktiven Modus festlegen, mit dem -p-Flag, gilt Ihre Auswahl nur für die aktuelle Sitzung und wird nicht als Standard gespeichert; /model in diesem Modus erfordert Claude Code v2.1.205 oder später. Projekt- und verwaltete Einstellungen haben weiterhin Vorrang und werden beim nächsten Start erneut angewendet. Ein Organisationsstandardmodell, das Ihr Admin so konfiguriert hat, dass es die Benutzerauswahl überschreibt, wird ebenfalls beim nächsten Start erneut angewendet.
In v2.1.144 bis v2.1.152 galt /model nur für die aktuelle Sitzung und d in der Auswahl speicherte einen Standard.
Das --model-Flag und die ANTHROPIC_MODEL-Umgebungsvariable gelten nur für die Sitzung, mit der Sie sie starten. Um verschiedene Modelle in verschiedenen Terminals gleichzeitig auszuführen, starten Sie jedes mit seinem eigenen --model-Flag, anstatt mit /model zu wechseln.
Preise in der /model-Auswahl werden angezeigt, wenn Claude Code mit der Anthropic API kommuniziert, direkt oder über ein LLM-Gateway, das sie als Proxy weiterleitet, und der Preis in einer Zeile ist der Preis des Modells, das diese Zeile auswählt. Bei Drittanbietern wie Amazon Bedrock und im Claude apps gateway bestimmt Ihr Anbieter oder Gateway, was Sie zahlen, daher zeigen Auswahlzeilen keinen Preis. Der Preis ist nur ein Anzeigelabel; er beeinflusst nicht, welches Modell eine Zeile auswählt oder was Ihr Anbieter abrechnet. Vor v2.1.206 zeigten Claude Platform on AWS und Gateway-Sitzungen Anthropic-Listenpreise, und eine Zeile konnte den Preis eines anderen Modells als des ausgewählten anzeigen.
Fortgesetzte Sitzungen, die mit claude --resume, --continue oder der /resume-Auswahl gestartet wurden, behalten das Modell, das sie beim Speichern des Transkripts verwendeten. Wenn das wiederhergestellte Modell eingestellt wurde oder von availableModels ausgeschlossen wird, fällt die Sitzung auf die normale Rangfolge zurück. Bei Anbietern, die anbieterspezifische Bereitstellungs-IDs anstelle von Anthropic-Modell-IDs verwenden, wie Amazon Bedrock, Google Cloud's Agent Platform und Microsoft Foundry, wird das Transkriptmodell überhaupt nicht wiederhergestellt und die Sitzung löst ihr Modell über die normale Rangfolge auf.
Wenn Ihre model-Einstellung haiku ist, wird eine auf einem Haiku-Modell gespeicherte Sitzung auf dem Modell fortgesetzt, zu dem haiku jetzt aufgelöst wird. Sobald haiku beispielsweise zu Haiku 5.5 aufgelöst wird, wird eine auf Haiku 4.5 gespeicherte Sitzung auf Haiku 5.5 fortgesetzt.
Ein Modell, das Sie für den neuen Start mit --model oder ANTHROPIC_MODEL auswählen, hat weiterhin Vorrang vor dem wiederhergestellten Modell. Ab v2.1.195 gilt dies auch für eine ANTHROPIC_DEFAULT_OPUS_MODEL-Familienvariable. ANTHROPIC_DEFAULT_MODEL kann dies auch unter den in seinem Abschnitt aufgelisteten Bedingungen tun.
Wenn das aktive Modell beim Start aus Projekt- oder verwalteten Einstellungen statt aus Ihrer eigenen Auswahl stammt, zeigt der Startheader, welche Einstellungsdatei es festgelegt hat. Führen Sie /model aus, um zu überschreiben; die Projekt- oder verwaltete Einstellung wird beim nächsten Start erneut angewendet. Auf Plattformen, die Claude Code einbetten und CLAUDE_CODE_PROVIDER_MANAGED_BY_HOST festlegen, hat die Modellkonfiguration des Hosts Vorrang vor verwalteten Modelleinstellungen, während eine verwaltete availableModels-Allowlist in Kraft bleibt, sofern der Host nicht seine eigene bereitstellt; Exceptions to managed settings precedence gibt an, welche Schlüssel und Variablen der Host überschreibt.
Wenn Sie oder Ihre Organisation PreModelSwitch-Hooks konfigurieren, werden sie vor einem angeforderten Wechsel ausgeführt und können ihn blockieren oder Sie bitten, ihn zu bestätigen.
Wenn Claude Code nicht feststellen kann, welche PreModelSwitch-Hooks die verwalteten Plugins Ihrer Organisation bereitstellen, z. B. weil ein verwaltetes Plugin nicht geladen werden konnte, lehnt es den Wechsel ab, anstatt ihn ungeprüft anzuwenden, und prüft bei jedem neuen Versuch erneut. Siehe Model switch was blocked by a PreModelSwitch hook für die Meldung und die Behebung.
Wenn Sie Modelle über die setModel()-Methode des Agent SDK, über eine App wie die Desktop-App oder von einem Gerät, das über Remote Control verbunden ist, wechseln, prüft Claude Code den Wert beim Wechsel:
- Agent SDK oder eine App: Mit Claude Code v2.1.268 oder später bestätigt Claude Code die ID beim ersten Wechsel der Sitzung zu ihr bei Ihrem Anbieter, sofern Claude Code die Modell-ID nicht lokal akzeptiert, wie es bei Ihrer benutzerdefinierten Modelloption der Fall ist. Die Bestätigung läuft bei jedem Anbieter, und eine ID, die Ihr Anbieter nicht anbietet, wird beim Wechsel abgelehnt, anstatt bei Ihrer nächsten Anfrage fehlzuschlagen.
- Remote Control: Auf der Anthropic API prüft Claude Code den Wert lokal und sendet keine Anfrage.
Siehe Model is not a recognized model id und Model not found für die Meldungen.
Wenn Sie das Modell mit dem --model-Flag, der ANTHROPIC_MODEL-Umgebungsvariable oder der model-Einstellung festlegen, prüft Claude Code es nicht im Voraus, und ein falsch geschriebener Wert erzeugt There's an issue with the selected model bei der ersten Anfrage.
Wenn das angeforderte Modell ein geplantes Ausmusterungsdatum hat oder automatisch einer neueren Version neu zugeordnet wird, zeigt Claude Code eine Warnung an, die das angeforderte Modell benennt. Interaktive Sitzungen zeigen sie als Starthinweis. Ab v2.1.182 wird die gleiche Warnung im nicht interaktiven Modus auf stderr geschrieben, wenn das Standard-Textausgabeformat verwendet wird. Die Prüfung deckt auch ein model ab, das im Subagenten-Frontmatter festgelegt ist. Die stderr-Warnung wird für --output-format json und stream-json unterdrückt; lesen Sie das tatsächliche Modell stattdessen aus dem modelUsage-Feld der Ergebnisnachricht.
Beispiel: Starten Sie eine Sitzung auf Opus:
claude --model opus
Wechseln Sie dann Modelle innerhalb der Sitzung:
/model sonnet
Beispiel-Einstellungsdatei:
{
"permissions": {
"allow": ["Bash(npm run lint)"]
},
"model": "opus"
}
Ein Standardmodell für neue Sitzungen festlegen
Legen Sie ANTHROPIC_DEFAULT_MODEL=<alias|name> fest, um das Modell auszuwählen, auf dem Ihre Sitzungen standardmäßig starten. Erfordert Claude Code v2.1.236 oder später.
Claude Code startet eine neue Sitzung auf dem Modell der Variablen nur, wenn keines der folgenden Elemente ein Modell auswählt:
- Das
--model-Flag ANTHROPIC_MODEL- Ein
model-Wert in einer beliebigen Einstellungsdatei, einschließlich der Auswahl, die Sie mit/modelspeichern - Ein Organisationsstandardmodell
Eine Auswahl, die Sie mit /model speichern, hat auch bei späteren Starts Vorrang vor der Variablen. Wenn stattdessen ANTHROPIC_MODEL gesetzt ist, kehrt Claude Code beim nächsten Start zum Modell dieser Variablen zurück, unabhängig davon, was Sie mit /model gespeichert haben.
Claude Code löst auch die Standard-Option zum Modell der Variablen auf, sofern kein Organisationsstandardmodell gilt. Wenn die Standard-Option zum Modell der Variablen aufgelöst wird, zeigt die Standard-Zeile in der /model-Auswahl das Label Set by ANTHROPIC_DEFAULT_MODEL.
Claude Code ignoriert die Variable in diesen Fällen, und die Standard-Option wird aufgelöst, als hätten Sie sie nicht festgelegt:
- Sie legen sie auf
default,inherit,opusplanoderhaikufest enforceAvailableModelsist aktiviert- Die Modellbeschränkungen Ihrer Organisation schließen das Modell aus
- Das Modell ist nicht für Ihr Konto verfügbar
Wenn eine neue Sitzung auf dem Modell der Variablen starten würde, startet eine Sitzung, die Sie mit claude --resume, --continue oder der /resume-Auswahl fortsetzen, ebenfalls darauf. Claude Code stellt das im Transkript dieser Sitzung gespeicherte Modell nicht wieder her. Andernfalls verwendet Claude Code die Variable nicht, wenn Sie eine Sitzung fortsetzen.
Eine neue Sitzung startet auf einem anderen Modell als Sie ausgewählt haben
Wenn Sie ein Modell mit /model auswählen und Ihre nächste Sitzung auf etwas anderem startet, sind dies die üblichen Ursachen:
- Sie haben es für eine Sitzung ausgewählt. Das Drücken von
sin der Auswahl, das Starten mit--modelund das Ausführen von/modelim nicht interaktiven Modus gelten alle für die aktuelle Sitzung und lassen Ihren gespeicherten Standard unverändert. - Etwas mit höherer Priorität legt das Modell fest. Ein
model-Wert in Projekt- oder verwalteten Einstellungen,ANTHROPIC_MODELin Ihrer Shell oder ein Organisationsstandardmodell, das Ihr Admin so festgelegt hat, dass es Benutzerauswahlen überschreibt, gilt bei jedem Start erneut. Ihre/model-Auswahl ist weiterhin gespeichert; sie wird nur übertroffen. Wenn Projekt- oder verwaltete Einstellungen das Modell festlegen, nennt der Startheader die Datei. - Claude Code konnte Ihre Auswahl nicht speichern.
/modelschreibtmodelin~/.claude/settings.json. Wenn Sie nicht in diese Datei schreiben können, z. B. weil ein anderes Tool sie generiert oder mit einer schreibgeschützten Kopie verlinkt, gilt das ausgewählte Modell nur für die Sitzung, und der nächste Start liest den alten Wert. Legen Siemodelin dem Tool fest, das die Datei generiert, oder machen Sie die Datei beschreibbar. Siehe A change you made in Claude Code is lost in new sessions. - Sie haben eine Sitzung fortgesetzt. Eine Sitzung, die Sie mit
claude --resumeoder--continuefortsetzen, behält normalerweise das Modell, das sie verwendete, anstatt Ihren aktuellen Standard zu verwenden.
Modellauswahl einschränken
Unternehmensadministratoren können availableModels in verwalteten oder Richtlinieneinstellungen verwenden, um einzuschränken, welche Modelle Benutzer auswählen können. Einträge entsprechen einer Modellfamilie wie sonnet, einem Versionspräfix wie claude-sonnet-4-5 oder einer vollständigen Modell-ID wie claude-sonnet-4-5-20250929. Ein Versionspräfix entspricht auch späteren Modell-IDs, die es um ein weiteres Segment erweitern, sodass claude-fable-5 sowohl Fable 5 als auch Fable 5.1 zulässt, während claude-fable-5-1 nur Fable 5.1 zulässt. Um ein Modell zu blockieren, das die Liste zulässt, oder um jede Modell-ID in der Liste nur die Version zuzulassen, die sie benennt, siehe Spezifische Modelle oder Versionen blockieren.
Auf Plattformen, die Claude Code einbetten und CLAUDE_CODE_PROVIDER_MANAGED_BY_HOST setzen, hat die Modellkonfiguration des Hosts Vorrang vor verwalteten Modelleinstellungen, während eine verwaltete availableModels-Allowlist in Kraft bleibt, es sei denn, der Host stellt seine eigene bereit; Ausnahmen von der Vorrangigkeit verwalteter Einstellungen gibt an, welche Schlüssel und Variablen der Host überschreibt.
Wenn availableModels gesetzt ist, gilt die Allowlist überall dort, wo ein Benutzer ein Modell angeben kann:
- Hauptsitzungsmodell:
/model, das Flag--model, die UmgebungsvariableANTHROPIC_MODEL, die Einstellungmodel,ANTHROPIC_DEFAULT_MODELund das Modell, das beim Fortsetzen einer Sitzung wiederhergestellt wird - Alias-Auflösung: die Umgebungsvariablen
ANTHROPIC_DEFAULT_OPUS_MODEL,ANTHROPIC_DEFAULT_SONNET_MODEL,ANTHROPIC_DEFAULT_HAIKU_MODELundANTHROPIC_DEFAULT_FABLE_MODELkönnen einen zulässigen Alias nicht zu einem Modell außerhalb der Liste umleiten - Schnellmodus:
/fastweigert sich umzuschalten, wenn dies implizit zu einem Opus-Modell außerhalb der Liste führen würde, mit der Meldung „is not in your organization's allowed models“ - Subagent- und Teamkollegen-Modelle: das Feld
modelin Subagent-Frontmatter, der Parametermodeldes Agent-Tools, Agent-Team-Teamkollegen-Modelle,CLAUDE_CODE_SUBAGENT_MODELund in v2.1.197 und früher das Modellauswahlfeld im Assistenten/agents - Skill- und Befehlsmodelle: das Frontmatter
modelin Skills und Befehlen - Advisor-Modell: die konfigurierte Einstellung
advisorModelund das Flag--advisor - Hintergrund-Agent-Modell: das Modell, das in der Dispatch-Auswahl ausgewählt ist
Auf der Anthropic API und Claude Platform on AWS wird ein Modellfamilien-Alias, opus, sonnet, haiku oder fable, zu seinem üblichen Modell aufgelöst, wenn die Allowlist dieses Modell zulässt. Wenn die Allowlist dieses Modell blockiert, ersetzt Claude Code es durch die neueste Version der Familie, die die Allowlist zulässt, und zeigt einen Hinweis an, der sowohl das angeforderte als auch das ersetzte Modell benennt. Mit ["sonnet", "claude-opus-4-6"] wählen beispielsweise sowohl /model opus als auch --model opus Claude Opus 4.6, das neueste zulässige Opus. Vor v2.1.205 wurde ein Alias, dessen neueste veröffentlichte Version außerhalb der Liste lag, wie jede andere blockierte Auswahl abgelehnt oder ersetzt, auch wenn die Liste eine ältere Version zulässt.
Die Ersetzung benötigt eine zulässige Version zum Landen: Wenn die Allowlist keine Version der Aliasfamilie zulässt, folgt der Alias dem Ablehnungs- und Ersetzungsverhalten unten wie jeder andere blockierte Wert.
Claude Code behandelt jede andere blockierte Auswahl je nachdem, wo das Modell gesetzt wurde:
-
/model: Claude Code lehnt den Wechsel mit einem Fehler ab -
Flag
--model,ANTHROPIC_MODELoder die Einstellungmodel: Claude Code ersetzt den Wert beim Start durch eine Warnung, die sowohl das angeforderte als auch das ersetzte Modell benennt, und die Sitzung startet auf dem Standardmodell -
ANTHROPIC_DEFAULT_MODEL: Claude Code ignoriert die Variable -
Subagent- oder Teamkollegen-Überschreibung: Claude Code führt den Subagent oder Teamkollegen auf einem Fallback-Modell aus, anstatt die Anfrage fehlschlagen zu lassen. Siehe Modell auswählen für den Subagent-Fallback und Teamkollegen und Modelle angeben für den Teamkollegen-Fallback.
In interaktiven Sitzungen warnt Sie Claude Code, wenn es ein Subagent-Modell durch diesen Fallback oder durch die oben beschriebene Ersetzung der neuesten zulässigen Version ersetzt, und benennt die angeforderten und ersetzten Modelle; es meldet keinen Teamkollegen-Fallback.
Wo die oben beschriebene Ersetzung der neuesten zulässigen Version gilt, folgt ein blockierter Familien-Alias stattdessen. Vor v2.1.222 fiel ein Alias auf jedem Provider wie jeder andere blockierte Wert zurück
-
Skill- oder Befehlsüberschreibung: Claude Code ignoriert die Überschreibung, einschließlich eines blockierten Familien-Alias, und der Skill oder Befehl wird auf dem Sitzungsmodell ausgeführt. Ein Skill oder Befehl, der in einem Subagent ausgeführt wird, folgt stattdessen dem Subagent-Verhalten oben
-
Einstellung
advisorModel: der Advisor ist für die Sitzung deaktiviert -
Flag
--advisor: Claude Code beendet sich beim Start mit einem Fehler. In einer Hintergrund-Sitzung startet es die Sitzung ohne den Advisor, anstatt sich zu beenden
Claude Code verbirgt ausgeschlossene Modelle in der Auswahl /model. Ob eine von Ihnen aufgeführte Modell-ID auch eine eigene Zeile erhält, hängt vom Provider ab:
- Anthropic API, Claude Platform on AWS, Claude apps gateway oder ein über
ANTHROPIC_BASE_URLfestgelegtes LLM-Gateway: Eine von Ihnen aufgeführte Anthropic-Modell-ID ohne integrierte Auswahlzeile erscheint als eigene beschriftete Zeile. Claude Code fügt eine solche Zeile für Opus-, Sonnet- und Haiku-Versionen hinzu, etwa für eine ältere Version, die die Liste festlegt. Wenn SiereplaceBuiltInOptionsin einermodelPicker-Aufstellung setzen, erscheint diese Zeile nicht. Vor v2.1.199 war eine solche ID nur durch Eingabe von/model <id>auswählbar. - Amazon Bedrock, Google Cloud's Agent Platform oder Microsoft Foundry: Sofern eine von Ihnen aufgeführte Modell-ID nicht mit
anthropic.beginnt, fügt Claude Code keine Zeile dafür hinzu, unabhängig davon, ob es sich um eine Anthropic-Modell-ID oder eine Provider-spezifische ID handelt. Mantle-Modell-IDs tragen dieses Präfix. Um eine aufgeführte Version ohne integrierte Zeile anzuzeigen, fügen Sie sie zusätzlich einermodelPicker-Aufstellung hinzu, die IDs im Format Ihres Providers akzeptiert.
Modelländerungen, die Claude Code in Ihrem Namen vornimmt, werden auf die gleiche Weise überprüft:
- Fallback-Modellketten: Einträge außerhalb der Allowlist werden gelöscht
- Plan-Modus-Upgrades: Auf der Anthropic API und Claude Platform on AWS verwendet ein Upgrade wie
opusplanzu einem ausgeschlossenen Modell die neueste zulässige Version der Upgrade-Familie. Bei Providern mit Provider-spezifischen Modell-IDs und wenn keine Version zulässig ist, wird das Upgrade übersprungen und die Planung wird auf dem Sitzungsmodell fortgesetzt - Automatischer Modell-Fallback: Ein Fallback, dessen Ziel ausgeschlossen ist, wird nicht ausgeführt, sodass die gekennzeichnete Anfrage mit einer Ablehnung endet
- Auto-Modus-Klassifikator: der Standard Claude Sonnet 5 des Klassifikators gilt nur, wenn die Allowlist Sonnet 5 zulässt. Wenn es ausgeschlossen ist, wird der Klassifikator auf dem Sitzungsmodell ausgeführt, das die Allowlist bereits regelt, oder auf einem Opus-Modell, wenn die Sitzung auf einem Fable-Modell läuft. Bei Providern außer der Anthropic API wird dieser Opus-Fallback auf dem Modell ausgeführt, das Sie in
ANTHROPIC_DEFAULT_OPUS_MODELfestlegen, andernfalls auf Opus 5, ohne die Allowlist zu konsultieren. Erfordert Claude Code v2.1.210 oder später - Schnellmodus: Das Aktivieren des Schnellmodus wird abgelehnt, wenn das Modell, auf dem die Sitzung danach läuft, außerhalb der Allowlist liegt
- Verfügbarkeits-Fallback auf Amazon Bedrock und Google Cloud's Agent Platform: Wenn Ihr Konto während einer Sitzung den Zugriff auf ein Modell verliert, überspringt der Wechsel zu einem anderen Modell ausgeschlossene Modelle. Die Modellprüfungen beim Start auf Amazon Bedrock und Google Cloud's Agent Platform überspringen ausgeschlossene Modelle nur, wenn die verwalteten Einstellungen zusätzlich
enforceAvailableModelssetzen
{
"availableModels": ["sonnet", "haiku"]
}
Oberflächenabdeckung
Jede Oberfläche erzwingt die Allowlist, die sie erhält. Welcher Liefermechanismus jede Oberfläche erreicht, unterscheidet sich:
| Liefermechanismus | CLI und IDE | Desktop-Lokalsitzungen | Web-, Mobil- und Cloud-Sitzungen | Agent SDK und nicht-interaktiv | Cowork |
|---|---|---|---|---|---|
| Server-verwaltete Einstellungen aus der Admin-Konsole | Erzwungen | Erzwungen | Erzwungen, außer in Claude Tag-Sitzungen | Erzwungen | Remote-Cowork-Sitzungen: Der Server überprüft das Modell. Auf dem Gerät des Benutzers: nicht bereitgestellt. |
| MDM oder verwaltete Einstellungsdateien | Erzwungen | Erzwungen | Nicht bereitgestellt in von Anthropic gehosteten Umgebungen; in selbst gehosteten Umgebungen erzwungen aus dem Runner-Image gemäß wie Claude Code verwaltete Quellen kombiniert | Erzwungen | Erzwungen, wo bereitgestellt |
- Cloud-Sitzungen, einschließlich derjenigen, die Sie aus der Desktop-App starten, laufen standardmäßig auf von Anthropic verwalteten VMs: Einstellungen, die auf Ihrem Gerät bereitgestellt werden, erreichen sie nicht, daher stellen Sie die Allowlist über server-verwaltete Einstellungen bereit. Sitzungen, die Ihre Organisation zu einer selbst gehosteten Umgebung leitet, laufen auf Ihrem eigenen Compute und lesen auch die verwaltete Einstellungsdatei im Runner-Image. Wie Claude Code verwaltete Quellen kombiniert gibt an, wann diese Datei gilt. Ein Modellwechsel in der Mitte einer Cloud-Sitzung wird abgelehnt, wenn das angeforderte Modell durch die Allowlist ausgeschlossen ist. Wenn die
availableModels-Liste in Ihren server-verwalteten Einstellungen nicht leer ist, lehnt der Server eine Anfrage ab, eine Cloud-Sitzung auf claude.ai/code oder aus der Desktop-App auf einem Modell zu starten, das die Liste ausschließt. - Claude Tag-Sitzungen laufen in Cloud-Umgebungen, erhalten aber keine server-verwalteten Einstellungen; in einer selbst gehosteten Umgebung lesen sie immer noch die verwaltete Einstellungsdatei im Runner-Image. Um das Modell für diese Sitzungen festzulegen, siehe Modell für einen Bereich auswählen im Claude Tag-Administratorhandbuch.
- Cowork, die agentengesteuerte Arbeit-Registerkarte in der Claude Desktop-App, führt ihre Sitzungen auf Claude Code aus, erhält aber absichtlich keine server-verwalteten Einstellungen aus der Admin-Konsole von claude.ai. Wenn die
availableModels-Liste in Ihren server-verwalteten Einstellungen nicht leer ist und ein Benutzer ein Modell außerhalb davon auswählt, lehnt der Server dieses Modell für eine Remote-Cowork-Sitzung ab. Eine verwaltete Einstellungsdatei gilt für Cowork-Sitzungen, wenn sie dort vorhanden ist, wo die Sitzung läuft; Remote-Cowork-Sitzungen laufen auf von Anthropic verwalteten VMs, wo eine auf dem Gerät bereitgestellte Datei nicht vorhanden ist. - Sitzungen auf Drittanbieter-Providern wie Amazon Bedrock, Google Cloud's Agent Platform, Microsoft Foundry und Claude Platform on AWS erhalten keine server-verwalteten Einstellungen, daher stellen Sie die Allowlist dort über MDM oder verwaltete Einstellungsdateien bereit.
- Die Bereitstellung über die Admin-Konsole erfordert außerdem, dass die Sitzung die Einstellungen mit einem zulässigen Login bei Ihrer Organisation oder einem dafür ausgestellten OAuth-Token abruft. Für Flotten, die sich mit API-Schlüsseln authentifizieren, ob direkt konfiguriert oder durch ein
apiKeyHelper-Skript generiert, stellen Sie die Allowlist über MDM oder verwaltete Einstellungsdateien bereit. - Die Desktop-Code-Registerkarte hostet auch SSH-Sitzungen, die die verwaltete Einstellungsdatei vom Remote-Host lesen, auf dem sie laufen. Siehe Desktop-verwaltete Einstellungen.
- Die Modellauswahlfelder auf claude.ai und in der Desktop-App verbergen oder grau aus Modelle, die durch die Allowlist Ihrer Organisation ausgeschlossen sind. Der Auswahlzustand ist eine Bequemlichkeit für Benutzer; die Erzwingung erfolgt in der Sitzung.
Standardmodell-Verhalten
Mit dem Standard-Präfix-Matching lässt availableModels allein die Option Standard auf dem Laufzeit-Standard des Systems für das Konto, bis Sie auch enforceAvailableModels setzen. Wenn dieser Standard ein Modell ist, das Sie einschränken möchten, setzen Sie auch enforceAvailableModels, oder blockieren Sie dieses Modell.
Mit availableModels: [] werden benannte Modellauswahlen blockiert und enforceAvailableModels hat keine Auswirkung.
Allowlist für das Standardmodell erzwingen
Setzen Sie enforceAvailableModels: true zusammen mit einem nicht leeren availableModels in verwalteten Einstellungen, um die Allowlist auf die Option Standard zu erweitern. Dies erfordert Claude Code v2.1.175 oder später.
{
"availableModels": ["sonnet", "haiku"],
"enforceAvailableModels": true
}
Für ein Mitglied ohne Modell auf ihrem Konto aufgezeichnet wird die Option Standard zu dem Kontotyp-Standard aufgelöst, oder zu dem Organisationsstandardmodell, wenn ein Administrator eines gesetzt hat. Wenn dieses Modell nicht in der Allowlist ist, wird die Option Standard stattdessen zu dem ersten availableModels-Eintrag aufgelöst, der ein zulässiges, verfügbares Modell benennt, und die Zeile Standard der Auswahl /model zeigt dieses Modell. Dies gilt überall dort, wo der Standard erreicht wird: Sitzungsstart, Auswahl von Standard in /model, das Schlüsselwort "default" in Fallback-Modellketten und der Fallback, der verwendet wird, wenn eine ausgeschlossene Auswahl gelöscht wird. Ein auf dem Konto eines Mitglieds aufgezeichnetes Modell wird auch gegen availableModels überprüft; Einstellung Ihres Modells beschreibt, wie die Option Standard es behandelt.
enforceAvailableModels ordnet die Option Standard nur neu zu, wenn availableModels nicht leer ist. Wenn availableModels nicht leer ist, aber kein Eintrag zu einem zulässigen und verfügbaren Modell aufgelöst wird, wird die Erzwingung übersprungen und eine Warnung wird angezeigt, die nur unter --debug sichtbar ist. Behalten Sie mindestens einen garantiert verfügbaren Eintrag in der Liste, um dies zu vermeiden.
Stellen Sie beide Schlüssel zusammen in der höchstrangigen verwalteten Quelle bereit, die Sie bereitstellen. Standardmäßig liest Claude Code nur diese Quelle, daher wird ein Paar, das in einer verwalteten Einstellungsdatei platziert ist, ignoriert, wenn die Admin-Konsole Einstellungen bereitstellt; unter dem Opt-in-Merge in wie Claude Code verwaltete Quellen kombiniert ignoriert Claude Code immer noch eine modelOverrides-Map aus einer Quelle, die unter der Quelle rangiert, die availableModels setzt.
Kontrollieren Sie das Modell, auf dem Benutzer laufen
Die Einstellung model ist eine anfängliche Auswahl, keine Erzwingung. Sie legt fest, welches Modell aktiv ist, wenn eine Sitzung startet, aber Benutzer können immer noch /model öffnen und Standard auswählen, das zu dem Laufzeit-Standard des Systems aufgelöst wird, unabhängig davon, was model gesetzt ist, es sei denn, enforceAvailableModels oder die Schlüssel, die spezifische Versionen blockieren wenden sich darauf an.
Um die Modellerfahrung vollständig zu kontrollieren, kombinieren Sie diese Einstellungen:
availableModels: schränkt ein, welche benannten Modelle Benutzer wechseln könnenenforceAvailableModels: erweitert dieavailableModels-Allowlist auf die Option Standard, sodass Standard nicht zu einem Modell außerhalb der Liste aufgelöst werden kanndeniedModelsundavailableModelsMatch: blockieren Sie spezifische Versionen, die einavailableModels-Eintrag sonst zulassen würdemodel: legt die anfängliche Modellauswahl fest, wenn eine Sitzung startetANTHROPIC_DEFAULT_SONNET_MODEL/ANTHROPIC_DEFAULT_OPUS_MODEL/ANTHROPIC_DEFAULT_HAIKU_MODEL/ANTHROPIC_DEFAULT_FABLE_MODEL: kontrollieren, zu welchen Modellen die Aliasesonnet,opus,haikuundfableaufgelöst werden, und welche Version der Kontotyp-Standard verwendet
Dieses Beispiel startet Benutzer auf Sonnet 4.5, begrenzt die Auswahl auf Sonnet und Haiku und stellt sicher, dass Standard zu einem Modell in der Allowlist aufgelöst wird, anstatt zum Tier-Standard:
{
"model": "claude-sonnet-4-5",
"availableModels": ["claude-sonnet-4-5", "haiku"],
"enforceAvailableModels": true,
"env": {
"ANTHROPIC_DEFAULT_SONNET_MODEL": "claude-sonnet-4-5"
}
}
Ohne enforceAvailableModels oder den env-Block erhält ein Benutzer, der Standard in der Auswahl auswählt, den Laufzeit-Standard anstelle der in model festgelegten Version. Die beiden Einstellungen decken unterschiedliche Bereiche ab: enforceAvailableModels macht Standard der Allowlist gehorchen, während der env-Block festlegt, zu welcher Version ein zulässiger Alias wie sonnet aufgelöst wird. Verwenden Sie enforceAvailableModels allein, wenn das Einschränken von Modellfamilien ausreicht; fügen Sie den env-Block hinzu, wenn Sie auch eine bestimmte Version festlegen müssen.
Merge-Verhalten
Wenn die verwalteten Einstellungen, die Claude Code anwendet, availableModels definieren, gilt diese Liste allein, abgesehen von einer Host-Plattform, die ihre eigene bereitstellt: Einträge in Benutzer-, Projekt- oder lokalen Einstellungen können sie nicht erweitern, und Claude Code führt availableModels auch nie über verwaltete Quellen hinweg zusammen; wie Claude Code verwaltete Quellen kombiniert gibt an, welche Quellenliste gilt. Andernfalls werden Listen aus Benutzer-, Projekt- und lokalen Einstellungen wie andere Array-Einstellungen verkettet und dedupliziert. Vor Claude Code v2.1.175 wurden Einträge aus Bereichen mit niedrigerer Priorität in die verwaltete Liste zusammengeführt, anstatt sie zu ersetzen.
Innerhalb der effektiven Liste deaktiviert ein Eintrag, der ein bestimmtes Modell in einer Familie benennt, ob ein Versionspräfix oder eine vollständige Modell-ID, den Wildcard-Eintrag dieser Familie: ["sonnet", "claude-sonnet-4-5"] erlaubt nur Sonnet 4.5-Versionen, nicht jedes Sonnet-Modell.
Mantle-Modell-IDs
Einträge in availableModels, die mit anthropic. beginnen, werden als benutzerdefinierte Optionen zur Auswahl /model hinzugefügt. Dies ist eine Ausnahme von der Alias-Zuordnung, die in Modelle für Drittanbieter-Bereitstellungen festlegen beschrieben ist. Wenn der Amazon Bedrock Mantle-Endpunkt aktiviert ist, leitet Claude Code die Einträge, die dem Mantle-Format entsprechen, an diesen Endpunkt weiter. Die Einstellung schränkt die Auswahl immer noch auf aufgelistete Einträge ein, und eine Mantle-ID bettet einen Familiennamen ein, daher zählt sie als spezifischer Eintrag und deaktiviert den Wildcard dieser Familie: Neben allen Mantle-IDs listen Sie die Versionspräfixe oder vollständigen IDs auf, die Sie auswählbar behalten möchten. Siehe Merge-Verhalten.
Spezifische Modelle oder Versionen blockieren
Ein availableModels-Eintrag wie claude-opus-5 zulässt auch spätere Versionen, die ihn erweitern, wie Opus 5.5, sobald Claude Code sie unterstützt. Zwei verwaltete Einstellungen ermöglichen es Ihnen, eine Veröffentlichung zurückzuhalten, und beide erfordern Claude Code v2.1.283 oder später:
deniedModels: listen Sie die zu blockierenden Modelle auf. Ein aufgelistetes Modell wird blockiert, auch wennavailableModelses zulässt, und der Schlüssel funktioniert auch ohne Allowlist. Eine Veröffentlichung, die kein Eintrag blockiert, bleibt zulässigavailableModelsMatch: setzen Sie es auf"exact", sodass jede Modell-ID inavailableModelsnur die Version zulässt, die sie benennt. Eine neuere Version einer aufgelisteten Modell-ID bleibt dann blockiert, bis Sie sie zur Liste hinzufügen
Frühere Versionen ignorieren beide Schlüssel, daher setzen Sie auch requiredMinimumVersion, um zu verhindern, dass diese Versionen starten.
Dieses Beispiel zulässt Opus- und Sonnet-Modelle und blockiert Opus 5.5 in jeder Schreibweise, einschließlich datierter und Provider-spezifischer IDs:
{
"availableModels": ["opus", "sonnet"],
"deniedModels": ["claude-opus-5-5"]
}
Ein blockiertes Modell, ob deniedModels es benennt oder eine "exact"-Liste es auslässt, wird überall dort als blockierte Auswahl behandelt, wo die Allowlist gilt. Es ist in der Auswahl /model verborgen, und /model <name> lehnt es ab. Wenn Sie eine blockierte Modell-ID mit --model, ANTHROPIC_MODEL oder der Einstellung model benennen, löscht Claude Code sie beim Start und löst stattdessen die Option Standard auf. Wenn ein Hook oder eine Hintergrundanfrage ein Modell benennt, das deniedModels blockiert, wie das Feld model eines Agent-Hooks, wird diese Anfrage stattdessen auf dem Sitzungsmodell ausgeführt.
Die Option Standard folgt beiden Schlüsseln auch, unabhängig davon, ob Sie enforceAvailableModels setzen. Wenn Sie es mit einem nicht leeren availableModels setzen, zählt ein blockierter Standard als ein Modell außerhalb der Allowlist. Andernfalls wird eine Option Standard, die zu einem blockierten Modell aufgelöst würde, in dieser Reihenfolge herabgestuft:
- Die neueste zulässige Version der gleichen Familie
- Das neueste zulässige Modell jeder Familie mit niedrigeren Kosten der Reihe nach: Sonnet, dann Haiku
- Der erste
availableModels-Eintrag, der ein zulässiges Modell benennt
Wenn keines davon zulässig ist, weigert sich eine Sitzung, die auf der Option Standard startet, mit einem Fehler zu starten, der den zu behebenden Schlüssel benennt. Eine "exact"-Liste wirkt sich auf die Option Standard nur aus, wenn die verwaltete availableModels-Liste mindestens ein Modell oder eine Familie benennt.
Claude Code liest beide Schlüssel nur aus verwalteten Einstellungen. Wenn Sie einen davon in Benutzer-, Projekt- oder lokalen Einstellungen oder mit --settings setzen, ignoriert Claude Code ihn mit einer Warnung.
Organisationsmodellbeschränkungen
Organisationsadministratoren in Claude Enterprise-Plänen schränken ein, welche Modelle Mitglieder ausführen können, indem sie einzelne Modelle in der Admin-Konsole von claude.ai deaktivieren. Diese Beschränkung wird mit den Berechtigungen des Kontos bereitgestellt, wenn Claude Code sich authentifiziert, getrennt von jeder availableModels-Liste in Einstellungen, und der Server erzwingt die gleiche Beschränkung unabhängig, wenn eine Sitzung erstellt wird. Erfordert Claude Code v2.1.187 oder später.
Die Beschränkung gilt, wenn sich ein Mitglied anmeldet oder seinen eigenen API-Schlüssel verwendet. Organisationsbezogene Anmeldedaten, wie Organisationsdienst-Schlüssel, sind nicht an einen Benutzer gebunden, daher gilt die Beschränkung nicht für sie.
Die Claude Console hat keine Modellbeschränkungskontrolle. Organisationen ohne Claude Enterprise-Plan, einschließlich derjenigen, deren Mitglieder sich über die Anthropic API authentifizieren, schränken Modelle stattdessen mit availableModels in verwalteten Einstellungen ein und fügen enforceAvailableModels hinzu, um die Option Standard abzudecken. Oberflächenabdeckung gibt an, wie jede Oberfläche diese Einstellungen empfängt und erzwingt.
Ein eingeschränktes Modell ist in der Auswahl /model verborgen. Wenn Sie es mit --model, der Umgebungsvariable ANTHROPIC_MODEL oder der Einstellung model nach Name auswählen, wird die Meldung Model "<name>" is restricted by your organization's settings. Using <model> instead. angezeigt und die Sitzung startet auf einem zulässigen Modell. Wenn Sie /model <name> für ein eingeschränktes Modell eingeben, wird es mit Model '<name>' is restricted by your organization's settings. Run /model to choose a different model. abgelehnt und die Sitzung behält ihr aktuelles Modell.
Ein Modellfamilien-Alias wie opus wird zu seinem üblichen Modell aufgelöst, wenn die Organisation es zulässt. Wenn die Organisation dieses Modell einschränkt, ersetzt Claude Code es durch die neueste Version der Familie, die die Organisation zulässt, mit dem gleichen Ersetzungshinweis. /model <alias> wird nur abgelehnt, wenn jede Version seiner Familie eingeschränkt ist; ein Alias, der mit --model, ANTHROPIC_MODEL oder der Einstellung model gesetzt ist, wird in diesem Fall immer noch beim Start ersetzt. Vor v2.1.205 wurde ein Familien-Alias basierend auf seiner neuesten veröffentlichten Version allein ersetzt oder abgelehnt, auch wenn eine ältere Version zulässig war.
Beschränkungen gelten organisationsweit oder pro Rolle:
- Das Deaktivieren eines Modells auf Organisationsebene entfernt es für jedes Mitglied.
- Rollenbezogener Zugriff gewährt verschiedenen benutzerdefinierten Rollen unterschiedliche Modelle, und ein Mitglied, das mehrere Rollen innehat, kann jedes Modell verwenden, das eine seiner Rollen gewährt.
- Haiku-Modelle sind immer verfügbar und können nicht deaktiviert werden, daher behält jedes Mitglied mindestens ein nutzbares Modell.
- Eine Zugangsänderung tritt bei neuen Anfragen innerhalb von etwa einer Minute in Kraft; die Auswahl
/modelspiegelt dies wider, wenn eine Sitzung das nächste Mal startet.
Beide Beschränkungen gelten zusammen: Ein Modell ist nur auswählbar, wenn es durch availableModels zulässig ist und nicht durch die Organisation eingeschränkt ist. Organisationsbeschränkungen erreichen Sitzungen nur auf der Anthropic API und LLM-Gateway-Bereitstellungen; bei jedem anderen Provider verwenden Sie stattdessen availableModels.
Organisationsstandardmodell
Organisationsadministratoren in Claude Enterprise-Plänen können ein Standardmodell für Claude Code-Mitglieder über die claude.ai-Administrationskonsole festlegen – für die gesamte Organisation oder pro benutzerdefinierte Rolle. Wenn ein Standardmodell festgelegt ist, wird die Option „Standard“ zu diesem Modell aufgelöst. Erfordert Claude Code v2.1.196 oder später.
Die Zeile „Standard“ in der /model-Auswahl zeigt den Namen des Organisationsstandardmodells mit der Bezeichnung „Org-Standard“. Die Bezeichnung lautet „Org-Standard“, unabhängig davon, ob der Administrator den Standard für die gesamte Organisation oder für Ihre Rolle festgelegt hat. Ein Rollenstandard gilt für Mitglieder dieser benutzerdefinierten Rolle und hat Vorrang vor dem organisationsweiten Standard. Wenn mehrere Ihrer Rollen unterschiedliche Standards festlegen, wird das leistungsfähigste Modell angewendet.
Das Organisationsstandardmodell ist ein Ausgangspunkt, keine Einschränkung. Diese Auswahlmöglichkeiten haben Vorrang vor ihm:
- das Flag
--modelund die UmgebungsvariableANTHROPIC_MODEL - ein
model-Wert in verwalteten Einstellungen oder bereitgestellt über--settings - ein
model-Wert in Ihren Benutzer-, Projekt- oder lokalen Einstellungen, einschließlich eines Modells, das Sie mit/modelspeichern
Administratoren können auch das Organisationsstandardmodell so konfigurieren, dass es die Benutzerauswahl überschreibt. Wenn die Überschreibung aktiviert ist, hat sie Vorrang vor dem model-Wert in Benutzer-, Projekt- und lokalen Einstellungen. Ein Modell, das Sie mit /model speichern, gilt also für die aktuelle Sitzung, und das Organisationsstandardmodell wird beim nächsten Start wieder angewendet. Wenn sich Ihre Auswahl unterscheidet, zeigt /model Your organization's default (<model>) applies on restart an. Das Flag --model, ANTHROPIC_MODEL, verwaltete Einstellungen und --settings haben auch bei aktivierter Überschreibung weiterhin Vorrang.
Um einzuschränken, welche Modelle Mitglieder auswählen können, verwenden Sie stattdessen Organisationsmodellbeschränkungen oder availableModels.
Claude Code liest das Organisationsstandardmodell einmal beim Start ein. Ein Standard, den der Administrator während einer Sitzung ändert, wird also beim nächsten Start wirksam.
Wenn das Organisationsstandardmodell die Benutzerauswahl nicht überschreibt, löscht der erste interaktive Start nach der Änderung durch den Administrator den model-Schlüssel aus Ihren Benutzereinstellungen einmalig, damit der neue Standard angewendet wird. Es ändert nichts anderes in der Datei, und ein Modell, das Sie nach diesem Start mit /model speichern, wird beibehalten.
Das Organisationsstandardmodell durchläuft diese Beschränkungsprüfungen, bevor es übernommen wird:
availableModelsallein gilt nicht für das Organisationsstandardmodell, daher wird ein Organisationsstandardmodell außerhalb der Zulassungsliste trotzdem angewendet. Wenn auchenforceAvailableModelsfestgelegt ist, wird ein Organisationsstandardmodell außerhalb der Zulassungsliste wie jedes andere Standardmodell zum ersten Eintrag der Zulassungsliste neu zugeordnet- ein Organisationsstandardmodell, das Organisationsmodellbeschränkungen für Ihr Konto verweigern, wird durch das neueste zulässige Modell in seiner Familie ersetzt, oder durch eine kostengünstigere Familie, wenn jede Version davon eingeschränkt ist
- für ein Organisationsstandardmodell, das
deniedModelsoder eine"exact"-Liste blockiert, siehe Spezifische Modelle oder Versionen blockieren - ein Organisationsstandardmodell, das für Ihr Konto überhaupt nicht verfügbar ist, wird übersprungen, und die Option „Standard“ wird aufgelöst, wie es ohne ein Organisationsstandardmodell der Fall wäre
Ab v2.1.199 behält die /model-Auswahl eine separate Zeile für die übliche Familie bei, wenn das Organisationsstandardmodell eine andere Modellfamilie ist als die übliche Standard des Kontotyps, sodass Sie für eine Sitzung trotzdem zu ihr wechseln können. In v2.1.196 bis v2.1.198 fehlt diese Zeile in der Auswahl.
Das Organisationsstandardmodell gilt nur für Sitzungen, die mit der Anthropic API authentifiziert sind. Um einen Standard an anderer Stelle festzulegen, einschließlich LLM-Gateway-Bereitstellungen, verwenden Sie stattdessen den model-Schlüssel in verwalteten Einstellungen.
Organisatorische Anstrengungsgrenzen
Ihre Organisation kann die Anstrengungsstufe auf zwei Wege begrenzen. Bei einem Claude Enterprise-Plan legen Organisationsadministratoren Anstrengungsgrenzen pro Rolle fest, wie unten beschrieben. Bei jedem Plan und jedem Anbieter, einschließlich Amazon Bedrock, Google Cloud's Agent Platform und Microsoft Foundry, begrenzt die verwaltete Einstellung maxEffortLevel die Anstrengung stattdessen auf dem Client. Wenn beide auf ein Modell zutreffen, gilt die niedrigere Obergrenze.
Organisationsadministratoren in Claude Enterprise-Plänen können eine maximale Anstrengungsstufe pro Modell für jede benutzerdefinierte Rolle festlegen, zusammen mit Rollenbeschränkungen auf Organisationsmodellebene. Stufen über der Obergrenze werden nicht in der /effort-Auswahl angeboten, und das Benennen einer höheren Stufe mit --effort oder /effort wird stattdessen mit der Obergrenze ausgeführt. In interaktiven Sitzungen und einfachen Text---print-Läufen warnt eine Meldung vor den angeforderten und angewendeten Stufen; bei json- oder stream-json-Ausgabe oder in Hintergrund-Agenten wird die Begrenzung stillschweigend angewendet. Obergrenzen gelten pro Modell, daher kann der Wechsel von Modellen ändern, welche Stufen verfügbar sind. Wenn mehrere Ihrer Rollen dasselbe Modell gewähren, gilt die am wenigsten restriktive Obergrenze. Erfordert Claude Code v2.1.195 oder später.
Anstrengungsgrenzen werden zusammen mit Organisationsmodellbeschränkungen bereitgestellt und erreichen dieselben Sitzungen.
Spezielles Modellverhalten
`default` Modelleinstellung
Das Verhalten von default hängt von Ihrem Kontotyp ab:
- Pro, Max, Team, Enterprise und Anthropic API: Standard ist Opus 5.5
- Claude Platform auf AWS, Amazon Bedrock und Google Cloud's Agent Platform: Standard ist Opus 5.5
- Microsoft Foundry: Standard ist Sonnet 4.5
Vor v2.1.280 wurde default auf Pro und Team Standard zu Sonnet 5 aufgelöst und auf Max, Team Premium, Enterprise, der Anthropic API, Claude Platform auf AWS, Amazon Bedrock und Google Cloud's Agent Platform ab v2.1.219 zu Opus 5. Vor v2.1.219 wurde default auf der Anthropic API, Max, Team Premium und Enterprise Pay-as-you-go ab v2.1.154 zu Opus 4.8 aufgelöst und auf Claude Platform auf AWS, Amazon Bedrock und Google Cloud's Agent Platform ab v2.1.207. Vor v2.1.207 wurde default auf Claude Platform auf AWS zu Opus 4.7 aufgelöst und auf Amazon Bedrock und Google Cloud's Agent Platform zu Sonnet 4.5.
Wenn ein Admin ein Organisations-Standardmodell festgelegt hat, wird default stattdessen zu diesem Modell aufgelöst, anstatt zum oben genannten Kontotyp-Standard. Erfordert Claude Code v2.1.196 oder später. default kann sich auch zu dem Modell auflösen, das Sie mit ANTHROPIC_DEFAULT_MODEL festlegen, unter den in seinem Abschnitt aufgelisteten Bedingungen, oder zu dem Modell, das auf Ihrem Konto gespeichert ist.
Wenn nichts auf Ihrem Konto gespeichert ist, verwaltete Einstellungen die Allowlist für das Standardmodell erzwingen und das Kontotyp-Standardmodell nicht in availableModels ist, wird default zum erzwungenen Standard aufgelöst, anstatt zum oben genannten Kontotyp-Standard. Wenn sowohl ein Organisations-Standard als auch eine Erzwingung gelten, ersetzt der Organisations-Standard zunächst den Kontotyp-Standard und die Erzwingung wird dann darauf angewendet: Ein in der Allowlist enthaltener Organisations-Standard wird beibehalten, während einer außerhalb der Liste zum erzwungenen Standard aufgelöst wird.
Fable-Modelle sind auf keinem Plan oder Provider der Kontotyp-Standard. Wenn Sie eines mit /model auswählen, wird es als das ausgewählte Modell in Ihren Benutzereinstellungen gespeichert, sodass spätere Sitzungen damit beginnen. Für die einmalige Änderung, die Claude Code an einer gespeicherten Fable 5-Auswahl in v2.1.257 vornimmt, siehe Mit Fable arbeiten.
`opusplan` Modelleinstellung
Das opusplan Modell-Alias bietet einen automatisierten Hybrid-Ansatz:
- Im Plan-Modus: verwendet
opusfür komplexe Überlegungen und Architekturentscheidungen - Im Ausführungsmodus: wechselt automatisch zu
sonnetfür Code-Generierung und Implementierung
Dies verbindet Opus's Überlegungen für die Planung mit Sonnets Effizienz für die Ausführung.
Die Plan-Modus-Opus-Phase verwendet das gleiche Kontextfenster wie die opus Modelleinstellung, und die Ausführungsphase verwendet das gleiche Fenster wie sonnet. Wenn opus und sonnet zu Modellen aufgelöst werden, die standardmäßig mit dem 1M Kontextfenster laufen, wie die aktuellen Modelle auf der Anthropic API, laufen beide Phasen damit. Um 1M-Kontext für beide Phasen anzufordern, wo sie das nicht tun, stellen Sie das Modell auf opusplan[1m] ein, zum Beispiel mit /model opusplan[1m]. Das Einstellen mit /model erfordert Claude Code v2.1.265 oder später; verwenden Sie auf früheren Versionen das --model Flag oder die model Einstellung stattdessen.
Wenn availableModels das neueste Opus ausschließt, aber eine ältere Version erlaubt, zum Beispiel ["sonnet", "claude-opus-4-6"], verwendet opusplan das neueste erlaubte Opus für die Planung und bleibt nur bei Sonnet, wenn jedes Opus ausgeschlossen ist. Eine Haiku-Sitzung, die normalerweise im Plan-Modus zu Sonnet wechseln würde, verwendet ebenfalls das neueste erlaubte Sonnet und bleibt nur bei Haiku, wenn jedes Sonnet ausgeschlossen ist. Vor v2.1.205 blieb der Plan-Modus beim Modell der Sitzung, wenn die neueste Version der Upgrade-Familie ausgeschlossen war, selbst wenn die Allowlist eine ältere erlaubte.
Die Ersetzung einer älteren erlaubten Version gilt auf der Anthropic API und Claude Platform auf AWS. Auf Amazon Bedrock, Google Cloud's Agent Platform, Microsoft Foundry und Mantle, deren Bereitstellungen Provider-spezifische Modell-IDs verwenden, bleibt der Plan-Modus beim Modell der Sitzung, wenn das Upgrade-Modell ausgeschlossen ist.
Für einen Hybrid-Ansatz, bei dem Claude während einer Aufgabe entscheidet, wann ein zweites Modell konsultiert werden soll, anstatt an der Plan-Grenze zu wechseln, siehe das Advisor-Tool.
Fallback-Modellketten
Wenn das primäre Modell überlastet ist, nicht verfügbar ist oder einen anderen nicht wiederholbaren Serverfehler zurückgibt, kann Claude Code zu einem Fallback-Modell wechseln, anstatt die Anfrage fehlschlagen zu lassen. Authentifizierungs-, Abrechnungs-, Rate-Limit-, Anfragegröße- und Transportfehler sowie eine Ablehnung durch die Richtlinienprüfung Ihrer Organisation lösen niemals einen Wechsel aus; diese folgen ihren normalen Wiederholungsversuchen und ihrer normalen Fehlerbehandlung. Es wechselt, wenn Amazon Bedrock oder Google Cloud's Agent Platform ein Modell ablehnt, das Ihr Konto nicht aufrufen kann, was Claude Code als das Modell, das nicht verfügbar ist, statt als Authentifizierungsfehler behandelt.
Konfigurieren Sie ein oder mehrere Fallback-Modelle und Claude Code versucht sie der Reihe nach, wobei eine Benachrichtigung angezeigt wird, wenn es wechselt. Der Wechsel gilt nur für den aktuellen Turn, sodass Ihre nächste Nachricht zuerst wieder das primäre Modell versucht. Claude Code begrenzt Ketten auf drei Modelle nach Duplikatentfernung und ignoriert zusätzliche Einträge.
Stellen Sie eine Kette für eine Sitzung mit dem --fallback-model Flag ein, das eine kommagetrennte Liste akzeptiert:
claude --fallback-model sonnet,haiku
Um eine Kette über Sitzungen hinweg beizubehalten, stellen Sie fallbackModel in Einstellungen als Array ein:
{
"fallbackModel": ["claude-sonnet-5", "claude-haiku-4-5"]
}
Das --fallback-model Flag hat Vorrang vor der fallbackModel Einstellung. Jeder Eintrag akzeptiert einen Modellnamen oder Alias, und "default" wird zum Standardmodell erweitert.
Claude Code bestätigt die Kette beim Start nicht und /status zeigt sie nicht an. Die Benachrichtigung, die angezeigt wird, wenn ein Wechsel stattfindet, ist das erste sichtbare Zeichen, dass ein Fallback konfiguriert ist.
Wenn eine Anfrage fehlschlägt, versucht Claude Code jeden Eintrag der Reihe nach, bis einer ihn akzeptiert. Ein Eintrag, der auch nicht erreichbar ist, wie ein in Einstellungen angeheftetes ausgemustertes Modell, schlägt auf die gleiche Weise zum nächsten fehl. Claude Code entfernt zwei Arten von Einträgen, bevor dieser Durchgang beginnt:
- Außerhalb der Allowlist: Claude Code löscht jeden Eintrag, der nicht von
availableModelserlaubt ist, wenn es die Kette liest. - Kleineres Kontextfenster während der Komprimierung: die Kette deckt auch Komprimierung ab, aber Claude Code wird nicht zu einem Modell mit einem kleineren Kontextfenster als das des primären zurückfallen, da die Zusammenfassung dort zuerst einen Teil der Konversation abschneiden würde. Wenn jedes Fallback kleiner ist, zeigt die Komprimierung den ursprünglichen Fehler an und Sie können es erneut versuchen.
Claude Code wendet die Kette auch auf Subagenten an. Wenn die Anfrage eines Subagenten fehlschlägt, versucht Claude Code Ihre konfigurierten Fallback-Modelle der Reihe nach, und der Subagent setzt sich auf dem Modell fort, das die Anfrage akzeptiert. Das Modell Ihrer Sitzung bleibt unverändert. Vor v2.1.247 beendete ein Fehler, den die Kette abdeckt, stattdessen den Subagenten.
Automatisches Modell-Fallback
Dieser Abschnitt behandelt inhaltsbasiertes Fallback von Fable-Modellen, Opus 5.5, Sonnet 5.5 und Opus 5. Für verfügbarkeitsbasiertes Fallback, wenn ein Modell überlastet oder nicht verfügbar ist, siehe Fallback-Modellketten.
Fable-Modelle, Opus 5.5, Sonnet 5.5 und Opus 5 laufen mit Sicherheitsklassifikatoren, die am häufigsten Cybersicherheits- und Biologie-Inhalte kennzeichnen. Für diese beiden Kategorien hängt das Fallback-Modell davon ab, welches Modell abgelehnt hat:
- Fable 5.1, Fable 5 und Opus 5.5: Biologie-gekennzeichnete Anfragen werden auf Opus 5 erneut ausgeführt, und Cybersicherheits-gekennzeichnete Anfragen werden auf Opus 4.8 erneut ausgeführt.
- Sonnet 5.5: Cybersicherheits-gekennzeichnete Anfragen werden auf Sonnet 5 erneut ausgeführt. Biologie-gekennzeichnete Anfragen enden stattdessen mit einer Ablehnung, da Sonnet 5.5 kein Biologie-Fallback-Modell hat.
- Opus 5: Cybersicherheits-gekennzeichnete Anfragen werden auf Opus 4.8 erneut ausgeführt. Biologie-gekennzeichnete Anfragen enden stattdessen mit einer Ablehnung, da Opus 5 seine eigenen Biologie-Klassifikatoren ohne Fallback-Modell ausführt.
Auf Amazon Bedrock, Google Cloud's Agent Platform und Microsoft Foundry löst Claude Code diese Ziele stattdessen durch die Modell-IDs Ihrer Bereitstellung auf. Siehe Fallback auf Bedrock, Agent Platform und Foundry aktivieren.
Wenn Claude Code eine gekennzeichnete Anfrage auf das Fallback-Modell ihrer Kategorie umstellt, führt es die Anfrage auf diesem Modell erneut aus. In Ihrer Hauptkonversation zeigt es eine Benachrichtigung im Transkript an. Wenn Sie vorher gefragt werden möchten, siehe Vor dem Wechsel fragen.
Nach einem Fallback setzt sich die Sitzung auf dem Fallback-Modell fort. Um zu Ihrem ursprünglichen Modell zurückzukehren, führen Sie /model aus.
Kategoriebasiertes Fallback erfordert Claude Code v2.1.219 oder später. Vor v2.1.219 wurde jede gekennzeichnete Fable 5-Anfrage auf das Standard-Opus-Modell Ihres Providers erneut ausgeführt, und Opus 5 war keine Fallback-Quelle.
Das Fallback-Modell wird gegen availableModels überprüft. Wenn es blockiert ist, findet kein Fallback statt. Die Ablehnung wird als normaler Fehler angezeigt und das Modell der Sitzung bleibt unverändert.
Effort-Stufe nach einem Fallback
Wenn Claude Code Ihre Sitzung auf das Fallback-Modell umstellt, behält es die Effort-Stufe bei, mit der die gekennzeichnete Anfrage lief. Zum Beispiel bleibt eine Sitzung auf Opus 5.5 mit dessen Standard medium, die auf Opus 4.8 zurückfällt, bei medium, obwohl Opus 4.8 standardmäßig high verwendet.
In Fällen wie diesen gilt eine andere Stufe:
- Ihre eigene Änderung: Sobald Sie eine Effort-Stufe wählen, ein Modell in
/modelauswählen oder die Sitzung später fortsetzen, wird die Stufe der gekennzeichneten Anfrage nicht mehr übernommen. - Skill-Effort: Eine Stufe, die das
effort-Frontmatter eines Skills für die gekennzeichnete Anfrage festgelegt hat, gilt für diesen Turn, und spätere Turns laufen mit der Stufe, die die Effort-Auflösungsreihenfolge für das Fallback-Modell ergibt.
Führen Sie in der Sitzung /effort status aus, um die geltende Stufe zu sehen, oder /effort, um sie zu ändern.
Überprüfen Sie, was das Fallback ausgelöst hat
Das Fallback kann bei der ersten Anfrage einer Sitzung ausgelöst werden, bevor Sie etwas Ungewöhnliches senden, da die erste Anfrage Workspace-Kontext wie Ihren CLAUDE.md-Inhalt und Git-Status trägt. Ein Repository, das Sicherheits- oder Biologie-Material enthält, kann den Klassifikator allein durch diesen Kontext auslösen.
Um zu überprüfen, ob Anpassungen der Auslöser sind, starten Sie eine Sitzung mit claude --safe-mode, das Anpassungen wie CLAUDE.md, Skills, MCP-Server und Hooks deaktiviert. Git-Status und Verzeichnisnamen sind keine Anpassungen und sind immer noch enthalten.
Vor dem Wechsel fragen
Um jedes Mal selbst zu entscheiden, was passiert, wenn eine Anfrage gekennzeichnet wird, führen Sie /config aus, wählen Sie Switch models when a message is flagged und wählen Sie Ask each time. Sie können auch switchModelsOnFlag in Ihrer Einstellungsdatei auf false setzen. Claude Code pausiert dann bei einer gekennzeichneten Anfrage, die das Modell wechseln würde, und bietet Ihnen zwei Optionen: zum Fallback-Modell wechseln oder den Prompt bearbeiten und es erneut versuchen.
Wenn eine gekennzeichnete Anfrage in einer interaktiven Sitzung zum ersten Mal das Modell wechseln würde, fragt Claude Code möglicherweise, ob ab dann automatisch gewechselt werden soll. Es fragt nur, wenn Sie switchModelsOnFlag nicht gesetzt haben, und speichert Ihre Wahl als diesen Schlüssel in Ihren Benutzereinstellungen.
Wenn Sie stattdessen beim aktuellen Modell bleiben, ist der gespeicherte Wert false, genau wie bei Ask each time. Wenn Sie die Frage schließen, speichert Claude Code nichts und fragt erneut, wenn das nächste Mal eine gekennzeichnete Anfrage das Modell wechseln würde.
Wenn Sie Ask each time gewählt haben, verhalten sich einige Fälle anders:
- Wenn die gekennzeichnete Kategorie kein Fallback-Modell hat, wie eine Biologie-Kennzeichnung auf Opus 5 oder Sonnet 5.5, zeigt Claude Code die Abfrage nicht an und die Anfrage endet mit der Ablehnung.
- Wenn beide Modelle die gleiche Anfrage kennzeichnen, können Sie den Prompt bearbeiten und es erneut versuchen oder eine neue Sitzung starten.
- In Cloud-Sitzungen in der mobilen App wird das Bearbeiten und erneute Versuchen nicht unterstützt. Wechseln Sie das Modell oder setzen Sie die Sitzung in einem Desktop-Browser oder der Desktop-App fort.
- Im nicht interaktiven Modus und in SDK-Integrationen, die die Abfrage nicht anzeigen können, beendet eine gekennzeichnete Anfrage den Turn stattdessen mit einer Ablehnung.
- In einem Subagenten zeigt Claude Code die Abfrage nicht an, und eine gekennzeichnete Anfrage, die das Modell wechseln würde, wird auf dem Fallback-Modell erneut ausgeführt.
- Wenn das Fallback-Ziel von
availableModelsblockiert ist, zeigt Claude Code die Abfrage nicht an. Die gekennzeichnete Anfrage endet mit der Ablehnung, genau wie beim automatischen Fallback, wenn das Ziel blockiert ist.
Fallback auf Bedrock, Agent Platform und Foundry aktivieren
Auf Amazon Bedrock, Google Cloud's Agent Platform und Microsoft Foundry sind Modell-IDs Provider-spezifisch, daher funktioniert automatisches Fallback nur, wenn Claude Code jedes beteiligte Modell identifizieren kann:
- Claude Code muss das aktuelle Modell als Fallback-Quelle erkennen. Fable 5.1 und Fable 5 werden erkannt, wenn die Modell-ID
claude-fable-5enthält, dem Wert vonANTHROPIC_DEFAULT_FABLE_MODELentspricht oder mitmodelOverrideszugeordnet ist. Opus 5.5, Sonnet 5.5 und Opus 5 werden durch ihre Provider-Modell-ID oder einemodelOverridesZuordnung erkannt. - Ein Opus-Ziel muss sich in Ihrer Bereitstellung auflösen, unabhängig davon, welches Modell abgelehnt hat: Stellen Sie
ANTHROPIC_DEFAULT_OPUS_MODELein oder behalten Sie einen Opus 4.8-Eintrag in der Modelliste des Providers. Ohne einen bleibt das Fallback für jedes Quellmodell aus, einschließlich Sonnet 5.5, und gekennzeichnete Anfragen enden mit einer Ablehnung. - Das Fallback-Modell der gekennzeichneten Kategorie muss sich in Ihrer Bereitstellung auflösen. Von einem Fable-Modell, Opus 5.5 oder Opus 5, wenn Sie
ANTHROPIC_DEFAULT_OPUS_MODELeinstellen, werden gekennzeichnete Anfragen auf diesem Modell für jede Kategorie erneut ausgeführt, die ein Fallback hat; eine Biologie-Kennzeichnung auf Opus 5 endet immer noch mit einer Ablehnung. Wenn Sie es nicht einstellen, werden Cybersicherheits-gekennzeichnete Anfragen auf dem Opus 4.8-Eintrag erneut ausgeführt und Biologie-gekennzeichnete Anfragen von einem Fable-Modell oder Opus 5.5 auf einem Opus 5-Eintrag. Von Sonnet 5.5 werden Cybersicherheits-gekennzeichnete Anfragen auf dem Modell erneut ausgeführt, das Sie inANTHROPIC_DEFAULT_SONNET_MODELeinstellen, oder auf einem Sonnet 5-Eintrag in der Modelliste des Providers, wenn Sie es nicht einstellen.
Wenn eines der beiden Modelle nicht identifiziert werden kann, wechselt Claude Code nicht. Die gekennzeichnete Anfrage endet mit einer Ablehnungsmeldung und Sie können das Modell mit /model wechseln und es erneut versuchen. Um beide Modelle identifizierbar zu machen, stellen Sie die Pins für Ihr Quellmodell ein:
- Fable-Modelle: Stellen Sie
ANTHROPIC_DEFAULT_FABLE_MODELauf Ihre Fable-Modell-ID ein, damit Claude Code sie als Fallback-Quelle erkennt. - Jedes Quellmodell: Stellen Sie
ANTHROPIC_DEFAULT_OPUS_MODELauf eine Opus-Modell-ID ein, um das Fallback einzuschalten und den gekennzeichneten Kategorien ein Ziel zu geben. Ein Pin, der ein Modell außerhalb der Opus-Familie benennt oder das Modell, das abgelehnt hat, lässt die Ablehnung stehen. - Sonnet 5.5: Zusätzlich zum Opus-Pin stellen Sie
ANTHROPIC_DEFAULT_SONNET_MODELein oder behalten Sie einen Sonnet 5-Eintrag in der Modelliste des Providers, um das Modell bereitzustellen, auf dem die Anfrage erneut ausgeführt wird. Ein Sonnet-Pin, der ein Modell außerhalb der Sonnet-Familie benennt oder Sonnet 5.5 selbst, lässt die Ablehnung stehen.
Das Fallback-Modell muss außerdem ein Kontextfenster haben, das mindestens so groß ist wie das der Sitzung, sonst wechselt Claude Code nicht und die gekennzeichnete Anfrage endet mit derselben Ablehnung. Bei diesen Providern laufen die Quellmodelle standardmäßig mit dem 1M-Kontextfenster. Heften Sie ein Modell an, das dies ebenfalls tut, wie Opus 4.8 in ANTHROPIC_DEFAULT_OPUS_MODEL oder Sonnet 5 in ANTHROPIC_DEFAULT_SONNET_MODEL, und zwar über eine ID, die Claude Code diesem Modell zuordnen kann.
Sicherheitsforschung und Biologie-Workloads
Workloads in offensiver Sicherheit oder Biologie, einschließlich Penetrationstests, Capture the Flag (CTF)-Übungen und biologienaher Codebasen, lösen häufig Fallback aus, oft bei der ersten Anfrage. Für substantielle Biologie-Arbeit auf Fable 5.1, Fable 5 oder Opus 5.5 verschiebt die erste gekennzeichnete Anfrage, die das Modell wechselt, die Sitzung zu Opus 5, und spätere Biologie-gekennzeichnete Anfragen enden dort in Ablehnungen, da Opus 5 kein Biologie-Fallback hat. Auf Opus 5 und Sonnet 5.5 erhalten Sie diese Ablehnungen von der ersten gekennzeichneten Anfrage an.
Dies ist das erwartete Routing für diese Domänen, keine Kontokennzeichnung. Wenn Ihre Organisation Fähigkeiten der Fable-Klasse für diese Arbeit benötigt, fragen Sie Ihr Anthropic-Kontoteam nach Programmen für vertrauenswürdigen Zugriff.
Effort-Stufe anpassen
Effort-Stufen steuern adaptive Überlegungen, die es dem Modell ermöglichen, bei jedem Schritt zu entscheiden, ob und wie viel es nachdenken soll, basierend auf der Aufgabenkomplexität. Niedrigerer Effort ist schneller und günstiger für einfache Aufgaben, während höherer Effort tiefere Überlegungen für komplexe Probleme bietet.
Die verfügbaren Effort-Stufen hängen vom Modell ab. Modelle, die hier nicht aufgelistet sind, unterstützen keinen Effort:
| Modell | Stufen |
|---|---|
| Fable 5.1 und Fable 5 | low, medium, high, xhigh, max |
| Opus 5.5, Sonnet 5.5, Haiku 5.5, Opus 5, Sonnet 5, Opus 4.8 und Opus 4.7 | low, medium, high, xhigh, max |
| Opus 4.6 und Sonnet 4.6 | low, medium, high, max |
Wenn Sie eine Stufe einstellen, die das aktive Modell nicht unterstützt, fällt Claude Code auf die höchste unterstützte Stufe bei oder unter der eingestellten zurück. Zum Beispiel läuft xhigh auf Opus 4.6 als high. Ihre Organisation oder Ihre eigenen Einstellungen können auch die Stufen begrenzen, die ein Modell bietet; siehe Effort-Grenzen der Organisation.
Claude Code löst die Effort-Stufe der Sitzung in dieser Reihenfolge auf und nimmt die erste, die zutrifft:
- Eine explizite Wahl: die
CLAUDE_CODE_EFFORT_LEVELUmgebungsvariable, Start mit--effortoder/effortin der Sitzung (ein nicht interaktives/efforthat engere Auswirkungen) - Ihre Einstellungen: die Stufe, die Sie für das Modell gespeichert haben, oder ein
effortLevelSchlüssel, mit dem Vorrang zwischen ihnen und über Einstellungsdateien hinweg, wie untermodelSettingsangegeben - Der Standard-Effort des Modells:
highauf jedem Modell, das Effort unterstützt, außer dass Opus 5.5, Sonnet 5.5 und Haiku 5.5 standardmäßigmediumverwenden, Opus 4.7 standardmäßigxhighverwendet und, wenn Ihre Organisation eine Standard-Effort-Stufe für ihr Organisations-Standardmodell festlegt, diese Stufe der Standard ist, wenn Sie dieses Modell ausführen
Nach einem automatischen Modell-Fallback siehe Effort-Stufe nach einem Fallback für die geltende Stufe.
Opus 5.5 startet bei medium, es sei denn, eine der obigen Quellen stellt eine Stufe dafür ein, und ein Top-Level effortLevel in Ihrer Benutzereinstellungsdatei zählt nicht für Opus 5.5. Dieser Schlüssel ist die ältere Form, die /effort schrieb, bevor Claude Code Stufen pro Modell speicherte: Er gilt weiterhin dort, wo er zuvor galt, auf Opus 5, Fable 5.1 und früheren Modellen, während Opus 5.5 und später veröffentlichte Modelle bei ihrem eigenen Standard beginnen, bis Sie mit /effort oder dem /model Picker eine Stufe für sie wählen. Ein Top-Level effortLevel in Projekt-, lokalen oder verwalteten Einstellungen oder einer, der mit --settings übergeben wird, gilt für jedes Modell.
Wenn Sie low, medium, high oder xhigh in einer interaktiven Sitzung auf Ihrem Computer einstellen, bestimmen Sie durch die Art der Bestätigung, wie lange die Stufe gilt:
Enterim/effortSlider oder dem/modelPicker oder eine Stufe, die nach/efforteingegeben wird: Speichert die Stufe als Ihren Standard und wendet sie in späteren Sitzungen ansim/effortSlider oder dem/modelPicker: Wendet die Stufe nur auf diese Sitzung an. Erfordert Claude Code v2.1.257 oder später
Claude Code speichert die Stufe pro Modell unter dem modelSettings Schlüssel in Ihren Benutzereinstellungen, sodass jedes Modell seine eigene gespeicherte Stufe behält.
max ist die tiefste Überlegungsstufe. Es sei denn, Sie stellen sie über die CLAUDE_CODE_EFFORT_LEVEL Umgebungsvariable ein, wendet Claude Code max nur auf die aktuelle Sitzung an.
Eine Stufe, die Sie über die Effort-Steuerung auf einem Telefon oder in einem Browser auswählen, die über Remote Control verbunden sind, gilt nur für diese Sitzung.
Wenn Sie eine Stufe mit /effort in einem -p Lauf einstellen, wendet Claude Code sie nur auf diese Sitzung an und speichert sie nicht als Ihren Standard.
Der /effort Slider hat auch einen Ultracode Umschalter. Ultracode ist eine Claude Code-Einstellung statt einer Effort-Stufe des Modells: Wenn es eingeschaltet ist, orchestriert Claude dynamische Workflows für substantielle Aufgaben, auf welcher Effort-Stufe auch immer die Sitzung läuft. Wo es dauerhaft eingestellt werden kann, erfahren Sie bei der ultracode Einstellung.
Das Ein- oder Ausschalten von Ultracode mit /effort oder der ultracode Einstellung lässt die Effort-Stufe unverändert. Das --effort ultracode Flag und der Agent SDK effortLevel: "ultracode" Wert schalten es ein und stellen zusätzlich die Stufe auf xhigh ein. Das Auswählen einer Stufe im /effort Slider oder dem /model Picker lässt Ultracode unverändert.
Sie können Ultracode auf eine der folgenden Arten einschalten:
/effort: Führen Sie/effort ultracodeaus, um es für die aktuelle Sitzung einzuschalten, oder/effort ultracode off, um es auszuschalten. Drücken Sie im/effortSliderTab, um den Ultracode Umschalter umzulegen, dannEnter, um es anzuwenden--effortFlag: Starten Sie mitclaude --effort ultracode, das die Sitzung mitxhighEffort und eingeschaltetem Ultracode startetultracodeEinstellung: Stellen Sie"ultracode": truein einer Einstellungsdatei, mit--settingsoder in einer Agent SDK Steuerungsanfrage ein. EineapplyFlagSettings()Anfrage akzeptiert aucheffortLevel: "ultracode", was es einschaltet und die Effort-Stufe aufxhighsetzt
Die Form /effort ultracode off, der Slider-Umschalter und das Beibehalten von Ultracode bei anderen Effort-Stufen als xhigh erfordern Claude Code v2.1.284 oder später. Vor v2.1.284 setzte das Einschalten von Ultracode die Sitzung auf xhigh Effort, das Auswählen einer anderen Stufe schaltete es aus und eine Effort-Obergrenze unter xhigh machte es nicht verfügbar.
Das Übergeben von ultracode an das --effort Flag oder den Agent SDK effortLevel Wert erfordert Claude Code v2.1.203 oder später. Vor v2.1.203 gab --effort ultracode Unknown --effort value 'ultracode' aus und die Sitzung startete mit dem Standard-Effort.
Die persistierte effortLevel Einstellung und die CLAUDE_CODE_EFFORT_LEVEL Umgebungsvariable akzeptieren ultracode nicht. Wenn CLAUDE_CODE_EFFORT_LEVEL oder eine Effort-Obergrenze die Stufe der Sitzung setzt, bleibt Ultracode bei dieser Stufe eingeschaltet.
Ultracode ist nicht verfügbar, wenn:
- Workflows ausgeschaltet sind
- Das Modell
xhighEffort nicht unterstützt
In diesen Fällen startet --effort ultracode die Sitzung mit ausgeschaltetem Ultracode, auf der höchsten Effort-Stufe, die das Modell und eine etwaige Obergrenze erlauben, bis zu xhigh.
Wählen Sie eine Effort-Stufe
Jede Stufe wägt Token-Verbrauch gegen Leistungsfähigkeit ab. Der Standard passt zu den meisten Codierungsaufgaben; passen Sie ihn an, wenn Sie ein anderes Gleichgewicht möchten.
| Stufe | Wann man sie verwendet |
|---|---|
low |
Schnelle Austausche, bei denen Sie jedes Ergebnis überprüfen, wie Brainstorming, eine erste Skizze oder eine kleine Änderung wie eine Umbenennung |
medium |
Der Standard auf Opus 5.5, Sonnet 5.5 und Haiku 5.5. Auf Opus 5.5 und Sonnet 5.5 passt er zu alltäglicher Entwicklungsarbeit mit klarem Umfang, wie der Implementierung einer neuen Funktion. Auf Modellen mit einem höheren Standard reduziert er die Token-Nutzung für kostensensible Arbeit, die etwas Intelligenz opfern kann |
high |
Arbeit, bei der Überprüfung wichtig ist oder Grenzfälle wahrscheinlich sind, wie das Beheben eines Fehlers in einer bestehenden Codebasis. Der Standard auf jedem Modell außer Opus 5.5, Sonnet 5.5, Haiku 5.5 und Opus 4.7 |
xhigh |
Tiefere Überlegungen bei höherem Token-Verbrauch. Der Standard auf Opus 4.7 |
max |
Schwierige Probleme, die Claude ohne Sie durcharbeiten soll, wie das Finden von Sicherheitslücken. max kann abnehmende Erträge zeigen und neigt zum Überdenken, daher testen Sie es, bevor Sie es breit einführen |
ultracode |
Eine Claude Code-Einstellung statt einer Stufe: plant einen dynamischen Workflow für jede substantielle Aufgabe auf jeder Effort-Stufe |
In Tests auf Opus 5.5 und Fable 5.1 testete Claude auf einer höheren Stufe mehr Grenzfälle und überprüfte mehr seiner Arbeit, bevor es antwortete. Es traf auch mehr Entscheidungen auf eigene Faust. Auf einer niedrigeren Stufe gab Claude einen Ausgangspunkt schneller zurück, was zu Arbeit passt, bei der Sie jedes Ergebnis überprüfen und den nächsten Schritt steuern. Um die gleichen Aufgaben auf jeder Stufe ausgeführt zu sehen, lesen Sie Using Claude Code: Spending your effort auf dem Blog.
Die Effort-Skala ist pro Modell kalibriert, daher steht der gleiche Stufenname nicht über alle Modelle hinweg für den gleichen zugrunde liegenden Wert.
Opus 5.5 verwendet standardmäßig medium, eine Stufe unter dem Standard high von Opus 5. In Anthropics Tests erreichte oder übertraf Opus 5.5 bei medium Opus 5 bei high in Evaluierungen zu Codierung und Wissensarbeit. Auf einer gegebenen Stufe denkt Opus 5.5 tendenziell mehr pro Turn nach als Opus 5. Wenn Sie von Opus 5 zu Opus 5.5 wechseln, beginnen Sie bei medium, anstatt die Stufe zu übernehmen, die Sie auf Opus 5 verwendet haben. Um Stufen an Ihrer eigenen Arbeit zu testen, siehe Calibrate effort im Opus 5.5 Prompting-Leitfaden.
Verwenden Sie Ultrathink für einmalige tiefe Überlegungen
Fügen Sie ultrathink an beliebiger Stelle in Ihren Prompt ein, um tiefere Überlegungen für diesen Turn anzufordern, ohne Ihre Effort-Einstellung für die Sitzung zu ändern. Claude Code erkennt das Schlüsselwort und fügt eine In-Context-Anweisung hinzu. Die an die API gesendete Effort-Stufe bleibt unverändert. Claude Code leitet andere Phrasen wie "think", "think hard" und "think more" als gewöhnlichen Prompt-Text weiter und erkennt sie nicht als Schlüsselwörter.
Stellen Sie die Effort-Stufe ein
Sie können den Effort auf eine der folgenden Arten ändern:
/effort: Führen Sie/effortohne Argumente aus, um einen interaktiven Slider zu öffnen,/effortgefolgt von einem Stufennamen, um sie direkt einzustellen, oder/effort auto, um Ihre gespeicherte Stufe für das aktive Modell zu löschen. Sie können es ausführen, während Claude arbeitet, und sobald Sie die Cache-Warnung bestätigen, falls Claude Code eine anzeigt, wendet Claude Code die neue Stufe auf die nächste Anfrage im Turn an- In
/model: Verwenden Sie die Pfeiltasten links/rechts, um den Effort-Slider anzupassen, wenn Sie ein Modell auswählen --effortFlag: Übergeben Sie einen Stufennamen, um ihn beim Start von Claude Code für eine einzelne Sitzung einzustellen- Umgebungsvariable: Setzen Sie
CLAUDE_CODE_EFFORT_LEVELauf einen Stufennamen oderauto - Einstellungen: Stellen Sie eine Stufe pro Modell in
modelSettingsein oder setzen SieeffortLevelauflow,medium,highoderxhighals Standard für Modelle ohne eigene Stufe.maxwird in keinem der beiden Schlüssel als Stufe akzeptiert, undultracodehat seinen eigenenultracodeSchlüssel - Von einem verbundenen Gerät: Wählen Sie in einer Remote Control-Sitzung eine Stufe über die Effort-Steuerung auf Ihrem Telefon oder in Ihrem Browser. Die Stufe gilt nur für die aktuelle Sitzung. Erfordert Claude Code v2.1.234 oder später
- Skill- und Subagent-Frontmatter: Stellen Sie
effortin einer Skill- oder Subagent-Markdown-Datei ein, um die Effort-Stufe zu überschreiben, wenn dieser Skill oder Subagent läuft
Der Frontmatter-Effort gilt, wenn dieser Skill oder Subagent aktiv ist, und überschreibt die Sitzungsstufe, aber nicht die Umgebungsvariable. Ein maxEffortLevel oder eine Effort-Obergrenze der Organisation begrenzt weiterhin die Stufe, auf der der Skill oder Subagent läuft.
Wenn Sie effortLevel in verwalteten Einstellungen einstellen, wendet Claude Code es beim Einstellungsschritt der Effort-Auflösungsreihenfolge an, und Benutzer können die Stufe weiterhin mit /effort oder --effort ändern. Um Benutzer bei oder unter einer Stufe zu halten, stellen Sie maxEffortLevel ein.
Der Effort-Slider erscheint in /model, wenn ein unterstütztes Modell ausgewählt ist. Die aktuelle Effort-Stufe wird auch in der Sitzungskopfzeile neben dem Modellnamen angezeigt, zum Beispiel "with low effort", sodass Sie bestätigen können, welche Einstellung aktiv ist, ohne /model zu öffnen. Die Fußzeile zeigt die Effort-Stufe außerdem kurz beim Start und bei jeder Änderung an.
Adaptive Überlegungen und feste Thinking-Budgets
Adaptive Überlegungen machen Thinking bei jedem Schritt optional, sodass Claude schneller auf alltägliche Prompts reagieren und tiefere Überlegungen für Schritte reservieren kann, die davon profitieren. Wenn Sie möchten, dass Claude häufiger oder seltener nachdenkt, als die aktuelle Stufe ergibt, können Sie dies direkt in Ihrem Prompt oder in CLAUDE.md sagen; das Modell reagiert auf diese Anleitung innerhalb seiner Effort-Einstellung.
Fable-Modelle, Sonnet 5 und später, Haiku 5.5 sowie Opus 4.7 und später verwenden immer adaptive Überlegungen. Der Modus mit festem Thinking-Budget und CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING gelten für sie nicht.
Auf Opus 4.6 und Sonnet 4.6 können Sie CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING=1 setzen, um zum vorherigen festen Thinking-Budget zurückzukehren, das von MAX_THINKING_TOKENS gesteuert wird. Siehe Umgebungsvariablen.
Extended Thinking
Extended Thinking ist die Überlegung, die Claude vor der Antwort ausgibt. Auf Modellen, die adaptive Überlegungen unterstützen, ist die Effort-Stufe die primäre Steuerung dafür, wie viel nachgedacht wird; die Einstellungen unten schalten Thinking ein oder aus und steuern, wie es angezeigt wird. Wenn Thinking auf der Anthropic API ausgeschaltet ist, sendet Claude Code stattdessen Effort high statt einer höheren Stufe an Modelle, von denen es weiß, dass sie diese Kombination nicht akzeptieren, wie Opus 5.
| Steuerung | Wie man sie einstellt |
|---|---|
| Umschalter für die aktuelle Sitzung | Drücken Sie Option+T auf macOS oder Alt+T auf Windows und Linux |
| Den globalen Standard festlegen | Führen Sie /config aus und schalten Sie den Thinking-Modus um. Gespeichert als alwaysThinkingEnabled in ~/.claude/settings.json |
| Über eine Umgebungsvariable deaktivieren | Setzen Sie MAX_THINKING_TOKENS=0, was Thinking auf der Anthropic API ausschaltet, außer auf Opus 5.5, Sonnet 5.5, Haiku 5.5 und Fable-Modellen. Bei Drittanbieter-Providern lässt Claude Code stattdessen den thinking Parameter weg, und Modelle mit adaptiven Überlegungen können weiterhin nachdenken |
Sie können Thinking auf Opus 5.5, Sonnet 5.5, Haiku 5.5 oder den Fable-Modellen nicht ausschalten. Der Sitzungs-Umschalter und die /config Zeile zeigen für diese Modelle Thinking can't be turned off an, statt den Schalter anzubieten, und ein gespeichertes alwaysThinkingEnabled: false oder MAX_THINKING_TOKENS=0 hat dort keine Wirkung. Auf diesen Modellen entscheidet das Modell pro Schritt basierend auf der Effort-Stufe, wie viel es nachdenkt. Die gespeicherte Einstellung gilt wieder, wenn Sie zu einem Modell wechseln, das sie akzeptiert.
Claude Code klappt die Thinking-Ausgabe standardmäßig zusammen. Drücken Sie Ctrl+O, um den ausführlichen Modus umzuschalten und die Überlegungen als grauen kursiven Text zu sehen. Interaktive Sitzungen auf der Anthropic API erhalten standardmäßig redigierte Thinking-Blöcke, daher setzen Sie showThinkingSummaries: true in Einstellungen, wenn die vollständigen Zusammenfassungen beim Aufklappen verfügbar sein sollen. Ihnen werden alle generierten Thinking-Token berechnet, auch wenn sie zusammengeklappt oder redigiert sind.
Erweiterter Kontext
Fable 5.1, Fable 5, Sonnet 5 und später, Haiku 5.5, Opus 4.6 und später sowie Sonnet 4.6 unterstützen ein Kontextfenster mit 1 Million Token für lange Sitzungen mit großen Codebasen.
Fable 5.1, Fable 5, Sonnet 5 und später, Haiku 5.5 sowie Opus 4.7 und später laufen standardmäßig mit dem 1M-Fenster, ohne dass ein [1m] Suffix nötig ist. Das schließt Sitzungen auf Amazon Bedrock, Google Cloud's Agent Platform und Microsoft Foundry sowie Sitzungen über das Claude apps gateway ein. Um sie stattdessen mit einem 200K-Fenster auszuführen, siehe 1M-Kontext ausschalten.
Opus 4.6 und Sonnet 4.6 erreichen 1M nur durch ihre [1m] Variante, und der Zugriff auf diese Variante hängt von Ihrem Plan ab. Auf Max-, Team- und Enterprise-Plänen, einschließlich sowohl Team Standard als auch Team Premium Plätze, ist Opus 4.6 mit 1M-Kontext in Ihrem Abonnement enthalten. Sonnet 4.6 mit 1M-Kontext erfordert Nutzungsguthaben auf jedem Abonnementplan, einschließlich Max.
| Plan | Opus 4.6 mit 1M-Kontext | Sonnet 4.6 mit 1M-Kontext |
|---|---|---|
| Max, Team und Enterprise | In Abonnement enthalten | Erfordert Nutzungsguthaben |
| Pro | Erfordert Nutzungsguthaben | Erfordert Nutzungsguthaben |
| API und Pay-as-you-go | Vollständiger Zugriff | Vollständiger Zugriff |
Claude Code überprüft diese Plan-Anforderungen nur, wenn es sich direkt mit der Anthropic API verbindet. Wenn Sie ANTHROPIC_BASE_URL auf ein LLM-Gateway verweisen lassen und Ihr gespeicherter claude.ai-Login die aktiven Anmeldedaten bleibt, überprüft Claude Code das Nutzungsguthaben Ihres Plans nicht. Die [1m] Optionen bleiben in /model verfügbar und das Gateway entscheidet, ob die Anfrage erfolgreich ist. Vor v2.1.229 lehnte Claude Code /model sonnet[1m] in dieser Konfiguration ab, wenn es das Nutzungsguthaben auf dem Konto nicht bestätigen konnte.
Auf der Anthropic API verwendet das 1M-Kontextfenster die Standard-Modellpreise ohne Aufpreis für Token über 200K, außer bei Haiku 5.5, das bei Prompts mit mehr als 100K Token mehr kostet. Für Pläne, bei denen erweiterter Kontext in Ihrem Abonnement enthalten ist, bleibt die Nutzung durch Ihr Abonnement abgedeckt. Für Pläne, die über Nutzungsguthaben auf erweiterten Kontext zugreifen, werden Token über das Nutzungsguthaben abgerechnet.
1M-Kontext für Opus 4.6 oder Sonnet 4.6 auswählen
Um eine 1M-Variante per Namen auszuwählen, hängen Sie das [1m] Suffix an einen Modell-Alias oder einen vollständigen Modellnamen an:
# Append [1m] to a full model name
/model claude-opus-4-6[1m]
/model claude-sonnet-4-6[1m]
# Or to an alias: the suffix applies to the model the alias resolves to
/model opus[1m]
Kontextfenster hinter einem LLM-Gateway
Wenn Sie ANTHROPIC_BASE_URL auf ein LLM-Gateway oder einen anderen Proxy setzen, gibt Claude Code jedem Modell, das es erkennt, das gleiche Kontextfenster, das das Modell auf der Anthropic API hat. Fable 5.1, Fable 5, Sonnet 5 und später, Haiku 5.5 sowie Opus 4.7 und später erhalten das 1M-Fenster, ohne dass eine [1m] Variante ausgewählt werden muss, und ein Modell, das 1M nur über seine [1m] Variante erreicht, wie Opus 4.6, läuft ohne sie mit 200K. Claude Code kann ein niedrigeres Limit, das das Gateway oder der dahinterliegende Server erzwingt, nicht erkennen. Wenn Ihr Gateway Anfragen über 200K Token ablehnt, setzen Sie CLAUDE_CODE_AUTO_COMPACT_WINDOW=200000 in der Umgebung, die Claude Code startet, damit Sitzungen auf jedem Modell an dieser Grenze komprimieren.
1M-Kontext ausschalten
Um Sitzungen bei einem 200K-Fenster zu halten, setzen Sie CLAUDE_CODE_DISABLE_1M_CONTEXT=1 in Ihrer Shell oder in einer Einstellungsdatei. Claude Code entfernt die [1m] Modellvarianten aus dem Modell-Picker. Auf Modellen, die standardmäßig mit dem 1M-Fenster laufen, wie den Fable-Modellen, Sonnet 5 und später sowie Opus 4.7 und später, behandelt es das Modell außerdem so, als hätte es ein 200K-Kontextfenster:
- Bei eingeschalteter automatischer Komprimierung komprimieren Sitzungen an der 200K-Grenze durch automatische Komprimierung. Ein Fenster für die automatische Komprimierung über 200K hebt diese Begrenzung nicht auf, da Claude Code dieses Fenster auf das Kontextfenster des Modells begrenzt.
- Bei ausgeschalteter automatischer Komprimierung stoppen Sitzungen an der 200K-Grenze mit dem Kontext-Limit-Fehler, statt zu komprimieren.
Haiku 5.5 Kontextfenster und Preise
Auf der Anthropic API läuft Haiku 5.5 auf jedem Plan mit dem 1M-Kontextfenster, ohne dass ein [1m] Suffix ausgewählt werden muss. Seine Modell-ID ist claude-haiku-5-5. Um es zu verwenden, führen Sie /model claude-haiku-5-5 in einer Sitzung aus oder starten Sie Claude Code aus Ihrer Shell mit claude --model claude-haiku-5-5.
Eine Haiku 5.5-Anfrage kostet pro Token mehr, wenn ihr Prompt länger als 100K Token ist. Siehe Anthropic-Preise für beide Tarife.
Sitzungen komprimieren standardmäßig bei etwa 967K Token automatisch. Um früher zu komprimieren, legen Sie ein kleineres Fenster für die automatische Komprimierung für das Modell fest.
Kontextfenster und automatische Komprimierung
Das Fenster für automatische Komprimierung bestimmt, wie voll das Kontextfenster werden kann, bevor Claude Code die Konversation komprimiert. Informationen darüber, was die Komprimierung pro Mechanismus behält und verwirft, finden Sie unter Was die Komprimierung übersteht.
Fenster für automatische Komprimierung einstellen
Sie können das Fenster für automatische Komprimierung an diesen Stellen einstellen:
- Für das aktuelle Modell, in dieser Sitzung und späteren: Führen Sie
/autocompactmit einem Wert aus, z. B./autocompact 500k. Claude Code speichert es in Ihren Benutzereinstellungen unter dem aktuellen Modell inmodelSettingsund wendet es auf die aktuelle Sitzung an. Wenn ein höher priorisierter Geltungsbereich für Einstellungen wie verwaltete Einstellungen ein eigenes Fenster für dieses Modell oder für jedes Modell festlegt, speichert der Befehl Ihren Wert, aber die Sitzung behält das Fenster dieses Geltungsbereichs bei, und der Befehl teilt dies mit. Führen Sie/autocompact autoaus, um zum für Ihr Modell optimierten Fenster zurückzukehren. Vor v2.1.288 speicherte der Befehl ein einziges Fenster für jedes Modell, alsautoCompactWindowauf oberster Ebene. - Für jedes Modell: Setzen Sie
autoCompactWindowin einer Einstellungsdatei, z. B."autoCompactWindow": 200000in~/.claude/settings.json. Ein Fenster, das Sie mit/autocompactfür ein Modell gespeichert haben, hat für dieses Modell Vorrang vor diesem Schlüssel in derselben Datei. - Für einen Start: Übergeben Sie
--autocompactbeim Starten von Claude Code. Das Flag überschreibt Ihre gespeicherte Einstellung für diesen Start, ohne sie zu ändern, undclaude --autocompact autoführt die Sitzung mit dem optimierten Fenster aus, auch wenn Ihre gespeicherte Einstellung einen Wert hat. Im Gegensatz zu/autocompactwird das Flag nicht durch einen höher priorisierten Geltungsbereich für Einstellungen wie verwaltete Einstellungen verdrängt. - In Skripten und Cloud-Umgebungen: Setzen Sie
CLAUDE_CODE_AUTO_COMPACT_WINDOW. Während es gesetzt ist, hat es Vorrang vor dem Befehl, dem Flag und der Einstellung, und/autocompactmeldet die Überschreibung, anstatt das Fenster zu ändern.
Der Befehl und das Flag akzeptieren eine Fenstergröße von 100K bis 1M Token in einer dieser Formen:
- Eine einfache Token-Anzahl, z. B.
200000 - Ein
k- oderM-Suffix, z. B.500koder1M - Eine bloße Zahl von 100 bis 1000, was Tausende bedeutet, also setzt
200200.000
Die Umgebungsvariable akzeptiert nur die einfache Token-Anzahl. Claude Code begrenzt das Fenster auf das Kontextfenster des Modells.
Standard-Schwellwerte für automatische Komprimierung
Wenn Sie kein Fenster für automatische Komprimierung einstellen, komprimiert Claude Code, wenn die Konversation das Kontextlimit des Modells erreicht, außer in diesen Sitzungen:
- Cloud-Sitzungen komprimieren, wenn sich die Konversation dem Limit des Modells nähert
- Sonnet 4.6 und Opus 4.6 ohne erweiterten Kontext komprimieren bei der 200K-Grenze
- Wenn Sie
CLAUDE_CODE_DISABLE_1M_CONTEXT=1setzen, komprimieren Modelle mit einem nativen 1M-Fenster, wie Sonnet 5 und die Fable-Modelle, bei der 200K-Grenze - Modelle, die mit einem nativen 1M-Fenster laufen, komprimieren, bevor das Fenster voll wird, standardmäßig bei etwa 967K Token. Dazu gehören die Fable-Modelle, Sonnet 5 und später, Haiku 5.5 sowie Opus 4.7 und später. Hinter einer benutzerdefinierten
ANTHROPIC_BASE_URLsiehe das Kontextfenster hinter einem Gateway - Sitzungen auf einer Modell-ID, die Claude Code nicht erkennt, z. B. ein LLM-Gateway-Alias, komprimieren bei dem Kontextfenster, das Claude Code für die ID annimmt; siehe Fenster für ein Gateway oder eine benutzerdefinierte Modell-ID korrigieren
Fenster für ein Gateway oder eine benutzerdefinierte Modell-ID korrigieren
Bei einem LLM-Gateway oder einer anderen benutzerdefinierten Bereitstellung kann Claude Code ein Kontextfenster für die Modell-ID annehmen, das sich vom echten Fenster des Modells unterscheidet, unabhängig davon, ob es die ID zu einem Claude-Modell auflöst oder nicht. Setzen Sie CLAUDE_CODE_MAX_CONTEXT_TOKENS auf das Fenster, das Claude Code stattdessen annehmen sollte.
Wie die Variable angewendet wird, hängt von der ID ab. Claude Code behandelt eine ID als Anbieter oder benutzerdefinierte Schreibweise, wenn sie nicht mit claude- beginnt, in beliebiger Schreibweise, oder wenn sie ein Suffix trägt, das Claude Code beim Lesen der ID entfernt, z. B. das @YYYYMMDD-Datum, das auf Google Cloud's Agent Platform verwendet wird. Vor v2.1.259 zählte Claude Code ein entferntes Suffix nicht, daher wurde eine nicht erkannte claude--ID mit einem Datumssuffix als bloßer claude--Name behandelt.
Eine nicht erkannte Anbieter- oder benutzerdefinierte Schreibweise, dieselbe Schreibweise mit [1m] und jede andere ID sind drei separate Fälle:
-
Wenn Claude Code einen Anbieter oder eine benutzerdefinierte Schreibweise nicht zu einem Modell auflösen kann, das es erkennt, und die ID kein
[1m]enthält, wird die Variable direkt angewendet und die proaktive Komprimierung wird bei dem deklarierten Fenster fortgesetzt. -
Wenn Claude Code einen Anbieter oder eine benutzerdefinierte Schreibweise nicht zu einem Modell auflösen kann, das es erkennt, und die ID enthält
[1m], in beliebiger Schreibweise, nimmt Claude Code ein 1M-Fenster dafür an und die Variable wird nicht von selbst angewendet. Um das Fenster zu korrigieren und gleichzeitig die proaktive Komprimierung beizubehalten, setzen Sie auchCLAUDE_CODE_DISABLE_1M_CONTEXT=1. Mit dieser Variable gesetzt, dimensioniert Claude Code die ID wie dieselbe Schreibweise ohne[1m], daher wirdCLAUDE_CODE_MAX_CONTEXT_TOKENSangewendet, wenn es auf diese ungetaggte Schreibweise angewendet würde.Mit einem deklarierten Fenster über 200K zeigt Claude Code dann eine Startwarnung an, dass das 200K-Limit nicht erzwungen wird. Die Warnung ist in dieser Konfiguration zu erwarten.
-
Wenn die ID zu einem Modell aufgelöst wird, das Claude Code erkennt, oder die ID ein bloßer
claude--Name ohne Suffix ist, das Claude Code entfernen kann, in beliebiger Schreibweise, wird die Variable nur wirksam, wenn auchDISABLE_COMPACTgesetzt ist, was alle Komprimierung deaktiviert.Beispielsweise löst eine ID, die einen Claude-Modellnamen enthält, den Claude Code kennt, wie
anthropic/claude-opus-4-8,us.anthropic.claude-…-v1:0, oder das datierteclaude-sonnet-4-5@20250929, zu diesem Modell auf. Dies umfasst IDs, die auch[1m]enthalten: Claude Code löstclaude-opus-4-8[1m]zu Opus 4.8 auf, auch wennCLAUDE_CODE_DISABLE_1M_CONTEXTgesetzt ist.
Für eine Modell-ID, die Claude Code nicht erkennt, setzen Sie CLAUDE_CODE_DISABLE_UNKNOWN_MODEL_WINDOW_ENFORCEMENT=1, damit Claude Code nur komprimiert, nachdem die API die Konversation mit einem zu-langen Fehler, den Claude Code erkennt, ablehnt. Claude Code führt diese Wiederherstellung nicht aus, wenn ein Gateway den Fehler zu einer Formulierung umschreibt, die Claude Code nicht erkennt.
Überprüfung Ihres aktuellen Modells
Sie können sehen, welches Modell Sie derzeit verwenden, an zwei Stellen:
- In der Statuszeile, falls Sie eine konfiguriert haben
- In
/status, das auch Ihre Kontoinformationen anzeigt
Benutzerdefinierte Modelloption hinzufügen
Verwenden Sie ANTHROPIC_CUSTOM_MODEL_OPTION, um einen einzelnen benutzerdefinierten Eintrag zur /model-Auswahl hinzuzufügen, ohne die integrierten Aliase zu ersetzen. Dies ist nützlich zum Testen von Modell-IDs, die Claude Code standardmäßig nicht auflistet. Für LLM-Gateway-Bereitstellungen kann Claude Code die Auswahl vom /v1/models-Endpunkt des Gateways auffüllen, wenn CLAUDE_CODE_ENABLE_GATEWAY_MODEL_DISCOVERY=1 gesetzt ist. Daher ist diese Variable nur erforderlich, wenn die Erkennung deaktiviert ist oder das gewünschte Modell nicht zurückgibt. Siehe Gateway-Modellauswahl.
Um stattdessen mehrere Modelle aufzulisten, in Ihrer eigenen Reihenfolge und unter Bezeichnungen Ihrer Wahl, setzen Sie modelPicker. Der Eintrag gibt an, welche Zeilen die Auswahl behält, wenn diese Aufstellung die integrierte ersetzt.
Dieses Beispiel setzt alle drei Variablen, um eine Gateway-gesteuerte Opus-Bereitstellung auswählbar zu machen. Claude Code liest Umgebungsvariablen beim Start, daher führen Sie die Exporte vor dem Starten von claude aus oder starten Sie eine vorhandene Sitzung neu, um sie zu übernehmen:
export ANTHROPIC_CUSTOM_MODEL_OPTION="my-gateway/claude-opus-5-5"
export ANTHROPIC_CUSTOM_MODEL_OPTION_NAME="Opus via Gateway"
export ANTHROPIC_CUSTOM_MODEL_OPTION_DESCRIPTION="Custom deployment routed through the internal LLM gateway"
ANTHROPIC_CUSTOM_MODEL_OPTION_NAME und ANTHROPIC_CUSTOM_MODEL_OPTION_DESCRIPTION sind optional:
- Wenn Sie den Namen weglassen, zeigt der Eintrag den Namen des Modells an, wenn Claude Code die ID erkennt, und die Modell-ID andernfalls.
- Wenn Sie die Beschreibung weglassen, verwendet Claude Code
Custom model (<model-id>).
Claude Code listet den benutzerdefinierten Eintrag nach den integrierten Einträgen auf, und alle modelPicker-Zeilen, die Sie anhängen, kommen danach.
Claude Code überspringt die Validierung für die Modell-ID, die in ANTHROPIC_CUSTOM_MODEL_OPTION gesetzt ist, daher können Sie jeden String verwenden, den Ihr API-Endpunkt akzeptiert.
Wenn availableModels gesetzt ist, fügen Sie die benutzerdefinierte Modell-ID auch in die Zulassungsliste ein. Andernfalls filtert Claude Code den benutzerdefinierten Eintrag aus der Auswahl und lehnt eine --model-Auswahl davon wie jedes andere ausgeschlossene Modell ab.
Eine benutzerdefinierte ID, die einen Familiennamen einbettet, wie z. B. my-gateway/claude-opus-5-5, zählt als spezifischer Eintrag für diese Familie und deaktiviert deren Wildcard. Daher müssen Sie auch die Versionen auflisten, die Sie auswählbar halten möchten. Siehe Zusammenführungsverhalten.
Umgebungsvariablen
Verwenden Sie die folgenden Umgebungsvariablen, um die Modellnamen zu steuern, auf die die Aliase verweisen. Jeder Wert muss ein vollständiger Modellname oder das entsprechende Äquivalent für Ihren API-Anbieter sein. Um das Modell auszuwählen, mit dem Ihre Sitzungen starten, setzen Sie ANTHROPIC_DEFAULT_MODEL, das diese Tabelle auslässt.
| Umgebungsvariable | Beschreibung |
|---|---|
ANTHROPIC_DEFAULT_FABLE_MODEL |
Das Modell, das für fable verwendet werden soll, und die Modell-ID, die Claude Code als Fable-Modell für automatisches Modell-Fallback bei Drittanbieter-Anbietern erkennt |
ANTHROPIC_DEFAULT_OPUS_MODEL |
Das Modell, das für opus verwendet werden soll, oder für opusplan, wenn der Plan-Modus aktiv ist. |
ANTHROPIC_DEFAULT_SONNET_MODEL |
Das Modell, das für sonnet verwendet werden soll, oder für opusplan, wenn der Plan-Modus nicht aktiv ist. |
ANTHROPIC_DEFAULT_HAIKU_MODEL |
Das Modell, das für haiku verwendet werden soll, oder Hintergrundfunktionalität |
CLAUDE_CODE_SUBAGENT_MODEL |
Das Standard-Modell für Subagenten, Agent-Team-Kollegen und Workflow-Agenten, denen auf andere Weise kein Modell zugewiesen ist. Akzeptiert einen Alias wie haiku oder einen vollständigen Modellnamen. Ein Modell pro Aufruf oder das model-Feld einer Definition, einschließlich inherit, hat Vorrang. Um das zu ändern, setzen Sie CLAUDE_CODE_SUBAGENT_MODEL_FORCE |
Bei Drittanbieter-Anbietern beschreibt Anzeige und Funktionen des fixierten Modells anpassen, was eine fixierte Modell-Zeile in der /model-Auswahl anzeigt.
Hinweis: ANTHROPIC_SMALL_FAST_MODEL ist veraltet zugunsten von
ANTHROPIC_DEFAULT_HAIKU_MODEL.
Modelle für Drittanbieter-Bereitstellungen fixieren
Beim Bereitstellen von Claude Code über Amazon Bedrock, Google Cloud's Agent Platform, Microsoft Foundry oder Claude Platform on AWS sollten Sie Modellversionen vor dem Rollout für Benutzer fixieren.
Ohne Fixierung verwendet Claude Code Modellaliase wie fable, opus, sonnet und haiku, die zur integrierten Standard-Modell-ID für jeden Anbieter aufgelöst werden. Dieser Standard kann hinter der neuesten Anthropic-Veröffentlichung zurückbleiben, und das Modell, auf das er verweist, ist möglicherweise noch nicht in einem Benutzerkonto aktiviert. Wenn der Standard nicht verfügbar ist, sehen Amazon Bedrock- und Google Cloud's Agent Platform-Benutzer einen Hinweis und die Sitzung greift auf eine frühere Version des Standard-Modells zurück, oder auf das Standard-Sonnet-Modell, wenn der Standard ein Opus-Modell ist und keine Opus-Version verfügbar ist. Microsoft Foundry-Benutzer sehen stattdessen Fehler, da Microsoft Foundry keine entsprechende Startprüfung hat.
Bei Amazon Bedrock und Google Cloud's Agent Platform fixiert ein Benutzer, der die Sitzung auf einer bestimmten Sonnet- oder Opus-Version startet, beispielsweise mit --model, ANTHROPIC_MODEL oder der model-Einstellung, diese Version als Standard der Sitzung für den entsprechenden Alias: Die Startprüfung überspringt den integrierten Standard, den sie ersetzt, und zeigt keinen Fallback-Hinweis. Vor v2.1.211 wurde die Prüfung ausgeführt und konnte einen Hinweis anzeigen, auch wenn ein Sitzungsmodell explizit konfiguriert war.
Setzen Sie die Modell-Umgebungsvariablen auf spezifische Versions-IDs als Teil Ihres anfänglichen Setups. Das Fixieren ermöglicht es Ihnen, zu kontrollieren, wann Ihre Benutzer zu einem neuen Modell wechseln.
Verwenden Sie die folgenden Umgebungsvariablen mit versionsspezifischen Modell-IDs für Ihren Anbieter:
| Anbieter | Beispiel |
|---|---|
| Amazon Bedrock | export ANTHROPIC_DEFAULT_OPUS_MODEL='us.anthropic.claude-opus-4-8' |
| Google Cloud's Agent Platform | export ANTHROPIC_DEFAULT_OPUS_MODEL='claude-opus-4-8' |
| Microsoft Foundry | export ANTHROPIC_DEFAULT_OPUS_MODEL='claude-opus-4-8' |
Wenden Sie das gleiche Muster auf ANTHROPIC_DEFAULT_FABLE_MODEL, ANTHROPIC_DEFAULT_SONNET_MODEL und ANTHROPIC_DEFAULT_HAIKU_MODEL an. Für aktuelle und ältere Modell-IDs über alle Anbieter hinweg siehe Modellübersicht. Um Benutzer auf eine neue Modellversion zu aktualisieren, aktualisieren Sie diese Umgebungsvariablen und stellen Sie erneut bereit.
Ein fixiertes Modell mit einem nativen 1M-Fenster, wie Opus 4.8 oder Sonnet 5, wird ohne Suffix mit dem 1M-Kontextfenster ausgeführt, wenn Claude Code die fixierte ID diesem Modell zuordnen kann. Die ID wird zugeordnet, wenn sie die Anthropic-API-ID des Modells enthält, so wie us.anthropic.claude-opus-4-8 die ID claude-opus-4-8 enthält, oder wenn ein modelOverrides-Eintrag das Modell ihr zuordnet. Bei einer fixierten ID, die Claude Code keinem Modell zuordnen kann, laufen Sitzungen standardmäßig mit einem 200K-Fenster, es sei denn, die ID trägt das [1m]-Suffix.
Für ein Modell, das 1M über seine [1m]-Variante erreicht, wie Opus 4.6 oder Sonnet 4.6, aktivieren Sie den erweiterten Kontext, indem Sie [1m] an die Modell-ID in ANTHROPIC_DEFAULT_OPUS_MODEL oder ANTHROPIC_DEFAULT_SONNET_MODEL anfügen:
export ANTHROPIC_DEFAULT_OPUS_MODEL='claude-opus-4-6[1m]'
Mit dem [1m]-Suffix wird das 1M-Kontextfenster auf alle Verwendungen des fixierten Alias angewendet, einschließlich der Plan-Modus-Opus-Phase von opusplan und Subagenten, deren model-Frontmatter den Alias benennt.
- Claude Code entfernt das Suffix, bevor die Modell-ID an Ihren Anbieter gesendet wird.
- Fügen Sie
[1m]nur an, wenn das zugrunde liegende Modell 1M-Kontext unterstützt. - Das Suffix wird pro Variable gelesen, nicht pro Modell. Bei Amazon Bedrock, Google Cloud's Agent Platform und Microsoft Foundry verwendet eine Opus-4.6- oder Sonnet-4.6-ID ohne
[1m]in einer Variable 200K-Kontext, auch wenn eine andere Variable das gleiche Modell mit dem Suffix setzt.
Wenn Sie eine ANTHROPIC_DEFAULT_*_MODEL-Variable setzen, zeigt die /model-Auswahl eine Zeile für dieses Modell anstelle der integrierten Zeilen der Familie an, einschließlich aller 1M-Kontextzeilen. Um das 1M-Fenster zu erreichen, ohne das Suffix zu dieser Variable hinzuzufügen, führen Ihre Benutzer /model opus[1m] aus, und Claude Code wendet das Suffix auf das Modell an, das die Variable benennt. /model sonnet[1m] funktioniert auf die gleiche Weise.
Eine availableModels-Allowlist, die über MDM oder eine verwaltete Einstellungsdatei bereitgestellt wird, gilt weiterhin bei Verwendung von Drittanbieter-Anbietern; server-verwaltete Einstellungen werden dort nicht bereitgestellt.
Die Filterung stimmt mit einem Modellalias wie opus, einem Versionspräfix wie claude-opus-4-8 oder der vollständigen Modell-ID in Anbieterform überein. Anbieterspezifische Präfixe wie us.anthropic. werden nicht entfernt, daher müssen Sie zum Zulassen eines bestimmten Modells die vollständige Anbieterform-ID auflisten oder sie durch modelOverrides zuordnen. Für ein fixiertes Modell ist diese ID der Wert, den Sie in seiner ANTHROPIC_DEFAULT_*_MODEL-Variable setzen. Alle [1m]-Suffixe werden sowohl aus dem Allowlist-Eintrag als auch aus dem angeforderten Modell vor dem Abgleich entfernt.
Anzeige und Funktionen des fixierten Modells anpassen
Wenn Sie ein Modell bei einem Drittanbieter fixieren, zeigt seine Zeile in der /model-Auswahl standardmäßig den Namen des Modells an, wenn Claude Code die fixierte ID erkennt, und andernfalls die rohe ID:
- Erkannt: die genaue ID eines Modells, das Claude Code kennt, wie seine Anthropic-API-ID oder die Form Ihres Anbieters oder Gateways, mit oder ohne das
[1m]-Suffix. Fixieren Sieus.anthropic.claude-sonnet-4-5-20250929-v1:0und die Zeile liestSonnet 4.5. - Nicht erkannt: jede andere ID, wie ein Anwendungs-Inferenzprofil-ARN oder eine Modellversion, die Claude Code nicht kennt, es sei denn, ein
modelOverrides-Eintrag ordnet ein Modell dieser genauen Zeichenkette zu. Bei Microsoft Foundry sind Bereitstellungsnamen benutzerdefiniert, daher erkennt Claude Code eine fixierte ID dort niemals, zugeordnet oder nicht, und die Zeile zeigt standardmäßig den Bereitstellungsnamen.
Wenn eine Zeile den Namen des Modells anzeigt, enthält seine Standardbeschreibung die fixierte ID, damit Sie immer noch sehen können, welche ID fixiert ist.
Claude Code erkennt möglicherweise auch nicht, welche Funktionen ein fixiertes Modell unterstützt. Sie können den Anzeigenamen und die Beschreibung selbst festlegen und Funktionen mit Begleit-Umgebungsvariablen für jedes fixierte Modell deklarieren.
Diese Variablen wirken sich auf Drittanbieter wie Amazon Bedrock, Google Cloud's Agent Platform und Microsoft Foundry aus. Die Variablen _NAME und _DESCRIPTION wirken sich auch aus, wenn ANTHROPIC_BASE_URL auf ein LLM-Gateway verweist. Sie haben keine Auswirkung bei direkter Verbindung zu api.anthropic.com.
| Umgebungsvariable | Beschreibung |
|---|---|
ANTHROPIC_DEFAULT_OPUS_MODEL_NAME |
Anzeigename für das fixierte Opus-Modell in der /model-Auswahl. Wenn nicht gesetzt, zeigt die Zeile den Namen des Modells an, wenn Claude Code die fixierte ID erkennt, und die fixierte ID andernfalls |
ANTHROPIC_DEFAULT_OPUS_MODEL_DESCRIPTION |
Anzeige-Beschreibung für das fixierte Opus-Modell in der /model-Auswahl. Wenn nicht gesetzt, zeigt die Zeile eine Standardbeschreibung an, die mit Custom Opus model beginnt |
ANTHROPIC_DEFAULT_OPUS_MODEL_SUPPORTED_CAPABILITIES |
Komma-getrennte Liste der Funktionen, die das fixierte Opus-Modell unterstützt |
Die gleichen _NAME-, _DESCRIPTION- und _SUPPORTED_CAPABILITIES-Suffixe sind für ANTHROPIC_DEFAULT_SONNET_MODEL, ANTHROPIC_DEFAULT_HAIKU_MODEL, ANTHROPIC_DEFAULT_FABLE_MODEL und ANTHROPIC_CUSTOM_MODEL_OPTION verfügbar.
Claude Code aktiviert Funktionen wie Effort-Stufen und Extended Thinking durch Abgleich der Modell-ID mit bekannten Mustern. Anbieterspezifische IDs wie Amazon Bedrock-ARNs oder benutzerdefinierte Bereitstellungsnamen stimmen oft nicht mit diesen Mustern überein, wodurch unterstützte Funktionen deaktiviert bleiben. Setzen Sie _SUPPORTED_CAPABILITIES, um Claude Code mitzuteilen, welche Funktionen das Modell tatsächlich unterstützt:
| Funktionswert | Aktiviert |
|---|---|
effort |
Effort-Stufen und der /effort-Befehl |
xhigh_effort |
Die xhigh-Effort-Stufe |
max_effort |
Die max-Effort-Stufe |
thinking |
Extended Thinking |
adaptive_thinking |
Adaptives Reasoning, das Thinking dynamisch basierend auf der Aufgabenkomplexität zuordnet |
interleaved_thinking |
Thinking zwischen Tool-Aufrufen |
Wenn _SUPPORTED_CAPABILITIES gesetzt ist, aktiviert Claude Code die aufgelisteten Funktionen und deaktiviert die nicht aufgelisteten für das entsprechende fixierte Modell. Wenn die Variable nicht gesetzt ist, greift Claude Code auf die integrierte Erkennung basierend auf der Modell-ID zurück.
Dieses Beispiel fixiert Opus auf ein benutzerdefiniertes Amazon Bedrock-Modell-ARN, setzt einen benutzerfreundlichen Namen und deklariert seine Funktionen:
export ANTHROPIC_DEFAULT_OPUS_MODEL='arn:aws:bedrock:us-east-1:123456789012:custom-model/abc'
export ANTHROPIC_DEFAULT_OPUS_MODEL_NAME='Opus via Bedrock'
export ANTHROPIC_DEFAULT_OPUS_MODEL_DESCRIPTION='Opus 4.7 routed through a Bedrock custom endpoint'
export ANTHROPIC_DEFAULT_OPUS_MODEL_SUPPORTED_CAPABILITIES='effort,xhigh_effort,max_effort,thinking,adaptive_thinking,interleaved_thinking'
Modell-IDs pro Version überschreiben
Auf Plattformen, die Claude Code einbetten und CLAUDE_CODE_PROVIDER_MANAGED_BY_HOST setzen, hat die Modellkonfiguration des Hosts Vorrang vor verwalteten Modelleinstellungen, während eine verwaltete availableModels-Allowlist in Kraft bleibt, es sei denn, der Host stellt seine eigene bereit; Ausnahmen vom Vorrang verwalteter Einstellungen sagt, welche Schlüssel und Variablen der Host überschreibt.
Die oben genannten Umgebungsvariablen auf Familienebene konfigurieren eine Modell-ID pro Familienalias. Wenn Sie mehrere Versionen innerhalb der gleichen Familie auf unterschiedliche Anbieter-IDs abbilden müssen, verwenden Sie stattdessen die modelOverrides-Einstellung.
modelOverrides ordnet einzelne Anthropic-Modell-IDs den anbieterspezifischen Strings zu, die Claude Code an die API Ihres Anbieters sendet. Wenn ein Benutzer ein zugeordnetes Modell in der /model-Auswahl auswählt, verwendet Claude Code Ihren konfigurierten Wert anstelle des integrierten Standards.
Dies ermöglicht es Enterprise-Administratoren, jede Modellversion zu einem bestimmten Amazon Bedrock-Inference-Profil-ARN, Google Cloud's Agent Platform-Versionsnamen oder Microsoft Foundry-Bereitstellungsnamen für Governance, Kostenzuteilung oder regionales Routing zu leiten.
Setzen Sie modelOverrides in Ihrer Einstellungsdatei:
{
"modelOverrides": {
"claude-opus-4-7": "arn:aws:bedrock:us-east-2:123456789012:application-inference-profile/opus-prod",
"claude-opus-4-6": "arn:aws:bedrock:us-east-2:123456789012:application-inference-profile/opus-46-prod",
"claude-sonnet-4-6": "arn:aws:bedrock:us-east-2:123456789012:application-inference-profile/sonnet-prod"
}
}
Schlüssel müssen Anthropic-Modell-IDs sein, wie in der Modellübersicht aufgelistet. Für datierte Modell-IDs fügen Sie das Datumssuffix genau so ein, wie es dort angezeigt wird. Unbekannte Schlüssel werden ignoriert.
Um die [claude-code:unrecognized_model]-Diagnosezeile für eine ID wie einen Gateway-Alias zu stoppen, fügen Sie einen Eintrag mit dieser ID als Wert hinzu.
Überschreibungen ersetzen die integrierten Modell-IDs, die jeden Eintrag in der /model-Auswahl unterstützen. Bei Amazon Bedrock haben modelOverrides-Einträge Vorrang vor allen Inference-Profilen, die Claude Code beim Start automatisch erkennt. Claude Code übergibt Werte, die bereits anbieterspezifisch sind, wie Amazon Bedrock-Inference-Profil-ARNs oder Microsoft Foundry-Bereitstellungsnamen, unverändert an den Anbieter.
Überschreibungen gelten auch, wenn Sie eine Anthropic-Modell-ID direkt über --model, die ANTHROPIC_MODEL-Umgebungsvariable oder eine ANTHROPIC_DEFAULT_*_MODEL-Umgebungsvariable übergeben. Bei Amazon Bedrock, Google Cloud's Agent Platform und Mantle wird eine Anthropic-Modell-ID ohne modelOverrides-Eintrag zur gleichen anbieterspezifischen ID aufgelöst wie die /model-Auswahl-Zeile für diese Version, wenn der Anbieter diese Version unterstützt. Mantle unterstützt eine Teilmenge von Versionen. Für eine Anthropic-Modell-ID außerhalb dieser Teilmenge sendet Claude Code die rohe ID an Mantle ohne Zuordnung, es sei denn, ein modelOverrides-Eintrag deckt sie ab. Vor v2.1.200 erreichten --model und die Umgebungsvariablenwerte den Anbieter unverändert, ohne die Überschreibungskarte zu durchlaufen.
modelOverrides funktioniert zusammen mit availableModels. Die Allowlist wird gegen die Anthropic-Modell-ID ausgewertet, nicht gegen den Überschreibungswert, daher stimmt ein Eintrag wie "opus" in availableModels weiterhin überein, auch wenn Opus-Versionen ARNs zugeordnet sind. Wenn enforceAvailableModels in verwalteten Einstellungen gesetzt ist, wird der erzwungene Standard ausschließlich durch modelOverrides aus verwalteten Einstellungen aufgelöst. Die Zuordnung eines Admins, wie eine Version, die an ein Inference-Profil-ARN fixiert ist, wird im erzwungenen Standard berücksichtigt. Überschreibungen aus Benutzer- oder Projekteinstellungen beeinflussen ihn nicht.
Wenn availableModels in verwalteten Einstellungen gesetzt ist, gelten nur modelOverrides aus verwalteten Einstellungen für eine Anthropic-Modell-ID, die direkt über --model oder die oben genannten Umgebungsvariablen übergeben wird. Claude Code ignoriert Überschreibungen in Benutzer- oder Projekteinstellungen für diese IDs und löst niemals eine ID auf, die die verwaltete Liste ausschließt, durch modelOverrides aus einer beliebigen Einstellungsquelle. Diese Einschränkung der verwalteten Quelle erfordert Claude Code v2.1.200 oder später. Siehe Modellauswahl einschränken, um zu erfahren, wie blockierte IDs behandelt werden.
Prompt-Caching-Konfiguration
Claude Code verwendet automatisch Prompt-Caching, um die Leistung zu optimieren und Kosten zu senken. Sie können Prompt-Caching global oder für bestimmte Modell-Tiers deaktivieren:
| Umgebungsvariable | Beschreibung |
|---|---|
DISABLE_PROMPT_CACHING |
Setzen Sie auf 1, um Prompt-Caching für alle Modelle zu deaktivieren. Hat Vorrang vor den modellspezifischen Einstellungen |
DISABLE_PROMPT_CACHING_HAIKU |
Setzen Sie auf 1, um Prompt-Caching für das Standard-Haiku-Modell zu deaktivieren |
DISABLE_PROMPT_CACHING_SONNET |
Setzen Sie auf 1, um Prompt-Caching für das Standard-Sonnet-Modell zu deaktivieren |
DISABLE_PROMPT_CACHING_OPUS |
Setzen Sie auf 1, um Prompt-Caching für das Standard-Opus-Modell zu deaktivieren |
DISABLE_PROMPT_CACHING_FABLE |
Setzen Sie auf 1, um Prompt-Caching nur für Fable-Modelle zu deaktivieren |
Um die Cache-TTL für die Hauptkonversation und für Subagenten separat auszuwählen, siehe wählen Sie die TTL selbst. Für das, was einen Cache-Miss auslöst, siehe Wie Claude Code Prompt-Caching verwendet.
Versionsverlauf
Diese Tabelle listet die Claude Code-Version auf, in der jeder Modellalias das Modell geändert hat, zu dem er aufgelöst wird, neueste zuerst.
| Version | Änderung |
|---|---|
| v2.1.293 | haiku wird zu Haiku 5.5 auf der Anthropic API aufgelöst |
| v2.1.284 | sonnet wird zu Sonnet 5.5 auf der Anthropic API aufgelöst |
| v2.1.280 | opus wird zu Opus 5.5 auf der Anthropic API, Claude Platform auf AWS, Amazon Bedrock und Google Cloud's Agent Platform aufgelöst |
| v2.1.257 | fable wird zu Fable 5.1 aufgelöst, außer in Claude Apps Gateway-Sitzungen |
| v2.1.219 | opus wird zu Opus 5 auf der Anthropic API, Claude Platform auf AWS, Amazon Bedrock und Agent Platform aufgelöst |
| v2.1.207 | opus wird zu Opus 4.8 auf Claude Platform auf AWS, Amazon Bedrock und Agent Platform aufgelöst |
| v2.1.197 | sonnet wird zu Sonnet 5 auf der Anthropic API aufgelöst |
| v2.1.154 | opus wird zu Opus 4.8 auf der Anthropic API aufgelöst |
| Früher | opus wird zu Opus 4.7 auf Claude Platform auf AWS und zu Opus 4.6 auf Amazon Bedrock und Agent Platform aufgelöst. fable wird zu Fable 5 und haiku zu Haiku 4.5 auf jedem Anbieter aufgelöst |