SpyBara
Go Premium

model-config.md 2026-10-07 23:59 UTC to 2026-10-08 20:59 UTC

This page contains 292 additions and 281 deletions.

2026
Thu 1 23:59 Fri 2 22:59 Sat 3 23:57 Sun 4 23:58 Wed 7 23:59 Thu 8 21:58

Configurazione del modello

Configurare quale modello Claude Code utilizza, livelli di impegno, contesto esteso e la finestra di auto-compattazione

Modelli disponibili

Per l'impostazione model in Claude Code, puoi configurare:

  • Un alias del modello
  • Un nome del modello
    • API Anthropic: un nome del modello completo
    • Amazon Bedrock: un ARN del profilo di inferenza
    • Microsoft Foundry: un nome di distribuzione
    • Agent Platform di Google Cloud: un nome di versione

Per indicazioni su quale modello e livello di sforzo si adattano a diversi tipi di lavoro, consulta Scelta di un modello Claude e livello di sforzo in Claude Code sul blog.

Alias dei modelli

Usa un alias del modello per selezionare le impostazioni del modello senza ricordare i numeri di versione esatti:

Alias del modello Comportamento
default Valore speciale che cancella qualsiasi override del modello e ripristina il valore predefinito di runtime per il tuo account. Non è di per sé un alias del modello
best Usa il modello in cui si risolve l'alias fable dove Fable è disponibile per te, altrimenti lo stesso modello di opus
fable Usa il modello Fable per il tuo provider per i tuoi compiti più difficili e più lunghi
sonnet Usa il modello Sonnet più recente per i compiti di programmazione quotidiani
opus Usa il modello Opus più recente per i compiti di ragionamento complesso
haiku Usa il modello Haiku veloce ed efficiente per i compiti semplici
sonnet[1m] Usa Sonnet con una finestra di contesto di 1 milione di token per sessioni lunghe. Nessun effetto quando sonnet si risolve già in Sonnet 5.5 o Sonnet 5 con la loro finestra nativa di 1M
opus[1m] Usa Opus con una finestra di contesto di 1 milione di token per sessioni lunghe. Nessun effetto quando opus si risolve già in Opus 4.7 o successivo con la sua finestra nativa di 1M
opusplan Modalità speciale che usa opus durante il plan mode, quindi passa a sonnet per l'esecuzione

Gli alias opus, sonnet e haiku si risolvono nella versione più recente sull'API Anthropic e in una versione precedente su alcuni altri provider:

Provider opus sonnet haiku
API Anthropic Opus 5.5 Sonnet 5.5 Haiku 5.5
Claude Platform on AWS Opus 5.5 Sonnet 4.6 Haiku 4.5
Amazon Bedrock, Agent Platform di Google Cloud Opus 5.5 Sonnet 4.5 Haiku 4.5
Microsoft Foundry Opus 4.6 Sonnet 4.5 Haiku 4.5

A meno che tu non imposti ANTHROPIC_DEFAULT_FABLE_MODEL, l'alias fable si risolve in Fable 5.1, tranne nelle sessioni del gateway delle app Claude, dove fable e best si risolvono in Fable 5.

Un gateway non configurato per servire claude-fable-5-1 rifiuta le richieste per quel modello. Per usare Fable 5.1 attraverso un gateway che lo serve, selezionalo con /model claude-fable-5-1.

Dove opus o sonnet si risolve in un modello più vecchio, i modelli più recenti sono disponibili selezionando esplicitamente il nome completo del modello o impostando ANTHROPIC_DEFAULT_OPUS_MODEL o ANTHROPIC_DEFAULT_SONNET_MODEL.

Le versioni precedenti risolvono questi alias in modelli più vecchi. Per la versione in cui ogni alias è cambiato, consulta Cronologia delle versioni.

Gli alias puntano alla versione consigliata per il tuo provider e si aggiornano nel tempo. Per fissare una versione specifica, usa il nome completo del modello, ad esempio claude-opus-5-5, o imposta la variabile d'ambiente corrispondente come ANTHROPIC_DEFAULT_OPUS_MODEL.

Lavorare con Fable

Claude Fable 5.1 e Claude Fable 5 sono i modelli più capaci in Claude Code, adatti a compiti più grandi di una singola sessione di lavoro. Sostengono lunghe sessioni autonome, indagano prima di agire e verificano il proprio lavoro più spesso rispetto ai modelli più piccoli. Fable 5.1 è la versione più recente.

Nessuno dei due modelli Fable è il valore predefinito del tipo di account su alcun piano o provider. Selezionane uno esplicitamente:

  • Fable 5.1: esegui /model fable, o avvia con claude --model fable. Nelle sessioni del gateway delle app Claude, dove l'alias si risolve in Fable 5, esegui invece /model claude-fable-5-1.
  • Fable 5: selezionalo tramite l'ID del modello. Sull'API Anthropic, esegui /model claude-fable-5 o avvia con claude --model claude-fable-5. Su altri provider, usa l'ID del modello Fable 5 del tuo provider o fissalo con ANTHROPIC_DEFAULT_FABLE_MODEL.

Se ti connetti direttamente all'API Anthropic e le tue impostazioni utente contengono claude-fable-5 o claude-fable-5[1m] come modello, ad esempio perché hai selezionato Fable nel selettore /model prima della v2.1.257, Claude Code cambia quel valore salvato nell'alias fable o fable[1m] la prima volta che esegui la v2.1.257 o successiva. La riga del modello all'avvio mostra (auto-updated) una volta. Un valore claude-fable-5 nelle impostazioni di progetto, locali o gestite rimane invariato.

Le richieste che i classificatori di sicurezza di un modello Fable segnalano, più spesso nei domini della sicurezza informatica e della biologia, attivano il fallback automatico del modello.

Per ottenere il massimo da Fable:

  • Descrivi il risultato, non i passaggi: indicagli il risultato che desideri e lascia che pianifichi il percorso. Per mantenerlo orientato verso quel risultato, imposta un obiettivo.
  • Affidagli problemi ambigui: le indagini sulla causa principale, il debug dei disservizi e le decisioni architetturali sono i casi in cui l'indagine e la verifica aggiuntive ripagano.
  • Salta i promemoria di verifica: verifica il proprio lavoro con meno sollecitazioni, quindi i promemoria per testare o controllare di solito non sono necessari.
  • Aumenta la dimensione dei compiti: affidagli lavoro che normalmente divideresti in parti. Sostiene lunghe sessioni senza perdere il filo.

Sull'API Anthropic, un modello Fable appare nel selettore /model a meno che availableModels o le restrizioni del modello dell'organizzazione lo escludano. Quando la tua organizzazione non può usare Fable in alcun modo, ad esempio con la conservazione dati zero, la riga rimane nel selettore disattivata, con una nota sul motivo.

Fable e crediti di utilizzo

A seconda del tuo piano e del livello della tua postazione, l'utilizzo di Fable può essere addebitato sui crediti di utilizzo invece di attingere ai limiti inclusi nel tuo piano. In questo caso, il selettore /model mostra "Richiede crediti di utilizzo" sulla riga di Fable. Per gestire i crediti di utilizzo, consulta Aggiungere crediti di utilizzo al tuo abbonamento.

Nelle sessioni interattive, Claude Code mostra una richiesta di consenso prima che una richiesta Fable venga addebitata sui crediti di utilizzo. I membri dei piani Enterprise con fatturazione a livello di organizzazione non vedono la richiesta. Puoi continuare su Fable usando i crediti di utilizzo o passare al tuo modello predefinito. Puoi anche chiudere la richiesta:

  • Quando selezioni un modello Fable con /model, mantieni il tuo modello attuale.
  • A metà sessione, Claude Code continua il turno sul tuo modello predefinito.

Dopo che hai scelto di continuare su Fable usando i crediti di utilizzo, Claude Code non mostra più la richiesta.

In una sessione con Remote Control connesso, in una sessione in background o nella sessione di un membro di un team di agenti, potrebbe non esserci nessuno al terminale, quindi Claude Code mantiene la richiesta di consenso a metà sessione fino alla scadenza dialogExpiry, cinque minuti per impostazione predefinita. Se nessuno ha risposto entro la scadenza, Claude Code termina il turno senza inviare la richiesta e aggiunge un avviso alla trascrizione, che viene mostrato anche dal client Remote Control. La tua selezione del modello rimane invariata e Claude Code chiede di nuovo il consenso al tuo prossimo messaggio.

Cosa puoi fare mentre la richiesta è in attesa dipende dalla sessione:

  • Con Remote Control connesso o nella sessione di un membro del team, premi un tasto qualsiasi al terminale per annullare la scadenza, e Claude Code attende la tua risposta.
  • In una sessione in background, rispondi prima della scadenza.
  • Se invii un nuovo messaggio dal client remoto prima che qualcuno abbia digitato al terminale, Claude Code termina il turno allo stesso modo e il tuo nuovo messaggio avvia il turno successivo. Dopo che qualcuno ha digitato al terminale, Claude Code continua ad attendere la risposta e mette in coda il tuo nuovo messaggio dopo di essa.

In una sessione ospitata da un'altra applicazione tramite l'Agent SDK, è quell'applicazione a decidere se la richiesta appare. Se appare e nessuno risponde prima della stessa scadenza dialogExpiry, Claude Code termina il turno senza inviare la richiesta.

In modalità non interattiva con il flag -p, e in un'applicazione Agent SDK che non mostra la richiesta, Claude Code non chiede mai il consenso. Quando in quei casi una richiesta Fable verrebbe addebitata sui crediti di utilizzo, Claude Code la addebita senza chiedere.

Impostare il modello

Puoi configurare il modello in diversi modi, elencati in ordine di priorità:

  1. Durante la sessione: usa /model <alias|name> per passare immediatamente, o esegui /model senza argomenti per aprire il selettore. Consulta quando Claude Code ti chiede di confermare il passaggio
  2. All'avvio: avvia con claude --model <alias|name>
  3. Variabile d'ambiente: imposta ANTHROPIC_MODEL=<alias|name>
  4. Impostazioni: configura in modo permanente nel tuo file di impostazioni usando il campo model
  5. Valore predefinito per le nuove sessioni: imposta ANTHROPIC_DEFAULT_MODEL=<alias|name>

/model salva la tua scelta come valore predefinito per le nuove sessioni scrivendo il campo model nelle tue impostazioni utente. Nel selettore:

  • Enter: cambia modello e lo salva come tuo valore predefinito
  • s: cambia modello solo per questa sessione e lascia invariato il tuo valore predefinito. Per usare un tasto diverso, riassegna modelPicker:thisSessionOnly

Digitare direttamente /model <name> si comporta come Enter. Per cambiare solo per questa sessione, apri il selettore con /model e premi s sulla riga del modello.

Su un piano Enterprise, quando hai effettuato l'accesso con il tuo account claude.ai e salvi un valore predefinito con /model, Claude Code registra la scelta anche su quell'account. Questo richiede Claude Code v2.1.280 o successiva.

  • Quando il tuo amministratore non ha impostato un modello predefinito dell'organizzazione, l'opzione Predefinito può risolversi nel modello registrato e, in tal caso, la riga Predefinito del selettore mostra il nome di quel modello.
  • Se le restrizioni del modello escludono il modello registrato o questo non è disponibile per il tuo account, e il tuo amministratore non ha impostato un modello predefinito dell'organizzazione, l'opzione Predefinito si risolve come se nulla fosse stato registrato.
  • Se scegli Predefinito o opusplan in /model, la scelta registrata non cambia.

Se cambi modello con /model, il cambio raggiunge anche i subagent che ereditano il modello della conversazione principale, perché Claude Code risolve il loro modello a partire da quello che la tua sessione sta usando quando Claude li avvia. Passa a Opus prima che Claude deleghi ricerche o esecuzioni di test a uno di essi, e anche quel lavoro verrà eseguito su Opus. Per mantenere un subagent personalizzato su un modello più piccolo, imposta model nella sua definizione.

Se imposti un modello con /model in modalità non interattiva, con il flag -p, la tua scelta si applica solo alla sessione corrente e non viene salvata come valore predefinito; /model in quella modalità richiede Claude Code v2.1.205 o successiva. Le impostazioni di progetto e gestite hanno comunque la precedenza e vengono riapplicate al prossimo avvio. Anche un modello predefinito dell'organizzazione che il tuo amministratore ha configurato per sovrascrivere la selezione dell'utente viene riapplicato al prossimo avvio.

Dalla v2.1.144 alla v2.1.152, /model si applicava solo alla sessione corrente e d nel selettore salvava un valore predefinito.

Il flag --model e la variabile d'ambiente ANTHROPIC_MODEL si applicano solo alla sessione che avvii con essi. Per eseguire modelli diversi in terminali diversi contemporaneamente, avvia ciascuno con il proprio flag --model anziché cambiare con /model.

I prezzi nel selettore /model appaiono quando Claude Code comunica con l'API Anthropic, direttamente o tramite un gateway LLM che le fa da proxy, e il prezzo su una riga è quello del modello che quella riga seleziona. Su provider di terze parti come Amazon Bedrock e sul gateway delle app Claude, è il tuo provider o gateway a determinare quanto paghi, quindi le righe del selettore non mostrano alcun prezzo. Il prezzo è solo un'etichetta di visualizzazione; non influisce su quale modello seleziona una riga né su quanto ti fattura il provider. Prima della v2.1.206, Claude Platform on AWS e le sessioni tramite gateway mostravano i prezzi di listino di Anthropic, e una riga poteva mostrare il prezzo di un modello diverso da quello che selezionava.

Le sessioni riprese con claude --resume, --continue o il selettore /resume mantengono il modello che stavano usando quando la trascrizione è stata salvata. Se il modello ripristinato è stato ritirato o è escluso da availableModels, la sessione segue il normale ordine di precedenza. Sui provider che usano ID di distribuzione specifici del provider anziché ID di modello Anthropic, come Amazon Bedrock, Agent Platform di Google Cloud e Microsoft Foundry, il modello della trascrizione non viene ripristinato affatto e la sessione risolve il proprio modello attraverso il normale ordine di precedenza.

Se la tua impostazione model è haiku, una sessione salvata su un modello Haiku riprende sul modello in cui haiku si risolve attualmente. Ad esempio, quando haiku si risolve in Haiku 5.5, una sessione salvata su Haiku 4.5 riprende su Haiku 5.5.

Un modello che scegli per il nuovo avvio con --model o ANTHROPIC_MODEL ha comunque la precedenza sul modello ripristinato. Dalla v2.1.195, lo stesso vale per una variabile della famiglia ANTHROPIC_DEFAULT_OPUS_MODEL. Può averla anche ANTHROPIC_DEFAULT_MODEL, alle condizioni elencate nella sua sezione.

Quando il modello attivo all'avvio proviene dalle impostazioni di progetto o gestite anziché dalla tua selezione, l'intestazione di avvio mostra quale file di impostazioni lo ha impostato. Esegui /model per sovrascriverlo; l'impostazione di progetto o gestita viene riapplicata al prossimo avvio. Sulle piattaforme che incorporano Claude Code e impostano CLAUDE_CODE_PROVIDER_MANAGED_BY_HOST, la configurazione del modello dell'host ha la precedenza sulle impostazioni del modello gestite, mentre un'allowlist availableModels gestita rimane in vigore a meno che l'host non ne fornisca una propria; Eccezioni alla precedenza delle impostazioni gestite indica quali chiavi e variabili l'host sovrascrive.

Se tu o la tua organizzazione configurate hook PreModelSwitch, questi vengono eseguiti prima che un cambio richiesto venga applicato e possono bloccarlo o chiederti di confermare.

Quando Claude Code non riesce a determinare quali hook PreModelSwitch forniscono i plugin gestiti della tua organizzazione, ad esempio perché un plugin gestito non è stato caricato, rifiuta il cambio anziché applicarlo senza controllo, e ricontrolla a ogni nuovo tentativo. Consulta Model switch was blocked by a PreModelSwitch hook per il messaggio e il ripristino.

Quando cambi modello tramite il metodo setModel() dell'Agent SDK, tramite un'app come l'app Desktop o da un dispositivo connesso tramite Remote Control, Claude Code controlla il valore al momento del cambio:

  • Agent SDK o un'app: con Claude Code v2.1.268 o successiva, a meno che Claude Code non accetti un ID modello localmente, come fa per la tua opzione di modello personalizzato, conferma l'ID con il tuo provider la prima volta che la sessione passa a esso. La conferma viene eseguita su ogni provider, e un ID che il tuo provider non offre viene rifiutato al momento del cambio invece di fallire alla tua richiesta successiva.
  • Remote Control: sull'API Anthropic, Claude Code controlla il valore localmente e non invia alcuna richiesta.

Consulta Model is not a recognized model id e Model not found per i messaggi.

Se imposti il modello con il flag --model, la variabile d'ambiente ANTHROPIC_MODEL o l'impostazione model, Claude Code non lo controlla in anticipo, e un valore digitato in modo errato produce There's an issue with the selected model alla prima richiesta.

Quando il modello richiesto ha una data di ritiro programmata o viene automaticamente rimappato a una versione più recente, Claude Code mostra un avviso che indica il modello richiesto. Le sessioni interattive lo mostrano come avviso all'avvio. Dalla v2.1.182, lo stesso avviso viene scritto su stderr in modalità non interattiva quando si usa il formato di output di testo predefinito. Il controllo copre anche un model impostato nel frontmatter di un subagent. L'avviso su stderr viene soppresso per --output-format json e stream-json; in questi casi leggi il modello effettivo dal campo modelUsage del messaggio di risultato.

Ad esempio, avvia una sessione su Opus:

claude --model opus

Poi cambia modello dall'interno della sessione:

/model sonnet

File di impostazioni di esempio:

{
    "permissions": {
        "allow": ["Bash(npm run lint)"]
    },
    "model": "opus"
}

Impostare un modello predefinito per le nuove sessioni

Imposta ANTHROPIC_DEFAULT_MODEL=<alias|name> per scegliere il modello su cui le tue sessioni si avviano per impostazione predefinita. Richiede Claude Code v2.1.236 o successiva.

Claude Code avvia una nuova sessione sul modello della variabile solo quando nessuno di questi elementi seleziona un modello:

Una scelta che salvi con /model ha la precedenza sulla variabile anche negli avvii successivi. Se invece imposti ANTHROPIC_MODEL, Claude Code torna al modello di quella variabile al prossimo avvio, qualunque cosa tu abbia salvato con /model.

Claude Code risolve anche l'opzione Predefinito nel modello della variabile, a meno che non si applichi un modello predefinito dell'organizzazione. Quando l'opzione Predefinito si risolve nel modello della variabile, la riga Predefinito nel selettore /model mostra l'etichetta Impostato da ANTHROPIC_DEFAULT_MODEL.

Claude Code ignora la variabile nei seguenti casi, e l'opzione Predefinito si risolve come se non l'avessi impostata:

Quando una nuova sessione si avvierebbe sul modello della variabile, anche una sessione che riprendi con claude --resume, --continue o il selettore /resume si avvia su di esso. Claude Code non ripristina il modello salvato nella trascrizione di quella sessione. Negli altri casi Claude Code non usa la variabile quando riprendi una sessione.

Una nuova sessione si avvia su un modello diverso da quello che hai scelto

Quando scegli un modello con /model e la sessione successiva si avvia su un altro, queste sono le cause più comuni:

  • L'hai scelto per una sola sessione. Premere s nel selettore, avviare con --model ed eseguire /model in modalità non interattiva si applicano tutti alla sessione corrente e lasciano invariato il valore predefinito salvato.
  • Qualcosa con priorità più alta imposta il modello. Un valore model nelle impostazioni di progetto o gestite, ANTHROPIC_MODEL nella tua shell o un modello predefinito dell'organizzazione che il tuo amministratore ha impostato per sovrascrivere le scelte dell'utente si applica di nuovo a ogni avvio. La tua scelta in /model resta salvata, ma ha una priorità inferiore. Quando le impostazioni di progetto o gestite impostano il modello, l'intestazione di avvio indica il file.
  • Claude Code non è riuscito a salvare la tua scelta. /model scrive model in ~/.claude/settings.json. Se non puoi scrivere su quel file, ad esempio perché un altro strumento lo genera o lo collega a una copia di sola lettura, il modello scelto resta valido per la sessione e all'avvio successivo viene letto il valore precedente. Imposta model nello strumento che genera il file, oppure rendi il file scrivibile. Consulta Una modifica fatta in Claude Code viene persa nelle nuove sessioni.
  • Hai ripreso una sessione. Una sessione che riprendi con claude --resume o --continue di solito mantiene il modello che stava usando anziché il tuo valore predefinito attuale.

Limitare la selezione del modello

Gli amministratori aziendali possono utilizzare availableModels nelle impostazioni gestite o di policy per limitare quali modelli gli utenti possono selezionare. Le voci corrispondono a una famiglia di modelli come sonnet, un prefisso di versione come claude-sonnet-4-5, o un ID modello completo come claude-sonnet-4-5-20250929. Un prefisso di versione corrisponde anche a ID modello successivi che lo estendono con un altro segmento, quindi claude-fable-5 consente sia Fable 5 che Fable 5.1, mentre claude-fable-5-1 consente solo Fable 5.1. Per bloccare un modello che l'elenco consente, o per fare in modo che ogni voce di ID modello consenta solo la versione che nomina, vedere Bloccare modelli o versioni specifici.

Sulle piattaforme che incorporano Claude Code e impostano CLAUDE_CODE_PROVIDER_MANAGED_BY_HOST, la configurazione del modello dell'host ha la precedenza rispetto alle impostazioni del modello gestito, mentre un allowlist availableModels gestito rimane in vigore a meno che l'host non fornisca il proprio; Eccezioni alla precedenza delle impostazioni gestite indica quali chiavi e variabili l'host sostituisce.

Quando availableModels è impostato, l'allowlist si applica ovunque un utente possa specificare un modello:

  • Modello della sessione principale: /model, il flag --model, la variabile di ambiente ANTHROPIC_MODEL, l'impostazione model, ANTHROPIC_DEFAULT_MODEL, e il modello ripristinato quando si riprende una sessione
  • Risoluzione alias: le variabili di ambiente ANTHROPIC_DEFAULT_OPUS_MODEL, ANTHROPIC_DEFAULT_SONNET_MODEL, ANTHROPIC_DEFAULT_HAIKU_MODEL, e ANTHROPIC_DEFAULT_FABLE_MODEL non possono reindirizzare un alias consentito a un modello al di fuori dell'elenco
  • Modalità veloce: /fast rifiuta di attivare/disattivare quando comporterebbe un passaggio implicito a un modello Opus al di fuori dell'elenco, con il messaggio "is not in your organization's allowed models"
  • Modelli di subagent e teammate: il campo model nel frontmatter di subagent, il parametro model dello strumento Agent, i modelli teammate del team di agent, CLAUDE_CODE_SUBAGENT_MODEL, e, nella versione 2.1.197 e precedenti, il selezionatore di modelli nella procedura guidata /agents
  • Modelli di skill e comando: il frontmatter model in skills e commands
  • Modello Advisor: l'impostazione advisorModel configurata e il flag --advisor
  • Modello di background agent: il modello selezionato nel dispatch picker

Sull'API Anthropic e su Claude Platform on AWS, un alias di famiglia di modelli, opus, sonnet, haiku, o fable, si risolve nel suo modello usuale quando l'allowlist consente quel modello. Quando l'allowlist blocca quel modello, Claude Code sostituisce la versione più recente della famiglia che l'allowlist consente e mostra un avviso che nomina sia i modelli richiesti che quelli sostituiti. Con ["sonnet", "claude-opus-4-6"], ad esempio, sia /model opus che --model opus selezionano Claude Opus 4.6, l'Opus più recente consentito. Prima della versione 2.1.205, un alias la cui versione più recente rilasciata era al di fuori dell'elenco veniva rifiutato o sostituito come qualsiasi altra selezione bloccata, anche quando l'elenco consentiva una versione precedente.

La sostituzione ha bisogno di una versione consentita su cui atterrare: quando l'allowlist non consente alcuna versione della famiglia dell'alias, l'alias segue il comportamento di rifiuto e sostituzione di seguito come qualsiasi altro valore bloccato.

Claude Code gestisce qualsiasi altra selezione bloccata in base a dove il modello è stato impostato:

  • /model: Claude Code rifiuta il passaggio con un errore

  • Flag --model, ANTHROPIC_MODEL, o l'impostazione model: Claude Code sostituisce il valore all'avvio con un avviso che nomina sia i modelli richiesti che quelli sostituiti, e la sessione inizia sul modello predefinito

  • ANTHROPIC_DEFAULT_MODEL: Claude Code ignora la variabile

  • Override di subagent o teammate: Claude Code esegue il subagent o il teammate su un modello di fallback piuttosto che far fallire la richiesta. Vedere Scegliere un modello per il fallback del subagent e Specificare teammate e modelli per il fallback del teammate.

    Nelle sessioni interattive, Claude Code ti avverte quando sostituisce il modello di un subagent, da questo fallback o dalla sostituzione della versione più recente consentita di cui sopra, nominando i modelli richiesti e sostituiti; non segnala il fallback di un teammate.

    Dove opera la sostituzione della versione più recente consentita di cui sopra, un alias di famiglia bloccato la segue invece. Prima della versione 2.1.222, un alias ricadeva come qualsiasi altro valore bloccato su ogni provider

  • Override di skill o comando: Claude Code ignora l'override, incluso un alias di famiglia bloccato, e lo skill o il comando viene eseguito sul modello della sessione. Uno skill o un comando che viene eseguito in un subagent segue il comportamento del subagent di cui sopra

  • Impostazione advisorModel: l'advisor è disabilitato per la sessione

  • Flag --advisor: Claude Code esce con un errore all'avvio. In una sessione in background, avvia la sessione senza l'advisor invece di uscire

Claude Code nasconde i modelli esclusi dal selezionatore /model. Il fatto che un ID modello elencato ottenga anche una propria riga dipende dal provider:

  • API Anthropic, Claude Platform on AWS, gateway delle app Claude, o un LLM gateway impostato tramite ANTHROPIC_BASE_URL: un ID modello Anthropic elencato che non ha una riga integrata nel selezionatore appare come una propria riga etichettata. Claude Code aggiunge una riga di questo tipo per le versioni di Opus, Sonnet e Haiku, come una versione precedente che l'elenco fissa. Se imposti replaceBuiltInOptions in una lineup modelPicker, quella riga non appare. Prima della versione 2.1.199, tale ID era selezionabile solo digitando /model <id>.
  • Amazon Bedrock, Agent Platform di Google Cloud o Microsoft Foundry: a meno che un ID modello elencato non inizi con anthropic., Claude Code non aggiunge una riga per esso, che si tratti di un ID modello Anthropic o di uno specifico del provider. Gli ID modello Mantle hanno quel prefisso. Per mostrare una versione elencata che non ha una riga integrata, aggiungila anche a una lineup modelPicker, che accetta ID nel formato del tuo provider.

I cambiamenti di modello che Claude Code effettua per tuo conto vengono controllati allo stesso modo:

  • Catene di modelli di fallback: le voci al di fuori dell'allowlist vengono eliminate
  • Aggiornamenti in Plan Mode: sull'API Anthropic e su Claude Platform on AWS, un aggiornamento come opusplan a un modello escluso utilizza la versione più recente consentita della famiglia di aggiornamento. Su provider con ID modello specifici del provider, e quando nessuna versione è consentita, l'aggiornamento viene saltato e la pianificazione continua sul modello della sessione
  • Fallback automatico del modello: un fallback il cui target è escluso non viene eseguito, quindi la richiesta contrassegnata termina con un rifiuto
  • Classificatore della modalità auto: il valore predefinito Claude Sonnet 5 del classificatore si applica solo quando l'allowlist consente Sonnet 5. Quando è escluso, il classificatore viene eseguito sul modello della sessione, che l'allowlist già governa, o su un modello Opus quando la sessione viene eseguita su un modello Fable. Su provider diversi dall'API Anthropic, quel fallback Opus viene eseguito sul modello che imposti in ANTHROPIC_DEFAULT_OPUS_MODEL o altrimenti su Opus 5, senza consultare l'allowlist. Richiede Claude Code v2.1.210 o successivo
  • Modalità veloce: l'abilitazione della modalità veloce viene rifiutata quando il modello su cui la sessione verrebbe eseguita in seguito è al di fuori dell'allowlist
  • Fallback di disponibilità su Amazon Bedrock e Agent Platform di Google Cloud: quando il tuo account perde l'accesso a un modello a metà sessione, il passaggio a un altro modello salta i modelli esclusi. I controlli del modello all'avvio su Amazon Bedrock e su Agent Platform di Google Cloud saltano i modelli esclusi solo quando le impostazioni gestite impostano anche enforceAvailableModels
{
  "availableModels": ["sonnet", "haiku"]
}

Copertura della superficie

Ogni superficie applica l'allowlist che riceve. Quale meccanismo di consegna raggiunge ogni superficie differisce:

Meccanismo di consegna CLI e IDE Sessioni locali desktop Sessioni web, mobile e cloud Agent SDK e non-interattive Cowork
Impostazioni gestite dal server dalla console di amministrazione Applicate Applicate Applicate, eccetto nelle sessioni Claude Tag Applicate Sessioni Cowork remote: il server controlla il modello. Sulla macchina dell'utente: non consegnate.
File MDM o impostazioni gestite Applicate Applicate Non consegnate negli ambienti ospitati da Anthropic; negli ambienti self-hosted, applicate dall'immagine del runner secondo come Claude Code combina le fonti gestite Applicate Applicate dove distribuite
  • Le sessioni cloud su Claude Code sul web, incluse quelle che avvii dall'app Desktop, vengono eseguite su VM gestite da Anthropic per impostazione predefinita: le impostazioni distribuite al tuo dispositivo non le raggiungono, quindi consegna l'allowlist tramite impostazioni gestite dal server. Le sessioni che la tua organizzazione instrada a un ambiente self-hosted vengono eseguite sul tuo calcolo e leggono anche il file di impostazioni gestite nell'immagine del runner. Come Claude Code combina le fonti gestite indica quando quel file si applica. Un cambio di modello a metà sessione in una sessione cloud viene rifiutato quando il modello richiesto è escluso dall'allowlist. Quando l'elenco availableModels nelle tue impostazioni gestite dal server è non vuoto, il server rifiuta una richiesta di avviare una sessione cloud su claude.ai/code o dall'app Desktop su un modello che l'elenco esclude.
  • Le sessioni Claude Tag vengono eseguite in ambienti cloud ma non ricevono impostazioni gestite dal server; in un ambiente self-hosted, leggono comunque il file di impostazioni gestite nell'immagine del runner. Per impostare il modello per quelle sessioni, vedere Scegliere il modello per un ambito nella guida di amministrazione di Claude Tag.
  • Cowork, la scheda agentic-work nell'app Claude Desktop, esegue le sue sessioni su Claude Code ma, per progettazione, non riceve impostazioni gestite dal server dalla console di amministrazione claude.ai. Quando l'elenco availableModels nelle tue impostazioni gestite dal server è non vuoto e un utente sceglie un modello al di fuori di esso, il server rifiuta quel modello per una sessione Cowork remota. Un file di impostazioni gestite si applica alle sessioni Cowork quando è presente dove la sessione viene eseguita; le sessioni Cowork remote vengono eseguite su VM gestite da Anthropic, dove un file distribuito dal dispositivo non è presente.
  • Le sessioni su provider di terze parti come Amazon Bedrock, Agent Platform di Google Cloud, Microsoft Foundry, e Claude Platform on AWS non ricevono impostazioni gestite dal server, quindi consegna l'allowlist tramite file MDM o impostazioni gestite lì.
  • La consegna dalla console di amministrazione richiede anche che la sessione effettui il recupero con un login idoneo alla tua organizzazione o con un token OAuth emesso per essa. Per le flotte che si autenticano con chiavi API, sia configurate direttamente sia generate da uno script apiKeyHelper, consegna l'allowlist tramite file MDM o impostazioni gestite.
  • La scheda Desktop Code ospita anche sessioni SSH, che leggono il file di impostazioni gestite dall'host remoto su cui vengono eseguite. Vedere Impostazioni gestite desktop.
  • I selezionatori di modelli su claude.ai e nell'app Desktop nascondono o disattivano i modelli esclusi dall'allowlist della tua organizzazione. Lo stato del selezionatore è una comodità per gli utenti; non applica l'allowlist.

Comportamento del modello predefinito

Con la corrispondenza del prefisso predefinita, availableModels da solo lascia l'opzione Predefinito sul valore predefinito di runtime del sistema per l'account fino a quando non imposti anche enforceAvailableModels. Se quel valore predefinito è un modello che intendi limitare, imposta anche enforceAvailableModels, o blocca quel modello.

Con availableModels: [], le selezioni di modelli denominati vengono bloccate e enforceAvailableModels non ha alcun effetto.

Applicare l'allowlist per il modello Predefinito

Imposta enforceAvailableModels: true insieme a un availableModels non vuoto nelle impostazioni gestite per estendere l'allowlist all'opzione Predefinito. Ciò richiede Claude Code v2.1.175 o successivo.

{
  "availableModels": ["sonnet", "haiku"],
  "enforceAvailableModels": true
}

Per un membro senza un modello registrato sul suo account, l'opzione Predefinito si risolve nel valore predefinito del tipo di account, o nel modello predefinito dell'organizzazione quando un amministratore ne ha impostato uno. Quando quel modello non è nell'allowlist, l'opzione Predefinito si risolve invece nella prima voce availableModels che nomina un modello consentito e disponibile, e la riga Predefinito del selezionatore /model mostra quel modello. Questo si applica ovunque il valore predefinito sia raggiunto: avvio della sessione, selezione di Predefinito in /model, la parola chiave "default" nelle catene di modelli di fallback, e il fallback utilizzato quando una selezione esclusa viene eliminata. Un modello registrato sul account di un membro viene controllato anche rispetto a availableModels; Setting your model descrive come l'opzione Predefinito lo tratta.

enforceAvailableModels rimappa l'opzione Predefinito solo quando availableModels è non vuoto. Quando availableModels è non vuoto ma nessuna voce si risolve in un modello consentito e disponibile, l'applicazione viene saltata con un avviso visibile solo sotto --debug. Mantieni almeno una voce garantita disponibile nell'elenco per evitare questo.

Distribuisci entrambe le chiavi insieme nella fonte gestita con il ranking più alto che consegni. Per impostazione predefinita Claude Code legge solo quella fonte, quindi una coppia posizionata in un file di impostazioni gestite viene ignorata quando la console di amministrazione consegna qualsiasi impostazione; secondo il merge opt-in in come Claude Code combina le fonti gestite, Claude Code ignora comunque una mappa modelOverrides da una fonte classificata al di sotto di quella che imposta availableModels.

Controllare il modello su cui gli utenti vengono eseguiti

L'impostazione model è una selezione iniziale, non un'applicazione. Imposta quale modello è attivo quando una sessione inizia, ma gli utenti possono comunque aprire /model e scegliere Predefinito, che si risolve nel valore predefinito di runtime del sistema indipendentemente da cosa sia impostato model, a meno che enforceAvailableModels o le chiavi che bloccano versioni specifiche non si applichino a esso.

Per controllare completamente l'esperienza del modello, combina queste impostazioni:

  • availableModels: limita quali modelli denominati gli utenti possono passare a
  • enforceAvailableModels: estende l'allowlist availableModels all'opzione Predefinito, quindi Predefinito non può risolversi in un modello al di fuori dell'elenco
  • deniedModels e availableModelsMatch: blocca versioni specifiche che una voce availableModels altrimenti consentirebbe
  • model: imposta la selezione del modello iniziale quando una sessione inizia
  • ANTHROPIC_DEFAULT_SONNET_MODEL / ANTHROPIC_DEFAULT_OPUS_MODEL / ANTHROPIC_DEFAULT_HAIKU_MODEL / ANTHROPIC_DEFAULT_FABLE_MODEL: controllano a cosa si risolvono gli alias sonnet, opus, haiku, e fable, e quale versione utilizza il valore predefinito del tipo di account

Questo esempio avvia gli utenti su Sonnet 4.5, limita il selezionatore a Sonnet e Haiku, e assicura che Predefinito si risolva in un modello nell'allowlist piuttosto che nel valore predefinito del tier:

{
  "model": "claude-sonnet-4-5",
  "availableModels": ["claude-sonnet-4-5", "haiku"],
  "enforceAvailableModels": true,
  "env": {
    "ANTHROPIC_DEFAULT_SONNET_MODEL": "claude-sonnet-4-5"
  }
}

Senza enforceAvailableModels o il blocco env, un utente che seleziona Predefinito nel selezionatore ottiene il valore predefinito di runtime piuttosto che la versione fissata in model. Le due impostazioni coprono ambiti diversi: enforceAvailableModels fa sì che Predefinito obbedisca all'allowlist, mentre il blocco env fissa quale versione un alias consentito come sonnet si risolve. Usa enforceAvailableModels da solo quando limitare le famiglie di modelli è sufficiente; aggiungi il blocco env quando hai anche bisogno di fissare una versione specifica.

Comportamento di merge

Quando le impostazioni gestite che Claude Code applica definiscono availableModels, solo quell'elenco si applica, a parte una piattaforma host che fornisce il proprio: le voci nelle impostazioni utente, progetto o locale non possono estenderlo, e Claude Code non unisce mai availableModels tra fonti gestite nemmeno; come Claude Code combina le fonti gestite indica quale elenco della fonte si applica. Altrimenti, gli elenchi dalle impostazioni utente, progetto e locale vengono concatenati e deduplicati come altre impostazioni di array. Prima di Claude Code v2.1.175, le voci da ambiti di precedenza inferiore si univano nell'elenco gestito invece di essere sostituite da esso.

All'interno dell'elenco effettivo, una voce che nomina un modello specifico in una famiglia, sia un prefisso di versione che un ID modello completo, disabilita la voce wildcard della famiglia: ["sonnet", "claude-sonnet-4-5"] consente solo le versioni di Sonnet 4.5, non ogni modello Sonnet.

ID modello Mantle

Le voci in availableModels che iniziano con anthropic. vengono aggiunte al selezionatore /model come opzioni personalizzate. Questa è un'eccezione alla corrispondenza dell'alias descritta in Fissare modelli per distribuzioni di terze parti. Con l'endpoint Amazon Bedrock Mantle abilitato, Claude Code instrada a quell'endpoint le voci che corrispondono al formato Mantle. L'impostazione limita comunque il selezionatore alle voci elencate, e un ID Mantle incorpora un nome di famiglia, quindi conta come una voce specifica e disabilita il wildcard della famiglia: insieme a qualsiasi ID Mantle, elenca i prefissi di versione o gli ID completi che desideri mantenere selezionabili. Vedere Comportamento di merge.

Bloccare modelli o versioni specifici

Una voce availableModels come claude-opus-5 consente anche rilasci successivi che la estendono, come Opus 5.5, non appena Claude Code li supporta. Due impostazioni gestite ti permettono di trattenere un rilascio, e entrambe richiedono Claude Code v2.1.283 o successivo:

  • deniedModels: elenca i modelli da bloccare. Un modello elencato viene bloccato anche quando availableModels lo consente, e la chiave funziona anche senza alcun allowlist. Un rilascio che nessuna voce blocca rimane consentito
  • availableModelsMatch: impostalo su "exact" in modo che ogni ID modello in availableModels consenta solo la versione che nomina. Una versione più recente di un ID modello elencato rimane quindi bloccata fino a quando non la aggiungi all'elenco

Le versioni precedenti ignorano entrambe le chiavi, quindi imposta anche requiredMinimumVersion per impedire a quelle versioni di avviarsi.

Questo esempio consente modelli Opus e Sonnet e blocca Opus 5.5 in ogni ortografia, inclusi ID datati e specifici del provider:

{
  "availableModels": ["opus", "sonnet"],
  "deniedModels": ["claude-opus-5-5"]
}

Un modello bloccato, sia che deniedModels lo nomini o che un elenco "exact" lo ometta, viene trattato come una selezione bloccata ovunque l'allowlist si applica. È nascosto dal selezionatore /model, e /model <name> lo rifiuta. Se nomini un ID modello bloccato con --model, ANTHROPIC_MODEL, o l'impostazione model, Claude Code lo elimina all'avvio e risolve l'opzione Predefinito invece. Se un hook o una richiesta in background nomina un modello che deniedModels blocca, come il campo model di un hook di agent, quella richiesta viene eseguita sul modello della sessione invece.

L'opzione Predefinito segue entrambe le chiavi anche, indipendentemente dal fatto che tu imposti enforceAvailableModels. Se lo imposti con un availableModels non vuoto, un valore predefinito bloccato conta come un modello al di fuori dell'allowlist. Altrimenti, un'opzione Predefinito che si risolverebbe in un modello bloccato scende in questo ordine:

  1. La versione più recente consentita della stessa famiglia
  2. Il modello più recente consentito di ogni famiglia di costo inferiore a turno: Sonnet, poi Haiku
  3. La prima voce availableModels che nomina un modello consentito

Se nessuno di questi è consentito, una sessione che inizia sull'opzione Predefinito rifiuta di avviarsi con un errore che nomina la chiave da correggere. Un elenco "exact" influisce sull'opzione Predefinito solo quando l'elenco availableModels gestito nomina almeno un modello o una famiglia.

Claude Code legge entrambe le chiavi solo dalle impostazioni gestite. Se imposti una di esse nelle impostazioni utente, progetto o locale o con --settings, Claude Code la ignora con un avviso.

Restrizioni del modello dell'organizzazione

Gli amministratori dell'organizzazione sui piani Claude Enterprise limitano quali modelli i membri possono eseguire disabilitando i singoli modelli nella console di amministrazione claude.ai. Questa restrizione viene consegnata con i diritti dell'account quando Claude Code si autentica, separata da qualsiasi elenco availableModels nelle impostazioni, e il server applica la stessa restrizione indipendentemente quando una sessione viene creata. Richiede Claude Code v2.1.187 o successivo.

La restrizione si applica quando un membro accede o utilizza la propria chiave API. Le credenziali con ambito organizzativo, come le chiavi di servizio dell'organizzazione, non sono legate a un utente, quindi la restrizione non si applica a loro.

La Claude Console non ha controllo di restrizione del modello. Le organizzazioni senza un piano Claude Enterprise, incluse quelle i cui membri si autenticano tramite l'API Anthropic, limitano i modelli con availableModels nelle impostazioni gestite, aggiungendo enforceAvailableModels per coprire l'opzione Predefinito. Copertura della superficie indica come ogni superficie riceve e applica queste impostazioni.

Un modello limitato è nascosto dal selezionatore /model. Selezionarlo per nome con --model, la variabile di ambiente ANTHROPIC_MODEL, o l'impostazione model mostra l'avviso Model "<name>" is restricted by your organization's settings. Using <model> instead. e la sessione inizia su un modello consentito. Digitare /model <name> per un modello limitato viene rifiutato con Model '<name>' is restricted by your organization's settings. Run /model to choose a different model. e la sessione mantiene il suo modello attuale.

Un alias di famiglia di modelli come opus si risolve nel suo modello usuale quando l'organizzazione lo consente. Quando l'organizzazione limita quel modello, Claude Code sostituisce la versione più recente della famiglia che l'organizzazione consente, con lo stesso avviso di sostituzione. /model <alias> viene rifiutato solo quando ogni versione della sua famiglia è limitata; un alias impostato con --model, ANTHROPIC_MODEL, o l'impostazione model viene comunque sostituito all'avvio in quel caso. Prima della versione 2.1.205, un alias di famiglia veniva sostituito o rifiutato in base alla sua versione più recente rilasciata da sola, anche quando una versione precedente era consentita.

Le restrizioni si applicano a livello di organizzazione o per ruolo:

  • Disabilitare un modello a livello di organizzazione lo rimuove per ogni membro.
  • L'accesso a livello di ruolo concede modelli diversi a diversi ruoli personalizzati, e un membro che detiene diversi ruoli può utilizzare qualsiasi modello che uno dei suoi ruoli concede.
  • I modelli Haiku sono sempre disponibili e non possono essere disabilitati, quindi ogni membro mantiene almeno un modello utilizzabile.
  • Un cambio di accesso ha effetto su nuove richieste entro circa un minuto; il selezionatore /model lo riflette la prossima volta che una sessione inizia.

Entrambe le restrizioni si applicano insieme: un modello è selezionabile solo quando è consentito da availableModels e non limitato dall'organizzazione. Le restrizioni dell'organizzazione raggiungono le sessioni sull'API Anthropic e sui distribuzioni LLM gateway solo; su qualsiasi altro provider, utilizza availableModels invece.

Modello predefinito dell'organizzazione

Gli amministratori dell'organizzazione nei piani Claude Enterprise possono impostare un modello predefinito per i membri di Claude Code dall'admin console di claude.ai, per l'intera organizzazione o per ruolo personalizzato. Quando ne viene impostato uno, l'opzione Predefinito si risolve in quel modello. Richiede Claude Code v2.1.196 o versione successiva.

La riga Predefinito nel selettore /model mostra il nome del modello predefinito dell'organizzazione con l'etichetta Org default. L'etichetta recita Org default indipendentemente dal fatto che l'amministratore abbia impostato il modello predefinito per l'intera organizzazione o per il vostro ruolo. Un modello predefinito del ruolo copre i membri di quel ruolo personalizzato e ha la precedenza sul modello predefinito a livello di organizzazione; quando diversi vostri ruoli impostano modelli predefiniti diversi, si applica il modello più capace.

Il modello predefinito dell'organizzazione è un punto di partenza, non una restrizione. Queste selezioni hanno la precedenza su di esso:

  • il flag --model e la variabile di ambiente ANTHROPIC_MODEL
  • un valore model nelle impostazioni gestite o fornito tramite --settings
  • un valore model nelle vostre impostazioni utente, progetto o locali, incluso un modello che salvate con /model

Gli amministratori possono anche configurare il modello predefinito dell'organizzazione per sovrascrivere la selezione dell'utente. Con l'override attivato, ha la precedenza sul valore model nelle impostazioni utente, progetto e locali, quindi un modello che salvi con /model si applica per la sessione corrente e il modello predefinito dell'organizzazione ritorna al prossimo avvio. Quando la tua selezione differisce, /model mostra Your organization's default (<model>) applies on restart. Il flag --model, ANTHROPIC_MODEL, le impostazioni gestite e --settings hanno ancora la precedenza anche con l'override attivato.

Per limitare quali modelli i membri possono selezionare, utilizzate restrizioni del modello dell'organizzazione o availableModels invece.

Claude Code legge il modello predefinito dell'organizzazione una sola volta all'avvio, quindi un modello predefinito che l'amministratore cambia durante la sessione ha effetto al prossimo avvio.

Quando il modello predefinito dell'organizzazione non ignora la selezione dell'utente, il primo avvio interattivo dopo che l'amministratore lo cambia cancella la chiave model dalle vostre impostazioni utente una sola volta, in modo che il nuovo modello predefinito si applichi. Non cambia nient'altro nel file, e un modello che salvate con /model dopo quel lancio viene mantenuto.

Il modello predefinito dell'organizzazione passa attraverso questi controlli di restrizione prima di essere adottato:

  • Con la corrispondenza del prefisso predefinito, availableModels da solo non si applica al modello predefinito dell'organizzazione, quindi un modello predefinito dell'organizzazione al di fuori della lista di autorizzazione si applica comunque. Quando enforceAvailableModels è anche impostato, un modello predefinito dell'organizzazione al di fuori della lista di autorizzazione viene rimappato alla prima voce della lista di autorizzazione come pure
  • un modello predefinito dell'organizzazione che restrizioni del modello dell'organizzazione negano per il vostro account viene sostituito dal modello più recente consentito nella sua famiglia, o da una famiglia a costo inferiore quando ogni versione di essa è limitata
  • per un modello predefinito dell'organizzazione che deniedModels o un elenco "exact" blocca, vedere Bloccare modelli o versioni specifiche
  • un modello predefinito dell'organizzazione che non è disponibile per il vostro account affatto viene saltato, e l'opzione Predefinito si risolve come farebbe senza un modello predefinito dell'organizzazione

A partire dalla v2.1.199, quando il modello predefinito dell'organizzazione è una famiglia di modelli diversa dal modello predefinito usuale del tipo di account vostro, il selettore /model mantiene una riga separata per quella famiglia usuale, in modo che possiate comunque passare ad essa per una sessione. Dalla v2.1.196 alla v2.1.198 quella riga manca dal selettore.

Il modello predefinito dell'organizzazione raggiunge solo le sessioni autenticate con l'API Anthropic. Per impostare un modello predefinito in qualsiasi altro luogo, incluse le distribuzioni LLM gateway, utilizzate la chiave model nelle impostazioni gestite invece.

Limiti di sforzo dell'organizzazione

La vostra organizzazione può limitare il livello di sforzo in due modi. Su un piano Claude Enterprise, gli amministratori dell'organizzazione impostano limiti di sforzo per ruolo, descritti di seguito. Su qualsiasi piano e qualsiasi provider, inclusi Amazon Bedrock, Google Cloud's Agent Platform e Microsoft Foundry, l'impostazione gestita maxEffortLevel limita lo sforzo sul client. Quando entrambi si applicano a un modello, si applica il limite inferiore.

Gli amministratori dell'organizzazione nei piani Claude Enterprise possono impostare un livello di sforzo massimo per modello per ogni ruolo personalizzato, insieme alle restrizioni del modello a livello di organizzazione. I livelli superiori al limite non vengono offerti nel selettore /effort, e denominare un livello superiore con --effort o /effort viene eseguito al limite. Nelle sessioni interattive e nelle esecuzioni in testo semplice --print, un avviso nomina i livelli richiesti e applicati; con output json o stream-json o negli agenti in background, il limite si applica silenziosamente. I limiti sono per modello, quindi il cambio di modelli può modificare quali livelli sono disponibili. Quando diversi vostri ruoli concedono lo stesso modello, si applica il limite meno restrittivo. Richiede Claude Code v2.1.195 o successivo.

I limiti di sforzo vengono forniti insieme alle restrizioni del modello dell'organizzazione e raggiungono le stesse sessioni.

Comportamento speciale del modello

Impostazione del modello `default`

Il comportamento di default dipende dal tipo di account:

  • Pro, Max, Team, Enterprise e Anthropic API: predefinito su Opus 5.5
  • Claude Platform su AWS, Amazon Bedrock e Google Cloud's Agent Platform: predefinito su Opus 5.5
  • Microsoft Foundry: predefinito su Sonnet 4.5

Prima della v2.1.280, default si risolveva in Sonnet 5 su Pro e Team Standard, e in Opus 5 su Max, Team Premium, Enterprise, Anthropic API, Claude Platform su AWS, Amazon Bedrock e Google Cloud's Agent Platform da v2.1.219. Prima della v2.1.219, default si risolveva in Opus 4.8 su Anthropic API, Max, Team Premium e Enterprise con pagamento a consumo da v2.1.154, e su Claude Platform su AWS, Amazon Bedrock e Google Cloud's Agent Platform da v2.1.207. Prima della v2.1.207, default si risolveva in Opus 4.7 su Claude Platform su AWS e in Sonnet 4.5 su Amazon Bedrock e Google Cloud's Agent Platform.

Quando un amministratore ha impostato un modello predefinito dell'organizzazione, default si risolve in quel modello invece del valore predefinito del tipo di account sopra indicato. Richiede Claude Code v2.1.196 o successiva. default può anche risolversi nel modello impostato con ANTHROPIC_DEFAULT_MODEL, secondo le condizioni elencate nella relativa sezione, o nel modello registrato sul tuo account.

Quando nulla è registrato sul tuo account, le impostazioni gestite applicano l'allowlist per il modello predefinito, e il valore predefinito del tipo di account non è in availableModels, default si risolve nel valore predefinito applicato invece del valore predefinito del tipo di account sopra indicato. Quando si applicano sia un valore predefinito dell'organizzazione sia l'applicazione dell'allowlist, il valore predefinito dell'organizzazione sostituisce prima il valore predefinito del tipo di account e l'applicazione si applica quindi ad esso: un valore predefinito dell'organizzazione presente nell'allowlist viene mantenuto, mentre uno al di fuori dell'elenco si risolve nel valore predefinito applicato.

I modelli Fable non sono il valore predefinito del tipo di account su nessun piano o provider. Sceglierne uno con /model lo salva come modello selezionato nelle impostazioni utente, in modo che le sessioni successive inizino su di esso. Per il cambio una tantum che Claude Code apporta a una selezione Fable 5 salvata nella v2.1.257, consulta Lavorare con Fable.

Impostazione del modello `opusplan`

L'alias del modello opusplan fornisce un approccio ibrido automatizzato:

  • In plan mode: utilizza opus per il ragionamento complesso e le decisioni architetturali
  • In modalità esecuzione: passa automaticamente a sonnet per la generazione del codice e l'implementazione

Questo abbina il ragionamento di Opus per la pianificazione con l'efficienza di Sonnet per l'esecuzione.

La fase Opus in plan mode utilizza la stessa finestra di contesto dell'impostazione del modello opus, e la fase di esecuzione utilizza la stessa finestra di sonnet. Quando opus e sonnet si risolvono in modelli che vengono eseguiti con la finestra di contesto 1M per impostazione predefinita, come i modelli attuali su Anthropic API, entrambe le fasi vengono eseguite con essa. Per richiedere il contesto 1M per entrambe le fasi dove non lo fanno, imposta il modello su opusplan[1m], ad esempio con /model opusplan[1m]. Impostarlo con /model richiede Claude Code v2.1.265 o successiva; nelle versioni precedenti, usa il flag --model o l'impostazione model.

Quando availableModels esclude l'Opus più recente ma consente una versione precedente, ad esempio ["sonnet", "claude-opus-4-6"], opusplan utilizza l'Opus più recente consentito per la pianificazione e rimane su Sonnet solo quando ogni Opus è escluso. Una sessione Haiku che normalmente passerebbe a Sonnet in plan mode utilizza allo stesso modo il Sonnet più recente consentito e rimane su Haiku solo quando ogni Sonnet è escluso. Prima della v2.1.205, il plan mode rimaneva sul modello della sessione ogni volta che la versione più recente della famiglia di aggiornamento era esclusa, anche quando l'allowlist ne consentiva una precedente.

La sostituzione di una versione precedente consentita si applica su Anthropic API e Claude Platform su AWS. Su Amazon Bedrock, Google Cloud's Agent Platform, Microsoft Foundry e Mantle, i cui deployment utilizzano ID modello specifici del provider, il plan mode rimane sul modello della sessione ogni volta che il modello di aggiornamento è escluso.

Per un approccio ibrido in cui Claude decide a metà attività quando consultare un secondo modello piuttosto che passare al confine del piano, consulta lo strumento advisor.

Catene di modelli di fallback

Quando il modello primario è sovraccarico, non disponibile o restituisce un altro errore del server per cui non è possibile riprovare, Claude Code può passare a un modello di fallback invece di far fallire la richiesta. Gli errori di autenticazione, fatturazione, rate limit, dimensione della richiesta e trasporto, e un rifiuto da parte del controllo delle policy della tua organizzazione, non attivano mai un passaggio; questi seguono i loro normali nuovi tentativi e la normale gestione degli errori. Il passaggio avviene invece quando Amazon Bedrock o Google Cloud's Agent Platform rifiuta un modello che il tuo account non può invocare, che Claude Code tratta come modello non disponibile piuttosto che come un errore di autenticazione.

Configura uno o più modelli di fallback e Claude Code li prova in ordine, mostrando un avviso quando passa. Il passaggio dura solo per il turno corrente, quindi il tuo prossimo messaggio prova di nuovo prima il modello primario. Claude Code limita le catene a tre modelli dopo la rimozione dei duplicati e ignora le voci extra.

Imposta una catena per una sessione con il flag --fallback-model, che accetta un elenco separato da virgole:

claude --fallback-model sonnet,haiku

Per mantenere una catena tra le sessioni, imposta fallbackModel nelle impostazioni come array:

{
  "fallbackModel": ["claude-sonnet-5", "claude-haiku-4-5"]
}

Il flag --fallback-model ha la precedenza sull'impostazione fallbackModel. Ogni voce accetta un nome di modello o un alias, e "default" si espande al modello predefinito.

Claude Code non conferma la catena all'avvio e /status non la visualizza. L'avviso mostrato quando si verifica un passaggio è il primo segno visibile che un fallback è configurato.

Quando una richiesta passa al fallback, Claude Code prova ogni voce in ordine finché una non l'accetta. Anche una voce che non può essere raggiunta, come un modello ritirato bloccato nelle impostazioni, passa alla successiva nello stesso modo. Claude Code rimuove due tipi di voce prima che inizi questo percorso:

  • Al di fuori dell'allowlist: Claude Code elimina qualsiasi voce non consentita da availableModels quando legge la catena.
  • Finestra di contesto più piccola durante la compattazione: la catena copre anche la compattazione, ma Claude Code non ripiegherà su un modello con una finestra di contesto più piccola di quella del primario, poiché il riassunto lì taglierebbe prima parte della conversazione. Se ogni fallback è più piccolo, la compattazione mostra l'errore originale e puoi riprovare.

Claude Code applica la catena anche ai subagent. Quando la richiesta di un subagent passa al fallback, Claude Code prova i modelli di fallback configurati in ordine, e il subagent continua sul modello che accetta la richiesta. Il modello della tua sessione rimane invariato. Prima della v2.1.247, un errore coperto dalla catena terminava invece il subagent.

Fallback automatico del modello

Questa sezione copre il fallback basato sul contenuto dai modelli Fable, Opus 5.5, Sonnet 5.5 e Opus 5. Per il fallback basato sulla disponibilità quando un modello è sovraccarico o non disponibile, consulta Catene di modelli di fallback.

I modelli Fable, Opus 5.5, Sonnet 5.5 e Opus 5 vengono eseguiti con classificatori di sicurezza, che il più delle volte segnalano contenuti di sicurezza informatica e biologia. Per queste due categorie, il modello di fallback dipende da quale modello ha rifiutato:

  • Fable 5.1, Fable 5 e Opus 5.5: le richieste segnalate per biologia vengono rieseguite su Opus 5, e le richieste segnalate per sicurezza informatica vengono rieseguite su Opus 4.8.
  • Sonnet 5.5: le richieste segnalate per sicurezza informatica vengono rieseguite su Sonnet 5. Le richieste segnalate per biologia terminano invece con un rifiuto, perché Sonnet 5.5 non ha un modello di fallback per la biologia.
  • Opus 5: le richieste segnalate per sicurezza informatica vengono rieseguite su Opus 4.8. Le richieste segnalate per biologia terminano invece con un rifiuto, perché Opus 5 esegue i propri classificatori di biologia senza modello di fallback.

Su Amazon Bedrock, Google Cloud's Agent Platform e Microsoft Foundry, Claude Code risolve invece questi target tramite gli ID modello del tuo deployment. Consulta Abilitare il fallback su Bedrock, Agent Platform e Foundry.

Quando Claude Code passa una richiesta segnalata al modello di fallback per la sua categoria, riesegue la richiesta su quel modello. Nella conversazione principale, mostra un avviso nella trascrizione. Per ricevere prima una richiesta di conferma, consulta Chiedere prima di passare.

Dopo un fallback, la sessione continua sul modello di fallback. Per tornare al tuo modello originale, esegui /model.

Il fallback basato sulla categoria richiede Claude Code v2.1.219 o successiva. Prima della v2.1.219, ogni richiesta Fable 5 segnalata veniva rieseguita sul modello Opus predefinito del tuo provider, e Opus 5 non era una fonte di fallback.

Il modello di fallback viene controllato rispetto a availableModels. Quando è bloccato, non si verifica alcun fallback. Il rifiuto viene mostrato come un errore normale e il modello della sessione rimane invariato.

Livello di sforzo dopo un fallback

Quando Claude Code passa la tua sessione al modello di fallback, mantiene il livello di sforzo con cui è stata eseguita la richiesta segnalata. Ad esempio, una sessione su Opus 5.5 al suo valore predefinito medium che ripiega su Opus 4.8 rimane a medium, anche se il valore predefinito di Opus 4.8 è high.

Un livello diverso si applica in casi come questi:

  • Una tua modifica: una volta che scegli un livello di sforzo, selezioni un modello in /model o riprendi la sessione in seguito, il livello della richiesta segnalata non viene più mantenuto.
  • Sforzo della skill: un livello impostato dal frontmatter effort di una skill per la richiesta segnalata si applica a quel turno, e i turni successivi vengono eseguiti al livello che l'ordine di risoluzione dello sforzo assegna al modello di fallback.

Nella sessione, esegui /effort status per vedere il livello in vigore, oppure /effort per cambiarlo.

Verificare cosa ha attivato il fallback

Il fallback può attivarsi alla prima richiesta di una sessione, prima di inviare qualcosa di insolito, perché la prima richiesta contiene il contesto del workspace come il contenuto di CLAUDE.md e lo stato di git. Un repository che contiene materiale di sicurezza o biologia può attivare il classificatore solo con quel contesto.

Per verificare se le personalizzazioni sono la causa, avvia una sessione con claude --safe-mode, che disabilita le personalizzazioni come CLAUDE.md, skill, server MCP e hook. Lo stato di git e i nomi delle directory non sono personalizzazioni e sono comunque inclusi.

Chiedere prima di passare

Per decidere cosa accade ogni volta che una richiesta viene segnalata, esegui /config, seleziona Cambia modelli quando un messaggio viene segnalato e scegli Chiedi ogni volta. Puoi anche impostare switchModelsOnFlag su false nel tuo file di impostazioni. Claude Code quindi si ferma a una richiesta segnalata che cambierebbe modello e ti offre due opzioni: passare al modello di fallback, oppure modificare il prompt e riprovare.

La prima volta che una richiesta segnalata cambierebbe modello in una sessione interattiva, Claude Code potrebbe chiederti se passare automaticamente da quel momento in poi. Lo chiede solo se non hai impostato switchModelsOnFlag, e salva la tua scelta come quella chiave nelle impostazioni utente.

Se scegli invece di restare sul modello corrente, il valore salvato è false, come per Chiedi ogni volta. Se ignori la domanda, Claude Code non salva nulla e la ripropone la prossima volta che una richiesta segnalata cambierebbe modello.

Quando hai scelto Chiedi ogni volta, alcuni casi si comportano diversamente:

  • Quando la categoria segnalata non ha un modello di fallback, come un flag di biologia su Opus 5 o Sonnet 5.5, Claude Code non mostra la richiesta di conferma e la richiesta termina con il rifiuto.
  • Se entrambi i modelli segnalano la stessa richiesta, puoi modificare il prompt e riprovare, o avviare una nuova sessione.
  • Nelle sessioni cloud sull'app mobile, la modifica e il nuovo tentativo non sono supportati. Cambia modello, oppure continua la sessione da un browser desktop o dall'app desktop.
  • In modalità non interattiva e nelle integrazioni SDK che non possono mostrare la richiesta di conferma, una richiesta segnalata termina invece il turno con un rifiuto.
  • In un subagent, Claude Code non mostra la richiesta di conferma, e una richiesta segnalata che cambierebbe modello viene rieseguita sul modello di fallback.
  • Quando il target di fallback è bloccato da availableModels, Claude Code non mostra la richiesta di conferma. La richiesta segnalata termina con il rifiuto, come il fallback automatico quando il target è bloccato.

Abilitare il fallback su Bedrock, Agent Platform e Foundry

Su Amazon Bedrock, Google Cloud's Agent Platform e Microsoft Foundry, gli ID modello sono specifici del provider, quindi il fallback automatico funziona solo quando Claude Code può identificare ciascun modello coinvolto:

  • Claude Code deve riconoscere il modello corrente come fonte di fallback. Fable 5.1 e Fable 5 vengono riconosciuti quando l'ID modello contiene claude-fable-5, corrisponde al valore di ANTHROPIC_DEFAULT_FABLE_MODEL o è mappato con modelOverrides. Opus 5.5, Sonnet 5.5 e Opus 5 vengono riconosciuti dal loro ID modello del provider o da un mapping modelOverrides.
  • Un target Opus deve risolversi nel tuo deployment, indipendentemente da quale modello ha rifiutato: imposta ANTHROPIC_DEFAULT_OPUS_MODEL, o mantieni una voce Opus 4.8 nell'elenco dei modelli del provider. Senza di esso, il fallback rimane disattivato per ogni modello sorgente, incluso Sonnet 5.5, e le richieste segnalate terminano con un rifiuto.
  • Il modello di fallback della categoria segnalata deve risolversi nel tuo deployment. Da un modello Fable, Opus 5.5 o Opus 5, se imposti ANTHROPIC_DEFAULT_OPUS_MODEL, le richieste segnalate vengono rieseguite su quel modello per ogni categoria che ha un fallback; un flag di biologia su Opus 5 termina comunque con un rifiuto. Se non lo imposti, le richieste segnalate per sicurezza informatica vengono rieseguite sulla voce Opus 4.8, e le richieste segnalate per biologia da un modello Fable o Opus 5.5 su una voce Opus 5. Da Sonnet 5.5, le richieste segnalate per sicurezza informatica vengono rieseguite sul modello che imposti in ANTHROPIC_DEFAULT_SONNET_MODEL, o su una voce Sonnet 5 nell'elenco dei modelli del provider se non lo imposti.

Se uno dei modelli non può essere identificato, Claude Code non cambia modello. La richiesta segnalata termina con un messaggio di rifiuto e puoi cambiare modello con /model e riprovare. Per rendere entrambi i modelli identificabili, imposta i pin per il tuo modello sorgente:

  • Modelli Fable: imposta ANTHROPIC_DEFAULT_FABLE_MODEL sul tuo ID modello Fable in modo che Claude Code lo riconosca come fonte di fallback.
  • Ogni modello sorgente: imposta ANTHROPIC_DEFAULT_OPUS_MODEL su un ID modello Opus per attivare il fallback e fornire un target alle categorie segnalate. Un pin che indica un modello al di fuori della famiglia Opus, o il modello che ha rifiutato, lascia invariato il rifiuto.
  • Sonnet 5.5: oltre al pin Opus, imposta ANTHROPIC_DEFAULT_SONNET_MODEL o mantieni una voce Sonnet 5 nell'elenco dei modelli del provider per fornire il modello su cui la richiesta viene rieseguita. Un pin Sonnet che indica un modello al di fuori della famiglia Sonnet, o Sonnet 5.5 stesso, lascia invariato il rifiuto.

Il modello di fallback deve inoltre avere una finestra di contesto grande almeno quanto quella della sessione, altrimenti Claude Code non cambia modello e la richiesta segnalata termina con lo stesso rifiuto. Su questi provider i modelli sorgente vengono eseguiti con la finestra di contesto 1M per impostazione predefinita. Blocca un modello che faccia altrettanto, come Opus 4.8 in ANTHROPIC_DEFAULT_OPUS_MODEL o Sonnet 5 in ANTHROPIC_DEFAULT_SONNET_MODEL, tramite un ID che Claude Code possa associare a quel modello.

Ricerca sulla sicurezza e carichi di lavoro biologici

I carichi di lavoro di sicurezza offensiva o biologia, inclusi test di penetrazione, esercizi Capture the Flag (CTF) e codebase legati alla biologia, attivano frequentemente il fallback, spesso alla prima richiesta. Per un lavoro sostanziale di biologia su Fable 5.1, Fable 5 o Opus 5.5, la prima richiesta segnalata che cambia modello sposta la sessione su Opus 5, e le successive richieste segnalate per biologia terminano lì con dei rifiuti, perché Opus 5 non ha fallback per la biologia. Su Opus 5 e Sonnet 5.5, ricevi quei rifiuti fin dalla prima richiesta segnalata.

Questo è il routing previsto per questi domini, non un flag dell'account. Se la tua organizzazione ha bisogno di capacità di classe Fable per questo lavoro, chiedi al tuo team di account Anthropic informazioni sui programmi di accesso affidabile.

Regola il livello di sforzo

I livelli di sforzo controllano il ragionamento adattivo, che consente al modello di decidere se e quanto ragionare a ogni passo in base alla complessità dell'attività. Uno sforzo inferiore è più veloce ed economico per attività semplici, mentre uno sforzo superiore fornisce un ragionamento più profondo per problemi complessi.

I livelli di sforzo disponibili dipendono dal modello. I modelli non elencati qui non supportano lo sforzo:

Modello Livelli
Fable 5.1 e Fable 5 low, medium, high, xhigh, max
Opus 5.5, Sonnet 5.5, Haiku 5.5, Opus 5, Sonnet 5, Opus 4.8 e Opus 4.7 low, medium, high, xhigh, max
Opus 4.6 e Sonnet 4.6 low, medium, high, max

Se imposti un livello che il modello attivo non supporta, Claude Code ripiega sul livello supportato più alto pari o inferiore a quello impostato. Ad esempio, xhigh viene eseguito come high su Opus 4.6. La tua organizzazione o le tue stesse impostazioni possono anche limitare i livelli che un modello offre; consulta Limiti di sforzo dell'organizzazione.

Claude Code risolve il livello di sforzo della sessione in questo ordine, prendendo il primo che si applica:

  1. Una scelta esplicita: la variabile d'ambiente CLAUDE_CODE_EFFORT_LEVEL, l'avvio con --effort, o /effort nella sessione (un /effort non interattivo ha un effetto più ristretto)
  2. Le tue impostazioni: il livello che hai salvato per il modello o una chiave effortLevel, con la precedenza tra loro e tra i file di impostazioni indicata in modelSettings
  3. Lo sforzo predefinito del modello: high su ogni modello che supporta lo sforzo, tranne Opus 5.5, Sonnet 5.5 e Haiku 5.5, il cui predefinito è medium, e Opus 4.7, il cui predefinito è xhigh; inoltre, quando la tua organizzazione imposta un livello di sforzo predefinito per il suo modello predefinito dell'organizzazione, quel livello è il predefinito quando esegui quel modello

Dopo un fallback automatico del modello, consulta Livello di sforzo dopo un fallback per il livello che si applica.

Opus 5.5 inizia a medium a meno che una delle fonti sopra non imposti un livello per esso, e un effortLevel di primo livello nel tuo file di impostazioni utente non conta per Opus 5.5. Quella chiave è la forma più vecchia che /effort scriveva prima che Claude Code salvasse i livelli per modello: continua ad applicarsi dove si applicava prima, su Opus 5, Fable 5.1 e modelli precedenti, mentre Opus 5.5 e i modelli rilasciati dopo di esso iniziano al loro predefinito finché non scegli un livello per loro con /effort o il selettore /model. Un effortLevel di primo livello nelle impostazioni di progetto, locali o gestite, o uno passato con --settings, si applica a ogni modello.

Quando imposti low, medium, high o xhigh in una sessione interattiva sulla tua macchina, scegli quanto dura in base a come lo confermi:

  • Enter nel cursore /effort o nel selettore /model, o un livello digitato dopo /effort: salva il livello come predefinito e applicalo nelle sessioni successive
  • s nel cursore /effort o nel selettore /model: applica il livello solo a questa sessione. Richiede Claude Code v2.1.257 o successiva

Claude Code salva il livello per modello, sotto la chiave modelSettings nelle tue impostazioni utente, quindi ogni modello mantiene il proprio livello salvato.

max è il livello di ragionamento più profondo. A meno che non lo imposti tramite la variabile d'ambiente CLAUDE_CODE_EFFORT_LEVEL, Claude Code applica max solo alla sessione corrente.

Quando imposti un livello con /effort in un'esecuzione -p, Claude Code lo applica solo a quella sessione e non lo salva come predefinito.

Il cursore /effort ha anche un'opzione Ultracode. Ultracode è un'impostazione di Claude Code piuttosto che un livello di sforzo del modello: quando è attiva, Claude orchestra workflow dinamici per attività sostanziali, a qualunque livello di sforzo venga eseguita la sessione. Per sapere dove può essere impostata in modo persistente, consulta l'impostazione ultracode.

Attivare o disattivare ultracode con /effort o l'impostazione ultracode lascia invariato il livello di sforzo. Il flag --effort ultracode e il valore Agent SDK effortLevel: "ultracode" lo attivano e impostano anche il livello a xhigh. Scegliere un livello nel cursore /effort o nel selettore /model lascia ultracode com'era.

Puoi attivare ultracode in uno dei seguenti modi:

  • /effort: esegui /effort ultracode per attivarlo per la sessione corrente o /effort ultracode off per disattivarlo. Nel cursore /effort, premi Tab per cambiare lo stato dell'opzione Ultracode, quindi Enter per applicarla
  • Flag --effort: avvia con claude --effort ultracode, che avvia la sessione a sforzo xhigh con ultracode attivato
  • Impostazione ultracode: imposta "ultracode": true in un file di impostazioni, con --settings, o in una richiesta di controllo Agent SDK. Una richiesta applyFlagSettings() accetta anche effortLevel: "ultracode", che lo attiva e imposta il livello di sforzo a xhigh

La forma /effort ultracode off, l'opzione nel cursore e il mantenimento di ultracode attivato a livelli di sforzo diversi da xhigh richiedono Claude Code v2.1.284 o successiva. Prima della v2.1.284, attivare ultracode impostava la sessione a sforzo xhigh, scegliere un altro livello lo disattivava, e un limite di sforzo inferiore a xhigh lo rendeva non disponibile.

Passare ultracode al flag --effort o al valore Agent SDK effortLevel richiede Claude Code v2.1.203 o successiva. Prima della v2.1.203, --effort ultracode stampava Unknown --effort value 'ultracode' e la sessione iniziava allo sforzo predefinito.

L'impostazione persistente effortLevel e la variabile d'ambiente CLAUDE_CODE_EFFORT_LEVEL non accettano ultracode. Se CLAUDE_CODE_EFFORT_LEVEL o un limite di sforzo imposta il livello della sessione, ultracode rimane attivato a quel livello.

Ultracode non è disponibile quando:

In questi casi --effort ultracode avvia la sessione con ultracode disattivato, al livello di sforzo più alto che il modello e un eventuale limite consentono, fino a xhigh.

Scegli un livello di sforzo

Ogni livello bilancia la spesa di token rispetto alla capacità. Il predefinito si adatta alla maggior parte delle attività di programmazione; regolalo quando desideri un equilibrio diverso.

Livello Quando usarlo
low Scambi rapidi in cui rivedi ogni risultato, come brainstorming, una prima bozza o una piccola modifica come una ridenominazione
medium Il predefinito su Opus 5.5, Sonnet 5.5 e Haiku 5.5. Su Opus 5.5 e Sonnet 5.5, si adatta al lavoro di ingegneria quotidiano con un ambito chiaro, come l'implementazione di una nuova funzionalità. Sui modelli con un predefinito più alto, riduce l'utilizzo di token per il lavoro sensibile ai costi che può sacrificare un po' di intelligenza
high Lavoro in cui la verifica è importante o i casi limite sono probabili, come la correzione di un bug in un codebase esistente. Il predefinito su ogni modello tranne Opus 5.5, Sonnet 5.5, Haiku 5.5 e Opus 4.7
xhigh Ragionamento più profondo a una spesa di token più elevata. Il predefinito su Opus 4.7
max Problemi difficili che vuoi che Claude risolva senza di te, come trovare vulnerabilità di sicurezza. max può mostrare rendimenti decrescenti ed è soggetto a ragionamento eccessivo, quindi provalo prima di adottarlo su larga scala
ultracode Un'impostazione di Claude Code piuttosto che un livello: pianifica un workflow dinamico per ogni attività sostanziale a qualsiasi livello di sforzo

Nei test su Opus 5.5 e Fable 5.1, Claude a un livello superiore ha testato più casi limite e ha verificato una parte maggiore del suo lavoro prima di rispondere. Ha anche fatto più scelte in autonomia. A un livello inferiore, Claude ha restituito un punto di partenza più velocemente, il che si adatta al lavoro in cui rivedi ogni risultato e guidi il passo successivo. Per vedere le stesse attività eseguite a ogni livello, leggi Using Claude Code: Spending your effort sul blog.

La scala dello sforzo è calibrata per modello, quindi lo stesso nome di livello non rappresenta lo stesso valore sottostante tra i modelli.

Il predefinito di Opus 5.5 è medium, un livello sotto il predefinito high di Opus 5. Nei test di Anthropic, Opus 5.5 a medium eguaglia o supera Opus 5 a high nelle valutazioni di programmazione e lavoro di conoscenza. A parità di livello, Opus 5.5 tende a ragionare di più per turno rispetto a Opus 5. Quando passi da Opus 5 a Opus 5.5, inizia da medium invece di riportare il livello che usavi su Opus 5. Per testare i livelli sul tuo lavoro, consulta Calibrate effort nella guida al prompting di Opus 5.5.

Usa ultrathink per un ragionamento profondo una tantum

Includi ultrathink in qualsiasi punto del tuo prompt per richiedere un ragionamento più profondo in quel turno senza modificare l'impostazione dello sforzo della sessione. Claude Code riconosce la parola chiave e aggiunge un'istruzione nel contesto. Il livello di sforzo inviato all'API rimane invariato. Claude Code passa altre frasi come "think", "think hard" e "think more" come normale testo del prompt e non le riconosce come parole chiave.

Imposta il livello di sforzo

Puoi modificare lo sforzo in uno dei seguenti modi:

  • /effort: esegui /effort senza argomenti per aprire un cursore interattivo, /effort seguito da un nome di livello per impostarlo direttamente, o /effort auto per cancellare il livello salvato per il modello attivo. Puoi eseguirlo mentre Claude sta lavorando e, una volta confermato l'avviso sulla cache, se Claude Code ne mostra uno, Claude Code applica il nuovo livello alla richiesta successiva nel turno
  • In /model: usa i tasti freccia sinistra/destra per regolare il cursore dello sforzo quando selezioni un modello
  • Flag --effort: passa un nome di livello per impostarlo per una singola sessione quando avvii Claude Code
  • Variabile d'ambiente: imposta CLAUDE_CODE_EFFORT_LEVEL su un nome di livello o auto
  • Impostazioni: imposta un livello per modello in modelSettings, o imposta effortLevel su low, medium, high o xhigh come predefinito per i modelli che non ne hanno uno. max non è accettato come livello in nessuna delle due chiavi, e ultracode ha la sua chiave ultracode
  • Da un dispositivo connesso: in una sessione Remote Control, scegli un livello dal controllo dello sforzo sul tuo telefono o nel browser. Il livello si applica solo alla sessione corrente. Richiede Claude Code v2.1.234 o successiva
  • Frontmatter di skill e subagent: imposta effort nel file markdown di una skill o di un subagent per sovrascrivere il livello di sforzo quando quella skill o quel subagent viene eseguito

Lo sforzo del frontmatter si applica quando quella skill o quel subagent è attivo, sovrascrivendo il livello della sessione ma non la variabile d'ambiente. Un maxEffortLevel o un limite di sforzo dell'organizzazione limita comunque il livello a cui viene eseguito la skill o il subagent.

Se imposti effortLevel nelle impostazioni gestite, Claude Code lo applica al passo delle impostazioni dell'ordine di risoluzione dello sforzo, e gli utenti possono comunque modificare il livello con /effort o --effort. Per mantenere gli utenti a un livello o al di sotto di esso, imposta maxEffortLevel.

Il cursore dello sforzo appare in /model quando è selezionato un modello supportato. Il livello di sforzo corrente è mostrato anche nell'intestazione della sessione accanto al nome del modello, ad esempio "with low effort", così puoi verificare quale impostazione è attiva senza aprire /model. Il piè di pagina mostra anche brevemente il livello di sforzo all'avvio e quando cambia.

Ragionamento adattivo e budget di ragionamento fissi

Il ragionamento adattivo rende il ragionamento opzionale a ogni passo, quindi Claude può rispondere più velocemente ai prompt di routine e riservare un ragionamento più profondo ai passi che ne traggono beneficio. Se vuoi che Claude ragioni più o meno spesso di quanto produce il livello corrente, puoi dirlo direttamente nel tuo prompt o in CLAUDE.md; il modello segue quell'indicazione entro la sua impostazione di sforzo.

I modelli Fable, Sonnet 5 e successivi, Haiku 5.5, e Opus 4.7 e successivi utilizzano sempre il ragionamento adattivo. La modalità con budget di ragionamento fisso e CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING non si applicano a loro.

Su Opus 4.6 e Sonnet 4.6, puoi impostare CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING=1 per tornare al precedente budget di ragionamento fisso controllato da MAX_THINKING_TOKENS. Consulta variabili d'ambiente.

Ragionamento esteso

Il ragionamento esteso è il ragionamento che Claude produce prima di rispondere. Sui modelli che supportano il ragionamento adattivo, il livello di sforzo è il controllo principale della quantità di ragionamento; le impostazioni seguenti attivano o disattivano il ragionamento e controllano come viene visualizzato. Con il ragionamento disattivato su Anthropic API, Claude Code invia lo sforzo high invece di un livello superiore ai modelli che sa non accettare quella combinazione, come Opus 5.

Controllo Come impostarlo
Attiva/disattiva per la sessione corrente Premi Option+T su macOS o Alt+T su Windows e Linux
Imposta il predefinito globale Esegui /config e attiva/disattiva la modalità di ragionamento. Salvato come alwaysThinkingEnabled in ~/.claude/settings.json
Disattiva tramite una variabile d'ambiente Imposta MAX_THINKING_TOKENS=0, che disattiva il ragionamento su Anthropic API tranne che su Opus 5.5, Sonnet 5.5, Haiku 5.5 e sui modelli Fable. Sui provider di terze parti, Claude Code omette invece il parametro thinking, e i modelli con ragionamento adattivo potrebbero comunque ragionare

Non puoi disattivare il ragionamento su Opus 5.5, Sonnet 5.5, Haiku 5.5 o sui modelli Fable. L'opzione della sessione e la riga di /config mostrano Thinking can't be turned off per questi modelli invece di offrire l'interruttore, e un alwaysThinkingEnabled: false o MAX_THINKING_TOKENS=0 salvato non ha effetto lì. Su questi modelli, il modello decide per ogni passo quanto ragionare in base al livello di sforzo. L'impostazione salvata si applica di nuovo quando passi a un modello che la accetta.

Claude Code comprime l'output del ragionamento per impostazione predefinita. Premi Ctrl+O per attivare/disattivare la modalità dettagliata e vedere il ragionamento come testo grigio in corsivo. Le sessioni interattive su Anthropic API ricevono blocchi di ragionamento oscurati per impostazione predefinita, quindi imposta showThinkingSummaries: true nelle impostazioni se vuoi che i riassunti completi siano disponibili quando espandi. Ti vengono addebitati tutti i token di ragionamento generati, anche quando compressi o oscurati.

Contesto esteso

Fable 5.1, Fable 5, Sonnet 5 e successivi, Haiku 5.5, Opus 4.6 e successivi, e Sonnet 4.6 supportano una finestra di contesto di 1 milione di token per sessioni lunghe con codebase di grandi dimensioni.

Fable 5.1, Fable 5, Sonnet 5 e successivi, Haiku 5.5, e Opus 4.7 e successivi vengono eseguiti con la finestra 1M per impostazione predefinita, senza bisogno del suffisso [1m]. Ciò include le sessioni su Amazon Bedrock, Google Cloud's Agent Platform e Microsoft Foundry, e le sessioni tramite Claude apps gateway. Per eseguirli invece con una finestra di 200K, consulta Disattiva il contesto 1M.

Opus 4.6 e Sonnet 4.6 raggiungono 1M solo attraverso la loro variante [1m], e l'accesso a quella variante dipende dal tuo piano. Sui piani Max, Team ed Enterprise, inclusi sia i posti Team Standard che Team Premium, Opus 4.6 con contesto 1M è incluso nel tuo abbonamento. Sonnet 4.6 con contesto 1M richiede crediti di utilizzo su ogni piano di abbonamento, incluso Max.

Piano Opus 4.6 con contesto 1M Sonnet 4.6 con contesto 1M
Max, Team e Enterprise Incluso nell'abbonamento Richiede crediti di utilizzo
Pro Richiede crediti di utilizzo Richiede crediti di utilizzo
API e pagamento a consumo Accesso completo Accesso completo

Claude Code controlla questi requisiti del piano solo quando si connette direttamente ad Anthropic API. Se punti ANTHROPIC_BASE_URL a un gateway LLM e il tuo accesso salvato a claude.ai rimane la credenziale attiva, Claude Code non controlla i crediti di utilizzo del tuo piano. Le opzioni [1m] rimangono disponibili in /model, e il gateway decide se la richiesta ha successo. Prima della v2.1.229, Claude Code rifiutava /model sonnet[1m] in quella configurazione quando non poteva confermare i crediti di utilizzo sull'account.

Su Anthropic API, la finestra di contesto 1M utilizza i prezzi standard del modello senza sovrapprezzo per i token oltre 200K, tranne su Haiku 5.5, che costa di più sui prompt più lunghi di 100K token. Per i piani in cui il contesto esteso è incluso nel tuo abbonamento, l'utilizzo rimane coperto dal tuo abbonamento. Per i piani che accedono al contesto esteso tramite crediti di utilizzo, i token vengono fatturati ai crediti di utilizzo.

Seleziona il contesto 1M per Opus 4.6 o Sonnet 4.6

Per selezionare una variante 1M per nome, aggiungi il suffisso [1m] a un alias di modello o a un nome di modello completo:

# Aggiungi [1m] a un nome di modello completo
/model claude-opus-4-6[1m]
/model claude-sonnet-4-6[1m]

# Oppure a un alias: il suffisso si applica al modello in cui l'alias si risolve
/model opus[1m]

Finestra di contesto dietro un gateway LLM

Se imposti ANTHROPIC_BASE_URL su un gateway LLM o un altro proxy, Claude Code assegna a ogni modello che riconosce la stessa finestra di contesto che il modello ha su Anthropic API. Fable 5.1, Fable 5, Sonnet 5 e successivi, Haiku 5.5, e Opus 4.7 e successivi ottengono la finestra 1M senza una variante [1m] da selezionare, e un modello che raggiunge 1M solo tramite la sua variante [1m], come Opus 4.6, viene eseguito a 200K senza di essa. Claude Code non può rilevare un limite inferiore applicato dal gateway o dal server che si trova dietro di esso. Se il tuo gateway rifiuta le richieste sopra i 200K token, imposta CLAUDE_CODE_AUTO_COMPACT_WINDOW=200000 nell'ambiente che avvia Claude Code, in modo che le sessioni su ogni modello si compattino a quel limite.

Disattiva il contesto 1M

Per mantenere le sessioni a una finestra di 200K, imposta CLAUDE_CODE_DISABLE_1M_CONTEXT=1 nella tua shell o in un file di impostazioni. Claude Code rimuove le varianti di modello [1m] dal selettore di modelli. Sui modelli che vengono eseguiti con la finestra 1M per impostazione predefinita, come i modelli Fable, Sonnet 5 e successivi, e Opus 4.7 e successivi, tratta anche il modello come avente una finestra di contesto di 200K:

  • Con la compattazione automatica attivata, le sessioni si compattano al limite di 200K tramite la compattazione automatica. Impostare la finestra di compattazione automatica sopra 200K non rimuove il limite, perché Claude Code limita quella finestra alla finestra di contesto del modello.
  • Con la compattazione automatica disattivata, le sessioni si fermano al limite di 200K con l'errore di limite di contesto invece di compattarsi.

Finestra di contesto e prezzi di Haiku 5.5

Su Anthropic API, Haiku 5.5 viene eseguito con la finestra di contesto 1M su ogni piano, senza suffisso [1m] da selezionare. Il suo ID modello è claude-haiku-5-5. Per usarlo, esegui /model claude-haiku-5-5 in una sessione, oppure avvia Claude Code dalla tua shell con claude --model claude-haiku-5-5.

Una richiesta Haiku 5.5 costa di più per token quando il suo prompt supera i 100K token. Consulta i prezzi di Anthropic per entrambe le tariffe.

Le sessioni si compattano automaticamente a circa 967K token per impostazione predefinita. Per compattare prima, imposta una finestra di compattazione automatica più piccola per il modello.

Finestra di contesto e compattazione automatica

La finestra di compattazione automatica è il livello di riempimento della finestra di contesto prima che Claude Code compatti la conversazione. Per informazioni su cosa la compattazione mantiene e scarta per ogni meccanismo, consulta Cosa sopravvive alla compattazione.

Impostare la finestra di compattazione automatica

Puoi impostare la finestra di compattazione automatica in queste posizioni:

  • Per il modello corrente, in questa sessione e in quelle successive: esegui /autocompact con un valore, come /autocompact 500k. Claude Code lo salva nelle tue impostazioni utente sotto il modello corrente in modelSettings e lo applica alla sessione corrente. Se un ambito di impostazioni con priorità più alta, come le impostazioni gestite, imposta una propria finestra per quel modello o per tutti i modelli, il comando salva il tuo valore ma la sessione mantiene la finestra di tale ambito, e il comando lo comunica. Esegui /autocompact auto per tornare alla finestra ottimizzata per il tuo modello. Prima della v2.1.288, il comando salvava un'unica finestra per tutti i modelli, come autoCompactWindow di primo livello.
  • Per tutti i modelli: imposta autoCompactWindow in un file di impostazioni, ad esempio "autoCompactWindow": 200000 in ~/.claude/settings.json. Una finestra che hai salvato per un modello con /autocompact ha la precedenza su questa chiave nello stesso file per quel modello.
  • Per un singolo avvio: passa --autocompact all'avvio di Claude Code. Il flag sovrascrive l'impostazione salvata per tale avvio senza modificarla, e claude --autocompact auto esegue la sessione alla finestra ottimizzata anche se l'impostazione salvata ha un valore. A differenza di /autocompact, il flag non è prevenuto da un ambito di impostazioni con priorità più alta, come le impostazioni gestite.
  • In script e ambienti cloud: imposta CLAUDE_CODE_AUTO_COMPACT_WINDOW. Mentre è impostata, ha la precedenza sul comando, sul flag e sull'impostazione, e /autocompact segnala l'override invece di modificare la finestra.

Il comando e il flag accettano una dimensione della finestra da 100K a 1M token, in una qualsiasi di queste forme:

  • Un conteggio di token semplice, come 200000
  • Un suffisso k o M, come 500k o 1M
  • Un numero semplice da 100 a 1000, che significa migliaia, quindi 200 imposta 200.000

La variabile d'ambiente accetta solo il conteggio di token semplice. Claude Code limita la finestra alla finestra di contesto del modello.

Soglie di compattazione automatica predefinite

Se non imposti una finestra di compattazione automatica, Claude Code compatta quando la conversazione raggiunge il limite di contesto del modello, tranne in queste sessioni:

  • Le sessioni cloud si compattano mentre la conversazione si avvicina al limite del modello
  • Sonnet 4.6 e Opus 4.6 senza contesto esteso si compattano al limite di 200K
  • Quando imposti CLAUDE_CODE_DISABLE_1M_CONTEXT=1, i modelli con una finestra nativa di 1M, come Sonnet 5 e i modelli Fable, si compattano al limite di 200K
  • I modelli in esecuzione con una finestra nativa di 1M si compattano prima che la finestra si riempia, a circa 967K token per impostazione predefinita. Questi includono i modelli Fable, Sonnet 5 e versioni successive, Haiku 5.5 e Opus 4.7 e versioni successive. Dietro un ANTHROPIC_BASE_URL personalizzato, consulta la finestra di contesto dietro un gateway
  • Le sessioni su un ID modello che Claude Code non riconosce, come un alias LLM gateway, si compattano alla finestra di contesto che Claude Code assume per l'ID; consulta Correggere la finestra per un gateway o un ID modello personalizzato

Correggere la finestra per un gateway o un ID modello personalizzato

Su un LLM gateway o un altro deploy personalizzato, Claude Code può assumere una finestra di contesto per l'ID modello che differisce dalla finestra reale del modello, indipendentemente dal fatto che risolva l'ID a un modello Claude o meno. Imposta CLAUDE_CODE_MAX_CONTEXT_TOKENS alla finestra che Claude Code dovrebbe assumere invece.

Il modo in cui la variabile si applica dipende dall'ID. Claude Code tratta un ID come un provider o un'ortografia personalizzata quando non inizia con claude-, in qualsiasi maiuscola/minuscola, o quando porta un suffisso che Claude Code rimuove durante la lettura dell'ID, come la data @YYYYMMDD utilizzata su Google Cloud's Agent Platform. Prima della v2.1.259, Claude Code non contava un suffisso rimosso, quindi un ID claude- non riconosciuto con un suffisso di data era trattato come un nome claude- semplice.

Un provider non riconosciuto o un'ortografia personalizzata, la stessa ortografia con [1m] e ogni altro ID sono tre casi separati:

  • Se Claude Code non può risolvere un provider o un'ortografia personalizzata a un modello che riconosce e l'ID non contiene [1m], la variabile si applica direttamente e la compattazione proattiva continua alla finestra dichiarata.

  • Se Claude Code non può risolvere un provider o un'ortografia personalizzata a un modello che riconosce e l'ID contiene [1m], in qualsiasi maiuscola/minuscola, Claude Code assume una finestra di 1M per esso e la variabile non si applica da sola. Per correggere la finestra mantenendo la compattazione proattiva, imposta anche CLAUDE_CODE_DISABLE_1M_CONTEXT=1. Con quella variabile impostata, Claude Code dimensiona l'ID come la stessa ortografia senza [1m], quindi CLAUDE_CODE_MAX_CONTEXT_TOKENS si applica quando si applicherebbe a tale ortografia senza tag.

    Con una finestra dichiarata superiore a 200K, Claude Code mostra quindi un avviso di avvio che il limite di 200K non è applicato. L'avviso è previsto in questa configurazione.

  • Se l'ID si risolve a un modello che Claude Code riconosce, o l'ID è un nome claude- semplice senza suffisso per Claude Code da rimuovere, in qualsiasi maiuscola/minuscola, la variabile ha effetto solo quando imposti anche DISABLE_COMPACT, che disabilita tutta la compattazione.

    Ad esempio, un ID che contiene un nome di modello Claude che Claude Code conosce, come anthropic/claude-opus-4-8, us.anthropic.claude-…-v1:0, o il datato claude-sonnet-4-5@20250929, si risolve a quel modello. Questo include gli ID che contengono anche [1m]: Claude Code risolve claude-opus-4-8[1m] a Opus 4.8 anche con CLAUDE_CODE_DISABLE_1M_CONTEXT impostato.

Per un ID modello che Claude Code non riconosce, imposta CLAUDE_CODE_DISABLE_UNKNOWN_MODEL_WINDOW_ENFORCEMENT=1 per fare in modo che Claude Code si compatti solo dopo che l'API rifiuta la conversazione con un errore di lunghezza eccessiva che Claude Code riconosce. Claude Code non esegue quel recupero quando un gateway riscrive l'errore con una formulazione che Claude Code non riconosce.

Verifica del modello corrente

È possibile vedere quale modello stai utilizzando attualmente in due posizioni:

  • Nella riga di stato, se ne hai una configurata
  • In /status, che visualizza anche le informazioni del tuo account

Aggiungere un'opzione di modello personalizzato

Utilizzare ANTHROPIC_CUSTOM_MODEL_OPTION per aggiungere una singola voce personalizzata al selettore /model senza sostituire gli alias incorporati. Questo è utile per testare ID di modello che Claude Code non elenca per impostazione predefinita. Per le distribuzioni di gateway LLM, Claude Code può popolare il selettore dall'endpoint /v1/models del gateway quando CLAUDE_CODE_ENABLE_GATEWAY_MODEL_DISCOVERY=1 è impostato, quindi questa variabile è necessaria solo quando la scoperta è disabilitata o non restituisce il modello desiderato. Vedere gateway model discovery.

Per elencare invece diversi modelli, nel vostro ordine e con etichette che scegliete, impostare modelPicker. La sua voce specifica quali righe il selettore mantiene quando questo lineup sostituisce quello incorporato.

Questo esempio imposta tutte e tre le variabili per rendere selezionabile una distribuzione Opus instradata tramite gateway. Claude Code legge le variabili di ambiente all'avvio, quindi eseguire gli export prima di lanciare claude, o riavviare una sessione esistente per applicarle:

export ANTHROPIC_CUSTOM_MODEL_OPTION="my-gateway/claude-opus-5-5"
export ANTHROPIC_CUSTOM_MODEL_OPTION_NAME="Opus via Gateway"
export ANTHROPIC_CUSTOM_MODEL_OPTION_DESCRIPTION="Custom deployment routed through the internal LLM gateway"

ANTHROPIC_CUSTOM_MODEL_OPTION_NAME e ANTHROPIC_CUSTOM_MODEL_OPTION_DESCRIPTION sono facoltativi:

  • Se omettete il nome, la voce mostra il nome del modello quando Claude Code riconosce l'ID, e l'ID del modello altrimenti.
  • Se omettete la descrizione, Claude Code utilizza Custom model (<model-id>).

Claude Code elenca la voce personalizzata dopo le voci incorporate, e qualsiasi riga modelPicker che aggiungete viene dopo di essa.

Claude Code salta la convalida per l'ID del modello impostato in ANTHROPIC_CUSTOM_MODEL_OPTION, quindi è possibile utilizzare qualsiasi stringa che l'endpoint API accetta.

Quando availableModels è impostato, includere l'ID del modello personalizzato anche nell'elenco di autorizzazione. Altrimenti Claude Code filtra la voce personalizzata dal selettore e rifiuta una selezione --model di essa come qualsiasi altro modello escluso.

Un ID personalizzato che incorpora un nome di famiglia, come my-gateway/claude-opus-5-5, conta come una voce specifica per quella famiglia e disabilita il suo wildcard, quindi elencare anche le versioni che intendete mantenere selezionabili. Vedere Comportamento di unione.

Variabili d'ambiente

Usa le seguenti variabili d'ambiente per controllare i nomi dei modelli a cui gli alias si mappano. Ogni valore deve essere un nome di modello completo, o l'identificatore equivalente per il tuo provider API. Per scegliere il modello su cui iniziano le tue sessioni, imposta ANTHROPIC_DEFAULT_MODEL, che questa tabella omette.

Variabile d'ambiente Descrizione
ANTHROPIC_DEFAULT_FABLE_MODEL Il modello da usare per fable, e l'ID del modello che Claude Code riconosce come modello Fable per il fallback automatico del modello su provider di terze parti
ANTHROPIC_DEFAULT_OPUS_MODEL Il modello da usare per opus, o per opusplan quando Plan Mode è attivo.
ANTHROPIC_DEFAULT_SONNET_MODEL Il modello da usare per sonnet, o per opusplan quando Plan Mode non è attivo.
ANTHROPIC_DEFAULT_HAIKU_MODEL Il modello da usare per haiku, o per le funzionalità in background
CLAUDE_CODE_SUBAGENT_MODEL Il modello predefinito per i subagent, i membri di un team di agenti e gli agenti dei workflow a cui non è assegnato un modello in un altro modo. Accetta un alias come haiku o un nome di modello completo. Un modello per singola invocazione o il campo model di una definizione, incluso inherit, ha la precedenza. Per cambiare questo comportamento, imposta CLAUDE_CODE_SUBAGENT_MODEL_FORCE

Sui provider di terze parti, Personalizzare la visualizzazione e le capacità del modello fissato descrive cosa mostra la riga di un modello fissato nel selettore /model.

Nota: ANTHROPIC_SMALL_FAST_MODEL è deprecato a favore di ANTHROPIC_DEFAULT_HAIKU_MODEL.

Fissare i modelli per distribuzioni di terze parti

Quando distribuisci Claude Code tramite Amazon Bedrock, Google Cloud's Agent Platform, Microsoft Foundry o Claude Platform on AWS, fissa le versioni dei modelli prima di distribuirlo agli utenti.

Senza fissaggio, Claude Code usa alias di modelli come fable, opus, sonnet e haiku che si risolvono in un ID di modello predefinito incorporato per ogni provider. Questo valore predefinito può rimanere indietro rispetto alla versione più recente di Anthropic, e il modello a cui punta potrebbe non essere ancora abilitato nell'account di un utente. Quando il valore predefinito non è disponibile, gli utenti di Amazon Bedrock e Google Cloud's Agent Platform vedono un avviso e la sessione usa come fallback una versione precedente del modello predefinito, o il modello Sonnet predefinito quando il valore predefinito è un modello Opus e nessuna versione di Opus è disponibile. Gli utenti di Microsoft Foundry vedono invece degli errori, perché Microsoft Foundry non ha alcun controllo di avvio equivalente.

Su Amazon Bedrock e Google Cloud's Agent Platform, un utente che avvia la sessione su una versione specifica di Sonnet o Opus, ad esempio con --model, ANTHROPIC_MODEL o l'impostazione model, fissa quella versione come predefinita della sessione per l'alias corrispondente: il controllo di avvio salta il valore predefinito incorporato che essa sostituisce e non mostra alcun avviso di fallback. Prima della v2.1.211, il controllo veniva eseguito e poteva mostrare un avviso anche quando un modello di sessione era configurato esplicitamente.

Usa le seguenti variabili d'ambiente con ID di modello specifici della versione per il tuo provider:

Provider Esempio
Amazon Bedrock export ANTHROPIC_DEFAULT_OPUS_MODEL='us.anthropic.claude-opus-4-8'
Google Cloud's Agent Platform export ANTHROPIC_DEFAULT_OPUS_MODEL='claude-opus-4-8'
Microsoft Foundry export ANTHROPIC_DEFAULT_OPUS_MODEL='claude-opus-4-8'

Applica lo stesso schema per ANTHROPIC_DEFAULT_FABLE_MODEL, ANTHROPIC_DEFAULT_SONNET_MODEL e ANTHROPIC_DEFAULT_HAIKU_MODEL. Per gli ID di modello attuali e legacy su tutti i provider, consulta la Panoramica dei modelli. Per aggiornare gli utenti a una nuova versione del modello, aggiorna queste variabili d'ambiente e ridistribuisci.

Un modello fissato con una finestra 1M nativa, come Opus 4.8 o Sonnet 5, viene eseguito con la finestra di contesto 1M senza alcun suffisso quando Claude Code riesce ad abbinare l'ID fissato a quel modello. L'ID corrisponde quando contiene l'ID API Anthropic del modello, come us.anthropic.claude-opus-4-8 contiene claude-opus-4-8, oppure quando una voce di modelOverrides mappa il modello su di esso. Con un ID fissato che Claude Code non riesce ad abbinare a un modello, le sessioni vengono eseguite per impostazione predefinita con una finestra di 200K, a meno che l'ID non contenga il suffisso [1m].

Per un modello che raggiunge 1M tramite la sua variante [1m], come Opus 4.6 o Sonnet 4.6, abilita il contesto esteso aggiungendo [1m] all'ID del modello in ANTHROPIC_DEFAULT_OPUS_MODEL o ANTHROPIC_DEFAULT_SONNET_MODEL:

export ANTHROPIC_DEFAULT_OPUS_MODEL='claude-opus-4-6[1m]'

Con il suffisso [1m], la finestra di contesto 1M si applica a tutto l'utilizzo dell'alias fissato, inclusa la fase Opus in plan mode di opusplan e i subagent il cui frontmatter model nomina l'alias.

  • Claude Code rimuove il suffisso prima di inviare l'ID del modello al tuo provider.
  • Aggiungi [1m] solo quando il modello sottostante supporta il contesto 1M.
  • Il suffisso viene letto per variabile, non per modello. Su Amazon Bedrock, Google Cloud's Agent Platform e Microsoft Foundry, un ID di Opus 4.6 o Sonnet 4.6 senza [1m] in una variabile usa il contesto 200K anche se un'altra variabile imposta lo stesso modello con il suffisso.

Quando imposti una variabile ANTHROPIC_DEFAULT_*_MODEL, il selettore /model mostra una riga per quel modello al posto delle righe incorporate della famiglia, incluse eventuali righe di contesto 1M. Per raggiungere la finestra 1M senza aggiungere il suffisso a quella variabile, i tuoi utenti eseguono /model opus[1m] e Claude Code applica il suffisso al modello indicato dalla variabile. /model sonnet[1m] funziona allo stesso modo.

Personalizzare la visualizzazione e le capacità del modello fissato

Quando fissi un modello su un provider di terze parti, la sua riga nel selettore /model mostra per impostazione predefinita il nome del modello se Claude Code riconosce l'ID fissato, altrimenti l'ID grezzo:

  • Riconosciuto: l'ID esatto di un modello che Claude Code conosce, come il suo ID API Anthropic o la forma usata dal tuo provider o gateway, con o senza il suffisso [1m]. Se fissi us.anthropic.claude-sonnet-4-5-20250929-v1:0, la riga mostra Sonnet 4.5.
  • Non riconosciuto: qualsiasi altro ID, come un ARN di un application inference profile o una versione del modello che Claude Code non conosce, a meno che una voce di modelOverrides non mappi un modello su quella stringa esatta. Su Microsoft Foundry, i nomi dei deploy sono definiti dall'utente, quindi Claude Code non riconosce mai un ID fissato lì, mappato o meno, e la riga mostra per impostazione predefinita il nome del deploy.

Quando una riga mostra il nome del modello, la sua descrizione predefinita include l'ID fissato, così puoi comunque vedere quale ID è fissato.

Claude Code potrebbe anche non riconoscere quali funzionalità supporta un modello fissato. Puoi impostare tu stesso il nome visualizzato e la descrizione, e dichiarare le capacità con variabili d'ambiente complementari per ogni modello fissato.

Queste variabili hanno effetto sui provider di terze parti come Amazon Bedrock, Google Cloud's Agent Platform e Microsoft Foundry. Le variabili _NAME e _DESCRIPTION hanno effetto anche quando ANTHROPIC_BASE_URL punta a un gateway LLM. Non hanno alcun effetto quando ti connetti direttamente a api.anthropic.com.

Variabile d'ambiente Descrizione
ANTHROPIC_DEFAULT_OPUS_MODEL_NAME Nome visualizzato per il modello Opus fissato nel selettore /model. Se non è impostata, la riga mostra il nome del modello se Claude Code riconosce l'ID fissato, altrimenti l'ID fissato
ANTHROPIC_DEFAULT_OPUS_MODEL_DESCRIPTION Descrizione visualizzata per il modello Opus fissato nel selettore /model. Se non è impostata, la riga mostra una descrizione predefinita che inizia con Custom Opus model
ANTHROPIC_DEFAULT_OPUS_MODEL_SUPPORTED_CAPABILITIES Elenco separato da virgole delle capacità supportate dal modello Opus fissato

Gli stessi suffissi _NAME, _DESCRIPTION e _SUPPORTED_CAPABILITIES sono disponibili per ANTHROPIC_DEFAULT_SONNET_MODEL, ANTHROPIC_DEFAULT_HAIKU_MODEL, ANTHROPIC_DEFAULT_FABLE_MODEL e ANTHROPIC_CUSTOM_MODEL_OPTION.

Claude Code abilita funzionalità come i livelli di sforzo e il ragionamento esteso confrontando l'ID del modello con schemi noti. Gli ID specifici del provider, come gli ARN di Amazon Bedrock o i nomi di deploy personalizzati, spesso non corrispondono a questi schemi, lasciando disabilitate funzionalità supportate. Imposta _SUPPORTED_CAPABILITIES per indicare a Claude Code quali funzionalità il modello supporta effettivamente:

Valore di capacità Abilita
effort I livelli di sforzo e il comando /effort
xhigh_effort Il livello di sforzo xhigh
max_effort Il livello di sforzo max
thinking Il ragionamento esteso
adaptive_thinking Ragionamento adattivo che alloca dinamicamente il ragionamento in base alla complessità dell'attività
interleaved_thinking Ragionamento tra le chiamate agli strumenti

Quando _SUPPORTED_CAPABILITIES è impostata, Claude Code abilita le capacità elencate e disabilita quelle non elencate per il modello fissato corrispondente. Quando la variabile non è impostata, Claude Code ripiega sul rilevamento incorporato basato sull'ID del modello.

Questo esempio fissa Opus a un ARN di un modello personalizzato di Amazon Bedrock, imposta un nome descrittivo e dichiara le sue capacità:

export ANTHROPIC_DEFAULT_OPUS_MODEL='arn:aws:bedrock:us-east-1:123456789012:custom-model/abc'
export ANTHROPIC_DEFAULT_OPUS_MODEL_NAME='Opus via Bedrock'
export ANTHROPIC_DEFAULT_OPUS_MODEL_DESCRIPTION='Opus 4.7 routed through a Bedrock custom endpoint'
export ANTHROPIC_DEFAULT_OPUS_MODEL_SUPPORTED_CAPABILITIES='effort,xhigh_effort,max_effort,thinking,adaptive_thinking,interleaved_thinking'

Sovrascrivere gli ID di modello per versione

Sulle piattaforme che incorporano Claude Code e impostano CLAUDE_CODE_PROVIDER_MANAGED_BY_HOST, la configurazione del modello dell'host ha la precedenza sulle impostazioni gestite relative al modello, mentre un'allowlist availableModels gestita rimane in vigore a meno che l'host non fornisca la propria; Eccezioni alla precedenza delle impostazioni gestite indica quali chiavi e variabili l'host sovrascrive.

Le variabili d'ambiente a livello di famiglia descritte sopra configurano un ID di modello per ogni alias di famiglia. Se devi mappare diverse versioni della stessa famiglia su ID di provider distinti, usa invece l'impostazione modelOverrides.

modelOverrides mappa i singoli ID di modello Anthropic sulle stringhe specifiche del provider che Claude Code invia all'API del tuo provider. Quando un utente seleziona un modello mappato nel selettore /model, Claude Code usa il valore che hai configurato invece del valore predefinito incorporato.

Questo permette agli amministratori aziendali di instradare ogni versione del modello verso un ARN di inference profile di Amazon Bedrock specifico, un nome di versione di Google Cloud's Agent Platform o un nome di deploy di Microsoft Foundry, per esigenze di governance, allocazione dei costi o instradamento regionale.

Imposta modelOverrides nel tuo file delle impostazioni:

{
  "modelOverrides": {
    "claude-opus-4-7": "arn:aws:bedrock:us-east-2:123456789012:application-inference-profile/opus-prod",
    "claude-opus-4-6": "arn:aws:bedrock:us-east-2:123456789012:application-inference-profile/opus-46-prod",
    "claude-sonnet-4-6": "arn:aws:bedrock:us-east-2:123456789012:application-inference-profile/sonnet-prod"
  }
}

Le chiavi devono essere ID di modello Anthropic come elencati nella Panoramica dei modelli. Per gli ID di modello con data, includi il suffisso della data esattamente come appare lì. Le chiavi sconosciute vengono ignorate.

Per eliminare la riga diagnostica [claude-code:unrecognized_model] per un ID come un alias di gateway, aggiungi una voce che abbia quell'ID come valore.

Gli override sostituiscono gli ID di modello incorporati alla base di ogni voce del selettore /model. Su Amazon Bedrock, le voci di modelOverrides hanno la precedenza su qualsiasi inference profile che Claude Code rileva automaticamente all'avvio. Claude Code passa al provider così come sono i valori che sono già nativi del provider, come gli ARN di inference profile di Amazon Bedrock o i nomi di deploy di Microsoft Foundry.

Gli override si applicano anche quando passi un ID di modello Anthropic direttamente tramite --model, la variabile d'ambiente ANTHROPIC_MODEL o una variabile d'ambiente ANTHROPIC_DEFAULT_*_MODEL. Su Amazon Bedrock, Google Cloud's Agent Platform e Mantle, un ID di modello Anthropic senza una voce in modelOverrides si risolve nello stesso ID specifico del provider della riga del selettore /model per quella versione, quando il provider supporta quella versione. Mantle supporta un sottoinsieme di versioni. Per un ID di modello Anthropic al di fuori di quel sottoinsieme, Claude Code invia a Mantle l'ID grezzo senza mapparlo, a meno che non sia coperto da una voce di modelOverrides. Prima della v2.1.200, --model e i valori delle variabili d'ambiente raggiungevano il provider così come erano, senza passare per la mappa degli override.

modelOverrides funziona insieme a availableModels. L'allowlist viene valutata rispetto all'ID di modello Anthropic, non al valore di override, quindi una voce come "opus" in availableModels continua a corrispondere anche quando le versioni di Opus sono mappate su ARN. Quando enforceAvailableModels è impostata nelle impostazioni gestite, il Default imposto si risolve tramite modelOverrides solo dalle impostazioni gestite. La mappatura di un amministratore, come una versione fissata su un ARN di inference profile, viene rispettata nel Default imposto. Gli override dalle impostazioni utente o di progetto non lo influenzano.

Quando availableModels è impostata nelle impostazioni gestite, a un ID di modello Anthropic passato direttamente tramite --model o le variabili d'ambiente descritte sopra si applicano solo i modelOverrides delle impostazioni gestite. Claude Code ignora gli override nelle impostazioni utente o di progetto per quegli ID, e non risolve mai tramite modelOverrides, da qualsiasi origine di impostazioni, un ID che l'elenco gestito esclude. Questa restrizione all'origine gestita richiede Claude Code v2.1.200 o successiva. Consulta Limitare la selezione del modello per sapere come vengono gestiti gli ID bloccati.

Configurazione del prompt caching

Claude Code usa automaticamente il prompt caching per ottimizzare le prestazioni e ridurre i costi. Puoi disabilitare il prompt caching globalmente o per livelli di modello specifici:

Variabile d'ambiente Descrizione
DISABLE_PROMPT_CACHING Imposta su 1 per disabilitare il prompt caching per tutti i modelli. Ha la precedenza sulle impostazioni per modello
DISABLE_PROMPT_CACHING_HAIKU Imposta su 1 per disabilitare il prompt caching per il modello Haiku predefinito
DISABLE_PROMPT_CACHING_SONNET Imposta su 1 per disabilitare il prompt caching per il modello Sonnet predefinito
DISABLE_PROMPT_CACHING_OPUS Imposta su 1 per disabilitare il prompt caching per il modello Opus predefinito
DISABLE_PROMPT_CACHING_FABLE Imposta su 1 per disabilitare il prompt caching solo per i modelli Fable

Per scegliere separatamente il TTL della cache per la conversazione principale e per i subagent, consulta scegliere tu il TTL. Per sapere cosa provoca un cache miss, consulta Come Claude Code usa il prompt caching.

Cronologia delle versioni

Questa tabella elenca la versione di Claude Code in cui ogni alias di modello ha modificato il modello a cui si risolve, dal più recente al meno recente.

Versione Modifica
v2.1.293 haiku si risolve a Haiku 5.5 su Anthropic API
v2.1.284 sonnet si risolve a Sonnet 5.5 su Anthropic API
v2.1.280 opus si risolve a Opus 5.5 su Anthropic API, Claude Platform su AWS, Amazon Bedrock e Agent Platform di Google Cloud
v2.1.257 fable si risolve a Fable 5.1, tranne nelle sessioni del gateway delle app Claude
v2.1.219 opus si risolve a Opus 5 su Anthropic API, Claude Platform su AWS, Amazon Bedrock e Agent Platform
v2.1.207 opus si risolve a Opus 4.8 su Claude Platform su AWS, Amazon Bedrock e Agent Platform
v2.1.197 sonnet si risolve a Sonnet 5 su Anthropic API
v2.1.154 opus si risolve a Opus 4.8 su Anthropic API
Precedenti opus si risolve a Opus 4.7 su Claude Platform su AWS e a Opus 4.6 su Amazon Bedrock e Agent Platform. fable si risolve a Fable 5 e haiku si risolve a Haiku 4.5 su ogni provider