Configuración del modelo
Configure qué modelo utiliza Claude Code, niveles de esfuerzo, contexto extendido y la ventana de auto-compact
Modelos disponibles
Para la configuración de model en Claude Code, puede configurar:
- Un alias de modelo
- Un nombre de modelo
- API de Anthropic: un nombre de modelo completo
- Amazon Bedrock: un ARN de perfil de inferencia
- Microsoft Foundry: un nombre de implementación
- Agent Platform de Google Cloud: un nombre de versión
Para obtener orientación sobre qué modelo y nivel de esfuerzo se ajustan a diferentes tipos de trabajo, consulte Choosing a Claude model and effort level in Claude Code en el blog.
ANTHROPIC_BASE_URL cambia dónde se envían las solicitudes, no qué modelo las responde. Para enrutar Claude a través de una puerta de enlace LLM, consulte LLM gateways.
Alias de modelos
Use un alias de modelo para seleccionar configuraciones de modelo sin recordar números de versión exactos:
| Alias de modelo | Comportamiento |
|---|---|
default |
Valor especial que borra cualquier anulación de modelo y revierte al valor predeterminado en tiempo de ejecución para su cuenta. No es en sí mismo un alias de modelo |
best |
Utiliza el último modelo Fable donde está disponible para usted; de lo contrario, el mismo modelo que opus |
fable |
Utiliza el último modelo Fable para sus tareas más difíciles y de mayor duración |
sonnet |
Utiliza el último modelo Sonnet para tareas de codificación diaria |
opus |
Utiliza el último modelo Opus para tareas de razonamiento complejo |
haiku |
Utiliza el modelo Haiku rápido y eficiente para tareas simples |
sonnet[1m] |
Utiliza Sonnet con una ventana de contexto de 1 millón de tokens para sesiones largas. Sin efecto cuando sonnet ya se resuelve a Sonnet 5 con su ventana nativa de 1M; detrás de una puerta de enlace LLM, selecciona la ventana de 1M para Sonnet 5 |
opus[1m] |
Utiliza Opus con una ventana de contexto de 1 millón de tokens para sesiones largas |
opusplan |
Modo especial que utiliza opus durante el modo de plan, luego cambia a sonnet para la ejecución |
La versión a la que se resuelven los alias opus y sonnet depende del proveedor:
| Proveedor | opus |
sonnet |
|---|---|---|
| API de Anthropic | Opus 5 | Sonnet 5 |
| Claude Platform on AWS | Opus 5 | Sonnet 4.6 |
| Amazon Bedrock, Agent Platform de Google Cloud | Opus 5 | Sonnet 4.5 |
| Microsoft Foundry | Opus 4.6 | Sonnet 4.5 |
A menos que establezca ANTHROPIC_DEFAULT_FABLE_MODEL, el alias fable se resuelve a Fable 5.1. Antes de v2.1.255, se resolvía a Fable 5.
Donde un alias se resuelve a un modelo más antiguo, los modelos más nuevos están disponibles seleccionando explícitamente el nombre de modelo completo o estableciendo ANTHROPIC_DEFAULT_OPUS_MODEL o ANTHROPIC_DEFAULT_SONNET_MODEL.
Antes de v2.1.219, opus se resolvía a Opus 4.8 en la API de Anthropic desde v2.1.154, y en Claude Platform on AWS, Amazon Bedrock y Agent Platform de Google Cloud desde v2.1.207. Antes de v2.1.207, opus se resolvía a Opus 4.7 en Claude Platform on AWS y a Opus 4.6 en Amazon Bedrock y Agent Platform de Google Cloud.
Los alias apuntan a la versión recomendada para su proveedor y se actualizan con el tiempo. Para fijar una versión específica, use el nombre de modelo completo, por ejemplo claude-opus-5, o establezca la variable de entorno correspondiente como ANTHROPIC_DEFAULT_OPUS_MODEL.
Opus 5 requiere Claude Code v2.1.219 o posterior. Sonnet 5 requiere v2.1.197 o posterior. Opus 4.8 requiere v2.1.154 o posterior. Ejecute claude update para actualizar.
Trabajar con Fable
Claude Fable 5.1 y Claude Fable 5 son los modelos más capaces en Claude Code, adecuados para tareas más grandes que una sola sesión. Sostienen sesiones autónomas largas, investigan antes de actuar y verifican su trabajo más a menudo que los modelos más pequeños. Fable 5.1 es la versión más reciente.
Ninguno de los modelos Fable es el valor predeterminado de tipo de cuenta en ningún plan o proveedor. Seleccione uno explícitamente:
- Fable 5.1: ejecute
/model fable, o inicie conclaude --model fable. - Fable 5: selecciónelo por ID de modelo. En la API de Anthropic, ejecute
/model claude-fable-5o inicie conclaude --model claude-fable-5. En otros proveedores, use el ID de modelo Fable 5 de su proveedor o fíjelo conANTHROPIC_DEFAULT_FABLE_MODEL.
Si su configuración de usuario contiene claude-fable-5 o claude-fable-5[1m] como modelo, por ejemplo porque seleccionó Fable en el selector /model antes de v2.1.255, y se conecta directamente a la API de Anthropic, Claude Code cambia ese valor guardado al alias fable o fable[1m] la primera vez que ejecuta v2.1.255 o posterior, y la línea del modelo de inicio muestra (auto-updated) una vez. Un valor claude-fable-5 en la configuración del proyecto, local o administrada se deja tal como está.
Las solicitudes que los clasificadores de seguridad de un modelo Fable marcan, más a menudo en dominios de ciberseguridad y biología, desencadenan alternancia automática de modelo.
Para aprovechar al máximo Fable:
- Describa el resultado, no los pasos: entrégale el resultado que desea y déjelo planificar el camino. Para mantenerlo trabajando hacia ese resultado, establezca un objetivo.
- Entrégale problemas ambiguos: investigaciones de causa raíz, depuración de interrupciones y decisiones de arquitectura son donde la investigación y verificación adicionales se pagan.
- Omita los recordatorios de verificación: verifica su propio trabajo con menos indicaciones, por lo que los recordatorios para probar o verificar generalmente son innecesarios.
- Dimensione tareas más grandes: entrégale trabajo que normalmente dividiría en piezas. Mantiene sesiones largas sin perder el hilo.
Fable 5.1 requiere Claude Code v2.1.255 o posterior. Si una solicitud de una versión anterior falla, consulte Claude Code does not support this model. Fable 5 requiere v2.1.170 o posterior. Ejecute claude update para actualizar. Para disponibilidad bajo retención de datos cero, consulte Model availability under ZDR.
En la API de Anthropic, el selector /model enumera un modelo Fable solo después de que el servidor lo informe como disponible para su organización. Cuando escribe /model fable o un ID de modelo Fable, Claude Code verifica la disponibilidad directamente con el servidor, por lo que una selección escrita puede tener éxito incluso cuando el selector no enumera la entrada.
Fable y créditos de uso
Dependiendo de su plan y nivel de asiento, el uso de Fable puede facturarse a créditos de uso en lugar de extraer de los límites incluidos en su plan. Cuando lo hace, el selector /model muestra "Requires usage credits" en la fila Fable. Para administrar créditos de uso, consulte Add usage credits to your subscription.
En sesiones interactivas, Claude Code muestra un mensaje de consentimiento antes de que una solicitud de Fable facture créditos de uso. Los miembros de planes Enterprise con facturación de organización no ven el mensaje. Puede continuar en Fable usando créditos de uso o cambiar a su modelo predeterminado. También puede descartar el mensaje:
- En el selector
/model, mantiene su modelo actual. - A mitad de sesión, Claude Code continúa el turno en su modelo predeterminado.
Después de elegir continuar en Fable usando créditos de uso, Claude Code no muestra el mensaje nuevamente.
En una sesión con Remote Control conectado, una sesión en segundo plano, o una sesión de compañero de equipo de agentes, es posible que nadie esté en la terminal, por lo que Claude Code mantiene el mensaje de consentimiento a mitad de sesión para el plazo dialogExpiry, cinco minutos por defecto. Si nadie ha respondido antes del plazo, Claude Code finaliza el turno sin enviar la solicitud y agrega un aviso a la transcripción, que el cliente de Remote Control también muestra. Su selección de modelo no cambia, y Claude Code solicita consentimiento nuevamente en su próximo mensaje.
Lo que puede hacer mientras el mensaje está esperando depende de la sesión:
- Con Remote Control conectado o en la sesión de un compañero, presione cualquier tecla en la terminal para cancelar el plazo, y Claude Code espera su respuesta.
- En una sesión en segundo plano, responda antes del plazo.
- Si envía un nuevo mensaje desde el cliente remoto antes de que alguien escriba en la terminal, Claude Code finaliza el turno de la misma manera, y su nuevo mensaje inicia el siguiente turno. Después de que alguien escriba en la terminal, Claude Code continúa esperando la respuesta y pone en cola su nuevo mensaje detrás de ella.
En modo no interactivo con la bandera -p y a través del Agent SDK, Claude Code nunca muestra el mensaje de consentimiento. Cuando una solicitud de Fable allí facturase a créditos de uso, Claude Code la factura sin preguntar.
Configurar su modelo
Puede configurar su modelo de varias formas, enumeradas en orden de prioridad:
- Durante la sesión: use
/model <alias|name>para cambiar inmediatamente, o ejecute/modelsin argumento para abrir el selector. Consulte cuando Claude Code le pide que confirme el cambio - Al inicio: inicie con
claude --model <alias|name> - Variable de entorno: establezca
ANTHROPIC_MODEL=<alias|name> - Configuración: configure permanentemente en su archivo de configuración usando el campo
model - Predeterminado para nuevas sesiones: establezca
ANTHROPIC_DEFAULT_MODEL=<alias|name>
/model guarda su elección como predeterminada para nuevas sesiones escribiendo el campo model en su configuración de usuario. En el selector:
Enter: cambiar modelo y guardar como predeterminados: cambiar modelo solo para esta sesión
Escribir /model <name> directamente se comporta como Enter. Un modelo establecido con /model en modo no interactivo, con la bandera -p, se aplica solo a la sesión actual y no se guarda como predeterminado. La configuración del proyecto y administrada aún tienen precedencia y se reaplicarán en el próximo inicio. Un modelo predeterminado de organización que su administrador ha configurado para anular la selección del usuario también se reaplicará en el próximo inicio.
En v2.1.144 a v2.1.152, /model se aplicaba solo a la sesión actual y d en el selector guardaba un predeterminado.
La bandera --model y la variable de entorno ANTHROPIC_MODEL se aplican solo a la sesión que inicia con ellas. Para ejecutar diferentes modelos en diferentes terminales al mismo tiempo, inicie cada uno con su propia bandera --model en lugar de cambiar con /model.
Los precios en el selector /model aparecen cuando Claude Code habla con la API de Anthropic, directamente o a través de una puerta de enlace LLM que la proxifica, y el precio en una fila es el precio del modelo que esa fila selecciona. En proveedores de terceros como Amazon Bedrock y en la puerta de enlace de aplicaciones Claude, su proveedor o puerta de enlace determina lo que paga, por lo que las filas del selector no muestran precio. El precio es solo una etiqueta de visualización; no afecta qué modelo selecciona una fila o qué factura su proveedor. Antes de v2.1.206, Claude Platform on AWS y las sesiones de puerta de enlace mostraban precios de lista de Anthropic, y una fila podría mostrar el precio de un modelo diferente al que seleccionaba.
Las sesiones reanudadas iniciadas con claude --resume, --continue, o el selector /resume mantienen el modelo que estaban usando cuando se guardó la transcripción, independientemente de la configuración actual de model. Si el modelo restaurado se ha retirado o está excluido por availableModels, la sesión cae a través del orden de precedencia normal. Esto evita que la elección de /model de otra sesión cambie el modelo en la reanudación. En proveedores que usan ID de implementación específicos del proveedor en lugar de ID de modelo de Anthropic, como Amazon Bedrock, Agent Platform de Google Cloud y Microsoft Foundry, el modelo de transcripción no se restaura en absoluto y la sesión resuelve su modelo a través del orden de precedencia normal.
Un modelo que elige para el nuevo inicio con --model o ANTHROPIC_MODEL aún tiene precedencia sobre el modelo restaurado. A partir de v2.1.195, también lo hace una variable de familia ANTHROPIC_DEFAULT_OPUS_MODEL. ANTHROPIC_DEFAULT_MODEL también puede, bajo las condiciones enumeradas en su sección.
Cuando el modelo activo al inicio proviene de la configuración del proyecto o administrada en lugar de su propia selección, el encabezado de inicio muestra qué archivo de configuración lo estableció. Ejecute /model para anular; la configuración del proyecto o administrada se reaplicará en el próximo inicio. En plataformas que incrustan Claude Code y establecen CLAUDE_CODE_PROVIDER_MANAGED_BY_HOST, la configuración de modelo del host tiene precedencia sobre la configuración de modelo administrada, mientras que una lista de permitidos availableModels administrada permanece en vigor a menos que el host suministre la suya propia; Exceptions to managed settings precedence dice qué claves y variables anula el host.
Cuando se solicita un cambio de modelo a través del método setModel() del Agent SDK o por una aplicación como la aplicación de escritorio que ejecuta Claude Code CLI para usted, Claude Code verifica que la cadena sea una que reconozca antes de guardarla. Esta verificación requiere Claude Code v2.1.200 o posterior. En la API de Anthropic, Claude Code reconoce:
- un alias de modelo
- una entrada del selector
/model - cualquier nombre que comience con
claude- - un valor que configuró usted mismo como una opción de modelo personalizado o en
modelOverrides
Claude Code rechaza una cadena no reconocida con Model "<name>" is not a recognized model id. y la sesión mantiene su modelo actual, en lugar de guardar la cadena y fallar en la próxima solicitud. Consulte la referencia de errores para pasos de recuperación.
La verificación se ejecuta solo en la API de Anthropic. En Amazon Bedrock, Agent Platform de Google Cloud, Microsoft Foundry, Claude Platform on AWS, y detrás de una puerta de enlace LLM o un ANTHROPIC_BASE_URL personalizado, su proveedor o puerta de enlace define los nombres de modelo, por lo que Claude Code pasa cualquier cadena sin verificarla. La verificación tampoco cubre la bandera --model, la variable de entorno ANTHROPIC_MODEL, o la configuración de model; un valor mal escrito allí produce There's an issue with the selected model en la primera solicitud en su lugar. Claude Code aún puede escribir la línea de diagnóstico de modelo no reconocido en el momento de la solicitud, en cada proveedor.
Cuando el modelo solicitado tiene una fecha de retiro programada o se remapea automáticamente a una versión más nueva, Claude Code muestra una advertencia que nombra el modelo solicitado. Las sesiones interactivas la muestran como un aviso de inicio. A partir de v2.1.182, la misma advertencia se escribe en stderr en modo no interactivo cuando se usa el formato de salida de texto predeterminado. La verificación también cubre un model establecido en frontmatter de subagente. La advertencia de stderr se suprime para --output-format json y stream-json; lea el modelo real del campo modelUsage del mensaje de resultado en su lugar.
Por ejemplo, inicie una sesión en Opus:
claude --model opus
Luego cambie modelos desde dentro de la sesión:
/model sonnet
Archivo de configuración de ejemplo:
{
"permissions": {
"allow": ["Bash(npm run lint)"]
},
"model": "opus"
}
Establecer un modelo predeterminado para nuevas sesiones
Establezca ANTHROPIC_DEFAULT_MODEL=<alias|name> para elegir el modelo en el que sus sesiones comienzan de forma predeterminada. Requiere Claude Code v2.1.236 o posterior.
Claude Code inicia una nueva sesión en el modelo de la variable solo cuando ninguno de estos selecciona un modelo:
- La bandera
--model ANTHROPIC_MODEL- Un valor de
modelen cualquier archivo de configuración, incluida la elección que guarda con/model - Un modelo predeterminado de organización
Una elección que guarda con /model tiene precedencia sobre la variable en lanzamientos posteriores también. Con ANTHROPIC_MODEL establecido en su lugar, Claude Code vuelve al modelo de esa variable en el próximo lanzamiento, sea lo que sea que haya guardado con /model.
Claude Code también resuelve la opción Predeterminado al modelo de la variable, a menos que se aplique un modelo predeterminado de organización. Cuando la opción Predeterminado se resuelve al modelo de la variable, la fila Predeterminado en el selector /model muestra la etiqueta Set by ANTHROPIC_DEFAULT_MODEL.
Claude Code ignora la variable en estos casos, y la opción Predeterminado se resuelve como si no la hubiera establecido:
- La establece en
default,inherit,opusplan, ohaiku enforceAvailableModelsestá activadoavailableModelso restricciones de modelo de organización excluyen el modelo- El modelo no está disponible para su cuenta
Cuando una nueva sesión comenzaría en el modelo de la variable, una sesión que reanuda con claude --resume, --continue, o el selector /resume también comienza en él. Claude Code no restaura el modelo guardado en la transcripción de esa sesión. De lo contrario, Claude Code no usa la variable cuando reanuda una sesión.
Una nueva sesión comienza en un modelo diferente al que eligió
Cuando elige un modelo con /model y su próxima sesión comienza en algo más, estas son las causas habituales:
- Lo eligió para una sesión. Presionar
sen el selector, iniciar con--model, y ejecutar/modelen modo no interactivo se aplican solo a la sesión actual y dejan su predeterminado guardado solo. - Algo con mayor prioridad establece el modelo. Un valor de
modelen la configuración del proyecto o administrada,ANTHROPIC_MODELen su shell, o un predeterminado de organización que su administrador estableció para anular las elecciones del usuario se aplica nuevamente en cada lanzamiento. Su elección de/modelaún se guarda; está superada. Cuando la configuración del proyecto o administrada establece el modelo, el encabezado de inicio nombra el archivo. - Claude Code no pudo guardar su elección.
/modelescribemodelen~/.claude/settings.json. Si no puede escribir en ese archivo, por ejemplo porque otra herramienta lo genera o lo vincula a una copia de solo lectura, el modelo que eligió dura para la sesión y el próximo lanzamiento lee el valor anterior. Establezcamodelen la herramienta que genera el archivo, o haga que el archivo sea escribible. Consulte A change you made in Claude Code is lost in new sessions. - Reanudó una sesión. Una sesión que reanuda con
claude --resumeo--continuegeneralmente mantiene el modelo que estaba usando en lugar de su predeterminado actual.
Restringir la selección de modelos
Los administradores empresariales pueden usar availableModels en configuración administrada o de políticas para restringir qué modelos pueden seleccionar los usuarios. Las entradas coinciden con una familia de modelos como sonnet, un prefijo de versión como claude-sonnet-4-5, o un ID de modelo completo como claude-sonnet-4-5-20250929. Un prefijo de versión también coincide con IDs de modelo posteriores que lo extienden con otro segmento, por lo que claude-fable-5 permite tanto Fable 5 como Fable 5.1, mientras que claude-fable-5-1 permite solo Fable 5.1.
En plataformas que integran Claude Code y establecen CLAUDE_CODE_PROVIDER_MANAGED_BY_HOST, la configuración de modelo del host tiene precedencia sobre la configuración de modelos administrada, mientras que una lista de permitidos availableModels administrada permanece en vigor a menos que el host proporcione la suya propia; Excepciones a la precedencia de configuración administrada indica qué claves y variables anula el host.
Cuando se establece availableModels, la lista de permitidos se aplica en todas partes donde un usuario puede especificar un modelo:
- Modelo de sesión principal:
/model, la bandera--model, la variable de entornoANTHROPIC_MODEL, la configuraciónmodel,ANTHROPIC_DEFAULT_MODEL, y el modelo restaurado cuando se reanuda una sesión - Resolución de alias: las variables de entorno
ANTHROPIC_DEFAULT_OPUS_MODEL,ANTHROPIC_DEFAULT_SONNET_MODEL,ANTHROPIC_DEFAULT_HAIKU_MODEL, yANTHROPIC_DEFAULT_FABLE_MODELno pueden redirigir un alias permitido a un modelo fuera de la lista - Modo rápido:
/fastse niega a alternar cuando implicaría cambiar implícitamente a un modelo Opus fuera de la lista, con el mensaje "is not in your organization's allowed models" - Modelos de subagente y compañero: el campo
modelen la frontmatter de subagente, el parámetromodelde la herramienta Agent, modelos de compañero de equipo de agente,CLAUDE_CODE_SUBAGENT_MODEL, y, en v2.1.197 y anteriores, el selector de modelos en el asistente/agents - Modelos de skill y comando: la frontmatter
modelen skills y comandos - Modelo de asesor: la configuración
advisorModelconfigurada y la bandera--advisor - Modelo de agente de fondo: el modelo seleccionado en el selector de envío
En la API de Anthropic y Claude Platform en AWS, un alias de familia de modelos, opus, sonnet, haiku, o fable, se resuelve a su modelo habitual cuando la lista de permitidos permite ese modelo. Cuando la lista de permitidos bloquea ese modelo, Claude Code sustituye la versión más nueva de la familia que la lista de permitidos permite y muestra un aviso que nombra tanto los modelos solicitados como los sustituidos. Con ["sonnet", "claude-opus-4-6"], por ejemplo, tanto /model opus como --model opus seleccionan Claude Opus 4.6, el Opus más nuevo permitido. Antes de v2.1.205, un alias cuya versión más nueva lanzada estaba fuera de la lista se rechazaba o reemplazaba como cualquier otra selección bloqueada, incluso cuando la lista permitía una versión anterior.
La sustitución necesita una versión permitida en la que aterrizar: cuando la lista de permitidos no permite ninguna versión de la familia del alias, el alias sigue el comportamiento de rechazo y reemplazo a continuación como cualquier otro valor bloqueado.
Claude Code maneja cualquier otra selección bloqueada según dónde se estableció el modelo:
-
/model: Claude Code rechaza el cambio con un error -
Bandera
--model,ANTHROPIC_MODEL, o la configuraciónmodel: Claude Code reemplaza el valor al inicio con una advertencia que nombra tanto los modelos solicitados como los sustituidos, y la sesión comienza en el modelo predeterminado -
ANTHROPIC_DEFAULT_MODEL: Claude Code ignora la variable -
Anulación de subagente o compañero: Claude Code ejecuta el subagente o compañero en un modelo de respaldo en lugar de fallar la solicitud. Consulte Elegir un modelo para el respaldo del subagente y Especificar compañeros y modelos para el respaldo del compañero.
En sesiones interactivas, Claude Code le advierte cuando sustituye el modelo de un subagente, por este respaldo o por la sustitución de versión más nueva permitida anterior, nombrando los modelos solicitados y sustituidos; no informa del respaldo de un compañero.
Donde opera la sustitución de versión más nueva permitida anterior, un alias de familia bloqueado la sigue en su lugar. Antes de v2.1.222, un alias retrocedía como cualquier otro valor bloqueado en cada proveedor
-
Anulación de skill o comando: Claude Code ignora la anulación, incluido un alias de familia bloqueado, y el skill o comando se ejecuta en el modelo de sesión. Un skill o comando que se ejecuta en un subagente sigue el comportamiento del subagente anterior en su lugar
-
Configuración
advisorModel: el asesor se deshabilita para la sesión -
Bandera
--advisor: Claude Code sale con un error al inicio. En una sesión de fondo, inicia la sesión sin el asesor en lugar de salir
Claude Code oculta los modelos excluidos del selector /model. Un ID de modelo completo en la lista que no tiene una fila de selector integrada, como una versión anterior que la lista fija, aparece en el selector /model como su propia fila etiquetada, a menos que Claude Code reemplace las opciones integradas con una alineación modelPicker. Antes de v2.1.199, tal ID era seleccionable solo escribiendo /model <id>.
Los cambios de modelo que Claude Code realiza en su nombre se verifican de la misma manera:
- Cadenas de modelo de respaldo: las entradas fuera de la lista de permitidos se descartan
- Actualizaciones de modo de plan: en la API de Anthropic y Claude Platform en AWS, una actualización como
opusplana un modelo excluido usa la versión más nueva permitida de la familia de actualización. En proveedores con IDs de modelo específicos del proveedor, y cuando no se permite ninguna versión, la actualización se omite y la planificación continúa en el modelo de la sesión - Respaldo automático de modelo: un respaldo cuyo destino está excluido no se ejecuta, por lo que la solicitud marcada termina con un rechazo en su lugar
- Clasificador de modo automático: el valor predeterminado de Claude Sonnet 5 del clasificador se aplica solo cuando la lista de permitidos permite Sonnet 5. Cuando está excluido, el clasificador se ejecuta en el modelo de la sesión, que la lista de permitidos ya rige, o en un modelo Opus cuando la sesión se ejecuta en un modelo Fable. En proveedores distintos de la API de Anthropic, ese respaldo de Opus se ejecuta en el modelo Opus predeterminado del proveedor sin consultar la lista de permitidos. Requiere Claude Code v2.1.210 o posterior
- Modo rápido: habilitar el modo rápido se rechaza cuando el modelo en el que se ejecutaría la sesión después está fuera de la lista de permitidos
{
"availableModels": ["sonnet", "haiku"]
}
Cobertura de superficie
Cada superficie aplica la lista de permitidos que recibe. El mecanismo de entrega que llega a cada superficie difiere:
| Mecanismo de entrega | CLI e IDE | Sesiones locales de escritorio | Sesiones web, móviles y en la nube | Agent SDK y no interactivo | Cowork |
|---|---|---|---|---|---|
| Configuración administrada por servidor desde la consola de administración | Aplicada | Aplicada | Aplicada | Aplicada | No entregada |
| MDM o archivos de configuración administrada | Aplicada | Aplicada | No entregada en entornos alojados por Anthropic; en entornos autohospedados, aplicada desde la imagen del ejecutor según cómo Claude Code combina fuentes administradas | Aplicada | Aplicada donde se implementa |
- Las sesiones en la nube, en Claude Code en la web o en la aplicación de escritorio, se ejecutan en máquinas virtuales administradas por Anthropic de forma predeterminada: la configuración implementada en su dispositivo no las alcanza, por lo que entregue la lista de permitidos a través de configuración administrada por servidor. Las sesiones que su organización enruta a un entorno autohospedado se ejecutan en su propio cálculo y también leen el archivo de configuración administrada en la imagen del ejecutor. Cómo Claude Code combina fuentes administradas indica cuándo se aplica ese archivo. Un cambio de modelo a mitad de sesión en una sesión en la nube se rechaza cuando el modelo solicitado está excluido por la lista de permitidos. El rechazo del lado del servidor en la creación de sesión se aplica a restricciones de modelo de organización, no a la clave de configuración
availableModels. - Cowork, la pestaña de trabajo agéntico en la aplicación de escritorio de Claude, ejecuta sus sesiones en Claude Code pero, por diseño, no recibe configuración administrada por servidor desde la consola de administración de claude.ai. Un archivo de configuración administrada se aplica a sesiones de Cowork cuando está presente donde se ejecuta la sesión; las sesiones remotas de Cowork se ejecutan en máquinas virtuales administradas por Anthropic, donde un archivo implementado en el dispositivo no está presente.
- Las sesiones en proveedores de terceros como Amazon Bedrock, Agent Platform de Google Cloud, Microsoft Foundry, y Claude Platform en AWS no reciben configuración administrada por servidor, por lo que entregue la lista de permitidos a través de MDM o archivos de configuración administrada allí.
- La entrega administrada por servidor también requiere que la sesión se autentique con un inicio de sesión o clave elegible. Las flotas que generan claves solo a través de un script
apiKeyHelperdeben entregar la lista de permitidos a través de MDM o archivos de configuración administrada. - La pestaña de código de escritorio también aloja sesiones SSH, que leen el archivo de configuración administrada del host remoto en el que se ejecutan. Consulte Configuración administrada de escritorio.
- Los selectores de modelos en claude.ai y en la aplicación de escritorio ocultan o atenúan los modelos excluidos por la lista de permitidos de su organización. El estado del selector es una conveniencia para los usuarios; la aplicación ocurre en la sesión.
Comportamiento del modelo predeterminado
Por sí solo, availableModels deja la opción Predeterminado en el predeterminado de tiempo de ejecución del sistema para la cuenta hasta que también establezca enforceAvailableModels. Si ese predeterminado es un modelo que tiene la intención de restringir, establezca también enforceAvailableModels.
Una matriz availableModels vacía nunca activa la aplicación del modelo predeterminado: con availableModels: [], las selecciones de modelos nombrados se bloquean pero el modelo predeterminado para el tipo de cuenta sigue siendo utilizable independientemente de enforceAvailableModels.
Aplicar la lista de permitidos para el modelo predeterminado
Establezca enforceAvailableModels: true junto con un availableModels no vacío en la configuración administrada para extender la lista de permitidos a la opción Predeterminado. Esto requiere Claude Code v2.1.175 o posterior.
{
"availableModels": ["sonnet", "haiku"],
"enforceAvailableModels": true
}
La opción Predeterminado se resuelve al predeterminado del tipo de cuenta, o al modelo predeterminado de organización cuando un administrador ha establecido uno. Cuando ese modelo no está en la lista de permitidos, la opción Predeterminado se resuelve en su lugar a la primera entrada availableModels que nombra un modelo permitido y disponible, y la fila Predeterminado del selector /model muestra ese modelo. Esto se aplica en todas partes donde se alcanza el predeterminado: inicio de sesión, seleccionar Predeterminado en /model, la palabra clave "default" en cadenas de modelo de respaldo, y el respaldo utilizado cuando se descarta una selección excluida.
enforceAvailableModels remapea la opción Predeterminado solo cuando availableModels no está vacío. Con availableModels: [], el modelo predeterminado para el tipo de cuenta sigue siendo utilizable, por lo que la configuración no puede bloquear a los usuarios de cada modelo. Cuando availableModels no está vacío pero ninguna entrada se resuelve a un modelo permitido y disponible, la aplicación se omite y Predeterminado se resuelve al predeterminado del tipo de cuenta, con una advertencia visible solo bajo --debug. Mantenga al menos una entrada garantizada disponible en la lista para evitar esto.
Implemente ambas claves juntas en la fuente administrada de mayor rango que entregue. De forma predeterminada, Claude Code lee solo esa fuente, por lo que un par colocado en un archivo de configuración administrada se ignora cuando la consola de administración entrega cualquier configuración; bajo la fusión de opción de participación en cómo Claude Code combina fuentes administradas, Claude Code aún ignora un mapa modelOverrides de una fuente clasificada por debajo de la que establece availableModels.
Controlar el modelo en el que se ejecutan los usuarios
La configuración model es una selección inicial, no una aplicación. Establece qué modelo está activo cuando comienza una sesión, pero los usuarios aún pueden abrir /model y seleccionar Predeterminado, que se resuelve al predeterminado de tiempo de ejecución del sistema independientemente de lo que se establezca model, a menos que enforceAvailableModels lo redirija.
Para controlar completamente la experiencia del modelo, combine estas configuraciones:
availableModels: restringe qué modelos nombrados pueden cambiar los usuariosenforceAvailableModels: extiende la lista de permitidosavailableModelsa la opción Predeterminado, por lo que Predeterminado no puede resolverse a un modelo fuera de la listamodel: establece la selección de modelo inicial cuando comienza una sesiónANTHROPIC_DEFAULT_SONNET_MODEL/ANTHROPIC_DEFAULT_OPUS_MODEL/ANTHROPIC_DEFAULT_HAIKU_MODEL/ANTHROPIC_DEFAULT_FABLE_MODEL: controlan a qué se resuelven los aliassonnet,opus,haiku, yfable, y qué versión usa el predeterminado del tipo de cuenta
Este ejemplo inicia a los usuarios en Sonnet 4.5, limita el selector a Sonnet y Haiku, y asegura que Predeterminado se resuelva a un modelo en la lista de permitidos en lugar del predeterminado de nivel:
{
"model": "claude-sonnet-4-5",
"availableModels": ["claude-sonnet-4-5", "haiku"],
"enforceAvailableModels": true,
"env": {
"ANTHROPIC_DEFAULT_SONNET_MODEL": "claude-sonnet-4-5"
}
}
Sin enforceAvailableModels o el bloque env, un usuario que selecciona Predeterminado en el selector obtiene el predeterminado de tiempo de ejecución en lugar de la versión fijada en model. Las dos configuraciones cubren diferentes alcances: enforceAvailableModels hace que Predeterminado obedezca la lista de permitidos, mientras que el bloque env fija qué versión se resuelve un alias permitido como sonnet. Use enforceAvailableModels solo cuando restringir familias de modelos sea suficiente; agregue el bloque env cuando también necesite fijar una versión específica.
Comportamiento de fusión
Cuando la configuración administrada que Claude Code aplica define availableModels, esa lista sola se aplica, aparte de una plataforma host que proporciona la suya propia: las entradas en la configuración de usuario, proyecto o local no pueden extenderla, y Claude Code nunca fusiona availableModels entre fuentes administradas tampoco; cómo Claude Code combina fuentes administradas indica qué lista de fuente se aplica. De lo contrario, las listas de la configuración de usuario, proyecto y local se concatenan y desduplican como otras configuraciones de matriz. Antes de Claude Code v2.1.175, las entradas de alcances de menor precedencia se fusionaban en la lista administrada en lugar de ser reemplazadas por ella.
Dentro de la lista efectiva, una entrada que nombra un modelo específico en una familia, ya sea un prefijo de versión o un ID de modelo completo, deshabilita la entrada de comodín de esa familia: ["sonnet", "claude-sonnet-4-5"] permite solo versiones de Sonnet 4.5, no cada modelo de Sonnet.
IDs de modelo de Mantle
Cuando el punto final de Amazon Bedrock Mantle está habilitado, las entradas en availableModels que comienzan con anthropic. se agregan al selector /model como opciones personalizadas y se enrutan al punto final de Mantle. Esta es una excepción a la coincidencia de alias descrita en Fijar modelos para implementaciones de terceros. La configuración aún restringe el selector a entradas enumeradas, y un ID de Mantle incrusta un nombre de familia, por lo que cuenta como una entrada específica y deshabilita el comodín de esa familia: junto con cualquier ID de Mantle, enumere los prefijos de versión o IDs completos que desea mantener seleccionables. Consulte Comportamiento de fusión.
Restricciones de modelo de organización
Los administradores de organización en planes Claude Enterprise restringen qué modelos pueden ejecutar los miembros deshabilitando modelos individuales en la consola de administración de claude.ai. Esta restricción se entrega con los derechos de la cuenta cuando Claude Code se autentica, separada de cualquier lista availableModels en la configuración, y el servidor aplica la misma restricción de forma independiente cuando se crea una sesión. Requiere Claude Code v2.1.187 o posterior.
La restricción se aplica cuando un miembro inicia sesión o usa su propia clave API. Las credenciales con alcance de organización, como las claves de servicio de organización, no están vinculadas a un usuario, por lo que la restricción no se aplica a ellas.
La consola de Claude no tiene control de restricción de modelo. Las organizaciones sin un plan Claude Enterprise, incluidas las cuyos miembros se autentican a través de la API de Anthropic, restringen modelos con availableModels en configuración administrada en su lugar, agregando enforceAvailableModels para cubrir la opción Predeterminado. Estas configuraciones se aplican por Claude Code mismo, no por el servidor.
Un modelo restringido se oculta del selector /model. Seleccionarlo por nombre con --model, la variable de entorno ANTHROPIC_MODEL, o la configuración model muestra el aviso Model "<name>" is restricted by your organization's settings. Using <model> instead. y la sesión comienza en un modelo permitido. Escribir /model <name> para un modelo restringido se rechaza con Model '<name>' is restricted by your organization's settings. Run /model to choose a different model. y la sesión mantiene su modelo actual.
Un alias de familia de modelos como opus se resuelve a su modelo habitual cuando la organización lo permite. Cuando la organización restringe ese modelo, Claude Code sustituye la versión más nueva de la familia que la organización permite, con el mismo aviso de sustitución. /model <alias> se rechaza solo cuando cada versión de su familia está restringida; un alias establecido con --model, ANTHROPIC_MODEL, o la configuración model aún se reemplaza al inicio en ese caso. Antes de v2.1.205, un alias de familia se sustituía o rechazaba basándose solo en su versión más nueva lanzada, incluso cuando se permitía una versión anterior.
Las restricciones se aplican en toda la organización o por rol:
- Deshabilitar un modelo a nivel de organización lo elimina para cada miembro.
- El acceso a nivel de rol otorga diferentes modelos a diferentes roles personalizados, y un miembro que tiene varios roles puede usar cualquier modelo que uno de sus roles otorgue.
- Los modelos de Haiku siempre están disponibles y no se pueden deshabilitar, por lo que cada miembro mantiene al menos un modelo utilizable.
- Un cambio de acceso entra en vigor en nuevas solicitudes dentro de aproximadamente un minuto; el selector
/modello refleja la próxima vez que comienza una sesión.
Ambas restricciones se aplican juntas: un modelo es seleccionable solo cuando está permitido por availableModels y no está restringido por la organización. Las restricciones de organización llegan a sesiones en la API de Anthropic y implementaciones de puerta de enlace LLM solo; en cualquier otro proveedor, use availableModels en su lugar.
Modelo predeterminado de la organización
Los administradores de la organización en planes Claude Enterprise pueden establecer un modelo predeterminado para los miembros de Claude Code desde la consola de administración de claude.ai, para toda la organización o por rol personalizado. Cuando se establece uno, la opción Predeterminado se resuelve a ese modelo. Requiere Claude Code v2.1.196 o posterior.
La fila Predeterminado en el selector /model muestra el nombre del modelo predeterminado de la organización con la etiqueta Predeterminado de org. La etiqueta dice Predeterminado de org tanto si el administrador estableció el predeterminado para toda la organización como para su rol. Un predeterminado de rol cubre a los miembros de ese rol personalizado y tiene prioridad sobre el predeterminado de toda la organización; cuando varios de sus roles establecen predeterminados diferentes, se aplica el modelo más capaz.
El modelo predeterminado de la organización es un punto de partida, no una restricción. Estas selecciones tienen prioridad sobre él:
- la bandera
--modely la variable de entornoANTHROPIC_MODEL - un valor
modelen configuración administrada o suministrado a través de--settings - un valor
modelen su configuración de usuario, proyecto o local, incluido un modelo que guarde con/model
Los administradores también pueden configurar el modelo predeterminado de la organización para anular la selección del usuario. Con la anulación activada, tiene prioridad sobre el valor model en la configuración de usuario, proyecto y local, por lo que un modelo que guarde con /model se aplica para la sesión actual y el modelo predeterminado de la organización vuelve en el siguiente lanzamiento. Cuando su selección difiere, /model muestra Se aplica el predeterminado de su organización (<model>) al reiniciar. La bandera --model, ANTHROPIC_MODEL, la configuración administrada y --settings siguen teniendo prioridad incluso con la anulación activada. La anulación está disponible para un conjunto limitado de organizaciones; consulte con su equipo de cuenta de Anthropic sobre la disponibilidad.
Para limitar qué modelos pueden seleccionar los miembros, use restricciones de modelo de la organización o availableModels en su lugar.
Claude Code lee el modelo predeterminado de la organización una vez al inicio, por lo que un predeterminado que el administrador cambia a mitad de sesión entra en vigor en el siguiente lanzamiento.
Cuando el modelo predeterminado de la organización no anula la selección del usuario, el primer lanzamiento interactivo después de que el administrador lo cambie borra la clave model de su configuración de usuario una sola vez, por lo que se aplica el nuevo predeterminado. No cambia nada más en el archivo, y un modelo que guarde con /model después de ese lanzamiento se mantiene.
El modelo predeterminado de la organización pasa a través de estas comprobaciones de restricción antes de ser adoptado:
availableModelspor sí solo no se aplica al modelo predeterminado de la organización, por lo que un modelo predeterminado de la organización fuera de la lista de permitidos sigue aplicándose. CuandoenforceAvailableModelstambién está establecido, un modelo predeterminado de la organización fuera de la lista de permitidos se remapea a la primera entrada de la lista de permitidos, como cualquier otro Predeterminado- un modelo predeterminado de la organización que restricciones de modelo de la organización deniegan para su cuenta se reemplaza por el modelo más reciente permitido en su familia, o una familia de menor costo cuando cada versión de ella está restringida
- un modelo predeterminado de la organización que no está disponible para su cuenta en absoluto se omite, y la opción Predeterminado se resuelve como lo haría sin un modelo predeterminado de la organización
A partir de v2.1.199, cuando el modelo predeterminado de la organización es una familia de modelos diferente del predeterminado habitual del tipo de cuenta, el selector /model mantiene una fila separada para esa familia habitual, por lo que aún puede cambiar a ella para una sesión. En v2.1.196 a v2.1.198 esa fila falta en el selector.
El modelo predeterminado de la organización llega solo a sesiones autenticadas con la API de Anthropic. Para establecer un predeterminado en cualquier otro lugar, incluidas las implementaciones de puerta de enlace LLM, use la clave model en configuración administrada en su lugar.
Límites de esfuerzo de la organización
Los administradores de la organización en planes Claude Enterprise pueden establecer un nivel de esfuerzo máximo por modelo para cada rol personalizado, junto con restricciones de modelo de la organización a nivel de rol. Los niveles por encima del límite no se ofrecen en el selector /effort, y nombrar un nivel superior con --effort o /effort se ejecuta en el límite en su lugar. En sesiones interactivas y ejecuciones simples de texto --print, una advertencia nombra los niveles solicitados y aplicados; con salida json o stream-json o en agentes en segundo plano, el límite se aplica silenciosamente. Los límites son por modelo, por lo que cambiar de modelo puede cambiar qué niveles están disponibles. Cuando varios de sus roles otorgan el mismo modelo, se aplica el límite menos restrictivo. Requiere Claude Code v2.1.195 o posterior.
Los límites de esfuerzo se entregan junto con restricciones de modelo de la organización y llegan a las mismas sesiones.
Comportamiento especial del modelo
Configuración del modelo `default`
El comportamiento de default depende de tu tipo de cuenta:
- Max, Team Premium, Enterprise y Anthropic API: por defecto Opus 5
- Claude Platform en AWS, Amazon Bedrock y Agent Platform de Google Cloud: por defecto Opus 5
- Pro y Team Standard: por defecto Sonnet 5
- Microsoft Foundry: por defecto Sonnet 4.5
Antes de v2.1.219, default se resolvía a Opus 4.8 en Anthropic API, Max, Team Premium y Enterprise de pago por uso desde v2.1.154, y en Claude Platform en AWS, Amazon Bedrock y Agent Platform de Google Cloud desde v2.1.207. Antes de v2.1.207, default se resolvía a Opus 4.7 en Claude Platform en AWS y a Sonnet 4.5 en Amazon Bedrock y Agent Platform de Google Cloud.
Cuando un administrador ha establecido un modelo predeterminado de la organización, default se resuelve a ese modelo en lugar del predeterminado del tipo de cuenta anterior. Requiere Claude Code v2.1.196 o posterior. default también puede resolverse al modelo que estableces con ANTHROPIC_DEFAULT_MODEL, bajo las condiciones enumeradas en su sección.
Cuando la configuración administrada aplica la lista de permitidos para el modelo Default y el predeterminado del tipo de cuenta no está en availableModels, default se resuelve al Default aplicado en lugar del predeterminado del tipo de cuenta anterior. Cuando ambos se aplican, el modelo predeterminado de la organización reemplaza primero el predeterminado del tipo de cuenta y luego se aplica la aplicación: se mantiene un modelo predeterminado de la organización en la lista de permitidos, mientras que uno fuera de la lista se resuelve al Default aplicado.
Los modelos Fable no son el predeterminado del tipo de cuenta en ningún plan o proveedor. Elegir uno con /model lo guarda como el modelo seleccionado en la configuración del usuario, por lo que las sesiones posteriores comienzan en él. Para el cambio único que Claude Code realiza en una selección de Fable 5 guardada en v2.1.255, consulta Trabajar con Fable.
Configuración del modelo `opusplan`
El alias del modelo opusplan proporciona un enfoque híbrido automatizado:
- En modo plan: utiliza
opuspara razonamiento complejo y decisiones de arquitectura - En modo ejecución: cambia automáticamente a
sonnetpara generación de código e implementación
Esto combina el razonamiento de Opus para la planificación con la eficiencia de Sonnet para la ejecución.
La fase Opus del modo plan utiliza la misma ventana de contexto que la configuración del modelo opus. En los niveles de suscripción donde Opus se actualiza automáticamente a contexto de 1M, opusplan recibe la actualización en modo plan también. Para forzar contexto de 1M para ambas fases cuando no estás en un nivel de actualización automática, establece el modelo a opusplan[1m].
Cuando availableModels excluye el Opus más nuevo pero permite una versión anterior, por ejemplo ["sonnet", "claude-opus-4-6"], opusplan utiliza el Opus más nuevo permitido para la planificación y se mantiene solo en Sonnet cuando se excluye cada Opus. Una sesión de Haiku que normalmente se actualizaría a Sonnet en modo plan utiliza asimismo el Sonnet más nuevo permitido, y se mantiene solo en Haiku cuando se excluye cada Sonnet. Antes de v2.1.205, el modo plan se mantenía en el modelo de la sesión siempre que se excluía la versión más nueva de la familia de actualización, incluso cuando la lista de permitidos permitía una anterior.
La sustitución de una versión anterior permitida se aplica en Anthropic API y Claude Platform en AWS. En Amazon Bedrock, Agent Platform de Google Cloud, Microsoft Foundry y Mantle, cuyas implementaciones utilizan ID de modelo específicos del proveedor, el modo plan se mantiene en el modelo de la sesión siempre que se excluya el modelo de actualización.
Para un enfoque híbrido donde Claude decide a mitad de la tarea cuándo consultar un segundo modelo en lugar de cambiar en el límite del plan, consulta la herramienta de asesor.
Cadenas de modelos de reserva
Cuando el modelo principal está sobrecargado, no disponible o devuelve otro error de servidor no reintentable, Claude Code puede cambiar a un modelo de reserva en lugar de fallar la solicitud. Los errores de autenticación, facturación, límite de velocidad, tamaño de solicitud y transporte, y una denegación por la verificación de política de tu organización, nunca desencadenan un cambio; esos siguen su manejo normal de reintentos y errores.
Configura uno o más modelos de reserva y Claude Code los intenta en orden, mostrando un aviso cuando cambia. El cambio dura solo el turno actual, por lo que tu siguiente mensaje intenta el modelo principal primero de nuevo. Claude Code limita las cadenas a tres modelos después de la eliminación de duplicados e ignora entradas adicionales.
Establece una cadena para una sesión con la bandera --fallback-model, que acepta una lista separada por comas:
claude --fallback-model sonnet,haiku
Para persistir una cadena entre sesiones, establece fallbackModel en configuración como un array:
{
"fallbackModel": ["claude-sonnet-5", "claude-haiku-4-5"]
}
La bandera --fallback-model tiene precedencia sobre la configuración fallbackModel. Cada entrada acepta un nombre de modelo o alias, y "default" se expande al modelo predeterminado.
Claude Code no confirma la cadena al inicio y /status no la muestra. El aviso mostrado cuando ocurre un cambio es el primer signo visible de que una reserva está configurada.
Cuando una solicitud falla, Claude Code intenta cada entrada en orden hasta que una la acepta. Una entrada que tampoco se puede alcanzar, como un modelo retirado fijado en la configuración, falla a la siguiente de la misma manera. Claude Code elimina dos tipos de entrada antes de ese recorrido:
- Fuera de la lista de permitidos: Claude Code descarta cualquier entrada no permitida por
availableModelscuando lee la cadena. - Ventana de contexto más pequeña durante la compactación: la cadena también cubre compactación, pero Claude Code no recurrirá a un modelo con una ventana de contexto más pequeña que la del principal, ya que resumir allí cortaría parte de la conversación primero. Si cada reserva es más pequeña, la compactación muestra el error original y puedes reintentar.
Claude Code también aplica la cadena a subagentes. Cuando la solicitud de un subagente falla, Claude Code intenta tus modelos de reserva configurados en orden, y el subagente continúa en el modelo que acepta la solicitud. El modelo de tu sesión no cambia. Antes de v2.1.247, un fallo que la cadena cubría terminaba el subagente.
Reserva automática de modelo
Esta sección cubre la reserva basada en contenido de modelos Fable y Opus 5. Para la reserva basada en disponibilidad cuando un modelo está sobrecargado o no disponible, consulta Cadenas de modelos de reserva.
Los modelos Fable y Opus 5 se ejecutan con clasificadores de seguridad, que con mayor frecuencia marcan contenido de ciberseguridad y biología. Cuando un clasificador marca una solicitud y la categoría marcada tiene un modelo de reserva, Claude Code vuelve a ejecutar la solicitud en ese modelo y muestra un aviso en la transcripción. Para esas dos categorías, el modelo de reserva depende de qué modelo rechazó:
- Fable 5.1 y Fable 5: las solicitudes marcadas por biología se vuelven a ejecutar en Opus 5, y las solicitudes marcadas por ciberseguridad se vuelven a ejecutar en Opus 4.8.
- Opus 5: las solicitudes marcadas por ciberseguridad se vuelven a ejecutar en Opus 4.8. Las solicitudes marcadas por biología terminan con un rechazo en su lugar, porque Opus 5 ejecuta sus propios clasificadores de biología sin modelo de reserva.
En Amazon Bedrock, Agent Platform de Google Cloud y Microsoft Foundry, Claude Code resuelve estos objetivos a través de tu implementación, y si estableces ANTHROPIC_DEFAULT_OPUS_MODEL, las categorías que tienen una reserva se vuelven a ejecutar en el modelo fijado; consulta Habilitar reserva en Bedrock, Agent Platform y Foundry.
Después de una reserva, la sesión continúa en el modelo de reserva. Para volver a tu modelo original, ejecuta /model.
La reserva basada en categoría requiere Claude Code v2.1.219 o posterior. Antes de v2.1.219, cada solicitud de Fable 5 marcada se volvía a ejecutar en el modelo Opus predeterminado de tu proveedor, y Opus 5 no era una fuente de reserva.
El modelo de reserva se verifica contra availableModels. Cuando está bloqueado, no ocurre reserva. El rechazo se muestra como un error normal y el modelo de la sesión no cambia.
Verificar qué desencadenó la reserva
La reserva puede desencadenarse en la primera solicitud de una sesión, antes de que envíes algo inusual, porque la primera solicitud lleva contexto del espacio de trabajo como tu contenido de CLAUDE.md y estado de git. Un repositorio que contiene material de seguridad o biología puede activar el clasificador solo en ese contexto.
Para verificar si las personalizaciones son el desencadenante, inicia una sesión con claude --safe-mode, que desactiva personalizaciones como CLAUDE.md, skills, servidores MCP y hooks. El estado de git y los nombres de directorios no son personalizaciones y aún se incluyen.
Preguntar antes de cambiar
Para decidir qué sucede cada vez que se marca una solicitud, en lugar de cambiar automáticamente, ejecuta /config y desactiva Cambiar modelos cuando se marca un mensaje, o establece switchModelsOnFlag a false en tu archivo de configuración. Una solicitud marcada pausa la sesión con dos opciones: cambiar al modelo de reserva, o editar el mensaje y reintentar en el modelo actual.
Algunos casos se comportan de manera diferente:
- Cuando la categoría marcada no tiene modelo de reserva, como una marca de biología en Opus 5, Claude Code no muestra el mensaje y la solicitud termina con el rechazo.
- Si ambos modelos marcan la misma solicitud, puedes editar el mensaje e intentar de nuevo, o iniciar una nueva sesión.
- En sesiones móviles de Claude Code en la web, no se admite edición y reintento. Cambia modelos, o continúa la sesión desde un navegador de escritorio o la aplicación de escritorio.
- En modo no interactivo e integraciones de SDK que no pueden mostrar el mensaje, una solicitud marcada termina el turno con un rechazo.
- Cuando el objetivo de reserva está bloqueado por
availableModels, Claude Code no muestra el mensaje. La solicitud marcada termina con el rechazo, igual que la reserva automática cuando el objetivo está bloqueado.
Habilitar reserva en Bedrock, Agent Platform y Foundry
En Amazon Bedrock, Agent Platform de Google Cloud y Microsoft Foundry, los ID de modelo son específicos del proveedor, por lo que la reserva automática solo funciona cuando Claude Code puede identificar ambos modelos involucrados:
- Claude Code debe reconocer el modelo actual como una fuente de reserva. Fable 5.1 y Fable 5 se reconocen cuando el ID del modelo contiene
claude-fable-5, coincide con el valor deANTHROPIC_DEFAULT_FABLE_MODEL, o se asigna conmodelOverrides. Opus 5 se reconoce por su ID de modelo del proveedor o una asignación demodelOverrides. - El modelo de reserva debe resolverse en tu implementación. Si estableces
ANTHROPIC_DEFAULT_OPUS_MODEL, las solicitudes marcadas se vuelven a ejecutan en ese modelo para cada categoría que tiene una reserva; una marca de biología en Opus 5 aún termina con un rechazo. Si no lo estableces, las solicitudes marcadas por ciberseguridad se vuelven a ejecutan en una entrada de Opus 4.8 en la lista de modelos del proveedor, y las solicitudes marcadas por biología de un modelo Fable en una entrada de Opus 5.
Si alguno de los modelos no se puede identificar, Claude Code no cambia automáticamente. La solicitud marcada termina con un mensaje de rechazo, y puedes cambiar modelos con /model e intentar de nuevo. Establecer ANTHROPIC_DEFAULT_FABLE_MODEL a tu ID de modelo Fable habilita el reconocimiento de Fable. Establecer ANTHROPIC_DEFAULT_OPUS_MODEL a un ID de modelo Opus proporciona un objetivo de reserva para las categorías marcadas, a menos que el pin nombre un modelo fuera de la familia Opus o el modelo que rechazó; entonces Claude Code no cambia y el rechazo se mantiene.
Investigación de seguridad y cargas de trabajo de biología
Las cargas de trabajo en seguridad ofensiva o biología, incluidas pruebas de penetración, ejercicios Capture the Flag (CTF) y bases de código adyacentes a biología, desencadenan reserva frecuentemente, a menudo en la primera solicitud. Para trabajo sustancial de biología en Fable 5.1 o Fable 5, Claude Code mueve la sesión a Opus 5 en la primera solicitud marcada, y las solicitudes posteriores marcadas por biología terminan en rechazos allí, porque Opus 5 no tiene reserva de biología. En Opus 5, obtienes esos rechazos desde la primera solicitud marcada.
Este es el enrutamiento esperado para estos dominios, no una marca de cuenta. Si tu organización necesita capacidad de clase Fable para este trabajo, pregunta a tu equipo de cuenta de Anthropic sobre programas de acceso de confianza.
Ajustar el nivel de esfuerzo
Los niveles de esfuerzo controlan el razonamiento adaptativo, que permite al modelo decidir si y cuánto pensar en cada paso según la complejidad de la tarea. El esfuerzo menor es más rápido y económico para tareas sencillas, mientras que el esfuerzo mayor proporciona razonamiento más profundo para problemas complejos.
Los niveles de esfuerzo disponibles dependen del modelo. Los modelos no enumerados aquí no admiten esfuerzo:
| Modelo | Niveles |
|---|---|
| Fable 5.1 y Fable 5 | low, medium, high, xhigh, max |
| Opus 5, Sonnet 5, Opus 4.8 y Opus 4.7 | low, medium, high, xhigh, max |
| Opus 4.6 y Sonnet 4.6 | low, medium, high, max |
Si estableces un nivel que el modelo activo no admite, Claude Code recurre al nivel más alto admitido en o por debajo del que estableces. Por ejemplo, xhigh se ejecuta como high en Opus 4.6. Tu organización también puede limitar qué niveles están disponibles para un modelo; consulta Límites de esfuerzo de la organización.
Con la configuración ultracode desactivada, Claude Code resuelve el nivel de esfuerzo de la sesión en este orden, tomando el primero que se aplique:
- Una opción explícita: la variable de entorno
CLAUDE_CODE_EFFORT_LEVEL, lanzar con--effort, o/efforten la sesión (un/effortno interactivo tiene efecto más estrecho) - El esfuerzo predeterminado del modelo, en Fable 5, Opus 4.8 u Opus 4.7: desde la primera vez que ejecutas uno de estos modelos, Claude Code mantiene el esfuerzo predeterminado de ese modelo entre sesiones, incluso cuando tu configuración resuelve un nivel diferente, hasta que cambies el esfuerzo una vez, por ejemplo con un
/effortinteractivo, el control deslizante de esfuerzo del selector/model, o--effortal lanzar. Opus 5 y Fable 5.1 no tienen tal retención - Tu configuración: el nivel que guardaste para el modelo o una clave
effortLevel, con la precedencia entre ellos y entre archivos de configuración indicada enmodelSettings - El esfuerzo predeterminado del modelo:
highen cada modelo que admite esfuerzo, excepto que Opus 4.7 por defecto esxhighy, cuando tu organización establece un nivel de esfuerzo predeterminado para su modelo predeterminado de la organización, ese nivel es el predeterminado cuando ejecutas ese modelo
Cuando estableces low, medium, high o xhigh en una sesión interactiva en tu máquina, Claude Code guarda el nivel y lo aplica en sesiones posteriores. Guarda el nivel por modelo, bajo la clave modelSettings en tu configuración de usuario, por lo que cada modelo mantiene su propio nivel guardado.
max es el nivel de razonamiento más profundo. A menos que lo establezas a través de la variable de entorno CLAUDE_CODE_EFFORT_LEVEL, Claude Code aplica max solo a la sesión actual.
Un nivel que elijas del control de esfuerzo en un teléfono o navegador conectado a través de Control Remoto se aplica solo a esa sesión.
Un nivel establecido con /effort en modo no interactivo, con la bandera -p, se aplica solo a la sesión actual y no se guarda como tu predeterminado. Tampoco cuenta como el cambio que termina el paso predeterminado del modelo anterior en Fable 5, Opus 4.8 u Opus 4.7: mientras ese paso esté en efecto, un /effort no interactivo reporta Not applied, así que pasa --effort al lanzar en su lugar.
El menú /effort también ofrece ultracode. Ultracode es una configuración de Claude Code en lugar de un nivel de esfuerzo del modelo: envía xhigh al modelo y además tiene Claude orquestar flujos de trabajo dinámicos para tareas sustanciales. Para dónde se puede establecer persistentemente, consulta la configuración ultracode.
Puedes activar ultracode a través de cualquiera de los siguientes:
/effort: ejecuta/effort ultracode, o selecciónalo del menú- Bandera
--effort: lanza conclaude --effort ultracode, que inicia la sesión con esfuerzoxhighy ultracode activado - Configuración
ultracode: establece"ultracode": trueen un archivo de configuración, con--settings, o en una solicitud de control del Agent SDK. Una solicitudapplyFlagSettings()también aceptaeffortLevel: "ultracode" - Selector
/model: mueve el control deslizante de esfuerzo aultracodecon las teclas de flecha mientras eliges un modelo. Claude Code lo activa para la sesión actual, incluso cuando guardas ese modelo como tu predeterminado
Pasar ultracode a la bandera --effort o al valor effortLevel del Agent SDK requiere Claude Code v2.1.203 o posterior. Antes de v2.1.203, --effort ultracode imprimía Unknown --effort value 'ultracode' y la sesión comenzaba con el esfuerzo predeterminado.
La configuración effortLevel persistida y la variable de entorno CLAUDE_CODE_EFFORT_LEVEL no aceptan ultracode. Cuando CLAUDE_CODE_EFFORT_LEVEL se establece a un nivel distinto de xhigh, las solicitudes se ejecutan en ese nivel y la orquestación de flujo de trabajo de ultracode permanece inactiva. Seleccionar ultracode entonces muestra una advertencia de que la variable de entorno anula el esfuerzo para la sesión.
Cuando ultracode no está disponible, por ejemplo cuando los flujos de trabajo están desactivados, --effort ultracode establece solo esfuerzo xhigh.
Elegir un nivel de esfuerzo
Cada nivel intercambia gasto de tokens contra capacidad. El predeterminado se adapta a la mayoría de tareas de codificación; ajusta cuando quieras un equilibrio diferente.
| Nivel | Cuándo usarlo |
|---|---|
low |
Reserva para tareas cortas, limitadas y sensibles a la latencia que no son sensibles a la inteligencia |
medium |
Reduce el uso de tokens para trabajo sensible a costos que puede sacrificar algo de inteligencia |
high |
Equilibra el uso de tokens e inteligencia. El predeterminado en cada modelo excepto Opus 4.7 |
xhigh |
Razonamiento más profundo con mayor gasto de tokens. El predeterminado en Opus 4.7 |
max |
Puede mejorar el rendimiento en tareas exigentes pero puede mostrar rendimientos decrecientes y es propenso al exceso de pensamiento. Prueba antes de adoptar ampliamente |
ultracode |
Una configuración de Claude Code que planifica un flujo de trabajo dinámico para cada tarea sustancial con razonamiento xhigh por mensaje |
La escala de esfuerzo se calibra por modelo, por lo que el mismo nombre de nivel no representa el mismo valor subyacente entre modelos.
Usar ultrathink para razonamiento profundo único
Incluye ultrathink en cualquier lugar de tu mensaje para solicitar razonamiento más profundo en ese turno sin cambiar tu configuración de esfuerzo de sesión. Claude Code reconoce la palabra clave y agrega una instrucción en contexto. El nivel de esfuerzo enviado a la API no cambia. Claude Code pasa otras frases como "think", "think hard" y "think more" como texto de mensaje ordinario y no las reconoce como palabras clave.
Establecer el nivel de esfuerzo
Puedes cambiar el esfuerzo a través de cualquiera de los siguientes:
/effort: ejecuta/effortsin argumentos para abrir un control deslizante interactivo,/effortseguido de un nombre de nivel para establecerlo directamente, o/effort autopara borrar tu nivel guardado para el modelo activo. Puedes ejecutarlo mientras Claude está trabajando, y una vez que confirmes la advertencia de caché, si Claude Code muestra una, Claude Code aplica el nuevo nivel a la siguiente solicitud en el turno- En
/model: usa las teclas de flecha izquierda/derecha para ajustar el control deslizante de esfuerzo cuando selecciones un modelo - Bandera
--effort: pasa un nombre de nivel para establecerlo para una única sesión cuando lanzas Claude Code - Variable de entorno: establece
CLAUDE_CODE_EFFORT_LEVELa un nombre de nivel oauto - Configuración: establece un nivel por modelo en
modelSettings, o estableceeffortLevelalow,medium,highoxhighcomo el predeterminado para modelos sin uno.maxno se acepta en ninguna clave, yultracodetiene su propia claveultracode - Desde un dispositivo conectado: en una sesión de Control Remoto, elige un nivel del control de esfuerzo en tu teléfono o en tu navegador. El nivel se aplica solo a la sesión actual. Requiere Claude Code v2.1.234 o posterior
- Frontmatter de skill y subagente: establece
efforten un archivo markdown de skill o subagente para anular el nivel de esfuerzo cuando ese skill o subagente se ejecuta
El esfuerzo de frontmatter se aplica cuando ese skill o subagente está activo, anulando el nivel de sesión pero no la variable de entorno.
La clave effortLevel en configuración administrada es un predeterminado inicial, no aplicación: los usuarios pueden cambiarlo para una sesión con /effort o --effort, y el valor administrado se reafirma como el predeterminado en nuevas sesiones.
El control deslizante de esfuerzo aparece en /model cuando se selecciona un modelo admitido. El nivel de esfuerzo actual también se muestra en el encabezado de la sesión junto al nombre del modelo, por ejemplo "with low effort", para que puedas confirmar qué configuración está activa sin abrir /model. El pie de página también muestra brevemente el nivel de esfuerzo al inicio y cuando cambia.
Razonamiento adaptativo y presupuestos de pensamiento fijo
El razonamiento adaptativo hace que el pensamiento sea opcional en cada paso, por lo que Claude puede responder más rápido a mensajes rutinarios y reservar pensamiento más profundo para pasos que se benefician de él. Si quieres que Claude piense más o menos a menudo de lo que el nivel actual produce, puedes decirlo directamente en tu mensaje o en CLAUDE.md; el modelo responde a esa orientación dentro de su configuración de esfuerzo.
Fable 5.1, Fable 5, Sonnet 5 y Opus 4.7 y posterior siempre utilizan razonamiento adaptativo. El modo de presupuesto de pensamiento fijo y CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING no se aplican a ellos.
En Opus 4.6 y Sonnet 4.6, puedes establecer CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING=1 para revertir al modo de presupuesto de pensamiento fijo anterior controlado por MAX_THINKING_TOKENS. Consulta variables de entorno.
Pensamiento extendido
El pensamiento extendido es el razonamiento que Claude emite antes de responder. En modelos que admiten razonamiento adaptativo, el nivel de esfuerzo es el control principal de cuánto pensamiento ocurre; las configuraciones a continuación activan o desactivan el pensamiento y controlan cómo se muestra. Con el pensamiento desactivado en Anthropic API, Claude Code envía esfuerzo high en lugar de un nivel más alto a modelos que sabe que no aceptan esa combinación, como Opus 5.
| Control | Cómo establecerlo |
|---|---|
| Alternar para la sesión actual | Presiona Option+T en macOS o Alt+T en Windows y Linux |
| Establecer el predeterminado global | Ejecuta /config y alterna el modo de pensamiento. Se guarda como alwaysThinkingEnabled en ~/.claude/settings.json |
| Desactivar a través de una variable de entorno | Establece MAX_THINKING_TOKENS=0, que desactiva el pensamiento en Anthropic API excepto en Fable 5.1 y Fable 5. En proveedores de terceros esto omite el parámetro thinking en su lugar, y los modelos de razonamiento adaptativo aún pueden pensar. Otros valores se aplican solo con un presupuesto de pensamiento fijo |
El pensamiento no se puede desactivar en Fable 5.1 o Fable 5. El alternador de sesión, alwaysThinkingEnabled y MAX_THINKING_TOKENS=0 no tienen efecto allí, y el modelo decide por paso cuánto pensar según el nivel de esfuerzo.
Claude Code colapsa la salida de pensamiento por defecto. Presiona Ctrl+O para alternar el modo detallado y ver el razonamiento como texto gris en cursiva. Las sesiones interactivas en Anthropic API reciben bloques de pensamiento redactados por defecto, así que establece showThinkingSummaries: true en configuración si quieres los resúmenes completos disponibles cuando expandes. Se te cobra por todos los tokens de pensamiento generados, incluso cuando están colapsados o redactados.
Contexto extendido
Fable 5.1, Fable 5, Sonnet 5, Opus 4.6 y posterior, y Sonnet 4.6 admiten una ventana de contexto de 1 millón de tokens para sesiones largas con bases de código grandes.
La disponibilidad varía según el modelo y el plan. En Anthropic API, Fable 5.1, Fable 5, Sonnet 5 y Opus 4.7 y posterior se ejecutan con la ventana de 1M por defecto.
En planes Max, Team y Enterprise, incluidos tanto asientos de Team Standard como Team Premium, Opus se actualiza automáticamente a contexto de 1M sin configuración adicional. Sonnet 4.6 con contexto de 1M no es parte de la actualización automática y requiere créditos de uso en cada plan de suscripción, incluido Max.
| Plan | Opus con contexto de 1M | Sonnet 4.6 con contexto de 1M |
|---|---|---|
| Max, Team y Enterprise | Incluido con suscripción | Requiere créditos de uso |
| Pro | Requiere créditos de uso | Requiere créditos de uso |
| API y pago por uso | Acceso completo | Acceso completo |
Claude Code verifica estos requisitos de plan solo cuando se conecta directamente a Anthropic API. Si apuntas ANTHROPIC_BASE_URL a una puerta de enlace LLM y tu inicio de sesión guardado de claude.ai permanece como la credencial activa, Claude Code no verifica tus créditos de uso del plan. Las opciones [1m] permanecen disponibles en /model, y la puerta de enlace decide si la solicitud tiene éxito. Antes de v2.1.229, Claude Code rechazaba /model sonnet[1m] en esa configuración cuando no podía confirmar créditos de uso en la cuenta.
Para desactivar contexto de 1M, establece CLAUDE_CODE_DISABLE_1M_CONTEXT=1. Claude Code elimina variantes de modelo de 1M del selector de modelo. En modelos con una ventana nativa de 1M, como Sonnet 5 y los modelos Fable, también trata el modelo como si tuviera una ventana de contexto de 200K:
- Con auto-compactación activada, las sesiones se compactan en el límite de 200K a través de auto-compactación. Establecer la ventana de auto-compactación por encima de 200K no levanta la retención, porque Claude Code limita esa ventana a la ventana de contexto del modelo.
- Con auto-compactación desactivada, las sesiones se detienen en el límite de 200K con el error de límite de contexto en lugar de compactarse.
Antes de v2.1.223, Claude Code mantenía solo sesiones de Sonnet 5, Opus 4.8 y Opus 5 a 200K. Consulta variables de entorno.
La ventana de contexto de 1M utiliza precios de modelo estándar sin prima para tokens más allá de 200K. Para planes donde el contexto extendido se incluye con tu suscripción, el uso permanece cubierto por tu suscripción. Para planes que acceden a contexto extendido a través de créditos de uso, los tokens se facturan a créditos de uso.
Si tu cuenta admite contexto de 1M, la opción aparece en el selector /model en las últimas versiones de Claude Code. Si no la ves, intenta reiniciar tu sesión.
También puedes usar el sufijo [1m] con alias de modelo o nombres de modelo completos:
# Usa el alias opus[1m] o sonnet[1m]
/model opus[1m]
/model sonnet[1m]
# O agrega [1m] a un nombre de modelo completo
/model claude-opus-4-8[1m]
Ventana de contexto de Sonnet 5
En Anthropic API, Sonnet 5 siempre se ejecuta con la ventana de contexto de 1M. No hay variante de 200K, no hay sufijo [1m] para seleccionar, y no se requieren créditos de uso en ningún plan. Las sesiones se auto-compactan antes de que la ventana se llene, a aproximadamente 967K tokens por defecto; establece CLAUDE_CODE_AUTO_COMPACT_WINDOW para elegir un umbral diferente.
Dos configuraciones presupuestan la ventana en 200K en su lugar:
- Puerta de enlace LLM: cuando
ANTHROPIC_BASE_URLapunta a una puerta de enlace, Claude Code no puede verificar soporte de 1M. Para usar la ventana completa, selecciona Sonnet 5 (1M context) en el selector de modelo, que se asigna asonnet[1m]. CLAUDE_CODE_DISABLE_1M_CONTEXT=1: mantiene sesiones en cada modelo con una ventana nativa de 1M a una ventana de 200K; consulta Contexto extendido para cómo se aplica la retención. Útil para implementaciones que necesitan limitar el contexto.
Ventana de contexto y auto-compactación
La ventana de auto-compactación es qué tan llena puede estar la ventana de contexto antes de que Claude Code compacte la conversación. Para ver qué compactación conserva y descarta por mecanismo, consulte Lo que sobrevive a la compactación.
Establecer la ventana de auto-compactación
Puede establecer la ventana de auto-compactación en tres lugares:
- Para esta sesión y las posteriores: ejecute
/autocompactcon un valor, como/autocompact 500k. Claude Code lo guarda en la configuración de usuario comoautoCompactWindowy lo aplica a la sesión actual; si un ámbito de configuración de mayor prioridad, como la configuración administrada, establece la clave, el comando guarda su valor pero la sesión mantiene la ventana de ese ámbito, y el comando lo indica. Ejecute/autocompact autopara volver a la ventana ajustada para su modelo. - Para un lanzamiento: pase
--autocompactal iniciar Claude Code. La bandera anula su configuración guardada para ese lanzamiento sin cambiarla, yclaude --autocompact autoejecuta la sesión en la ventana ajustada incluso si su configuración guardada tiene un valor. A diferencia de/autocompact, la bandera no es anulada por un ámbito de configuración de mayor prioridad, como la configuración administrada. - En scripts y entornos en la nube: establezca
CLAUDE_CODE_AUTO_COMPACT_WINDOW. Mientras esté establecida, tiene precedencia sobre el comando, la bandera y la configuración, y/autocompactreporta la anulación en lugar de cambiar la ventana.
El comando y la bandera aceptan un tamaño de ventana de 100K a 1M de tokens, en cualquiera de estas formas:
- Un recuento de tokens simple, como
200000 - Un sufijo
koM, como500ko1M - Un número simple de 100 a 1000, que significa miles, por lo que
200establece 200.000
La variable de entorno acepta solo el recuento de tokens simple. Claude Code limita la ventana al tamaño de la ventana de contexto del modelo.
Umbrales de auto-compactación predeterminados
Si no establece una ventana de auto-compactación, Claude Code compacta cuando la conversación alcanza el límite de contexto del modelo, excepto en estas sesiones:
- Las sesiones en la nube se compactan cuando la conversación se acerca al límite del modelo
- Sonnet 4.6 y Opus 4.6 sin contexto extendido se compactan en el límite de 200K, y también lo hacen Opus 4.8 y Opus 5 cuando se ejecutan con una ventana de contexto de 200K, como en Amazon Bedrock, Google Cloud's Agent Platform y Microsoft Foundry
- Cuando establece
CLAUDE_CODE_DISABLE_1M_CONTEXT=1, los modelos con una ventana nativa de 1M, como Sonnet 5 y los modelos Fable, se compactan en el límite de 200K - Sonnet 5 se compacta en el umbral para su configuración
- Las sesiones en un ID de modelo que Claude Code no reconoce, como un alias de puerta de enlace LLM, se compactan en la ventana de contexto que Claude Code asume para el ID; consulte Corregir la ventana para una puerta de enlace o ID de modelo personalizado
Corregir la ventana para una puerta de enlace o ID de modelo personalizado
En una puerta de enlace LLM u otra implementación personalizada, Claude Code puede asumir una ventana de contexto para el ID del modelo que difiere de la ventana real del modelo, independientemente de si resuelve el ID a un modelo Claude. CLAUDE_CODE_MAX_CONTEXT_TOKENS declara la ventana que Claude Code debe asumir en su lugar. Cómo se aplica la variable depende del ID. Un ID no reconocido, un ID [1m] no reconocido y un ID que comienza con claude- o se resuelve a un modelo Claude son tres casos separados:
- Si el ID no comienza con
claude-ni contiene[1m], en cualquier caso, y Claude Code no puede resolverlo a un modelo Claude, la variable se aplica directamente y la compactación proactiva continúa en la ventana declarada. - Si el ID no comienza con
claude-pero contiene[1m], en cualquier caso, y Claude Code no puede resolverlo a un modelo Claude, Claude Code asume una ventana de 1M para él y la variable no se aplica por sí sola. Para corregir la ventana mientras se mantiene la compactación proactiva, también establezcaCLAUDE_CODE_DISABLE_1M_CONTEXT=1. Con una ventana declarada superior a 200K, Claude Code muestra una advertencia de inicio de que el límite de 200K no se aplica. La advertencia es esperada en esta configuración. - Si el ID comienza con
claude-en cualquier caso o se resuelve a un modelo Claude, la variable tiene efecto solo cuandoDISABLE_COMPACTtambién está establecida, lo que desactiva toda compactación. Por ejemplo, Claude Code resuelve un ID que contiene un nombre de modelo Claude, comoanthropic/claude-opus-4-8ous.anthropic.claude-…-v1:0, a ese modelo. Esto incluye IDs que también contienen[1m]: Claude Code resuelveclaude-opus-4-8[1m]a Opus 4.8 incluso conCLAUDE_CODE_DISABLE_1M_CONTEXTestablecida.
Para un ID de modelo que Claude Code no reconoce, establezca CLAUDE_CODE_DISABLE_UNKNOWN_MODEL_WINDOW_ENFORCEMENT=1 para que Claude Code compacte solo después de que la API rechace la conversación con un error demasiado largo que Claude Code reconoce. Claude Code no ejecuta esa recuperación cuando una puerta de enlace reescribe el error a una redacción que Claude Code no reconoce.
Verificar su modelo actual
Puede ver qué modelo está utilizando actualmente en dos lugares:
- En la línea de estado, si tiene una configurada
- En
/status, que también muestra la información de su cuenta
Agregar una opción de modelo personalizado
Utilice ANTHROPIC_CUSTOM_MODEL_OPTION para agregar una única entrada personalizada al selector /model sin reemplazar los alias integrados. Esto es útil para probar IDs de modelo que Claude Code no enumera de forma predeterminada. Para implementaciones de puerta de enlace LLM, Claude Code puede completar automáticamente el selector desde el punto final /v1/models de la puerta de enlace cuando se establece CLAUDE_CODE_ENABLE_GATEWAY_MODEL_DISCOVERY=1, por lo que esta variable solo es necesaria cuando el descubrimiento está deshabilitado o no devuelve el modelo que desea. Consulte descubrimiento de modelo de puerta de enlace.
Para enumerar varios modelos en su propio orden y bajo etiquetas que elija, establezca modelPicker. Su entrada indica qué filas mantiene el selector cuando esa alineación reemplaza la integrada.
Este ejemplo establece las tres variables para hacer que una implementación de Opus enrutada por puerta de enlace sea seleccionable. Claude Code lee variables de entorno al iniciarse, por lo que ejecute las exportaciones antes de lanzar claude, o reinicie una sesión existente para aplicarlas:
export ANTHROPIC_CUSTOM_MODEL_OPTION="my-gateway/claude-opus-5"
export ANTHROPIC_CUSTOM_MODEL_OPTION_NAME="Opus via Gateway"
export ANTHROPIC_CUSTOM_MODEL_OPTION_DESCRIPTION="Custom deployment routed through the internal LLM gateway"
ANTHROPIC_CUSTOM_MODEL_OPTION_NAME y ANTHROPIC_CUSTOM_MODEL_OPTION_DESCRIPTION son opcionales:
- Si omite el nombre, la entrada muestra el nombre del modelo cuando Claude Code reconoce el ID, y el ID del modelo en caso contrario.
- Si omite la descripción, Claude Code utiliza
Custom model (<model-id>).
Claude Code enumera la entrada personalizada después de las entradas integradas, y cualquier fila de modelPicker que agregue viene después de ella.
Claude Code omite la validación para el ID de modelo establecido en ANTHROPIC_CUSTOM_MODEL_OPTION, por lo que puede utilizar cualquier cadena que su punto final de API acepte.
Cuando availableModels está establecido, incluya también el ID de modelo personalizado en la lista de permitidos. De lo contrario, Claude Code filtra la entrada personalizada del selector y rechaza una selección de --model de la misma como cualquier otro modelo excluido.
Un ID personalizado que incrusta un nombre de familia, como my-gateway/claude-opus-5, cuenta como una entrada específica para esa familia y deshabilita su comodín, por lo que también debe enumerar las versiones que desea mantener seleccionables. Consulte Comportamiento de fusión.
Variables de entorno
Utilice las siguientes variables de entorno para controlar los nombres de modelo a los que se asignan los alias. Cada valor debe ser un nombre de modelo completo, o el identificador equivalente para su proveedor de API. Para elegir el modelo en el que comienzan sus sesiones, establezca ANTHROPIC_DEFAULT_MODEL, que esta tabla omite.
| Variable de entorno | Descripción |
|---|---|
ANTHROPIC_DEFAULT_FABLE_MODEL |
El modelo a utilizar para fable, y el ID de modelo que Claude Code reconoce como modelo Fable para alternancia automática de modelo en proveedores de terceros |
ANTHROPIC_DEFAULT_OPUS_MODEL |
El modelo a utilizar para opus, o para opusplan cuando Plan Mode está activo. |
ANTHROPIC_DEFAULT_SONNET_MODEL |
El modelo a utilizar para sonnet, o para opusplan cuando Plan Mode no está activo. |
ANTHROPIC_DEFAULT_HAIKU_MODEL |
El modelo a utilizar para haiku, o funcionalidad de fondo |
CLAUDE_CODE_SUBAGENT_MODEL |
El modelo predeterminado para subagentes, compañeros de equipo de agentes y agentes de workflow que no tienen asignado un modelo de otra manera. Acepta un alias como haiku o un nombre de modelo completo. Un modelo por invocación o el campo model de una definición, incluido inherit, tiene precedencia. Para cambiar eso, establezca CLAUDE_CODE_SUBAGENT_MODEL_FORCE |
Nota: ANTHROPIC_SMALL_FAST_MODEL está deprecado en favor de ANTHROPIC_DEFAULT_HAIKU_MODEL.
Fijar modelos para implementaciones de terceros
Cuando implemente Claude Code a través de Amazon Bedrock, Plataforma de Agentes de Google Cloud, Microsoft Foundry, o Claude Platform on AWS, fije versiones de modelo antes de implementar para usuarios.
Sin fijar, Claude Code utiliza alias de modelo como fable, opus, sonnet y haiku que se resuelven a un ID de modelo predeterminado integrado para cada proveedor. Ese predeterminado puede rezagarse con respecto a la versión más reciente de Anthropic, y el modelo al que apunta puede que aún no esté habilitado en la cuenta de un usuario. Cuando el predeterminado no está disponible, los usuarios de Amazon Bedrock y Plataforma de Agentes de Google Cloud ven un aviso y la sesión retrocede a una versión anterior del modelo predeterminado, o al modelo Sonnet predeterminado cuando el predeterminado es un modelo Opus y no hay versión de Opus disponible. Los usuarios de Microsoft Foundry ven errores en su lugar, porque Microsoft Foundry no tiene ninguna verificación de inicio equivalente.
En Amazon Bedrock y Plataforma de Agentes de Google Cloud, un usuario que inicia la sesión en una versión específica de Sonnet u Opus, por ejemplo con --model, ANTHROPIC_MODEL, o la configuración model, fija esa versión como el predeterminado de la sesión para el alias coincidente: la verificación de inicio omite el predeterminado integrado que reemplaza y no muestra ningún aviso de alternancia. Antes de v2.1.211, la verificación se ejecutaba y podía mostrar un aviso incluso cuando un modelo de sesión estaba configurado explícitamente.
Establezca las variables de entorno de modelo en IDs de versión específicos como parte de su configuración inicial. Fijar le permite controlar cuándo sus usuarios se mueven a un nuevo modelo.
Utilice las siguientes variables de entorno con IDs de modelo específicos de versión para su proveedor:
| Proveedor | Ejemplo |
|---|---|
| Amazon Bedrock | export ANTHROPIC_DEFAULT_OPUS_MODEL='us.anthropic.claude-opus-4-8' |
| Plataforma de Agentes de Google Cloud | export ANTHROPIC_DEFAULT_OPUS_MODEL='claude-opus-4-8' |
| Microsoft Foundry | export ANTHROPIC_DEFAULT_OPUS_MODEL='claude-opus-4-8' |
Aplique el mismo patrón para ANTHROPIC_DEFAULT_FABLE_MODEL, ANTHROPIC_DEFAULT_SONNET_MODEL y ANTHROPIC_DEFAULT_HAIKU_MODEL. Para IDs de modelo actuales y heredados en todos los proveedores, consulte Descripción general de modelos. Para actualizar usuarios a una nueva versión de modelo, actualice estas variables de entorno e implemente nuevamente.
Para habilitar contexto extendido para un modelo fijo, añada [1m] al ID de modelo en ANTHROPIC_DEFAULT_OPUS_MODEL o ANTHROPIC_DEFAULT_SONNET_MODEL:
export ANTHROPIC_DEFAULT_OPUS_MODEL='claude-opus-4-8[1m]'
El sufijo [1m] aplica la ventana de contexto de 1M a todo el uso de los alias opus y sonnet, incluida la fase Opus de modo de plan de opusplan.
- Claude Code elimina el sufijo antes de enviar el ID de modelo a su proveedor.
- Solo añada
[1m]cuando el modelo subyacente admita contexto de 1M. - El sufijo se lee por variable, no por modelo. En Amazon Bedrock, Plataforma de Agentes de Google Cloud y Microsoft Foundry, un ID de modelo sin
[1m]en una variable utiliza contexto de 200K incluso si otra variable establece el mismo modelo con el sufijo. Sonnet 5 siempre se ejecuta con la ventana de 1M en estos proveedores y nunca necesita el sufijo.
Una lista de permitidos availableModels entregada a través de MDM o un archivo de configuración administrado aún se aplica cuando se utilizan proveedores de terceros; la configuración administrada por servidor no se entrega allí.
El filtrado coincide con un alias de modelo como opus, un prefijo de versión como claude-opus-4-8, o el ID de modelo completo en forma de proveedor. Los prefijos específicos del proveedor como us.anthropic. no se eliminan, por lo que para permitir un modelo específico, enumere su ID completo en forma de proveedor, o asígnelo a través de modelOverrides. Cualquier sufijo [1m] se elimina tanto de la entrada de la lista de permitidos como del modelo solicitado antes de coincidir.
Personalizar la visualización y capacidades del modelo fijo
Cuando fija un modelo en un proveedor de terceros, su fila en el selector /model muestra el nombre del modelo de forma predeterminada si Claude Code reconoce el ID fijo, y el ID sin procesar en caso contrario:
- Reconocido: el ID exacto de un modelo que Claude Code conoce, como su ID de API de Anthropic o la forma de su proveedor o puerta de enlace, con o sin el sufijo
[1m]. Fijeus.anthropic.claude-sonnet-4-5-20250929-v1:0y la fila leeSonnet 4.5. - No reconocido: cualquier otro ID, como un ARN de perfil de inferencia de aplicación o una versión de modelo que Claude Code no conoce, a menos que una entrada de
modelOverridesasigne un modelo a esa cadena exacta. En Microsoft Foundry, los nombres de implementación están definidos por el usuario, por lo que Claude Code nunca reconoce un ID fijo allí, asignado o no, y la fila muestra el nombre de implementación de forma predeterminada.
Cuando una fila muestra el nombre del modelo, su descripción predeterminada incluye el ID fijo para que aún pueda ver qué ID está fijo.
Claude Code también puede no reconocer qué características admite un modelo fijo. Puede establecer el nombre de visualización y la descripción usted mismo y declarar capacidades con variables de entorno complementarias para cada modelo fijo.
Estas variables tienen efecto en proveedores de terceros como Amazon Bedrock, Plataforma de Agentes de Google Cloud y Microsoft Foundry. Las variables _NAME y _DESCRIPTION también tienen efecto cuando ANTHROPIC_BASE_URL apunta a una puerta de enlace LLM. No tienen efecto cuando se conecta directamente a api.anthropic.com.
| Variable de entorno | Descripción |
|---|---|
ANTHROPIC_DEFAULT_OPUS_MODEL_NAME |
Nombre de visualización para el modelo Opus fijo en el selector /model. Cuando no está configurado, la fila muestra el nombre del modelo si Claude Code reconoce el ID fijo, y el ID fijo en caso contrario |
ANTHROPIC_DEFAULT_OPUS_MODEL_DESCRIPTION |
Descripción de visualización para el modelo Opus fijo en el selector /model. Cuando no está configurado, la fila muestra una descripción predeterminada que comienza con Custom Opus model |
ANTHROPIC_DEFAULT_OPUS_MODEL_SUPPORTED_CAPABILITIES |
Lista separada por comas de capacidades que admite el modelo Opus fijo |
Los mismos sufijos _NAME, _DESCRIPTION y _SUPPORTED_CAPABILITIES están disponibles para ANTHROPIC_DEFAULT_SONNET_MODEL, ANTHROPIC_DEFAULT_HAIKU_MODEL, ANTHROPIC_DEFAULT_FABLE_MODEL y ANTHROPIC_CUSTOM_MODEL_OPTION.
Claude Code habilita características como niveles de esfuerzo y pensamiento extendido haciendo coincidir el ID de modelo con patrones conocidos. Los IDs específicos del proveedor como ARNs de Amazon Bedrock o nombres de implementación personalizados a menudo no coinciden con estos patrones, dejando las características compatibles deshabilitadas. Establezca _SUPPORTED_CAPABILITIES para indicar a Claude Code qué características admite realmente el modelo:
| Valor de capacidad | Habilita |
|---|---|
effort |
Niveles de esfuerzo y el comando /effort |
xhigh_effort |
El nivel de esfuerzo xhigh |
max_effort |
El nivel de esfuerzo max |
thinking |
Pensamiento extendido |
adaptive_thinking |
Razonamiento adaptativo que asigna dinámicamente el pensamiento basado en la complejidad de la tarea |
interleaved_thinking |
Pensamiento entre llamadas de herramientas |
Cuando se establece _SUPPORTED_CAPABILITIES, las capacidades enumeradas se habilitan y las capacidades no enumeradas se deshabilitan para el modelo fijo coincidente. Cuando la variable no está configurada, Claude Code vuelve a la detección integrada basada en el ID de modelo.
Este ejemplo fija Opus a un ARN de modelo personalizado de Amazon Bedrock, establece un nombre amigable y declara sus capacidades:
export ANTHROPIC_DEFAULT_OPUS_MODEL='arn:aws:bedrock:us-east-1:123456789012:custom-model/abc'
export ANTHROPIC_DEFAULT_OPUS_MODEL_NAME='Opus via Bedrock'
export ANTHROPIC_DEFAULT_OPUS_MODEL_DESCRIPTION='Opus 4.7 routed through a Bedrock custom endpoint'
export ANTHROPIC_DEFAULT_OPUS_MODEL_SUPPORTED_CAPABILITIES='effort,xhigh_effort,max_effort,thinking,adaptive_thinking,interleaved_thinking'
Anular IDs de modelo por versión
En plataformas que integran Claude Code y establecen CLAUDE_CODE_PROVIDER_MANAGED_BY_HOST, la configuración de modelo del host tiene precedencia sobre la configuración de modelo administrada, mientras que una lista de permitidos availableModels administrada permanece en vigor a menos que el host proporcione la suya propia; Excepciones a la precedencia de configuración administrada dice qué claves y variables anula el host.
Las variables de entorno a nivel de familia anteriores configuran un ID de modelo por alias de familia. Si necesita asignar varias versiones dentro de la misma familia a IDs de proveedor distintos, utilice la configuración modelOverrides en su lugar.
modelOverrides asigna IDs de modelo individuales de Anthropic a las cadenas específicas del proveedor que Claude Code envía a la API de su proveedor. Cuando un usuario selecciona un modelo asignado en el selector /model, Claude Code utiliza su valor configurado en lugar del predeterminado integrado.
Esto permite a los administradores empresariales enrutar cada versión de modelo a un ARN de perfil de inferencia de Amazon Bedrock específico, nombre de versión de Plataforma de Agentes de Google Cloud o nombre de implementación de Microsoft Foundry para gobernanza, asignación de costos o enrutamiento regional.
Establezca modelOverrides en su archivo de configuración:
{
"modelOverrides": {
"claude-opus-4-7": "arn:aws:bedrock:us-east-2:123456789012:application-inference-profile/opus-prod",
"claude-opus-4-6": "arn:aws:bedrock:us-east-2:123456789012:application-inference-profile/opus-46-prod",
"claude-sonnet-4-6": "arn:aws:bedrock:us-east-2:123456789012:application-inference-profile/sonnet-prod"
}
}
Las claves deben ser IDs de modelo de Anthropic como se enumeran en la Descripción general de modelos. Para IDs de modelo con fecha, incluya el sufijo de fecha exactamente como aparece allí. Las claves desconocidas se ignoran.
Para detener la línea de diagnóstico [claude-code:unrecognized_model] para un ID como un alias de puerta de enlace, añada una entrada con ese ID como su valor.
Las anulaciones reemplazan los IDs de modelo integrados que respaldan cada entrada en el selector /model. En Amazon Bedrock, las entradas de modelOverrides tienen precedencia sobre cualquier perfil de inferencia que Claude Code descubra automáticamente al inicio. Claude Code pasa valores que ya son específicos del proveedor, como ARNs de perfil de inferencia de Amazon Bedrock o nombres de implementación de Microsoft Foundry, al proveedor tal como están.
Las anulaciones también se aplican cuando pasa un ID de modelo de Anthropic directamente a través de --model, la variable de entorno ANTHROPIC_MODEL, o una variable de entorno ANTHROPIC_DEFAULT_*_MODEL. En Amazon Bedrock, Plataforma de Agentes de Google Cloud y Mantle, un ID de modelo de Anthropic sin entrada de modelOverrides se resuelve al mismo ID específico del proveedor que la fila del selector /model para esa versión, cuando el proveedor admite esa versión. Mantle admite un subconjunto de versiones. Para un ID de modelo de Anthropic fuera de ese subconjunto, Claude Code envía el ID sin procesar a Mantle sin asignarlo, a menos que una entrada de modelOverrides lo cubra. Antes de v2.1.200, --model y los valores de variable de entorno llegaban al proveedor tal como estaban sin pasar por el mapa de anulación.
modelOverrides funciona junto con availableModels. La lista de permitidos se evalúa contra el ID de modelo de Anthropic, no el valor de anulación, por lo que una entrada como "opus" en availableModels continúa coincidiendo incluso cuando las versiones de Opus se asignan a ARNs. Cuando enforceAvailableModels se establece en configuración administrada, el Predeterminado aplicado se resuelve a través de modelOverrides desde configuración administrada únicamente. La asignación de un administrador, como una versión fijada a un ARN de perfil de inferencia, se respeta en el Predeterminado aplicado. Las anulaciones de configuración de usuario o proyecto no la afectan.
Cuando availableModels se establece en configuración administrada, solo modelOverrides de configuración administrada se aplican a un ID de modelo de Anthropic pasado directamente a través de --model o las variables de entorno anteriores. Claude Code ignora las anulaciones en configuración de usuario o proyecto para esos IDs, y nunca resuelve un ID que la lista administrada excluye a través de modelOverrides de ninguna fuente de configuración. Esta restricción de fuente administrada requiere Claude Code v2.1.200 o posterior. Consulte Restringir la selección de modelo para saber cómo se manejan los IDs bloqueados.
Configuración de almacenamiento en caché de indicaciones
Claude Code utiliza automáticamente almacenamiento en caché de indicaciones para optimizar el rendimiento y reducir costos. Puede desactivar el almacenamiento en caché de indicaciones globalmente o para niveles de modelo específicos:
| Variable de entorno | Descripción |
|---|---|
DISABLE_PROMPT_CACHING |
Establezca en 1 para desactivar el almacenamiento en caché de indicaciones para todos los modelos. Tiene precedencia sobre la configuración por modelo |
DISABLE_PROMPT_CACHING_HAIKU |
Establezca en 1 para desactivar el almacenamiento en caché de indicaciones solo para modelos Haiku |
DISABLE_PROMPT_CACHING_SONNET |
Establezca en 1 para desactivar el almacenamiento en caché de indicaciones solo para modelos Sonnet |
DISABLE_PROMPT_CACHING_OPUS |
Establezca en 1 para desactivar el almacenamiento en caché de indicaciones solo para modelos Opus |
DISABLE_PROMPT_CACHING_FABLE |
Establezca en 1 para desactivar el almacenamiento en caché de indicaciones solo para modelos Fable |
Para elegir el TTL de caché para la conversación principal y para subagentes por separado, consulte elegir el TTL usted mismo. Para saber qué desencadena un error de caché, consulte Cómo Claude Code utiliza el almacenamiento en caché de indicaciones.