Si tiene credenciales de Google Cloud y desea comenzar a usar Claude Code a través de Vertex AI, el asistente de inicio de sesión lo guía a través del proceso. Completa los requisitos previos del lado de GCP una vez por proyecto; el asistente maneja el lado de Claude Code.
Ejecute claude. En el mensaje de inicio de sesión, seleccione 3rd-party platform, luego Google Vertex AI.
3
Siga los mensajes del asistente
Elija cómo se autentica en Google Cloud: Credenciales predeterminadas de aplicación de gcloud, un archivo de clave de cuenta de servicio, o credenciales ya en su entorno. El asistente detecta su proyecto y región, verifica qué modelos Claude puede invocar su proyecto, y le permite fijarlos. Guarda el resultado en el bloque env de su archivo de configuración de usuario, por lo que no necesita exportar variables de entorno usted mismo.
Después de haber iniciado sesión, ejecute /setup-vertex en cualquier momento para reabrirlo el asistente y cambiar sus credenciales, proyecto, región o fijaciones de modelo.
Configuración de región
Claude Code admite puntos finales de Vertex AI globales, multirregión y regionales. Establezca CLOUD_ML_REGION en global, una ubicación multirregión como eu o us, o una región específica como us-east5. Claude Code selecciona el nombre de host correcto de Vertex AI para cada formulario, incluidos los hosts aiplatform.eu.rep.googleapis.com y aiplatform.us.rep.googleapis.com para ubicaciones multirregión.
Configurar manualmente
Para configurar Vertex AI a través de variables de entorno en lugar del asistente, por ejemplo en CI o una implementación empresarial con script, siga los pasos a continuación.
1. Habilitar la API de Vertex AI
Habilite la API de Vertex AI en su proyecto de GCP:
# Establezca su ID de proyecto
gcloud config set project YOUR-PROJECT-ID# Habilitar la API de Vertex AI
gcloud services enable aiplatform.googleapis.com
2. Solicitar acceso al modelo
Solicite acceso a los modelos Claude en Vertex AI:
Claude Code admite la actualización automática de credenciales para GCP a través de la configuración gcpAuthRefresh. Cuando Claude Code detecta que sus credenciales de GCP han expirado o no se pueden cargar, ejecuta el comando configurado para obtener nuevas credenciales antes de reintentar la solicitud.
La salida del comando se muestra al usuario, pero la entrada interactiva no es compatible. Esto funciona bien para flujos de autenticación basados en navegador donde la CLI muestra una URL y usted completa la autenticación en el navegador. El comando de actualización agota el tiempo de espera después de tres minutos si la autenticación no se completa. Si establece gcpAuthRefresh en la configuración del proyecto como .claude/settings.json, el comando se ejecuta solo después de que acepte el mensaje de confianza del espacio de trabajo.
4. Configurar Claude Code
Establezca las siguientes variables de entorno:
# Habilitar la integración de Vertex AIexport CLAUDE_CODE_USE_VERTEX=1export CLOUD_ML_REGION=global
export ANTHROPIC_VERTEX_PROJECT_ID=YOUR-PROJECT-ID# Opcional: Anular la URL del punto final de Vertex para puntos finales personalizados o puertas de enlace# export ANTHROPIC_VERTEX_BASE_URL=https://aiplatform.googleapis.com# Opcional: Deshabilitar el almacenamiento en caché de indicaciones si es necesarioexport DISABLE_PROMPT_CACHING=1# Opcional: Solicitar TTL de caché de indicaciones de 1 hora en lugar del predeterminado de 5 minutosexport ENABLE_PROMPT_CACHING_1H=1# Cuando CLOUD_ML_REGION=global, anule la región para modelos que no admiten puntos finales globalesexport VERTEX_REGION_CLAUDE_HAIKU_4_5=us-east5export VERTEX_REGION_CLAUDE_4_6_SONNET=europe-west1
La mayoría de las versiones de modelo tienen una variable VERTEX_REGION_CLAUDE_* correspondiente. Consulte la referencia de variables de entorno para obtener la lista completa. Verifique Vertex Model Garden para determinar qué modelos admiten puntos finales globales frente a solo regionales.
Prompt caching se habilita automáticamente. Para deshabilitarlo, establezca DISABLE_PROMPT_CACHING=1. Para solicitar un TTL de caché de 1 hora en lugar del predeterminado de 5 minutos, establezca ENABLE_PROMPT_CACHING_1H=1; las escrituras de caché con un TTL de 1 hora se facturan a una tarifa más alta. Para límites de velocidad elevados, póngase en contacto con el soporte de Google Cloud. Al usar Vertex AI, el comando /logout no está disponible ya que la autenticación se maneja a través de credenciales de Google Cloud.
Claude Code deshabilita MCP tool search de forma predeterminada en Vertex AI, por lo que las definiciones de herramientas MCP se cargan por adelantado. Vertex AI admite búsqueda de herramientas para Claude Sonnet 4.5 y posterior y Claude Opus 4.5 y posterior. Establezca ENABLE_TOOL_SEARCH=true para habilitarlo en esos modelos. Los modelos anteriores en Vertex AI no aceptan el encabezado beta requerido, y las solicitudes fallan si habilita la búsqueda de herramientas con ellos.
5. Fijar versiones de modelo
Establezca estas variables de entorno en ID de modelo específicos de Vertex AI.
Sin ANTHROPIC_DEFAULT_OPUS_MODEL, el alias opus en Vertex se resuelve a Opus 4.6. Establézcalo en el ID de Opus 4.8 para usar el modelo más reciente:
Claude Code utiliza estos modelos predeterminados cuando no se establecen variables de fijación:
Tipo de modelo
Valor predeterminado
Modelo principal
claude-sonnet-4-5@20250929
Modelo pequeño/rápido
Igual que el modelo principal
Las tareas en segundo plano como la generación de títulos de sesión utilizan el modelo pequeño/rápido, normalmente un modelo de clase Haiku. En Vertex AI, Claude Code establece por defecto esto al modelo principal porque Haiku puede no estar habilitado en todos los proyectos o regiones. Para usar Haiku para tareas en segundo plano, establezca ANTHROPIC_DEFAULT_HAIKU_MODEL en un ID de modelo que esté disponible en su proyecto.
Cuando Claude Code se inicia con Vertex AI configurado, verifica que los modelos que pretende usar sean accesibles en su proyecto. Esta verificación requiere Claude Code v2.1.98 o posterior.
Si ha fijado una versión de modelo que es más antigua que el valor predeterminado actual de Claude Code, y su proyecto puede invocar la versión más reciente, Claude Code le solicita que actualice la fijación. Aceptar escribe el nuevo ID de modelo en su archivo de configuración de usuario y reinicia Claude Code. Rechazar se recuerda hasta el próximo cambio de versión predeterminada.
Si no ha fijado un modelo y el valor predeterminado actual no está disponible en su proyecto, Claude Code retrocede a la versión anterior para la sesión actual y muestra un aviso. El retroceso no se persiste. Habilite el modelo más reciente en Model Garden o fije una versión para hacer la opción permanente.
Configuración de IAM
Asigne los permisos de IAM requeridos:
El rol roles/aiplatform.user incluye los permisos requeridos:
aiplatform.endpoints.predict - Requerido para la invocación de modelo y conteo de tokens
Para permisos más restrictivos, cree un rol personalizado con solo los permisos anteriores.
Claude Sonnet 5, Opus 4.6 y posteriores, y Sonnet 4.6 admiten la ventana de contexto de 1M de tokens en Vertex AI. Sonnet 5 siempre se ejecuta con la ventana de 1M, sin ninguna variante [1m] para seleccionar. Para los otros modelos, Claude Code habilita automáticamente la ventana de contexto extendida cuando selecciona una variante de modelo de 1M.
Verifique las cuotas actuales o solicite un aumento de cuota a través de Cloud Console
Si encuentra errores "modelo no encontrado" 404:
Confirme que el modelo está habilitado en Model Garden
Verifique que el modelo esté disponible en la ubicación que especificó. Algunos modelos se ofrecen solo en ubicaciones global o multirregión como eu y us, no en regiones específicas
Si utiliza CLOUD_ML_REGION=global, verifique que sus modelos admitan puntos finales globales en Model Garden en "Características compatibles". Para modelos que no admiten puntos finales globales, ya sea:
Especifique un modelo compatible a través de ANTHROPIC_MODEL o ANTHROPIC_DEFAULT_HAIKU_MODEL, o
Establezca una región o ubicación multirregión usando variables de entorno VERTEX_REGION_<MODEL_NAME>
Si encuentra errores 429:
Para puntos finales regionales, asegúrese de que el modelo principal y el modelo pequeño/rápido sean compatibles en su región seleccionada
Considere cambiar a CLOUD_ML_REGION=global para una mejor disponibilidad
290 Ventana de contexto de 1M de tokens290 Ventana de contexto de 1M de tokens
291</h2>291</h2>
292292
293Claude Opus 4.6 y posteriores, y Sonnet 4.6, admiten la [ventana de contexto de 1M de tokens](https://platform.claude.com/docs/en/build-with-claude/context-windows#1m-token-context-window) en Vertex AI. Claude Code habilita automáticamente la ventana de contexto extendida cuando selecciona una variante de modelo de 1M.293Claude Sonnet 5, Opus 4.6 y posteriores, y Sonnet 4.6 admiten la [ventana de contexto de 1M de tokens](https://platform.claude.com/docs/en/build-with-claude/context-windows#1m-token-context-window) en Vertex AI. Sonnet 5 siempre se ejecuta con la ventana de 1M, sin ninguna variante `[1m]` para seleccionar. Para los otros modelos, Claude Code habilita automáticamente la ventana de contexto extendida cuando selecciona una variante de modelo de 1M.
294294
295El [asistente de configuración](#sign-in-with-vertex-ai) ofrece una opción de contexto de 1M cuando fija modelos. Para habilitarlo para un modelo fijado manualmente en su lugar, agregue `[1m]` al ID del modelo. Consulte [Fijar modelos para implementaciones de terceros](/es/model-config#pin-models-for-third-party-deployments) para obtener detalles.295El [asistente de configuración](#sign-in-with-vertex-ai) ofrece una opción de contexto de 1M cuando fija modelos. Para habilitarlo para un modelo fijado manualmente en su lugar, agregue `[1m]` al ID del modelo. Consulte [Fijar modelos para implementaciones de terceros](/es/model-config#pin-models-for-third-party-deployments) para obtener detalles.