En esta página se ofrece una descripción general de las opciones de configuración de los servicios de Cloud Run.
Evitar los arranques en frío y reducir la latencia
Puedes evitar los arranques en frío de tu aplicación y reducir la latencia de la aplicación si defines un número mínimo de instancias. Ten en cuenta que, si estableces un número mínimo de instancias, se generarán costes. Consulta más información en el artículo Definir el número mínimo de instancias de los servicios.
Capacidad
Puedes controlar la cantidad de memoria, CPU y concurrencia máxima que puede usar un servicio.
Usa la configuración de facturación para controlar cómo se te cobra: por solicitud y solo cuando la instancia procesa una solicitud, o durante todo el ciclo de vida de la instancia.
Variables de entorno
Puedes crear pares clave-valor para usarlos con tu servicio de Cloud Run. Para obtener más información, consulta Configurar variables de entorno para servicios.
Entorno de ejecución
Cloud Run tiene dos entornos de ejecución. Consulta las diferencias entre ambos entornos de ejecución.
GPU
Si necesitas alojar cargas de trabajo de IA, como modelos de inferencia y entrenamiento de modelos, puedes configurar servicios de Cloud Run con o sin GPU.
Protegerse frente a niveles de solicitudes altos
Puedes controlar cuántas instancias crea tu servicio de Cloud Run para atender las solicitudes configurando los valores de instancias máximas e instancias mínimas. Esto puede ayudar a reducir los costes y protegerse frente a niveles de solicitudes anormalmente altos.
Comprobaciones del estado
Cloud Run te permite configurar dos tipos de sondas de comprobación del estado. Una de las sondas determina cuándo está listo el contenedor para aceptar tráfico y la otra determina si se debe reiniciar el contenedor. Consulta más información sobre las comprobaciones del estado de los contenedores.
Etiquetas
Las etiquetas de Cloud Run son pares clave/valor que puedes aplicar a servicios, revisiones y funciones de Cloud Run. Las etiquetas te ayudan a organizar tus recursos de Cloud Run y a gestionar los costes a gran escala con la granularidad que necesites.
Las etiquetas que hayas definido anteriormente para tus funciones de Cloud Run mediante comandos gcloud functions o la API Cloud Functions v2 se propagan a Cloud Run cuando despliegas tus funciones en Cloud Run.
Escalado
De forma predeterminada, Cloud Run escala automáticamente hasta un número máximo de instancias especificado o predeterminado, en función del tráfico y del uso de la CPU. Sin embargo, en algunos casos prácticos, puede que quieras definir un número específico de instancias mediante el