Resolver problemas do Cloud Scheduler

Nesta página, mostramos como resolver problemas com o Cloud Scheduler.

O Cloud Scheduler publica registros no início e no final de cada execução de job. É possível recuperar, visualizar e analisar os registros de um job específico, incluindo os registros de auditoria disponíveis para o Cloud Scheduler. Para mais informações, consulte Visualizar registros.

Por padrão, quando um job do Cloud Scheduler não recebe um reconhecimento do serviço de destino (o gerenciador de solicitações do job), ele é considerado como falho. O Cloud Scheduler vai tentar executar o job novamente de acordo com a espera exponencial configurada.

Para informações sobre incidentes que afetam os Google Cloud serviços, consulte o Google Cloud Painel do Service Health e Todos os incidentes informados para o Cloud Scheduler.

O job falha devido a um problema em um serviço downstream

Uma falha de job pode ser causada por um problema em um serviço downstream que o Cloud Scheduler está segmentando, por exemplo, o Cloud Run, em vez do próprio Cloud Scheduler. Você pode suspeitar de um problema em um serviço downstream quando as seguintes condições se aplicam:

  • As permissões do Cloud Scheduler estão configuradas corretamente.
  • O Cloud Scheduler pode acessar o serviço de destino.
  • As mensagens de erro nos registros de execução do Cloud Scheduler são originadas do serviço downstream.

Para resolver esse problema, siga estas etapas:

  1. Invocar o serviço downstream diretamente: verifique se o serviço downstream pode ser invocado sem o Cloud Scheduler. Uma invocação bem-sucedida indica que o Cloud Scheduler provavelmente está causando o problema. Se não for bem-sucedida, o serviço downstream vai precisar de mais depuração.
  2. Analise os registros do serviço de destino: examine os registros do serviço de destino, determine os erros que estão sendo gerados e faça a triagem deles de acordo com a necessidade.
  3. Procure operações de longa duração: quando o Cloud Scheduler retorna um erro HTTP 504 para operações de longa duração (mais de 30 minutos), verifique os registros do serviço de destino para saber se a execução foi concluída ou falhou, já que o serviço de destino pode ter um tempo limite de solicitação mais longo. Nesse cenário, o Cloud Scheduler atinge o tempo limite, mas o serviço de destino não.

O job falha com um erro de permissão

As permissões controlam quais principais podem acessar recursos e quais operações são permitidas. Permissões mal configuradas podem interromper as execuções de jobs e causar erros de permissão negada. Os registros de auditoria fornecem um registro detalhado de todas as mudanças de permissão, permitindo que você identifique a origem desses problemas.

Quando o job do Cloud Scheduler falha com um erro de permissão, os registros de execução podem mostrar uma mensagem semelhante a "debugInfo":"URL_ERROR-ERROR_OTHER. Original HTTP response code number = 403".

Para resolver esse problema, faça uma ou mais das seguintes verificações:

  • Verifique os papéis do IAM concedidos ao agente de serviço: o agente de serviço do Cloud Scheduler requer o papel Agente de serviço do Cloud Scheduler (roles/cloudscheduler.serviceAgent). Sem essa função, os jobs do Cloud Scheduler falham. É possível conceder manualmente o papel ao agente de serviço do Cloud Scheduler. Uma concessão manual é necessária somente se você ativou a API Cloud Scheduler antes de 19 de março de 2019 ou se removeu a função de agente de serviço do Cloud Scheduler. Para mais informações, consulte Conceder o papel de agente de serviço do Cloud Scheduler.

  • Verifique as permissões da conta de serviço: confira se a