Solucione problemas dos serviços da plataforma StorageGRID
Os endpoints usados nos serviços da plataforma são criados e mantidos pelos usuários do tenant no Tenant Manager. No entanto, se um tenant tiver problemas para configurar ou usar os serviços da plataforma, você pode usar o Grid Manager para ajudar a resolver o problema.
Problemas com novos endpoints
Antes que um locatário possa usar os serviços da plataforma, ele deve criar um ou mais endpoints usando o Tenant Manager. Cada endpoint representa um destino externo para um serviço da plataforma, como um bucket do StorageGRID S3, um bucket do Amazon Web Services, um tópico do Amazon Simple Notification Service, um tópico do Kafka ou um cluster do Elasticsearch hospedado localmente ou na AWS. Cada endpoint inclui tanto a localização do recurso externo quanto as credenciais necessárias para acessar esse recurso.
Quando um locatário cria um endpoint, o StorageGRID valida se o endpoint existe e se pode ser acessado usando as credenciais especificadas. A conexão com o endpoint é validada a partir de um nó em cada local.
Se a validação do endpoint falhar, uma mensagem de erro explica por que a validação do endpoint falhou. O usuário do locatário deve resolver o problema e tentar criar o endpoint novamente.
|
|
A criação do endpoint falhará se os serviços da plataforma não estiverem habilitados para a conta do tenant. |
Problemas com os endpoints existentes
Se ocorrer um erro quando StorageGRID tentar acessar um endpoint existente, uma mensagem será exibida no painel do Tenant Manager.

Os usuários locatários podem acessar a página de Endpoints para revisar a mensagem de erro mais recente de cada endpoint e determinar há quanto tempo o erro ocorreu. A coluna Último erro exibe a mensagem de erro mais recente de cada endpoint e indica há quanto tempo o erro ocorreu. Erros que incluem o ícone
ocorreram nos últimos 7 dias.

|
|
Algumas mensagens de erro na coluna Último erro podem incluir um logID entre parênteses. Um administrador da grade ou suporte técnico pode usar esse ID para localizar informações mais detalhadas sobre o erro no bycast.log. |
Problemas relacionados a servidores proxy
Se você configurou um "proxy de armazenamento" entre os nós de armazenamento e os endpoints do serviço da plataforma, podem ocorrer erros se o seu serviço de proxy não permitir mensagens do StorageGRID. Para resolver esses problemas, verifique as configurações do seu servidor proxy para garantir que as mensagens relacionadas ao serviço da plataforma não estejam sendo bloqueadas.
Determine se ocorreu um erro
Se ocorrerem erros de endpoint nos últimos 7 dias, o painel do Tenant Manager exibirá uma mensagem de alerta. Você pode acessar a página Endpoints para ver mais detalhes sobre o erro.
As operações do cliente falham
Alguns problemas nos serviços da plataforma podem causar falhas nas operações do cliente no bucket S3. Por exemplo, as operações do cliente S3 falharão se o serviço interno de Replicated State Machine (RSM) for interrompido ou se houver muitas mensagens dos serviços da plataforma enfileiradas para entrega.
Para verificar o status dos serviços:
-
Selecione Nós > site > Nó de armazenamento > Visão geral.
-
Verifique se há alertas ativos na tabela de Alertas.
-
Resolva quaisquer alertas ativos. Se necessário, entre em contato com o suporte técnico.
Erros de endpoint recuperáveis e irrecuperáveis
Após a criação dos endpoints, erros nas solicitações de serviço da plataforma podem ocorrer por diversos motivos. Alguns erros são recuperáveis com a intervenção do usuário. Por exemplo, erros recuperáveis podem ocorrer pelos seguintes motivos:
-
As credenciais do usuário foram excluídas ou expiraram.
-
O bucket de destino não existe.
-
A notificação não pôde ser entregue.
Caso StorageGRID encontre um erro recuperável, a solicitação de serviço da plataforma será repetida até que seja bem-sucedida.
Outros erros são irrecuperáveis. Por exemplo, erros irrecuperáveis podem ocorrer pelos seguintes motivos:
-
O endpoint foi excluído.
-
Um endpoint de webhook destino responde a uma solicitação de notificação com um
400 Bad Requesterro.
Se StorageGRID encontrar um erro de endpoint irrecuperável:
-
No Grid Manager, acesse Suporte > Ferramentas > Métricas > Grafana > Platform Services Overview para visualizar os detalhes do erro.
-
No Gerenciador de Locatários, vá para STORAGE (S3) > Platform Services Endpoints para visualizar os detalhes do erro.
-
Verifique o
/var/local/log/bycast-err.logpara erros relacionados. Os nós de armazenamento que possuem o serviço ADC contêm este arquivo de log.
Não foi possível entregar as mensagens dos serviços da plataforma
Se o destino encontrar um problema que o impeça de aceitar mensagens dos serviços da plataforma, a operação do cliente no bucket será bem-sucedida, mas a mensagem dos serviços da plataforma não será entregue. Por exemplo, esse erro pode ocorrer se as credenciais forem atualizadas no destino de forma que StorageGRID não consiga mais se autenticar no serviço de destino.
Verifique se há alertas relacionados.
Desempenho mais lento para solicitações de serviço da plataforma
O software StorageGRID pode limitar as solicitações S3 recebidas para um bucket se a taxa de envio das solicitações exceder a taxa na qual o endpoint de destino pode recebê-las. A limitação só ocorre quando há um acúmulo de solicitações aguardando para serem enviadas ao endpoint de destino.
O único efeito visível é que as solicitações S3 recebidas levarão mais tempo para serem executadas. Se você começar a detectar um desempenho significativamente mais lento, você deve reduzir a taxa de ingestão ou usar um endpoint com maior capacidade. Se o acúmulo de solicitações continuar crescendo, as operações do cliente S3 (como solicitações PUT) eventualmente falharão.
As solicitações do CloudMirror têm mais probabilidade de serem afetadas pelo desempenho do endpoint de destino, porque normalmente envolvem mais transferência de dados do que as solicitações de integração de pesquisa ou de notificação de eventos.
As solicitações de serviço da plataforma falham
Para visualizar a taxa de falha de solicitações para serviços da plataforma:
-
Selecione Nós.
-
Selecione site > Serviços da Plataforma.
-
Veja o gráfico da taxa de erros de solicitação.

Alerta de indisponibilidade dos serviços da plataforma
O alerta Serviços da plataforma indisponíveis indica que nenhuma operação de serviço da plataforma pode ser executada em um site porque há poucos Storage Nodes com o serviço RSM em execução ou disponíveis.
O serviço RSM garante que as solicitações de serviço da plataforma sejam enviadas aos seus respectivos endpoints.
Para resolver este alerta, determine quais Storage Nodes no site incluem o serviço RSM. (O serviço RSM está presente nos Storage Nodes que também incluem o serviço ADC.) Em seguida, certifique-se de que a maioria simples desses Storage Nodes esteja em execução e disponível.
|
|
Se mais de um nó de armazenamento que contenha o serviço RSM falhar em um site, você perderá quaisquer solicitações de serviço de plataforma pendentes para esse site. |
Orientações adicionais para resolução de problemas nos endpoints dos serviços da plataforma
Para obter informações adicionais, consulte "Usar uma conta de locatário > Solucionar problemas de endpoints de serviços da plataforma".