Saiba mais sobre o serviço de integração de pesquisa do StorageGRID
Você pode habilitar a integração de pesquisa para um bucket do S3 se você quiser usar um serviço externo de pesquisa e análise de dados para os metadados dos seus objetos.
O serviço de integração de pesquisa é um serviço personalizado do StorageGRID que envia automaticamente e de forma assíncrona os metadados de objetos S3 para um endpoint de destino sempre que um objeto é criado ou excluído, ou quando seus metadados ou tags são atualizados. Você pode então usar ferramentas sofisticadas de pesquisa, análise de dados, visualização ou aprendizado de máquina fornecidas pelo serviço de destino para pesquisar, analisar e obter insights a partir dos dados dos seus objetos.
Por exemplo, você pode configurar seus buckets para enviar metadados de objetos S3 para um serviço Elasticsearch remoto. Em seguida, você pode usar o Elasticsearch para realizar buscas em todos os buckets e executar análises sofisticadas de padrões presentes nos metadados dos seus objetos.
Embora a integração com o Elasticsearch possa ser configurada em um bucket com o S3 Object Lock ativado, os metadados do S3 Object Lock (incluindo Retain Until Date e o status de Legal Hold) dos objetos não serão incluídos nos metadados enviados ao Elasticsearch.
|
|
Como o serviço de integração de pesquisa faz com que metadados de objetos sejam enviados para um destino, seu XML de configuração é chamado de "XML de configuração de notificação de metadados". Este XML de configuração é diferente do "XML de configuração de notificação" usado para habilitar notificações de eventos. |
Integração de pesquisa e buckets S3
Você pode habilitar o serviço de integração de pesquisa para qualquer bucket versionado ou não versionado. A integração de pesquisa é configurada associando um arquivo XML de configuração de notificação de metadados ao bucket, que especifica em quais objetos agir e o destino dos metadados do objeto.
As notificações de metadados são geradas na forma de um documento JSON nomeado com o nome do bucket, o nome do objeto e o ID da versão, se houver. Cada notificação de metadados contém um conjunto padrão de metadados do sistema para o objeto, além de todas as tags e metadados do usuário do objeto.
|
|
Para tags e metadados de usuário, StorageGRID envia datas e números para o Elasticsearch como strings ou como notificações de eventos do S3. Para configurar o Elasticsearch para interpretar essas strings como datas ou números, siga as instruções do Elasticsearch para mapeamento dinâmico de campos e para mapeamento de formatos de data. Você deve habilitar os mapeamentos dinâmicos de campos no índice antes de configurar o serviço de integração de pesquisa. Depois que um documento é indexado, você não pode editar os tipos de campo do documento no índice. |
Notificações de pesquisa
As notificações de metadados são geradas e enfileiradas para entrega sempre que:
-
Um objeto é criado.
-
Um objeto é excluído, inclusive quando objetos são excluídos como resultado da operação da política ILM da grid.
-
Metadados ou tags dos objetos são adicionados, atualizados ou excluídos. O conjunto completo de metadados e tags é sempre enviado na atualização, não apenas os valores alterados.
Depois de adicionar o XML de configuração de notificação de metadados a um bucket, as notificações são enviadas para quaisquer novos objetos que você criar e para quaisquer objetos que você modificar atualizando seus dados, metadados de usuário ou tags. No entanto, as notificações não são enviadas para quaisquer objetos que já estavam no bucket. Para garantir que os metadados de objeto de todos os objetos no bucket sejam enviados ao destino, você deve fazer uma das seguintes ações:
-
Configure o serviço de integração de pesquisa imediatamente após criar o bucket e antes de adicionar quaisquer objetos.
-
Execute uma ação em todos os objetos já presentes no bucket que acionará o envio de uma mensagem de notificação de metadados para o destino.
Serviço de integração de pesquisa e Elasticsearch
O serviço de integração de pesquisa do StorageGRID suporta um cluster Elasticsearch como destino. Assim como nos outros serviços da plataforma, o destino é especificado no endpoint cujo URN é usado no XML de configuração do serviço. Use o "NetApp Ferramenta de Matriz de Interoperabilidade" para determinar as versões suportadas do Elasticsearch.