View a markdown version of this page

OpenSearch Painéis de solução de problemas - OpenSearch Serviço Amazon

As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.

OpenSearch Painéis de solução de problemas

Esta seção descreve problemas conhecidos que podem fazer com que os OpenSearch painéis fiquem indisponíveis, falhem no carregamento ou se comportem de forma inesperada. Cada problema inclui as ações que você pode tomar para resolvê-lo sozinho. Os painéis são executados nos nós de dados ativos do seu domínio e armazenam seu estado (padrões de índice, visualizações e painéis) no OpenSearch índice de painéis. Como resultado, a maioria dos problemas de disponibilidade dos painéis remonta à integridade do cluster, ao armazenamento, à migração do índice dos OpenSearch painéis, à configuração do cluster ou dos painéis, aos limites de recursos ou à versão do software de serviço do domínio.

Cada problema é organizado como sintoma (o que você vê e como confirmá-lo), causa raiz, como mitigar (etapas de autoatendimento) e Ação sugerida (como evitar que ele se repita).

nota

Muitos problemas conhecidos do Dashboards já foram resolvidos em uma versão mais recente do software de serviço. Antes de continuar com o problema, abra o console do Amazon OpenSearch Service (o AWS console do serviço, não a interface do usuário do OpenSearch Dashboards), verifique o painel de notificações e instale a atualização mais recente disponível do software do serviço. Várias seções abaixo listam isso como a ação recomendada. Se uma alteração de configuração ou atualização já estiver em andamento, espere que ela termine antes de instalar uma atualização.

Os painéis estão bloqueados em “o servidor ainda não está pronto” (erro HTTP 503 não está pronto)

Sintomas

Os painéis são exibidos OpenSearch Dashboards server is not ready yet (um erro HTTP 503 não pronto) e não terminam de carregar. Os painéis mostram essa página sempre que a inicialização não é concluída. Uma versão resumida é normal durante uma reinicialização, atualização ou blue/green implantação e é limpa sozinha. Trate isso como um problema quando ele persistir. Para restringir a causa, verifique a integridade do cluster do domínio e se uma alteração ou atualização na configuração está em andamento:

  • Se uma alteração ou atualização estiver em andamento, a mensagem geralmente é transitória; aguarde até que o domínio retorne ao Active.

  • Se a integridade do cluster estiver vermelha, os painéis não poderão ser iniciados porque isso depende do cluster; resolva primeiro o problema do cluster (consulteProblemas relacionados ao cluster e ao acesso).

  • Se a mensagem persistir enquanto a integridade do cluster estiver verde, a migração do índice dos OpenSearch painéis provavelmente será bloqueada (descrita abaixo).

Causa raiz

Os painéis informam que “o servidor ainda não está pronto” até que todos os serviços principais terminem de ser inicializados, e é por isso que uma versão transitória da mensagem é esperada durante a inicialização e as implantações. blue/green Quando persiste com um cluster verde, a causa mais comum é o bloqueio da migração do índice do OpenSearch Dashboards: na inicialização, o Dashboards migra seus objetos salvos para um novo índice por trás de um alias e, se essa migração não for concluída, o Dashboards nunca ficará pronto. Gatilhos comuns para uma migração bloqueada:

  • Depois de uma atualização, uma migração bloqueada pode ocorrer pelos seguintes motivos:

    • Um índice de OpenSearch painéis que sobrou de uma versão anterior impede que o novo alias seja criado.

    • Uma atualização de uma versão mais antiga do mecanismo cujos painéis não usavam um alias entra em conflito com um índice existente.

    • Documentos escritos por uma instância mais nova (autogerenciada) do Dashboards não podem ser migrados automaticamente para a versão de destino.

  • Sem uma atualização, uma migração bloqueada pode ocorrer pelos seguintes motivos:

    • Um índice corrompido do OpenSearch Dashboards criado por uma solicitação de interface do usuário ou uma restauração bloqueia o alias.

    • Dois ou mais índices de OpenSearch painéis versionados apontam para o mesmo alias. Isso também pode aparecer como um Internal Server Error (HTTP 500) mesmo quando a integridade do cluster está verde.

    • Per-user ou índices por locatário foram criados sem um alias em domínios que usam controle de acesso refinado ou autenticação do Amazon Cognito.

    • Uma alteração no mapeamento de objetos salvos não pode ser aplicada devido a um documento quebrado.

Como mitigar
  1. Se uma alteração de configuração ou atualização de versão estiver em andamento, aguarde até que o domínio retorne ao Active. A mensagem geralmente é transitória e clara por si só. Uma alteração ou atualização normal é concluída em algumas horas. Se o Dashboards ainda estiver indisponível mais de 4 horas após o domínio retornar ao Active, trate isso como um problema persistente. Continue com as etapas a seguir. (Você não pode iniciar uma atualização do software de serviço enquanto o domínio ainda estiver processando uma alteração.)

  2. Se a integridade do cluster estiver vermelha ou amarela, resolva primeiro o problema do cluster (consulteProblemas relacionados ao cluster e ao acesso). Os painéis não podem ser iniciados em um cluster não íntegro.

  3. Se a mensagem persistir enquanto a integridade do cluster estiver verde, reúna alguns diagnósticos somente para leitura que ajudem o Support AWS a resolver o problema mais rapidamente e, em seguida, entre em contato com o AWS Support para reparar o índice do Dashboards. OpenSearch Inclua a saída dos seguintes comandos no seu caso:

    GET _cat/aliases/.kibana*?v GET _cat/indices/.kibana*?v

    Reparar a migração bloqueada é a solução para um domínio já bloqueado. A instalação de uma atualização de software não desbloqueia, por si só, um domínio que já está bloqueado. Não exclua você mesmo o índice dos OpenSearch painéis. A exclusão permanente remove todas as visualizações, painéis e padrões de índice salvos que não são salvos em um instantâneo. Se um reparo exigir a exclusão de um índice que contém dados, o AWS Support solicitará sua permissão primeiro. Para um domínio de produção que ficou indisponível por mais de uma hora sem nenhuma alteração na configuração em andamento, abra seu caso de Support com uma gravidade de comprometimento do sistema de produção ou superior.

  4. Para evitar a recorrência, mantenha o domínio na atualização mais recente do software do serviço; as versões atuais corrigem as causas comuns de falha na migração. Instale a atualização depois que o domínio retornar ao Active.

  5. Faça um instantâneo manual antes de cada atualização de versão para que você possa restaurar os objetos salvos em caso de falha na migração. Para obter mais informações sobre como tirar instantâneos, consulteCriação de instantâneos de índice no Amazon Service OpenSearch.

Ação sugerida

Mantenha seu domínio em uma versão atual do software de serviço e tire uma foto antes de cada atualização. Se você usa painéis para monitorar a produção, considere o centralizadoUsando a OpenSearch interface do usuário no Amazon OpenSearch Service, que não está vinculado à migração do índice de OpenSearch painéis por domínio de um único domínio.

Falha ao carregar painéis com uma mensagem allow_explicit_index

Sintomas

Os painéis não são carregados e exibem uma mensagem semelhante à seguinte:

Kibana must be able to specify the index within Elasticsearch multi-requests (rest.action.multi.allow_explicit_index=true).
Causa raiz

A opção de cluster rest.action.multi.allow_explicit_index avançado está definida comofalse. Defina essa opção para true que os painéis possam realizar suas operações em massa, mget e msearch.

Como mitigar

rest.action.multi.allow_explicit_indexVolte para true as opções avançadas do domínio. Essa é uma alteração no plano de gerenciamento que você faz com suas próprias AWS credenciais, seja no console (abra o domínio, escolha Editar e atualize as configurações avançadas do cluster) ou com a Interface de Linha de AWS Comando (CLI):AWS

aws opensearch update-domain-config \ --domain-name my-domain \ --advanced-options rest.action.multi.allow_explicit_index=true

A alteração de uma opção avançada aciona uma blue/green implantação, portanto, a alteração leva alguns minutos para ser aplicada. Para obter mais informações sobre configurações avançadas de cluster, consulteConfigurações avançadas do cluster.

Ação sugerida

Não rest.action.multi.allow_explicit_index defina como, a false menos que você pretenda restringir o acesso ao índice por meio de políticas baseadas em recursos. Deixá-lo como padrão (true) mantém os painéis operacionais.

Os painéis ficam sem memória

Sintomas

Os painéis são reiniciados, falham ou param de responder quando carregados, especialmente ao abrir painéis grandes ou carregar muitos objetos salvos.

Causa raiz

O processo de painéis esgotou a memória disponível, geralmente devido ao carregamento de muitos objetos salvos ou à renderização de painéis pesados.

Como mitigar
  1. Instale a atualização mais recente do software de serviço. As versões atuais dimensionam a pilha de painéis dinamicamente e removem o antigo limite fixo de tamanho.

  2. Se você aumentou savedObjects:listingLimit (padrão1000) nas Configurações avançadas, reduza. Valores grandes, como10000, causaram erros de falta de memória.

  3. Reduza a complexidade do painel, o número de painéis e a frequência de atualização automática.

  4. Se o uso de memória for cronicamente alto, escale para um tipo de instância com mais memória. Para obter mais informações sobre o dimensionamento de domínios, consulte. Dimensionamento de domínios do Amazon OpenSearch Service

Ação sugerida

Para detectar isso antes que os painéis fiquem sem memória, observe a OpenSearchDashboardsHeapUtilization CloudWatch métrica; se ela exceder consistentemente 80%, escale para um tipo de instância maior. Right-size digite sua instância para usar seus painéis, mantenha os painéis enxutos e evite aumentar savedObjects:listingLimit além do que você precisa.

As solicitações falham devido ao tamanho da carga

Sintomas

Algumas páginas de painéis não são carregadas porque a carga útil da solicitação excede o limite de carga útil dos painéis (server.maxPayloadBytes, cujo padrão é 1 MB/1.048.576 bytes).

Causa raiz

Os padrões de índice que correspondem a um número muito grande de índices ou campos produzem solicitações maiores que o limite de carga útil.

Como mitigar
  1. Reduza o tamanho da solicitação em vez de aumentar o limite:

    • Reduza o número de índices em seus padrões de índice.

    • Reduza o número de campos.

    • Reduza o tamanho do nome do campo.

  2. Entre em contato com o AWS Support para solicitar a opção suportada em nível de conta que mantém um server.maxPayloadBytes valor maior para sobreviver às blue/green implantações e substituições de nós. Essa opção está disponível em todas as versões compatíveis do Amazon OpenSearch Service.

nota

Não tente aumentar esse limite editando você mesmo a configuração dos painéis nos nós. Node-level as mudanças não são persistentes. Qualquer blue/green implantação ou substituição de nós os remove. Em vez disso, use a opção em nível de conta por meio do AWS Support.

Ação sugerida

Mantenha os padrões de índice dentro do escopo dos índices e campos que você realmente usa para que as solicitações permaneçam dentro do limite de carga útil.

Os painéis não estão disponíveis durante a atualização de uma versão

Sintomas

Os painéis não estão disponíveis durante a maior parte da implantação de um upgrade de versão blue/green do mecanismo. Esse é um comportamento esperado, não uma falha, e se resolve sozinho quando a atualização é concluída.

Causa raiz

Os painéis permanecem off-line durante a maior parte da atualização da versão para evitar condições de disputa de verificação de versão entre o ambiente antigo e o novo.

Como mitigar

Aguarde a conclusão da atualização; os painéis ficam disponíveis novamente automaticamente. Trate as atualizações de versão como uma janela de manutenção planejada dos painéis e agende-as fora do horário comercial crítico. Para obter mais informações sobre alterações na configuração, consulteFazendo alterações de configuração no Amazon OpenSearch Service.

Ação sugerida

Agende atualizações durante janelas de baixo tráfego. Se você precisar de uma disponibilidade de painéis que não esteja vinculada à janela de atualização de um único domínio, considere a centralizaçãoUsando a OpenSearch interface do usuário no Amazon OpenSearch Service.

Uma atualização da versão do mecanismo falha na verificação de pré-atualização com um índice incompatível

Sintomas

Você inicia uma atualização da versão do mecanismo (ou executa a verificação de elegibilidade da atualização) e ela falha na verificação de pré-atualização, antes do início de qualquer atualização. A notificação de validação lista um ou mais índices incompatíveis e pode nomear especificamente o índice dos OpenSearch painéis. Isso normalmente acontece quando você atualiza para a versão OpenSearch 3.x enquanto o domínio ainda tem índices criados no OpenSearch 1.3, no Elasticsearch 7.10 ou em versões anteriores, incluindo o índice Dashboards. OpenSearch (As atualizações da versão OpenSearch 1.3 ou 2.x devem ir primeiro para a OpenSearch versão 2.19 e depois para a OpenSearch 3.x.)

Causa raiz

OpenSearch só pode ler índices da versão principal imediatamente anterior, portanto, a OpenSearch 3.x não é compatível com índices criados na versão OpenSearch 1.3, no Elasticsearch 7.10 ou em versões anteriores. A verificação de pré-atualização bloqueia a atualização e lista esses índices propositalmente, para que você não perca nenhum dado. Você deve reindexar ou remover índices antigos antes de uma atualização de versão principal; o serviço não os reindexa automaticamente. O índice do OpenSearch Dashboards segue a mesma regra.

Como mitigar
  1. Execute a verificação de elegibilidade do upgrade para ver a lista completa de índices incompatíveis (a mesma lista está na notificação de falha no upgrade). Para obter mais informações sobre a atualização de domínios, consulte. Atualizando domínios do Amazon OpenSearch Service

  2. Faça um instantâneo manual antes de fazer alterações. Para obter mais informações sobre como tirar instantâneos, consulteCriação de instantâneos de índice no Amazon Service OpenSearch.

  3. Para cada índice de dados incompatível, reindexe-o em um novo índice (criado na versão atual) e exclua o antigo. Para UltraWarm índices frios, mova-os primeiro para o armazenamento ativo, reindexe e, em seguida, mova-os de volta.

    POST _reindex { "source": { "index": "my-old-index" }, "dest": { "index": "my-new-index" } }
  4. Para o índice de OpenSearch painéis, faça backup primeiro porque ele contém seus padrões de índice, visualizações e painéis: em Painéis, acesse Gerenciamento de painéis, Objetos salvos e exporte-os. Em seguida, exclua o índice incompatível. Um índice novo e compatível é criado automaticamente após a atualização; reimporte seus objetos salvos posteriormente. Se você preferir não excluí-lo, entre em contato com o AWS Support.

  5. Exclua qualquer índice incompatível que você não precise mais em vez de reindexá-lo.

  6. Re-run verifique a elegibilidade e acione novamente o upgrade depois que ele for aprovado.

Ação sugerida

Reindexe ou remova índices antigos para que eles não abranjam mais de uma versão principal; índices deixados em várias atualizações acabarão por bloquear uma. Faça um instantâneo manual antes de cada atualização e exporte os objetos salvos OpenSearch do seu painel periodicamente como backup.

Os painéis não carregam corretamente, mostram uma página em branco ou geram relatórios em branco

Sintomas

Um único usuário ou navegador vê uma página em branco, relatórios em branco ou um banner vermelho que dizOpenSearch Dashboards did not load properly. Check the server output for more information., enquanto outros usuários não são afetados. Confirme reproduzindo em uma janela privada (anônima) ou em um navegador diferente.

Causa raiz

Um cache de navegador obsoleto causa esse problema, especialmente após uma atualização do software de serviço ou quando você usa o recurso de relatórios.

Como mitigar
  1. Limpe o cache e os cookies do navegador e recarregue a página. Experimente uma janela privada (anônima) e um navegador compatível e atualizado.

  2. Desative bloqueadores de anúncios ou extensões de navegador para o URL dos painéis.

  3. Se o banner persistir para todos os usuários (não apenas para um navegador), instale a atualização mais recente do software de serviço e entre em contato com o AWS Support se o problema persistir.

Ação sugerida

Limpe o cache do navegador após uma atualização do software do serviço e use um navegador compatível e atualizado.

Configurações não suportadas

Evite essas configurações, que são fontes comuns de problemas nos painéis:

  • Proxies reversos (por exemplo, nginx) na frente dos painéis são suportados somente para controle de acesso, conforme descrito em. Usando um proxy para acessar o OpenSearch serviço a partir de painéis Se você executar o Dashboards por meio de um software proxy de terceiros e encontrar um erro inesperado, reproduza o problema sem o proxy antes de entrar em contato com o Support AWS .

  • As edições manuais nos arquivos de configuração do nó não são persistentes. Qualquer blue/green implantação ou substituição de nó os reverte. Use configurações e opções suportadas em vez de edições em nível de nó. Você não pode usar o SSH para acessar nós ou modificar diretamente os arquivos de configuração.

Como os painéis dependem de um cluster íntegro e da configuração de acesso do seu domínio, os tópicos de solução de problemas a seguir geralmente se aplicam quando os painéis não estão disponíveis. Para tudo isso, vejaSolução de problemas do Amazon OpenSearch Service.

  • Não consigo acessar os OpenSearch painéis: política de acesso e autenticação do Amazon Cognito, incluindo User: anonymous is not authorized to perform: es:ESHttpGet os tempos limite de erro VPC-access e solicitação.

  • Status do cluster vermelho e status do cluster amarelo: fragmentos não atribuídos impedem que os painéis leiam ou gravem seu OpenSearch índice de painéis.

  • ClusterBlockException: pouco espaço de armazenamento ou alta pressão de memória JVM bloqueia gravações, incluindo gravações no índice OpenSearch Dashboards.

  • JVM OutOfMemoryError e limitação de solicitações: superfícies de sobrecarga do cluster como erros e respostas dos painéis. 429 Too Many Requests