Análise de configuração para ambientes de banco de dados no Workload Factory
O Workload Factory for Databases analisa regularmente as configurações de banco de dados para determinar se há algum problema com as implementações do Microsoft SQL Server e do Oracle no armazenamento Amazon FSx for NetApp ONTAP. Quando problemas são encontrados, o Workload Factory mostra quais são os problemas e explica o que precisa ser alterado para que suas configurações de banco de dados alcancem o máximo desempenho, eficiência de custos e conformidade com as melhores práticas.
O Workload Factory fornece as melhores práticas e recomendações para cargas de trabalho de banco de dados bem arquitetadas. A análise bem arquitetada avalia as configurações e definições do Microsoft SQL Server e do Oracle Database relacionadas a armazenamento, computação, aplicação, resiliência e clonagem.
Como funciona
O Workload Factory analisa diariamente suas cargas de trabalho em execução em implantações de sistemas de arquivos Amazon FSx for NetApp ONTAP. A análise fornece status bem arquitetado, insights e recomendações.
Após a conclusão da análise diária, as configurações aparecem como "otimizadas" ou "não otimizadas" no painel Well-architected da implantação. Você encontrará a pontuação total de otimização, problemas de configuração por categoria e uma lista de problemas de configuração e recomendações. Você pode revisar as recomendações para problemas de configuração. Alguns problemas podem ser corrigidos automaticamente pelo Workload Factory, enquanto outros exigem intervenção manual. Nesse caso, o Workload Factory fornece instruções detalhadas para ajudar você a implementar as alterações recomendadas.
Você pode descartar a análise de configurações que não se aplicam aos seus ambientes. Isso evita alertas desnecessários e resultados de otimização imprecisos.
Você também pode criar regras personalizadas em linguagem simples para validar seus ambientes em relação aos padrões da sua organização e às melhores práticas da NetApp. Teste as regras com uma simulação e, em seguida, agende a execução delas em todos os seus ambientes. "Saiba mais sobre regras personalizadas".
Por que isso importa
O Workload Factory aplica as melhores práticas a grandes ambientes de armazenamento, banco de dados e VMware, combinando avaliação contínua com insights de recomendações e remediação. As correções automatizadas aplicadas no console do Workload Factory reduzem erros humanos, garantem gerenciamento uniforme e preservam o desempenho e a confiabilidade em toda a sua infraestrutura de cargas de trabalho.
Opções para analisar seu ambiente de banco de dados
O Workload Factory oferece as seguintes opções para analisar seu ambiente de banco de dados:
-
Avaliação única: Execute uma "avaliação única"avaliação para descobrir o status de arquitetura adequada de suas instâncias do Microsoft SQL Server ou bancos de dados Oracle sem armazenar credenciais ou registrar recursos.
Para a avaliação única, você só precisa fornecer as credenciais uma vez para as instâncias do Microsoft SQL Server ou bancos de dados Oracle que deseja analisar.
-
avaliação contínua: O Workload Factory analisa regularmente o seu ambiente de banco de dados, fornece recomendações contínuas para otimizar suas configurações e corrige problemas automaticamente.
Para avaliação contínua, você precisa registrar seus recursos, associar um link e conceder permissões em sua conta AWS.
Melhores práticas do Microsoft SQL Server
As seguintes práticas recomendadas e recomendações aplicam-se às cargas de trabalho do Microsoft SQL Server.
Storage
Utilize a camada SSD primária para cargas de trabalho SQL sensíveis ao desempenho.
Details
Use a camada SSD primária para volumes FSx for ONTAP para desempenho ideal. A camada de pool de capacidade pode reduzir o desempenho e aumentar a latência. A camada SSD primária foi projetada para cargas de trabalho de alto desempenho, enquanto a camada de pool de capacidade é otimizada para eficiência de custos e pode não atender aos requisitos de desempenho das cargas de trabalho do SQL Server.
Mantenha uma quantidade suficiente de espaço livre acima do tamanho total do volume.
Details
Mantenha capacidade suficiente no sistema de arquivos acima do tamanho total do seu volume. Pouco espaço livre causa problemas de desempenho; espaço livre em excesso desperdiça armazenamento e aumenta os custos.
Dimensione e monitore os discos de log para evitar reversões e interrupções.
Details
Dimensione e monitore seu disco de logs do SQL Server para evitar reversões de transações, indisponibilidade do banco de dados, corrupção de dados e problemas de desempenho causados por um disco de logs cheio.
Dimensione o TempDB para evitar gargalos e timeouts.
Details
Dimensione e monitore o TempDB para manter o desempenho e a estabilidade. Pouco espaço no TempDB pode causar lentidão nas consultas, timeouts de aplicativos e falhas do sistema.
Separe `.mdf`e `.ldf`caminhos.
Details
Separe os arquivos de dados e de log em unidades diferentes para melhorar a E/S paralela, a flexibilidade de backup e o comportamento de restauração. Recomendamos separar os caminhos LUN de dados e de log em volumes diferentes para bancos de dados menores.
Use uma unidade dedicada.
Details
Instale o TempDB em uma unidade dedicada para evitar conflitos de E/S e melhorar o desempenho e a estabilidade do SQL Server.
Aloque armazenamento conforme necessário.
Details
Configure thin provisioning para volumes FSx for ONTAP para aproveitar melhor o armazenamento e reduzir custos. O thin provisioning permite que você aloque armazenamento conforme necessário, em vez de reservar toda a capacidade de uma só vez.
Aumente os volumes automaticamente.
Details
Ative o dimensionamento automático e configure o modo para grow que os volumes aumentem automaticamente antes de ficarem cheios e somente leitura.
Configure as configurações de espaço do dispositivo de bloco para LUNs usadas pelo SQL Server.
Details
Configure as configurações de espaço do dispositivo de bloco para LUNs usadas por instâncias do Microsoft SQL Server para evitar falhas de gravação e melhorar a eficiência do espaço no FSx for ONTAP.
Mantenha espaço para dados ativos.
Details
Defina a reserva de cópia Snapshot para 0% e ative a exclusão automática de cópia Snapshot para proteger o espaço para os dados ativos.
Expanda o volume antes de excluir as cópias Snapshot.
Details
Quando o espaço estiver acabando, expanda o volume antes de excluir as cópias Snapshot. Expandir o volume evita erros de "volume cheio", reduz falhas de gravação e preserva os pontos de recuperação de cópia Snapshot.
Coloque os dados de cópia Snapshot em camadas usando a política de hierarquização somente de cópias Snapshot.
Details
Utilize a política de tiering somente para cópias Snapshot, que move apenas os dados de cópia Snapshot para a camada de capacidade, mantendo os dados ativos na camada SSD. Essa abordagem preserva o desempenho de baixa latência para cargas de trabalho SQL, enquanto reduz os custos de armazenamento. Faça o tiering dos dados de cópia Snapshot após um período de resfriamento de 7 dias.
Utilize desduplicação, compressão e compactação.
Details
Habilite a deduplicação, a compressão e a compactação para reduzir o uso de armazenamento e o custo, mantendo o desempenho.
Associe o tipo de sistema operacional do LUN ONTAP ao particionamento do host.
Details
Associe o valor do sistema operacional LUN do ONTAP ao esquema de particionamento do host para manter o alinhamento correto de E/S.
Configure a política, as sessões, o status e as configurações de tempo limite de Multipath I/O (MPIO).
Details
Configure o Multipath I/O (MPIO) para resiliência e taxa de transferência. Use cinco sessões MPIO por interface de destino para Microsoft SQL Server em LUNs iSCSI, monitore o status do caminho e defina o tempo limite do host para 60 segundos.
Configurado para 64K.
Details
Defina o tamanho da unidade de alocação NTFS para 64 KB para melhorar a eficiência do disco e reduzir a fragmentação em cargas de trabalho do SQL Server.
Desative os snapshots agendados.
Details
Desative os snapshots agendados para volumes FSx for ONTAP usados pelo Microsoft SQL Server. Em vez disso, gerencie os snapshots externamente usando ferramentas como NetApp SnapCenter, que criam backups consistentes com o aplicativo e ajudam a evitar corrupção de dados durante as operações de restauração.
Computação
Ajuste o tamanho da instância EC2 à demanda da carga de trabalho.
Details
Ajuste o tamanho da sua instância EC2 do SQL Server de acordo com a demanda da carga de trabalho. Aumente o tamanho quando estiver subdimensionado e reduza o tamanho quando estiver superdimensionado para equilibrar custo e desempenho.
Aplique os patches atuais do sistema operacional.
Details
Aplique os patches mais recentes do sistema operacional para melhorar a segurança e a confiabilidade.
Configure o Receive Side Scaling (RSS).
Details
Configure o Receive Side Scaling (RSS) para distribuir o processamento de rede entre as CPUs e melhorar o desempenho da rede. Valide as configurações antes da implantação.
Alinhe a Unidade Máxima de Transmissão (MTU) entre os caminhos do host e do armazenamento.
Details
Alinhe as configurações de Unidade Máxima de Transmissão (MTU) do EC2 com os caminhos do FSx for ONTAP para evitar fragmentação e manter uma taxa de transferência estável.
Aplicativo
Analise o uso da licença para recursos pagos.
Details
Analise o uso da licença do SQL Server no nível do host. Se os recursos pagos não estiverem em uso, a licença não estará otimizada e pode aumentar o custo.
Aplique os patches mais recentes do SQL Server.
Details
Aplique os patches mais recentes do SQL Server para melhorar a segurança e a confiabilidade do sistema.
Utilize valores testados sob carga de trabalho.
Details
Configure o MAXDOP para otimizar o desempenho das consultas. Valores de 4, 8 ou 16 geralmente funcionam bem. Teste sua carga de trabalho e monitore os tipos de espera de paralelismo, como CXPACKET.
Resiliência
Use snapshots consistentes de aplicativos com o NetApp SnapCenter.
Details
Use snapshots consistentes de aplicativos com o NetApp SnapCenter para tirar snapshots precisos e confiáveis dos seus dados de volume em um momento específico. SnapCenter facilita os backups e ajuda você a restaurar dados rapidamente, reduzindo o tempo de inatividade e protegendo cargas de trabalho críticas.
Proteja contra interrupções regionais.
Details
Habilite a replicação entre regiões (CRR) para melhorar a disponibilidade de dados e a recuperação de desastres em seu ambiente SQL Server. A CRR ajuda a proteger contra interrupções regionais e garante a continuidade dos negócios ao replicar dados em diferentes locais.
Configure o FSx for ONTAP backups ou AWS Backup.
Details
Configure o FSx for ONTAP backups ou o AWS Backup para atender aos requisitos de retenção e conformidade, evitando fluxos de trabalho de backup duplicados.
Configure o quorum para instâncias de cluster de failover.
Details
Configure o quorum corretamente para as instâncias de failover cluster do SQL Server para que o cluster possa tolerar falhas de nós esperadas.
Mantenha as letras das unidades consistentes em todos os nós.
Details
Use as mesmas letras de unidade em todos os nós da sua configuração de alta disponibilidade do SQL Server. Isso facilita o gerenciamento e ajuda o failover a funcionar corretamente.
Ajuste o heartbeat para um comportamento de failover estável.
Details
Ajuste as configurações de heartbeat para evitar failovers desnecessários, enquanto ainda detecta falhas reais rapidamente.
Certifique-se de que ambos os nós possam acessar os LUNs iSCSI compartilhados.
Details
Todos os discos compartilhados (iSCSI LUNs) devem ser acessíveis a partir de ambos os nós no modelo de implementação FCI para que o failover funcione.
Valide a conta de serviço e as dependências de inicialização.
Details
Valide as permissões da conta de serviço, o tipo de inicialização e as dependências para garantir um comportamento confiável de alta disponibilidade.
Clonagem
Remova clones antigos regularmente.
Details
Remova regularmente clones obsoletos para reduzir o custo de storage e a complexidade operacional. Clones antigos e não utilizados geram custos elevados.
Melhores práticas da Oracle
As seguintes boas práticas e recomendações aplicam-se às cargas de trabalho do Oracle.
Storage
Mantenha uma quantidade suficiente de espaço livre acima do tamanho total do volume.
Details
Mantenha capacidade suficiente no sistema de arquivos acima do tamanho total do seu volume. Pouco espaço livre causa problemas de desempenho; espaço livre em excesso desperdiça armazenamento e aumenta os custos.
Aloque armazenamento conforme necessário.
Details
Configure thin provisioning para volumes FSx for ONTAP para aproveitar melhor o armazenamento e reduzir custos. O thin provisioning permite que você aloque armazenamento conforme necessário, em vez de reservar toda a capacidade de uma só vez.
Aumente os volumes automaticamente.
Details
Ative o dimensionamento automático e defina o modo para grow que os volumes aumentem automaticamente antes de ficarem cheios e somente leitura.
Configure as configurações de espaço do dispositivo de bloco para LUNs usadas pelo SQL Server.
Details
Configure as configurações de espaço do dispositivo de bloco para LUNs usados por bancos de dados Oracle para evitar falhas de gravação e melhorar a eficiência de espaço no FSx para ONTAP.
Mantenha espaço para dados ativos.
Details
Defina a reserva de cópia Snapshot para 0% e ative a exclusão automática de cópia Snapshot para proteger o espaço para os dados ativos.
Expanda o volume antes de excluir as cópias Snapshot.
Details
Quando o espaço estiver acabando, expanda o volume antes de excluir as cópias Snapshot. Expandir o volume evita erros de "volume cheio", reduz falhas de gravação e preserva os pontos de recuperação de cópia Snapshot.
Coloque os dados de cópia Snapshot em camadas usando a política de hierarquização somente de cópias Snapshot.
Details
Utilize a política de tiering somente para cópias Snapshot, que move apenas os dados de cópia Snapshot para a camada de capacidade, mantendo os dados ativos na camada SSD. Essa abordagem preserva o desempenho de baixa latência para cargas de trabalho SQL, enquanto reduz os custos de armazenamento. Faça o tiering dos dados de cópia Snapshot após um período de resfriamento de 7 dias.
Utilize desduplicação, compressão e compactação.
Details
Habilite a deduplicação, a compressão e a compactação para reduzir o uso de armazenamento e o custo, mantendo o desempenho.
Defina a troca de memória com base na RAM.
Details
Configure o espaço de troca (swap) com base na quantidade de RAM para que o sistema possa lidar com a pressão na memória e evitar lentidão ou travamentos.
Utilize um volume dedicado para cada tipo de arquivo Oracle para isolar padrões de E/S e melhorar o desempenho.
Details
Armazene logs de arquivamento, arquivos de dados, arquivos de controle, logs de refazer e arquivos temporários em unidades separadas para isolar padrões de E/S e melhorar a resiliência. Mantenha cópias redundantes em volumes separados onde necessário.
Utilize um volume dedicado.
Details
Coloque os binários do Oracle em um volume dedicado para reduzir a disputa de E/S. Essa separação simplifica as atualizações de software e minimiza o risco de modificações acidentais ou corrupção.
Desative os snapshots locais agendados.
Details
Desative os snapshots agendados para volumes FSx for ONTAP usados pela Oracle para economizar espaço e reduzir custos. Em vez disso, gerencie os snapshots externamente usando ferramentas como NetApp SnapCenter, que criam backups consistentes com o aplicativo e ajudam a evitar corrupção de dados durante as operações de restauração.
Desative para dNFS.
Details
Desative o parâmetro ONTAP nfs-rootonly para dNFS. nfs-rootonly Restringe as conexões NFS a portas privilegiadas (<1024). Como os processos dNFS no NFSv4+ não são executados como root e usam portas mais altas, desativar esse parâmetro permite as conexões necessárias.
Inclua permissões de superusuário e setuid na política de exportação dedicada para binários Oracle.
Details
Certifique-se de que, se os binários do Oracle estiverem localizados em um compartilhamento NFS, a política de exportação inclua permissões de superusuário e setuid. O acesso de superusuário (root) permite que os clientes NFS sejam mapeados como root, o que é necessário para a execução dos binários.
Configure o Oracle Automatic Storage Management (ASM) para storage baseado em iSCSI em execução no FSx para ONTAP.
Details
Utilize o Oracle Automatic Storage Management (ASM) para armazenamento baseado em iSCSI executado no FSx for ONTAP para otimizar o desempenho, simplificar o gerenciamento de storage e aumentar a escalabilidade para as implementações do Oracle Database.
-
LUNs do grupo de discos de dados ASM, grupo de discos de logs ASM, grupo de discos FRA ASM e grupo de discos de arquivamento ASM
Distribua LUNs entre os recursos do grupo de discos do Automatic Storage Management (ASM).
Details
Distribua os LUNs entre os grupos de discos de dados, redo log e archive log do Automatic Storage Management (ASM) para desempenho e redundância ideais.
-
redundância externa do ASM
Configure grupos de discos Oracle ASM com redundância EXTERNAL.
Details
Configure grupos de discos Oracle ASM com redundância EXTERNAL para LUNs iSCSI do FSx for ONTAP para aproveitar a alta disponibilidade incorporada do FSx for ONTAP, otimizar a eficiência de storage e reduzir custos evitando o espelhamento de dados no nível do Oracle.
-
Alinhamento do tamanho do bloco lógico do driver de filtro ASM e da ASMLib
Configure o Oracle ASM Filter Driver (AFD) e a ASMLib para usar o tamanho de bloco lógico do storage FSx for ONTAP subjacente.
Details
Configure o Oracle ASM Filter Driver (AFD) e o ASMLib no arquivo de configuração do ASMLib para usar o tamanho de bloco lógico do armazenamento FSx for ONTAP subjacente. Isso garante que o AFD e o ASMLib alinhem as operações de E/S com o tamanho de bloco do storage, otimizando o desempenho ao minimizar a latência e reduzir a sobrecarga de E/S desnecessária.
Defina como 128 para cargas de trabalho Oracle baseadas em NFS.
Details
Configure os parâmetros do kernel para a tabela de slots TCP com o valor 128 para cargas de trabalho do Oracle executadas em NFS. Essa configuração permite mais operações de E/S simultâneas, reduzindo a latência em cenários de alta taxa de transferência, como o acesso a arquivos de dados do Oracle. Os parâmetros do kernel controlam o número máximo de solicitações NFS pendentes via TCP, funcionando como a profundidade da fila em configurações Fibre Channel. Os valores padrão do Linux, normalmente definidos como 16, não oferecem desempenho ideal para o banco de dados.
Utilize opções de montagem NFS que otimizem o desempenho para arquivos de banco de dados.
Details
Use opções de montagem NFS otimizadas para arquivos de banco de dados. Os principais parâmetros incluem rw para acesso de leitura/gravação, bg para montagem em segundo plano, hard para tentativas indefinidas em caso de falhas e proto=tcp para entrega confiável. Os valores rsize e wsize de 262144 melhoram operações de E/S de grande porte, aumentando a taxa de transferência, enquanto nointr não interrompe tarefas de longa duração. Essa configuração aprimora o desempenho e a resiliência do banco de dados, principalmente em ambientes de alta taxa de transferência.
Use opções de montagem NFS que otimizem o desempenho para o diretório base ADR.
Details
Use opções de montagem NFS otimizadas para o diretório base ou diretório raiz do Repositório de Diagnóstico Automático (ADR). O diretório base do ADR armazena logs e rastreamentos, que se beneficiam de opções de confiabilidade semelhantes às dos arquivos principais do banco de dados, mas não exigem a opção de montagem nointr, pois as operações são menos sensíveis a interrupções.
Faça a correspondência dos nomes de domínio NFSv4 entre o host e o servidor NFS.
Details
Corresponda os nomes de domínio NFSv4 entre o host (/etc/idmapd.conf ou hostname -d) e o servidor NFS (v4-id-domain no ONTAP).
Não desative o armazenamento em cache do host em implantações independentes.
Details
Omitir as opções de montagem NFS que desativam o armazenamento em cache do host—como, actimeo=0 e noac—em implantações Oracle independentes para melhorar a eficiência e a confiabilidade. Essas opções se aplicam a ambientes clusterizados para garantir a consistência do cache, mas em ambientes de instância única, elas ignoram o armazenamento em cache e podem reduzir significativamente o desempenho.
Ative dNFS.
Details
Habilite o Direct NFS (dNFS) em seu ambiente Oracle para melhorar o desempenho e a confiabilidade do armazenamento NFS.
Evite a resolução de nomes por round-robin.
Details
Evite o uso de Direct NFS (dNFS) com qualquer tipo de resolução de nomes round-robin, incluindo DNS, DDNS, NIS ou qualquer outro método. Isso inclui o recurso de balanceamento de carga de DNS disponível no ONTAP. A resolução consistente de endereço IP mantém a estabilidade do banco de dados e previne possíveis falhas ou corrupção de dados.
Validar `oranfstab`conteúdo.
Details
Verifique e atualize o conteúdo do arquivo oranfstab para garantir o uso correto do Direct NFS (dNFS). O arquivo oranfstab é essencial para configurar recursos avançados do dNFS, como multipathing e opções específicas do NFS. A configuração correta melhora a eficiência do acesso e do gerenciamento de dados.
Use nosharecache para casos específicos de montagem múltipla.
Details
Configure a opção de montagem nosharecache para ambientes onde Direct NFS (dNFS) está habilitado e um volume de origem é montado mais de uma vez em um único servidor com montagens NFS aninhadas. Essa configuração impede o compartilhamento de armazenamento em cache entre as montagens, garantindo a consistência de dados e o desempenho ideal.
Computação
Aplique os patches atuais.
Details
Aplique os patches mais recentes do sistema operacional para melhorar a segurança e a confiabilidade.
Desative Páginas Grandes Transparentes (THP).
Details
Desative as Transparent Huge Pages (THP) em hosts de banco de dados que executam bancos de dados Oracle para evitar possível degradação de desempenho e melhorar o gerenciamento de memória.
Ative as opções avançadas do Transmission Control Protocol (TCP).
Details
Ative os carimbos de data/hora TCP, SACK e dimensionamento de janela para obter o melhor desempenho e confiabilidade da rede.
Defina filesystemio_options = setall.
Details
Configure filesystemio_options = setall para obter o desempenho ideal de E/S. Ajuste o tamanho da área global do sistema (SGA), se necessário, ao migrar de E/S com buffer.
Remova o db_file_multiblock_read_count parâmetro.
Details
Remova o parâmetro db_file_multiblock_read_count do arquivo de texto FILE init.ora ou do arquivo binário gerenciado pelo servidor SPFILE (spfile<SID>.ora para bancos de dados Oracle para evitar problemas de desempenho e permitir que o Oracle gerencie essa configuração automaticamente.
Aplique as atualizações de CPU mais recentes.
Details
Aplique as atualizações críticas mais recentes da Oracle para corrigir vulnerabilidades de segurança e manter a integridade do seu ambiente de banco de dados. Revise e aplique patches regularmente para se proteger contra possíveis ameaças e garantir a conformidade com as melhores práticas de segurança.
Resiliência
Use snapshots consistentes de aplicativos com o NetApp SnapCenter.
Details
Use snapshots consistentes de aplicativos com o NetApp SnapCenter para tirar snapshots precisos e confiáveis dos seus dados de volume em um momento específico. SnapCenter facilita os backups e ajuda você a restaurar dados rapidamente, reduzindo o tempo de inatividade e protegendo cargas de trabalho críticas.
Proteja contra interrupções regionais.
Details
Habilite a replicação entre regiões (CRR) para melhorar a disponibilidade de dados e a recuperação de desastres para seus bancos de dados Oracle. A CRR ajuda a proteger contra interrupções regionais e garante a continuidade dos negócios ao replicar dados em diferentes locais.
Configure o FSx for ONTAP backups ou AWS Backup.
Details
Configure o FSx for ONTAP backups ou o AWS Backup para atender aos requisitos de retenção e conformidade, evitando fluxos de trabalho de backup duplicados.
Clonagem
Remova clones antigos regularmente.
Details
Remova regularmente clones obsoletos para reduzir o custo de storage e a complexidade operacional. Clones antigos e não utilizados geram custos elevados.
"Implementar configurações de banco de dados bem arquitetadas"