Com o Proxmox trazendo dezenas de recursos de nível empresarial, há muito que você pode fazer para melhorar os recursos do seu servidor doméstico depois de mergulhar totalmente nas regras de virtualização. Mas, além de suas vantagens de qualidade de vida, o Proxmox VE também possui alguns recursos avançados que, embora ofereçam benefícios interessantes, podem criar grandes peculiaridades que os tornam ideais para o laboratório doméstico médio.
Clusters de alta disponibilidade são um desses recursos, e muitas vezes vejo mestres veteranos recomendando replicação ZFS/armazenamento com tecnologia Ceph para recém-chegados. Mas o problema é o seguinte: um cluster de HA mal implementado pode facilmente atrapalhar sua configuração e esgotar sua carteira se você mergulhar na toca do coelho despreparado.
No papel, a alta disponibilidade para laboratórios domésticos é extremamente importante
Especialmente se você gosta de trabalhar em tantos experimentos quanto eu
Antes que você me julgue por exagerar na alta disponibilidade para laboratórios domésticos, deixe-me acrescentar que estou plenamente consciente de sua utilidade. Na verdade, como alguém que ainda possui um cluster de replicação ZFS de 2 nós + Raspberry Pi QDevice, estou pronto para usá-los em ambientes de produção e configurações rigorosas de laboratório doméstico.
Afinal, ser capaz de manter suas VMs e contêineres Linux em funcionamento quando um experimento malsucedido derruba um nó é uma vantagem pura dos clusters de alta disponibilidade. Caramba, se você estiver usando ferramentas FOSS para toda a sua casa, o failover automático pode migrar seus serviços críticos para sistemas de backup para que você possa trabalhar na correção do sistema defeituoso em seu próprio ritmo. Com a atualização mais recente do Proxmox, que adiciona suporte completo para um balanceador de carga dinâmico, seu ambiente de alta disponibilidade pode até mesmo se reequilibrar automaticamente quando um nó voltar a ficar online, em vez de forçá-lo a mover manualmente LXCs e VMs para evitar o uso excessivo de nós secundários.
Sem mencionar que as regras de armazenamento distribuído do Proxmox garantem que seus convidados virtuais não sejam perdidos, mesmo que um dos sistemas em que estão executando fique offline. Implantei meu cluster de HA apenas para poder obter experiência prática com ele em projetos DevOps, e ele funciona muito bem para essa tarefa, especialmente quando o combino com nomes como Ansible, Terraform e Semaphore.
Mas agora que mencionei tudo isso, também quero deixar claro que por trás de seus recursos revolucionários estão muitos problemas para os quais você deve estar preparado antes de começar a agrupar seus nós e configurar regras de armazenamento distribuído.
As configurações de HA não são apenas diversão e jogos
Mesmo um simples conjunto de replicação ZFS pode ser um pouco difícil de manter
Como qualquer carregador impressionante, fui imediatamente atraído pelos conjuntos de HA alguns anos atrás, quando vi postagens no Reddit apresentando configurações massivas de PVE. Mas o que eu não percebi foi o enorme custo de tal configuração. Por exemplo, os clusters distribuídos do Ceph exigem pelo menos três ou mais nós (se você tiver um número ímpar dessas estações de trabalho), e qualquer quantidade menor poderá causar problemas no longo prazo.
Mesmo que um cluster Ceph típico de 3 nós possa lidar com um nó com falha, você precisa garantir que os contêineres e VMs que deseja executar 24 horas por dia, 7 dias por semana, possam ter suporte em suas estações de trabalho secundárias, ou você acabará com sistemas dolorosamente lentos. O Ceph também requer velocidades de rede mais altas e você precisará de pelo menos 2,5 G para evitar lentidão durante as operações de sincronização (e migração). Dados os preços estagnados do hardware no momento, não posso recomendar ao profissional médio de laboratório doméstico que compre os suprimentos para esta configuração.
A replicação ZFS é um pouco mais fraca porque você pode usar a solução QDevice para criar um cluster de alta disponibilidade se não tiver sistemas suficientes para atender ao requisito de 3 nós. Mas a maior ressalva da replicação ZFS é que você precisará agendar cuidadosamente suas tarefas de snapshot. Se eles estiverem muito distantes, você poderá perder dados. Mas se você configurá-los com muita frequência, eles poderão consumir a largura de banda da sua rede.
A solução de problemas de ambas as configurações também é um problema real e, se você quiser desmontar seu cluster, precisará executar vários comandos para desconectar os nós. Isso antes de incluir na equação os custos de energia para operar todos esses sistemas 24 horas por dia.
Nós PVE individuais + pipelines do servidor de backup Proxmox 3-2-1 são significativamente melhores
Dividir convidados virtuais entre nós primários e experimentais é uma boa opção para a maioria dos trapaceiros
Em termos de tempo de atividade máximo para convidados virtuais, eu sempre recomendaria uma configuração dupla (ou múltipla, se você tiver hardware suficiente), onde os respectivos sistemas permaneceriam separados. Deixando de lado o conjunto de replicação ZFS que configurei em sistemas antigos apenas para meus experimentos de DevOps, dividi minhas cargas de trabalho Proxmox em dois grupos: os contêineres mais importantes são executados em meu sistema integrado i5-1235U, enquanto meu antigo PC para jogos lida com VMs pesadas.
Todo o resto, seja uma distribuição Linux peculiar com recursos exclusivos, meu arsenal não essencial de contêineres ou um aplicativo divertido que encontrei durante minhas sessões de rolagem do apocalipse no GitHub, permanece na minha estação de trabalho experimental Xeon. Dessa forma, se eu acidentalmente quebrar este sistema, posso ficar tranquilo sabendo que minha pilha de rede, VMs de desenvolvedor, hub Home Assistant e outros servidores de missão crítica continuarão funcionando nos outros dois dispositivos.
Para adicionar uma camada extra de segurança a esta configuração, configurei um fluxo de trabalho do Proxmox Backup Server onde minhas máquinas PVE enviam instantâneos de quase todos os convidados virtuais para uma instância local do PBS, que por sua vez é puxada por uma instância externa do PBS localizada em um local relativo. Finalmente, se eu encontrar um convidado virtual particularmente útil durante a experimentação, simplesmente uso uma instância virtualizada do Proxmox Datacenter Manager para movê-lo da minha máquina Xeon para um dos meus nós PVE “seguros”.
Esteja ciente dos riscos antes de avançar a todo vapor no caminho do cluster HA
Mais uma vez, deixe-me deixar claro que adoro as disposições integradas de alta disponibilidade do Proxmox e não vejo nada de errado em usá-lo em um ambiente complexo ou em qualquer coisa relacionada a pipelines de produção. Em vez disso, o que eu realmente quero dizer é que você não deve mergulhar na configuração do HA logo no início do seu laboratório doméstico.
Certamente é muito divertido de usar, mas toda a emoção se transforma em horror quando a condição de quorum do cluster cuidadosamente elaborada é perdida e você acaba com uma interface de usuário da Web somente leitura com convidados virtuais inacessíveis. Se você está se perguntando, sim, estou falando por experiência própria.








