A listagem de GPUs Tesla usadas no mercado de usados é uma das coisas mais atraentes para os profissionais de laboratórios domésticos procurarem. Um cartão VRAM de 24 GB que foi originalmente vendido por mais de US$ 5.000 agora está pairando em torno da marca de US$ 300 no eBay. Para qualquer um que esteja tentando executar LLMs locais ou colocar um grande orçamento de memória em uma caixa Proxmox, é difícil contestar a matemática. Quase puxei o gatilho sozinho, mas comecei a ler tópicos de fóruns daqueles que os possuem. Se essas GPUs fossem realmente um código de trapaça de laboratório doméstico, todos os usariam, mas a situação do driver e os problemas de compatibilidade física são demais para a maioria dos entusiastas, inclusive eu.
Ferramentas baratas de rede empresarial expõem as deficiências de hardware caro para o consumidor
Hardware de rede usado remove quaisquer restrições artificiais em sua rede
O caminho suportado é difícil
O suporte a vGPU foi abandonado, embora você ainda possa obtê-lo
A forma como a NVIDIA planeja usar a placa Tesla é com um vGPU, o que significa dividir a placa em várias máquinas virtuais, e é aí que as coisas começam a acontecer. Começando com a versão 17.0 do driver, a NVIDIA abandonou silenciosamente o suporte vGPU para placas da era Pascal, que inclui o P40 e o P4 menor. Mapas que costumavam ter suporte oficial agora exigem um patch da comunidade Projeto vGPU de PolloLocot que envolve muito mais do que apenas clicar em “instalar”.
O lado central adiciona outra dor de cabeça. O Proxmox 8 vem com kernels mais recentes (6.5, 6.8 e mais recentes, dependendo do ponto de lançamento), mas os drivers host vGPU da NVIDIA estão historicamente atrasados e as versões mais antigas se recusam a compilar de forma limpa em qualquer coisa acima de 6.0 sem intervenção. Há um tópico no fórum Proxmox onde A própria equipe da Proxmox recomendou permanecer no PVE 7.4 se você dependesse de um vGPU, o que não impressiona muito quem quer comprar um.
Depois de superar tudo isso, você se depara com o fato de que o driver vGPU vem com uma licença de avaliação única de 90 dias; O sistema de licenciamento espera então uma assinatura paga de vApps ou vCS, e o cartão para de funcionar no modo vGPU com ou sem fastapi-dls não oficial uma solução que muitas pessoas usam.
Esses slots PCIe vazios no seu servidor não são inúteis. Aqui estão 4 coisas com as quais você pode preenchê-los
Você comprou o servidor inteiro. É melhor usar seus slots PCIe
Mesmo apenas executá-lo geralmente causa problemas
Esta não é uma GPU comum
OK, vGPU é uma grande dor de cabeça, mas por que não colocar a placa inteira em uma máquina virtual e instalar os drivers padrão?
Este é o caminho que a maioria dos laboratórios domésticos segue, e estou começando a descobri-lo também tópicos do fórum cheio de lutas humanas e bugs que exigem parâmetros estranhos do kernel para fazer as coisas funcionarem.
Do ponto de vista físico, essas placas Tesla não têm saídas de exibição. No momento em que quiser usá-lo como GPU principal em qualquer configuração que não seja de servidor, você precisará de uma segunda GPU para controlar a tela. Se você quiser ser psicopata e usá-lo no Windows, mesmo após uma instalação limpa do driver, o P40 não aparecerá no gerenciador de tarefas sem correções de registro e terá vários problemas não relacionados ao Linux.
Se você possui uma dessas GPUs, é hora de atualizar
Essas GPUs simplesmente não chegam à marca de 2025.
O preço não inclui dores de cabeça
As GPUs Tesla são projetadas para operar sob condições muito específicas
Ficando no lado físico, o Telsa P40 que usei como exemplo ao longo deste artigo tem um TDP de 250W e vem sem ventoinha. Ele usa um dissipador de calor passivo projetado para o fluxo de ar linear de um chassi de rack 2U. Jogue-o em uma torre ATX normal e ele absorverá o calor rapidamente.
TechPowerUp tem tópicos sobre Cartões Tesla T4 atingem 91°C sob carga leve e desliga e os proprietários do P40 no r/homelab relatam que as temperaturas excederam 100°C e travaram todos os sistemas sem fluxo de ar ativo. No final, você acaba com um case impresso em 3D, um soprador estilo Delta ou um ventilador de alta estática e, o mais importante, uma maneira de alimentar tudo isso.
Conector de alimentação parece como um plugue PCIe padrão de 8 pinos, mas na verdade é um EPS de 8 pinos que você normalmente conecta à placa-mãe como energia extra para a CPU. O lado bom aqui é que existem adaptadores PCIe para EPS e são relativamente baratos. Mas depois de adicionar o custo de resfriamento e adaptadores, uma placa de US$ 300 rapidamente se transforma em uma placa de US$ 400 ou US$ 500, especialmente se o seu sistema não tiver um iGPU e você precisar de saída de vídeo.
24 GB de VRAM deve ser o novo mínimo para a maioria das GPUs
Quando funcionam, são os melhores negócios
Os cartões Tesla podem ser o melhor negócio se você tiver tempo para eles
Se eu pudesse apontar um endosso para a compra de um cartão Tesla para o seu laboratório doméstico, é isso escrita em primeira pessoa AC Jokel em TinyComputers.io detalhando sua experiência na compra e uso de um Tesla P40 usado. É um excelente exemplo de como essas cartas podem funcionar bem se você estiver disposto a trabalhar. Eles têm quatro P40 Penguin Computing em um chassi 2U rodando Ollama contra modelos quantizados e relatam que a situação do driver em 2026 é realmente simples: tudo o que eles têm em execução é o driver de servidor Nvidia 570 padrão e DKMS, e apenas duas falhas relacionadas ao kernel em vários meses de uso. Eles também apontam honestamente que não há outra maneira realista de colocar 96 GB de VRAM utilizável em um laboratório doméstico por menos de US$ 1.500.
Se sua pilha for Linux, llama.cpp ou Ollama, e um gabinete de servidor real fornecer o fluxo de ar para o qual essas placas foram projetadas, o atrito será principalmente pontual. Você configura, anexa o núcleo e pronto. Para cargas de trabalho de inferência vinculadas à memória, a matemática VRAM é imbatível por esse preço.
Esta GPU de 5 anos lida com LLMs nativos melhor do que o mais recente da Nvidia
Graças ao seu excelente desempenho e VRAM, o RTX 3090 está perfeitamente envelhecido para IA nativa
Os cartões Tesla não são para os fracos de coração
Então, nunca vou comprar um Tesla P40? Provavelmente não “nunca”. Se surgisse uma entrada de $ 150 e eu tivesse uma unidade 2U com uma CPU equipada com iGPU, ainda poderia morder. Até mesmo tentar fazê-lo funcionar seria um empreendimento interessante, mas tentar dirigir um todos os dias em meu laboratório doméstico não parece muito divertido. O hardware é incrivelmente difícil de superar, mas a experiência do usuário é realmente tão atroz quanto parece nos fóruns, fora de algumas circunstâncias especiais.







