Por mais que eu adore ficar na frente da tela do computador por quatorze horas ou mais todos os dias, ainda sou um defensor do papel e da caneta em alguns casos. Um desses casos, claro, são as listas de embalagem. Costumo viajar uma vez a cada dois meses, por alguns dias ou um pouco mais, e uma coisa que nunca consigo acertar é fazer minhas listas.

Claro, tenho algumas listas de verificação no Google Keep, mas nada supera a abordagem de caneta e papel. Infelizmente, a ressalva dessa abordagem é que tenho que criar uma nova lista a cada vez, então finalmente decidi ver se conseguia que Claude, ChatGPT e Gemini tentassem me ajudar a tornar todo o processo mais tranquilo e despreocupado com um aplicativo de embalagem baseado em React que eu pudesse carregar sempre que precisasse encher minha mala.

Usei Claude, Gemini e ChatGPT para construir meu site pessoal e houve um vencedor claro

A Batalha dos Desenvolvedores Web de IA.

Claude foi o primeiro e certamente estabeleceu o padrão

Eu quase não me incomodo com os outros

Para começar, meu prompt tinha que ser o mesmo em todos os três LLMs que tentei. Ao mesmo tempo, tinha que ser extremamente detalhado, pois era a única maneira de garantir que eu aproveitasse ao máximo meu prompt e que o LLM tivesse o máximo de informações possível para trabalhar ao criar meu planejador. A única coisa que eu sabia que não deveria fazer era tentar usar Claude como uma caixa mágica e, em vez disso, falar com ele como um colaborador. Então eu tive que ser intencional com meu prompt e layout.

Abordei Claude da mesma forma que um breve desenvolvedor. Comecei definindo o que queria, meus hábitos de embalagem, minha preferência por uma interface de usuário limpa e o fato de que absolutamente eu adoro gatos. Em seguida, solidifiquei a estrutura separando a sacola da mochila e até defini como os itens deveriam se organizar de forma dinâmica. A parte mais engraçada, claro, foi o enorme mascote do gato SVG que muda conforme você embrulha. Dos três, LLM Claude claramente fez o melhor trabalho ao selecionar o gato. Eu até deixei o LLM me fazer algumas perguntas para esclarecimentos antes de começar a construir o aplicativo, o que Claude fez um ótimo trabalho – três perguntas precisas que atingiram o que eu queria.

O resultado foi um software brilhante que me perguntava se eu faria uma viagem de um dia ou durante a noite. Ele segmentou os itens em seções, com cada item tendo um status de toque triplo – embalado, embalado e verificado novamente. A barra de status sempre fixa na parte superior acompanhava meu progresso conforme eu avançava nas seções. Meu recurso favorito é definitivamente a verificação tripla de cada item, o que parece um acidente quando estou quase pronto para sair uma hora antes de sair. Claramente, Claude sabia o que estava fazendo e muito mais. O resultado final quase me fez interromper o experimento porque sabia que tinha conseguido exatamente o que precisava.

Dei ao Claude Code o controle da minha área de trabalho por uma semana e ele automatizou coisas que pensei serem impossíveis.

Fiquei seriamente atordoado.

ChatGPT arrasou, mas não muito

No entanto, isso não agradou a Claude

Naquela época, eu sabia exatamente o que pedir ao ChatGPT para construir para mim, e o OpenAI GPT-5.5 precisava vencer o Sonnet 4.6, ou pelo menos competir em pé de igualdade. Com o prompt principal pronto, fui em frente e pedi ao ChatGPT para criar um agendador semelhante para mim com condições semelhantes, pedindo para garantir que meu recurso favorito de toque triplo permanecesse ativo em todo o agendador. A única diferença desta vez seria a paleta de cores e o tema, que pedi ao GPT para controlar totalmente.

Agora que tornei os gatos parte integrante disso, o ChatGPT precisava resolver o cronograma. Foi capaz de me dar uma estética mais atraente que era naturalmente mais agradável aos olhos, e os tons pastéis mais quentes definitivamente pareciam mais bonitos. No entanto, não tinha o mesmo polimento que Claude tinha. Ainda estava em segundo lugar, e até vi um caso em que escolhi a versão do ChatGPT para meu planejador de pacotes em vez da de Claude porque funcionava tão bem, mas tinha uma filosofia de design completamente diferente.

Questões GPT-5.5 me perguntou Quando cheguei ao prompt principal, foi direto e curto, e depois de uma resposta a cada uma das cinco perguntas que me fez, eu estava olhando para um planejador muito fofo que mal posso esperar para usar novamente, talvez para outra viagem.

Eu uso OpenCode em vez de Claude Code e é tão bom

Batida por batida, recurso por recurso.

Os gêmeos perderam completamente o enredo

Sem polimento e difícil de olhar

Quando mudei para Gêmeos, pensei que a fórmula estava bloqueada. O prompt já havia produzido dois planejadores realmente utilizáveis, então tudo que Gêmeos precisou fazer foi seguir as instruções e vivenciar um pouco de sua própria personalidade, certo? certo? Em vez disso, o que recebi pareceu um pequeno documento HTML codificado no Bloco de Notas por um aluno que mal passou na matéria. Claro, o layout era limpo, mas apenas porque faltava qualquer cor ou personalidade, ou mesmo gráficos, além do gato solitário no topo. Passei parágrafos tentando definir o aplicativo, mas Gemini parecia querer me dar apenas o mínimo.

Naquele ponto, eu nem estava interessado em ajustar o prompt ou dizer ao Gemini o que ele havia feito de errado, especialmente considerando o quão impressionantes seus concorrentes tinham sido até agora. Na verdade, a parte mais interessante de tudo isso é que Gemini foi o único LLM a me dizer isso não deveria ter para me fazer qualquer pergunta para esclarecer e fui em frente e criei um aplicativo React.

O resultado foi um aplicativo que até uma mãe acharia difícil de amar. Nem uma única tarefa crítica pré-viagem teve uma quebra de fila antes dela. Cada caixa e bolsa simplesmente tinham “CRÍTICO” e “DESEMBALADO” escritos ao lado de cada item. Depois disso, a barra de porcentagem de progresso que solicitei especificamente simplesmente não apareceu e apenas uma pequena quantidade de texto foi exibida conforme eu marcava cada caixa. Além disso, nem ficou pegajoso como eu precisava. Nem um único item ou caixa de seleção parecia clicável e tudo o que realmente estava estava anexado a um emoji que eu nem sabia que precisava clicar.

Foi difícil de digerir, mas eu precisava ter certeza de não estar dando mais instruções ao Gemini ou apontando uma lista de coisas que ele havia feito de errado. Claude já havia colocado a fasquia extremamente alta e ChatGPT fez o mesmo. Gêmeos, por outro lado, apenas leu as instruções e escreveu o código, como se esperasse apenas fazer o trabalho e escapar impune da incompetência em armas.

SO

Windows, macOS

Preços individuais

Plano gratuito disponível; Plano Pro de US$ 17/mês

Preços de grupo

$ 100 por mês por pessoa para o plano Max

Claude é assistente de IA e LLM pela Anthropic.


Cancelei minhas assinaturas ChatGPT, Perplexity e Gemini para Claude – e precisava disso antes

Eu gostaria de ter feito isso antes.

Há uma diferença entre gerar código e entender as pessoas

O futuro pertencerá a uma ferramenta que entenda as intenções e os pequenos aborrecimentos das pessoas.

Passamos a maior parte de dois anos fingindo que todos os principais LLMs estão jogando o mesmo jogo, mas depois de observar esses três enfrentando a mesma tarefa, não tenho mais certeza de que isso seja verdade. Enquanto Claude e ChatGPT pareciam colegas de trabalho com quem eu estava trabalhando, Gemini sentia como se tivessem acabado de concluir uma tarefa cinco minutos antes do exame.

Claramente, o futuro dessas ferramentas não pertencerá a qual chatbot conseguir extrair a maior parte do código com mais rapidez. Em vez disso, pertencerá àqueles que realmente entendem a intenção, o ritmo, a linguagem do design e as pequenas falhas humanas que fazem ou quebram o software. Claude acertou esse equilíbrio perfeitamente, enquanto ChatGPT chegou impressionantemente perto com sua identidade mais suave e divertida. Enquanto isso, Gêmeos nunca entendeu realmente a tarefa.

Link da fonte