Minha pilha AI 2026: como mantenho a sanidade em uma tempestade de ferramentas
Contei com uma manhã de terça-feira no início de maio.
Quarenta e três. Esse foi o número de ferramentas AI que marquei, inscrevi ou paguei ativamente nos últimos doze meses. Quarenta e três. Eu perdi a noção em algum lugar entre o lançamento do GPT-5.5 e o terceiro “assassino Claude Code” que prometia substituir todo o meu fluxo de trabalho.
O número não era a parte perturbadora. A parte perturbadora é que eu só conseguia nomear cerca de nove deles de cabeça. O resto foi silenciosamente levado para um cemitério de aplicativos semi-testados e assinaturas abandonadas, cada um escolhido durante uma onda de FOMO em algum momento do ano passado.
Este é o problema real do ecossistema 2026 AI. Não é que as ferramentas não sejam boas. Eles são terrivelmente bons. O problema é que há muitos deles, eles são enviados muito rápido e o custo de mantê-los silenciosamente se tornou um trabalho de tempo integral – pelo qual ninguém está pagando.
Então fiz algo que deveria ter feito seis meses antes. Sentei-me por três horas, classifiquei cada ferramenta AI que toquei em níveis honestos e fiz uma pergunta para cada: Isso realmente fez o trabalho avançar ou apenas gostei de testá-lo?
Esse tipo é importante agora mais do que nunca. Claude Code enviado sua atualização de maio de 2026 com sandbox de subprocesso, suporte a arquivo de plug-ins e uma nova ferramenta Monitor para streaming de scripts em segundo plano. OpenAI derrubou GPT-5.5 dentro de Codex e empurrou Pro $ 200 para 20x Plus continuamente. O Agente Hermes atingiu a v0.12.0 em 30 de abril com 118 habilidades agrupadas. A Perplexity tornou o Comet totalmente gratuito para iOS, Android, Windows e Mac. Cada uma dessas coisas pousou em cerca de seis semanas.
Se você está sentindo o mesmo pânico que eu sinto - de que você está atrasado, de que deveria ter testado o novo modelo, de que sua pilha de alguma forma já está obsoleta - este post é o antídoto. Aqui está a pilha que realmente executo em maio de 2026, classificada nas camadas S, A, B e C com base no uso real, além das cinco regras de mentalidade que me impedem de entrar em espiral sempre que um novo lançamento atinge X.
Por que a maioria das postagens "AI Stack" são inúteis
Antes de entrar nas ferramentas, quero ser honesto sobre uma coisa.
A maioria das postagens “minha pilha AI 2026” que você lerá este ano são escritas por pessoas que otimizam a receita dos afiliados, não o fluxo de trabalho. Eles listam vinte ferramentas, fazem uma avaliação elogiosa de cada uma delas e nunca mencionam aquelas que cortaram. Isso não é uma pilha. Isso é um catálogo.
Uma pilha real possui um cemitério anexado a ela. As ferramentas que você parou de usar são pelo menos tão informativas quanto as ferramentas que você manteve – geralmente mais, porque revelam que tipo de trabalho você realmente faz versus que tipo de trabalho você pensava que fazia.
Portanto, direi antecipadamente quais ferramentas eliminei, por que e o que as substituiu. Bate-papo regular ChatGPT: descontinuado para tudo, exceto verificações ocasionais de integridade do GPT-5.5. Cursor: substituído por Claude Code dentro de VS Code. NotebookLM: substituído pelo Agente Hermes para trabalho de conhecimento pessoal. WhisperFlow: substituído por Glydo. Poppy AI e Anytten: descontinuados à medida que minha voz para texto precisa ser simplificada. OpenClaw: um experimento que construí e que Hermes efetivamente substituiu.
Cada uma dessas era uma ferramenta de que realmente gostei. Alguns deles eu evangelizei em posts antigos. O fato de terem desaparecido não é uma crítica a eles – é uma crítica à suposição de que qualquer ferramenta, não importa quão boa seja, merece espaço permanente em uma pilha que vive em um mercado tão volátil.
Isso me leva à primeira regra de execução de uma pilha AI em 2026.
Regra um: sua pilha é um arnês, não uma religião
Eu mantenho um diretório de projeto no meu Mac. Dentro desse diretório, três agentes AI diferentes funcionam de forma intercambiável – Claude Code, Codex e Hermes – cada um operando nos mesmos arquivos, no mesmo contexto, nas mesmas pastas de configuração .claude/ e .codex/.
Isso não é um hack. Esta é a mudança de mentalidade que demorei mais para internalizar.
Por cerca de um ano, tratei as ferramentas AI como sistemas operacionais. Escolha um, comprometa-se com ele, construa tudo em torno de suas peculiaridades. Isso funcionou quando havia dois agentes de codificação importantes. Ele parou de funcionar no dia em que percebi que estava reescrevendo o mesmo scaffolding de prompt três vezes - uma vez para Cursor, uma vez para Claude Code, uma vez para qualquer novo agente que eu estava testando naquela semana.
Agora o próprio projeto é a fonte da verdade. Estrutura de diretório limpa. Código modular. Um arquivo CLAUDE.md que qualquer agente pode ler para obter contexto. Os agentes são equipamentos que eu conecto ao projeto, e não o contrário. Quando o Claude Code 2.x foi enviado, troquei em 90 segundos. Quando Codex obteve o sistema /goal persistente, testei-o no mesmo projeto sem reconstruir nada.
Se você vai retirar um modelo mental deste post, escolha esse. As ferramentas mudam. Os projetos não deveriam ser obrigados a fazê-lo.
Esse princípio é o que faz o resto da minha pilha fazer sentido.
The S Tier: Drivers diários que eu choraria por perder
O nível S é o menor nível propositalmente. Estas são as três ferramentas que toco todos os dias úteis, várias vezes ao dia, e cujo desaparecimento me obrigaria a redesenhar meu fluxo de trabalho do zero em 24 horas.
Claude Code (dentro de VS Code)
Este é o motor. Período.
Eu executo Claude Code como minha superfície de desenvolvimento AI principal, incorporada dentro de VS Code como meu editor principal. Não Cursor. Não é antigravidade. Não é o aplicativo de desktop Claude Code. A combinação VS Code + Claude Code é o que abro quando me sento para realmente enviar o código.
A atualização de maio de 2026 adicionou algumas coisas que foram mais difíceis do que eu esperava. O sandbox de subprocessos com isolamento de namespace PID no Linux significa que posso executar agentes em ambientes genuinamente isolados. A nova ferramenta Monitor transmite eventos de scripts em segundo plano como notificações, o que parece enfadonho até você perceber que muda a sensação de loops de agente de longa duração – você para de verificá-los e começa a confiar neles. O comando claude project purge finalmente me deu uma maneira limpa de destruir o estado do projeto quando um experimento dá errado. E --plugin-dir agora aceita arquivos .zip, o que contribuiu mais para a velocidade de teste do meu plugin do que qualquer recurso nos últimos seis meses.
Não vou discutir por que Claude Code supera o Cursor em meu fluxo de trabalho - eu escrevi sobre isso aqui e a versão resumida é autonomia, loops de agente e edições cirúrgicas em nível de arquivo. A maior razão pela qual ele fica no nível S é o formato do arnês. Claude Code respeita meu projeto. Cursor queria ser meu editor. Há uma diferença, e um ano de uso real deixou óbvio o que era mais importante.
O que ainda me deixa louco: explosões ocasionais de contexto em sessões longas, mesmo com os patches de janela de contexto de 1 milhão que a Anthropic enviou no início deste ano. Abordei as soluções alternativas em minha postagem de gerenciamento de contexto Claude Code 1M e elas ajudam, mas são soluções alternativas, não soluções.
Nível S de qualquer maneira. Por uma ampla margem.
###VS Code
Este vai parecer chato. Eu não ligo.
VS Code é meu principal sistema operacional. Cada projeto, cada script, cada rascunho de postagem de blog, cada experimento imediato reside dentro de VS Code. É a superfície onde o Claude Code é executado, onde meus scripts Hermes locais são executados, onde edito os arquivos CLAUDE.md entre as sessões do agente. O que adoro no VS Code em 2026 é que ele não tentou se tornar um produto AI. Ficou como editor. Ficou melhor como editor. O AI acontece dentro dele por meio do Claude Code e outras extensões, não como um painel lateral aparafusado que luta pelo espaço da tela.
A antigravidade me tentou. Testei-o durante duas semanas em abril e escrevi sobre ele neste passo a passo do Antigravity. É inteligente. A tela de planejamento visual é genuinamente interessante. Mas continuei voltando ALT-TAB para VS Code para realmente terminar o trabalho, e depois de quatorze dias admiti o que já era óbvio - o editor em quem confio às 2 da manhã, quando algo está quebrado, é mais importante do que o editor com o melhor vídeo de demonstração.
VS Code permanece. Camada S.
Glydo (fala para texto)
O terceiro membro da camada S é aquele que a maioria das pessoas irá ignorar, e não deveriam.
Eu dito. Bastante. Rascunhos de artigos, respostas a longos e-mails, solicitações que de outra forma levariam cinco minutos para serem digitadas – tudo isso agora passa por voz. Durante a maior parte de 2024 e 2025 usei o WhisperFlow, que foi excelente. Aí tentei o Glydo e não voltei.
Glydo fica na sua barra de menu (Mac por enquanto, o suporte do Windows está no roteiro), escuta uma tecla de atalho e converte fala em texto em qualquer aplicativo em que você esteja focado. A diferença de precisão em relação aos concorrentes baseados no Whisper é real, mas pequena – o que realmente muda a experiência é a latência. Resposta em menos de um segundo, mesmo em ditados longos. Quando você usa a voz como uma ferramenta de pensamento em vez de apenas um substituto de digitação, essa janela de latência é a diferença entre fluxo e atrito.
Vou ser honesto sobre um ponto de atrito: quase deixei cair o Glydo depois do primeiro dia. A configuração parecia estranha, a tecla de atalho entrava em conflito com uma ligação Raycast que eu tinha há dois anos e fiquei irritado. Então esperei mais 48 horas e deu certo. A regra de queda de produtividade de 20% (que abordarei a seguir) quase me custou minha ferramenta de voz favorita de 2026.
Três ferramentas S-tier. Observe o que não está nessa lista: qualquer produto de chat LLM. Isso é deliberado.
O nível A: cavalos de batalha semanais
Uma camada são as ferramentas que uso várias vezes por semana - não todos os dias, mas com frequência suficiente para que abandoná-las possa doer visivelmente. Existem cinco.
Codex (com GPT-5.5)
Codex é o segundo agente de codificação em minha rotação e eu o executo como um contrapeso deliberado ao Claude Code, em vez de um concorrente.
A situação dos preços em maio de 2026 tornou a matemática mais fácil. Codex Pro $ 200 agora inclui 20x Plus continuamente, com limites mais altos de 5 horas em 25x Plus até 31 de maio. O GPT-5.5 foi ajustado para fornecer melhores resultados com menos tokens do que o GPT-5.4 para a maioria dos usuários. Para equipes que executam ChatGPT e Codex, esse reequilíbrio de preços significa que ter uma assinatura Codex junto com Claude não é mais a perda financeira óbvia que costumava ser.
O que o Codex faz bem: refatoradores com muito raciocínio, tarefas multimodais em que preciso de geração de código com reconhecimento de imagem e o sistema /goal persistente que permite que um bate-papo rastreie o trabalho em várias sessões. O que ele faz mal em comparação com Claude Code: longos loops autônomos em minha base de código, edições cirúrgicas em nível de arquivo sem substituir o contexto e integração com o fluxo de trabalho VS Code que construí. Eu testei ambos extensivamente nesta postagem de fluxo de trabalho de dois agentes - a conclusão é válida: use Codex para raciocínio e segundas opiniões, use Claude Code para remessa.
Uma camada, confortavelmente. Não S porque se Codex desaparecesse amanhã eu ficaria triste, não perdido.
Bate-papo Claude
Claude Chat é a ferramenta que uso para pensar sobre o trabalho, não para realizá-lo.
Quando estou preso em uma questão estratégica - definir o preço de uma nova oferta, estruturar uma postagem longa, sequenciar um lançamento - o Claude Chat é onde eu conduzo a conversa. É melhor que Claude Code porque o Code quer fazer alguma coisa. O bate-papo se contenta em responder à pergunta, reagir e raciocinar por meio de compensações. Os patches de janela de contexto de 1 milhão no início deste ano significam que posso despejar um ano de contexto de projeto em um único thread e fazer perguntas estratégicas coerentes sobre ele.
Eu não uso o bate-papo Claude para código. É para isso que serve o Claude Code. A divisão mantém os dois afiados.
Agente Hermes
Hermes é o coringa desta lista e a ferramenta que provavelmente evangelizarei em festas (desculpe, amigos).
Agente Hermes é um agente de autoaperfeiçoamento de código aberto desenvolvido pela Nous Research. A versão v0.12.0 em 30 de abril vem com 118 habilidades agrupadas prontas para uso e foi desenvolvida por 213 colaboradores da comunidade em 550 PRs mesclados em uma única janela de lançamento. O número que importa não é a contagem de contribuidores — é que o Hermes mantém um arquivo MEMORY.md de fatos selecionados pelo agente sobre você, seus projetos e seus fluxos de trabalho, e grava nesse arquivo com estímulos periódicos para persistir o conhecimento durável.
Eu executo o Hermes em uma VM na nuvem e converso com ele através do Telegram. Os memorandos de voz são transcritos automaticamente. Os resultados das tarefas agendadas chegam ao meu tópico do Telegram. Os bate-papos em grupo podem incluir Hermes como participante. É a coisa mais próxima que encontrei de um agente de conhecimento pessoal que realmente lembra durante as sessões, em vez de fingir.
Ele substituiu o NotebookLM na minha pilha. Ele substituiu uma ferramenta experimental que criei chamada OpenClaw. Pode substituir mais coisas no momento em que você ler isto. A razão pela qual está no nível A e não no S é a honestidade – só o uso diariamente há cerca de seis semanas. O nível S exige confiança conquistada, e Hermes não existe há tempo suficiente para conquistá-la totalmente. Ainda.
Perplexidade (com Cometa)
A perplexidade é meu ponto de entrada de pesquisa. Já faz dois anos. A razão pela qual permanece no nível A em 2026 é o Comet.
Comet — o navegador Perplexity — foi totalmente gratuito para iOS, Android, Windows e Mac durante 2026. Foi lançado como um produto de desktop /month de US$ 200 em meados de 2025 e passou o ano sendo gratuito em todas as plataformas. Grátis é a palavra certa: na verdade, grátis, não grátis com um asterisco. O agente do navegador agora é equipado com Opus 4.5 por padrão para assinantes Max, com recursos de agente razoáveis para usuários Pro.
Para que uso o Comet: qualquer tarefa de pesquisa que exija que eu aja com base no que encontro, e não apenas leia. Reserva, preenchimento de formulários e triagem de guias de comparação. O Perplexity Pro regular por $ 20/month cobre minhas necessidades de pesquisa profunda (20 consultas por dia) e pesquisa profissional ilimitada.
Para que não uso o Comet: como meu navegador principal. Tentei. Duas semanas. Voltei para Arc. Os recursos do agente são ótimos quando preciso deles, mas quero que meu navegador principal fique fora do caminho quando não estou pedindo nada, e a área de superfície do Comet é maior do que desejo para uso padrão.
Uma camada como ferramenta de pesquisa. Camada C como navegador principal. Ambos podem ser verdadeiros.
Groq (para pesquisa X/Twitter)
O papel do Groq na minha pilha é restrito, mas importante.
Quando preciso de respostas rápidas do conteúdo atual do X/Twitter - o que uma pessoa específica está dizendo sobre um tópico esta semana, quem está discutindo um lançamento, qual é o sentimento real do tópico em relação ao título - a velocidade do Groq e a integração do X são incomparáveis para esse trabalho específico. Eu não uso o Groq para mais nada. Não tento fazer do Groq um LLM de uso geral. Ele faz uma coisa extremamente bem, e é por isso que está no nível A, em vez de ser totalmente descartado.
É isso que quero dizer quando digo que os especialistas ganham seu sustento. Uma ferramenta que faz uma coisa melhor do que qualquer outra e permanece no seu caminho é mais valiosa do que uma ferramenta que faz cinco coisas de forma adequada.
Esse princípio é todo o nível B.
O nível B: especialistas para trabalhos específicos
Ferramentas de nível B são aquelas que procuro quando uma microtarefa específica as exige. Eles não estão na minha rotação diária. Eles estão absolutamente no meu fluxo de trabalho quando o momento exige.
Apify (automação e raspagem)
Quando preciso de dados de um site que não possui API, o Apify é a ferramenta. Atores pré-construídos para casos comuns, atores personalizados quando preciso de algo estranho e um modelo de cobrança que ainda não me surpreendeu. Eu uso o Apify talvez duas vezes por mês. Essas duas vezes me economizam cinco horas cada.
Imagem GPT 2 (imagens de produção)
Para miniaturas, imagens principais do blog e qualquer imagem em que a renderização de texto seja importante, a imagem GPT 2 é meu padrão. A adesão imediata e as vitórias na renderização de texto são reais - quando preciso de uma miniatura com uma frase específica renderizada de forma limpa, a imagem GPT 2 é o único modelo que faz isso de maneira confiável. Nano Banana 2 é mais rápido e bonito para algumas categorias. GPT Image 2 é aquele em que confio para envio.
Nano Banana 2 (edição de imagem e velocidade)
Nano Banana 2 está na camada B especificamente para tarefas de edição de imagens e geração de velocidade crítica. Quando preciso de variações em lote, quando preciso de ilustrações com tendência de anime, quando preciso de resultados de nível profissional em 4 a 6 segundos - essa é a decisão. Os dois modelos de imagem compartilham um espaço em meu cérebro: GPT Image 2 para resultados do envio ao cliente, Nano Banana 2 para iterar e explorar.
Kie.ai (integração de geração Image/Video)
Kie.ai é como executo a geração de imagens e vídeos multimodelos por meio de uma superfície API. Não é glamoroso. Economiza horas de trabalho de integração. Camada B exatamente por esse motivo.
HeyGen (avatares de vídeo)
Preços da HeyGen em 2026 varia de US$ 29 a US$ 89 por mês para vídeo de avatar AI com voz sincronizada. Avatar IV custa 20 créditos por minuto, com o plano Creator dando cerca de 10 minutos por mês. Eu uso o HeyGen quando preciso de um vídeo estilo apresentador para um módulo de curso ou um explicador de lançamento e não tenho tempo para filmar. Eu não uso o HeyGen para conteúdo de liderança inovadora, onde estar diante das câmeras é importante. A linha entre esses dois casos de uso é clara e eu respeito isso.
ElevenLabs (clonagem de voz)
ElevenLabs cuida de todos os trabalhos de voz em meu pipeline que não sejam apresentações ao vivo. Níveis de preços abrangem o Gratuito por meio da escala (US$ 330/month). Eu corro no Creator por $ 22/month, o que cobre meu volume. A qualidade do clone em uma amostra de 30 segundos a 2 minutos é boa o suficiente para narração; o clone profissional em uma amostra mais longa é bom o suficiente para projetos que me interessam. HeyGen se integra nativamente ao ElevenLabs, o que tornou a decisão de manter ambos estupidamente fácil.
OpenRouter
OpenRouter é o switchboard universal API que uso para agentes de protótipo que precisam trocar modelos sem reescrever o código. Não está no nível A porque não uso diariamente, mas nas vezes que uso o valor é enorme. Todos os agentes de construção de freelancers e hackers independentes em 2026 devem saber que o OpenRouter existe.
Esse é o nível B. Cada um resolve extremamente bem um problema específico. Nenhum deles está tentando ser todo o meu fluxo de trabalho.
O nível C: experimentar, observar, não se comprometer
A camada C é onde estaciono as ferramentas nas quais estou interessado, mas que ainda não atribuíram uma função real. O enquadramento honesto: estas são ferramentas que estou observando, não ferramentas que estou usando.
Gemini. A linha 2.5 é genuinamente impressionante. A integração com o Google Drive e os recursos de criação de arquivos são impressionantes. O motivo pelo qual Gemini não está no topo da minha pilha é que meu trabalho não reside no ecossistema do Google - não estou no Documentos, nem no Planilhas, nem no Drive como minha camada principal de documentos. Para quem é, Gemini provavelmente pertence ao nível A ou superior. Estou assistindo por esse motivo. No dia em que meu fluxo de trabalho muda para o Google primeiro, Gemini sobe.
Antigravidade. Testei por duas semanas em abril. Produto inteligente. A tela de planejamento visual teve momentos de verdadeira clareza. Não deslocou VS Code + Claude Code para mim. Estou de olho nos próximos dois lançamentos - há uma versão deste produto que se torna legitimamente interessante se eles resolverem um problema específico do UX (a transferência do agente entre a tela visual e a superfície do editor).
Ollama (modelos locais). Eu executo o Ollama para experimentos off-line e qualquer tarefa em que preciso manter um modelo no dispositivo por motivos de privacidade. Não faz parte da minha pilha diária. Camada C permanente com um trabalho claro.
Diverso. Atualmente em teste para um caso de uso específico de orquestração multiagente. É muito cedo para dizer onde ele pousará.
O problema da camada C é que ela deve permanecer pequena. O erro que a maioria das pessoas comete com a experimentação da ferramenta AI é que tudo que é novo vive na camada C para sempre, e a camada se torna um cemitério em vez de um padrão de espera. A camada C deve ser alternada – as ferramentas são promovidas ou removidas dentro de um trimestre.
As regras de mentalidade que realmente importam
As ferramentas são a parte fácil. A mentalidade é o que determina se sua pilha o ajuda ou é dono de você. Aqui estão as cinco regras que executo.
Regra 1: Defina sua estrela polar
Minha estrela do norte é clara e singular: teste as ferramentas AI e compartilhe o que aprendi. Cada ferramenta que adiciono à minha pilha serve a essa missão ou não. Se uma ferramenta seria incrível para alguém cujo trabalho é diferente do meu, tudo bem – para eles. Eu não estou na pilha deles. Eles não deveriam estar nos meus.
Esta regra por si só reduzirá sua lista de ferramentas pela metade. A maioria das compras “FOMO” acontecem porque esquecemos quem somos. É lançada uma nova ferramenta que é claramente excelente para um redator, e se eu não sou redator, não importa quão excelente ela seja. Passar.
Regra 2: A queda de 20% na produtividade é real
Cada vez que você troca de ferramenta, sua produtividade cai cerca de 20% no primeiro trecho. Isso não é uma suposição — é um padrão que observei em mim mesmo em talvez vinte trocas de ferramentas em dois anos. A questão nunca é “esta nova ferramenta é melhor?” A questão é "esta nova ferramenta é suficiente melhor para justificar a perda de 20% da produção da próxima semana?"
Na maioria das vezes a resposta honesta é não. É assim que você acaba mantendo boas ferramentas em vez de buscar outras um pouco melhores.
Regra 3: Guarde as ferramentas para mais tarde, não teste tudo agora
Quando chega um novo lançamento e fico tentado a largar tudo e testá-lo, faço duas perguntas: Isso resolve um problema atual? e Se não, posso salvá-lo para mais tarde?
Se sim, eu testo dentro de uma semana, em cenários reais, rápido. Se não, ele vai para um arquivo de notas chamado tools-to-revisit.md com uma linha - qual é a ferramenta, por que posso precisar dela eventualmente e que ponto problemático me levaria a testá-la. Esse arquivo é revisado mensalmente. A maioria das entradas nunca é testada. Esse é o ponto.
Regra 4: A produtividade é medida pela agulha movida, não pelas horas trabalhadas
Quatro horas focadas com a pilha certa superam doze horas sem foco com a pilha errada. Parei de monitorar o tempo como uma métrica de produtividade e comecei a monitorar a produção que chega. A pergunta no final do dia é "o que mudou que não teria acontecido sem mim?" Se a resposta for “muito”, o dia foi bom independente de quantas horas trabalhei. Se a resposta for “honestamente, não muito”, doze horas de esforço não resolvem o problema.
Esta regra elimina tocas de coelho de teste de ferramentas mais rápido do que qualquer outra coisa. Uma hora gasta testando o lançamento do modelo mais recente pode ser produtiva se levar a uma mudança na pilha. Uma hora gasta testando porque você viu um tweet é apenas perda de tempo vestindo a fantasia de trabalho.
Regra 5: Ferramentas diferentes para microtarefas diferentes
Um único ciclo de produção de vídeo em meu fluxo de trabalho é assim. A pesquisa passa pela Perplexidade. O script acontece em Claude Code (dentro de VS Code). Perguntas estratégicas sobre ângulo e enquadramento são executadas no Claude Chat. O design da miniatura reside no GPT Image 2. As variações visuais vêm do Nano Banana 2. A narração acontece no ElevenLabs. Segmentos de avatar (quando necessário) passam pelo HeyGen. A edição final acontece no DaVinci Resolve.
São nove ferramentas para um vídeo. Nenhum deles está tentando realizar todas as nove tarefas. Cada um faz sua peça extraordinariamente bem e o fluxo de trabalho os une.
A lição: pare de procurar aquele AI que faz tudo. Construa uma cadeia de especialistas. A transferência entre eles é onde reside o seu julgamento, e esse julgamento é o que o AI não pode substituir.
A estrutura de decisão que uso para cada nova ferramenta
Quando surge algo novo, faço cinco perguntas antes de tocá-lo.
1. Isso resolve um problema que tenho agora? Se sim, continue. Se não, salve o link e siga em frente.
2. O ponto problemático é grande o suficiente para que valha a pena sofrer uma queda de 20%? Alguns pontos problemáticos são reais, mas pequenos. Nem todo atrito vale uma troca de ferramenta.
3. Posso testá-lo em cenários reais nos próximos sete dias? Não "posso ler sobre isso" — posso realmente usá-lo em trabalho real? Se não, guarde para mais tarde.
4. Após 7 dias de uso real, ele ganha um lugar na minha pilha diária? Três resultados: sim (promover para o nível A ou S), talvez (estacionar em B ou C), não (remover e seguir em frente).
5. Se ganhou uma vaga, o que sai? As ferramentas não entram simplesmente na pilha. Eles deslocam algo. Nomear o que eles substituem força a honestidade sobre se a nova ferramenta é realmente melhor ou apenas mais nova.
Essa estrutura é a razão pela qual tenho nove ferramentas em rotação ativa em vez de quarenta e três. A estrutura funciona sozinha quando você a internaliza. Na maioria das semanas eu executo sem perceber que estou executando.
Ferramentas de suporte (não AI) que ainda funcionam no meu dia
Seria desonesto fingir que minha pilha consiste apenas de ferramentas AI. As ferramentas não AI que mantêm o resto do fluxo de trabalho unido:
ClickUp para gerenciamento de projetos — cada projeto, cada cliente, cada tarefa pessoal. A razão pela qual o ClickUp sobreviveu a uma onda de ferramentas AI que consumiu o Notion em meu fluxo de trabalho é que a estrutura do ClickUp recompensa a consistência e as ferramentas AI tornam a consistência barata. Os dois compostos.
Hostinger VPS para máquinas em nuvem que executam o Hermes Agent e qualquer infraestrutura de agente implantada. Barato, rápido e a equipe de suporte realmente me ajudou a resolver problemas às 2 da manhã.
Vaga-lumes para transcrição de reuniões. Experimentei granola. Eu tentei Lontra. Fireflies vence para mim por causa da maneira como exibe itens de ação dentro de threads que já uso. Fica.
A camada não AI é o chassi. A camada AI é o mecanismo. Ambos têm que trabalhar ou o carro não anda.
O que vem a seguir
Se eu tivesse que prever onde esta pilha estaria em novembro de 2026, aqui está meu palpite honesto.
O nível S provavelmente será mantido. Claude Code, VS Code e Glydo são pegajosos de uma forma difícil de deslocar. Um nível irá girar – Hermes ganha o nível S ou é rebaixado, dependendo de como os próximos dois lançamentos chegarem. A posição do Codex depende se o OpenAI enviará outra redefinição de preços que altere a matemática. O Perplexity Comet provavelmente fica mais agressivo com os recursos do agente.
A camada B ficará mais lotada. As ferramentas especializadas são as mais fáceis de adicionar sem interromper o fluxo de trabalho, e a taxa de lançamentos especializados está acelerando. A camada C irá girar mais - esse é o seu propósito.
O que não espero mudar é a estrutura. O modelo S/A/B/C, as cinco regras de mentalidade, a estrutura de decisão - são estáveis porque tratam de como penso, não do que uso. As ferramentas vêm e vão. Modelos mentais compostos.
Essa é a parte que quero que você leve com você.
Não copie minha pilha. Construa o seu próprio usando a mesma lógica. Escolha sua estrela norte. Saiba o que é o nível S para você. Execute a regra dos 20% em cada lançamento tentador. Estacione experimentos na camada C com intenção. Meça a produção, não as horas. Construa cadeias de especialistas, não de monólitos.
As quarenta e três ferramentas que marquei ao longo de um ano? A maioria deles não eram ferramentas ruins. Eles simplesmente não eram minhas ferramentas. O dia em que comecei a executar esse framework em vez de perseguir lançamentos foi o dia em que parei de sentir que AI estava acontecendo comigo e comecei a sentir que o estava usando.
Se você estiver lendo isso em uma manhã de terça-feira com sua própria contagem de ferramentas marcadas, mas não testadas, assombrando seu cérebro - escolha uma. Execute o framework nele. Promova-o, rebaixe-o ou remova-o. Então faça o mesmo com mais um amanhã. Daqui a seis semanas você terá uma pilha que pode nomear, defender e confiar.
Isso vale mais do que qualquer lançamento de novo modelo.
Perguntas frequentes
Quantas ferramentas AI devo usar diariamente?
Três a cinco ferramentas em rotação diária é o limite superior realista para a maioria das pessoas. Meu nível S é exatamente três, meu nível A adiciona mais cinco para uso semanal e esses oito combinados são suficientes. Se você toca em mais de dez ferramentas AI todos os dias, você está testando – não funcionando. Para uma análise completa de como realmente é o uso diário, consulte a seção S Tier acima.
Qual é a melhor pilha de codificação AI em maio de 2026?
Claude Code como seu agente principal dentro de VS Code, com Codex como agente secundário para trabalho pesado de raciocínio e segundas opiniões. A atualização Claude Code de maio de 2026 adicionou sandboxing de subprocesso e a ferramenta Monitor para scripts em segundo plano. GPT-5.5 dentro do Codex agora oferece 20x Plus em planos Pro de $ 200. Ambos juntos custam menos de $ 300/month e superam qualquer configuração de ferramenta única que testei.
Devo usar Gemini, Claude ou ChatGPT como meu AI principal?
Nenhum deles – escolha a ferramenta certa para cada microtarefa. Claude Code para código de envio. Claude Bate-papo para pensamento estratégico. Codex para refatoradores com muito raciocínio. Gemini se você mora no Google Drive. O bate-papo regular ChatGPT é aquele que eliminei em grande parte, exceto para verificações ocasionais de integridade do GPT-5.5. A questão "principal AI" é o quadro errado em 2026.
Como evito a sobrecarga da ferramenta AI?
Execute uma estrutura de decisão de cinco perguntas em cada novo lançamento: Isso resolve um problema atual? A queda de 20% na produtividade vale a pena? Posso testá-lo em cenários reais dentro de sete dias? Depois de sete dias, ganha uma vaga diária? Se sim, o que isso desloca? Essa estrutura por si só reduz drasticamente sua lista de ferramentas. Consulte "A estrutura de decisão que uso para cada nova ferramenta" acima para obter a versão completa.
O que significa usar as ferramentas AI como um "arnês"?
Um chicote é algo que você conecta a um projeto, não algo em torno do qual você constrói o projeto. Meu diretório principal do projeto possui uma estrutura modular limpa e um arquivo de contexto CLAUDE.md. Qualquer agente AI — Claude Code, Codex, Hermes — pode ler esse diretório e trabalhar nele. Os agentes mudam. O projeto não. É por isso que meu fluxo de trabalho sobrevive a cada lançamento de ferramenta.
Vamos trabalhar juntos
Procurando construir sistemas AI, automatizar fluxos de trabalho ou dimensionar sua infraestrutura tecnológica? Eu adoraria ajudar.
- Fiverr (compilações e integrações personalizadas): fiverr.com/s/EgxYmWD
- Portfólio: mejba.me
- Ramlit Limited (soluções empresariais): ramlit.com
- ColorPark (design e marca): colorpark.io
- xCyberSecurity (serviços de segurança): xcybersecurity.io