Ma pile AI 2026 : comment rester sain d'esprit dans une tempête d'outils
Je comptais sur un mardi matin début mai.
Quarante-trois. C'était le nombre d'outils AI que j'avais mis en favoris, auxquels je m'étais inscrit ou pour lesquels j'avais activement payé au cours des douze derniers mois. Quarante-trois. J'avais perdu le fil quelque part entre le déploiement de GPT-5.5 et le troisième "Claude Code killer" qui promettait de remplacer l'intégralité de mon flux de travail.
Le numéro n'était pas la partie dérangeante. Ce qui était troublant, c’était que je ne pouvais en nommer que neuf par tête. Le reste avait tranquillement dérivé dans un cimetière d’applications à moitié testées et d’abonnements abandonnés, chacun choisi lors d’une vague de FOMO à un moment donné au cours de l’année dernière.
C’est le véritable problème de l’écosystème 2026 AI. Ce n'est pas que les outils ne soient pas bons. Ils sont terriblement bons. Le problème est qu'il y en a trop, qu'ils sont expédiés trop vite et que le coût de leur suivi est tranquillement devenu un travail à temps plein – pour lequel personne ne vous paie.
J’ai donc fait quelque chose que j’aurais dû faire six mois plus tôt. Je me suis assis pendant trois heures, j'ai classé tous les outils AI que j'avais utilisés dans des niveaux honnêtes et j'ai posé une question pour chacun : Est-ce que cela a réellement fait avancer le travail, ou est-ce que j'ai simplement aimé le tester ?
Ce genre de situation compte plus que jamais. Claude Code livré sa mise à jour de mai 2026 avec sandboxing de sous-processus, prise en charge des archives de plugins et un nouvel outil Monitor pour la diffusion en continu de scripts en arrière-plan. OpenAI a supprimé GPT-5.5 dans Codex et a poussé Pro 200 $ à 20x Plus de manière continue. Hermes Agent est sorti en version 0.12.0 le 30 avril avec 118 compétences groupées. Perplexity a rendu Comet entièrement gratuit sur iOS, Android, Windows et Mac. Chacun de ces objets a atterri en six semaines environ.
Si vous ressentez la même panique que moi – que vous êtes en retard, que vous auriez dû tester le nouveau modèle, que votre pile est déjà obsolète – cet article est l'antidote. Voici la pile que j'utilise réellement en mai 2026, triée en niveaux S, A, B et C en fonction de l'utilisation réelle, ainsi que les cinq règles d'état d'esprit qui m'empêchent de monter en flèche à chaque fois qu'un nouveau lancement atteint X.
Pourquoi la plupart des publications "AI Stack" sont inutiles
Avant d'aborder les outils, je veux être honnête sur quelque chose.
La plupart des articles « ma pile AI 2026 » que vous lirez cette année sont rédigés par des personnes qui optimisent les revenus d'affiliation, et non le flux de travail. Ils répertorient vingt outils, donnent à chacun d’eux une critique élogieuse et ne mentionnent jamais ceux qu’ils ont supprimés. Ce n'est pas une pile. C'est un catalogue.
Une vraie pile est associée à un cimetière. Les outils que vous avez arrêté d'utiliser sont au moins aussi informatifs que les outils que vous avez conservés - généralement plus, car ils révèlent le type de travail que vous effectuez réellement par rapport au type de travail que vous pensiez faire.
Je vais donc vous dire d'emblée quels outils j'ai progressivement supprimés, pourquoi et ce qui les a remplacés. Chat régulier ChatGPT : supprimé progressivement pour tout, à l'exception des contrôles d'intégrité GPT-5.5 occasionnels. Curseur : remplacé par Claude Code dans VS Code. NotebookLM : remplacé par Hermes Agent pour le travail de connaissances personnelles. WhisperFlow : remplacé par Glydo. Poppy AI et Anytten : supprimés progressivement car mes besoins de conversion voix-texte sont simplifiés. OpenClaw : une expérience que j'ai construite et qu'Hermès a effectivement remplacée.
Chacun d’entre eux était un outil que j’ai vraiment apprécié. J’en ai évangélisé certains dans d’anciens messages. Le fait qu'ils aient disparu ne leur porte pas atteinte, mais plutôt à l'hypothèse selon laquelle tout outil, aussi bon soit-il, mérite un espace permanent dans une pile qui vit dans un marché aussi volatil.
Cela m'amène à la première règle d'exécution d'une pile AI en 2026.
Règle n°1 : votre pile est un harnais, pas une religion
Je garde un répertoire de projet sur mon Mac. Dans ce répertoire, trois agents AI différents fonctionnent de manière interchangeable – Claude Code, Codex et Hermes – chacun opérant sur les mêmes fichiers, le même contexte, les mêmes dossiers de configuration .claude/ et .codex/.
Ce n'est pas un hack. C’est le changement de mentalité qui m’a pris le plus de temps à intérioriser.
Pendant environ un an, j'ai traité les outils AI comme des systèmes d'exploitation. Choisissez-en un, engagez-vous, construisez tout autour de ses bizarreries. Cela fonctionnait lorsqu’il y avait deux agents de codage importants. Il a cessé de fonctionner le jour où j'ai réalisé que je réécrivais trois fois le même échafaudage d'invites : une fois pour Cursor, une fois pour Claude Code, une fois pour le nouvel agent que je testais cette semaine-là.
Désormais, le projet lui-même est la source de la vérité. Structure de répertoires propre. Code modulaire. Un fichier CLAUDE.md que tout agent peut lire pour le contexte. Les agents sont des harnais que je branche dans le projet, et non l'inverse. Lorsque Claude Code 2.x a été expédié, j'ai changé en 90 secondes. Lorsque Codex a obtenu le système /goal persistant, je l'ai testé sur le même projet sans rien reconstruire.
Si vous souhaitez retirer un modèle mental de ce message, prenez celui-là. Les outils changent. Les projets ne devraient pas avoir à le faire.
Ce principe est ce qui donne du sens au reste de ma pile.
Le niveau S : des pilotes quotidiens dont je pleurerais de perdre
Le niveau S est volontairement le plus petit niveau. Ce sont les trois outils que je touche chaque jour ouvrable, plusieurs fois par jour, et dont la disparition m'obligerait à repenser mon workflow de zéro dans les 24 heures.
Claude Code (à l'intérieur de VS Code)
C'est le moteur. Période.
J'exécute Claude Code comme surface de développement AI principale, intégrée dans VS Code comme éditeur principal. Pas le curseur. Pas d'antigravité. Pas l'application de bureau Claude Code. La combinaison VS Code + Claude Code est ce que j'ouvre lorsque je m'assois pour expédier le code.
La mise à jour de mai 2026 a ajouté quelques éléments qui ont été plus difficiles que prévu. Le sandboxing des sous-processus avec l'isolation de l'espace de noms PID sous Linux signifie que je peux exécuter des agents dans des environnements véritablement isolés. Le nouvel outil Monitor diffuse les événements des scripts d'arrière-plan sous forme de notifications, ce qui semble ennuyeux jusqu'à ce que vous réalisiez que cela change la sensation des boucles d'agent de longue durée : vous arrêtez de les vérifier et commencez à leur faire confiance. La commande claude project purge m'a finalement donné un moyen propre de neutraliser l'état du projet lorsqu'une expérience tourne mal. Et --plugin-dir accepte désormais les archives .zip, ce qui a fait plus pour la vitesse de test de mon plugin que n'importe quelle fonctionnalité au cours des six derniers mois.
Je ne vais pas revenir sur la raison pour laquelle Claude Code bat Cursor pour mon flux de travail - j'ai écrit à ce sujet ici et la version courte concerne l'autonomie, les boucles d'agent et les modifications chirurgicales au niveau du fichier. La principale raison pour laquelle il se situe au niveau S est la forme du harnais. Claude Code respecte mon projet. Cursor voulait être mon éditeur. Il y a une différence, et une année d’utilisation réelle a montré ce qui comptait le plus.
Ce qui me rend encore fou : des explosions de contexte occasionnelles lors de longues sessions, même avec les 1 millions de correctifs de fenêtre contextuelle qu'Anthropic a livrés plus tôt cette année. J'ai couvert les solutions de contournement dans mon article sur la gestion du contexte Claude Code 1M et elles sont utiles, mais ce sont des solutions de contournement, pas des correctifs.
Niveau S en tout cas. De loin.
VS Code
Celui-ci va sembler ennuyeux. Je m'en fiche.
VS Code est mon principal système d'exploitation de pensée. Chaque projet, chaque script, chaque brouillon d'article de blog, chaque expérience d'invite se trouve dans VS Code. C'est la surface sur laquelle Claude Code s'exécute, où mes scripts Hermes locaux s'exécutent, où je modifie les fichiers CLAUDE.md entre les sessions d'agent. Ce que j'aime chez VS Code en 2026, c'est qu'il n'a pas essayé de devenir un produit AI. Il est resté éditeur. Ça s'est amélioré en tant qu'éditeur. Le AI se produit à l'intérieur via Claude Code et d'autres extensions, et non comme un panneau latéral boulonné qui se bat pour l'espace sur l'écran.
L'antigravité m'a tenté. Je l'ai testé pendant deux semaines en avril et j'ai écrit à ce sujet dans cette procédure pas à pas d'Antigravity. C'est intelligent. Le canevas de planification visuelle est vraiment intéressant. Mais je n'arrêtais pas de me retrouver avec ALT-TAB en train de revenir à VS Code pour terminer le travail, et après quatorze jours, j'ai admis ce qui était déjà évident : l'éditeur en qui j'ai confiance à 2 heures du matin quand quelque chose est cassé compte plus que l'éditeur avec la meilleure vidéo de démonstration.
VS Code reste. Niveau S.
Glydo (parole-texte)
Le troisième membre du niveau S est celui que la plupart des gens vont ignorer, et ils ne devraient pas le faire.
Je dicte. Beaucoup. Brouillons d’articles, réponses à de longs e-mails, invites qui prendraient autrement cinq minutes à saisir – tout cela passe désormais par la voix. Pendant la majeure partie de 2024 et 2025, j’ai utilisé WhisperFlow, qui était excellent. Ensuite, j'ai essayé Glydo et je n'y suis pas retourné.
Glydo vit dans votre barre de menus (Mac pour l'instant, la prise en charge de Windows est sur la feuille de route), écoute un raccourci clavier et convertit la parole en texte dans n'importe quelle application sur laquelle vous vous concentrez. La différence de précision par rapport aux concurrents basés sur Whisper est réelle mais minime : ce qui change réellement l'expérience, c'est la latence. Rendement en moins d'une seconde, même sur de longues dictées. Lorsque vous utilisez la voix comme outil de réflexion au lieu de simplement remplacer la frappe, cette fenêtre de latence fait la différence entre le flux et la friction.
Je vais être honnête sur un point de friction : j'ai failli laisser tomber Glydo après le premier jour. La configuration semblait délicate, le raccourci clavier était en conflit avec une liaison Raycast que j'avais depuis deux ans et j'étais ennuyé. Ensuite, je lui ai donné 48 heures supplémentaires et ça a cliqué. La règle de baisse de productivité de 20 % (à laquelle je reviendrai ci-dessous) m'a presque coûté mon outil vocal préféré de 2026.
Trois outils S-tier. Remarquez ce qui ne figure pas sur cette liste : n'importe quel produit de chat LLM. C'est délibéré.
Le niveau A : les bêtes de somme hebdomadaires
Un niveau correspond aux outils que j'utilise plusieurs fois par semaine - pas tous les jours, mais assez souvent pour que s'en éloigner serait sensiblement douloureux. Il y en a cinq.
Codex (avec GPT-5.5)
Codex est le deuxième agent de codage de ma rotation, et je l'utilise comme un contrepoids délibéré à Claude Code plutôt que comme un concurrent.
La situation des prix en mai 2026 a en fait facilité les calculs. Codex Pro 200 $ inclut désormais 20x Plus sur une base continue, avec des limites de 5 heures plus élevées à 25x Plus jusqu'au 31 mai. GPT-5.5 a été optimisé pour offrir de meilleurs résultats avec moins de jetons que GPT-5.4 pour la plupart des utilisateurs. Pour les équipes exécutant à la fois ChatGPT et Codex, ce rééquilibrage des prix signifie qu'avoir un abonnement Codex aux côtés de Claude n'est plus la perte financière évidente qu'il était.
Ce que Codex fait bien : des refactoristes lourds de raisonnement, des tâches multimodales pour lesquelles j'ai besoin d'une génération de code prenant en compte les images et le système /goal persistant qui permet à une seule piste de discussion de fonctionner sur plusieurs sessions. Ce qu'il fait mal par rapport à Claude Code : de longues boucles autonomes sur ma base de code, des modifications chirurgicales au niveau des fichiers sans écraser le contexte et l'intégration avec le flux de travail VS Code que j'ai créé. J'ai testé les deux de manière approfondie dans cet article sur le workflow à deux agents — la conclusion est valable : utilisez Codex pour le raisonnement et les deuxièmes avis, utilisez Claude Code pour l'expédition.
Un étage, confortablement. Pas S car si Codex disparaissait demain, je serais triste, pas bloqué.
Claude Chat
Claude Chat est l'outil que j'utilise pour réfléchir au travail, pas pour le faire.
Lorsque je suis bloqué sur une question stratégique (tarification d'une nouvelle offre, structuration d'une publication longue, séquencement d'un lancement), Claude Chat est l'endroit où je mène la conversation. C'est mieux que Claude Code pour ça parce que Code veut faire quelque chose. Le chat se contente de répondre à la question, de la repousser et de raisonner en faisant des compromis. Les correctifs de la fenêtre de contexte 1M plus tôt cette année me permettent de regrouper une année de contexte de projet dans un seul fil et de poser des questions stratégiques cohérentes par rapport à celui-ci.
Je n'utilise pas Claude Chat pour le code. C'est à cela que sert Claude Code. La séparation les maintient tous les deux vifs.
Agent Hermès
Hermès est le joker sur cette liste et l'outil que je suis le plus susceptible d'évangéliser lors de fêtes (désolé, les amis).
Hermes Agent est un agent open source auto-améliorable construit par Nous Research. La version v0.12.0 du 30 avril est livrée avec 118 compétences regroupées prêtes à l'emploi et a été créée par 213 contributeurs de la communauté sur 550 PR fusionnés dans une seule fenêtre de version. Le nombre qui compte n'est pas le nombre de contributeurs : c'est qu'Hermes maintient un fichier MEMORY.md contenant des informations organisées par des agents sur vous, vos projets et vos flux de travail, et écrit dans ce fichier avec des coups de pouce périodiques pour conserver des connaissances durables.
J'exécute Hermes sur une VM cloud et je lui parle via Telegram. Les mémos vocaux sont automatiquement transcrits. Les résultats des tâches planifiées arrivent dans mon fil Telegram. Les discussions de groupe peuvent inclure Hermès comme participant. C'est la chose la plus proche que j'ai trouvée d'un agent de connaissances personnelles qui se se souvient d'une session au lieu de faire semblant.
Il a remplacé NotebookLM dans ma pile. Il a remplacé un outil expérimental que j'avais construit appelé OpenClaw. Cela pourrait remplacer davantage de choses au moment où vous lirez ceci. La raison pour laquelle il se trouve au niveau A et non au niveau S est honnête : je ne l'utilise quotidiennement que depuis environ six semaines. Le niveau S nécessite une confiance méritée, et Hermès n’existe pas depuis assez longtemps pour la mériter pleinement. Encore.
Perplexité (avec Comet)
La perplexité est mon point d’entrée dans mes recherches. Cela fait deux ans. La raison pour laquelle il reste au niveau A en 2026 est Comet.
Comet – le navigateur Perplexity – est devenu entièrement gratuit sur iOS, Android, Windows et Mac en 2026. Il a été lancé en tant que produit de bureau /month à 200 $ à la mi-2025 et a passé l'année à être gratuit sur toutes les plateformes. Gratuit est le bon mot : réellement gratuit, pas gratuit avec un astérisque. L'agent de navigateur est désormais alimenté par défaut par Opus 4.5 pour les abonnés Max, avec des capacités d'agent raisonnables pour les utilisateurs Pro.
Ce pour quoi j'utilise Comet : toute tâche de recherche qui m'oblige à agir sur ce que je trouve, pas seulement à le lire. Réservation, remplissage de formulaires, tri des onglets de comparaison. Perplexity Pro régulier à 20 $/month couvre mes besoins en recherche approfondie (20 requêtes par jour) et Pro Search illimité.
Ce pour quoi je n’utilise pas Comet : comme navigateur principal. J'ai essayé. Quinze jours. Je suis retourné à Arc. Les fonctionnalités de l'agent sont excellentes lorsque j'en ai besoin, mais je souhaite que mon navigateur principal reste à l'écart lorsque je ne lui demande rien, et la surface de Comet est plus grande que ce que je souhaite pour une utilisation par défaut.
Un niveau comme outil de recherche. Niveau C en tant que navigateur principal. Les deux peuvent être vrais.
Groq (pour la recherche X/Twitter)
Le rôle de Groq dans ma pile est restreint mais important.
Lorsque j'ai besoin de réponses rapides à partir du contenu X/Twitter actuel – que dit une personne spécifique sur un sujet cette semaine, qui discute d'un lancement, quel est le sentiment réel du fil par rapport au titre – la vitesse de Groq et l'intégration X sont inégalées pour ce travail spécifique. Je n'utilise Groq pour rien d'autre. Je n'essaie pas de faire de Groq un LLM à usage général. Il fait extrêmement bien une chose, et c’est pourquoi il est au niveau A au lieu d’être complètement abandonné.
C’est ce que je veux dire lorsque je dis que les spécialistes gagnent leur vie. Un outil qui fait une chose mieux que toute autre chose et reste dans sa voie a plus de valeur qu'un outil qui fait cinq choses de manière adéquate.
Ce principe concerne l’ensemble du niveau B.
Le niveau B : des spécialistes pour des tâches spécifiques
Les outils de niveau B sont ceux que j'utilise lorsqu'une micro-tâche spécifique les exige. Ils ne font pas partie de ma rotation quotidienne. Ils sont absolument dans mon flux de travail lorsque le moment l’exige.
Apify (Automatisation & Scraping)
Lorsque j'ai besoin de données provenant d'un site Web qui n'a pas de API, Apify est l'outil. Des acteurs prédéfinis pour les cas courants, des acteurs personnalisés lorsque j'ai besoin de quelque chose de bizarre et un modèle de facturation qui ne m'a pas encore mordu. J'utilise Apify peut-être deux fois par mois. Ces deux fois me font gagner cinq heures chacune.
Image GPT 2 (images de production)
Pour les vignettes, les images de héros de blog et toute image pour laquelle le rendu du texte est important, GPT Image 2 est ma valeur par défaut. Les gains en matière d'adhésion rapide et de rendu de texte sont réels : lorsque j'ai besoin d'une vignette avec une phrase spécifique rendue proprement, GPT Image 2 est le seul modèle qui fait cela de manière fiable. Nano Banana 2 est plus rapide et plus joli pour certaines catégories. GPT Image 2 est celui auquel je fais confiance pour l'expédition.
Nano Banana 2 (édition d'images et vitesse)
Nano Banana 2 est au niveau B spécifiquement pour les tâches d'édition d'images et la génération critique en termes de vitesse. Quand j'ai besoin de variations par lots, quand j'ai besoin d'illustrations orientées anime, quand j'ai besoin de résultats de niveau professionnel en 4 à 6 secondes, c'est l'appel. Les deux modèles d'image partagent un emplacement dans mon cerveau : GPT Image 2 pour les sorties expédiées au client, Nano Banana 2 pour itérer et explorer.
Kie.ai (intégration Image/Video Gen)
Kie.ai est la façon dont j'exécute la génération d'images et de vidéos multimodèles via une seule surface API. Pas glamour. Permet d'économiser des heures de travail d'intégration. Niveau B pour exactement cette raison.
HeyGen (avatars vidéo)
Tarif HeyGen en 2026 varie de 29 $ à 89 $ par mois pour la vidéo d'avatar AI avec voix synchronisée. Avatar IV coûte 20 crédits par minute, le plan Creator offrant environ 10 minutes par mois. J'utilise HeyGen lorsque j'ai besoin d'une vidéo de style présentateur pour un module de cours ou un explicatif de lancement et que je n'ai pas le temps de filmer. Je n'utilise pas HeyGen pour du contenu de leadership éclairé où il est important d'être moi-même devant la caméra. La frontière entre ces deux cas d’utilisation est claire et je la respecte.
ElevenLabs (Clonage vocal)
ElevenLabs gère tous les travaux vocaux de mon pipeline qui ne sont pas des présentations en direct. Niveaux de tarification s'étendent gratuitement jusqu'à l'échelle (330 $/month). Je cours sur Creator à 22 $/month, ce qui couvre mon volume. La qualité du clonage sur un échantillon de 30 secondes à 2 minutes est suffisante pour la narration ; le clone professionnel sur un échantillon plus long est suffisant pour les projets qui me tiennent à cœur. HeyGen s'intègre nativement à ElevenLabs, ce qui a pris la décision de garder les deux bêtement faciles.
OuvrirRouter
OpenRouter est le standard universel API que j'utilise pour les agents prototypes qui doivent échanger des modèles sans réécrire le code. Ce n'est pas au niveau A parce que je ne l'utilise pas quotidiennement, mais les fois où je l'utilise, la valeur est énorme. Tous les agents de construction indépendants et hackers indépendants en 2026 devraient savoir qu’OpenRouter existe.
C'est le niveau B. Chacun résout extrêmement bien un problème spécifique. Aucun d’entre eux n’essaie de constituer l’intégralité de mon flux de travail.
Le niveau C : expérimenter, observer, ne pas s'engager
Le niveau C est l'endroit où je gare les outils qui m'intéressent mais qui n'ont pas encore donné de véritable rôle. Le cadrage honnête : ce sont des outils que je regarde, pas des outils que j'utilise.
Gemini. La gamme 2,5 est véritablement impressionnante. L'intégration avec Google Drive et les fonctionnalités de création de fichiers sont impressionnantes. La raison pour laquelle Gemini n'est pas plus haut dans ma pile est que mon travail ne vit pas dans l'écosystème Google : je ne suis pas dans Docs, ni dans Sheets, ni dans Drive comme couche de document principale. Pour quelqu'un qui l'est, Gemini appartient probablement au niveau A ou supérieur. Je le regarde pour cette raison. Le jour où mon flux de travail passe d'abord à Google, Gemini progresse.
Antigravité. Je l'ai testé pendant deux semaines en avril. Produit intelligent. Le canevas de planification visuelle a connu des moments de réelle clarté. N'a pas remplacé VS Code + Claude Code pour moi. Je garde un œil sur les deux prochaines versions : il existe une version de ce produit qui devient légitimement intéressante si elle résout un problème spécifique de UX (le transfert d'agent entre le canevas visuel et la surface de l'éditeur).
Ollama (modèles locaux). J'exécute Ollama pour des expériences hors ligne et pour toute tâche pour laquelle je dois conserver un modèle sur l'appareil pour des raisons de confidentialité. Ne fait pas partie de ma pile quotidienne. Niveau C permanent avec un travail clair.
Manifold. Test en cours pour un cas d'utilisation spécifique d'orchestration multi-agents. Trop tôt pour dire où il atterrira.
Le problème avec le niveau C, c'est qu'il est censé rester petit. L'erreur que la plupart des gens commettent avec l'expérimentation de l'outil AI est que tout ce qui est nouveau vit pour toujours dans le niveau C, et que le niveau devient un cimetière plutôt qu'un modèle d'attente. Le niveau C devrait tourner – les outils sont soit promus, soit supprimés dans un délai d'un trimestre.
Les règles de mentalité qui comptent réellement
Les outils sont la partie la plus facile. L’état d’esprit est ce qui détermine si votre stack vous aide ou vous possède. Voici les cinq règles que je respecte.
Règle 1 : Définissez votre étoile polaire
Mon étoile du nord est claire et singulière : testez les outils AI et partagez ce que j'apprends. Chaque outil que j'ajoute à ma pile sert cette mission ou non. Si un outil peut être formidable pour quelqu'un dont le travail est différent du mien, c'est très bien, pour lui. Je ne suis pas dans leur pile. Ils ne devraient pas être dans le mien.
Cette règle à elle seule réduira de moitié votre liste d’outils. La plupart des achats « FOMO » se produisent parce que nous oublions qui nous sommes. Un nouvel outil est lancé, il est clairement excellent pour un rédacteur, et si je ne suis pas rédacteur, peu importe à quel point il est excellent. Passer.
Règle 2 : la baisse de productivité de 20 % est réelle
Chaque fois que vous changez d'outil, votre productivité chute d'environ 20 % pour la première fois. Ce n’est pas une supposition – c’est un modèle que j’ai moi-même observé lors d’une vingtaine de changements d’outils en deux ans. La question n'est jamais « ce nouvel outil est-il meilleur ? » La question est « ce nouvel outil est-il suffisamment meilleur pour justifier une perte de 20 % de la production de la semaine prochaine ? »
La plupart du temps, la réponse honnête est non. C'est ainsi que vous finissez par conserver de bons outils au lieu d'en rechercher des légèrement meilleurs.
Règle 3 : Enregistrez les outils pour plus tard, ne testez pas tout maintenant
Lorsqu'un nouveau lancement arrive et que je suis tenté de tout abandonner et de le tester, je pose deux questions : Est-ce que cela résout un problème actuel ? et Si non, puis-je le sauvegarder pour plus tard ?
Si oui, je le teste dans la semaine, dans des scénarios réels, rapidement. Si non, il est placé dans un fichier de notes appelé tools-to-revisit.md avec une seule ligne : quel est l'outil, pourquoi je pourrais en avoir besoin éventuellement et quel problème me pousserait à le tester. Ce dossier est examiné mensuellement. La plupart des entrées ne sont jamais testées. C'est le point.
Règle 4 : la productivité est mesurée par le déplacement de l'aiguille et non par les heures travaillées
Quatre heures concentrées avec la bonne pile battent douze heures floues avec la mauvaise. J'ai arrêté de suivre le temps comme mesure de productivité et j'ai commencé à suivre les résultats expédiés. La question à la fin d'une journée est « qu'est-ce qui a bougé qui n'aurait pas bougé sans moi ? » Si la réponse est « beaucoup », la journée a été bonne, quel que soit le nombre d'heures travaillées. Si la réponse est « honnêtement, pas grand-chose », douze heures d’efforts ne suffisent pas.
Cette règle tue les terriers de test d’outils plus rapidement que toute autre chose. Une heure passée à tester le dernier lancement de modèle peut être productive si elle entraîne un changement de pile. Une heure passée à le tester parce que vous avez vu un tweet, c'est juste du temps perdu à porter le costume de travail.
Règle 5 : Différents outils pour différentes micro-tâches
Un seul cycle de production vidéo dans mon flux de travail ressemble à ceci. La recherche passe par la Perplexité. Les scripts se produisent dans Claude Code (à l'intérieur de VS Code). Des questions stratégiques sur l'angle et le cadrage sont posées via le chat Claude. La conception des vignettes réside dans GPT Image 2. Les variations visuelles proviennent de Nano Banana 2. La voix off se produit dans ElevenLabs. Les segments d'avatar (si nécessaire) passent par HeyGen. Le montage final a lieu dans DaVinci Resolve.
Cela représente neuf outils pour une vidéo. Aucun d’entre eux n’essaie d’accomplir les neuf tâches. Chacun fait extraordinairement bien sa pièce et le flux de travail les assemble.
La leçon : arrêtez de chercher celui AI qui fait tout. Construire une chaîne de spécialistes. C'est dans le transfert entre eux que réside votre jugement, et ce jugement est ce que AI ne peut pas remplacer.
Le cadre décisionnel que j'utilise pour chaque nouvel outil
Quand quelque chose de nouveau arrive, je lui pose cinq questions avant d’y toucher.
1. Cela résout-il un problème que je rencontre actuellement ? Si oui, continuez. Si non, enregistrez le lien et continuez.
2. Le problème est-il suffisamment important pour que la baisse de 20 % en vaille la peine ? Certains problèmes sont réels mais petits. Toutes les frictions ne valent pas la peine d’un changement d’outil.
3. Puis-je le tester dans des scénarios réels au cours des sept prochains jours ? Pas « puis-je en savoir plus » : puis-je réellement l'utiliser sur un travail réel ? Sinon, conservez-le pour plus tard.
4. Après 7 jours d'utilisation réelle, gagne-t-il une place dans mon stack quotidien ? Trois résultats : oui (promouvoir au niveau A ou S), peut-être (se garer en B ou C), non (supprimer et passer à autre chose).
5. S'il a gagné une place, qu'est-ce qui en ressort ? Les outils n'entrent pas seulement dans la pile. Ils déplacent quelque chose. Nommer ce qu’ils remplacent oblige à être honnête quant à savoir si le nouvel outil est réellement meilleur ou simplement plus récent.
Ce cadre est la seule raison pour laquelle j'ai neuf outils en rotation active au lieu de quarante-trois. Le framework fonctionne tout seul une fois que vous l'avez internalisé. La plupart des semaines, je l'exécute sans m'en rendre compte.
Prise en charge des outils (non AI) qui gèrent toujours ma journée
Il serait malhonnête de prétendre que ma pile n'est constituée que d'outils AI. Les outils non AI qui maintiennent le reste du flux de travail ensemble :
ClickUp pour la gestion de projet : chaque projet, chaque client, chaque tâche personnelle. La raison pour laquelle ClickUp a survécu à une vague d'outils AI qui a mangé Notion dans mon flux de travail est que la structure de ClickUp récompense la cohérence et que les outils AI rendent la cohérence bon marché. Les deux composés.
Hostinger VPS pour les machines cloud qui exécutent Hermes Agent et toute infrastructure d'agent déployée. Pas cher, rapide et l'équipe d'assistance m'a aidé à résoudre les problèmes à 2 heures du matin.
Lucioles pour la transcription des réunions. J'ai essayé Granola. J'ai essayé Loutre. Fireflies gagne pour moi en raison de la façon dont il fait apparaître les éléments d'action dans les fils de discussion que j'utilise déjà. Cela reste.
La couche non AI est le châssis. La couche AI est le moteur. Les deux doivent travailler, sinon la voiture ne bouge pas.
Ce qui vient ensuite
Si je devais prédire où se trouvera cette pile en novembre 2026, voici ma supposition honnête.
Le niveau S tiendra probablement. Claude Code, VS Code et Glydo sont collants et difficiles à déplacer. Un niveau tournera – Hermès gagne le niveau S ou est rétrogradé, en fonction de la manière dont les deux prochaines versions arriveront. La position de Codex dépend du fait que OpenAI expédie ou non une autre réinitialisation des prix qui modifie les calculs. Perplexity Comet devient probablement plus agressif avec les fonctionnalités d'agent.
Le niveau B deviendra plus encombré. Les outils spécialisés sont les plus faciles à ajouter sans perturber le flux de travail, et le rythme des lancements spécialisés s'accélère. Le niveau C sera celui qui effectuera le plus de rotation – c'est tout son objectif.
Ce que je ne m'attends pas à changer, c'est le cadre. Le modèle S/A/B/C, les cinq règles de mentalité, le cadre de décision – ceux-ci sont stables car ils concernent ma façon de penser, pas ce que j'utilise. Les outils vont et viennent. Composé de modèles mentaux.
C'est la partie que je veux que tu emportes avec toi.
Ne copiez pas ma pile. Construisez le vôtre en utilisant la même logique. Choisissez votre étoile du nord. Sachez ce qu'est le niveau S pour vous. Appliquez la règle des 20 % à chaque lancement tentant. Parcez les expériences au niveau C avec intention. Mesurez la production, pas les heures. Construisez des chaînes de spécialistes, pas de monolithes.
Les quarante-trois outils que j’ai mis en favoris sur un an ? La plupart d’entre eux n’étaient pas de mauvais outils. Ce n’étaient tout simplement pas mes outils. Le jour où j'ai commencé à exécuter ce framework au lieu de courir après les lancements, c'est le jour où j'ai arrêté d'avoir l'impression que AI m'arrivait et j'ai commencé à avoir l'impression de l'utiliser.
Si vous lisez ceci un mardi matin avec votre propre nombre d'outils marqués mais non testés qui hantent l'arrière de votre cerveau, choisissez-en un. Exécutez le framework dessus. Promouvez-le, rétrogradez-le ou supprimez-le. Ensuite, faites la même chose avec un autre demain. Dans six semaines, vous disposerez d’une pile que vous pourrez nommer, défendre et à laquelle vous pourrez faire confiance.
Cela vaut plus que n’importe quel lancement de nouveau modèle.
Questions fréquemment posées
Combien d'outils AI dois-je réellement utiliser quotidiennement ?
Trois à cinq outils en rotation quotidienne constituent la limite supérieure réaliste pour la plupart des gens. Mon niveau S est exactement de trois, mon niveau A en ajoute cinq de plus pour une utilisation hebdomadaire, et ces huit combinés sont suffisants. Si vous utilisez plus de dix outils AI chaque jour, vous testez – cela ne fonctionne pas. Pour une description complète de ce à quoi ressemble réellement l’utilisation quotidienne, consultez la section Niveau S ci-dessus.
Quelle est la meilleure pile de codage AI en mai 2026 ?
Claude Code en tant qu'agent principal dans VS Code, avec Codex en tant qu'agent secondaire pour les travaux de raisonnement et les deuxièmes avis. La mise à jour Claude Code de mai 2026 a ajouté le sandboxing des sous-processus et l'outil Monitor pour les scripts en arrière-plan. GPT-5.5 dans Codex propose désormais 20x Plus sur les forfaits Pro à 200 $. Les deux coûtent ensemble moins de 300 $/month et surpassent toutes les configurations à outil unique que j'ai testées.
Dois-je utiliser Gemini, Claude ou ChatGPT comme AI principal ?
Aucun d’entre eux – choisissez le bon outil pour chaque micro-tâche. Claude Code pour le code d’expédition. Claude Discutez pour une réflexion stratégique. Codex pour les refactors exigeants en raisonnement. Gemini si vous vivez dans Google Drive. Le chat régulier ChatGPT est celui que j'ai en grande partie supprimé, à l'exception de vérifications occasionnelles de l'intégrité de GPT-5.5. La question "principale AI" est la mauvaise image en 2026.
Comment puis-je éviter la surcharge de l'outil AI ?
Exécutez un cadre de décision en cinq questions à chaque nouveau lancement : cela résout-il un problème actuel ? La baisse de productivité de 20 % en vaut-elle la peine ? Puis-je le tester dans des scénarios réels dans un délai de sept jours ? Après sept jours, gagne-t-il une place quotidienne ? Si oui, qu'est-ce que cela déplace ? Ce framework à lui seul réduit considérablement votre liste d’outils. Voir « Le cadre décisionnel que j'utilise pour chaque nouvel outil » ci-dessus pour la version complète.
Que signifie utiliser les outils AI comme « harnais » ?
Un harnais est quelque chose que vous branchez à un projet, pas quelque chose autour duquel vous construisez le projet. Mon répertoire de projet principal a une structure modulaire propre et un fichier de contexte CLAUDE.md. Tout agent AI (Claude Code, Codex, Hermes) peut lire ce répertoire et travailler dessus. Les agents changent. Ce n’est pas le cas du projet. C'est pourquoi mon flux de travail survit à chaque lancement d'outil.
Let's Work Together
Vous cherchez à créer des systèmes AI, à automatiser les flux de travail ou à faire évoluer votre infrastructure technologique ? I'd love to help.
- Fiverr (versions et intégrations personnalisées) : fiverr.com/s/EgxYmWD
- Portefeuille : mejba.me
- Ramlit Limited (solutions d'entreprise) : ramlit.com
- ColorPark (conception et image de marque) : colorpark.io
- xCyberSecurity (services de sécurité) : xcybersecurity.io