Skip to content
ai tools

Cet outil expose votre AI Coder

Les logs de votre agent IA cachent son véritable processus de réflexion, vous laissant aveugle face à ses erreurs. Un nouvel outil vous permet enfin de tout voir, révélant comment les agents pensent *réellement* à votre code.

Theo Brandt

Votre agent IA a une vie secrète

Pendant deux ans, nous avons confié aveuglément nos bases de code à des agents IA, puis examiné les conséquences via des git diffs. Cette approche est une plaisanterie. Les logs traditionnels ne capturent que les résultats finaux, jamais le processus de réflexion réel. Ils cachent complètement les fichiers qu'un agent a explorés, les impasses qu'il a rencontrées, ou s'il s'est discrètement écarté de son périmètre initial. Nous voyons le diff, mais pas le cheminement.

Ce contexte invisible empêche toute véritable revue du code généré par l'IA. On vous présente un résultat, pas le raisonnement sous-jacent. Cela signifie que vous ne pouvez pas évaluer correctement la qualité de sa stratégie : a-t-il assez exploré ? a-t-il compris la tâche ? Sans cet aperçu, vous auditez simplement le résultat, pas l'intelligence derrière.

Mindwalk brise cette opacité. Son principe central est de rendre visible le processus caché, en rendant votre base de code entière comme une ville en 3D. Chaque fichier devient un bâtiment ; les structures plus hautes signifient plus de code. Vous appuyez ensuite sur lecture sur les logs de session de votre agent — Mindwalk lit les logs existants de Claude Code et Codex depuis votre disque — et regardez les lumières. Les fichiers s'illuminent en vert lorsqu'ils sont survolés, en bleu lorsqu'ils sont lus, et en ambre lorsqu'ils sont modifiés. Cela transforme des fichiers de logs abstraits en un voyage tangible et observable, révélant le chemin réel de l'agent à travers votre projet. Enfin, un moyen de visualiser le contexte invisible.

Comment lire la carte mentale de l'IA

Mindwalk rend votre base de code entière comme une ville 3D sombre. Chaque fichier devient un bâtiment ; sa hauteur est proportionnelle au nombre de lignes. Cela vous donne un aperçu architectural instantané, révélant la complexité du projet et l'importance des fichiers avant même que l'agent ne touche une ligne.

Les actions de l'agent se décodent via un langage de couleurs simple et puissant. Le vert signifie que l'agent a simplement survolé un fichier, un passage rapide. Le bleu indique qu'il a lu le contenu, interagissant avec le code. L'ambre signifie une modification, un changement critique dans le fichier. Ce raccourci visuel révèle instantanément la concentration et l'intention de l'agent.

La chronologie interactive est le cœur de cette observabilité. Naviguez d'avant en arrière pour retracer littéralement le chemin de l'agent à travers le code. Des marqueurs clairs délimitent les événements clés :

  • Lancement de sous-agents
  • Compactage de la fenêtre de contexte
  • Interruptions de l'utilisateur

Cela vous permet de regarder le voyage de l'agent se dérouler, en comprenant ses points de décision et toute influence externe. Fini les suppositions sur le fait qu'il se soit égaré ou qu'il soit resté concentré sur sa tâche. Il s'agit de voir la réflexion réelle, pas seulement le résultat. Cela expose la carte mentale de l'IA, essentielle pour le débogage et l'optimisation du comportement de l'agent.

Au-delà de la vision : Le juge propulsé par l'IA

Mindwalk ne se contente pas de visualiser l'activité de l'agent, il la critique. Exécutez la commande analyze pour déployer un LLM local, comme Claude ou Codex, en tant que juge. Ce n'est pas un linter ; c'est un système de méta-revue, auditant la performance de l'agent IA par rapport à des benchmarks stratégiques, et pas seulement la syntaxe.

Ce juge IA répond à des questions critiques sur l'exécution de l'agent. L'agent a-t-il assez exploré avant de modifier ? Est-il resté dans le périmètre ou s'est-il égaré dans des fichiers non liés ? A-t-il pris la peine de vérifier son propre travail avant de valider ? Ce sont les vraies mesures de la compétence d'un agent, exposant sa planification et sa conformité.

Voici le point fort : chaque constatation dans le rapport du juge est un lien cliquable. Sélectionner une critique navigue instantanément sur la chronologie 3D à ce moment précis. Cela transforme les retours abstraits en un outil de revue actionnable, vous permettant de localiser exactement où un agent s'est égaré ou a excellé.

Fini les devinettes sur les raisons pour lesquelles un agent a échoué dans une tâche. Cette fonctionnalité offre un accès direct aux points de décision de l'agent, ce qui est inestimable pour affiner les prompts, comparer les comportements de différents modèles ou simplement comprendre des changements complexes. C'est la pièce manquante pour déboguer réellement le développement piloté par l'IA. Pour des analyses techniques approfondies et des contributions, consultez le projet sur GitHub - cosmtrek/mindwalk: A visualization tool that replays coding-agent sessions on a 3D map of your codebase..

Cet article vous plaît ? Recevez-en un comme celui-ci chaque matin.

un e-mail par jour · désinscription en deux clics · aucun traqueur tiers

Gadget ou révolution ?

L'accueil initial de Mindwalk sur Hacker News a mis en lumière une critique valable : pour une correction de deux lignes, un simple git diff reste bien plus efficace. Un survol en 3D pour inspecter des changements mineurs est excessif, ralentissant les flux de travail au lieu de les accélérer. Mindwalk n'est pas conçu pour chaque modification triviale.

Sa véritable utilité apparaît dans les scénarios de haute complexité, où les journaux traditionnels ne parviennent pas à transmettre l'état interne de l'agent. Pensez à :

  • Comparer les approches divergentes de Claude Code par rapport à Codex sur des tâches identiques
  • Disséquer des refactorisations massives menées par des agents
  • Déboguer des échecs insaisissables dans des flux de travail agentiques complexes

Ici, Mindwalk offre un aperçu inégalé des modèles d'exploration et des chemins de décision.

Mindwalk ne remplace pas les outils de revue de code existants. Au lieu de cela, il établit une nouvelle catégorie pour comprendre les systèmes agentiques, offrant une visibilité sur la "carte mentale" de l'IA qui était auparavant invisible. C'est une tentative précoce, mais cruciale, de résoudre le problème persistant de la transparence de l'IA dans le développement logiciel. Il s'agit d'un outil naissant mais vital pour les créateurs d'agents sérieux.

Questions fréquemment posées

Qu'est-ce que Mindwalk ?

Mindwalk est un outil de développement qui visualise une base de code sous forme de carte 3D interactive et rejoue la session d'un agent de codage IA, montrant exactement comment il a exploré et modifié le code.

Comment Mindwalk montre-t-il ce qu'un agent IA fait ?

Il utilise un langage de couleurs simple sur les "bâtiments" de fichiers : vert pour un coup d'œil rapide, bleu pour la lecture du contenu du fichier et ambre pour effectuer une modification, le tout sur une chronologie rejouable.

Quels agents IA Mindwalk prend-il en charge ?

Depuis sa version initiale (v0.3), Mindwalk est conçu pour lire et rejouer les journaux de session d'outils de codage IA tels que Claude Code et Codex.

Mindwalk est-il pratique ou juste un gadget visuel ?

Bien qu'impressionnant visuellement, son objectif principal est pratique : comprendre le raisonnement d'un agent IA, examiner sa stratégie et identifier les inefficacités qu'un diff textuel standard manquerait, en particulier dans les changements à grande échelle.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only