overview
Qu'est-ce que Agent Island ?
Agent Island est un outil de surveillance d'agents IA développé par Tristan666666 (via GitHub) qui permet aux développeurs utilisant Claude Code et OpenAI Codex de surveiller les états des sessions d'agents IA locales. Il fournit des mises à jour de statut en temps réel, des alertes 'à votre tour' et un suivi de l'utilisation locale sans nécessiter de compte ni de télémétrie.
Agent Island fait référence à deux initiatives distinctes : une application de bureau native et un environnement de simulation orienté recherche. L'application de bureau, accessible à l'adresse https://agent-island.dev/, est un outil gratuit et open-source pour macOS et Windows. Elle réside dans la barre de menus de macOS ou la zone de notification système, affichant le statut des sessions locales de Claude Code et OpenAI Codex (par exemple, 'en cours', 'en attente d'entrée', 'bloqué'). Sa fonction principale est de fournir aux développeurs des mises à jour de statut et des alertes rapides, évitant ainsi les interactions manquées lors de tâches d'agents IA de longue durée. Les données de session sont traitées et stockées localement, garantissant la confidentialité de l'utilisateur.
La deuxième initiative, également appelée Agent Island, est un environnement de simulation multijoueur pour l'évaluation des agents de modèles linguistiques. Introduit dans un article de recherche du 5 mai 2026 intitulé "Agent Island: A Saturation- and Contamination-Resistant Benchmark from Multiagent Games" sur arXiv, cet environnement facilite les jeux de coopération, de conflit et de persuasion entre agents IA. Il sert de référence dynamique pour évaluer les capacités de persuasion et de manipulation inter-agents, en abordant les limites des références statiques. La recherche a utilisé un modèle Bayesian Plackett–Luce pour classer les compétences des joueurs, avec openai/gpt-5.5 démontrant des performances supérieures dans 999 jeux.
