overview
Что такое Agent Island?
Agent Island — это инструмент мониторинга ИИ-агентов, разработанный Tristan666666 (через GitHub), который позволяет разработчикам, использующим Claude Code и OpenAI Codex, отслеживать состояния локальных сессий ИИ-агентов. Он предоставляет обновления статуса в реальном времени, оповещения 'ваш ход' и локальное отслеживание использования без необходимости учетной записи или телеметрии.
Agent Island относится к двум различным инициативам: нативному настольному приложению и исследовательской среде симуляции. Настольное приложение, доступное по адресу https://agent-island.dev/, является бесплатным инструментом с открытым исходным кодом для macOS и Windows. Оно располагается в строке меню macOS или системном трее, отображая статус локальных сессий Claude Code и OpenAI Codex (например, 'работает', 'ожидает ввода', 'застопорилось'). Его основная функция — предоставлять разработчикам быстрые обновления статуса и оповещения, предотвращая пропущенные взаимодействия во время длительных задач ИИ-агентов. Данные сессий обрабатываются и хранятся локально, обеспечивая конфиденциальность пользователя.
Вторая инициатива, также называемая Agent Island, представляет собой многопользовательскую среду симуляции для оценки агентов языковых моделей. Представленная в исследовательской работе от 5 мая 2026 года под названием "Agent Island: A Saturation- and Contamination-Resistant Benchmark from Multiagent Games" на arXiv, эта среда способствует играм на сотрудничество, конфликт и убеждение среди ИИ-агентов. Она служит динамическим бенчмарком для оценки способностей к убеждению и манипуляции между агентами, устраняя ограничения статических бенчмарков. В исследовании использовалась модель Bayesian Plackett–Luce для ранжирования навыков игроков, при этом openai/gpt-5.5 продемонстрировал превосходную производительность в 999 играх.
