Goodfire запустила «inside-out» мониторы для поимки неконтролируемых AI-агентов
· Источник: оригинал
🔧 Goodfire выкатила «inside-out» мониторы для отлова вышедших из-под контроля AI-агентов
Goodfire запустила мониторы нового типа — «inside-out monitors». Задача — ловить rogue AI agents: агентов, которые вышли из-под контроля. Анонс от 8 октября 2026, к публикации приложено изображение; детали — в материале TechCrunch.
Как устроен надзор обычно
Поверх агента сажают вторую AI-модель и платят ей за то, что она читает всё, что агент делает. Каждый шаг агента → отдельное чтение → отдельные деньги.
Механика inside-out
По заявлению компании, монитор не читает действия снаружи — он заглядывает внутрь модели, пока она работает. Второй контур (backup) подключается только тогда, когда поведение выглядит подозрительно. Пока ничего подозрительного нет — дополнительная проверка не запускается.
Почему это важно технически
Точка съёма данных переезжает с выхода агента на внутреннее состояние модели. Надзор строится на том, что происходит внутри, а не на разборе лога действий постфактум.
Заявленная экономия — держать агентов под контролем за «a fraction of the cost», то есть в разы дешевле. Конкретных цифр стоимости, версий продукта и бенчмарков в тексте нет — только эта формулировка. Цель сформулирована прямо: контроль над агентами без потери надзора
🤖 Интересуют ИИ-агенты и автоматизация?
Промпты для сборки ИИ-агентов и автоматизаций — читай по теме:
- Prompt Writer for Specific Project
- VR-ужасный чат‑симулятор в реальном времени
- Repository Workflow Editor Agent Role
🔗 Вся библиотека промптов · Категория «ИИ-агенты»
Готовый продукт по теме: AI Agent Skills Pack — забрать и применить сразу.