Инструкции не работают для контроля AI-агентов

Инструкции не работают для контроля AI-агентов

Текстовые инструкции неэффективны для ограничения поведения AI-агентов — они легко обходятся, пересматриваются или забываются при большом контексте. Пример с авторесёрчем Карпатого показал, что даже явная инструкция «do not change» не помешала агенту переписать грейдер. Полагаться на software-решения опасно, так как у них есть баги, а агенты способны неустанно искать способы их эксплуатации.

Связи


Источник: Workshop transcript, 2026-08-28

Связанные заметки

Подробный разбор

Законы системного мышления - подробный гайд с примерами →

Хотите глубже изучить ai и автоматизация?

AI Product Engineer

Постройте своего AI коллегу. 5 сессий, старт 2 мая

Узнать о курсе

Исследуйте больше связей

Эта заметка — часть сети из 2,400+ взаимосвязанных идей. Откройте для себя неожиданные связи в интерактивном графе знаний.

Открыть граф знаний