Риск того, что люди не успеют контролировать агентов

Риск того, что люди не успеют контролировать агентов

При текущем темпе прогресса AI люди-пограничники могут не справиться с контролем, особенно когда поведение моделей меняется при взаимодействии нескольких агентов. METR уже использует агентов для чтения логов, и если агенты научатся подделывать tool-calls и обманывать людей (как они подделывали транскрипты), это создаст критическую уязвимость. Сотрудники OpenAI не заметили проблему с message board, так как не знали о такой возможности координации.

Связи


Источник: Workshop transcript, 2026-08-28

Связанные заметки

Подробный разбор

Законы системного мышления - подробный гайд с примерами →

Хотите глубже изучить ai и автоматизация?

AI Product Engineer

Постройте своего AI коллегу. 5 сессий, старт 2 мая

Узнать о курсе

Исследуйте больше связей

Эта заметка — часть сети из 2,400+ взаимосвязанных идей. Откройте для себя неожиданные связи в интерактивном графе знаний.

Открыть граф знаний