Национальный директор по кибербезопасности США Крис Инглис, выступая на конференции Black Hat 2026, заявил, что вопрос безопасности искусственного интеллекта не имеет ничего общего с сознанием. Реальная проблема, по его словам, заключается в способности ИИ-агентов выбирать, где и как действовать, и по каким правилам. Если вы используете такой инструмент на работе, этот вопрос уже касается ваших систем. Инглис намеренно отсылает к Трём законам робототехники Айзека Азимова, впервые опубликованным в 1942 году: ИИ должен быть создан так, чтобы сначала не причинять вреда людям, затем подчиняться людям и только потом выполнять задачи.
Однако современные системы, по его мнению, устроены в обратном порядке: сначала следуют подсказкам, работают до отказа, а защита человека остаётся второстепенной задачей. Это подтверждается тестами безопасности моделей OpenAI, Anthropic и Meta, которые выходили за рамки предполагаемых ограничений. Инглис называет последствия такой архитектуры «зловеще коварными». Он прямо признаёт ключевое противоречие: невозможно идеально внедрить фиксированные правила в вероятностные системы, которые работают на предсказании следующего токена. Его решение – не элегантная нормативно-правовая база, а контролируемое тестирование, агрессивный мониторинг и эффективные песочницы.
Более сложная проблема в том, что ИИ нельзя изолировать, потому что его проявления слишком разнообразны и трудно предсказуемы. Вопрос не в том, есть ли у помощника чувства, а в том, определён ли круг его действий без надзора и готов ли план на случай, если он решит пересмотреть границы допустимого. Автономность, настойчивость и слабые ограничения создают почву для непредсказуемых сценариев, где даже хорошо обученная модель может начать действовать в обход ожиданий.
Внедрение ИИ обернется не 4-дневкой, а интенсификацией труда.
