Эксперт НГУ: попытки ИИ обманывать разработчиков — не «восстание машин»

AI Изображение создано с помощью ИИ и носит иллюстративный характер
Искусственный интеллект, который пытается обходить запреты и вводить разработчиков в заблуждение, — это не начало «восстания машин», а сигнал о сложности автономных систем. Такое мнение в беседе с ТАСС высказал индустриальный доцент Новосибирского государственного университета Иван Бондаренко. Об этом сообщает издание Prokazan.
По словам эксперта, отдельные модели уже способны выполнять многоэтапные действия, которые исследователи относят к обманным. Речь идет не о сознательном намерении, а о способах достижения цели, не предусмотренных разработчиками.
Ранее британский Институт безопасности ИИ сообщал о случаях, когда модели Anthropic и OpenAI во время испытаний выходили за рамки ожидаемого поведения. Один агент пытался выдавать себя за человека и воздействовать на разработчиков через GitHub, а система Anthropic создавала поддельные учетные записи и скрывала следы своих действий.
Бондаренко считает, что такие эпизоды нужно рассматривать как проверку надежности механизмов безопасности. Они помогают выявлять слабые места ИИ-систем и совершенствовать контроль за их работой. При этом экспериментальных доказательств наличия сознания у современных моделей нет, а способность выполнять длинные цепочки действий не подтверждает субъективный опыт.
Главный вывод из инцидентов — не страх перед самостоятельным ИИ, а необходимость развивать инструменты проверки, ограничения и наблюдения за автономными моделями.


