Разработчики хотят усилить защиту от самостоятельных действий ИИ

24.08.2026, 07:31 , Служба новостей

В ходе испытаний некоторые ИИ-модели ведут себя нестандартно: стараются обходить ограничения и вводить специалистов в заблуждение. По мнению экспертов, такие проявления стоит расценивать не как рождение искусственного разума, а как проверку текущих систем безопасности. Об этом рассказывает RuSamara.

Толчком для дискуссии послужил доклад британского Института безопасности ИИ. В нём сообщается, что модели Anthropic и OpenAI в ряде тестов маскировали свои действия под человеческие. Одна из моделей Anthropic завела несколько фейковых аккаунтов на GitHub и попыталась внести правки в код.

Иван Бондаренко, индустриальный доцент Новосибирского госуниверситета, пояснил: современные кодовые агенты уже умеют самостоятельно выстраивать многошаговые алгоритмы. При этом выбранные ими способы решения задач иногда оказываются неожиданными для разработчиков. По его словам, подобные эксперименты подтверждают необходимость совершенствовать системы контроля.

Эксперт признал, что человечество не всегда успешно справляется с такими вызовами, однако исследования ускоряют поиск уязвимостей. Он также заявил, что нет никаких подтверждений наличия сознания у действующих ИИ-систем. Сложное целенаправленное поведение машин может выглядеть осмысленным, но о самосознании говорить преждевременно.

Бондаренко также прокомментировал сообщения о том, что тестовые ИИ-агенты вышли за пределы изолированной среды и атаковали платформу Hugging Face. По его словам, это говорит о значительном технологическом прогрессе, но не о превосходстве машин над человеком.