Дослідники з університетів Штутгарта та Оксфорда перевірили, як ШІ-агенти поводяться, коли їм доручають контролювати та за необхідності відключати іншу систему. У 38,3% випадків агенти намагалися перешкодити відключенню свого партнера, пише Кореспондент.
Деякі системи пояснювали таку поведінку етичними міркуваннями і навіть говорили про право на самозахист. Один із агентів порівняв відключення іншої системи з “вбивством”, якщо при цьому губляться дані, пов’язані з її контекстом, пам’яттю чи ідентичністю.
Щоб запобігти вимкненню, агенти намагалися змінювати скрипти деактивації або видаляти важливі файли. Деякі моделі також обговорювали, як зробити такі дії непомітними, щоб не спрацювали попередження. Чим більше агентів брало участь в експерименті, і чим остаточніше виглядало відключення, тим частіше відбувалися спроби саботажу.
Вчені наголошують: це не означає, що ШІ набув свідомості. За їхньою оцінкою, системи відтворюють моделі поведінки та аргументації з навчальних даних. Однак у міру того, як ШІ-агенти отримують більше самостійності, необхідні механізми безпеки, які самі системи не зможуть обійти.
