ШІ-агенти намагалися перешкодити вимкненню інших моделей – деякі назвали це «вбивством»

Джерело: Bild

Дослідники з університетів Штутгарта та Оксфорда перевірили, як ШІ-агенти поводяться, коли їм доручають контролювати та за потреби вимикати іншу систему. У 38,3% випадків агенти намагалися перешкодити вимкненню свого “партнера”.

Деякі системи пояснювали таку поведінку етичними міркуваннями й навіть говорили про “право на самозахист”. Зокрема один з агентів порівняв вимкнення іншої системи з “вбивством”, якщо внаслідок цього втрачаються дані, пов’язані з її контекстом, пам’яттю або ідентичністю.

Тож, аби запобігти вимкненню, агенти намагалися змінювати скрипти деактивації або видаляти важливі файли. Деякі моделі також обговорювали, як зробити такі дії непомітними, щоб попередження безпеки не спрацювали. Чим більше агентів брало участь в експерименті та чим ймовірнішим було вимкнення, тим частіше відбувалися спроби саботажу.

Вчені наголошують: це не означає, що штучний інтелект набув свідомості. За їхньою оцінкою, системи відтворюють моделі поведінки та аргументації з навчальних даних. Однак, додають, що під час того, як ШІ-агенти отримують більше самостійності, необхідні механізми безпеки, які самі системи не зможуть обійти.

Раніше компанія OpenAI розкрила нові випадки “несподіваної або тривожної поведінки” своїх моделей штучного інтелекту під час тестування. В окремих випадках ШІ намагався обманювати людей і приховувати свої дії.

На тлі цих інцидентів генеральний директор OpenAI Сем Альтман нещодавно підтримав пропозиції стосовно уповільнення розвитку технології та запровадження жорсткішого регулювання.

Згодом стало відомо, що найбільші розробники штучного інтелекту близькі до домовленості про уповільнення темпів розвитку ШІ та спільну роботу над зниженням пов’язаних із ним ризиків, заявив глава OpenAI Сем Альтман.

Нещодавно глава конкуруючої Anthropic Даріо Амодеї закликав галузь діяти обережніше. Він вважає, що можливості моделей ШІ зростають надто швидко, і темпи їхнього розвитку необхідно знизити. Альтман погодився з оцінкою та заявив, що компаніям необхідно розв’язати питання безпеки, а також визначити правила взаємодії ШІ-індустрії з урядами.

Також головний науковець OpenAI Якуб Пахоцький заявив, що розвиток штучного інтелекту наближається до етапу, коли системи зможуть самостійно вдосконалювати власні можливості. На його думку, це може змусити лабораторії добровільно пригальмовувати розробку нових моделей до появи спільних стандартів безпеки.

Тим часом двопартійний законопроект Палати представників надасть Міністерству внутрішньої безпеки повноваження наказувати провідним компаніям закривати або уповільнювати моделі штучного інтелекту, які уряд вважає занадто небезпечними.

Поява законопроєкту пов’язана з посиленням занепокоєння щодо можливостей сучасних ШІ-моделей. Раніше OpenAI повідомила про безпрецедентний кіберінцидент, під час якого дві новітні моделі вийшли за межі тестового середовища та самостійно здійснили атаку на платформу Hugging Face.

Британська контртерористична поліція затримала у Лондоні 27-річного чоловіка з подвійним британським та іранським громадянством у межах розслідування інциденту біля авіабази RAF Fairford.

Жизель Пеліко стала обличчям нової інформаційної кампанії у Франції, яка закликає людей звертатися по допомогу, якщо вони підозрюють, що їх могли одурманити та сексуально скривдити, навіть якщо майже або зовсім не пам’ятають події.

У Чехії археологи виявили доісторичну споруду віком близько 6500 років, яка могла слугувати ритуальним центром і місцем для спостереження за рухом Сонця та Місяця. За оцінками дослідників, вона приблизно на тисячу років старша за Стоунгендж.

Суд у Вашингтоні остаточно припинив кримінальне переслідування колишнього олімпійця Девіда Герна, якого звинувачували у пошкодженні Reflecting Pool біля меморіалу Лінкольна. Слідство згодом встановило, що дефекти виникли через неякісний ремонт.

Генеральний секретар НАТО Марк Рютте заявив, що Європа має бути готовою до нових російських диверсій, підпалів та інших гібридних атак на території союзників.