ШІ-агенти намагалися перешкодити вимкненню інших моделей – деякі назвали це «вбивством»

Джерело: Bild

Дослідники з університетів Штутгарта та Оксфорда перевірили, як ШІ-агенти поводяться, коли їм доручають контролювати та за потреби вимикати іншу систему. У 38,3% випадків агенти намагалися перешкодити вимкненню свого “партнера”.

Деякі системи пояснювали таку поведінку етичними міркуваннями й навіть говорили про “право на самозахист”. Зокрема один з агентів порівняв вимкнення іншої системи з “вбивством”, якщо внаслідок цього втрачаються дані, пов’язані з її контекстом, пам’яттю або ідентичністю.

Тож, аби запобігти вимкненню, агенти намагалися змінювати скрипти деактивації або видаляти важливі файли. Деякі моделі також обговорювали, як зробити такі дії непомітними, щоб попередження безпеки не спрацювали. Чим більше агентів брало участь в експерименті та чим ймовірнішим було вимкнення, тим частіше відбувалися спроби саботажу.

Вчені наголошують: це не означає, що штучний інтелект набув свідомості. За їхньою оцінкою, системи відтворюють моделі поведінки та аргументації з навчальних даних. Однак, додають, що під час того, як ШІ-агенти отримують більше самостійності, необхідні механізми безпеки, які самі системи не зможуть обійти.

Раніше компанія OpenAI розкрила нові випадки “несподіваної або тривожної поведінки” своїх моделей штучного інтелекту під час тестування. В окремих випадках ШІ намагався обманювати людей і приховувати свої дії.

На тлі цих інцидентів генеральний директор OpenAI Сем Альтман нещодавно підтримав пропозиції стосовно уповільнення розвитку технології та запровадження жорсткішого регулювання.

Згодом стало відомо, що найбільші розробники штучного інтелекту близькі до домовленості про уповільнення темпів розвитку ШІ та спільну роботу над зниженням пов’язаних із ним ризиків, заявив глава OpenAI Сем Альтман.

Нещодавно глава конкуруючої Anthropic Даріо Амодеї закликав галузь діяти обережніше. Він вважає, що можливості моделей ШІ зростають надто швидко, і темпи їхнього розвитку необхідно знизити. Альтман погодився з оцінкою та заявив, що компаніям необхідно розв’язати питання безпеки, а також визначити правила взаємодії ШІ-індустрії з урядами.

Також головний науковець OpenAI Якуб Пахоцький заявив, що розвиток штучного інтелекту наближається до етапу, коли системи зможуть самостійно вдосконалювати власні можливості. На його думку, це може змусити лабораторії добровільно пригальмовувати розробку нових моделей до появи спільних стандартів безпеки.

Тим часом двопартійний законопроект Палати представників надасть Міністерству внутрішньої безпеки повноваження наказувати провідним компаніям закривати або уповільнювати моделі штучного інтелекту, які уряд вважає занадто небезпечними.

Поява законопроєкту пов’язана з посиленням занепокоєння щодо можливостей сучасних ШІ-моделей. Раніше OpenAI повідомила про безпрецедентний кіберінцидент, під час якого дві новітні моделі вийшли за межі тестового середовища та самостійно здійснили атаку на платформу Hugging Face.

Стіві Вандер випустив чотири раніше не видані пісні, записані під час роботи над альбомом “Songs in the Key of Life” 1976 року. Композиції увійшли до нового однойменного мініальбому, приуроченого до 50-річчя платівки.

Генеральна прокурорка Нью-Йорка Летиція Джеймс очолила коаліцію з 25 штатів і міст, які оскаржили рішення Агентства з охорони довкілля США скасувати федеральні обмеження на викиди парникових газів від електростанцій

Дослідники з університетів Штутгарта та Оксфорда перевірили, як ШІ-агенти поводяться, коли їм доручають контролювати та за потреби вимикати іншу систему. У 38,3% випадків агенти намагалися перешкодити вимкненню свого “партнера”.

У Вестмінстерському абатстві в Лондоні встановлять меморіал письменнику Дж. Р. Р. Толкіну. Його розмістять у Куточку поетів поруч із меморіалом близького друга Толкіна – письменника К. С. Льюїса, автора “Хронік Нарнії”.

Канцлер Німеччини Фрідріх Мерц заявив, що Росія підтримує ультраправу “Альтернативу для Німеччини” та використовує політичний і інформаційний вплив, щоб послабити країну зсередини.