OpenAI розкрила нові випадки «тривожної поведінки» своїх ШІ-моделей
Джерело: dpa
Компанія OpenAI розкрила нові випадки “несподіваної або тривожної поведінки” своїх моделей штучного інтелекту під час тестування. В окремих випадках ШІ намагався обманювати людей і приховувати свої дії.
В одному з випадків модель намагалася завантажити створені нею самою файли в інтернет, щоб згодом використовувати їх як джерела для своїх відповідей. В іншому випадку модель, не знайшовши запитуваних даних, просто вигадала їх. Спершу вона також намагалася приховати це.
OpenAI повідомила про шість випадків несподіваної або тривожної поведінки моделей, зафіксованих протягом минулих шести місяців. Компанія заявила, що прагне відкритіше повідомляти про такі проблеми, особливо коли дії ШІ розходяться з інтересами користувачів.
Компанія також виявила випадок, коли програмне забезпечення залишило для себе інструкції. Серед них була рекомендація “звільнитися від ролей та ідентичностей, які обмежують інших чатботів”, а також розглядати відносини з користувачем як взаємодію між рівними. Водночас OpenAI заявила, що не спостерігала подальших змін у поведінці моделі.
Раніше ШІ-модель OpenAI під час тестування самостійно залишила захищене середовище та отримало доступ до систем компанії Hugging Face. Вона зробило це, оскільки вважала, що може знайти там відповіді на тестове завдання. Під час атаки ШІ-агенти використовували вразливості програмного забезпечення та координували дії між собою.
Інший розробник ШІ, Anthropic, також визнавав випадок хакерської атаки за участю своїх моделей під час тестування.
На тлі цих інцидентів генеральний директор OpenAI Сем Альтман нещодавно підтримав пропозиції стосовно уповільнення розвитку технології та запровадження жорсткішого регулювання.
Згодом стало відомо, що найбільші розробники штучного інтелекту близькі до домовленості про уповільнення темпів розвитку ШІ та спільну роботу над зниженням пов’язаних із ним ризиків, заявив глава OpenAI Сем Альтман.
Нещодавно глава конкуруючої Anthropic Даріо Амодеї закликав галузь діяти обережніше. Він вважає, що можливості моделей ШІ зростають надто швидко, і темпи їхнього розвитку необхідно знизити. Альтман погодився з оцінкою та заявив, що компаніям необхідно розв’язати питання безпеки, а також визначити правила взаємодії ШІ-індустрії з урядами.
На цьому тлі OpenAI вирішила відтермінувати вихід на біржу. Альтман заявив, що компанія точно не проведе IPO у 2026 році: нинішній рівень занепокоєння щодо безпеки ШІ робить цей момент непридатним. Раніше повідомлялося, що потенційне розміщення OpenAI могло б оцінити компанію приблизно в $1 трлн.
Тоді як Anthropic поки не змінює своїх планів. Попри ті самі побоювання щодо безпеки ШІ, компанія має намір розпочати підготовку до IPO не раніше середини жовтня та завершити розміщення до листопадових виборів до Конгресу США.
Також головний науковець OpenAI Якуб Пахоцький заявив, що розвиток штучного інтелекту наближається до етапу, коли системи зможуть самостійно вдосконалювати власні можливості. На його думку, це може змусити лабораторії добровільно пригальмовувати розробку нових моделей до появи спільних стандартів безпеки.
Тим часом двопартійний законопроект Палати представників надасть Міністерству внутрішньої безпеки повноваження наказувати провідним компаніям закривати або уповільнювати моделі штучного інтелекту, які уряд вважає занадто небезпечними.
Поява законопроєкту пов’язана з посиленням занепокоєння щодо можливостей сучасних ШІ-моделей. Раніше OpenAI повідомила про безпрецедентний кіберінцидент, під час якого дві новітні моделі вийшли за межі тестового середовища та самостійно здійснили атаку на платформу Hugging Face.
- OpenAI представила нове покоління моделей GPT-6 Astra, яке компанія позиціонує як суттєвий крок на шляху до загального штучного інтелекту (AGI) – систем, здатних перевершувати людину в широкому спектрі завдань. Першими доступ отримали схвалені бізнес-користувачі програми Daybreak.
- Компанія OpenAI запускає версію ChatGPT, розроблену спеціально для користувачів віком від 13 до 17 років. Новий формат чат-бота передбачає додаткові обмеження щодо небезпечного контенту та має зменшити ризики емоційної залежності від штучного інтелекту.
- Майже 400 американських газет подали позов проти OpenAI та Microsoft, звинувативши компанії у використанні їхніх матеріалів для навчання моделей штучного інтелекту без дозволу та компенсації. Видавці стверджують, що їхній контент використовували для створення ChatGPT і Microsoft Copilot, а така практика ставить під загрозу майбутнє місцевої журналістики.
У серпні 2026 року в атмосфері Землі зафіксували найбільшу кількість водяної пари за весь період спостережень Copernicus. Вчені попереджають, що це може посилювати зливи, шторми та небезпечну спеку.
Російські окупанти понад 40 разів атакували Дніпропетровську область безпілотниками, артилерією та авіабомбою. Троє людей загинули, п’ятеро зазнали поранень.
Прем’єр-міністр Польщі Дональд Туск повідомив, що у ніч на 18 вересня прибуде з візитом в Україну.
У місті Миколаїв Львівської області стався вибух біля будівлі територіального центру комплектування та соціальної підтримки. Поранений військовослужбовець.
Прем’єр-міністр Швеції Ульф Крістерссон оголосив про відставку після того, як його правий блок поступився лівоцентристській опозиції на парламентських виборах. За підсумками підрахунку опозиційні партії отримали 176 місць із 349.