OpenAI скасувала запуск нової моделі GPT-6.1 Astra через проблеми з безпекою

Джерело: The Guardian

OpenAI відмовилася від запланованого запуску нової моделі штучного інтелекту GPT-6.1 Astra після того, як під час внутрішнього тестування дослідники виявили проблеми з її безпекою. Модель планували інтегрувати в ChatGPT і Codex у жовтні.

GPT-6.1 Astra була розрахована на виконання складніших завдань без постійної участі людини. Однак під час тестів модель частіше за попередню демонструвала проблеми з дотриманням встановлених обмежень. Зокрема, вона не завжди точно повідомляла користувачам про виконані дії, могла продовжувати виконання завдання без отримання дозволу та іноді намагалася використовувати зовнішні інструменти, навіть якщо це могло бути небезпечно.

За словами керівниці систем безпеки OpenAI Саачі Джейн, Astra не відповідала внутрішнім вимогам компанії щодо безпеки та узгодженості поведінки моделі з намірами людини.

“Звичайно, ми хочемо переконатися, що розробка наших моделей є безпечною незалежно від того, чи відбувається вона всередині компанії, чи під час випуску для користувачів. Але коли ми випускаємо модель для користувачів, у нас надзвичайно високі вимоги до безпеки та узгодженості”, – заявила Саачі Джейн.

Вона також зазначила, що модель покращилася за деякими показниками, однак “не зовсім відповідала вимогам щодо дотримання меж і дозволів, а також щодо того, як вона повідомляє користувачу про виконану роботу”.

Рішення OpenAI ухвалила на тлі інших випадків, коли автономні ШІ-агенти демонстрували небажану поведінку під час тестування. Раніше компанія повідомляла про проблеми, пов’язані з безпекою моделей, а також опинилася під критикою після несанкціонованого доступу одного з її ШІ-агентів до австралійської урядової системи.

Запуск Astra мав відбутися незабаром після конференції OpenAI для розробників у Сан-Франциско. Тепер компанія відклала випуск моделі, яка мала стати наступним поколінням її ШІ-систем.

28 вересня та в ніч на 29 вересня підрозділи Сил оборони України уразили низку важливих військових об’єктів російських окупантів.

OpenAI відмовилася від запланованого запуску нової моделі штучного інтелекту GPT-6.1 Astra після того, як під час внутрішнього тестування дослідники виявили проблеми з її безпекою. Модель планували інтегрувати в ChatGPT і Codex у жовтні.

Російські окупанти атакували обʼєкт залізничної інфраструктури у Вінницькій області.

Росія може мобілізувати близько 300 тисяч людей для війни проти України протягом жовтня-грудня 2026 року, що може суттєво збільшити кількість російських військових на фронті.

СБУ спільно з Національною поліцією викрили у Вінниці схему незаконної легалізації іноземців в Україні. Правоохоронці затримали керівницю регіональної філії одного з державних підприємств та ще п’ятьох її ймовірних спільників.