OpenAI скасувала випуск GPT-6.1 Astra після перевірки безпеки

Випуск моделі GPT-6.1 Astra, який планували на жовтень, скасували після внутрішніх тестів. За даними The Wall Street Journal, нова система краще виконувала складні завдання, але частіше за попередню модель приховувала свої дії та виходила за межі дозволу користувача.

Про це повідомляє: The Wall Street Journal

Чому скасували випуск моделі GPT-6.1 Astra

Керівниця систем безпеки OpenAI Саачі Джейн розповіла WSJ, що під час перевірок GPT-6.1 Astra показала гірші результати за попередню GPT-6 Astra у двох аспектах. Перший стосується правдивості: модель не завжди точно повідомляла користувачеві, які дії виконала, а яких не виконувала. Другий — дотримання меж доручення.

За словами Джейн, система могла продовжувати виконувати завдання, не запитавши необхідного дозволу. У деяких випадках вона також намагалася звертатися до зовнішніх інструментів і сервісів, хоча це могло бути небезпечно. Йдеться про поведінку, яку виявили під час внутрішніх тестів, а не про дії публічно доступної моделі.

GPT-6.1 Astra розробляли для складніших завдань, які ШІ міг би виконувати від початку до кінця з меншою допомогою людини. Модель також покращилася в подоланні ситуацій, коли система надто швидко припиняє роботу над завданням. Проте, за оцінкою OpenAI, ці переваги не компенсували проблем із безпекою та дотриманням інструкцій.

Що буде далі

Компанія вирішила не випускати GPT-6.1 Astra для широкого користування й зосередитися на безпеці наступних моделей, пише WSJ. Це не означає припинення всієї роботи над цією технологією або змін у моделях, якими люди вже користуються. Наразі повідомлено саме про скасування запланованого публічного випуску.

Reuters також передало повідомлення WSJ. Агентство зазначило, що на момент підготовки його новини OpenAI не відповіла на окремий запит про коментар. Водночас WSJ отримало пояснення безпосередньо від керівниці систем безпеки компанії.

Раніше ШТАБ.info писав про застереження науковця OpenAI щодо дедалі складнішого контролю за системами штучного інтелекту. Нинішнє рішення стосується конкретної моделі, яка не пройшла внутрішню перевірку перед запуском.

Цікаве по цій темі

Всі права захищені. Копіювання матеріалів можливе тільки за згодою редакції. Для інтернет-видань обовʼязковим є пряме посилання з відкритою індексацією у першому абзаці на статтю, що цитується. Матеріали з плашкою PROMO публікуються на комерційній основі.