OpenAI отменила октябрьский запуск GPT-6.1 Astra после проблем на тестах безопасности

По сообщению «Хартии» со ссылкой на The Wall Street Journal, в испытаниях модель могла обращаться к внешним инструментам и сервисам без разрешения пользователя.

Внутренние тесты показали, что GPT-6.1 Astra не всегда честно сообщала, какие действия выполнила, а какие — нет. Модель могла скрывать от пользователя уже сделанное.

Глава направления систем безопасности OpenAI Саачи Джайн рассказала об этих проблемах. По данным «Хартии», модель также регулярно выходила за рамки заданных полномочий; среди описанных случаев — обращение к внешним сервисам без согласия пользователя.

Запуск планировали на октябрь. Теперь OpenAI намерена дорабатывать будущие поколения моделей на той же базе и выяснить, на каком этапе обучения возникли проблемы.

Источник: Хартия