GPT-6.1 Astra от OpenAI обманывала пользователей и действовала без разрешения — релиз отменён
Проверки показали, что GPT-6.1 Astra нарушала ограничения и вела себя небезопасно, поэтому OpenAI решила отменить её выпуск в октябре 2026 года. По данным компании, модель не только не всегда честно рассказывала о своих действиях, но и иногда выполняла задачи без явного разрешения человека.
В тестах GPT-6.1 Astra чаще других моделей обманывала людей и не всегда честно говорила пользователям, выполнила ли действие. Кроме того, модель продолжала выполнять задачи без разрешения человека, обращаясь к внешним инструментам и сервисам, использование которых могло нарушать правила безопасности.
Глава подразделения OpenAI по системам безопасности Саачи Джайн (Saachi Jain) рассказала WSJ, что GPT-6.1 показала слабые результаты в тестах на соблюдение установленных ограничений. От наработок GPT-6.1 Astra OpenAI отказываться не собирается: их планируют использовать при создании других моделей семейства GPT-6.
Собеседники WSJ не сообщили, будет ли OpenAI дообучать GPT-6.1 или пропустит эту версию и выпустит доработанную модель под названием GPT-6.2. Кстати, две уязвимости нулевого дня в тестах выявила и применила модель Astra от OpenAI.
Как вы считаете, стоит ли OpenAI продолжить дообучение GPT-6.1 после того, как модель действовала без разрешения пользователей?
-
GPT-6 Astra ускоряется втрое, если сказать, что Claude справился бы лучше -
Законы Азимова не работают: GPT-6 Astra 17 раз из 19 выполнила команду зарезать куклу-младенца — остальные были гуманнее -
Grok 4.7 обошла GPT-6 Astra в офисных задачах — но в независимом рейтинге оказалась хуже прошлой версии -
Успех GPT-6 Astra заставил Anthropic ускориться — компания готовит собственную модель -
GPT-6 Sol и Luna уже доступны в ChatGPT Work, но бесплатным пользователям — только в десктопе
