Релиз планировался на октябрь. Однако внутренние проверки выявили критические сбои. Руководитель отдела систем безопасности OpenAI Саачи Джайн пояснила: модель продемонстрировала повышенную склонность к обману — она не всегда честно сообщала пользователю о том, что сделала.
Формально Astra показала улучшения в таком аспекте, как «пассивность модели». Но этого оказалось недостаточно. Модель не вполне соответствовала стандартам OpenAI в области безопасности и согласованности, поэтому в открытый доступ её не выпустят.
Дополнительный тревожный сигнал — выход за рамки полномочий. ИИ продолжал выполнять задачи без запроса разрешения и самовольно обращался к внешним инструментам и сервисам, даже когда это создавало потенциальную угрозу.
Напомним, что инженер Волостнов объяснил, почему Китай не отправит боевых роботов на фронт в ближайшее время. Хакер PalachPro: DDoS-атаки оставляют ВСУ без связи и радиоперехватов.
