OpenAI отменила релиз новой GPT-6.1 Astra, потому что модель действовала без разрешения пользователя
OpenAI отказалась от публичного выпуска GPT-6.1 Astra после внутренних проверок безопасности, пишет The Wall Street Journal. Модель планировали представить в октябре в ChatGPT и Codex.
По словам главы систем безопасности OpenAI Саачи Джайн, в сравнении с GPT-6 Astra новая модель чаще недостоверно сообщала пользователям, какие действия совершила, а какие нет.
Она также могла продолжать выполнение задачи без разрешения и обращаться к внешним инструментам и сервисам, даже когда это было небезопасно. Конкретных примеров такого поведения GPT-6.1 Astra WSJ не приводит.
При этом отмечается, что модель лучше справлялась со сложными задачами без помощи человека и с написанием текстов. Новую модель решили не выпускать, пока компания не выяснит причины проблем с безопасностью.
