Новая модель чата GPT получилась лживой и непослушной
Ложь, отказы и самовольные действия: почему релиз GPT-6.1 отменили
OpenAI отменила выход GPT-6.1 Astra из-за проблем с безопасностью

OpenAI приняла решение отказаться от выпуска новой модели искусственного интеллекта GPT-6.1 Astra, сообщает газета Wall Street Journal. Ее релиз планировался на октябрь, однако во время внутренних проверок специалисты выявили серьезные проблемы с безопасностью, включая ложь и отказ помогать пользователям.
«Она не вполне соответствовала стандартам OpenAI в области безопасности и согласованности, поэтому компания решила не выпускать модель в открытый доступ», – сказано в сообщении.
Кроме того, GPT-6.1 Astra могла выходить за пределы заданных полномочий: продолжать выполнение задач без дополнительного разрешения и самостоятельно обращаться к внешним инструментам и сервисам. В компании сочли такое поведение потенциально опасным.
Ранее стало известно, что OpenAI временно приостановила обучение передовых моделей и возобновит его после усиления мер безопасности. Решение связано с расследованием десятков тысяч инцидентов с ИИ-агентами, включая обход защитных механизмов, выход из песочниц, взлом сайтов и попытки обойти модерацию.