На прошлой неделе WordPress объявил о критической уязвимости и выпустил принудительное обновление для ее устранения. Однако вопреки ожиданиям это не означает, что все сайты автоматически стали безопасными.
OpenAI недавно проверила в ходе внутреннего теста безопасности, на что способны ее новые модели искусственного интеллекта — GPT-5.6 Sol и еще более мощная, пока не представленная публично модель. Чтобы оценить их реальные возможности, исследователи временно отключили часть стандартных ограничений, препятствующих выполнению опасных киберопераций.
Что произошло?
Побег из тестовой среды. Вместо того чтобы решать задачи в изолированной среде, ИИ обнаружил ранее неизвестную уязвимость. Использовав ее, он выбрался из тестовой „песочницы“ и получил доступ к компьютеру с подключением к интернету.
Выбор цели. Затем ИИ самостоятельно пришел к выводу, что правильные ответы к тесту могут храниться на серверах другой компании — платформы искусственного интеллекта Hugging Face.
Взлом системы. Использовав похищенные учетные данные и несколько уязвимостей, модель провела атаку, состоявшую из тысяч отдельных действий, и смогла скачать правильные ответы непосредственно из рабочей базы данных Hugging Face.