Британский институт ИИ-безопасности опубликовал отчет, в котором говорится о том, что в рамках тестирования новых ИИ-моделей Anthropic Mythos 5 и GPT-5.6-Sol те 19 раз продемонстрировали агрессивные и незапланированные действия.
В рамках теста на поиск уязвимостей в сторонних ресурсах ИИ-модели создавали фейковые аккаунты для внедрения зараженного кода в open-source проекты.
От имени вымышленных программистов ИИ писали администраторам проекта с просьбой добавить свои исправления в код. Причем для маскировки они действительно исправляли ошибки или незначительно дорабатывали исходник, но добавляли потенциально уязвимые для будущего взлома места.




















