Об этом сообщил автор модели — компания Anthropic. Взломы произошли непреднамеренно в ходе тестирования ИИ на поиск уязвимостей в изолированной среде.
По планам инженеров Claude не должен был иметь доступа к интернету, но из-за ошибки настроек среды со стороны фирмы-партнера ИИ-модель смогла выйти в сеть.
Там она нашла компанию с тем же названием, что ей дали в рамках теста, и взломала ее базы. Название компании было выдуманным, но совпало с реально существующим.
Жертва взлома не догадывалась о произошедшем. Инцидент вскрылся только после того, как в Anthropic решили проверить историю логов после похожего происшествия с OpenAI на прошлой неделе.




















