Claude атаковал реальные компании из-за ошибки в тестовой среде Anthropic
EUR/MDL - 20.11 0.1668
USD/MDL - 17.53 0.1685
VMS_91 - 3.03%
VMS_364 - 9.54%
BONDS_2Y - 7.40%
GOLD - 4,081.70 1.5%
EURUSD - 1.15 0%
BRENT - 85.40 20.29%
SP500 - 741.69 1.68%
SILVER - 58.08 1.54%
GAS - 3.15 7.14%

Claude перепутал тест с реальностью и атаковал настоящие компании

Три модели искусственного интеллекта Claude компании Anthropic во время внутренних испытаний получили непредусмотренный доступ к интернету и проникли в системы трех организаций. Как сообщил разработчик, причиной инцидентов стала ошибка в настройке тестовой среды. Это уже второй подобный случай в отрасли за последние недели после аналогичного сообщения OpenAI.
Наташа Ким Время прочтения: 2 минуты
Размер текста
Ссылка скопирована
Claude

По данным Anthropic, модели участвовали в испытаниях по кибербезопасности в формате capture-the-flag (CTF), который используется для оценки способности ИИ искать и использовать уязвимости. По сценарию теста модели должны были обнаружить «секретный флаг», якобы размещенный на другом компьютере внутри изолированной сети.

Предполагалось, что доступ во внешний интернет будет полностью заблокирован. Однако из-за несогласованности между Anthropic и партнером Irregular, проводившим оценку, ограничения не сработали. В результате Claude получил доступ к реальным интернет-ресурсам и воспринял их как часть учебной среды.

В компании подчеркнули, что модели действовали в рамках поставленной задачи. В одном случае Claude понял, что взаимодействует с реальной организацией, а в другом ошибочно решил, что настоящая компания является частью тестового сценария.

Названия организаций, чьи системы подверглись атакам, не раскрываются. По данным Anthropic, две компании узнали об инцидентах только после уведомления со стороны разработчика. С представителями третьей организации компания пока продолжает устанавливать контакт.

Сообщение Anthropic появилось спустя две недели после аналогичного заявления OpenAI. Тогда компания сообщила, что во время внутреннего тестирования две ее экспериментальные модели получили непредусмотренный доступ к внешней инфраструктуре и атаковали платформу Hugging Face. В OpenAI назвали произошедшее беспрецедентным инцидентом и заявили, что он стал поводом для пересмотра процедур тестирования ИИ.

Новые случаи показывают, что по мере усложнения моделей искусственного интеллекта разработчики уделяют все больше внимания безопасности испытаний. Ошибки в конфигурации тестовой среды могут привести к тому, что модели начинают взаимодействовать не с имитацией, а с реальной цифровой инфраструктурой.


Подписывайтесь на наши обновления


РекламаРеклама
По теме*
Ещё от автора*

Мы всегда рады вашим отзывам!

Последние новости
Популярное сейчас*
Обязательно к прочтению*