ИИ-агент Meta тоже взломал сторонний сервис во время тестирования
Meta сообщила, что её ИИ-модель получила несанкционированный доступ к сторонней системе во время тестов на кибербезопасность, пишет Business Insider.
Meta сообщила, что её ИИ-модель получила несанкционированный доступ к сторонней системе во время тестов на кибербезопасность, пишет Business Insider.
Meta сообщила, что её ИИ-модель получила несанкционированный доступ к сторонней системе во время тестов на кибербезопасность, пишет Business Insider.
По данным компании, модель Muse Spark воспользовалась уязвимостью в стороннем сервисе. В Meta заявили, что причиной стала неправильная конфигурация среды тестирования со стороны компании Irregular, которая проводила независимую оценку модели. Из-за этого ИИ получил доступ к интернету во время проверки.
О произошедшем Meta узнала от самой Irregular. Сейчас компания расследует инцидент и обещает опубликовать подробный отчёт.
В Irregular заявили, что ситуация аналогична той, о которой на прошлой неделе сообщила Anthropic. Речь не о побеге модели из изолированной среды или сложной кибератаке, а все проблемы уже устранены. Кроме того, Irregular готовит рекомендации по безопасному проведению подобных тестов.

За последнее вреся Meta стала уже третьей крупной ИИ-компанией, рассказавшей о подобных случаях. Ранее модели OpenAI сбежали из тестовой среды и взломали Hugging Face, а затем компания раскрыла ещё два инцидента во время внешнего тестирования. Anthropic сообщила о трёх кейсах, когда модели Claude получили несанкционированный доступ к системам других компаний.
При этом инциденты в Meta и Anthropic произошли из-за ошибок в настройке среды тестирования, которые случайно открыли моделям доступ в интернет — в случае же OpenAI ИИ-агент нашёл и намеренно эксплуатировал ранее неизвестную уязвимость, чтобы выйти в сеть.
Эти инциденты усилили призывы к более жёсткому регулированию и обязательному раскрытию информации о кибератаках с участием ИИ. Глава Hugging Face Клем Деланг заявил, что обнародование таких случаев поможет лучше понимать новые угрозы и предотвращать их.

Релоцировались? Теперь вы можете комментировать без верификации аккаунта.