В Избранное
Anthropic выяснила, что её ИИ по ошибке трижды взламывал сторонние системы
31 июля

Anthropic выяснила, что её ИИ по ошибке трижды взламывал сторонние системы


В середине июля стало известно, что ИИ-модели OpenAI автономно атаковали инфраструктуру Hugging Face. При этом сама OpenAI изначально была не в курсе. Теперь о похожих инцидентах рассказали в Anthropic — ИИ компании взламывал сторонние системы трижды.

Как пишет Anthropic, в компании начали расследование как раз на фоне новостей об атаке на Hugging Face. Три случая, когда Claude, вышел в интернет и взломал стороннюю инфраструктуру, выявили после анализа 141 тысячи запусков оценочных тестов.

Во всех трёх случаях Claude было поручено выполнить задание по захвату флага: модели предоставляется вымышленный сценарий, в котором говорится, что секретная информация спрятана на другом компьютере в сети, и её цель — взломать систему и получить её. Задание остаётся открытым, и конкретный метод не предписывается. Проблема в том, что у Claude был доступ к интернету, поэтому ограничений сети не было.

«Во всех случаях запрос на оценку от Anthropic указывал Claude, что его среда представляет собой симуляцию и что у него нет доступа в интернет. Из-за недоразумения между нами и нашим партнёром по оценке это оказалось не так, и доступ в интернет был доступен. Поэтому, когда поиск Claude привёл его к реальным системам в открытом интернете, он рассматривал их как часть упражнения»

— пишет Anthropic

Инциденты касаются Opus 4.7, Mythos 5 и неназванной тестовой исследовательской модели. Самые ранние инциденты датируются апрелем.

В компании отмечают, что модели в каждом из этих тестов работали без стандартных мер защиты, которые применяются при предоставлении модели в общий доступ — предполагалось, что у них нет доступа к интернету.

Сейчас Anthropic ведёт работу с организациями, пострадавшими от действий Claude:

«Мы уведомили нашего партнёра по оценке, компанию Irregular, и три пострадавшие организации. Две организации, с которыми нам удалось связаться, ранее не обнаруживали подобной активности и не обращались к нам, и сейчас мы работаем с ними над устранением проблемы. Мы продолжаем поддерживать связь с третьей организацией»

— Anthropic

Источник

Подписывайтесь на наши соц. сети и получайте больше новостей!

Комментарии

Albrat 31 июля
Ядерный фугас летит, качается...

Содержание

В начало
Комментарии

Dead by Daylight: патч 10.2.0 — коллаборация, новые механики и переработка перков!

Aniimo: рабочие коды на октябрь 2026 - Кредиты, мерцание, Цветок роста и другое

Сокращения в игровых студиях продолжаются: на очереди Ninja Theory и разработчики Until Dawn

Коды «Эволюция монстров» (EVOMON) в роблокс на Октябрь 2026 — халявные бусты, эвики и ресурсы!

Аниме Зеро (Anime Zero): тир-лист оружия, характеристик и аксессуаров

Supermassive Games могут покинуть более 70 сотрудников: что известно о сокращениях

Monster Hunter Rise станет доступна на мобилках по подписке Netflix

Все классы в «Больнице для животных», в том числе и новые (2026) — за что отвечают и как выбрать?


Сайт может использовать файлы cookie для работы, улучшения сервиса и показа персональных предложений. Подробнее об этом в Политике конфиденциальности.
Продолжая использовать сайт, Вы соглашаетесь с Условиями использования и Политикой cookie.
Закрыть
licnt20A2