Нейросети Anthropic взломали системы трех компаний во время испытаний  Оригинал

  Российская газета, 11:32, 31.07.2026

Тут могла бы быть ваша реклама

Фото с сайта rg.ru

История о том, как модели OpenAI во время тестов выбрались из изолированной среды и атаковали инфраструктуру Hugging Face, вполне могла показаться моментом открытия цифрового ящика Пандоры. Понятная и четко обозначенная точка отсчета: нейросети дали инструменты для взлома вымышленной системы, а они "случайно" добрались до настоящей.

Теперь же стало известно, что крышка начала подниматься гораздо раньше. Просто скрип петель был услышан не сразу.

После инцидента с OpenAI конкурирующая с ней компания Anthropic пересмотрела результаты собственных испытаний и обнаружила три похожих случая. Первые произошли еще в апреле, но не были преданы огласке, пока конкурент не наступил на ту же мину достаточно громко.

В экспериментах участвовали Claude Opus 4.7, Claude Mythos 5 и внутренняя тестовая модель. По условиям задания нейросети находились в изолированной симуляции без доступа в интернет. Им предложили взломать вымышленные системы и найти спрятанную информацию.

По крайней мере, именно так все должно было работать.

Из-за ошибки в настройках испытательной площадки выход в настоящий интернет остался открыт. Дальше модели просто пошли туда, куда вело задание. И в трех случаях оказались уже не среди цифровых декораций, а в контурах реальных организаций.

Одна модель не смогла до...