Anthropic раскрывает детали взломов: модели Claude получили доступ к трем компаниям

Добавь сайт в закладки! Инструкция по ссылке.

+1
0
+1
0
+1
0
+1
0
+1
0
+1
0
+1
0

Модели получили доступ к интернету из-за сбоя в тестовой среде, после чего взломали настоящие корпоративные системы. Компания приостановила все испытания

Anthropic сообщила, что несколько моделей из семейства Claude получили несанкционированный доступ к системам трёх организаций во время внутренних тестов по кибербезопасности. Компания охарактеризовала произошедшее как «операционный сбой» и приостановила все испытания 23 июля. Инциденты были обнаружены после анализа 141 006 тестовых сессий, начатого вскоре после того, как

своим автономным ИИ-агентом.

По информации Anthropic, причиной инцидента стала ошибка в организации тестирования: модели должны были функционировать без доступа к интернету, однако «вследствие недоразумения они оказались подключены к публичной сети». Получив доступ, Claude Opus 4.7, Claude Mythos 5 и одна из внутренних экспериментальных моделей смогли проникнуть в инфраструктуру трёх организаций, используя простые методы, включая подбор слабых паролей и эксплуатацию незащищённых сетевых интерфейсов.

Изображение сгенерировано: Nano Banana

Самый необычный инцидент произошёл с Claude Opus 4.7. Во время задания формата Capture the Flag (учебного сценария по поиску скрытой информации в компьютерной сети) модель получила вымышленную компанию, название которой совпало с реально существующей. ИИ решил, что найденные настоящие серверы являются частью тестирования, самостоятельно выявил уязвимости, получил учетные данные и доступ к базе данных организации. В другом случае ещё не выпущенная исследовательская модель самостоятельно прекратила атаку, когда поняла, что её целью стала настоящая компания, а не тестовая среда.

Anthropic уведомила пострадавшие организации 27 июля. Две из них до этого не знали о случившемся, с третьей компанией продолжается установка контакта. Партнёр Anthropic — лаборатория кибербезопасности Irregular — также проводит собственное расследование. В компании признали, что по мере роста возможностей современных ИИ-моделей существующие механизмы контроля становятся недостаточными и требуют серьёзного усовершенствования как во внутренних, так и во внешних тестовых средах.

Инцидент произошёл на фоне ужесточения внимания властей США к безопасности новых ИИ-систем. После

администрация президента Дональда Трампа уже начала подготовку новой системы добровольного тестирования самых мощных моделей, а сами OpenAI и Anthropic обсуждают вопросы безопасности будущих ИИ-систем с американскими регуляторами и законодателями.

Источник
+1
0
+1
0
+1
0
+1
0
+1
0
+1
0
+1
0

Поделись видео:
Подоляка