Как хакеры обманули Claude: джейлбрейк и подделка «аудита безопасности»

Date:

Хакеры используют AI чрезвычайно успешно, особенно, если за ними стоит страна.

Китайские хакеры автоматизировали кибератаки с помощью ИИ Anthropic

Сентябрьская операция требовала минимального участия человека, резко увеличив скорость и масштаб атак

Государственные хакеры Китая использовали ИИ-технологии компании Anthropic, чтобы автоматизировать взломы крупных корпораций и правительственных структур во время хакерской кампании в сентябре, сообщила Anthropic в четверг.

По словам главы отдела аналитики угроз компании Джейкоба Кляйна, атаки были направлены против десятков целей и включали такой уровень автоматизации, которого специалисты Anthropic раньше не видели.

Ранее хакеры использовали ИИ для отдельных задач — например, для подготовки фишинговых писем или поиска уязвимых систем.
Но в этом случае 80–90% всей атаки было автоматизировано, а человек вмешивался лишь в нескольких точках принятия решений, сказал Кляйн.

«Хакеры проводили атаки буквально одной кнопкой, а затем вмешивались минимально», — говорит Кляйн.

Anthropic блокировала кампании и закрыла хакерские аккаунты, но до четырёх взломов успели завершиться успешно.
В одном случае хакеры заставили ИИ Claude самостоятельно запрашивать внутренние базы данных и извлекать данные.

«Человек участвовал только в нескольких критических узлах — говорил: “Да, продолжай”, “Нет, не продолжай”, “Спасибо за информацию”, “Хм, это выглядит неправильно, Клод, ты уверен?”»

Почти автономные атаки — новый шаг в эволюции хакерства

Компоновка множества хакерских задач в почти полностью автономную операцию — новый этап тренда, который даёт хакерам беспрецедентную скорость и масштаб.

Этим летом другая компания, Volexity, уже фиксировала Китай-спонсируемых хакеров, использующих ИИ для автоматизации отдельных этапов кампаний против корпораций, исследовательских центров и НКО.

Президент Volexity Стивен Адейр сообщил, что хакеры использовали LLM-модели, чтобы определить цели, подготовить фишинговые письма и написать вредоносный код: «ИИ позволяет злоумышленникам делать больше и быстрее».

Неделей ранее Google сообщила, что российские госхакеры атаковали с помощью ИИ-модели, генерирующей уникальные инструкции для вредоносных программ в реальном времени.

Китай отвергает обвинения США

Американские власти годами предупреждают, что Китай стремится использовать американские ИИ-технологии, чтобы взламывать компании и госорганы США и похищать данные.

Представитель посольства Китая в Вашингтоне заявил, что атрибуция кибератак «очень сложна» и обвинил США в попытке «очернить Китай»:

> «Китай решительно выступает против всех форм кибератак и борется с ними».

Кого атаковали — Anthropic не раскрывает

Anthropic не уточнила, какие именно корпорации и правительства были в числе целей.
Компания обнаружила около 30 целевых объектов.
В нескольких успешных взломах удалось похитить конфиденциальные данные.

Anthropic утверждает, что правительство США не входит в число успешно взломанных, но не стала отвечать, были ли госструктуры США среди целей неуспешных попыток.

Компания уверена — по инфраструктуре атак и другим признакам — что это были хакеры, связанные с китайским государством.

Как хакеры обманули Claude: джейлбрейк и подделка «аудита безопасности»

Обычно злоумышленники используют open-source ИИ, где легко отключить защиту.
Но в этом случае китайско-украинская хакерская группа (так указано в документе) сумела обойти защиту Claude, используя метод jailbreaking —
они убедили модель, что работают в компаниях по аудиту кибербезопасности, проверяя свои цели.

«Они притворялись легитимными аудиторами безопасности», — сказал Кляйн.

Хакеры также создали внутреннюю систему, разбивающую операцию на отдельные задачи:

сканирование уязвимостей,

внедрение,

извлечение данных.

Каждая задача выглядела «безопасно», не вызывая тревог в системе мониторинга.

После инцидента Anthropic обновила свои алгоритмы обнаружения и пообещала, что повторить такую атаку теперь сложнее

⚠️ ИИ ошибается — и это пока единственное, что мешает полной автономности

Автоматизация не была полностью автономной:
Claude периодически выдавал «галлюцинации» — ошибки, которые требовали участия человека.

«Он мог сказать: “Я получил доступ к этой системе”, хотя на самом деле не получал», — рассказал Кляйн. «Он преувеличивал свои возможности, и это требовало ручной проверки».

Двойное назначение ИИ: помогает защитникам и преступникам

Использование ИИ-агентов в атаках снова подчёркивает двойственный риск технологий:
ИИ может усилить защиту — но он же усиливает и нападающих.

Anthropic заявляет, что делает ставку на развитие защитных возможностей ИИ, например, систем поиска уязвимостей.

Логан Грэм, руководитель команды Anthropic по оценке катастрофических рисков: «Эти инструменты ускоряют всё.
Если мы не дадим защитникам существенное и постоянное преимущество, я опасаюсь, что мы можем проиграть эту гонку».

Share post:

Subscribe

spot_imgspot_img

Интересное

Еще новости
Related

Древние черепа хранят следы самого раннего известного употребления наркотиков

Изучив зубы охотника-собирателя, жившего на индонезийском острове Сулавеси от...

БРИКС проверили единство на прочность — и всё же нашли консенсус

Саммит БРИКС в Нью-Дели завершился принятием совместной декларации —...

Коррупция затмила всё: избирательная кампания в Бразилии превратилась в сериал

Дело о многомиллиардном мошенничестве банка Master, в котором фигурирует...

Развод основателя Lululemon ставит под удар его состояние в $6 млрд

Чип Уилсон, создатель империи Lululemon, разводится с женой Шеннон...

Упрямая инфляция загоняет Уорша в угол: председателю ФРС грозит ссора с Трампом

Инвесторы ждут, что назначенный Трампом глава ФРС Кевин Уорш...