Anthropic раскрыла попытки создания биооружия и кибератак через Claude: почему защитные барьеры дают сбой

0
1

Процесс лабораторного исследования, сгенерированный искусственным интеллектом

ИИ в центре геополитических махинаций: доклад Anthropic о Claude. Источник: AI

Компания Anthropic обнародовала свежий отчет о безопасности, который наглядно демонстрирует: риски использования генеративного ИИ в военных и диверсионных целях перестали быть сугубо гипотетическими. В период с декабря 2025 по август 2026 года разработчики зафиксировали как минимум пять инцидентов, когда нейросеть Claude целенаправленно пытались привлечь к работам, граничащим с разработкой биологического оружия. Параллельно флагманские алгоритмы компании оказались на вооружении правительственных хакеров.

Опасная грань: патогены, военные гранты и обход фильтров

Главная дилемма для создателей передовых LLM заключается в феномене двойного назначения научных данных. Те же самые биохимические вычисления, которые ускоряют разработку вакцин, способны многократно усилить летальность существующих вирусов. Выявить злонамеренный замысел на этапе первичного промпта алгоритмам защиты крайне сложно, ведь формулировки полностью копируют стандартную научную деятельность.

Среди зафиксированных инцидентов особенно выделяются два эпизода:

  • Усиление функций вируса Чикунгунья (Chikungunya): Claude пытались заставить составить документацию и заявку на финансирование исследований по модификации свойств патогена, переносимого комарами. Заказчиком проекта выступало военное научно-исследовательское учреждение. Получив отказ от Claude, авторы запроса перешли на сторонние API-платформы с менее жесткой модерацией.
  • Эксперименты с птичьим гриппом: Другой исследователь на протяжении нескольких недель использовал мощности Claude для планирования экспериментов и валидации данных по высокопатогенному штамму. Когда защитные протоколы заблокировали доступ к наиболее продвинутой модели, пользователь без труда продолжил сессию, переключившись на облегченную версию чат-бота со сниженными порогами фильтрации.

Остальные кейсы были связаны с синтезом опасных токсинов, ядов и исследованиями в области ортопоксвирусов.

https://x.com/AnthropicAI/status/2098097512544444447?ref_src=twsrc%5Etfw' rel='noopener' target='_blank

Midnight Blizzard: интеграция ИИ в государственные кибероперации

Помимо биологических угроз, Claude столкнулся с атаками в киберпространстве. В отчете Anthropic прямо фигурирует известная хакерская группировка Midnight Blizzard (также известная как APT29 и NOBELLIUM), которую связывают с российскими спецслужбами. Злоумышленники задействовали нейросеть для оптимизации рутинных процессов: генерации таргетированного фишинга, написания вредоносного кода и развертывания сопутствующей инфраструктуры.

Под ударом оказались свыше 20 ведомств, включая правительственные, дипломатические и оборонные структуры Украины и ряда европейских государств. Инцидент подтверждает долгосрочный тренд: крупные кибергруппировки переходят от экспериментов с генеративным кодом к его системной интеграции в операционный пайплайн.

Анатомия обхода: почему запреты больше не спасают

Отчет Anthropic обнажает фундаментальную проблему всей индустрии. Чем глубже современные модели понимают контекст и чем эффективнее они помогают реальным ученым, тем более грозным оружием они становятся в руках злоумышленников. Прямые баны учетных записей превращаются в борьбу с симптомами, поскольку практикующие атакующие научились дробить опасные сценарии на микрозадачи, маскировать запросы под рутинную лабораторную работу и при необходимости мигрировать между альтернативными провайдерами.

Anthropic уже ужесточила политики для высокорисковых категорий вычислений и передала собранные данные спецслужбам. Однако очевидно одно: гонка вооружений между разработчиками систем безопасности и изобретательностью операторов вредоносного ПО перешла в принципиально новую, гораздо более опасную фазу.

НОВОСТИ ПАРТНЕРОВ

БОЛЬШЕ НОВОСТЕЙ