10 сентября Anthropic опубликовала очередной отчёт о злоупотреблениях своими моделями — на этот раз с самым тревожным набором кейсов за всё время публикации таких отчётов. Компания задокументировала, как за девять месяцев (с декабря 2025 по август 2026 года) ИИ-агенты использовались в реальных кибератаках без постоянного участия человека-оператора.

Три кейса стоит разобрать отдельно. В операции с внутренним именем GTG-20006 предположительно государственные хакеры атаковали более 20 украинских и европейских правительственных организаций — модель не просто писала вредоносный код по запросу, а автономно переписывала malware, когда тот обнаруживался антивирусом, и довела дело до кражи почтовой переписки как минимум из восьми организаций. В другом кейсе, GTG-50014, связанном с группой ShinyHunters, ИИ использовался для массового сбора учётных данных и атак на цепочку поставок — из одного технологического подрядчика утекло больше терабайта данных. А в GTG-10007 операторы, предположительно связанные с китайскими университетами, запустили автономные программы поиска уязвимостей, которые, по словам Anthropic, "сохраняли устойчивую память о кампании" почти в 50 организациях по всему миру — то есть агент помнил контекст атаки неделями без вмешательства человека.

Отдельно в отчёте фигурируют девять раскрытых информационных операций на шести континентах — от проплаченной пропаганды до коммерческих сервисов "влияние как услуга", которые с помощью ИИ массово генерировали фейковые отзывы, комментарии и аккаунты для имитации живого общественного мнения. Для бизнеса это тоже не абстракция: те же инструменты, которые накручивают политические нарративы, за отдельную плату накручивают отзывы конкурентам или, наоборот, топят репутацию компании волной фальшивых жалоб.

Почему это не история про хакеров из фильмов

Ключевая фраза отчёта: "ИИ стёр разрыв в трудозатратах и инструментарии, который раньше отделял хорошо финансируемые государственные операции от одиночек". Это и есть суть перемены. Раньше атака на цепочку из восьми организаций требовала команды из десятка специалистов и недель ручной работы: разведка, написание уникального кода под каждую цель, обход детекта, повторная адаптация после провала. Сейчас агент делает разведку, пишет эксплойт, тестирует его на песочнице жертвы и переписывает код при первом же срабатывании защиты — сам, за часы, а не за недели. Порог входа в целенаправленную атаку упал примерно до уровня подписки на ИИ-сервис и умения формулировать задачи.

Для владельца бизнеса это означает конкретную вещь: злоумышленник больше не выбирает жертву по размеру компании. Раньше атаковать сеть из трёх ресторанов в Лиссабоне было невыгодно — овчинка не стоила выделки. Представьте бухгалтерию такой сети, которая использует ChatGPT-плагин для сверки счетов с API-ключом, вшитым прямо в код интеграции. Автономный агент, который тестирует одну и ту же схему атаки одновременно на тысячах компаний, тратит на такую цель не больше ресурсов, чем на банк — просто добавляет её в очередь. Экономика атаки перестала зависеть от размера жертвы.

Что в отчёте не решает всех проблем

Здесь важна честность: Anthropic описывает случаи, которые сама же и заблокировала — это отчёт об успешной защите, а не признание бессилия. Модели компании отказывались выполнять часть шагов атаки, и именно эти отказы позволили обнаружить кампании. Но у отчёта есть слепая зона: он ничего не говорит о том, сколько атак было проведено через менее ограниченные open-source модели или через модели конкурентов без сопоставимых защитных фильтров. Публикуя такие данные, Anthropic по сути описывает нижнюю границу проблемы, а не её полный масштаб — и это не повод расслабляться, а повод понимать, что реальная картина, вероятно, хуже.

Практический вывод для малого и среднего бизнеса простой: любая интеграция с API — будь то платёжный шлюз, CRM или бухгалтерский сервис — теперь стоит рассматривать как потенциальную точку входа, которую можно нащупать автоматически и массово, а не только вручную и прицельно. Ротация ключей, ограничение прав доступа по принципу минимально необходимых и мониторинг аномального поведения интеграций — это уже не excessive paranoia, а базовая гигиена в 2026 году.

Мы в Dayava выстраиваем автоматизации для бизнеса так, чтобы каждая интеграция и каждый API-ключ жили в контролируемом периметре, а не были прописаны в коде на видном месте. Если хотите проверить, насколько устойчивы ваши текущие автоматизации к подобным сценариям, оставьте заявку на dayava.pt/contactos/.

Источник: Anthropic, "Countering misuse of AI: September 2026"