10 вересня Anthropic опублікувала черговий звіт про зловживання своїми моделями — цього разу з найтривожнішим набором кейсів за весь час публікації таких звітів. Компанія задокументувала, як протягом дев'яти місяців (з грудня 2025 по серпень 2026 року) ІІ-агенти використовувалися в реальних кібератаках без постійної участі людини-оператора.
Три кейси варто розглянути окремо. В операції з внутрішньою назвою GTG-20006 імовірно державні хакери атакували понад 20 українських та європейських урядових організацій — модель не просто писала шкідливий код за запитом, а автономно переписувала malware щоразу, коли той виявляв антивірус, і довела справу до крадіжки поштового листування щонайменше з восьми організацій. В іншому кейсі, GTG-50014, пов'язаному з групою ShinyHunters, ІІ використовувався для масового збору облікових даних та атак на ланцюг постачання — з одного технологічного підрядника витекло понад терабайт даних. А в GTG-10007 оператори, імовірно пов'язані з китайськими університетами, запустили автономні програми пошуку вразливостей, які, за словами Anthropic, "зберігали стійку пам'ять про кампанію" майже в 50 організаціях по всьому світу — тобто агент пам'ятав контекст атаки тижнями без втручання людини.
Окремо у звіті фігурують дев'ять розкритих інформаційних операцій на шести континентах — від оплаченої пропаганди до комерційних сервісів "вплив як послуга", які за допомогою ІІ масово генерували фейкові відгуки, коментарі й акаунти для імітації живої громадської думки. Для бізнесу це теж не абстракція: ті самі інструменти, що накручують політичні наративи, за окрему плату накручують відгуки конкурентам або, навпаки, топлять репутацію компанії хвилею фальшивих скарг.
Чому це не історія про кіношних хакерів
Ключова фраза звіту: "ІІ стер розрив у трудовитратах та інструментарії, який раніше відділяв добре фінансовані державні операції від одинаків". У цьому й полягає суть зміни. Раніше атака на ланцюг із восьми організацій вимагала команди з десятка фахівців і тижнів ручної роботи: розвідка, написання унікального коду під кожну ціль, обхід детекту, повторна адаптація після провалу. Тепер агент сам проводить розвідку, пише експлойт, тестує його в пісочниці жертви і переписує код одразу після спрацювання захисту — сам, за години, а не тижні. Поріг входу в цілеспрямовану атаку впав приблизно до рівня підписки на ІІ-сервіс і вміння чітко формулювати завдання.
Для власника бізнесу це означає конкретну річ: зловмисник більше не обирає жертву за розміром компанії. Раніше атакувати мережу з трьох ресторанів у Лісабоні було невигідно — овчинка не варта вичинки. Уявіть бухгалтерію такої мережі, яка використовує ChatGPT-плагін для звірки рахунків з API-ключем, вшитим прямо в код інтеграції. Автономний агент, що тестує одну й ту саму схему атаки одночасно на тисячах компаній, витрачає на таку ціль не більше ресурсів, ніж на банк — просто додає її в чергу. Економіка атаки перестала залежати від розміру жертви.
Що звіт не вирішує
Тут важлива чесність: Anthropic описує випадки, які сама ж і заблокувала — це звіт про успішний захист, а не визнання безсилля. Моделі компанії відмовлялися виконувати частину кроків атаки, і саме ці відмови дозволили виявити кампанії. Але у звіту є сліпа зона: він нічого не каже про те, скільки атак було проведено через менш обмежені open-source моделі або через моделі конкурентів без порівнянних захисних фільтрів. Публікуючи такі дані, Anthropic по суті описує нижню межу проблеми, а не її повний масштаб — і це не привід розслаблятися, а привід розуміти, що реальна картина, ймовірно, гірша.
Практичний висновок для малого й середнього бізнесу простий: будь-яку інтеграцію з API — чи то платіжний шлюз, CRM чи бухгалтерський сервіс — тепер варто розглядати як потенційну точку входу, яку можна намацати автоматично й масово, а не лише вручну й прицільно. Ротація ключів, обмеження прав доступу за принципом мінімально необхідного та моніторинг аномальної поведінки інтеграцій — це вже не надмірна параноя, а базова гігієна у 2026 році.
Ми в Dayava вибудовуємо автоматизації для бізнесу так, щоб кожна інтеграція і кожен API-ключ жили в контрольованому периметрі, а не були прописані в коді на видноті. Якщо хочете перевірити, наскільки стійкі ваші поточні автоматизації до подібних сценаріїв, залиште заявку на dayava.pt/contactos/.
Джерело: Anthropic, "Countering misuse of AI: September 2026"