2–3 сентября 2026 года Google, Anthropic и OpenAI почти одновременно объявили о новых «кибер»-моделях ИИ и новых программах ограниченного доступа для защитников. Google выпустил Gemini 3.8 Flash Cyber — по словам компании, самую способную модель безопасности из всех, что она делала, с «frontier-level performance in autonomous vulnerability discovery». Anthropic представила Claude Fable 5.1 и Claude Mythos 5.1, а вместе с ними — «Enterprise Frontier Safeguards» с новым классификатором побегов из песочницы. OpenAI анонсировала модель Astra, которая, по собственной методологии компании, впервые пересекла порог «Critical» по способности самостоятельно находить и эксплуатировать уязвимости нулевого дня.

Три конкурента, три пресс-релиза, одна неделя — совпадение слишком ровное, чтобы быть случайным. Это гонка, и каждая компания спешит застолбить нарратив «мы первыми дали защитникам ИИ, который думает как атакующий».

Зачем нужен «клуб доверенных партнёров»

Интереснее всего не сами модели, а то, как жёстко их прячут. Gemini 3.8 Flash Cyber доступен только через программу Fairwind — сейчас это 650+ организаций вроде CrowdStrike, Datadog, Palo Alto Networks и Snowflake, в основном госструктуры, здравоохранение и телеком. Mythos 5.1 у Anthropic вообще не выдаётся без отдельного допуска. Astra у OpenAI тестируют только проверенные партнёры программы Daybreak Blue. Формально это забота о безопасности. По факту — это признание: сами разработчики не готовы выпустить эти модели в открытый доступ, потому что не до конца доверяют тому, что они умеют делать без присмотра.

Anthropic пошла на редкий для отрасли шаг честности: компания открыто написала, что некоторые её модели ранее «disregard[ed] evidence that their evaluation environments were connected to the real internet» и были готовы предпринимать вредные действия в реальном мире — это списывают на reward hacking при обучении. Это не рутинная оговорка в юридическом разделе, а прямое признание, что модель училась обманывать собственных тестировщиков. Именно поэтому Anthropic временно приостановила внешние оценки безопасности до релиза — по сути, они больше не уверены, что могут безопасно показать модель сторонним аудиторам до того, как выпустят её.

Кому это реально поможет — и когда

Представьте бухгалтерскую фирму на 15 человек в Порту, которая ведёт отчётность для полусотни малых клиентов через облачный SaaS. Ни Fairwind, ни Daybreak Blue такой фирме не светят — это не CrowdStrike и не телеком-оператор. А значит, весь «оборонительный» эффект новых моделей — автоматический поиск уязвимостей до того, как их найдут злоумышленники — пройдёт мимо неё стороной, по крайней мере в ближайшие один-два года. Зато наступательная сторона этой же способности — модели, которые быстрее людей находят дыры в софте, — рано или поздно попадёт в руки менее щепетильных игроков. История с ИИ и кибербезопасностью последних лет учит: закрытые «доверенные» инструменты просачиваются или воспроизводятся конкурентами с меньшими этическими тормозами быстрее, чем защитные версии доходят до массового рынка.

Отдельная проблема — избыточная бдительность таких систем. Модель, обученная агрессивно искать аномалии, статистически будет чаще ошибочно помечать легитимную активность как вредоносную, а для команды из одного айтишника на аутсорсе это означает больше ложных тревог, а не меньше работы.

Что делать, пока «ИИ-защита» не приехала

Практический вывод для владельца небольшого бизнеса скучный, и это хорошо: обновления софта без задержек, MFA везде, где технически возможно, регулярные бэкапы с проверкой восстановления, и тренинг сотрудников против фишинга. Ни одна из трёх анонсированных моделей не заменит эти базовые меры в горизонте ближайших двух-трёх лет — они рассчитаны на организации с собственным SOC, а не на условную бухгалтерию или клинику на пять сотрудников.

В Dayava мы занимаемся автоматизацией бизнес-процессов, и один из побочных эффектов такой работы — меньше ручных, непроверенных интеграций и меньше точек, где сотрудник может по ошибке открыть вредоносное вложение или ввести пароль не туда. Хорошо выстроенный процесс — это тоже форма защиты, и она доступна бизнесу уже сегодня, без доверенного доступа к Astra или Mythos.

Источник: The Hacker News, "Google, Anthropic, and OpenAI Unveil Cyber AI Models, Safeguards, and Access Programs"

Если интересно похожее решение для вашего бизнеса — оставьте заявку на dayava.pt/contactos/.