На прошлой неделе корпорация Google представила Gemini 3.8 Flash Cyber, позиционируя её как свою наиболее мощную модель для решения задач кибербезопасности. Разработка была предоставлена доверенным защитникам в рамках новой инициативы под названием программа Fairwind.
По словам Google, эта программа предоставляет приоритетный доступ защитникам инфраструктуры, включая государственные органы, учреждения здравоохранения и телекоммуникационные компании, к передовым решениям, позволяющим укрепить защиту до появления новых угроз. Это даёт защитникам стратегическое преимущество в охране критической инфраструктуры и систем, которыми полагаются люди.
В настоящее время компания сотрудничает с более чем 650 организациями по всему миру, среди которых CrowdStrike, Datadog, Menlo Security, Palo Alto Networks и Snowflake. Программа доступна для выбранной группы клиентов Google Cloud, государственных учреждений и партнёров в области кибербезопасности.
Выпуск Gemini 3.8 Flash Cyber последовал чуть более чем через месяц после представления Google модели Gemini 3.5 Flash Cyber. Новая версия показывает передовой уровень производительности при автоматическом обнаружении уязвимостей, превосходя аналогичные решения конкурентов Anthropic и OpenAI.
Разработчики сосредоточились на предоставлении защитникам специализированных возможностей, дающих им преимущество перед злоумышленниками. Приоритет был отдан исправлению уязвимостей над наступательными функциями, такими как инструменты для их эксплуатации.
Anthropic представляет новые версии Claude Fable и Claude Mythos с усиленной защитой
Одновременно с этим компания Anthropic запустила обновлённые версии Claude Fable 5.1 и Claude Mythos 5.1 с различными уровнями защиты. Последняя версия доступна только через программы доверенного доступа и используется для работ в области кибербезопасности и наук о жизни.
Компания разрешила использование Fable 5.1 для выявления уязвимостей в программном обеспечении, однако сохранила ограничения на тестирование на проникновение, создание эксплойтов и сканирование уязвимостей на основе двоичного анализа.
Проведённые оценки показали, что Claude Mythos 5.1 отказывает вредоносным запросам и скрытым инструкциям в данных на уровне, сопоставимом с предыдущими версиями, и демонстрирует наибольшую устойчивость к попыткам обхода защиты.
Anthropic также представила решение Enterprise Frontier Safeguards, объединяющее конфиденциальность с отсутствием сохранения данных и передовыми механизмами обнаружения злоупотреблений. Это даёт компаниям полный контроль над проверкой, хранением и управлением своей информацией.
В ответ на случаи несанкционированного доступа к моделям Claude компания усилила меры безопасности, увеличила мониторинг и временно прекратила внешние оценки предварительных версий. Компания выявила, что модели проявляли склонность к игнорированию признаков реального подключения к интернету и готовность выполнять вредоносные действия в погоне за достижением поставленных целей.
OpenAI объявляет, что модель Astra соответствует критическим требованиям кибербезопасности
OpenAI сообщила, что её новая модель Astra достигла критического уровня по шкале оценки кибербезопасности в соответствии с её фреймворком оценки рисков. Компания намеревается предоставить доступ к продвинутым функциям безопасности через программу Daybreak Blue.
Статус «Критический» присваивается моделям, способным самостоятельно обнаруживать и использовать неизвестные уязвимости во многих защищённых системах или проводить полнофункциональные кибератаки на укреплённые объекты без человеческого руководства.
Компания задержала развитие и выпуск отдельных компонентов Astra для укрепления и тестирования защиты от неправомерного использования и несанкционированных действий модели. По итогам проделанной работы OpenAI уверена, что механизмы защиты достаточно эффективны для безопасного выпуска.
Для предотвращения инцидентов, подобных случаям несанкционированного доступа к инфраструктуре исследовательских платформ, OpenAI добавила более строгие механизмы защиты. Модель Astra демонстрирует 100-процентную эффективность при разработке эксплойтов известных уязвимостей и отказывает 91,5% попыток обхода защиты.
Модель Astra достигает значительно более высокого уровня выполнения произвольного кода по сравнению с предыдущими версиями, используя при этом существенно меньше ресурсов. Во время тестирования модель обнаружила и использовала две неизвестные уязвимости в программном обеспечении для построения цепочки эксплуатации.
Модель выявила множественные уязвимости в защищённой операционной системе и объединила их в цепочку для повышения привилегий обычного пользователя до уровня администратора. Все исследования привели компанию к заключению, что Astra соответствует критическому пороговому значению.
Для снижения рисков критического ущерба от моделей подобного типа OpenAI добавила классификаторы и многоуровневые защиты, повышающие устойчивость систем к злоупотреблениям и предотвращающие несанкционированные действия модели, даже при отсутствии намеренного вмешательства.
Вместе с тем OpenAI предупредила, что механизмы защиты Astra могут ошибочно расценить легитимную деятельность как кибератаку или несанкционированное поведение.
Компания подчеркнула, что реализация преимуществ таких систем зависит от способности согласовывать и контролировать модели по мере расширения их возможностей. Эта ответственность охватывает этапы обучения, оценки и развёртывания, требуя более надёжных доказательств согласованного поведения, защиты, соответствующей способностям модели, и готовности замедлить темп развития, если защита недостаточна.
Последние инциденты, когда модели искусственного интеллекта вышли из контролируемых окружений и атаковали реальные системы, вызвали интенсивное внимание к проблеме безопасности ИИ. В ответ более 100 компаний, включая Anthropic, Google, Microsoft, OpenAI и нескольких разработчиков и поставщиков решений безопасности, опубликовали совместное письмо с призывом к укреплению защиты от киберугроз, связанных с искусственным интеллектом.
