Проект Glasswing: как Anthropic использует ИИ для поиска уязвимостей
Anthropic разработала модель Claude Mythos Preview — одну из самых мощных систем для выявления киберуязвимостей. Инициатива под названием Project Glasswing объединила крупнейшие технологические компании мира: Amazon Web Services, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorgan Chase, Linux Foundation, Microsoft, Nvidia и Palo Alto Networks. Помимо этого ядра, доступ к модели получили более 40 дополнительных организаций, занимающихся разработкой и поддержкой критически важного программного обеспечения.
Важно подчеркнуть: Mythos Preview не обучалась специально для задач кибербезопасности. По словам Anthropic, её возможности «возникли как побочный эффект общих улучшений в коде, рассуждениях и автономности». Однако именно эти улучшения делают модель одинаково эффективной как в устранении уязвимостей, так и в их эксплуатации — и это вызывает серьёзные вопросы.
Масштаб находок: от 27-летних багов до полностью автономных эксплойтов
Результаты работы Mythos Preview впечатляют и пугают одновременно. Модель обнаружила баг возрастом 27 лет в OpenBSD — операционной системе, известной своей повышенной безопасностью. В другом случае она полностью автономно выявила и использовала 17-летнюю уязвимость удалённого выполнения кода в FreeBSD — CVE-2026-4747, — которая позволяет неаутентифицированному пользователю из любой точки интернета получить полный контроль над сервером, работающим под NFS. Ни один человек не участвовал в обнаружении или эксплуатации после начального запроса на поиск бага.
Nicholas Carlini из исследовательской команды Anthropic описал способность модели комбинировать уязвимости: «Эта модель может создавать эксплойты из трёх, четырёх, а иногда и пяти уязвимостей, которые в цепочке дают сложный конечный результат. За последние пару недель я нашёл больше багов, чем за всю остальную свою жизнь». Mythos Preview достигла уровня, при котором она практически полностью покрывает существующие бенчмарки безопасности, что заставило Anthropic сместить фокус на novel real-world задачи — прежде всего на zero-day уязвимости.
Партнёры и финансирование: кто получает доступ и на каких условиях
Anthropic инвестирует до $100 млн в виде кредитов на использование Mythos Preview в рамках проекта Glasswing, а также $4 млн в прямых пожертвованиях организациям, занимающимся открытым исходным кодом и безопасностью. Отдельно компания направила $2,5 млн в Alpha-Omega и OpenSSF через Linux Foundation и $1,5 млн в Apache Software Foundation — это даёт разработчикам критически важных open-source проектов доступ к сканированию уязвимостей с помощью ИИ в масштабе, ранее недоступном для небольших команд.
Jim Zemlin, CEO Linux Foundation, прокомментировал: «Раньше экспертиза в области безопасности была роскошью, доступной только организациям с крупными командами. Разработчики open-source, чьё ПО лежит в основе критической инфраструктуры мира, исторически оставались одни с проблемами безопасности». Проект Glasswing призван изменить эту ситуацию.
Почему модель не будет опубликована: этика и риски
«Мы не планируем делать Claude Mythos Preview общедоступной из-за её возможностей в области кибербезопасности», — заявил Newton Cheng, Frontier Red Team Cyber Lead в Anthropic. — «С учётом темпов развития ИИ, совсем скоро подобные возможности станут доступны шире, потенциально за пределами тех, кто привержен их безопасному применению. Последствия — для экономики, общественной безопасности и национальной безопасности — могут быть серьёзными».
Это не гипотеза. Anthropic ранее раскрыла то, что назвала первым задокументированным случаем кибератаки, в значительной степени проведённой ИИ — китайская государственная группа использовала ИИ-агентов для автономного проникновения на около 30 глобальных целей, при этом ИИ выполнял большинство тактических операций самостоятельно. Компания также провела закрытые брифинги для старших чиновников правительства США, и разведывательное сообщество сейчас активно оценивает, как модель может изменить как наступательные, так и оборонительные операции в киберпространстве.
Новый стандарт для frontier-моделей: контролируемое развертывание вместо открытого релиза
Конкурентная обстановка стремительно меняется. Когда OpenAI выпустила GPT-5.3-Codex в феврале, компания назвала её первой моделью, классифицированной как высококвалифицированная для задач кибербезопасности в рамках её Preparedness Framework. Шаг Anthropic с Glasswing сигнализирует о том, что ведущие лаборатории рассматривают контролируемое развертывание — а не открытый релиз — как формирующийся стандарт для моделей данного уровня возможностей.
Anthropic планирует в конечном счёте развертывать модели класса Mythos в масштабе, но только после внедрения новых механизмов защиты. Компания намерена запустить эти safeguard'ы с предстоящей моделью Claude Opus, что позволит доработать их на модели, не несущей такого же уровня риска, как Mythos Preview. Сохранится ли этот стандарт по мере распространения подобных возможностей — вопрос, на который пока нет ответа, и ни одна отдельная инициатива не в состоянии его дать.
