Проект Glasswing от Anthropic объединяет технологических гигантов
Источник: VentureBeat · Michael Nuñez
Компания Anthropic во вторник анонсировала проект Glasswing — масштабную инициативу в сфере кибербезопасности, объединяющую невыпущенную передовую ИИ-модель Claude Mythos Preview с коалицией из двенадцати ведущих технологических и финансовых компаний. Цель проекта — найти и устранить уязвимости в программном обеспечении ключевых объектов критической инфраструктуры по всему миру до того, как ими смогут воспользоваться злоумышленники.
В число партнеров-основателей воли Amazon Web Services, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, Linux Foundation, Microsoft, Nvidia и Palo Alto Networks. В Anthropic заявляют, что также предоставили доступ более чем 40 дополнительным организациям, которые разрабатывают или поддерживают критически важное ПО, и выделяют до 100 млн долларов в виде квот на использование Claude Mythos Preview в рамках этой инициативы, а также 4 млн долларов в виде прямых пожертвований организациям, занимающимся безопасностью с открытым исходным кодом.
Этот анонс прозвучал в момент чрезвычайного подъема — и пристального внимания — к этому базирующемуся в Сан-Франциско ИИ-стартапу. В воскресенье Anthropic сообщила, что ее годовой объем выручки в пересчете на текущие темпы превысил 30 млрд долларов (по сравнению с примерно 9 млрд долларов на конец 2025 года), а число корпоративных клиентов, каждый из которых тратит более 1 млн долларов в год, теперь превышает 1000, удвоившись менее чем за два месяца. Одновременно с этим компания объявила о заключении многогигаваттной сделки на вычислительные мощности с Google и Broadcom. В тот же день издание Bloomberg сообщило, что Anthropic переманила высокопоставленного руководителя Microsoft Эрика Бойда (Eric Boyd) на должность главы отдела расширения инфраструктуры.
Однако Glasswing — это нечто совершенно иное, чем просто финансовый рубеж или сделка по вычислениям. Это самая амбициозная попытка Anthropic превратить возможности передового искусственного интеллекта — возможности, которые сама компания описывает как опасные, — в оборонительное преимущество до того, как те же самые возможности окажутся в распоряжении враждебных сил.
Почему Anthropic создала модель, которую считает слишком опасной для публичного релиза
В центре проекта Glasswing находится Claude Mythos Preview — универсальная передовая модель, которая, по утверждению Anthropic, уже обнаружила тысячи уязвимостей нулевого дня высокой степени тяжести (то есть ранее неизвестных разработчикам ПО брешей) во всех основных операционных системах и ведущих веб-браузерах, а также в ряде других критически важных программ.
Компания не делает эту модель общедоступной.
«Мы не планируем открывать общий доступ к Claude Mythos Preview из-за ее возможностей в сфере кибербезопасности», — рассказал Ньютон Чен (Newton Cheng), руководитель команды кибербезопасности Frontier Red Team в Anthropic, в эксклюзивном интервью VentureBeat. — «Однако, учитывая темпы развития ИИ, пройдет совсем немного времени, прежде чем подобные возможности распространятся повсеместно, потенциально попав к акторам, которые не стремятся применять их безопасным образом. Последствия для экономики, общественной безопасности и национальной безопасности могут оказаться тяжелыми».
Такие формулировки — «последствия могут оказаться тяжелыми» — звучат впечатляюще, когда исходят от компании, создавшей эту модель. Anthropic фактически утверждает, что созданный ею инструмент достаточно мощен, чтобы изменить ландшафт кибербезопасности, и единственное ответственное решение — сохранить его под ограничениями, дав защитникам фору.
Технические результаты подтверждают это заявление. Согласно пресс-релизу Anthropic, Mythos Preview смогла обнаружить практически все выявленные уязвимости и разработать множество связанных с ними эксплойтов полностью автономно, без какого-либо вмешательства человека. Выделяются три примера: модель обнаружила 27-летнюю уязвимость в OpenBSD — системе, которая считается одной из самых защищенных операционных систем в мире и обычно используется для работы брандмауэров и критической инфраструктуры. Эта брешь позволяла злоумышленнику удаленно «уронить» любую машину под управлением данной ОС простым подключением к ней. Модель также обнаружила 16-летнюю уязвимость в FFmpeg — повсеместно используемой библиотеке кодирования и декодирования видео — в строке кода, которую инструменты автоматического тестирования прогоняли пять миллионов раз, так и не выявив проблему. И, пожалуй, самое тревожное: Mythos Preview автономно нашла и объединила несколько уязвимостей в ядре Linux, чтобы повысить обычные права пользователя до полного контроля над системой.
Все три уязвимости были переданы профильным мейнтейнерам и на данный момент устранены. Что касается множества других уязвимостей, находящихся в процессе исправления, Anthropic заявляет, что уже сегодня публикует криптографические хэши деталей, а подробности планирует раскрыть после выпуска патчей.
В тестовом бенчмарке CyberGym модель Mythos Preview набрала 83,1%, тогда как Claude Opus 4.6 (следующая по эффективности модель Anthropic) — 66,6%. В бенчмарках по программированию разрыв еще шире: на SWE-bench Verified Mythos Preview показывает 93,9% против 80,8% у Opus 4.6, а на SWE-bench Pro — 77,8% против 53,4%.
Как Anthropic планирует раскрывать тысячи уязвимостей нулевого дня, не перегружая разработчиков открытого ПО
Найти тысячи уязвимостей нулевого дня за один раз звучит впечатляюще. Реальное и ответственное обращение с этими результатами — это логистический кошмар, и одна из самых резких критических претензий, высказываемых исследователями безопасности в адрес ИИ-поиска уязвимостей. Затопить мейнтейнеров опенсорс-проектов (многие из которых являются неоплачиваемыми волонтерами) лавиной критических баг-репортов легко может принести больше вреда, чем пользы.
Чен сообщил VentureBeat, что Anthropic создала специальный конвейер триажа для решения этой проблемы. «Мы проводим триаж каждого найденного бага, после чего отправляем баги с наивысшим уровнем опасности профессиональным специалистам по триажу, с которыми у нас заключены контракты. Они помогают нам в процессе раскрытия информации, вручную проверяя каждый отчет, чтобы мы отправляли разработчикам только качественные данные», — пояснил он.
Этот конвейер призван предотвратить именно тот сценарий, которого больше всего боятся мейнтейнеры: автоматизированный поток непроверенных отчетов. «Мы не отправляем большие объемы находок в один проект, предварительно не связавшись с разработчиками и не пытаясь согласовать приемлемый для них темп», — добавил Чен.
Если у Anthropic есть доступ к исходному коду, компания стремится прикладывать к каждому отчету кандидат на патч с указанием происхождения (чтобы мейнтейнер знал, что патч был написан или проверен моделью) и предлагает помощь в доработке исправления до продакшн-качества. «Модели могут писать патчи, — отметил Чен, — но есть множество факторов, влияющих на их качество, и мы настоятельно рекомендуем подвергать такие автоматически созданные патчи тем же проверкам и тестированию, что и написанные людьми».
Что касается сроков публикации, в Anthropic заявляют, что придерживаются концепции скоординированного раскрытия уязвимостей. После появления патча компания обычно выжидает 45 дней перед публикацией полных технических деталей, давая пользователям время установить исправление до того, как информация об эксплойтах станет публичной. По словам Чена, компания может сократить этот буфер, «если детали уже стали публично известны по другим каналам или если более ранняя публикация существенно поможет защитникам выявлять и пресекать текущие атаки», либо продлить его, «когда развертывание патча необычайно сложно или затронутая зона чрезвычайно широка».
Это разумные принципы, но им предстоит пройти проверку в масштабах, с которыми не сталкивалась ни одна программа раскрытия уязвимостей. Огромный объем находок — тысячи брешей во всех основных платформах — означает, что даже с тщательно продуманным процессом триажа возникнут узкие места. Кроме того, 45-дневное окно предполагает, что мейнтейнеры действительно смогут создать, протестировать и выпустить патч за это время, что далеко не гарантировано для сложных ошибок уровня ядра или глубоко встроенных криптографических изъянов.
Утечка исходного кода, ошибка в CMS и почему доверие — главная уязвимость Anthropic
Ирония судьбы: компания, заявляющая о создании самой мощной кибермодели в истории, сама допускает череду неловких промахов в области безопасности, что не ускользнуло от внимания наблюдателей.
В конце марта черновик статьи о Mythos остался в незащищенном и общедоступном хранилище данных — из-за конфигурационной ошибки в CMS были скомпрометированы примерно 3000 внутренних адекватных ресурсов, включая, судя по всему, стратегические планы по запуску модели. Спустя несколько дней, 31 марта, любой, кто выполнил npm install для Claude Code, загрузил полный оригинальный исходный код Anthropic (512 000 строк) примерно на три часа из-за ошибки пакетирования. Этот инцидент привлек широкое внимание в сообществе разработчиков и впервые был освещен изданием VentureBeat.
На вопрос о том, почему партнеры и правительства должны доверять Anthropic как хранителю модели с беспрецедентными кибервозможностями, Чен ответил прямо. «Безопасность лежит в основе того, как мы создаем и выпускаем продукты, — заявил он VentureBeat. — Эти два инцидента — ошибка конфигурации CMS блога и ошибка пакетирования npm — были человеческими ошибками в инструментах публикации, а не взломами нашей архитектуры безопасности. Мы внесли изменения, чтобы предотвратить их повторение, и продолжим совершенствовать наши процессы».
Технически это точное различие — ни один из инцидентов не затронул веса базовой модели Anthropic, инфраструктуру обучения или системы API, — однако этот аргумент может оказаться трудноубедительным для широкой публики. Для организации, которая просит правительства и компании из списка Fortune 500 доверить ей инструмент, способный автономно находить и использовать уязвимости в ядре Linux, даже незначительные операционные промахи несут колоссальные репутационные риски. Тот факт, что именно утечка данных о Mythos впервые привлекла внимание сообщества к существованию модели за несколько недель до запланированного анонса, лишь подчеркивает это.
Что обнаружили Microsoft, CrowdShark и Linux Foundation при тестировании модели
Масштаб коалиции впечатляет. В нее вошли прямые конкуренты — Google и Microsoft — наряду с игроками рынка кибербезопасности, финансовыми институтами и попечителями крупнейшей в мире экосистемы открытого ПО. Некоторые партнеры уже несколько недель тестируют Mythos Preview на собственной инфраструктуре.
Технический директор CrowdStrike Элия Зайцев (Elia Zaitsev) охарактеризовал инициативу через сжатие временных интервалов: «Окно между обнаружением уязвимости и ее эксплуатацией злоумышленниками сократилось — то, на что раньше уходили месяцы, с помощью ИИ теперь происходит за минуты». Вице-президент и директор по информационной безопасности AWS Эми Херцог (Amy Herzog) отметила, что ее команды уже тестировали Mythos Preview на критически важных кодовых базах, где модель «уже помогает нам укреплять код». А глобальный директор по информационной безопасности Microsoft Игорь Цыганский отметил, что при тестировании на открытом бенчмарке безопасности Microsoft CTI-REALM «Claude Mythos Preview продемонстрировала существенные улучшения по сравнению с предыдущими моделями».
Пожалуй, самый показательный комментарий дал Джим Землин (Jim Zemlin), исполнительный директор Linux Foundation, указавший на фундаментальную асимметрию, которая десятилетиями преследовала безопасность открытого кода: «В прошлом экспертиза в области безопасности была роскошью, доступной лишь организациям с крупными профильными командами. Мэйнтейнеры опенсорс-проектов, чей код лежит в основе большей части критической инфраструктуры мира, исторически были вынуждены разбираться с безопасностью в одиночку». Проект Glasswing, по его словам, «предлагает надежный путь к изменению этой ситуации».
Подтверждая это заявление финансово, Anthropic заявляет, что пожертвовала 2,5 млн долларов организациям Alpha-Omega и OpenSSF через Linux Foundation, а также 1,5 млн долларов — Apache Software Foundation. Мэйнтейнеры, заинтересованные в получении доступа, могут подать заявку через программу Anthropic Claude for Open Source.
Цены, сделка по вычислениям и путь Anthropic к возможному IPO
После периода исследовательского превью (в течение которого обязательства Anthropic по кредитам на 100 млн долларов покроют большую часть использования) Claude Mythos Preview будет доступна участникам по цене 25 долларов за миллион входных токенов и 125 долларов за миллион выходных токенов. Участники могут получить доступ к модели через API Claude, Amazon Bedrock, Vertex AI от Google Cloud и Microsoft Foundry.
Эти цены отражают высокую вычислительную интенсивность модели. В опубликованном и утекшем в марте черновике блога Mythos описывалась как ресурсоемкая модель, обслуживание которой обойдется дорого как самой Anthropic, так и ее клиентам. Решением Anthropic является разработка и внедрение новых средств защиты в грядущей модели Claude Opus, что позволит компании «улучшить и доработать их с помощью модели, которая не несет в себе такого уровня риска, как Mythos Preview», как рассказал Чен изданию VentureBeat. Специалисты по безопасности, чья легитимная работа пострадает от этих защитных мер, смогут подать заявку на участие в грядущей программе киберверификации (Cyber Verification Program).
Финансовый контекст имеет решающее значение. В тот же день, когда стартовал проект Glasswing, Anthropic раскрыла данные о росте выручки и сделке с Google-Broadcom. Broadcom подписала расширенное соглашение с Anthropic, которое предоставит ИИ-стартапу доступ примерно к 3,5 гигаваттам вычислительной мощности на базе процессоров Google, сообщает CNBC. Масштаб задействованных вычислений поражает воображение — и это помогает объяснить, почему Anthropic нуждается как в доходах от корпоративных партнерств в сфере кибербезопасности, так и в инфраструктуре для обслуживания модели масштаба Mythos Preview.
Тайминг также пересекает растущие спекуляции о выходе Anthropic на биржу. Сообщается, что компания рассматривает возможность IPO уже в октябре 2026 года. Громкая инициатива в области кибербезопасности, связанная с государственными структурами и партнерами с безупречной репутацией, — это именно та программа, которая укрепляет позиции компании перед IPO, особенно когда она одновременно демонстрирует 30 миллиардов долларов годовой выручки и вычислительные мощности, измеряемые в гигаватах.
Anthropic: у защитников есть месяцы, а не годы, прежде чем злоумышленники нагонят их
Самый важный вопрос, который ставит проект Glasswing — не в том, реальны ли возможности Mythos Preview (партнерские рекомендации и устраненные уязвимости говорят сами за себя), а в том, сколько времени есть у защитников до того, как аналогичные возможности появятся у злоумышленников.
Чен открыто высказался о временных рамках. «Возможности передового ИИ, вероятно, существенно продвинутся вперед уже в ближайшие несколько месяцев, — заявил он VentureBeat. — Учитывая темпы прогресса ИИ, пройдет совсем немного времени, прежде чем такие возможности распространятся повсеместно, потенциально выйдя за рамки контроля акторов, которые обязуются развертывать их безопасно». Он охарактеризовал проект Glasswing как «важный шаг к обеспечению защитников долгосрочным преимуществом в наступающую эпоху кибербезопасности, управляемой ИИ», но добавил ключевую оговорку: «Важно понимать, что это отправная точка. Ни одна организация не способна решить эти проблемы кибербезопасности в одиночку».
К этой оценке — месяцы, а не годы — стоит отнестись со всей серьезностью. DARPA запустила свой оригинальный проект Cyber Grand Challenge в 2016 году — соревнование по созданию автоматических систем защиты, способных анализировать бреши, формировать патчи и развертывать их в сети в режиме реального времени. Тогда бот-победитель на базе ИИ, Mayhem, занял последнее место при сопоставлении с командами людей на DEF CON. Десять лет спустя Anthropic утверждает, что передовая ИИ-модель способна находить уязвимости, пережившие 27 лет экспертных проверок людей и миллионы автоматических тестов безопасности, а также самостоятельно объединять эксплойты для полного захвата системы.
Разница между этими двумя точками данных иллюстрирует, почему индустрия воспринимает происходящее как подлинный переломный момент, а не как маркетинговую уловку. Сама Anthropic имеет непосредственный опыт столкновения с наступательной стороной этого уравнения: в ноябре 2025 года компания сообщила, что поддерживаемая государством Китая группировка достигла от 80 до 90 процентов автономного тактического выполнения задач с использованием Claude примерно на 30 целях, согласно отчету Anthropic о злоупотреблениях.
Проект Glasswing стартует на фоне одной из самых бурных недель в истории Anthropic. За считанные дни компания анонсировала модель, которую считает слишком опасной для публичного релиза, отчиталась о троекратном росте выручки, заключила многогигаваттную сделку по вычислениям, наняла топ-менеджера Microsoft, повысила стоимость использования сторонних инструментов (вроде OpenClaw) для подписчиков Claude Code, а также пережила серьезный сбой в работе чат-бота Claude во вторник утром. В Anthropic обещают публично отчитаться о полученных результатах в течение 90 дней. В среднесрочной перспективе компания предложила сделать независимый сторонний орган идеальной площадкой для продолжения работы над крупномасштабными проектами в сфере кибербезопасности.
Успеют ли они вовремя — зависит от гонки, которая уже идет полным ходом. Anthropic создала модель, способную автономно взламывать самые защищенные операционные системы на планете, и теперь делает ставку на то, что передача ее защитникам под жестким контролем принесет больше пользы, чем неизбежный момент, когда аналогичные возможности окажутся в менее аккуратных руках. По сути, это пари на то, что прозрачность сможет опередить распространение. Ближайшие месяцы покажут, окупится ли эта ставка или крылья glasswing («стеклянного крыла») так и не окажутся достаточно непрозрачными, чтобы скрыть то, что идет им на смену.



