Anthropic открывает Mythos для широкой аудитории с запуском Claude Fable 5 — своей самой мощной доступной модели
Источник: VentureBeat · Carl Franzen
Компания Anthropic сегодня представила две новые модели искусственного интеллекта — Claude Fable 5 и Claude Mythos 5. Этот релиз стал первым масштабным выходом компании на рынок с мощными возможностями ИИ «класса Mythos», которые ранее были доступны только участвующим организациям в рамках закрытой программы кибербезопасности Project Glasswing, о запуске которой было объявлено два месяца назад.
По словам представителей компании, Fable 5 — версия, которая с сегодняшнего дня станет доступна большинству пользователей и разработчиков — превосходит все предыдущие общедоступные модели Claude. Она демонстрирует более высокую производительность в разработке программного обеспечения, интеллектуальной работе, обработке визуальных данных, научных исследованиях и выполнении долгосрочных задач.
Она бьет существующие бенчмарки и занимает лидирующие позиции практически по всем параметрам, хотя предыдущая версия Claude Mythos Preview по-прежнему удерживает первенство в задачах использования компьютера и междисциплинарных рассуждений (см. график бенчмарков ниже и здесь).
Сравнительная диаграмма бенчмарков Claude Fable 5 и Mythos 5. Источник: Anthropic
Новый Claude Mythos 5, напротив, имеет меньше ограничений по своим возможностям, но более ограничен в доступности. Это обновленная версия предыдущей аналогичной, но ограниченной в релизе модели Mythos Preview. В связи с этим в ней сняты определенные защитные барьеры, однако официальный доступ к ней имеют только одобренные Anthropic пользователи, включая партнеров компании по кибербезопасности в рамках инициативы Project Glasswing, а также избранные исследователи-биологи.
Ключевое различие заключается в том, что универсальная модель Fable 5 облекает те же базовые возможности класса Mythos в новые защитные механизмы. В Anthropic заявляют, что запросы, затрагивающие определенные области повышенного риска — включая кибербезопасность, биологию, химию и дистилляцию моделей — автоматически перенаправляются на Claude Opus 4.8 (предыдущую флагманскую универсальную модель компании), о чем пользователи получают соответствующее уведомление. В случае с Mythos 5 это не так.
Компания утверждает, что более 95% сессий Fable 5 обрабатываются исключительно за счет собственных ответов модели без переключения на резервные варианты, а внутренние и внешние тесты на проникновение (red-teaming) не выявили «универсальных джейлбрейков» после более чем 1000 часов тестирования.
Anthropic заявляет, что Fable 5 доступна широкой публике уже сегодня через ее веб-сайт, приложения и API, в то время как Mythos 5 на начальном этапе будет предоставляться только тем пользователям, у которых уже есть доступ к более ранней версии Claude Mythos Preview.
Скриншот информации об API Claude Fable 5 и Mythos 5 на сайте Anthropic.
Ценообразование, доступ и сложный запуск
Anthropic установила цену на Fable 5 и Mythos 5 на уровне $10 за миллион входных токенов и $50 за миллион выходных токенов. По заявлению компании, это более чем вдвое дешевле Claude Mythos Preview, однако эта стоимость по-прежнему делает модели самыми дорогими среди ведущих ИИ-моделей, доступных по всему миру.
|
Модель |
Вход |
Выход |
Общая стоимость |
Источник |
|
MiMo-V2.5 Flash |
$0.10 |
$0.30 |
$0.40 |
|
|
deepseek-v4-flash |
$0.14 |
$0.28 |
$0.42 |
|
|
deepseek-v4-pro |
$0.435 |
$0.87 |
$1.305 |
|
|
MiniMax-M3 |
$0.30 |
$1.20 |
$1.50 |
|
|
Gemini 3.1 Flash-Lite |
$0.25 |
$1.50 |
$1.75 |
|
|
Qwen3.7-Plus |
$0.40 |
$1.60 |
$2.00 |
|
|
MiMo-V2.5 |
$0.40 |
$2.00 |
$2.40 |
|
|
Grok 4.3 (низкий контекст) |
$1.25 |
$2.50 |
$3.75 |
|
|
GLM-5 |
$1.00 |
$3.20 |
$4.20 |
|
|
Kimi-K2.6 |
$0.95 |
$4.00 |
$4.95 |
|
|
GLM-5.1 |
$1.40 |
$4.40 |
$5.80 |
|
|
Grok 4.3 (высокий контекст) |
$2.50 |
$5.00 |
$7.50 |
|
|
Qwen3.7-Max |
$2.50 |
$7.50 |
$10.00 |
|
|
Gemini 3.5 Flash |
$1.50 |
$9.00 |
$10.50 |
|
|
Gemini 3.1 Pro Preview (≤200K) |
$2.00 |
$12.00 |
$14.00 |
|
|
GPT-5.4 |
$2.50 |
$15.00 |
$17.50 |
|
|
Gemini 3.1 Pro Preview (>200K) |
$4.00 |
$18.00 |
$22.00 |
|
|
Claude Opus 4.8 |
$5.00 |
$25.00 |
$30.00 |
|
|
GPT-5.5 |
$5.00 |
$30.00 |
$35.00 |
|
|
Claude Fable 5 / Claude Mythos 5 |
$10.00 |
$50.00 |
$60.00 |
Для разработчиков Fable 5 доступна через Claude API как claude-fable-5. В Anthropic отмечают, что Fable 5 уже сегодня полностью доступна в Claude API и на тарифных планах Enterprise с оплатой по факту использования.
Для пользователей по подписке схема внедрения более сложная. По словам компании, Fable 5 будет включена в планы Pro, Max, Team и тарифные планы Enterprise на базе пользовательских мест без дополнительной платы с сегодняшнего дня и по 22 июня.
23 июня компания планирует убрать Fable 5 из этих планов, после чего ее использование потребует кредитов на отправку запросов. В Anthropic заявляют, что стремятся вернуть Fable 5 в качестве стандартной части планов подписки как можно быстрее.
Разница между Fable 5 и Mythos 5
Anthropic не позиционирует Fable 5 и Mythos 5 как две разные модели в привычном смысле «маленькая против большой». Судя по всему, они имеют одинаковый уровень базовых возможностей. Разница заключается в контроле доступа — то есть в том, насколько легко пользователям будет получить модели в свое распоряжение, и в средствах защиты, встроенных в каждую из них.
Как упоминалось ранее, Fable 5 включает в себя новый уровень защиты, который обнаруживает определенные запросы повышенного риска (включая кибербезопасность, биологию и химию, а также попытки дистилляции возможностей модели в другие системы) и перенаправляет такие запросы на Claude Opus 4.8.
Mythos 5 снимает некоторые из этих ограничений для доверенных пользователей, работающих в одобренных сферах.
На практике Mythos 5 эффективнее при выполнении деликатных задач в области кибербезопасности и биологии, поскольку может давать ответы там, где Fable 5 переключается на резервную модель.
Однако для большинства обычных корпоративных задач и задач разработчиков, как утверждают в Anthropic, Fable 5 работает практически так же эффективно, как и Mythos 5.
Этот запуск также демонстрирует подход Anthropic к выводу на рынок передовых моделей с потенциально опасными возможностями двойного назначения: не путем открытия всех возможностей для всех подряд и не простым отказом отвечать на рискованные вопросы, а путем перенаправления некоторых запросов на менее мощную модель при сохранении более сильной модели для большинства повседневных задач.
Серьезный шаг вперед в автономном написании кода
Для корпоративных заказчиков наиболее очевидным вариантом использования станет разработка программного обеспечения. В Anthropic заявляют, что Fable 5 способна работать без участия человека дольше и более независимо, чем предыдущие модели Claude. Именно это требуется компаниям, если они хотят, чтобы ИИ-агенты не просто автодополняли код или отвечали на вопросы разработчиков.
В бенчмарке SWE-bench Pro, измеряющем способность модели справляться со сложными задачами по разработке ПО, Fable 5 и Mythos 5 достигают результата 80,3%, значительно опережая новейшую передовую универсальную модель OpenAI GPT-5.5, набравшую 58,6%.
В бенчмарке FrontierCode Diamond от компании Cognition, который оценивает создание качественного, поддерживаемого кода с помощью агентов, модели набирают 29,3% по сравнению с 13,4% у Claude Opus 4.8 и 5.7% у GPT-5.5 (согласно таблице бенчмарков в материалах Anthropic).
В Anthropic также отмечают, что Fable 5 показывает наивысшие результаты среди передовых моделей на FrontierCode даже при среднем уровне рассуждений, что намекает на способность модели обеспечивать качественный код без постоянной необходимости задействовать максимальные вычислительные мощности.
Самый яркий пример из практики клиентов приводит Stripe. В Anthropic рассказали, что Stripe протестировала Fable 5 на кодовой базе на Ruby объемом 50 миллионов строк и обнаружила, что модель выполнила масштабную миграцию кодовой базы всего за один день — на ручную работу у команды ушло бы больше двух месяцев. Представители Stripe отметили: «Fable 5 сжимает месяцы работы инженеров до считанных дней. В нашей кодовой базе на Ruby объемом 50 миллионов строк она сделала за день то, на что у нас вручную ушло бы больше двух месяцев».
Другие ранние пользователи описывают модель как особенно полезную для долгосрочных задач разработки. В компании Cursor заявили: «Fable 5 — это передовая модель в CursorBench. Она открыла целый класс долгосрочных проблем, которые были недоступны для более ранних моделей». В Replit отметили, что Fable 5 показала самую высокую производительность среди всех протестированных ими моделей в ViBench — их комплексном бенчмарке для «вайб-кодинга» (vibe-coding) — и создает приложения за меньшее время с меньшим количеством токенов. В Figma назвали Fable 5 «явным шагом вперед в агентском кодировании и прототипировании».
Именно на этот корпоративный сдвиг делает ставку Anthropic: ИИ-системы для написания кода, способные брать на себя крупные объемы работы, а не отдельные тикеты. Сюда могут входить миграция кодовой базы, прототипирование приложений, ревью пулл-реквестов, генерация тестов, отладка в незнакомых инструментах, проектирование пользовательских интерфейсов и многоэтапные внутренние программные проекты.
В компании Base44 заявили: «Fable 5 намного глубже и лучше справляется с созданием полноценных приложений с первого раза, а вызовы инструментов у нее превосходны». Представители Genspark поделились: «Fable 5 заняла 1-е место в наших оценках, одержав победу в прямом сравнении над каждой протестированной моделью. Она оказалась значительно сильнее в самых сложных задачах из нашего набора — дизайне пользовательского интерфейса и написании кода для игр». В Rakuten отметили: «При максимальной нагрузке Fable 5 анализирует и проверяет собственную работу. Для нас именно это делает возможным высокоавтономные операции — дополнительные размышления окупаются сполна».
Для технических директоров (CTO) и лидеров инженерных команд это говорит о том, что ценность модели может заключаться не столько в генерации «сырого» кода, сколько в непрерывном выполнении задач: понимании намерения, планировании шагов, вызове инструментов, проверке собственной работы и продвижении вперед без постоянного ручного контроля со стороны человека.
Интеллектуальная работа, финансы, юриспруденция и операции
Anthropic также позиционирует Fable 5 как более мощную модель для корпоративной интеллектуальной работы. В бенчмарке GDPval-AA компания фиксирует результат 1932 балла для Fable 5 и Mythos 5 по сравнению с 1890 баллами у Claude Opus 4.8, 1769 баллами у GPT-5.5 и 1314 баллами у Gemini 3.1 Pro.
В GDPpdf — бенчмарке, сфокусированном на рассуждениях по визуальным документам — Fable 5 и Mythos 5 набирают 29,8% без использования инструментов (против 22,5% у Opus 4.8, 24,9% у GPT-5.5 и 16.7% у Gemini 3.1 Pro).
Это имеет решающее значение для бизнеса, поскольку большая часть корпоративной работы по-прежнему сосредоточена в неструктурированных документах: PDF-файлах, электронных таблицах, диаграммах, отчетах, контрактах, официальных заявках, презентациях и скриншотах. По данным Anthropic, Fable 5 демонстрирует улучшения в рассуждениях на основе документов, интерпретации диаграмм и таблиц, а также в решении комплексных задач.
В Hex отметили: «Fable 5 — первая модель, преодолевшая отметку в 90% в нашем основном аналитическом бенчмарке сложных долгосрочных аналитических задач, что на 10 пунктов выше результата Opus. В самых сложных вопросах она демонстрирует глубокое суждение и внимание к нюансам». Компания Hebbia назвала Fable 5 моделью с самым высоким баллом в своем финансовом бенчмарке для рассуждений уровня senior, зафиксировав двузначный рост показателей в задачах анализа документов, интерпретации графиков и таблиц, а также решения проблем.
Финансовые примеры примечательны тем, что указывают на переход ИИ-агентов от простого суммирования к более сложным аналитическим рабочим процессам.
В IMC заявили, что Fable 5 «блестяще справилась почти со всеми нашими оценками торгового анализа: поиском фактов, концептуальными рассуждениями, анализом первопричин и расчетом ожидаемой стоимости». В Optiver отметили, что модель оказалась сильнее Opus 4.8 в их торговом бенчмарке и была «поразительно стабильной», показывая идентичные результаты в ходе повторяющихся запусков. В Balyasny Asset Management назвали Fable 5 сильнейшей финансово-ориентированной моделью из всех протестированных ими.
Команды юристов и операционные отделы также могут ощутить немедленный эффект. В Crosby Legal поделились: «Fable 5 ощущается совершенно иначе. При слепом тестировании наши юристы обнаружили, что ее правки в режиме рецензирования каждый раз соответствовали нашей текущей модели или превосходили ее». В Notion сообщили, что модель способна взять работу, «на которую вы бы убили весь день», и превратить хаотичные заметки в рабочий план проекта. В Zapier назвали Fable 5 новым лидером AutomationBench, отметив ее большую автономность по сравнению с Opus 4.8: «Там, где Opus останавливается с вопросами, Fable 5 продолжает искать решение».
Для поставщиков корпоративного ПО это указывает на появление более способных встроенных агентов в рабочих продуктах: агентов, способных проанализировать контракт, обновить план проекта, составить электронную таблицу, изучить график, подать тикет, выполнить запрос, обратиться к внутреннему API и продолжать работу до тех пор, пока задача не будет выполнена.
Видение и понимание интерфейсов
Anthropic заявляет, что Fable 5 также является ее сильнейшей моделью компьютерного зрения (vision). В презентационных материалах компания утверждает, что модель способна извлекать точные цифры из подробных научных иллюстраций и справляться с задачами на основе визуального восприятия — например, восстанавливать исходный код веб-приложения исключительно по скриншотам.
Это имеет прямые последствия для корпоративной автоматизации. Многие бизнес-процессы по-прежнему зависят от визуальных интерфейсов, у которых нет удобных API: дашбордов, PDF-файлов, форм, устаревших приложений, скриншотов, сканов и отчетов с большим количеством изображений. Более мощная модель компьютерного зрения поможет агентам работать в таких средах без необходимости сложной кастомной интеграции.
В Anthropic также отмечают, что Fable 5 требует меньше вспомогательных элементов (scaffolding), чем предыдущие модели Claude. В качестве примера компания приводит тот факт, что более ранние версии Claude с трудом справлялись с прохождением Pokémon FireRed даже при наличии дополнительных инструментов, в то время как Fable 5 впечатляюще прошла игру, используя минимальный набор возможностей только на базе зрения. Anthropic опубликовала ускоренное видео своего прохождения на YouTube и в своем блоге:
Суть здесь не в самих играх, а в более широком спектре навыков агента: считывании визуальной среды, запоминании прогресса, принятии решений о дальнейших действиях и выполнении задач на долгосрочной дистанции.
В ходе другого внутреннего теста, как утверждают в Anthropic, модель заставили играть в колодостроительную игру Slay the Spire с доступом к постоянной файловой памяти. По словам компании, персистентная память повысила производительность Fable 5 в три раза сильнее, чем производительность Opus 4.8, при этом Fable доходила до финального акта игры в три раза чаще. Для корпоративных пользователей это означает, что Fable 5 может эффективнее использовать заметки, логи и сохраненный контекст в ходе многоэтапных задач.
Это может иметь решающее значение для внутренних агентов, работающих на протяжении дней или недель: агентов отдела продаж, отслеживающих исследования аккаунтов; инженерных агентов, управляющих миграциями; финансовых агентов, обновляющих модели; или агентов техподдержки, помнящих, что они пытались сделать на протяжении множества шагов.
От ограниченной кибермодели к универсальному корпоративному ИИ
Анонс последовал за апрельским релизом Claude Mythos Preview в рамках Project Glasswing — закрытой программы для киберзащитников, провайдеров критической инфраструктуры и ключевых разработчиков ПО. Anthropic создала Glasswing после того, как внутренние оценки показали, что модели класса Mythos способны находить и использовать уязвимости в программном обеспечении на уровне, вызывающем серьезные опасения по поводу их нецелевого использования.
После дебюта Glasswing и Mythos официальные лица и разведывательные службы США начали оценивать, как подобные модели могут изменить как кибероборону, так и наступательные операции, в то время как сенатор Марк Уорнер предупредил, что обнаружение уязвимостей с помощью ИИ должно заставить индустрию «ускорить и перераспределить приоритеты в отношении выпуска патчей». Финансовые регуляторы также обратили на это внимание: The Guardian сообщила, что модель Mythos стала предметом обсуждения среди высших банковских чиновников и регуляторов в США и Великобритании из-за опасений, что ускоренные с помощью ИИ кибератаки могут угрожать платежным системам и финансовой стабильности в целом.
Реакция не ограничилась тревожными заявлениями. Правительства также стремятся получить доступ к технологии: Reuters сообщил, что национальное агентство интернет-безопасности Южной Кореи получило доступ к Mythos через Project Glasswing, что отражает более широкую геополитическую гонку за право использовать передовой ИИ для национальной киберобороны. В то же время компания Anthropic столкнулась с критикой по поводу того, способна ли она надежно контролировать доступ к тем самым возможностям, которые, по ее словам, слишком опасны для общего релиза. The Verge сообщила, что неавторизованные пользователи получили доступ к Mythos после ее ограниченного запуска, назвав этот инцидент репутационным ударом для компании, которая построила свой бренд на идеях ответственного искусственного интеллекта.
Критики также ставят под сомнение, не рискует ли изобилующее предупреждениями позиционирование Anthropic превратиться в инструмент маркетинга, поскольку оно выставляет компанию одновременно и источником новой возможности, и привратником, решающим, какие именно правительства, компании и исследователи получат к ней доступ.
Выпуская Fable 5, Anthropic усиливает роль привратника, пытаясь отделить общую корпоративную пользу модели класса Mythos от наиболее рискованных аспектов ее возможностей. Компания заявляет, что Fable 5 способна справляться с разработкой ПО, исследованиями, визуальным мышлением, анализом документов и долгосрочными агентскими рабочими процессами, в то время как классификаторы блокируют или перенаправляют запросы, которые могут предоставить то, что Anthropic называет «усилением» (uplift) для злоумышленников.
Эти классификаторы охватывают три основные области.
-
Кибербезопасность: по утверждению Anthropic, модели класса Mythos способны находить и эксплуатировать уязвимости, а также выполнять более масштабные задачи «агентского хакинга», такие как рекогносцировка, обнаружение и латеральное перемещение.
-
Биология и химия: компания заявляет, что те же принципы рассуждений, которые помогают исследователям разрабатывать методы лечения, могут также помочь обладающим ресурсами злоумышленникам в проведении опасных биологических экспериментов.
-
Дистилляция моделей: в Anthropic отмечают, что пользователи могут попытаться извлечь возможности Claude для обучения конкурирующих моделей, включая те, которые могут быть выпущены без аналогичных мер безопасности.
Когда классификаторы Fable 5 обнаруживают одну из таких категорий, обработка запроса автоматически берется на себя моделью Claude Opus 4.8. В Anthropic заявляют, что пользователи будут получать уведомления при срабатывании этого механизма. Это примечательное продуктовое решение: вместо того чтобы просто отклонять подобные запросы, Anthropic пытается сохранить функциональность пользовательского опыта, одновременно ограничивая доступ к наиболее мощной версии модели в чувствительных областях.
Anthropic заявляет, что протестировала новую систему классификаторов в рамках внутренних и внешних учений red-teaming. Компания утверждает, что программа внешней выплаты вознаграждений за найденные баги (bug bounty) не выявила ни одного универсального джейлбрейка после более чем 1000 часов тестирования, и внешние организации по тестированию на проникновение также не смогли найти универсальный джейлбрейк. По данным Anthropic, один из внешних партнеров выяснил, что Fable 5 выполнила нулевое количество вредоносных одношаговых киберзапросов, связанных с планированием кибератак, разработкой эксплойтов или обходом защиты, даже когда в промптах использовался любой из 30 публичных методов джейлбрейка.
Компания по-прежнему признает наличие компромиссов. В Anthropic отмечают, что защитные механизмы действуют излишне осторожно и иногда могут срабатывать на вполне безобидные запросы. Это может вызывать разочарование у специалистов по безопасности, исследователей-биологов и продвинутых корпоративных пользователей, чья легитимная работа пересекается с заблокированными категориями. Компания планирует со временем снизить количество ложноположительных срабатываний.
Mythos 5 и ограниченный рубеж
В то время как Fable 5 предназначена для широкого коммерческого запуска, Mythos 5 — это модель, за которой стоит следить компаниям, работающим в сфере безопасности, критической инфраструктуры и наук о жизни.
Компания заявляет, что все пользователи, имеющие доступ к Claude Mythos Preview, могут обновиться до Mythos 5 начиная с сегодняшнего дня. Компания планирует расширять доступ в рамках программы доверенного доступа (trusted access program) в сотрудничестве с правительством США.
Это различие важно для секторов, где заблокированные возможности не являются маргинальными случаями, а представляют собой ключевые рабочие процессы. Команде безопасности может потребоваться воспроизвести уязвимости, проверить их эксплуатируемость, проанализировать латеральное перемещение или смоделировать поведение атакующего в контролируемой среде. Исследовательской группе биологов может потребоваться проанализировать рабочие процессы молекулярного дизайна, которые вызвали бы срабатывание универсальных защитных механизмов. Fable 5 не создана для того, чтобы предоставлять каждому пользователю неограниченный доступ к таким возможностям; Mythos 5 предназначена для проверенных пользователей, которым они действительно необходимы.
В Anthropic утверждают, что Mythos 5 обладает самыми мощными возможностями в области кибербезопасности среди всех моделей в мире. В таблице бенчмарков компании семейство моделей набирает 78,0% в ExploitBench по сравнению с 69,0% у Claude Mythos Preview, 40,0% у Opus 4.8 и 34,0% у GPT-5.5. В CyberGym график Anthropic показывает результат Mythos 5 на уровне 83,8%, что немного опережает Mythos Preview с 83,1% и значительно превосходит Opus 4.8 со стандартными настройками защиты.
Компания приводит аналогичные аргументы в области биологии. В Anthropic заявляют, что модели класса Mythos превосходят специализированные языковые модели белков в задаче, связанной с аденоассоциированными вирусами — механизмом доставки, используемым в генной терапии. Компания преподносит это как многообещающий, так и рискованный факт: те же возможности, которые могут помочь исследованиям в области генной терапии, могут быть использованы и в опасных биологических работах.
Anthropic заявляет, что ее внутренние эксперты по дизайну белков использовали Mythos 5 для ускорения процессов разработки лекарств примерно в десять раз. В качестве примера компания приводит случай, когда Mythos 5 с использованием инструментов белкового дизайна и биоинформатики без вмешательства человека сравнялась с квалифицированными операторами-людьми или превзошла их, выбирая сайты связывания, подбирая и запуская инструменты, а также справляясь со сбоями. В Anthropic сообщают, что девять из 14 белковых мишеней в исследовании привели к созданию перспективных кандидатов для разработки лекарств, которые компания сейчас изучает.
Компания также заявляет, что Mythos 5 генерировала новые гипотезы в области молекулярной биологии, которым ученые Anthropic отдавали предпочтение перед гипотезами моделей класса Opus примерно в 80% случаев при слепом сравнении. По словам Anthropic, несколько таких идей уже перешли в стадию экспериментальной оценки, а одна гипотеза, касающаяся белка E. coli, была впоследствии подтверждена независимой лабораторией, работавшей над той же проблемой.
Эти заявления потенциально значимы, но к ним следует относиться с осторожностью до публикации подробностей. В Anthropic заявляют о намерении опубликовать дополнительные результаты в ближайшие месяцы. На данный момент главный вывод для бизнеса носит направленный характер: компания уверена, что ее топовые модели уже способны выполнять части рабочих процессов научных исследований с меньшим вмешательством человека, чем предыдущие системы.
Новое требование по более длительному хранению данных
Компания также представила новую политику хранения данных для моделей класса Mythos. В Anthropic заявляют, что вводят обязательное 30-дневное хранение всей информации для запросов к Fable 5, Mythos 5 и будущим моделям с аналогичным или более высоким уровнем возможностей как в собственных, так и в сторонних интерфейсах. Компания заявляет, что не будет использовать эти данные для обучения новых моделей Claude или в целях, не связанных с безопасностью, и добавляет средства защиты конфиденциальности, включая логирование доступа человека и удаление данных через 30 дней практически во всех случаях.
Эта политика может стать одним из самых сложных вопросов при принятии корпоративных решений о покупке Fable 5. Многие компании стремятся получить возможности передового ИИ, но также требуют строгого контроля за хранением данных, особенно в регулируемых секторах. Позиция Anthropic заключается в том, что для моделей с таким уровнем возможностей необходим более жесткий мониторинг. Корпоративным клиентам придется самостоятельно решать, оправдывает ли прирост возможностей требования к хранению данных.
Последствия для бизнеса
Более широкое значение Fable 5 для бизнеса заключается в том, что Anthropic пытается коммерциализировать более автономный класс ИИ-моделей, не открывая все их возможности каждому пользователю. Это может стать шаблоном для того, как передовые лаборатории будут выпускать все более мощные системы: одно семейство моделей, несколько уровней доступа и ограничения для конкретных доменов в зависимости от уровня доверия к пользователю и рисков.
Если Fable 5 будет работать так, как описывают Anthropic и первые клиенты, разработчики смогут перекладывать на нее более крупные задачи: миграцию кода, рефакторинг, создание интерфейсов, написание тестов, исправление багов, составление документации, разработку внутренних инструментов и создание многоэтапных приложений.
Для компаний, ориентированных на интеллектуальную работу, Fable 5 может сделать ИИ более полезным в рабочих процессах, где предыдущие модели были слишком несовершенными: финансовых исследованиях, анализе таблиц, юридическом рецензировании, анализе закупок, подготовке материалов для совета директоров, рыночных исследованиях, операциях в сфере продаж и планировании проектов. Главный выигрыш заключается не просто в лучших ответах, а в меньшем количестве итераций, меньшем числе исправлений и большей способности продолжать работу в условиях неопределенности.
Для команд безопасности запуск выглядит сложнее. Большинство организаций получат Fable 5, а не неограниченный Mythos 5. Это означает, что они могут рассчитывать на более качественное общее кодирование и анализ, но не на полный доступ к кибервозможностям, которые Anthropic считает рискованными. Доверенные защитники в рамках Project Glasswing получат Mythos 5, что предоставит им более прямой инструмент для обнаружения уязвимостей и защитного тестирования.
Для компаний, работающих в сфере наук о жизни, картина схожа. Fable 5 может помочь с общими исследованиями, анализом литературы, интерпретацией данных и научными рассуждениями, однако более чувствительные биологические возможности будут ограничены. Anthropic фактически создает отдельный путь доступа для проверенных исследователей, чья работа требует возможностей, способных стать опасными в чужих руках.
Запуск также усиливает конкурентное давление во всей индустрии ИИ. Anthropic заявляет о передовых результатах в агентском кодировании, интеллектуальной работе, компьютерном зрении, кибербезопасности, юридических рассуждениях, пространственном мышлении и медицинских бенчмарках. Однако более значимым с точки зрения стратегии может оказаться утверждение компании о том, что она нашла работающий механизм выпуска моделей, стоящих выше класса Opus. Если защитные механизмы Fable 5 выдержат проверку реальным миром, Anthropic сможет доказать, что способна выводить на рынок более мощные модели быстрее, не открывая при этом самые опасные возможности настежь.
Это по-прежнему большое «если». Корпоративный рынок проверит не только производительность Fable 5 в бенчмарках, но и ее надежность, частоту ложных срабатываний, издержки хранения данных и масштабируемую стоимость. Модель, способная выполнять больше работы автономно, также способна сжигать больше токенов, порождать больше вопросов управления и создавать новую нагрузку на команды, которым приходится проверять ее результаты.
Тем не менее сегодняшний запуск знаменует собой четкий сдвиг в линейке моделей Claude. Opus больше не является высшим коммерческим уровнем возможностей Anthropic. Модели класса Mythos теперь стоят выше него. Fable 5 — первая версия этого уровня для обычных пользователей; Mythos 5 — ограниченная версия для доверенной работы с повышенным риском. Вместе они демонстрируют план Anthropic по внедрению передового ИИ в корпоративные рабочие процессы с одновременным удержанием под замком наиболее опасных возможностей.



