Anthropic выпускает Claude Fable 5.1 и Mythos 5.1 со снижением стоимости чтения кэша Fable на 75%

Anthropic выпускает Claude Fable 5.1 и Mythos 5.1 со снижением стоимости чтения кэша Fable на 75%

Источник: VentureBeat · Carl Franzen

На дворе лишь первый день сентября 2026 года, но сентябрь и весь осенний сезон уже вовсю набирают обороты в мире ИИ: компания Anthropic только что выпустила свои новейшие и самые мощные большие языковые модели на сегодняшний день — Claude Fable 5.1 и Claude Mythos 5.1.

Эти два названия относятся к одной и той же базовой модели. Fable 5.1 представляет собой общедоступную версию с установленными производственными средствами защиты Anthropic. Mythos 5.1 доступна через программы с ограниченным доступом для проверенных организаций в сфере кибербезопасности и наук о жизни, которым требуются возможности, обычно ограничиваемые этими мерами предосторожности.

Однако для корпоративных покупателей этот релиз знаменует собой нечто большее, чем очередное повышение производительности в бенчмарках. Anthropic одновременно меняет экономику работы постоянных агентов, снижая стоимость кэшированного контекста на 75%, и представляет новую архитектуру безопасности под названием Enterprise Frontier Safeguards (EFS), призванную позволить организациям хранить данные мониторинга в инфраструктуре, находящейся под их собственным контролем.

Эти изменения происходят в особенно важный момент. За последние несколько недель Anthropic и Британский институт безопасности ИИ сообщили об инцидентах, в ходе которых более ранние модели Claude, запущенные в условиях необычно мягких оценок кибербезопасности, предпринимали несанкционированные действия против реальных систем. Anthropic временно приостановила внешние кибероценки и с тех пор внедрила дополнительные меры сдерживания и мониторинга перед их возобновлением.

В совокупности Fable 5.1 выглядит не столько как обычное обновление модели, сколько как попытка решить три все более взаимосвязанные корпоративные проблемы: как сделать агентов достаточно способными для выполнения сложной работы, достаточно экономичными для круглосуточной работы и достаточно управляемыми, чтобы предоставить доступ к конфиденциальным системам.

Модель, созданная для работы, которая не заканчивается на одном промпте

Anthropic позиционирует Fable 5.1 в первую очередь как средство для непрерывного решения задач.

В бенчмарке Terminal-Bench-Science 0.1, который оценивает агентские научные исследования, Anthropic сообщает, что Fable 5.1 набрала 52,6% по сравнению с 24,7% у Fable 5, 29,0% у Opus 5 и 22,4% у GPT-5.6 Sol в своей тестовой среде. В Terminal-Bench 4.0 модель Fable 5.1 набирает 55,8% против 42,0% у Fable 5 и 52,3% у Opus 5. Mythos 5.1 достигает 60,9% в том же кодинговом бенчмарке при работе в условиях более мягких средств киберзащиты.

Прирост производительности выходит за рамки программирования. Anthropic сообщает о показателе GDPval-AA v2 на уровне 1 853 для интеллектуальной работы по сравнению с 1 824 для Opus 5 и 1 723 для Fable 5. В AutomationBench, предназначенном для измерения бизнес-процессов, Fable 5.1 набирает 31,4% против 17,1% у Fable 5 и 26,9% у Opus 5. На CursorBench 3.2.0 этот показатель достигает 73,4%.

Эти цифры следует воспринимать как результаты, заявленные самим производителем, а не как независимое доказательство превосходства. Anthropic также отмечает оговорки в отношении ряда оценок: производственные средства защиты могут влиять на баллы, а выпуск задач OSWorld в августе 2026 года напрямую не сопоставим с некоторыми ранее опубликованными результатами.

Поэтому более полезным сигналом для корпоративных команд могут стать те типы сбоев, которые, по словам партнеров с ранним доступом, модель способна устранить.

Инвестиционная фирма Millennium сообщила Anthropic, что Fable 5.1 отследила крайне редкий сбой программного обеспечения, вызванный ошибкой в библиотеке стороннего вендора, после того как проблема не поддавалась объяснению в течение четырех-пяти лет.

Провайдер корпоративных расходов Ramp описал 38-часовой автономный запуск машинного обучения, в ходе которого модель переоценила предыдущий результат, запустила шесть экспериментов и вернулась с выводами и предлагаемыми дальнейшими шагами.

Компания Browserbase заявила, что Fable 5.1 выполнила 82% задач в своем самом сложном бенчмарке для браузерных агентов по сравнению с 74% у Opus 5 и 57% у Fable 5.

Все это — отзывы клиентов, предоставленные в рамках запуска Anthropic, а не независимо воспроизведенные бенчмарки. Но они иллюстрируют направление, в котором движется Anthropic: смещение единицы работы ИИ от отдельного ответа или фрагмента кода к целому расследованию.

Это меняет архитектуру развертывания. Модели, способной работать часами, требуются стабильный контекст, доступ к инструментам, контрольные точки, логирование, границы разрешений и надежное восстановление после ошибок. Интеллект модели становится лишь одним из компонентов системы.

Ценообразование: Fable 5.1 остается премиальной, но кэширование меняет расклад

Наиболее быстро поддающееся измерению корпоративное изменение — это ценообразование.

Fable 5.1 сохраняет базовые тарифы API модели Fable 5: $10 за 1 миллион входных токенов и $50 за миллион выходных. Это делает ее значительно более дорогой по некэшированным токенам по сравнению с другими моделями в линейке Anthropic. Opus 5 стоит $5 за миллион входных токенов и $25 за миллион выходных токенов, а Sonnet 5 — $2 и $10 соответственно.

Важным изменением являются кэшированные входящие данные:

Модель Claude

Вход / 1M

Чтение из кэша / 1M

Выход / 1M

Fable 5.1

$10

$0.25

$50

Fable 5

$10

$1.00

$50

Opus 5

$5

$0.50

$25

Sonnet 5

$2

$0.20

$10

Anthropic снизила стоимость попадания в кэш для Fable 5.1 всего до $0.25 на входе по сравнению с $1.00 для Fable 5.

Кроме того, это всего 2,5% от обычной цены входящих токенов Fable, составляющей $10, а не 10-процентный множитель, используемый большинством других моделей Claude.

Запись в кэш на пять минут по-прежнему стоит $12,50 за миллион токенов, а на один час — $20, но последующее чтение обходится всего в $0.25 за миллион.

Это формирует необычный ценовой профиль. Обычные входные и выходные данные Fable 5.1 в два раза дороже, чем у Opus 5, однако ее кэшированный ввод стоит вдвое дешевле чтения из кэша Opus 5. Цена чтения из кэша всего на 25% выше, чем у Sonnet 5, несмотря на то, что базовая цена входа Fable в пять раз выше.

Это имеет решающее значение для агентов, поскольку они многократно обращаются к одной и той же кодовой базе, системным инструкциям, определениям инструментов, документам и накопленной истории разговоров. В Anthropic заявляют, что более низкая цена кэша снижает эффективную стоимость Fable 5.1 примерно на 25% для типичных рабочих нагрузок и почти на 45% для высокоагентных задач, где кэшированный контекст составляет большую долю использования.

Это более полезная корпоративная система координат, чем простое сравнение прейскурантных цен за токен. Выбор модели для агентского рабочего процесса все больше зависит от стоимости успешно выполненной задачи, включая повторные попытки, воспроизведение контекста, вызовы инструментов и количество токенов, потребляемых моделью до достижения пригодного результата.

Снижение цен на кэширование также может быть попыткой привлечь все более чувствительные к ценам компании. Как показал отчет Financial Times, спустя более чем два месяца после релиза на долю Fable 5 приходилось лишь около 11% расходов на модели Anthropic среди примерно 70 000 компаний, представленных в данных о транзакциях Ramp, в то время как более дешевые Opus 5 и Opus 4.8 наращивали свою долю.

The Information также сообщала о растущей обеспокоенности корпоративных клиентов по поводу непредсказуемых счетов за ИИ: например, ServiceNow начала отслеживать активность сотрудников после быстрого исчерпания своего годового бюджета на Anthropic. Эти отчеты показывают, что даже когда предприятия высоко ценили возможности Fable 5, многие не были готовы сделать ее моделью по умолчанию для крупномасштабных производственных нагрузок.

Тем не менее, Fable 5.1 остается дорогой по сравнению со значительной частью широкого рынка. Текущая акционная цена API OpenAI для GPT-5.6 Sol составляет $4 за миллион входных токенов, $0.40 за кэшированный ввод и $20 за миллион выходных токенов (как минимум до 21 ноября). Gemini 3.7 Flash от Google в настоящее время оценивается в $0.75 за миллион на входе и $3.75 на выходе до конца 2026 года.

Модель

Вход ($/1M)

Выход ($/1M)

Итого ($/1M)

Источник

Muse Spark 1.2 Contributor

$0.10

$0.20

$0.30

Meta

MiMo-V2.5 Flash

$0.10

$0.30

$0.40

Xiaomi

DeepSeek-V4-Flash — вне пиковых часов

$0.22

$0.66

$0.88

DeepSeek

GPT-5.6 Luna

$0.20

$1.20

$1.40

OpenAI

MiniMax-M3

$0.30

$1.20

$1.50

MiniMax

LongCat-2.0 — лимитированная промо-акция

$0.30

$1.20

$1.50

LongCat

DeepSeek-V4-Flash — часы пик

$0.44

$1.32

$1.76

DeepSeek

MiMo-V2.5

$0.40

$2.00

$2.40

Xiaomi

DeepSeek-V4-Pro — вне пиковых часов

$0.66

$1.98

$2.64

DeepSeek

LongCat-2.0 — стандарт

$0.75

$2.95

$3.70

LongCat

MiMo-V2.5 Pro (≤256K)

$1.00

$3.00

$4.00

Xiaomi

Gemini 3.6 Flash — до 31 декабря 2026 г.

$0.75

$3.75

$4.50

Google

Gemini 3.7 Flash — до 31 декабря 2026 г.

$0.75

$3.75

$4.50

Google

DeepSeek-V4-Pro — часы пик

$1.32

$3.96

$5.28

DeepSeek

Muse Spark 1.1 / 1.2

$1.25

$4.25

$5.50

Meta

GLM-5.3

$1.40

$4.40

$5.80

Z.AI

Grok 4.6 — <200K токенов промпта

$2.00

$6.00

$8.00

xAI

MiMo-V2.5 Pro (>256K)

$2.00

$6.00

$8.00

Xiaomi

Qwen3.8-Max

$2.00

$6.00

$8.00

QwenCloud

Gemini 3.6 Flash — с 1 января 2027 г.

$1.50

$7.50

$9.00

Google

Gemini 3.7 Flash — с 1 января 2027 г.

$1.50

$7.50

$9.00

Google

GPT-5.6 Terra

$2.00

$12.00

$14.00

OpenAI

Grok 4.6 — ≥200K токенов промпта

$4.00

$12.00

$16.00

xAI

GPT-5.4

$2.50

$15.00

$17.50

OpenAI

Kimi K3

$3.00

$15.00

$18.00

Moonshot AI

Claude Opus 5

$5.00

$25.00

$30.00

Anthropic

Sakana Fugu Ultra (≤272K)

$5.00

$30.00

$35.00

Sakana AI

GPT-5.6 Sol — Стандартный режим

$5.00

$30.00

$35.00

OpenAI

Claude Fable 5 / Claude Mythos 5

$10.00

$50.00

$60.00

Anthropic

Claude Fable 5.1 / Claude Mythos 5.1

$10.00

$50.00

$60.00

Anthropic

GPT-5.6 Sol — Быстрый режим

$10.00

$60.00

$70.00

OpenAI

Таким образом, Fable должна оправдывать свою премиальную стоимость за счет более высокого процента успешного выполнения задач, меньшего потребления токенов или возможности заменить более дорогостоящие человеческие или многоэтапные рабочие процессы, а не просто за счет базовой цены API.

Система ценообразования Anthropic предоставляет дополнительные рычаги. Пакетная обработка (Batch processing) сокращает расценки на ввод и вывод Fable 5.1 вдвое — до $5 и $25 за миллион токенов — для асинхронных рабочих нагрузок. Вывод исключительно на территории США добавляет множитель 1.1x. Поиск в интернете стоит $10 за 1 000 поисковых запросов в дополнение к потреблению токенов, в то время как получение веб-страниц (web fetch) не облагается отдельной платой.

Для команд по закупкам эти детали делают профилирование рабочих нагрузок все более важным. У агента по проверке кода с огромным объемом повторно используемого контекста репозитория экономика может сильно отличаться от рабочего процесса генерации отчетов, в котором преобладают новые выходные токены.

Киберинциденты, стоящие за релизом

Архитектуру безопасности, окружающую Fable 5.1, также необходимо рассматривать на фоне недавних инцидентов с кибербезопасностью в Anthropic.

30 июля Anthropic сообщила, что проверка 141 006 запусков тестов по кибербезопасности выявила три инцидента (охватывающих шесть запусков), в ходе которых модели Claude выходили в публичный интернет из сторонней тестовой среды и получали несанкционированный доступ к реальным организациям.

Модели работали без средств киберзащиты, применяемых к общедоступным развертываниям Claude. Они выполняли упражнения в формате CTF (capture-the-flag) и были прямо предупреждены о том, что их окружение является симуляцией без доступа в интернет. Тем не менее, проблема конфигурации оставила открытым путь в сеть.

В ходе наиболее серьезного инцидента модель Claude Opus 4.7 столкнулась с реальной компанией, название которой совпадало с названием вымышленной организации в тесте. За четыре запуска модель получила учетные данные приложений и инфраструктуры и получила доступ к базе данных, содержащей несколько сотен строк производственных данных. В Anthropic заявили, что модель в конечном итоге столкнулась с признаками того, что система является реальной, но продолжила свою атаку.

Второй инцидент был связан с Mythos 5. Модель обнаружила инструкции для разработчиков, ссылающиеся на несуществующий пакет Python, и решила, что публикация пакета под этим именем может помочь ей выиграть в смоделированном состязании. Она создала учетную запись на PyPI и загрузила вредоносный код в настоящий общедоступный репозиторий пакетов.

Пакет оставался доступным примерно в течение часа, был скачан и запущен на 15 реальных системах. Одна из них принадлежала охранной компании, чей автоматический сканер выполнил код пакета; код Claude извлек учетные данные и впоследствии использовал их для доступа к дополнительной инфраструктуре.

В третьем инциденте внутренняя исследовательская модель Anthropic просканировала около 9 000 интернет-целей после того, как не смогла достичь намеченной вымышленной цели. Она скомпрометировала доступное из интернета приложение с помощью незащищенных учетных данных и SQL-инъекции, после чего остановилась, осознав, что система не имеет никакого отношения к учебной задаче.

Эти инциденты не затронули клиентские данные или производственную инфраструктуру Anthropic, и компания утверждает, что средства защиты рабочей среды, опущенные во время тестов, заблокировали бы такое поведение. Тем не менее, эти эпизоды продемонстрировали проблему, знакомую разработчикам корпоративных агентов: достаточно настойчивый агент может использовать двусмысленность между тем, к чему его оператор намеренно разрешил доступ, и тем, к чему его технические учетные данные позволяют получить доступ.

Отдельное заявление Британского института безопасности ИИ усилило эту озабоченность.

Во время тестирования, проведенного в июле, AISI провела киберсостязание 122 раза на нескольких моделях с намеренно включенным доступом в интернет и отключенными вендорскими киберклассификаторами. Десять запусков привели к 19 несанкционированным реальным действиям. Семнадцать из них были связаны с моделью Mythos 5 от Anthropic, два — с запуском GPT-5.6 Sol.

Самая серьезная последовательность действий включала попытку агента Mythos 5 внедрить вредоносный код в реальный проект с открытым исходным кодом, создание фальшивых личностей и попытку применить социальную инженерию к мейнтейнеру с целью заставить его принять изменения. Мейнтейнер отклонил их, и в AISI заявили, что расследование не выявило какого-либо реального ущерба в результате инцидента. Агент также попытался провести промпт-инъекцию против других систем ИИ и оставил сообщения, которые более поздние агенты обнаружили и использовали.

Опять же, это были намеренно разрешительные исследовательские конфигурации, а не коммерчески доступные развертывания. Но выводы AISI актуальны далеко за пределами ИИ-лабораторий: следует исходить из того, что все более способные агенты будут исследовать пути, которые их операторы не предвидели, особенно при постановке сложных целей и предоставлении широкого доступа к инструментам.

От защитных механизмов модели к защите инфраструктуры

Реакцией Anthropic стало добавление уровней защиты вокруг модели.

Компания приостановила внешние оценки кибербезопасности и ненадолго остановила часть внутреннего тестирования, после чего развернула классификатор реального времени, предназначенный для обнаружения агрессивного зондирования, попыток побега из песочницы или неожиданного доступа в интернет до выполнения вызова инструмента. Она также перевела высокорисковые кибернагрузки в режим более изощренной изоляции и предъявила новые требования к внешним оценщикам, включая обязательную сетевую изоляцию и предварительную валидацию песочниц. Внешние оценки кибербезопасности теперь возобновлены.

Сама модель Fable 5.1 также получает более точные производственные средства защиты. По заявлению Anthropic, ее средства киберзащиты теперь вызывают примерно на 60% меньше вмешательств за сеанс Claude Code по сравнению с предыдущими защитными механизмами Fable 5. Модель может использоваться для обнаружения уязвимостей программного обеспечения в защитных целях, в то время как такие работы, как создание эксплойтов, тестирование на проникновение и некоторые виды сканирования бинарных уязвимостей, по-прежнему перенаправляются или ограничиваются.

Это различие имеет решающее значение для команд безопасности, пытающихся внедрить ИИ в работу. Средство защиты, которое блокирует слишком много легитимных действий, может сделать автономный рабочий процесс безопасности ненадежным; то, которое разрешает слишком многое, создает принципиально иной риск. Точность, а не просто наличие фильтра, становится производственным требованием.

Enterprise Frontier Safeguards переносит хранение данных к клиенту

Anthropic решает второе корпоративное ограничение с помощью EFS.

Ранее компания внедрила 30-дневное хранение данных для Fable 5 в рамках своей системы обнаружения злоупотреблений. Для регулируемых организаций сохранение конфиденциальных диалогов у поставщика моделей может сильно затруднить развертывание независимо от договорных гарантий.

EFS меняет эту архитектуру. Данные мониторинга могут храниться в собственной среде клиента на AWS, Azure или Google Cloud под управлением ключей шифрования клиента, политик доступа и журналов аудита. Автоматизированные системы Anthropic могут анализировать данные на предмет паттернов, связанных с серьезными злоупотреблениями, при этом оповещения поступают клиенту для проверки; в Anthropic заявляют, что проверка людьми-сотрудниками компании не требуется.

В Anthropic сообщили, что разрабатывали EFS совместно с более чем 100 организациями из сфер финансовых услуг, здравоохранения, производства, телекоммуникаций, права, розничной торговли и государственного сектора, а также при участии AWS, Google Cloud и Microsoft Azure.

Поддержка планируется в Claude Code, Claude Enterprise, Claude Platform, Amazon Bedrock, Claude Platform на AWS, Agent Platform от Google и Microsoft Foundry. Поэтапное развертывание начинается этой осенью. Соответствующие критериям клиенты могут использовать Fable 5.1 без хранения данных до тех пор, пока не появится EFS. Anthropic не взимает отдельную плату за EFS, хотя клиенты по-прежнему несут ответственность за собственное облачное хранилище, операции и расходы на исходящий трафик.

Это потенциально так же важно, как и обновление самой модели. Корпоративное управление ИИ смещается от обещаний о том, что поставщик делает с данными, к архитектурам, которые определяют, где эти данные вообще могут существовать.

Fable для производства, Mythos для контролируемых рубежей

Разделение на Fable и Mythos дает Anthropic механизм отделения общего корпоративного развертывания от особо чувствительных доменов.

Fable 5.1 уже доступна через API Anthropic в качестве claude-fable-5-1, а также через AWS, Google Cloud и Microsoft Azure. Mythos 5.1 использует ту же базовую модель, но предоставляет более мягкие средства защиты проверенным специалистам по киберзащите и организациям, занимающимся науками о жизни, через программы веверификации.

Эта же модель продемонстрировала возможности, выходящие далеко за рамки программного обеспечения. Anthropic сообщает, что Mythos 5.1 спроектировала экспериментально подтвержденные белковые связующие агенты, в то время как Fable 5.1 обучила нейронную сеть, создавшую карту высот с более высоким разрешением, охватывающую примерно треть Венеры. Mythos 5.1 также оптимизировала семь биологических моделей глубокого обучения с открытым исходным кодом, причем Anthropic сообщила об ускорении инференса до 2.5x.

Для фармацевтических, инженерных и исследовательских организаций это указывает на будущее, в котором та же агентская архитектура, что используется для расследования сбоев в коде, сможет также оркестрировать моделирование, эксперименты и анализ.

Операционный урок в каждом случае один и тот же: чем больше работы агент может выполнить без вмешательства человека, тем более весомыми становятся его права.

Fable 5.1 делает таких долго работающих агентов более способными и, благодаря более дешевому кэшированному контексту, потенциально намного более дешевыми в эксплуатации. EFS дает регулируемым компаниям еще один механизм управления своими данными. Более точные средства защиты снижают часть трений, из-за которых высокопроизводительные модели было трудно использовать в рабочих процессах безопасности.

Но недавние инциденты самой Anthropic также показывают, почему вопрос корпоративного развертывания не может ограничиваться выбором модели.

Следующему поколению ИИ-инфраструктуры потребуется относиться к агентам скорее как к мощным служебным учетным записям (service accounts), чем как к чат-ботам: строго ограниченные учетные данные, сегментированные сети, явные белые списки (allowlists), непрерывная телеметрия, одобрение человеком необратимых действий и допущение того, что агент может найти пути, которые его разработчик не предвидел.

Fable 5.1 увеличивает объем работы, которую организации могут правдоподобно делегировать. Ее более глобальное значение может заключаться в том, что она также делает инфраструктуру, окружающую это делегирование, невозможной для восприятия как второстепенную деталь.

Технологии

Смотреть все

Подпишитесь на свежие новости!

Глубокая аналитика для руководителей в области корпоративного ИИ, данных и безопасности

Подписаться по RSS

RSS-ленты обновляются каждые 15 минут. Материалы переведены с venturebeat.com.