Anthropic выпускает Claude Haiku 5.5 со снижением цены API на 90%, наравне с GPT-6 Luna

Anthropic выпускает Claude Haiku 5.5 со снижением цены API на 90%, наравне с GPT-6 Luna

Сегодня Anthropic выпустила Claude Haiku 5.5, снизив цены на токены на 90% для запросов объемом менее 100 000 токенов. Модель ориентирована на повторяющиеся задачи, из-за которых использование корпоративного ИИ в больших масштабах может обходиться дорого: составление краткого содержания документов, классификацию информации, запросы к базам данных и выполнение небольших заданий для более мощных агентов.

Стоимость начинается с 0,10 доллара за миллион входных токенов и 0,50 доллара за миллион выходных — столько же стоит GPT-6 Luna от OpenAI. По оценке Anthropic, с учетом размеров запросов и изменений в расходе токенов выполнение рабочих задач обходится примерно на 75% дешевле, чем на Haiku 4.5.

Вместе с запуском также снижена стоимость чтения кэша для Sonnet 5.5, а подписчики Max и Team получат ежемесячные кредиты для API. Таким образом, анонс не ограничивается выпуском одной недорогой модели.

Вспомогательная роль для корпоративных агентов

Anthropic позиционирует Haiku как вспомогательную модель для Opus и Sonnet, которые компания по-прежнему рекомендует для сложных задач программирования. Согласно примеру, приведенному компанией Rogo, разрабатывающей ИИ для финансовой отрасли, крупная модель может подготовить финансовую презентацию, а Haiku — найти показатель выручки, необходимый для одного из слайдов.

«Она достаточно точна, чтобы мы могли ей доверять, и достаточно быстра и дешева, чтобы использовать ее часто», — заявил Алекс Ван, работающий в сфере прикладного ИИ в Rogo. Его слова приводит Anthropic.

Самая значительная экономия — на коротких запросах

У цены есть важное ограничение: при объеме свыше 100 000 токенов Haiku 5.5 стоит 0,50 доллара за миллион входных токенов и 2,50 доллара за миллион выходных. Это на 50% дешевле, чем Haiku 4.5, тогда как для запросов ниже этого порога снижение составляет 90%.

Стоимость за миллион токенов

Haiku 5.5: менее 100 000 токенов

Haiku 5.5: более 100 000 токенов

Haiku 4.5

Входные

0,10 доллара

0,50 доллара

1,00 доллар

Выходные

0,50 доллара

2,50 доллара

5,00 долларов

Чтение кэша

0,01 доллара

0,05 доллара

0,10 доллара

Запись в кэш

0,125 доллара

0,625 доллара

1,25 доллара

Источник: материалы Anthropic о запуске. В них не уточняется, как тарифицируются запросы ровно на 100 000 токенов и какие именно токены учитываются при определении порога.

По данным Anthropic, около 90% запросов к Haiku 4.5 относятся к короткой категории. Оценка средней экономии на рабочих задачах в 75% также учитывает обновленный токенизатор — механизм, который делит содержимое на оплачиваемые единицы. После обновления для выполнения той же работы требуется несколько больше токенов.

Как Haiku выглядит на фоне OpenAI, Google и Grok

Более низкие тарифы делают Haiku конкурентоспособной среди других закрытых моделей, но не означают, что она стала самой дешевой на всем рынке. Luna от OpenAI предлагает те же четыре тарифа, что и Haiku в нижней ценовой категории, включая кэширование.

Модель

Входные токены за миллион

Выходные токены за миллион

Условия тарификации

Anthropic Claude Haiku 5.5

0,10 доллара

0,50 доллара

Запросы менее чем на 100 000 токенов

OpenAI GPT-6 Luna

0,10 доллара

0,50 доллара

Базовые тарифы; выше — для запросов более чем на 272 000 входных токенов

Google Gemini 3.5 Flash-Lite

0,30 доллара

2,50 доллара

Стандартный тариф

Anthropic Claude Haiku 5.5

0,50 доллара

2,50 доллара

Запросы более чем на 100 000 токенов

Google Gemini 3.8 Flash

0,75 доллара

3,75 доллара

Промотарифы действуют до 31 декабря 2026 года

Grok 4.3

1,25 доллара

2,50 доллара

Менее 200 000 токенов запроса

Grok 4.7

2,00 доллара

6,00 долларов

Менее 200 000 токенов запроса

OpenAI GPT-6.1 Sol

2,00 доллара

10,00 долларов

Базовые стандартные тарифы

Anthropic Claude Sonnet 5.5

2,00 доллара

10,00 долларов

Тарифы, указанные в таблице запуска

Источники: материалы Anthropic; официальные тарифы для GPT-6 Luna, GPT-6.1 Sol, Gemini и Grok; проверены 7 октября. В цифрах не учитываются кэширование, скидки на пакетную обработку, инструменты, региональные надбавки и индивидуальные тарифы. Здесь сравниваются цены, а не сопоставимые возможности моделей.

Пороговые значения контекста имеют значение: верхний тариф Haiku в пять раз выше нижнего, тогда как надбавка для Luna начинает действовать при объеме более 272 000 входных токенов. Одних лишь цен на токены недостаточно, чтобы определить стоимость выполнения задачи: на нее влияют расход токенов, повторные попытки и точность.

Результаты тестов улучшились, но есть оговорка об уровне усилий

В таблице бенчмарков Anthropic показаны улучшения по сравнению с Haiku 4.5 и более высокие результаты, чем у GPT-6 Luna, в приведенных ниже тестах; Sonnet 5.5 при этом по-прежнему опережает Haiku. Это результаты, опубликованные поставщиком, а не результаты независимой проверки.

Тест

Haiku 5.5

Haiku 4.5

GPT-6 Luna

Sonnet 5.5

GDPval-AA v2.1: интеллектуальная работа

1 620

735

1 437

1 840

AA-Briefcase v1.1: интеллектуальная работа

1 578

614

1 336

1 824

OSWorld 2.1, офлайн-подмножество: работа с компьютером

72,4%

15,7%

48,9%

83,9%

Terminal-Bench 4.0: программирование с помощью агентов

39,2%

0,0%

16,4%

70,6%

FrontierCode 1.1, основная оценка

46,4%

—

42,4%

52,1%*

Источник: Anthropic. Для результата Sonnet в FrontierCode указан режим High effort; тире означает, что результат не предоставлен. Значения в первых двух строках — баллы, а не проценты.

В Haiku 5.5 появились настраиваемые уровни усилий; по умолчанию установлен средний. Это важно при интерпретации результатов: на графике Anthropic оценка около 39% в Terminal-Bench соответствует максимальному уровню усилий, тогда как при среднем уровне результат составляет около 20%.

Клиенты отмечают ускорение, но данных о пропускной способности нет

Anthropic называет Haiku своей самой быстрой моделью при стандартной скорости работы, одновременно признавая, что Opus в режиме Fast Mode работает быстрее. В материалах, изученных для этой статьи, компания не приводит показатель в токенах в секунду.

Отзывы клиентов дают более ограниченные данные. Вице-президент по продуктам ИИ в Box Яшодха Бхавнани сообщает об улучшении результата на 11 пунктов по сравнению с Haiku 4.5 и примерно двукратном снижении задержки, не уточняя шкалу оценки. Аарон Винь, ведущий инженер-программист в Asana, отмечает, что задержка при выполнении задач сократилась более чем на 30%, а скорость вывода на один ход агента выросла до 2,5 раза по сравнению с неназванной моделью.

Зив Клапоу, выдающийся инженер-программист в HubSpot, сообщает о среднем результате 92,8% по итогам трех запусков теста CRM компании — это лучший показатель среди проверенных моделей. Отзывы, предоставленные самими компаниями, не позволяют сопоставить пропускную способность разных поставщиков.

Снижение цены Sonnet и новые кредиты для API по подписке

Помимо запуска Haiku, стоимость чтения кэша в Sonnet 5.5 снизится с 0,20 до 0,10 доллара за миллион токенов.

По оценке Anthropic, на типичных задачах с агентами это позволит сэкономить около 20%; фактическая экономия зависит от того, насколько часто приложение повторно использует сохраненный контекст.

На этой неделе начнут предоставлять ежемесячные кредиты для API: 100 долларов подписчикам Max 5x, 200 долларов — Max 20x и до 500 долларов на всех пользователей подписки Team. Кредиты можно потратить на любую модель через платформу Anthropic. В предоставленном проекте не объясняется, как распределяются средства в Team и на каких условиях переносится остаток.

Доступность в облаках и особенности развертывания

По словам Anthropic, Haiku будет доступна через собственную платформу компании, AWS, Google Cloud и Microsoft Azure; идентификатор API — claude-haiku-5-5. Обновления SDK для Python и TypeScript добавляют бета-функции для работы с браузерами и компьютерами. Некоторые действующие клиенты Azure и Google Cloud получат снижение стоимости кэширования для Sonnet в ближайшие дни.

По сравнению с Haiku 4.5 в новой модели также ужесточены ограничения в сфере кибербезопасности: в частности, стандартные меры защиты блокируют тестирование на проникновение. Организации, которым нужен более широкий доступ к возможностям в области кибербезопасности или биологии, могут подать заявку через программы верификации Anthropic.

Для корпоративных разработчиков практическая проверка заключается в том, сможет ли Haiku достаточно надежно выполнять узкую задачу, чтобы оправдать частое использование. Более низкие цены и заявленные улучшения делают такую проверку привлекательнее, однако собственные результаты Anthropic по-прежнему говорят в пользу того, чтобы поручать более сложную работу крупным моделям.

Технологии

Смотреть все

Подпишитесь на свежие новости!

Глубокая аналитика для руководителей в области корпоративного ИИ, данных и безопасности

Подписаться по RSS

RSS-ленты обновляются каждые 15 минут.