Появилась новая модель для программирования Composer 2 от Cursor: она превосходит Claude Opus 4.6, но всё ещё уступает GPT-5.4

Появилась новая модель для программирования Composer 2 от Cursor: она превосходит Claude Opus 4.6, но всё ещё уступает GPT-5.4

Cursor, платформа для написания кода с использованием искусственного интеллекта из Сан-Франциско от стартапа Anysphere, оцениваемого в 29,3 миллиарда долларов, запустила Composer 2 — новую дообученную вариацию китайской открытой модели Kimi K2.5, которая теперь доступна в среде программирования Cursor на базе ИИ-агентов и демонстрирует значительно улучшенные результаты на тестах по сравнению с предыдущей собственной моделью.

Компания также выпускает и делает Composer 2 Fast — более дорогой, но быстрый вариант — моделью по умолчанию для пользователей.

Ниже приведена структура затрат:

Это значительное снижение цен по сравнению с предыдущей собственной моделью Cursor, Composer 1.5 от февраля, которая стоила 3,50 доллара за миллион входных токенов и 17,50 доллара за миллион выходных токенов; Composer 2 примерно на 86% дешевле по обеим позициям.

Composer 2 Fast также примерно на 57% дешевле, чем Composer 1.5.

Существуют также скидки на «кэшированное чтение» (то есть повторную отправку части тех же токенов в промпте модели): 0,20 доллара за миллион токенов для Composer 2 и 0,35 доллара за миллион для Composer 2 Fast по сравнению с 0,35 доллара за миллион для Composer 1.5.

Также важно то, что это, судя по всему, собственный релиз Cursor, а не широко распространенная автономная модель. В анонсе компании и документации модели указано, что Composer 2 доступен в Cursor, оптимизирован для рабочего процесса агентов Cursor и интегрирован со стеком инструментов продукта.

Предоставленные материалы не указывают на отдельную доступность через внешние платформы моделей или в качестве универсального API за пределами среды Cursor.

Cursor делает ставку на долгосрочное программирование, а не только на улучшенные дополнения кода

Главное техническое утверждение в этом релизе заключается не просто в том, что Composer 2 набирает больше баллов, чем Composer 1.5. Речь идет о том, что, по заявлению Cursor, модель лучше приспособлена для долгосрочного программирования с помощью агентов.

В своем блоге Cursor сообщает, что прирост качества достигнут благодаря первому этапу непрерывного предварительного обучения, которое обеспечило более прочную основу для масштабируемого обучения с подкреплением. Исходя из этого, компания заявляет, что обучила Composer 2 выполнению долгосрочных задач по программированию, и модель способна решать проблемы, требующие сотен действий.

Эта формулировка важна, так как она решает одну из самых нерешенных проблем в сфере ИИ для кодинга. Многие модели хороши в генерации изолированных фрагментов кода. Гораздо меньшее их число остается надежным в рамках более длительного рабочего процесса, который включает в себя чтение репозитория, принятие решений об изменениях, редактирование нескольких файлов, выполнение команд, интерпретацию сбоев и продвижение к цели.

Документация Cursor подтверждает, что это именно тот сценарий использования, который их волнует. В ней Composer 2 описывается как агентная модель с окном контекста в 200 000 токенов, оптимизированная для использования инструментов, редактирования файлов и операций в терминале внутри Cursor.

В ней также отмечены такие методы обучения, как самосуммирование для долго выполняющихся задач. Для разработчиков, которые уже используют Cursor в качестве основной среды, такая более точная настройка может иметь гораздо большее значение, чем абстрактные победы в таблицах лидеров.

Прирост производительности в тестах существенен, хотя GPT-5.4 по-прежнему лидирует по одному ключевому показателю

Cursor Composer 2 benchmarks.

Сравнение Cursor Composer 2 с другими ведущими моделями по независимым тестам. Источник: Cursor

Опубликованные Cursor результаты демонстрируют явное улучшение по сравнению с предыдущими моделями Composer. Компания указывает для Composer 2 результат 61.3 на CursorBench, 61.7 на Terminal-Bench 2.0 и 73.7 на SWE-bench Multilingual.

Для сравнения: показатели Composer 1.5 составляют 44.2, 47.9 и 65.9, а Composer 1 — 38.0, 40.0 и 56.9.

Этот релиз выглядит более сдержанным по сравнению с некоторыми другими запусками моделей, поскольку Cursor не заявляет о всеобщем лидерстве.

В тесте Terminal-Bench 2.0, измеряющем эффективность работы ИИ-агента в интерфейсах командной строки, GPT-5.4 по-прежнему лидирует с результатом 75.1, в то время как Composer 2 набирает 61.7, опережая Opus 4.6 (58.0), Opus 4.5 (52.1) и Composer 1.5 (47.9).

Cursor Composer 2 score on Terminal-Bench 2.0 compared to other leading models.

Результаты Cursor Composer 2 в тесте Terminal-Bench 2.0 по сравнению с другими ведущими моделями. Источник: Cursor

Это делает предложения Cursor более прагматичными и, возможно, более полезными для покупателей. Компания не утверждает, что Composer 2 — лучшая во всем модель. Она заявляет, что модель перешла в более конкурентоспособную весовую категорию, предлагая при этом более привлекательную экономику и глубокую интеграцию с продуктом, который разработчики уже используют.

Cursor также включила в свой набор тестов CursorBench график зависимости производительности от стоимости, который призван продемонстрировать преимущества Composer 2 с точки зрения эффективности Парето.

Cursor Composer 2 Performance vs. Cost model comparison chart

График сравнения производительности и стоимости моделей Cursor Composer 2. Источник: Cursor

На этой графической иллюстрации Composer 2 занимает более выгодную позицию по соотношению затрат и производительности по сравнению с Composer 1.5 и выгодно отличается от более дорогостоящих конфигураций GPT-5.4 и Opus 4.6, представленных Cursor. Главный посыл компании заключается не просто в том, что Composer 2 превосходит предшественника по баллам, а в том, что он может предложить более эффективный баланс между стоимостью и интеллектом для повседневной работы с кодом внутри Cursor.

Почему фактор «привязки к Cursor» имеет значение для покупателей

Для читателей, решающих, стоит ли использовать Composer 2, самым важным вопросом может стать вовсе не производительность в бенчмарках сама по себе, а то, нужен ли им инструмент, оптимизированный под пользовательский интерфейс самого Cursor.

Это может стать преимуществом. Согласно документации, Composer 2 может получать доступ к стеку агентских инструментов Cursor, включая семантический поиск по коду, поиск по файлам и папкам, чтение и редактирование файлов, команды оболочки, управление браузером и доступ в веб.

Подобная интеграция может оказаться ценнее «сырого» качества модели, если конечная цель — выполнение реальных программных задач, а не создание впечатляющих ответов с первой попытки.

Но это также сужает целевую аудиторию. Командам, ищущим модель, которую можно широко развернуть на множестве внешних инструментов и платформ, следует учитывать, что Cursor позиционирует Composer 2 как инструмент для собственных пользователей, а не как универсальную общедоступную базовую модель.

Общая картина: Cursor делает ставку на практическую пользу

Значение Composer 2 заключается вовсе не в том, что Cursor внезапно занял первое место во всех тестах на написание кода. Это не так. Гораздо важнее то, что Cursor выдвигает прагматичный аргумент: ее модель становится лучше, цены достаточно низкие для стимулирования массового использования, а более быстрый тариф работает настолько оперативно, что компания без колебаний делает его стандартным вопреки более высокой стоимости.

Такое сочетание может найти отклик у инженерных команд, которых все меньше волнует абстрактный престиж модели, и все больше — то, сможет ли ассистент оставаться полезным на протяжении долгосрочных сессий программирования и не стоить при этом заоблачных денег.

Более широкая ценовая политика Cursor помогает понять уровень конкурентного давления вокруг этого запуска. На текущей странице с ценами Cursor предлагает бесплатный тариф Hobby, план Pro за 20 долларов в месяц, Pro+ за 60 долларов в месяц и Ultra за 200 долларов в месяц для индивидуальных пользователей, причем более высокие тарифы предоставляют больше возможностей для использования моделей от OpenAI, Anthropic и Google.

Что касается корпоративного сегмента, тариф Teams стоит 40 долларов за пользователя в месяц, в то время как Enterprise имеет индивидуальное ценообразование и включает в себя общие лимиты использования, централизованную биллинговую систему, аналитику использования, средства контроля конфиденциальности, единый вход (SSO), журналы аудита и детальные права администратора. Другими словами, Cursor взимает плату не просто за доступ к кодинг-модели. Компания продает управляемый прикладной уровень, который располагается поверх моделей от различных провайдеров, дополняя их функциями для командной работы, корпоративным управлением и инструментами автоматизации процессов.

Эта бизнес-модель испытывает все большее давление по мере того, как компании-разработчики базовых моделей ИИ глубже проникают в сферу написания кода. OpenAI и Anthropic больше не ограничиваются продажей моделей через сторонние продукты; они выпускают собственные интерфейсы для кодинга, агенты и оценочные фреймворки (такие как Codex и Claude Code), что ставит под вопрос объем свободного пространства для промежуточных платформ.

Комментаторы в X (бывший Twitter), хотя их мнение и не обязательно репрезентативно для всего рынка в целом, все чаще пишут о переходе с Cursor на Claude Code от Anthropic, особенно среди опытных пользователей, привлеченных интерфейсами командной строки, более длительными сценариями работы агентов и меньшими накладными расходами.

Некоторые из таких постов описывают разочарование ценовой политикой Cursor, потерей контекста или редактороцентричным интерфейсом, в то время как Claude Code хвалят за более прямой и полноценный агентский подход к работе. Даже при критическом восприятии подобные обсуждения указывают на стратегическую проблему, с которой сталкивается Cursor: компании приходится доказывать, что ее интегрированная платформа, средства управления для команд и теперь уже собственные внутренние модели создают достаточную ценность, чтобы оправдать роль посредника между разработчиками и создателями все более мощных продуктов для кодинга.

Это делает Composer 2 стратегически важным продуктом для Cursor.

Предлагая гораздо более дешевую собственную модель взамен Composer 1.5, тесно интегрируя ее со своими инструментами и делая ускоренную версию стандартом по умолчанию, компания пытается доказать, что она предлагает не просто оболочку для сторонних систем.

Сложность заключается в том, что по мере совершенствования продуктов для кодинга от самих создателей базовых моделей разработчики и корпоративные клиенты могут все чаще задаваться вопросом: нужен ли им вообще отдельный сервис для программирования с помощью ИИ или собственных инструментов создателей моделей вполне достаточно?

Технологии

Смотреть все

Подпишитесь на свежие новости!

Глубокая аналитика для руководителей в области корпоративного ИИ, данных и безопасности

Подписаться по RSS

RSS-ленты обновляются каждые 15 минут.