За что стоит сказать спасибо ИИ в 2025 году

За что стоит сказать спасибо ИИ в 2025 году

Здравствуйте, дорогие читатели! С прошедшим Днем благодарения и Черной пятницей!

Этот год был похож на жизнь внутри перманентного DevDay. Каждую неделю какая-нибудь лаборатория выпускает новую модель, новый фреймворк для агентов или новую демо-версию в стиле «это все меняет». Это ошеломляет. Но это также первый год, когда у меня появилось ощущение, что Искусственный интеллект наконец-то начинает диверсифицироваться — это больше не одна или две передовые модели в облаке, а целая экосистема: открытая и закрытая, гигантская и крошечная, западная и китайская, облачная и локальная.

Итак, вот за что я действительно благодарен в сфере ИИ в 2025 году — за релизы, которые, как мне кажется, будут иметь значение через 12–24 месяца, а не только в рамках шумихи этой недели.

1. OpenAI продолжала выпускать мощные продукты: GPT-5, GPT-5.1, Atlas, Sora 2 и открытые веса

Будучи компанией, которая бесспорно породила эпоху «генеративного ИИ» со своим вирусным хитом ChatGPT в конце 2022 года, OpenAI, пожалуй, столкнулась с одной из самых сложных задач среди всех ИИ-компаний в 2025 году: сохранить траекторию роста, даже когда хорошо финансируемые конкуренты вроде Google с их моделями Gemini и другие стартапы вроде Anthropic представили собственные высококонкурентные решения.

К счастью, OpenAI справилась с вызовом — и даже больше. Главным событием стал релиз GPT-5 в августе в качестве новой передовой модели для рассуждений, за которым в ноябре последовала GPT-5.1 с новыми «мгновенными» (instant) и «мыслительными» (thinking) вариантами, которые динамически регулируют время «размышлений» над каждой задачей.

На практике запуск GPT-5 прошел непросто — VentureBeat писала о ранних сбоях в математике и кодинге, а также о более сдержанной, чем ожидалось, реакции сообщества в статье «Запуск GPT-5 от OpenAI проходит не гладко», но компания быстро провела работу над ошибками на основе отзывов пользователей. Как ежедневный пользователь этой модели, я лично доволен ею и впечатлен.

В то же время предприятия, реально использующие модели, сообщают о солидных результатах. Например, компания ZenDesk Global заявляет, что агенты на базе GPT-5 теперь решают более половины клиентских тикетов, а у некоторых клиентов показатели успешного решения достигают 80–90%. Это та самая тихая новость: эти модели не всегда могут впечатлить завсегдатаев X (бывший Twitter), но они начинают двигать реальные ключевые показатели эффективности (KPI).

Что касается инструментов, OpenAI наконец-то предоставила разработчикам серьезного ИИ-инженера — GPT-5.1-Codex-Max, новую модель для написания кода, способную выполнять долгосрочные агентские рабочие процессы. Она уже стала стандартом по умолчанию в среде Codex от OpenAI. VentureBeat подробно рассказала об этом в материале «OpenAI представляет кодинг-модель GPT-5.1-Codex-Max, которая уже внутренне выполнила 24-часовую задачу».

Затем появился ChatGPT Atlas — полноценный веб-браузер со встроенным прямо в Chrome ChatGPT, включающий в себя резюме сайдбара, анализ страниц и поиск, тесно интегрированные в обычный просмотр веб-страниц. Это самый яркий знак того, что понятия «ассистент» и «браузер» движутся навстречу друг другу.

В сфере мультимедиа Sora 2 превратила оригинальное видеодемо Sora в полноценную модель видео- и аудиогенерации с улучшенной физикой, синхронизированным звуком и диалогами, а также с расширенным контролем стиля и структуры кадров. Кроме того, появилось специальное приложение Sora с полноценной составляющей социальной сети, позволяющее любому пользователю создать собственную телевизионную сеть в своем кармане.

И наконец — возможно, самое символичное — OpenAI выпустила gpt-oss-120B и gpt-oss-20B, открытые модели рассуждений типа MoE (Mixture of Experts) под лицензией стиля Apache 2.0. Что бы вы ни думали об их качестве (а ранние пользователи open-source бурно выражали свои жалобы), это первый случай со времен GPT-2, когда OpenAI выложила серьезные веса в общественное достояние.

2. Китайская волна открытого исходного кода становится мейнстримом

Если 2023 и 2024 годы прошли под знаком Llama и Mistral, то 2025 год принадлежит экосистеме открытых весов Китая.

Исследование MIT и Hugging Face показало, что Китай теперь слегка опережает США по количеству глобальных загрузок открытых моделей, во многом благодаря DeepSeek и семейству Qwen от Alibaba.

Главные моменты:

  • DeepSeek-R1 вышла в январе как модель рассуждений с открытым исходным кодом, конкурирующая с о1 от OpenAI, с весами под лицензией MIT и семейством дистиллированных уменьшенных моделей. VentureBeat следила за этой историей от ее релиза до влияния на кибербезопасность и появления оптимизированных по производительности вариантов R1.

  • Kimi K2 Thinking от Moonshot — «мыслящая» модель с открытым исходным кодом, которая рассуждает шаг за шагом с использованием инструментов, очень похожая на концепт o1/R1, позиционируется как лучшая открытая модель для рассуждений на сегодняшний день в мире.

  • Компания Z.ai выпустила GLM-4.5 и GLM-4.5-Air в качестве «агентских» моделей, открыв базовые и гибридные варианты рассуждений на GitHub.

  • Семейство ERNIE 4.5 от Baidu прибыло в виде полностью открытого мультимодального пакета MoE под лицензией Apache 2.0, включая плотную модель на 0.3B и визуальные «мыслительные» варианты, ориентированные на работу с графиками, дисциплинами STEM и инструментами.

  • Линейка Qwen3 от Alibaba — включая Qwen3-Coder, крупные модели рассуждений и серию Qwen3-VL, выпущенные летом и осенью 2025 года — продолжает задавать высокую планку для открытых весов в кодинге, переводе и мультимодальных рассуждениях, что заставило меня объявить прошедшее лето «летом Qwen.»

VentureBeat отслеживала эти сдвиги, включая китайские математические модели и модели рассуждений, такие как Light-R1-32B и крошечная модель VibeThinker-1.5B от Weibo, которая превзошла базовые показатели DeepSeek при мизерных бюджетах на обучение.

Если вас волнуют открытые экосистемы или локальные варианты развертывания (on-premise), это год, когда китайская сцена открытых весов перестала быть диковинкой и превратилась в серьезную альтернативу.

3. Маленькие и локальные модели взрослеют

Еще одна вещь, за которую я благодарен: у нас наконец-то появляются хорошие маленькие модели, а не просто игрушки.

Компания Liquid AI провела 2025 год, продвигая свои модели Liquid Foundation Models (LFM2) и визуально-языковые варианты LFM2-VL, разработанные с первого дня для развертывания с низким временем отклика и с учетом возможностей устройств — периферийных коробочных решений (edge boxes), роботов и ограниченных в ресурсах серверов, а не только гигантских кластеров. Новая модель LFM2-VL-3B нацелена на встроенную робототехнику и промышленную автономность, а ее демонстрации запланированы на ROSCon.

Со стороны крупных технологических гигантов линейка Gemma 3 от Google убедительно доказала, что «крошечный» все еще может означать «способный». Семейство Gemma 3 охватывает диапазон от 270 млн параметров до 27 млрд, и все они имеют открытые веса, а более крупные варианты поддерживают мультимодальность.

Выдающимся представителем стала Gemma 3 270M — компактная модель, созданная специально для тонкой настройки (fine-tuning) и задач со структурированным текстом (подумайте о кастомных форматтерах, маршрутизаторах и стражах/watchdogs). О ней писали как в блоге разработчиков Google, так и в обсуждениях сообщества в кругах локальных LLM.

Эти модели, возможно, никогда не попадут в тренды X, но они идеально подходят для рабочих нагрузок с повышенными требованиями к конфиденциальности, автономных процессов, тонких клиентов (thin-client devices) и «роев агентов», где вам не нужно, чтобы каждый вызов инструмента обращался к гигантской пограничной LLM.

4. Meta + Midjourney: Эстетика как услуга

Один из самых странных поворотов этого года: Meta заключила партнерское соглашение с Midjourney, вместо того чтобы просто попытаться победить ее.

В августе Meta объявила о сделке по лицензированию «эстетических технологий» Midjourney — ее стека генерации изображений и видео — и интеграции их в будущие модели и продукты Meta, от лент Facebook и Instagram до функций Meta AI.

VentureBeat освещала это в материале «Meta партнерствует с Midjourney и будет лицензировать ее технологии для будущих моделей и продуктов», что породило очевидный вопрос: замедляет ли это или меняет дорожную карту API самой Midjourney? Мы все еще ждем ответа на этот вопрос, но, к сожалению, заявленные планы по выпуску API пока не материализовались.

Однако для создателей контента и брендов немедленный смысл прост: визуальные эффекты уровня Midjourney появляются в мейнстримных социальных инструментах, а не остаются запертыми в боте Discord. Это может сделать более качественный ИИ-арт нормой для гораздо более широкой аудитории — и заставить конкурентов, таких как OpenAI, Google и Black Forest Labs, продолжать поднимать планку.

5. Gemini 3 и Nano Banana Pro от Google

Google попыталась ответить на GPT-5 с помощью Gemini 3, заявленной как ее самая мощная модель на сегодняшний день, с улучшенными рассуждениями, кодингом и мультимодальным пониманием, а также с новым режимом Deep Think для медленных, сложных задач.

Статья VentureBeat «Google представила Gemini 3, заявляя о лидерстве в математике, науке, мультимодальности и агентном ИИ» представила этот релиз как прямой вызов передовым бенчмаркам и агентским рабочим процессам.

Но неожиданным хитом стал Nano Banana Pro (Gemini 3 Pro Image) — новый флагманский генератор изображений от Google. Он специализируется на инфографике, диаграммах, сценах с несколькими объектами и многоязычном тексте, который действительно читабельно отображается в разрешениях 2K и 4K.

В мире корпоративного ИИ, где графики, схемы продуктов и иллюстрации в стиле «объясните эту систему визуально» имеют больший вес, чем фантастические драконы, это огромное достижение.

6. Темные лошадки, за которыми я слежу

Еще несколько релизов, за которые я благодарен, даже если они не укладываются аккуратно в одну категорию:

Заключительная мысль (на данный момент)

Если 2024 год был годом «одной большой модели в облаке», то 2025 год — это год, когда карта взорвалась: множество передовых направлений на вершине, Китай, берущий лидерство в открытых моделях, быстро матереющие маленькие и эффективные системы, и творческие экосистемы вроде Midjourney, вовлекаемые в стеки бигтеха.

Я благодарен не просто за какую-то отдельную модель, а за то, что теперь у нас есть выбор — закрытые и открытые, локальные и хостинговые, ориентированные на рассуждения и на медиаконтент. Для журналистов, разработчиков и предприятий именно это разнообразие является главной новостью 2025 года.

Счастливых праздников, всего наилучшего вам и вашим близким!

ИИ

Смотреть все

Подпишитесь на свежие новости!

Глубокая аналитика для руководителей в области корпоративного ИИ, данных и безопасности

Подписаться по RSS

RSS-ленты обновляются каждые 15 минут.