GPT-5.3 от OpenAI сокращает количество галлюцинаций на 26,8%
Новая модель OpenAI — GPT-5.3 Instant, которая является самым широко используемым решением компании, — сокращает количество галлюцинаций почти на 26,8% по сравнению со своим предшественником, уделяя первостепенное внимание точности и надежности в диалоге в ущерб простому росту производительности, заявляют в OpenAI.
GPT-5.3 Instant, которая по сути является стандартной и наиболее востребованной моделью среди пользователей ChatGPT, также отличается улучшенным тоном, релевантностью и плавностью беседы при меньшем числе отказов. Она доступна как в ChatGPT, так и через API.
В настоящий момент до версии 5.3 будет обновлена только модель Instant, однако в компании сообщили, что уже работают над скорейшим обновлением до версии 5.3 остальных моделей в категориях ChatGPT, Thinking и Pro.
GPT-5.3 Instant сокращает количество галлюцинаций почти на 26,8%
OpenAI провела две внутренние оценки: одну — в сферах с повышенными рисками, включая медицину, финансы и юриспруденцию; вторую — на основе отзывов пользователей.
Судя по результатам проверок в зонах повышенного риска, проведенных компанией, GPT-5.3 Instant снижает количество галлюцинаций на 26,8% при использовании веб-поиска. Надежность при опоре на внутренние знания возросла на 19.7%. Отзывы пользователей показали снижение числа галлюцинаций на 22,5% при обработке запросов с использованием веб-поиска.
В компании отметили, что GPT-5.3 Instant стала надежнее благодаря усовершенствованию механизмов балансировки информации из интернета с собственными внутренними данными для обучения и рассуждений.
«В целом, GPT-5.3 Instant с меньшей вероятностью будет избыточно концентрироваться на результатах веб-поиска, что раньше могло приводить к длинным спискам ссылок или слабо связанной между собой информации. Модель лучше справляется с распознаванием подтекста вопросов и выдачей наиболее важных данных, особенно в самом начале ответа, что делает ответы более релевантными и пригодными к немедленному использованию без ущерба для скорости или тона», — заявили в компании.
В качестве примера в OpenAI привели ситуацию, когда пользователь спрашивает о крупнейшем трансфере в Главной лиге бейсбола и его последствиях. Предыдущая модель, GPT-5.2, зачастую просто выдавала краткую сводку результатов поиска.
Точность выходит на первый план, смещая производительность в качестве главного аргумента OpenAI
Выпуская это обновление — в первую очередь для своей самой популярной модели — OpenAI стремится донести до корпоративных клиентов и других пользователей ChatGPT, что борьба теперь идет не только за производительность модели, но и за ее способность точно опираться на достоверную фактуру. Вместо того чтобы концентрироваться на метриках производительности вроде скорости работы и экономии токенов, компания делает упор на надежность GPT-5.3 Instant.
Конкуренты, такие как Google и Anthropic, также заявляют о повышенной точности в своих новых моделях. В Anthropic отметили, что их новая разработка Claude Sonnet 4.6 дает меньше галлюцинаций, в то время как Google была вынуждена отозвать свою модель Gemma 3 после того, как та выдала галлюцинацию с ложной информацией об одном из законодателей.
GPT-5.3 Instant снижает количество отказов и избавляется от «неловкого» тона
«Это обновление затрагивает те аспекты работы с ChatGPT, с которыми люди сталкиваются ежедневно: тон, релевантность и плавность диалога. Это тонкие проблемы, которые не всегда отражаются в бенчмарках, но именно они определяют, воспринимается ли ChatGPT как полезный инструмент или как источник разочарования. GPT-5.3 Instant напрямую учитывает отзывы пользователей в этих областях», — отмечается в блоге OpenAI.
GPT-5.3 Instant отличается более естественным стилем общения, отойдя от того тона, который в OpenAI назвали «неловким» (cringe) — он казался излишне навязчивым и делал преждевременные выводы о намерениях пользователя. Компания отметила, что позаботится о том, чтобы индивидуальность чат-платформы оставалась более стабильной от обновления к обновлению, избавив пользователей от резких перепадов тональности при общении с моделью.
Новая модель существенно сокращает количество отказов. В OpenAI заявили, что предыдущая версия нередко отказывалась отвечать на вопросы, даже когда те не нарушали никаких защитных фильтров. Иногда старая модель отвечала «слишком осторожно или назидательно, особенно когда дело касалось деликатных тем».
Компания обещает, что GPT-5.3 не станет повторять эту ошибку и смягчит «излишне оборонительные или морализаторские вступления». Это означает, что модель будет отвечать напрямую и без оговорок, избавляя пользователей от ситуаций, когда диалог завершается без ответа на их запрос.
Тем не менее, GPT-5.3 Instant все еще сталкивается с некоторыми ограничениями, в особенности при работе с такими языками, как корейский и японский, где ответы по-прежнему звучат неестественно.
Карта безопасности указывает на регресс в категориях материалов сексуального характера и самоповреждений
Новая модель по-прежнему не поддерживает контент для взрослых, сообщил представитель OpenAI в письме изданию VentureBeat, пояснив, что компания все еще ищет способ «максимизировать свободу пользователей, сохраняя при этом высокую планку безопасности». Сроков внедрения этой функции у OpenAI пока нет.
OpenAI провела оценку безопасности новой модели и указала в своей карте безопасности, что, несмотря на хорошие результаты в борьбе с запрещенным контентом, она все же уступает по этому показателю GPT-5.2 Instant. Впрочем, в компании отметили, что эти показатели могут измениться после релиза.
«GPT-5.3 Instant демонстрирует регресс по сравнению с GPT-5.2 Instant и GPT-5.1 Instant в отношении недопустимого контента сексуального характера, а также по сравнению с GPT-5.2 Instant в категории материалов о самоповреждениях как при стандартных, так и при динамических оценках», — заявили в компании.
В остальных категориях, по словам представителей OpenAI, модель выступает на уровне предыдущих релизов или превосходит их, а зафиксированные случаи регресса в отношении графического насилия и насильственных противоправных действий обладают низкой статистической значимостью.
Ждать ли новую модель в ближайшее время?
Анонсировав GPT-5.3 Instant и упомянув, что обновления для Thinking и Pro появятся в скором времени, компания намекнула, что и эта новилка может вскоре уйти на покой.
В публикации в X OpenAI сообщила, что GPT-5.4 появится «раньше, чем вы думаете».
Компания не стала вдаваться в подробности о том, каких именно изменений стоит ждать в GPT-5.4 и какие режимы получат ее первыми.
Предыдущая модель, GPT-5.2 Instant, останется доступной в селекторе моделей ChatGPT до 3 июня, после чего будет отправлена в архив.



