Сайт Lmarena представил обновленный рейтинг языковых моделей отдельно показав разные версии GPT-5.
https://t.me/black_triangle_tg
Данный рейтинг интересен тем, что составляется при помощи пользователей, которые задают вопрос и получают два анонимных ответа от разных моделей, выбирая из них лучший.
GPT-5-Chat, предназначенная для использования в качестве чат-бота, не смогла превзойти GPT-4o.
GPT-4o превосходит GPT-5-Chat в многоэтапных диалогах, текстах, программировании и обработке длинных запросов.
Кроме того, GPT-5-Chat продемонстрировала особенно слабые результаты в ответах на русском языке.
P.S.: Claude Opus 4.1 занимает первое место в номинации coding
================
👁 News | 👁 Soft | 👁 Gear |