Путаница между LLM и чат-продуктами в 2025 году

Удивительно, но в 2025 году до сих пор есть путаница между LLM-моделью и продуктом чата-промощника. Ну типа на LLM Arena GPT 5.1 на таком-то месте, Deepseek на таком-то месте, значит noname телеграм-бот с Deepseek на столько-то лучше или хуже, чем ChatGPT. Такой подход в какой-то степени был похож на правду в 2023 году, сейчас он бессмысленен совершенно. Пока ещё не на уровне “в Швейцарии и Сьерра-Леоне по 9 миллионов человек живет, значит экономики примерно одинаковы”, но быстро к этому уровню приближается.

Кроме населения, т. е. модели на арене, на качество продукта влияют:

– настройки: системный промпт, температура и подобное;

– лимиты и ограничения, типа длины контекста и бюджета размышления;

– банальное интерфейсное удобство, включая скорость отклика;

– самое главное – то, как модель взаимодействует с внешним миром: память, доступ в интернет, мультиформатность, способность общаться голосом или картинками.

Именно это определяет реальный пользовательский опыт, а не формальный ELO-рейтинг в вакууме.

Подписывайтесь на Telegram GPT/ChatGPT/AI Central Александра Горного.