Путаница между LLM и чат-продуктами в 2025 году
Удивительно, но в 2025 году до сих пор есть путаница между LLM-моделью и продуктом чата-промощника. Ну типа на LLM Arena GPT 5.1 на таком-то месте, Deepseek на таком-то месте, значит noname телеграм-бот с Deepseek на столько-то лучше или хуже, чем ChatGPT. Такой подход в какой-то степени был похож на правду в 2023 году, сейчас он бессмысленен совершенно. Пока ещё не на уровне “в Швейцарии и Сьерра-Леоне по 9 миллионов человек живет, значит экономики примерно одинаковы”, но быстро к этому уровню приближается.
Кроме населения, т. е. модели на арене, на качество продукта влияют:
– настройки: системный промпт, температура и подобное;
– лимиты и ограничения, типа длины контекста и бюджета размышления;
– банальное интерфейсное удобство, включая скорость отклика;
– самое главное – то, как модель взаимодействует с внешним миром: память, доступ в интернет, мультиформатность, способность общаться голосом или картинками.
Именно это определяет реальный пользовательский опыт, а не формальный ELO-рейтинг в вакууме.
Подписывайтесь на Telegram GPT/ChatGPT/AI Central Александра Горного.