Михаил Щёголев

с 21.09.2026
2 подписчика
0 подписок

Как работают привычные модели

ChatGPT, Claude и другие языковые модели пишут ответ по одному кусочку слова за раз. Каждый следующий кусочек зависит от предыдущего. Поэтому длинный ответ генерируется несколько секунд, а платите вы за каждый выданный токен.

11

Как это началось

Я попросил разработчика сравнить Qdrant, Milvus и pgvector для RAG-системы заказчика. Через 40 минут пришёл документ на 14 страниц. В нём были таблицы, плюсы и минусы, сравнение лицензий и бенчмарки из чужих статей.