ruslanabuzyaroff

с 22.07.2026
2 подписчика
3 подписки
«Не вижу прайс», "Нет исходных данных" - и все это в одном чате. Или зачем я сделал двойную память для своего ИИ-ассистента.

Стандартная схема обещает простую победу: подключаем локальную #llm , вешаем векторную базу (ChromaDB/Pinecone), добавляем #rag — и получаем «умного» #ai ассистента. На практике оказывается, что один только долгосрочный контекст не спасает внутри длинного диалога.

C чего все начиналось.

Начну с того, что я вообще не #ml инженер. Но в апреле я решил собрать ИИ-ассистента, который учится на своих ошибках, чисто факультативно)