В блоге Neon утверждают, что их метод Retrieval‑Augmented Generation делает работу с открытыми LLM в 100 раз дешевле, чем у конкурентов. В статье они сравнивают стоимость токенов и latency на нескольких популярных open‑source моделях, и цифры действительно выглядят впечатляюще.
Для меня, кто каждый день собирает AI‑агенты на полностью бесплат…