Алиса AI и ГигаЧАТ в роли CBDO: Итоги 3 тестов
Три дня назад я запустил эксперимент: проверку отечественных LLM на операционных бизнес-задачах. Никаких общих вопросов — только то, что влияет на маржинальность и забирает время топ-менеджмента.
Промежуточный рейтинг:
- Алиса AI — 11/15 баллов
- GigaChat Аналитик — 10/15 баллов
- Базовый GigaChat — 3/15 балла
Тест №1: SWOT-анализ запуска 1С:КА
- Алиса AI (5/5): Победитель в продуктовой логике. Выдала стратегию уровня CPO.
- GigaChat Аналитик (3/5): Победитель в бизнес-стратегии. Предложил грамотные управленческие решения: выделение центра компетенций с собственным P&L и модель «shared success».
- Базовый GigaChat (1/5): Имитация аналитики и банальные советы.
Тест №2: B2B E-mail Outreach (Холодное письмо COO ритейл-сети)
- GigaChat Аналитик (5/5): Идеальный заход через социальное доказательство, жесткое удержание экспертного фрейма и грамотный призыв к действию (CTA).
- Алиса AI (3/5): Провал по фрейм-контролю. Скатилась в позицию подрядчика со штампами про «снижение нагрузки на бюджет».
- Базовый GigaChat (1/5): Фамильярность на старте, гарантирующая отправку в спам.
Тест №3: Competitor Intelligence
Задача: Найти уязвимости четырех конкурентов (А., В., Ал., Ад.) и сформировать аргументы для перехвата клиентов компанией N.
- Алиса AI (3/5): Поверхностная оценка конкурентов без погружения в специфику.
- GigaChat Аналитик (2/5): Не уловил разницу между консалтингом и жесткой операционкой.
- Базовый GigaChat (1/5): Шаблонные фразы.
Предел возможностей LLM: Ни одна из моделей не учла критический фактор 2026 года — вступление в силу закона о платформенной занятости и усиление контроля над данным режиму. Конкуренты (В. и Ал.) массово используют самозанятых, что несет для заказчика огромный риск переквалификации отношений в трудовые и многомиллионных доначислений налогов. Принципиальный отказ N от СМЗ и «белый» контур — сильнейший аргумент отстройки, который ИИ упустил из-за шаблонного мышления.
P.S. В роли арбитра выступали мои помощники: Gemini, ChatGPT и Notebook LM. Вне конкурса ChatGPT получил 4/5 в третьем тесте исключительно за счет годового погружения в бизнес-контекст N., а Gemini забрала 1/5 за фантазийную стратегию логистики.
Завтра переходим к четвертой задаче — Market Insight (аналитика отраслевой отчетности).
Следить за экспериментом в реальном времени: