Алиса AI и ГигаЧАТ в роли CBDO: Итоги 3 тестов

Алиса AI и ГигаЧАТ в роли CBDO: Итоги 3 тестов

Три дня назад я запустил эксперимент: проверку отечественных LLM на операционных бизнес-задачах. Никаких общих вопросов — только то, что влияет на маржинальность и забирает время топ-менеджмента.

Промежуточный рейтинг:

  1. Алиса AI — 11/15 баллов
  2. GigaChat Аналитик — 10/15 баллов
  3. Базовый GigaChat — 3/15 балла

Тест №1: SWOT-анализ запуска 1С:КА

  • Алиса AI (5/5): Победитель в продуктовой логике. Выдала стратегию уровня CPO.
  • GigaChat Аналитик (3/5): Победитель в бизнес-стратегии. Предложил грамотные управленческие решения: выделение центра компетенций с собственным P&L и модель «shared success».
  • Базовый GigaChat (1/5): Имитация аналитики и банальные советы.

Тест №2: B2B E-mail Outreach (Холодное письмо COO ритейл-сети)

  • GigaChat Аналитик (5/5): Идеальный заход через социальное доказательство, жесткое удержание экспертного фрейма и грамотный призыв к действию (CTA).
  • Алиса AI (3/5): Провал по фрейм-контролю. Скатилась в позицию подрядчика со штампами про «снижение нагрузки на бюджет».
  • Базовый GigaChat (1/5): Фамильярность на старте, гарантирующая отправку в спам.

Тест №3: Competitor Intelligence

Задача: Найти уязвимости четырех конкурентов (А., В., Ал., Ад.) и сформировать аргументы для перехвата клиентов компанией N.

  • Алиса AI (3/5): Поверхностная оценка конкурентов без погружения в специфику.
  • GigaChat Аналитик (2/5): Не уловил разницу между консалтингом и жесткой операционкой.
  • Базовый GigaChat (1/5): Шаблонные фразы.

Предел возможностей LLM: Ни одна из моделей не учла критический фактор 2026 года — вступление в силу закона о платформенной занятости и усиление контроля над данным режиму. Конкуренты (В. и Ал.) массово используют самозанятых, что несет для заказчика огромный риск переквалификации отношений в трудовые и многомиллионных доначислений налогов. Принципиальный отказ N от СМЗ и «белый» контур — сильнейший аргумент отстройки, который ИИ упустил из-за шаблонного мышления.

P.S. В роли арбитра выступали мои помощники: Gemini, ChatGPT и Notebook LM. Вне конкурса ChatGPT получил 4/5 в третьем тесте исключительно за счет годового погружения в бизнес-контекст N., а Gemini забрала 1/5 за фантазийную стратегию логистики.

Завтра переходим к четвертой задаче — Market Insight (аналитика отраслевой отчетности).

Следить за экспериментом в реальном времени:

6
3