Инструментов GEO-мониторинга становится всё больше — от западных платформ до российских сервисов и самописных скриптов. Внешне все обещают одно и то же: «узнайте, что нейросети говорят о вашем бренде». Разница — в методике, и именно она определяет, получите вы измерение или красивые случайные цифры. Ошибка на этом этапе стоит дорого вдвойне: вы не просто платите за инструмент — вы месяцами принимаете решения на основе цифр, которым нельзя верить. Ниже — восемь критериев, по которым стоит оценивать любой инструмент. Сразу честная оговорка: мы сами делаем такой сервис — «Брендометр», — поэтому не будем никого называть плохим. Вместо этого дадим вопросы, которые стоит задать любому сервису, включая наш.

1. Покрытие движков — обязательно включая российские

Список нейросетей — первый фильтр. Для бизнеса с аудиторией в России критичны Алиса и Поиск с Алисой (49,5 млн человек в месяц, быстрые ответы в 42% запросов Яндекса) и GigaChat — западные платформы их, как правило, не покрывают. Обратное тоже верно: если часть клиентов сидит в ChatGPT, Gemini и Perplexity, мониторинг только российских движков покажет половину картины. У движков разные модели, источники и аудитории, и о бренде они рассказывают по-разному. Вопрос сервису: «какие движки вы проверяете и как быстро добавляете новые?»

2. Серии прогонов, а не единичные проверки

Ответы нейросетей стохастичны: модель генерирует текст заново при каждом обращении, и два ответа на один вопрос могут не совпадать вовсе. Сервис, который проверяет запрос один раз и рисует «вы упомянуты», показывает случайное значение — с тем же успехом можно спросить модель самому, как в нашей инструкции по ручной проверке. Честный мониторинг задаёт каждый вопрос серией из 5–10 независимых прогонов в чистых сессиях. Вопрос: «сколько прогонов приходится на один запрос и можно ли это настроить?»

3. Доверительные интервалы и честная статистика

Даже серия из десяти прогонов даёт заметный разброс. Если график показывает рост доли упоминаний с 40% до 45% без интервалов, отличить динамику от шума невозможно — а решения на основе шума хуже, чем отсутствие решений. Сервис должен показывать доверительные интервалы для каждой метрики и не рисовать «рост», который статистически не отличим от прошлого замера.

4. Доступ к сырым ответам

Агрегированные проценты должны быть проверяемы: возможность открыть каждый ответ, увидеть полный текст, дату и версию модели. Без этого приходится верить сервису на слово, а ошибки автоматической разметки — например, бренд «упомянут» во фразе «не рекомендую X» — остаются невидимыми.

5. Тональность и контекст, а не только факт упоминания

«X — устаревшее решение, возьмите лучше Y» и «рекомендую X» — формально оба ответа содержат упоминание бренда. Метрика «упомянут в 70% ответов» без тональности может маскировать поток антирекламы. Проверьте, что сервис размечает тональность и показывает, в каком контексте бренд назван: рекомендация, нейтральное перечисление или критика.

6. Конкуренты и источники

Хороший мониторинг показывает не только вас: кого модели называют рядом и вместо вас, ваш Share of Voice в категории — как читать эту метрику, мы разобрали в статье «Share of Voice в нейросетях» — и какие сайты цитируются в ответах. Источники — самое действенное: 84% цитат приходится на сторонние площадки, и именно список цитируемых сайтов превращает мониторинг из «интересных цифр» в план действий.

7. Отчёты и уведомления

Данные должны доходить до решений. Проверьте: есть ли PDF-отчёт, который можно отдать руководству или клиенту без доступа к сервису; приходят ли уведомления об изменениях (Telegram, почта); видна ли динамика между замерами, а не только текущий срез. Отдельный плюс — история: возможность вернуться к любой прошлой дате и посмотреть, что модели отвечали тогда.

8. Прозрачная методология и понятная цена

У сервиса должна быть открыто описанная методология: как формируются сессии, сколько прогонов в серии, как считаются интервалы, фиксируются ли версии моделей. И понятная модель оплаты: сколько стоит проверка одного запроса в одном движке и во что обойдётся рост пула запросов. Отдельный красный флаг — обещания «гарантированно поднять бренд в ответах ChatGPT»: прямо влиять на ответы моделей невозможно, и тот, кто обещает это, вводит вас в заблуждение уже на этапе продажи.

Универсальный тест: попросите показать сырые ответы за любой день и объяснить, как из них получилась цифра на графике. Сервис, который измеряет честно, отвечает на этот вопрос за минуту.

Шпаргалка: восемь вопросов сервису

  1. Какие движки вы проверяете и есть ли среди них Алиса, Поиск с Алисой и GigaChat?
  2. Сколько прогонов приходится на один запрос и как изолируются сессии?
  3. Показываете ли доверительные интервалы для каждой метрики?
  4. Могу ли я открыть полный текст любого ответа с датой и версией модели?
  5. Как размечается тональность и что считается рекомендацией?
  6. Показываете ли конкурентов, Share of Voice и цитируемые источники?
  7. Есть ли PDF-отчёты, уведомления об изменениях и история замеров?
  8. Где описана методология и сколько стоит проверка одного запроса в одном движке?

Как проверить сервис до оплаты

  • запустите бесплатный тест на своих реальных запросах, а не на демо-примерах;
  • сравните результаты с ручной проверкой — например, по чек-листу аудита из 12 пунктов;
  • задайте вопросы из шпаргалки выше и оцените, насколько прямо отвечает поддержка;
  • посчитайте экономику на год вперёд: сколько будет стоить ваш реальный пул запросов при нужной частоте замеров;
  • убедитесь, что в интерфейсе видны сырые ответы, интервалы и источники, а не только итоговый «балл видимости».

«Брендометр» мы строили от этих же критериев: одиннадцать движков, включая Алису, Поиск с Алисой и GigaChat; серии независимых прогонов в чистых сессиях; доверительные интервалы; полные тексты ответов с фиксацией версий моделей; тональность, конкуренты и цитируемые источники; PDF-отчёты и уведомления в Telegram. Методология описана открыто, а проверить её можно бесплатно: при регистрации даётся 400 кредитов — хватит на полный первый замер. Сравните нас с любым другим инструментом по этим восьми пунктам.