Как отследить трафик из AI-платформ
Сервисы аналитики Similarweb и Semrush разрабатывают инструменты, которые показывают объём цитирования конкретных сми в ответах больших LLM — ChatGPT, Perplexity, AI Overviews и иже с ними.
Откуда берутся данные
Есть два основных источника, которыми пользуются сервисы аналитики:
1) Search APIs + “synthetic prompts” Провайдеры используют поисковые API, которые прогоняют миллионы синтетических промптов ежедневно — чтобы собирать ответы AI-поиска и видеть, где/когда в них появляются упоминания брендов и ссылки-цитирования.
2) Clickstream-данные из браузерных расширений Провайдеры покупают clickstream, собранный через расширение Chrome extension, установленное у пользователей.
Затем сервисы аналитики агрегируют реальные пользовательские формулировки в более крупные сущности: Кластеризуют промпты → получают “широкие промпты / темы” (topic categories), удаляют персональные данные и получают «технически синтетические данные».
Это смоделированные кластеры поверх реального поведения, а не логи конкретных запросов пользователей.
Поскольку AI-платформы не открывают данные о цитировании, точность и методологии у всех сервисов мягко говоря «неидеальна».
Чтобы следить за AI-трендами, подпишитесь на канал AI в медиа | Дайджесты. Там новости только по этой теме, только хардкор.
В этом посте были ссылки, но мы их удалили по правилам Сетки