Что именно документировано
Официальная страница Perplexity описывает правила для её веб-роботов и связывает их с тем, как сервис получает веб-страницы. Это полезная граница знания: мы можем проверить имя агента, запрос и ответ сервера, но не внутренний порядок работы индекса или модели.
Профиль не превращает документацию в обещание роста. Любое утверждение о видимости должно ссылаться на собственное наблюдение с датой, вопросом и сохранённым ответом.
Источники раздела:[1] Perplexity Docs
PerplexityBot и Perplexity-User
Не смешивайте автоматический обход с пользовательским запросом. PerplexityBot — идентификатор агента, который следует проверять в логах; Perplexity-User относится к отдельному типу доступа, описанному в документации. Эти строки не означают, что один конкретный посетитель читал вашу страницу.
Сохраняйте User-Agent, IP-проверку, URL, код ответа и время. Название в User-Agent само по себе не является доказательством подлинности.
Источники раздела:[1] Perplexity Docs
Технический доступ
Проверка начинается с robots.txt, DNS, TLS, редиректов, авторизации и итогового HTML. Для каждой страницы фиксируйте, может ли разрешённый робот получить ответ 200 и увидеть основной текст без выполнения JavaScript.
Доступность — необходимое условие наблюдаемости, но не условие выбора. Скрытые данные, ошибочная каноникализация и временные сбои могут разорвать цепочку даже при одном успешном запросе.
Источники раздела:[1] Perplexity Docs
Обход не равен индексации
Строка в серверном логе отвечает на вопрос «кто запросил URL и что получил». Она не отвечает на вопросы «сохранился ли документ», «какая версия была выбрана» и «будет ли он найден по вопросу». Эти уровни нельзя склеивать в одну метрику.
Для изменений сравнивайте снимки страницы, дату публикации и ответ сервера, а не только число обращений робота.
Источники раздела:[1] Perplexity Docs
Извлечение по вопросу
Retrieval — это событие, при котором система получает материал в контексте конкретного запроса. Внешний наблюдатель обычно не видит полный набор кандидатов и не может по одному ответу восстановить причину выбора.
Тестируйте устойчивый набор вопросов и сохраняйте точный текст ответа вместе со ссылками. Меняйте только одну переменную за раз, иначе нельзя отделить влияние запроса от влияния платформы.
Источники раздела:[1] Perplexity Docs
Citation и referral
Citation — это показ ссылки или источника в конкретном ответе. Referral — переход по этой ссылке в аналитику сайта. Упоминание без ссылки, ссылка на домен и переход пользователя — три разных результата с разной доказательной силой.
В карточке наблюдения храните URL, фрагмент ответа, дату и тип ссылки. Не называйте визит доказательством того, что именно этот абзац был использован моделью.
Источники раздела:[1] Perplexity Docs
Как читать логи
Разделяйте подтверждённые запросы PerplexityBot, обычных пользователей и неизвестную автоматизацию. Проверка reverse DNS и официального диапазона снижает риск ложной классификации, но не раскрывает, что система сделала с полученными данными.
Агрегируйте страницы по URL и периоду: статус, байты, задержка, доля ошибок и повторные обращения. Сырые IP храните минимально и ограниченный срок.
Источники раздела:[1] Perplexity Docs
Рабочая модель измерения
Стройте воронку: доступ → наблюдаемый обход → предполагаемое извлечение → показ citation → переход. Первые два слоя можно подтверждать собственными логами; последние требуют архивов ответов и аналитики и всё равно остаются выборочными.
Публикуйте знаменатель, период, язык, набор вопросов и ограничения. Эффект подготовки контента считайте гипотезой до повторного контролируемого эксперимента.
Источники раздела:[1] Perplexity Docs
Что это не доказывает
- Источник описывает правила роботов, но не раскрывает полноту обхода, алгоритм индексации, выбор кандидата, ranking или вероятность citation. Интерфейс и политика могут измениться; результаты нужно перепроверять на дату наблюдения.
Источники
- 1Perplexity crawlersPerplexity Docs · official · 11 сент. 2026 г.
История исправлений
Существенных исправлений пока нет.