{
  "@context": "https://schema.org",
  "@type": "Article",
  "schema_version": "1.1",
  "content_item_id": "briefing-perplexity-crawler-roles.ru",
  "translation_group_id": "briefing-perplexity-crawler-roles",
  "locale": "ru",
  "type": "briefing",
  "section": "briefings",
  "slug": "perplexity-crawler-roles",
  "title": "Perplexity разделяет поискового робота и пользовательский fetch",
  "description": "Почему PerplexityBot и Perplexity-User нужно считать раздельно и как не превратить серверный лог в ложное доказательство цитаты.",
  "direct_answer": "Perplexity документирует PerplexityBot для поискового обхода и Perplexity-User для получения страницы по пользовательскому запросу. Совпавшие User-Agent и официальный IP помогают классифицировать fetch, но ни одна роль сама по себе не доказывает, что страница появилась ссылкой в ответе.",
  "sections": [
    {
      "heading": "Что документировано",
      "paragraphs": [
        "У двух агентов разные заявленные назначения. PerplexityBot относится к поисковому обходу, а Perplexity-User получает страницу в контексте пользовательского действия. Сведение обоих в категорию «AI crawler» уничтожает важную часть сигнала: регулярное discovery и fetch для конкретного запроса становятся неразличимыми.",
        "Разделение ролей помогает сформулировать осторожный вопрос: какой тип доступности мы наблюдаем? Bot показывает заявленный поисковый обход, User — обращение, инициированное продуктовым сценарием. Ни один из них не описывает внутренний индекс, ranking или полный путь от запроса к ответу."
      ],
      "source_ids": [
        "perplexity-bots"
      ]
    },
    {
      "heading": "Как подтвердить агента",
      "paragraphs": [
        "Не доверяйте одному User-Agent: его можно скопировать. Сопоставьте адрес с актуальным официальным IP endpoint, сохраните версию списка и время проверки. Если используется DNS-проверка, выполните reverse и forward-confirmed reverse lookup. Несовпавший запрос остаётся claimed или unknown, а не попадает в статистику подтверждённых ботов."
      ]
    },
    {
      "heading": "Что записывать",
      "paragraphs": [
        "Минимальная строка содержит timestamp, URL, status, размер ответа, полную строку User-Agent, результат IP-проверки и роль. Сырые IP не нужны в долгосрочной аналитике: после сетевой проверки их можно обрезать и HMAC-хэшировать по политике приватности. Агрегаты PerplexityBot и Perplexity-User показываются отдельно.",
        "Короткий reproducible check можно выполнить на одном URL: отправить обычный HEAD/GET, записать ответ сервера, затем сопоставить User-Agent и IP с текущим официальным списком и повторить через неделю. Смена списка или ответа должна создать новую версию проверки, а не молча переписать старую."
      ],
      "source_ids": [
        "perplexity-bots"
      ]
    },
    {
      "heading": "Что лог не доказывает",
      "paragraphs": [
        "Успешный ответ 200 подтверждает доставку ресурса этому запросу. Он не раскрывает, попал ли документ в индекс, был ли отобран retrieval, использован ли факт, показана ли ссылка и перешёл ли человек. Для цитирования нужен сохранённый ответ с видимой атрибуцией конкретного URL."
      ]
    },
    {
      "heading": "Рабочий пример",
      "paragraphs": [
        "Если сервер видит запрос с User-Agent PerplexityBot, сначала сохраните время, URL, статус и подтверждение диапазона IP. Это наблюдаемый обход. Если позже пользовательский ответ Perplexity содержит ссылку на тот же URL, это отдельное наблюдение: совпадение не доказывает, что именно этот обход породил цитату. В отчёте храните две строки, а не одну конверсию."
      ]
    },
    {
      "heading": "Чек-лист действия",
      "paragraphs": [
        "Перед классификацией запроса проверьте User-Agent, официальный список диапазонов, обратное и прямое DNS-подтверждение, URL и код ответа. Разделяйте crawler, user fetch и неизвестную автоматизацию. Не блокируйте агента только по имени; сначала зафиксируйте правило и риск. Любое утверждение о цитировании подтверждайте отдельным архивом ответа."
      ]
    },
    {
      "heading": "Что остаётся неизвестным",
      "paragraphs": [
        "Документация Perplexity объясняет назначение PerplexityBot и Perplexity-User, но не показывает, какой из полученных документов вошёл в candidate set конкретного ответа и почему одна ссылка оказалась видимой, а другая — нет. Поэтому даже подтверждённый Perplexity-User фиксируется как пользовательский fetch, пока рядом не сохранён сам ответ с точным URL."
      ]
    },
    {
      "heading": "Решение для отчёта",
      "paragraphs": [
        "В аналитике держите отдельные поля: подтверждённый обход, пользовательский fetch, реферер и наблюдаемая цитата. Сводный показатель допустим только как технический счётчик запросов, но не как показатель влияния на ответы. Каждую неделю проверяйте правила классификации на нескольких реальных логах."
      ]
    }
  ],
  "published_at": "2026-09-11",
  "modified_at": "2026-09-11",
  "data_through": "2026-09-11",
  "next_review_at": "2026-09-18",
  "author": "GeoAeoAle Editorial",
  "origin": "editorial",
  "publisher": "GeoAeoAle Editorial",
  "license": "https://creativecommons.org/licenses/by/4.0/",
  "canonical_url": "https://geoaeoale.com/ru/briefings/perplexity-crawler-roles/",
  "claims": [
    {
      "claim_id": "perplexity-two-agents",
      "text": "Perplexity публикует отдельные описания и IP endpoints для PerplexityBot и Perplexity-User.",
      "status": "observed",
      "confidence": "high",
      "source_ids": [
        "perplexity-bots"
      ],
      "publication_status": "public",
      "confidentiality": "public"
    }
  ],
  "sources": [
    {
      "source_id": "perplexity-bots",
      "canonical_url": "https://docs.perplexity.ai/docs/resources/perplexity-crawlers",
      "title": "Perplexity crawlers",
      "publisher": "Perplexity Docs",
      "source_type": "official",
      "locale": "en",
      "published_at": null,
      "checked_at": "2026-09-11",
      "sha256": "75930d803650ae046c37ed3529840f7cbf1a6599c1bf2e41cc70bf83cc5b6470",
      "license": "Source terms apply",
      "visibility": "public"
    }
  ],
  "related_slugs": [
    "crawler-access-vs-citation",
    "ai-visibility"
  ],
  "limitations": [
    "Диапазоны IP и назначения агентов могут измениться; документацию нужно проверять перед изменением firewall или отчёта."
  ],
  "corrections": []
}