{
  "@context": "https://schema.org",
  "@type": "Article",
  "schema_version": "1.1",
  "content_item_id": "guide-how-ai-search-finds-sources.ru",
  "translation_group_id": "guide-how-ai-search-finds-sources",
  "locale": "ru",
  "type": "guide",
  "section": "knowledge",
  "slug": "how-ai-search-finds-sources",
  "title": "Как AI-поиск находит и выбирает источники",
  "description": "AI-ответ не является прозрачным журналом поиска. Можно наблюдать запрос бота, опубликованный ответ и показанные ссылки, но нельзя по одной цитате восстановить полный retrieval trace, веса источников или внутреннее рассуждение. Google описывает query fan-out как возможный способ разложить сложный вопрос на дополнительные запросы; это документированная возможность конкретной системы, а не универсальное правило для всех answer engines.",
  "direct_answer": "AI-ответ не является прозрачным журналом поиска. Можно наблюдать запрос бота, опубликованный ответ и показанные ссылки, но нельзя по одной цитате восстановить полный retrieval trace, веса источников или внутреннее рассуждение. Google описывает query fan-out как возможный способ разложить сложный вопрос на дополнительные запросы; это документированная возможность конкретной системы, а не универсальное правило для всех answer engines.",
  "sections": [
    {
      "heading": "1. Семь разных этапов",
      "paragraphs": [
        "URL может быть обнаружен, запрошен, обработан, включён в индекс, извлечён под конкретный вопрос, использован при синтезе и показан ссылкой. Это не одна воронка с гарантированным переходом между шагами. Если отчёт соединяет их в один балл, он теряет диагностическую ценность: нельзя понять, проблема в доступе, покрытии индекса или выборе конкретного ответа."
      ],
      "source_ids": [
        "google-ai-search"
      ]
    },
    {
      "heading": "2. Почему нужен самостоятельный фрагмент",
      "paragraphs": [
        "Фрагмент должен назвать субъект, действие, период и границу утверждения. «Платформа использует источники» слабее, чем «В документации OpenAI описан отдельный поисковый crawler; документ не утверждает, что каждый fetch появляется в ответе». Второй вариант проверяем, не смешивает официальный факт с предположением и не требует восстановить контекст из пяти экранов."
      ],
      "source_ids": [
        "openai-bots",
        "perplexity-bots"
      ]
    },
    {
      "heading": "3. Сценарий: сложный вопрос",
      "paragraphs": [
        "Вопрос «Как выбрать платформу для AI-поиска?» содержит намерения: определить критерии, сравнить функции и проверить свежесть. Система может искать документацию о каждой платформе отдельно. Поэтому редактор не должен ожидать единственного «главного» источника. Он формирует карту claims, связывает каждый критерий с первичным документом, а на странице отмечает, какие части являются сравнением редакции."
      ],
      "source_ids": [
        "google-ai-search"
      ]
    },
    {
      "heading": "4. Воспроизводимый тест",
      "paragraphs": [
        "Сохраните точную формулировку вопроса, locale, country, device, mode, timestamp, полный ответ и все ссылки, включая отсутствие ссылок. Запустите одинаковую панель минимум в две даты. Изменение интерфейса, языка или режима создаёт новый срез. Сравнивайте только совместимые срезы и показывайте абсолютные числа рядом с долями."
      ],
      "source_ids": [
        "perplexity-bots"
      ]
    },
    {
      "heading": "5. Как проверять цитату",
      "paragraphs": [
        "Откройте источник и найдите утверждение, которое якобы подтверждает ссылка. Отметьте совпадение смысла, дату, версию и контекст. Если URL только сопровождает ответ, назовите его displayed link, а не evidence. Если источник противоречит ответу, это отдельный quality finding, а не доказательство того, что платформа всегда ошибается."
      ],
      "source_ids": [
        "google-ai-search"
      ]
    },
    {
      "heading": "6. Границы вывода",
      "paragraphs": [
        "Документация оператора и наблюдение интерфейса имеют разную силу. Нельзя утверждать, что страница была использована в скрытом retrieval, если виден только визит бота. Нельзя обобщать один ответ на все языки, регионы и даты. Корректная формулировка: «в этой панели, на этой поверхности, в этот момент наблюдалось…»."
      ],
      "source_ids": [
        "google-ai-search"
      ]
    },
    {
      "heading": "7. Чеклист публикации",
      "paragraphs": [
        "Перед выпуском проверьте: один вопрос — один direct answer; каждый factual claim имеет первичный источник; источник релевантен соседнему тезису; observation/inference/hypothesis размечены; prompt panel и период записаны; отсутствуют обещания цитирования; сохранена версия ответа. Только после этого материал становится исследованием, а не пересказом ощущения от одного чата."
      ],
      "source_ids": [
        "google-ai-search"
      ]
    },
    {
      "heading": "8. Карта доказательств для одного ответа",
      "paragraphs": [
        "Возьмите один вопрос, например «как проверить техническую доступность страницы для AI-поиска», и разложите результат на четыре поля. В первом поле — исходный URL и его fetch; во втором — видимый фрагмент ответа; в третьем — ссылка и точный абзац, который она поддерживает; в четвёртом — переход или его отсутствие. Если ссылка ведёт на страницу, но не подтверждает соседний тезис, это displayed link, а не evidence. Если бот пришёл, а ссылка не появилась, запишите fetch без citation. Если ответ упомянул бренд без URL, это mention без citation. Карта не позволяет восстановить внутренний retrieval trace, но предотвращает смешение наблюдаемых событий и даёт редактору понятный список следующих проверок."
      ],
      "source_ids": [
        "google-ai-search",
        "openai-bots",
        "perplexity-bots"
      ]
    },
    {
      "heading": "9. Как выбирать изменение",
      "paragraphs": [
        "Используйте простую матрицу: проблема доступа требует технического исправления; проблема понимания — ясного заголовка, определения и самостоятельного фрагмента; проблема доказательности — первичного источника и периода данных; проблема цитирования — повторного теста поверхности, а не обещания нового тега. Для каждого кандидата оцените стоимость, обратимость и наблюдаемость. Сначала выбирайте изменение, которое можно откатить и проверить на небольшом контрольном наборе. Не объявляйте победителем вариант с одним удачным ответом: он может отражать временный индекс или изменение интерфейса."
      ],
      "source_ids": [
        "google-ai-search",
        "perplexity-bots"
      ]
    },
    {
      "heading": "10. Что сохранять в архиве",
      "paragraphs": [
        "Минимальный архив прогона — это не только итоговая ссылка. Сохраните prompt, режим и локаль, timestamp, версию страницы, полный ответ, все отображённые URL и снимок источника, если лицензия это допускает. Рядом укажите, какой фрагмент подтверждает claim, а какой является выводом редакции. При повторе не перезаписывайте старый срез: новая дата и изменившаяся поверхность должны оставаться различимыми. Такой архив позволяет проверить спорное наблюдение и честно сообщить, если исходный ответ больше недоступен."
      ],
      "source_ids": [
        "google-ai-search",
        "openai-bots",
        "perplexity-bots"
      ]
    },
    {
      "heading": "11. Операторская оговорка",
      "paragraphs": [
        "Владелец сайта управляет публикацией, доступом, фактами и измерением. Он не управляет индексом оператора, скрытыми сигналами retrieval, составом ответа или тем, появится ли переход. Поэтому сильный материал описывает интерфейс и условия теста, а не приписывает платформе универсальное поведение. Формулировки вроде «мы наблюдали» и «в этом срезе» точнее, чем «модель всегда выбирает». Это ограничение сохраняется даже при полном техническом соответствии рекомендациям."
      ],
      "source_ids": [
        "google-ai-search",
        "openai-bots"
      ]
    }
  ],
  "published_at": "2026-09-11",
  "modified_at": "2026-09-11",
  "data_through": "2026-09-11",
  "next_review_at": "2026-10-11",
  "author": "GeoAeoAle Editorial",
  "origin": "editorial",
  "publisher": "GeoAeoAle Editorial",
  "license": "https://creativecommons.org/licenses/by/4.0/",
  "canonical_url": "https://geoaeoale.com/ru/knowledge/how-ai-search-finds-sources/",
  "claims": [
    {
      "claim_id": "source-query-fanout",
      "text": "Google описывает query fan-out как возможный способ разложить сложный вопрос на дополнительные поисковые запросы.",
      "status": "observed",
      "confidence": "high",
      "source_ids": [
        "google-ai-search"
      ],
      "publication_status": "public",
      "confidentiality": "public"
    },
    {
      "claim_id": "source-citation-not-trace",
      "text": "Показанная ссылка наблюдаема, но не раскрывает полный путь выбора источника.",
      "status": "inference",
      "confidence": "high",
      "source_ids": [
        "google-ai-search",
        "perplexity-bots"
      ],
      "publication_status": "public",
      "confidentiality": "public"
    }
  ],
  "sources": [
    {
      "source_id": "google-ai-search",
      "canonical_url": "https://developers.google.com/search/docs/appearance/ai-features",
      "title": "Top ways to ensure your content performs well in Google's AI experiences",
      "publisher": "Google Search Central",
      "source_type": "official",
      "locale": "en",
      "published_at": null,
      "checked_at": "2026-09-11",
      "sha256": "c6b267ed42c26ee63151c87d27de45d8882a5b7dc77c3d3dece510b21d63c300",
      "license": "Source terms apply",
      "visibility": "public"
    },
    {
      "source_id": "openai-bots",
      "canonical_url": "https://developers.openai.com/api/docs/bots",
      "title": "Overview of OpenAI crawlers",
      "publisher": "OpenAI Developers",
      "source_type": "official",
      "locale": "en",
      "published_at": null,
      "checked_at": "2026-09-11",
      "sha256": "ccbdef3018bd08dceaacb7fe0ea07a2020d25e201ab84aa44625827aac925440",
      "license": "Source terms apply",
      "visibility": "public"
    },
    {
      "source_id": "perplexity-bots",
      "canonical_url": "https://docs.perplexity.ai/docs/resources/perplexity-crawlers",
      "title": "Perplexity crawlers",
      "publisher": "Perplexity Docs",
      "source_type": "official",
      "locale": "en",
      "published_at": null,
      "checked_at": "2026-09-11",
      "sha256": "75930d803650ae046c37ed3529840f7cbf1a6599c1bf2e41cc70bf83cc5b6470",
      "license": "Source terms apply",
      "visibility": "public"
    }
  ],
  "related_slugs": [
    "retrieval",
    "rag",
    "grounding",
    "query-fan-out",
    "source-attribution"
  ],
  "limitations": [
    "Один ответ и один fetch не раскрывают универсальную архитектуру или полный список использованных источников.",
    "Разберите одну страницу end-to-end: проверьте исходный HTML, статус 200, canonical, robots и sitemap; затем задайте один и тот же вопрос в выбранной поверхности. Сохраните полный ответ, видимые ссылки, точный подтверждающий фрагмент, локаль, время и версию страницы. Повторите тест после изменения.",
    "Упоминание без URL, ссылка без релевантного фрагмента и визит краулера — разные события. Citation засчитывайте только при совпадении проверяемого утверждения и ссылки; без сохранённого ответа наблюдение нельзя воспроизвести."
  ],
  "corrections": []
}