Microsoft Learn описывает генеративные ответы поверх публичных сайтов в Copilot Studio. Это хороший источник о настройке публичного веб-контекста и его ограничениях, но не доказательство того, что любой материал будет показан или процитирован в consumer Bing или Copilot. Доступ, извлечение, citation и переход нужно измерять отдельно.
Brave Search — самостоятельный поисковый сервис с собственным индексом. Его AI Answers дают краткое резюме поверх результатов и показывают ссылки на источники, тогда как Ask Brave предназначен для более длинного диалога и follow-up-вопросов. Документация подтверждает наличие ссылок и режимов, но не раскрывает формулу выбора конкретного URL.
ChatGPT Search — подключённый к вебу режим ответов в ChatGPT. OpenAI различает OAI-SearchBot для поиска, GPTBot для обучения и ChatGPT-User для пользовательского получения страницы. Разрешение роботу делает доступ возможным, но не гарантирует извлечение, показ, позицию или цитату.
Официальная документация Anthropic подтверждает веб-поиск Claude и показ источников в ответах. Она не раскрывает универсальный ranking, полный retrieval pipeline или правило, по которому любая доступная страница будет выбрана и процитирована. Поэтому Claude нужно проверять по сохранённым ответам и ссылкам, а доступ сайта измерять отдельно.
DuckDuckGo Search Assist — опциональная функция в поисковой выдаче: она сканирует веб, генерирует краткий ответ и всегда связывает его с одним или двумя источниками. Duck.ai — отдельный анонимизированный чат с моделями разных поставщиков. Search Assist и Duck.ai нельзя измерять как одну систему.
Gemini может показать пользователю панель Sources со ссылками, но эта панель доказывает только отображённые источники в конкретном ответе. Она не раскрывает внутренний crawler, ranking или полноту retrieval. Поэтому доступ страницы, показ ссылки, цитирование тезиса и переход нужно считать разными событиями.
Google AI Search — генеративные функции внутри Google Search. Сайт должен быть доступен для обычного обхода и индексации, но Google не обещает отдельного способа попасть в AI-ответ. Search Console и серверные логи показывают части процесса, а не полный журнал цитирования.
Справка X описывает Grok как продукт, который может сам решить выполнить поиск по публичным постам X и провести поиск в интернете в реальном времени. Это подтверждает существование web/X search-поверхности, но не раскрывает индекс, веса, список кандидатов или причины конкретной citation.
Kagi объединяет собственные индексы Teclis и TinyGem, внешние поисковые и вертикальные источники, пользовательские настройки и AI-поверхности. Assistant может получить web-доступ через Kagi Search, но переключатель web, линза и ссылка в ответе — наблюдаемые условия конкретного запроса, а не обещание цитирования.
У Perplexity есть документированный обходчик PerplexityBot, но запрос этого робота доказывает только доставку страницы. Он не доказывает, что документ попал в индекс, был извлечён для конкретного вопроса, показан в ответе или привёл посетителя. Поэтому техническую доступность, retrieval, citation и referral нужно измерять как разные события.
Yandex описывает Neuro/Yandex AI как режим, который разбивает сложный вопрос, находит релевантные материалы в интернете, синтезирует ответ и добавляет ссылки на источники. Официальные документы подтверждают source-linked web discovery, но не раскрывают внутреннее ранжирование и не обещают citation конкретной странице.
Документация Яндекса помогает проверить доступ робота, статусы и состояние индекса, но не раскрывает внутренний отбор источников для ответов Алисы. Crawl — это readiness-сигнал, а не доказательство AI-цитирования.
You.com публикует несколько разных поверхностей: потребительские агенты, Research/ARI и API web/news search. Их общая черта — web-данные и цитаты, но заявленные возможности нельзя смешивать: API annotations, выделенная цитата в Research и пользовательский ответ являются разными артефактами проверки.