Рабочее значение

Retrieval начинается с пользовательского или системного запроса и заканчивается набором кандидатов или фрагментов контекста. Корпус может быть веб-индексом, закрытой базой или набором загруженных файлов. Наблюдать этот этап напрямую можно только через трассировку, раскрытую документацию или контролируемую систему.

Источники раздела:[1] Google Search Central[2] OpenAI Developers

Как отличать

Crawler получает страницы, индекс хранит или организует доступное представление, ranking упорядочивает кандидатов, а retrieval выбирает их для конкретной задачи. Citation и attribution относятся к видимому ответу. Одно событие не служит доказательством остальных.

Источники раздела:[1] Google Search Central[2] OpenAI Developers

Пример

OAI-SearchBot может запросить страницу, но серверный лог не показывает, вошла ли она в набор кандидатов для последующего ответа ChatGPT Search. И наоборот, ссылка в ответе указывает на наблюдаемый результат, но не раскрывает все документы, рассмотренные системой.

Проверка

Во внешнем аудите сохраняйте одинаковые вопросы, режим, язык, регион, ответы и конечные ссылки; это измеряет результаты, совместимые с retrieval, но не сам скрытый этап. В собственной системе дополнительно журналируйте запрос, версию корпуса, идентификаторы кандидатов и оценки.

Предел интерпретации

Отсутствие ссылки не доказывает отсутствие retrieval: использованный контекст могли не показать. Присутствие ссылки также не раскрывает причин выбора. Поэтому внешние исследования должны говорить о наблюдаемых ответах и ссылках, а не о внутреннем retrieval без доступа к логам.

Что это не доказывает

  • Для закрытых поисковых систем retrieval обычно является латентным этапом. Публичные измерения могут проверять доступность, выдачу и цитаты, но причинное утверждение о внутреннем выборе требует данных самой платформы.

Источники

  1. 2
    Overview of OpenAI crawlersOpenAI Developers · official · 11 сент. 2026 г.

История исправлений

Существенных исправлений пока нет.