Исходный HTML
Заголовок, direct answer, дата, навигация и основной текст должны присутствовать в HTML ответа сервера. JavaScript может добавить Pagefind или фильтры, но страница не должна исчезать при отключённых скриптах. Проверка: curl финального URL, просмотр исходника и ручное открытие с выключенным JavaScript.
Источники раздела:[1] Google Search Central
Статусы и редиректы
Действующий URL отвечает 200. Постоянный перенос отвечает 301 и ведёт на реальный эквивалент; удалённый документ не превращается в пустой 200. Цепочка проверяется с -I и конечным GET, потому что заголовок редиректа сам по себе не показывает, что конечный HTML пригоден.
Источники раздела:[1] Google Search Central
Robots не является замком
robots.txt — публичная подсказка добросовестному боту. Любой клиент может её проигнорировать, а URL и данные могут быть найдены из других источников. Ops-панель, логи и черновики защищаются Basic Auth, VPN или application auth. В реестре отдельно указывайте политику для поискового краулера, training crawler и user-triggered fetch.
Источники раздела:[1] Google Search Central
Sitemap и внутренняя сеть
Sitemap помогает обнаружению, но не заменяет links между материалами. Включайте только canonical публичных страниц; исключайте search, JSON sidecars, карантин и ops. Проверяйте, что каждый sitemap URL существует, имеет один canonical и не ведёт на soft 404.
Источники раздела:[1] Google Search Central
Языковые версии
RU и EN имеют отдельные URL и self-canonical. В head каждой версии ставятся взаимные hreflang и x-default на явный выбор языка. Перевод не должен менять числа, период, силу вывода или список источников. Проверяйте parity автоматически по claim IDs и dataThrough.
Источники раздела:[1] Google Search Central
Сценарий релизной проверки
После сборки запустите curl для apex и www, проверьте HTTPS и цепочку redirect, затем robots, все sitemap, RSS, JSON-LD и sidecars. Откройте representative guide с отключённым JS и на ширине 320 px. Результат сохраняйте в артефактах релиза, чтобы откат был проверяемым, а не ручным воспоминанием.
Источники раздела:[1] Google Search Central
Идентификация ботов
User-Agent — заявление клиента. Подтверждённым ботом в аналитике он становится только при совпадении с официальными IP или DNS-проверкой оператора, когда такие данные опубликованы. OAI-SearchBot, GPTBot и ChatGPT-User нельзя автоматически считать одной категорией. Посещение подтверждает запрос, не citation.
Источники раздела:[1] Google Search Central
Что считать успехом
Успешный технический релиз означает доступный HTML, корректные статусы, работающие canonical/hreflang/sitemap и отсутствие утечек ops. Он не означает, что поисковик обязан обходить URL или answer engine обязан показать его. Actual visibility измеряется отдельной панелью сохранённых ответов.
Источники раздела:[1] Google Search Central
Таблица проверки перед публикацией
Проверка должна быть последовательной. Сначала подтвердите, что URL отвечает 200 и отдаёт основной текст в HTML. Затем сверяйте canonical с фактическим адресом, включайте только публичный canonical в sitemap и проверяйте внутреннюю ссылку из уже доступной страницы. Для двуязычного материала сравните claim IDs, числа, период dataThrough и силу вывода. В конце откройте страницу без JavaScript и отдельно проверьте, что служебные маршруты закрыты авторизацией. В журнале фиксируйте результат как pass, fail или not applicable, а не просто ставьте зелёную галочку. Такой журнал нужен для отката и для объяснения, почему URL был или не был выпущен.
Источники раздела:[1] Google Search Central[5] Google Search Central
Типовые сбои и восстановление
Если после релиза появился soft 404, не исправляйте его добавлением пустого текста: верните эквивалентный документ или корректный 410. Если sitemap содержит старый адрес, обновите индекс и проверьте конечные URL, а не только файл. Если RU и EN разошлись по числу или источнику, карантиньте обе версии до исправления, даже если одна уже технически доступна. Если бот запросил закрытый путь, это сигнал проверить авторизацию и логи, а не повод раскрывать маршрут через robots. Каждый сбой должен оставлять причину, affected URL, версию исправления и повторную проверку.
Источники раздела:[1] Google Search Central
Граница технической готовности
Доступный HTML, разрешённый crawl и корректный sitemap делают документ пригодным для обнаружения, но не превращают его в обязательный источник. Индексация, retrieval, цитирование и переход — разные события. Поэтому отчёт о готовности должен заканчиваться не обещанием, а следующим наблюдением: какие URL проверим, каким вопросом, в какой локали и когда. Если оператор меняет интерфейс или правила обхода, baseline устаревает и его нужно пометить как исторический срез.
Источники раздела:[1] Google Search Central[6] OpenAI Developers
Порядок диагностики
Диагностируйте от дешёвого к дорогому. Сначала запросите финальный URL и проверьте HTML, статус и canonical. Затем просмотрите robots и sitemap, после чего проверьте внутренние ссылки и языковые альтернативы. Только когда технический слой исправен, задавайте вопросы в AI-поверхности и оценивайте видимые источники. Если сразу начать с наблюдения ответа, техническую ошибку легко принять за редакционную. Каждый найденный дефект связывайте с URL, ожидаемым поведением, фактическим ответом и версией исправления.
Источники раздела:[1] Google Search Central[5] Google Search Central
Что это не доказывает
- HTTP 200 и разрешённый robots показывают доступ, но не гарантируют индексирование, retrieval или citation.
- Перед релизом проверяйте страницу как обычный клиент: curl с обычным User-Agent и браузер без JavaScript. Заголовок, основной текст, дата, ссылки и таблицы должны быть в HTML. Дополнительно проверьте trailing slash, www и ошибочный URL, чтобы redirect и 404 были предсказуемыми.
- Публичная доступность не должна раскрывать закрытые материалы. Секреты, логи, очереди и черновики защищаются авторизацией; robots.txt для этого недостаточно. После деплоя сравнивайте публичные URL с sitemap и sidecar-реестром и проверяйте отсутствие внутренних путей в HTML.
Источники
- 1Google Search technical requirementsGoogle Search Central · official · 11 сент. 2026 г.
- 2Introduction to robots.txtGoogle Search Central · official · 11 сент. 2026 г.
- 3Build and submit a sitemapGoogle Search Central · official · 11 сент. 2026 г.
- 4Managing multi-regional and multilingual sitesGoogle Search Central · official · 11 сент. 2026 г.
- 5Top ways to ensure your content performs well in Google's AI experiencesGoogle Search Central · official · 11 сент. 2026 г.
- 6Overview of OpenAI crawlersOpenAI Developers · official · 11 сент. 2026 г.
- 7Perplexity crawlersPerplexity Docs · official · 11 сент. 2026 г.
История исправлений
Существенных исправлений пока нет.