sitemap.xml для Google — как Search Console читает карту: принял XML, увидел URL, не обязан положить в индекс. Формат файла и что в него класть — sitemap.xml в техническом кластере. Хаб качества — Google SEO. Кабинет — Search Console. Здесь отчёт «файлы Sitemap», статусы «обнаружено» и типичные ошибки Google, не общая спецификация XML.
Очередь захода — сканирование. Лимит обхода — crawl budget. Решение хранить документ — индексация Google. Запреты доступа — robots.txt.
Что отчёт Sitemap в Console показывает на самом деле
| Статус кабинета | Значит | Не значит |
|---|---|---|
| Успешно | Google скачал XML и разобрал URL | Все строки из файла в индексе |
| Не удалось получить | Робот не дошёл до файла: 404, 5xx, редирект на чужой хост, Disallow | «Сайт выпал из поиска» |
| Есть ошибка | Битый XML, неверный namespace, слишком большой кусок | Падение позиций по денежным URL |
| Обнаружено N URL | Столько адресов вытащили из карты | Столько документов хранят |
Цифра «обнаружено» в отчёте карты и цифра «страницы в индексе» — разные множества. Карта может быть короткой, индекс шире за счёт ссылок. Или наоборот: в XML тысяча фильтров, в индексе живые каноникалы. Сверять их как KPI договора нельзя.
Как Google обращается с картой на практике
- Отправка в Search Console не заменяет директиву
Sitemap:в robots и не заменяет ссылку с живой страницы. lastmod— подсказка. Ежедневная «сегодня» на всём каталоге без правки документа робот перестаёт уважать.- Индекс карт (
sitemapindex) удобен, когда каталог, статьи и медиа живут отдельно. Один гигантский файл с параметрами хуже нескольких коротких канонических. - Расширения image/video/news имеют смысл, только если эти объекты реально должны быть в соответствующих витринах Google. Не копируйте теги «на всякий случай».
- URL в карте на www при каноникале без www повторяет ошибку зеркала: Google увидит кандидата и отвергнет его как дубль.
Кабинет подтвердил, что XML читается. Индекс решается доступом, дублем и смыслом. «Sitemap без ошибок» — не покрытие сайта.
Типичный сбой на WordPress в ISPmanager: плагин отдаёт карту с одним хостом, каноникал смотрит в другой, а /sitemap.xml редиректит на HTML-оглавление. Живой тест — открыть XML инкогнито с того же хоста, что в свойстве Console, и сверить 20 денежных URL. Если PDF из кабинета называют аудитом карты — это статус файла, не спрос: смотрите постановку SEO-аудита.
Не кладите в карту для Google то, что сами закрыли в robots или пометили noindex: вы спорите двумя файлами. Не просите переиндексацию всего sitemap после смены двух title. Точечный запрос — на конкретный каноникал после реальной правки.
Ограничение. Нет замера «какой процент карт РФ Google отвергает» и не выдумываем. Лимиты размера и числа URL смотрите в текущей справке Google, не в пересказе плагина. Общий формат XML и правила «что класть» остаются на техническом URL, чтобы не каннибалить оба H1.
Частые вопросы
Почему Search Console принял sitemap, а страниц нет в индексе Google?
Кабинет подтвердил, что XML читается. Хранить URL Google не обязан: дубль, каноникал, noindex, тонкость. Смотрите проверку URL, не статус «успешно».
Нужно ли отдельно отправлять карту, если она уже указана в robots.txt?
Не обязательно. Директива Sitemap обычно достаточна. Отправка в Console удобна, чтобы видеть ошибки разбора. Два раза «нажать для надёжности» индекс не ускоряет.
Помогает ли sitemap.xml поднять позиции в Google?
Нет. Карта помогает обнаружить канонические 200. Позиции решает документ и спрос, не наличие XML.
Можно ли в одну карту для Google свалить фильтры и UTM?
Не нужно. Мусор в XML тратит обход и путает отчёт «обнаружено». Оставляйте канонические посадки, категории и карточки со спросом.