Генератор sitemap.xml

Два режима. Вставьте адрес сайта — инструмент загрузит страницу, соберёт с неё внутренние ссылки и сразу построит карту. Или вставьте свой список URL, если он уже готов. К каждому адресу можно добавить дату изменения (lastmod), частоту обновления (changefreq) и приоритет (priority) — поисковики используют их как подсказки при обходе. Готовый файл загружается в Яндекс.Вебмастер и Google Search Console.

Список URL

0 строк

sitemap.xml

0 URL
Скопировано ✓ URL в карте:0

Два режима сборки и откуда берутся даты

У генератора два режима. В первом вы даёте адрес страницы, сервер загружает её, вынимает все ссылки на тот же домен, отбрасывает якоря, почту и телефоны и складывает адреса в файл. Во втором вы вставляете готовый список адресов, и он превращается в XML без обхода. Первый режим удобен для сайта на пару сотен страниц, второй — когда список уже есть в выгрузке из базы или краулера.

Обход берёт ссылки только с той страницы, которую вы указали: если каталог лежит на три уровня глубже главной, в карту попадут лишь адреса первого уровня. Для глубоких сайтов правильнее прогнать краулер и вставить список во второй режим. Ссылки, которые дорисовывает JavaScript после загрузки, сервер тоже не увидит: он читает HTML как есть, без выполнения скриптов.

Дата lastmod подставляется из заголовка Last-Modified, если сервер его отдаёт, иначе остаётся сегодняшняя. Поля changefreq и priority проставляются одинаковыми для всех адресов и нужны лишь для совместимости: поисковики их пропускают, зато lastmod используют, если дата похожа на правду.

XML-код на экране
Карта сайта — обычный XML: обёртка urlset и по одному url на каждый адрес. Фото: Diego Mariano, CC BY-SA 4.0.
РежимЧто на входеКогда подходит
По адресуодна страница, ссылки с неёмаленький сайт с меню на все разделы
Из спискаадреса по одному в строкевыгрузка из CMS, базы или краулера
Индексный файлнесколько картбольше 50 000 адресов

Как карта сайта стала общим протоколом

До 2005 года поисковый робот узнавал о страницах единственным способом — переходя по ссылкам. Всё, до чего ссылки не дотягивались, для поиска не существовало, и это называли «глубокой сетью». В июне 2005 года Google предложил вебмастерам самим отдавать список адресов в файле по простой схеме, и назвал его Sitemaps. Через полтора года, в ноябре 2006-го, к схеме присоединились Yahoo и Microsoft, появился сайт sitemaps.org и версия протокола 0.90, которая действует до сих пор.

Весной 2007 года договорились о строке Sitemap: в robots.txt, чтобы роботы находили карту без регистрации в панелях. Позже добавили расширения для картинок, видео и новостей и индексный файл для больших сайтов. Лимит на размер файла подняли с 10 до 50 мегабайт в 2016 году. Яндекс принимает тот же формат и показывает в Вебмастере, сколько адресов из карты попало в индекс.

Спор о полях changefreq и priority закончился признанием: Google в своей документации прямо пишет, что игнорирует оба, а lastmod учитывает, только если дата совпадает с реальными правками. Протокол пережил двадцать лет почти без изменений, потому что решал одну задачу и не пытался решить остальные.

Вывеска у офиса Google
Протокол придумали в Google в 2005 году, а через год его приняли конкуренты. Фото: Викисклад, общественное достояние.
Старая дорожная карта
Карта не ведёт робота за руку: она лишь показывает, какие дороги существуют. Фото: Викисклад, общественное достояние.

Что положить в карту, а что убрать

Перед сборкой решите, что карта должна содержать: только страницы с кодом 200, без редиректов, без закрытых от индексации и без дублей с параметрами. Страница в карте с кодом 404 или с canonical на другой адрес не ломает файл, но портит отчёт в Вебмастере и Search Console, и по нему потом трудно понять, что на самом деле не индексируется. Прогнать список по кодам ответа помогает проверка ответа сервера, а разобрать чужую или старую карту — анализ sitemap.

Большой сайт делите на карты по разделам: каталог, статьи, категории. Тогда в панелях видно, какой раздел проседает по индексации, вместо одной общей цифры. Файлы связывает индексная карта, а в robots.txt достаточно одной строки на неё. После переезда адресов старую карту убирайте сразу, иначе роботы неделями будут ходить по редиректам.

Дата lastmod работает только при аккуратном обращении: обновляйте её при реальной правке содержимого. Пересборка файла сама по себе поводом для новой даты быть не должна. Если все страницы датированы сегодняшним днём, поисковик перестаёт верить полю целиком.

Адресов в файледо 50 000
Размер файладо 50 МБ
Обязательное полеloc
Полезное полеlastmod
Игнорируютсяchangefreq, priority
Протокол2005, Google
sitemaps.org2006
Строка в robots.txt2007

Как создать карту сайта: три способа

Выбор зависит от того, на чём сделан сайт и как часто меняются страницы.

Движок собирает сам. WordPress с версии 5.5 отдаёт карту по адресу /wp-sitemap.xml без всяких плагинов, а Yoast SEO и Rank Math подменяют её своей. У конструкторов вроде Tilda карта генерируется автоматически и обновляется вместе с сайтом. В 1С-Битрикс генерация живёт в модуле поисковой оптимизации и запускается по расписанию. Главный плюс способа — файл не устаревает.

Онлайн-генератор. Выручает, когда сайт статический, движок карту не умеет или нужно быстро собрать файл под конкретный список страниц. Инструмент выше работает двумя путями: собирает ссылки прямо со страницы по её адресу или превращает готовый список адресов в XML. Сделать sitemap онлайн получится за минуту: вставили список, забрали готовый файл, положили в корень сайта.

Краулер или скрипт. На больших каталогах карту собирают обходом сайта: Screaming Frog выгружает XML после сканирования, а на своём сервере файл чаще генерирует скрипт при сборке или по расписанию. Так в карту попадают только живые страницы с кодом 200.

Дерево сайта из карты

Список адресов в карте — это структура сайта в плоском виде. Чтобы увидеть дерево, отсортируйте адреса по алфавиту и посчитайте слэши в каждом: первый сегмент пути даёт разделы, второй — подразделы, дальше идут конечные страницы.

Сразу становятся видны три вещи. Разделы-одиночки, внутри которых одна страница. Слишком глубокая вложенность: до четвёртого уровня и дальше робот доходит заметно реже. Разросшиеся ветки тегов и фильтров, которым в карте вообще делать нечего. Разбор занимает пять минут в таблице и обычно даёт больше, чем красивая визуализация.

Как пользоваться

  1. Вставьте адрес сайта и нажмите «Собрать ссылки с сайта» — инструмент загрузит страницу и вытащит внутренние адреса. Готовый список можно вставить в поле вручную.
  2. Скопируйте адреса страниц в левое поле — по одному на строку. Каждый должен начинаться с http:// или https://, иначе строка будет пропущена.
  3. При желании укажите дату изменения, частоту обновления и приоритет — они применятся ко всем URL. Можно оставить значения пустыми, тогда теги не добавятся.
  4. Справа появится готовый XML. Скопируйте его, сохраните в файл sitemap.xml, положите в корень сайта и укажите в robots.txt и панелях вебмастера.

Частые вопросы

Как сделать sitemap бесплатно без программ?

Вставьте адрес сайта и нажмите «Собрать ссылки с сайта»: генератор загрузит страницу, соберёт внутренние ссылки и сразу построит XML. Второй путь — вставить свой список адресов из выгрузки или таблицы. Оба бесплатны и без ограничений по числу страниц в пределах стандарта, файл сохраняется кнопкой.

Как посмотреть дерево сайта по карте?

Скопируйте список адресов из карты в инструмент «Дерево сайта» на этом сайте: он разложит адреса по разделам и уровням вложенности и покажет, где сайт глубже трёх кликов. Ссылка стоит в блоке похожих инструментов ниже.

Как создать карту сайта, если списка URL нет?

Вставьте адрес любой страницы сайта и нажмите «Собрать ссылки с сайта». Инструмент загрузит её на сервере и соберёт все внутренние ссылки — обычно это меню, разделы и материалы с этой страницы. Учтите ограничение: собирается один уровень, то есть ссылки именно с указанной страницы. Для полной карты крупного сайта нужен краулер вроде Screaming Frog.

Обязательны ли lastmod, changefreq и priority?

Нет. Обязателен только сам адрес страницы (loc). Остальные теги — необязательные подсказки. Яндекс и Google учитывают lastmod, а changefreq и priority чаще игнорируют, поэтому их можно не добавлять.

Сколько URL можно добавить в один sitemap?

По стандарту — до 50 000 ссылок и до 50 МБ в одном файле. Если страниц больше, их разбивают на несколько sitemap и объединяют индексным файлом sitemap index. Для большинства сайтов одного файла достаточно.

Что писать в robots.txt?

Добавьте строку «Sitemap: https://вашсайт/sitemap.xml» — поисковики найдут карту автоматически. Дополнительно карту можно отправить вручную в Яндекс.Вебмастере и Google Search Console.

Данные куда-то отправляются?

Нет. Всё работает прямо в браузере на JavaScript — введённые данные не уходят на сервер и нигде не сохраняются.

Как создать карту сайта бесплатно?

Тремя способами. Движком: WordPress отдаёт /wp-sitemap.xml сам, у конструкторов карта собирается автоматически. Онлайн-генератором вроде этого: вставили адрес сайта или список страниц — забрали готовый XML. Краулером с выгрузкой в XML. Первые два бесплатны без оговорок, у краулеров бесплатные версии ограничены числом страниц.

Чем sitemap.xml отличается от карты сайта на странице?

sitemap.xml — служебный файл для поисковых роботов, человек его обычно не открывает. HTML-карта сайта — обычная страница со ссылками на разделы, её делают для посетителей и заодно для перелинковки. Задачи разные, одна другую не заменяет: робот читает XML, человек — HTML.

Как посмотреть дерево сайта?

Проще всего из карты сайта. Выгрузите список адресов, отсортируйте по алфавиту и посчитайте слэши: первый сегмент пути — разделы, второй — подразделы. Сразу видны разделы с одной страницей внутри и ветки глубже третьего уровня, до которых робот доходит реже.

Похожие инструменты

Ответ сервера (HTTP-коды)

Список URL → коды ответа 200/301/404, цепочки редиректов, финальный адрес и время ответа. Для аудита и чистки битых ссылок. До 30 адресов за раз.

Открыть
Анализ XML Sitemap

Ссылка на sitemap.xml → число URL, lastmod, дубли, не-https, ошибки XML и коды ответа выборки URL. Дополнение к генератору sitemap.

Открыть
Генератор robots.txt

Собирает robots.txt: Disallow/Allow, Sitemap, Host, Crawl-delay. Пресеты «открыть/закрыть сайт» и «закрыть служебное CMS».

Открыть
Генератор Open Graph

Готовые og-теги и Twitter Card для страницы. С предпросмотром карточки, проверкой длин и подсказками по размеру картинки.

Открыть
Определение CMS

Узнай движок сайта по URL: WordPress, 1С-Битрикс, Tilda, Joomla, Drupal, OpenCart и другие — по сигнатурам кода и заголовкам. Полезно по конкурентам.

Открыть
Проверка SSL-сертификата

Домен → срок действия и дата истечения, кем выдан, доверие, совпадение с доменом и список SAN. Чтобы HTTPS не «протух» внезапно.

Открыть

Ещё инструменты для SEO и семантики

Кластеризация запросов и лемматизация, чистка по стоп-словам, генераторы sitemap.xml, robots.txt и редиректов, разметка Schema.org — в разделе 17 инструментов.

Сервисы, о которых здесь речь

Что это за инструменты, кому подходят и что доступно без оплаты — в карточках каталога.

Разделы каталога: Панели вебмастера, Конструкторы сайтов и CMS.