Кластеризация запросов

Разбивает список ключевых запросов на смысловые группы по общим словам — с учётом словоформ (морфологии). Это быстрый черновой способ увидеть структуру ядра: один кластер обычно соответствует одной посадочной странице.

Запросы

0 запросов

Кластеры

0 кластеров
Скопировано ✓ Кластеров:0из них групп:0

Три способа кластеризовать и когда какой нужен

Кластеризация решает одну задачу: понять, сколько страниц нужно и какие запросы ведут на каждую. Способ выбирают по размеру ядра и по цене ошибки. Инструмент на этой странице группирует по общим словам — быстро и бесплатно, чего хватает для небольшого ядра и первичной разборки.

Способы группировки запросов
Для ядра до тысячи запросов разница между способами обычно меньше, чем кажется
СпособКак работаетСильная сторонаОграничение
По общим словамГруппирует по совпадению слов в запросахБыстро, работает офлайн, ничего не стоитРазводит синонимы: «купить окна» и «заказать окна» в разных группах
По топу выдачи (hard)В группе остаются запросы с общими сайтами в топе у всехТочнее всего отражает мнение поискаНужны данные выдачи, группы получаются мелкими
По топу выдачи (soft)Достаточно пересечения с центром группыГруппы крупнее и ближе к структуре сайтаИногда склеивает разные интенты
Вручную по смыслуРазметка глазамиПонимает контекст бизнесаРеально только на сотнях запросов, не на десятках тысяч

Практическое правило: сначала прогоните ядро по общим словам и посмотрите, что получилось. Если групп вышло столько же, сколько запросов, ядро слишком разнородное — его сначала чистят. Если наоборот, всё слиплось в две группы, значит запросы почти дублируют друг друга, и страниц нужно меньше, чем вы планировали.

Что делать с готовыми группами

1
Проверьте интент внутри группыЗапросы «купить», «цена», «отзывы» и «что такое» требуют разных страниц, даже когда слова совпадают. Смешанная группа — первый признак, что кластеризация по словам сработала формально.
2
Назначьте каждой группе страницуОдна группа — одна посадочная. Две страницы под одну группу начинают конкурировать между собой, и поиск выбирает то одну, то другую.
3
Отсортируйте группы по спросуСуммарная частотность группы показывает, за что браться первым. Сотня мелких групп по десять показов подождёт.
4
Проверьте, нет ли уже такой страницыПоловина групп на живом сайте закрывается существующими страницами: их надо дополнить. Новые страницы тут только создадут конкуренцию своим же.

Как запросы попадают в одну группу

Инструмент читает список построчно, разбивает каждый запрос на слова, выбрасывает предлоги и союзы и приводит остальное к основе: «виниров», «виниры» и «винир» становятся одним словом. Дальше запросы сравниваются попарно по числу общих основ. Первый запрос открывает первую группу; каждый следующий либо присоединяется к группе, с которой у него достаточно общих слов, либо открывает свою.

Порог «сила группировки» и задаёт это «достаточно». При единице любой общий корень сводит запросы вместе, и группы получаются крупными: всё со словом «окна» ляжет в одну. При двух-трёх словах группы дробятся, и «пластиковые окна цена» отделяется от «пластиковые окна отзывы». Порядок строк тоже влияет: группа получает имя по первому запросу, поэтому список, отсортированный по частоте, даёт более понятные заголовки.

Синонимы и разные формулировки одного смысла метод не видит: «заказать окна» и «окна под ключ» окажутся в разных группах, хотя ведут на одну страницу. Это цена скорости: расчёт идёт в браузере за доли секунды на десятках тысяч строк, и ему не нужны данные выдачи.

Сортировка писем по ячейкам
Группировка по словам похожа на сортировку почты по индексу: быстро, но конверт с ошибкой в адресе ляжет в чужую ячейку. Фото: Geographer, CC BY-SA 2.0.
ПорогГрупп получаетсяДля чего
1 словомало, крупныепервый взгляд на ядро, оценка числа разделов
2 словасредниеразводка по посадочным страницам
3 словамного, мелкиедлинные запросы, узкие ниши

От статистики к группировке по выдаче

Слово «кластер» пришло в семантику из статистики. Кластерный анализ как метод описал психолог Роберт Трайон в 1939 году, а алгоритм k-средних, на котором держится половина современных группировок, Стюарт Ллойд предложил в 1957 году для задач телефонной связи. Идея одна: объекты, похожие друг на друга, собрать вместе, непохожие — развести.

В поисковой оптимизации группировать запросы начали вручную, по смыслу, пока ядра умещались в сотни строк. Когда сбор из Вордстата и подсказок стал давать десятки тысяч фраз, появились программы группировки по словам, а в середине 2010-х — сервисы кластеризации по выдаче: два запроса считаются одной группой, если у них в топ-10 совпадает несколько адресов. Так поиск сам подсказывает, какие фразы он считает одним намерением.

Между этими двумя способами и живёт инструмент на странице: он делает черновую группировку по словам, как первые программы, и делает её в браузере без данных выдачи. Для боевого ядра результат уточняют по топам или руками.

Сортировка почты вручную
До программ группировки запросы раскладывали по страницам руками, как письма по ячейкам. Фото: Archives New Zealand, CC BY-SA 2.0.
Наборная касса с литерами
Наборная касса: у каждой литеры своя ячейка, и порядок в ней решает, как быстро соберётся строка. Фото: Andrea.C.Fi, CC BY-SA 4.0.

Порядок работы с ядром

Перед группировкой почистите список: уберите точные повторы в удалении дубликатов и неявные — в удалении неявных дублей. Иначе одна фраза в трёх написаниях создаст три группы, а частотность посчитается трижды. Отсортируйте список по частоте, чтобы группы получали имена по самым ходовым запросам.

Начинайте с порога в одно слово и смотрите на размер групп. Если группа со словом «ремонт» собрала половину ядра, поднимите порог до двух и прогоните ещё раз. Группы из одного запроса оставляйте на потом: обычно это либо мусор, либо редкая формулировка, которую стоит вручную присоединить к соседям.

Готовые группы проверяйте на смешение намерений: «что такое», «цена» и «отзывы» внутри одной группы означают три разные страницы. Информационные запросы уводите в статьи, коммерческие — в категории и карточки. Дальше слова из групп пригодятся в генераторе минус-слов для рекламы и в проверке длины заголовков для будущих страниц.

Методпо общим словам
Морфологияприведение к основе
Порог1–3 общих слова
Данные выдачине нужны
Расчётв браузере
Кластерный анализ1939, Трайон
k-средних1957, Ллойд
Кластеризация по топамсередина 2010-х

Как пользоваться

Считается в браузере, ничего не уходит на сервер. Для боевых проектов глубокую кластеризацию по топу выдачи я собираю внутри услуги «семантическое ядро».

  1. Скопируйте ключевые фразы в левое поле — по одной на строку. Подойдёт выгрузка из Wordstat, Key Collector или подсказок.
  2. Выберите, сколько общих слов нужно для попадания в один кластер (1 — мягко, 2–3 — строже), и оставьте включённой морфологию, чтобы «виниры» и «виниров» считались одним словом.
  3. Справа появится ядро, разбитое на группы с заголовками вида «# виниры (5)». Скопируйте результат или перенесите в таблицу.

Частые вопросы

Как работает кластеризация?

Каждый запрос разбивается на слова, служебные слова отбрасываются, остальные при включённой морфологии приводятся к основе. Дальше запросы группируются по числу общих слов: чем больше пересечение, тем вероятнее общий кластер. Это эвристика по словам — быстрый черновик структуры ядра.

Чем «сила группировки» отличается?

Это минимальное число общих слов, при котором запрос попадает в существующий кластер. «1 слово» — мягкая группировка, кластеров меньше и они крупнее. «2–3 слова» — строже, кластеры мельче и точнее. Начните с 1 и ужесточайте, если группы получаются слишком общими.

Это то же самое, что кластеризация по топу выдачи?

Нет. Здесь группировка идёт по словам в самих запросах. Пересечение URL в топ-10 Яндекса и Google тут не учитывается. Словарный метод быстрый и бесплатный, но более грубый. Кластеризацию по выдаче (когда учитывается, как поисковик реально склеивает запросы) я делаю внутри услуги по сбору семантического ядра.

Как сделать группировку запросов онлайн

Загрузите список фраз и задайте порог совпадения: запросы объединяются в группы по общим адресам в выдаче. Мягкий порог даёт крупные группы, жёсткий разбивает ядро мельче и надёжнее для коммерческих страниц. Верхние группы после расчёта стоит просмотреть глазами: алгоритм сравнивает выдачу и не понимает смысла.

Где этому учат

Кластеризация запросовкак из списка фраз получить структуру сайта

Похожие инструменты

Удаление дубликатов

Убирает повторы из списка, оставляя только уникальные строки. Без учёта регистра, с подсчётом повторов и сортировкой.

Открыть
Лемматизация и нормализация

Приводит ключи к основе (стемминг) и схлопывает словоформы. Умный дедуп семантики: ловит дубли по падежам, числу и порядку слов.

Открыть
Генератор минус-слов

Разбирает фразы на уникальные слова с частотой и собирает минус-слова для Яндекс.Директа и Google Ads. Целевые слова исключаются.

Открыть
Длина Title и Description

Массовая проверка длины метатегов списком: считает символы, помечает превышение лимита и подсвечивает хвост, который обрежется в выдаче.

Открыть
Микроразметка Schema.org

Генератор JSON-LD: Organization, LocalBusiness, Article, FAQ, хлебные крошки, Product. Готовый код для расширенных сниппетов и ИИ-выдач.

Открыть
robots.txt для AI + llms.txt

Галочками закрываете или открываете нейросетевые боты (GPTBot, ClaudeBot, Google-Extended, PerplexityBot) и собираете модный файл llms.txt. На волне GEO.

Открыть

Ещё инструменты для SEO и семантики

Кластеризация запросов и лемматизация, чистка по стоп-словам, генераторы sitemap.xml, robots.txt и редиректов, разметка Schema.org — в разделе 17 инструментов.