Как собрать семантическое ядро и расширить структуру сайта: пошаговое руководство

Как составить семантическое ядро без помощи специалиста — руководство для владельцев интернет-магазинов Я подготовил универсальное руководство, которое позволит правильно собрать и кластеризовать
1. Формируем черновую структуру сайта
Первым делом мы готовим черновую структуру сайта, которую в дальнейшем будем расширять на основании собранной семантики и анализа конкурентов.
Если сайт в разработке:
- просим описать в брифе особенности бизнеса;
- просим отправить выгрузку товаров в табличном формате (.xls или Google Таблицы).
После получения брифа и выгрузки товаров мы изучаем полученные данные и готовим черновую структуру сайта с учетом служебных страниц: «О нас», «Контакты», «Доставка и оплата», «Вопросы и ответы».
Если сайт готов:
- переносим текущую структуру сайта в рабочий документ (Google Таблицы) ;
- изучаем продукцию сайта, создаем дополнительные категории, подкатегории и фильтры на основе названий товаров.
Например, на одном из проектов в категории «Защита от бытовых вредителей» мы обнаружили разные типы товаров:
Поэтому для них создали дополнительные категории:
- cпирали от комаров:
- москитные сетки;
- липкие ленты;
- липкие листы;
- палочки от комаров;
- мухобойки;
- ловушки.
При работе со структурой существующего сайта мы выделяем новые категории зеленым цветом. Так лучше видны новые категории и масштабы расширения структуры.
При создании черновой структуры кроме категорий / подкатегорий мы также добавляем типы и значения фильтров. Хорошо проработанную черновую структуру легче и быстрее расширить, чем кластеризовать «сырые» данные.
1.1. Составляем список конкурентов
Если работаем с существующим сайтом, определяем его основных конкурентов с помощью сервиса Serpstat:
1.1.1. В строке поиска указываем сайт.
1.1.2. Выбираем поисковую систему и регион.
1.1.3. Переходим в раздел «SEO-анализ» — «Конкуренты».
1.1.4. Сортируем по количеству общих фраз.
В итоге получаем список основных конкурентов:
Если оптимизируем новый сайт или по сайту еще нет достаточного количества информации в Serpstat, переходим к анализу лидеров в отдельных категориях. Для этого вместо домена в Serpstat задаем поисковую фразу. Например, список конкурентов для категории «Удобрения»:
Эти данные пригодятся при работе с существующим сайтом, потому что мы будем знать лидеров в отдельных нишах.
Все полученные данные сохраняем для дальнейшей обработки. Для этого выгружаем данные через «Экспорт»:
После выгрузки конкурентов исключаем все информационные сайты и оставляем только коммерческие:
1.2. Анализируем структуру конкурентов
На этом этапе мы детально изучаем структуру конкурентов: их категории и фильтры. Если у них есть интересные элементы, добавляем в структуру для дальнейшего изучения.
Например, на сайте одного из конкурентов в категории «Инсектициды» были обнаружены фильтры:
- для защиты от;
- для защиты культуры.
Эти фильтры также добавили в черновую структуру:
2. Собираем семантическое ядро
На данном этапе мы собираем максимально большое количество поисковых запросов, распределяем их по категориям и при необходимости создаем дополнительные категории и фильтры.
Для каждой категории готовим базовые ключевые запросы на основании названий категорий, а также расширяем их с помощью синонимов. Для этого мы используем:
- Serpstat;
- Яндекс.Вордстат;
- Планировщик ключевых слов Google Рекламы;
- KeyCollector;
- Внутреннюю разработку Netpeak.
Для эффективной работы с большим объемом данных почти все операции по сбору семантического ядра выполняем в KeyCollector.
2.1. Настраиваем KeyCollector
Перед началом работы с KeyCollector:
- добавляем прокси (чем больше, тем лучше) ;
- добавляем аккаунты Яндекс.Директ;
- добавляем аккаунты Google Рекламы;
- подключаем сторонние API;
- указываем ключ для распознавания капчи;
- указываем нужный регион для Яндекс.Вордстат и Яндекс.Директ.
При этом лучше использовать платные персональные прокси, потому что при совместном использовании вероятность бана в сервисах очень большая.
Не используйте основные аккаунты для Google Рекламы и Яндекс.Директ — они должны быть созданы специально для KeyCollector. Существует большая вероятность их бана.Для удобства работы со сбором и кластеризацией семантического ядра в KeyCollector мы используем группы. Для каждой категории, подкатегории и значению фильтров создаем папку на основании черновой структуры:
2.2. Формируем базовые запросы
Для начала мы анализируем название категории и содержимое страницы — нам необходимо придумать несколько поисковых запросов, которые могут описать содержимое страницы. Например, ключевые фразы для категории «Средства защиты растений»:
- сзр;
- средства защиты растений.
Затем расширяем количество базовых фраз с помощью синонимов. Один из инструментов, которые мы используем — «Похожие фразы» в Serpstat:
С помощью инструмента можно найти еще несколько синонимов для каждого базового запроса.
Далее проводим анализ конкурентов: в строке поиска Serpstat указываем конкретные страницы конкурента (например, страницу категории «средства защиты растений»):
По каждому конкуренту мы получили список ключевых фраз, по которым он ранжируется в топ–100. Для получения большего количества данных мы анализируем несколько поисковых систем, а если в регионе нет хороших конкурентов — анализируем сайты в других регионах. Все полученные запросы переносим в KeyCollector.
Чтобы не переносить каждый раз фразы из Serpstat в KeyCollector, мы используем функцию сбора ключевых фраз по домену / URL прямо из Serpstat. Она позволяет указать сразу несколько URL и добавить все ключевые фразы в проект. А это экономия времени:
2.3. Используем дополнительные сервисы для поиска синонимов
Если у вас нет доступа к Serpstat, можно проанализировать правую колонку в Вордстат.
Кроме поиска синонимов в Serpstat, можно использовать планировщик ключевых слов в Google Рекламе.
2.3.1. Открываем инструмент «Планировщик ключевых слов».
2.3.2. Выбираем «Поиск новых ключевых слов по фразе, сайту или категории».
2.3.3. Указываем базовые запросы.
2.3.4. Указываем регион и язык.
2.3.5. Нажимаем «Получить варианты».
После этих манипуляций получаем список похожих ключевых слов:
2.4. Собираем расширения поисковых фраз из разных источников
Для этих целей мы используем инструменты Serpstat и Яндекс, Вордстат в KeyCollector, а также собираем подсказки в Google и Яндекс. Для сбора расширений поисковых фраз вышеуказанных инструментов вполне достаточно.
2.5. Формируем стоп-слова
Перед непосредственным сбором семантики составляем список стоп-слов. Использование стоп-слов очень важно: с их помощью мы отсекаем все мусорные фразы, а в будущем при обновлении семантического ядра нам не придется делать двойную работу.
Также список стоп-слов пригодится специалистам контекстно-медийной рекламы. В зависимости от тематики стоп-слова могут быть разными. Обычно в список стоп-слов добавляем:
- информационные приставки (что, это, как, фото, видео, смотреть, инструкция, схема, своими руками) ;
- города (которые не соответствуют маркетинговым целям) ;
- фразы, которые предполагают бесплатное получение товара (скачать, бесплатно, дешево) ;
- субъективные понятия (лучший, самый) ;
- популярные сайты / бренды (olx, олх, вконтакте, vk, пром).
По мере сбора семантического ядра список стоп-слов постоянно расширяется и может составлять сотни строк. Для удобства работы со стоп-словами мы используем встроенный одноименный инструмент в KeyCollector:
2.6. Собираем расширения в Serpstat
После добавления стоп-слов переходим к сбору расширений ключевых фраз с помощью Serpstat. Для этого в KeyCollector выбираем «Serpstat» — «Сбор расширений ключевых фраз»:
Указываем фразы, и получаем список расширений фраз из Serpstat:
2.7. Собираем расширения в Вордстат
Далее собираем расширения в Яндекс.Вордстат. Для этого используем инструмент «Пакетный сбор» слов из левой колонки Яндекс.Вордстат:
Перед сбором расширений в Яндекс.Вордстат включаем применение стоп-слов при составлении запроса к Вордстат (при условии, что список стоп-слов не превышает 7000 символов):
Таким образом, отсекая ненужные фразы, мы тратим меньше ресурсов. Если список стоп-слов превышает 7000 символов, пропускаем этот шаг и возвращаемся к нему после сбора данных.
2.8. Собираем поисковые подсказки
После сбора фраз в Serpstat и Вордстат собираем подсказки в Google и Яндекс, используя поисковые подсказки в Serpstat и KeyCollector.
Для получения поисковых в Serpstat:
- указываем фразу, по которой необходимо собрать подсказки;
- выбираем поисковую систему;
- переходим в раздел «Поисковые подсказки»;
- экспортируем полученные данные.
Чтобы ускорить процесс получения подсказок из Serpstat, мы используем API Serpstat. Используя специальную таблицу, делаем так:
2.8.1. Указываем токен для доступа к Serpstat.
2.8.2. Указываем список ключевых фраз, для которых хотим получить поисковые подсказки.
2.8.3. Выбираем поисковую систему, из которой нужно собрать подсказки.
2.8.4. Выбираем в меню Serpstat > Get Suggestions By Keyword.
2.8.5. Переходим во вкладку Suggestions By Keyword и получаем список поисковых подсказок.
Также при использовании «Пакетного экспорта» можно массово выгрузить подсказки. Для этого необходимо:
- в Serpstat перейти в раздел «Поисковые подсказки»;
- выбрать инструмент «Пакетный экспорт»;
- указать фразы, по которым мы хотим получить подсказки;
- выгрузить поисковые подсказки.
Результаты переносим в KeyCollector и повторяем процедуру с другими поисковыми системами / регионами.
Если у вас нет аккаунта Serpstat, можно использовать встроенный инструмент в KeyCollector «Пакетный сбор поисковых подсказок» и собирать поисковые подсказки в Яндекс или Google:
3. Чистим запросы
После сбора расширений ключевых фраз необходимо очистить семантическое ядро от «мусорных» запросов — неподходящих или низкоэффективных фраз.
Если мы не использовали опцию «Применение стоп-слов при обращению к Яндекс.Вордстат», необходимо очистить запросы с помощью инструмента «Стоп-слова»:
Далее собираем частотность по всем фразам:
3.1. Выбираем инструмент «Сбор статистики Яндекс.Директ».
3.2. Собираем статистику за год, потому что собирая статистику за последний месяц, мы привязываемся к сезонности в этот период.
3.3. Ставим галочку «Целью сбора статистики является заполнение колонок частот Яндекс.Вордстат.
3.4. Нажимаем на кнопку «Получить данные».
После получения статистики по всем необходимым запросам переходим к инструменту «Анализ неявных дублей» и задаем настройки:
- ищем дубли во всех группах;
- отмечаем все фразы, кроме самой высокочастотной;
- если не все неявные дубли имеют частоту, то снимаем отметку со всех дублей;
- если несколько фраз имеют одинаково высокую частотность, оставляем одну из них;
- выбираем, на основании какой колонки частотностей анализировать неявные дубли.
После выполнения всех настроек нажимаем на «Выполнить поиск дублей повторно» и получаем отмеченные неявные дубли, которые нужно удалить:
После очистки неявных дублей переходим к инструменту «Анализ групп»:
С помощью инструмента быстро удаляем ненужные фразы, которые остались. Для этого отмечаем все неподходящие группы. В контекстном меню выбираем пункт «Отправить все слова из определений групп, в которых хотя бы одна фраза отмечена, в окно стоп-слов»:
На данном этапе мы отправляем все неподходящие слова в список стоп-слов. Это могут быть города, бренды или типы товаров, которые сайт не продает или не планирует продавать.
8 шагов к очистке семантического ядра в Key Collector Далее
3.1. Группируем ключевые фразы
Последний этап создания семантического ядра — группировка ключевых фраз. После очистки всех запросов от мусорных фраз мы переходим к кластеризации.
Это можно делать как в ручном, так и полуавтоматическом режиме. Мы используем встроенный инструмент группировки ключевых фраз в KeyCollector, который группирует фразы на основе выдачи поисковых систем, затем группируем фразы вручную.
В качестве выбора поисковой системы для анализа топа используем выдачу Google.ru, потому что он реже банит прокси. Выбор поисковой системы для кластеризации не критичен, так как наша цель — не подстроиться под топ, а определить близкие фразы, которые в дальнейшем мы будем проверять вручную.
Выбираем инструмент «Получить данные для ПС Google» в разделе «Вычисление KEI»:
Учтите, что для сбора выдачи по большому количеству фраз необходимо много хороших прокси. Лучше всего использовать платные прокси, которые будете использовать только вы. Таким образом вы минимизируете вероятность попадания в бан и получения капчи.Далее переходим к инструменту «Анализ групп» и настраиваем группировку:
- тип группировки: по составу фраз и поисковой выдаче;
- сила по составу: 1;
- сила по SERP: 5;
- поисковая система: зависит от того, какую ПС мы спарсили;
- топ: «все имеющиеся».
Напоследок вручную проходим по всем группам запросов, объединяем, создаем новые и распределяем фразы по текущим.
Правила группировки фраз для семантического ядра сайта Подробнее о группировке фраз
После ручной сортировки у нас уже получается почти готовая структурированная семантика. Вот как выглядит часть структуры групп нового сайта в KeyCollector для категории «Ножи и инструменты»:
4. Формируем структуру сайта
После сбора семантического ядра мы переходим к созданию структуры сайта. На данном этапе мы окончательно формируем:
- категории;
- подкатегории;
- блоки фильтров.
Все ранее собранные данные анализируем и переносим в таблицу. В документе видно примерно 20% структуры, которая получается в итоге.
Естественно, на всеобщее обозрение мы не будем выставлять всю структуру, ведь мы потратили много часов на ее создание. Но вы можете понять, что в результате выходит:
- структура сайта в таблице с названиями урлов;
- структура сайта в Mind Map;
- семантическое ядро с частотностью;
- список стоп-слов.
Вывод
В этой статье мы детально рассмотрели, как увеличить охват и видимость сайта за счет сбора семантического ядра и расширения структуры с помощью различных инструментов.
Для привлечения трафика на сайт за счет создания дополнительных страниц:
- Создайте черновую структуру сайта.
- Соберите и кластеризуйте семантическое ядро.
- Создайте новые категории, подкатегории и фильтры на основании семантического ядра.
Если при выполнении описанных в статье действий вы столкнулись со сложностями, делитесь в комментариях — попробуем разобраться вместе.
С радостью возьмем в работу еще несколько проектов.
Заказывайте SEO-продвижение у лидеров рынка
Комментарии:
О том, как рассчитать коэффициент ROI (ROMI) для выявления эффективности и прибыльности рекламных кампаний...
03 09 2026 14:14:58
Благодаря внедрению интеpaктивной формы подписки увеличили количество ежемecячных подписок на 100%, доход — на 51%, а коэффициент транзакций — на 71%....
01 09 2026 14:15:34
Все, что нужно знать об UTM-метках: зачем использовать, как правильно сгенерить и анализировать....
31 08 2026 8:39:14
Как добиться эффективности и самоорганизации. Читайте о системе тимлида Netpeak Андрея Коваля....
30 08 2026 11:48:30
Как добавить свою рекламу через поисковый сервис с картинками в Google....
29 08 2026 8:19:48
Часто трафик проседает из-за удаления важных страниц или изменения URL-адресов. Анализ данных веб-архива позволит сохранить или восстановить посещаемость...
28 08 2026 2:51:30
Личный опыт экс-главреда экс-блога Netpeak (сейчас — Netpeak Journal): о работе с информацией, мотивации написания, редактуре черновика, подаче информации по степени важности, выделении главного и составлении окончательной версии текста. Как сделать текст логичным и полезным? Узнайте!...
27 08 2026 1:17:38
Сторителлинг — это способ рассказывать истории, его цель — дать возможность читателю или зрителю почувствовать себя героем этой истории,...
26 08 2026 5:30:23
Отключение и удаление элементов, расширенные настройки, интересные дополнения и многое другое в нашем материале про мир SEO расширений....
25 08 2026 18:56:23
Считаем SEO-эффект от нового дизайна сайта и работы над usability...
24 08 2026 11:41:11
Для максимальной прибыли с YouTube-канала нужно выбрать одну из наиболее посещаемых ниш. Не всегда прибыльная тема соответствует личным предпочтениям владельца канала...
23 08 2026 22:41:14
Интересный и важный документ, не пропустите. Для ранжирования используется сумма коммерческой и тематической релевантности. Уходя с головой в SEO, многие вебмастера забывают о пользовательских факторах. Узнайте больше об этом!...
22 08 2026 1:40:57
Чтобы раскрутить себя в Твиттер иногда нужно чистить списки фолловеров и это намного проще, чем кажется :)...
21 08 2026 0:54:48
Подборка ненаучных наблюдений и ситуаций, в которых бывал каждый из нас...
20 08 2026 5:51:19
Как сделать креативный мобильный баннер. Зачем нужны особенные баннеры для мобильных? Что делать с картинкой? Что делать с текстом? Что делать с другими рекламными форматами? Дополнительные элементы. Обо всем этом детально и спримерами...
19 08 2026 17:50:43
Как пользоваться выбором высокочастотных фраз для метатегов, чисткой мусорных фраз и как расставлять приоритеты для навигационных запросов с указанием определенного направления...
18 08 2026 5:40:30
Расчет прогноза по LTV позволит более точно задать параметры рекламной кампании в Apple Search Ads на начальном этапе. Как это делают в RadASO, читайте в статье....
17 08 2026 13:31:39
База самых распространенных CMS и модулей для их SEO-оптимизации....
16 08 2026 4:11:21
Статистика изменений долей рынка после майского и декабрьского апдейта Google в 2020 году....
15 08 2026 12:21:14
Как обнаружить слабые места бизнеса и улучшить продажи с помощью технологии Call Tracking....
14 08 2026 12:52:40
Планируете создание бизнеса, связанного с торговлей в интернете? Сначала прочитайте этот текст....
13 08 2026 17:50:32
Ежегодно в конце ноября начинается ажиотаж вокруг «огромных» скидок на Черную пятницу. Во всем мире этого дня ждут и готовятся покупать выгоднее. Но так ли это на самом деле?...
12 08 2026 0:27:53
На третий месяц работы мы вышли на положительный ROMI, на четвертый — ROMI превысил 800%....
11 08 2026 2:31:54
«Rework» — одна из самых любимых книг нетпиковцев....
10 08 2026 20:33:26
Как диагностировать Google Panda, понять, что нужно изменить на своем сайте и сделать пользователей счастливыми....
09 08 2026 19:42:41
Пошагово подключаем скрипт проверки бюджета аккаунтов Google Ads. Скрипт отправляет уведомление на почту и в Telegram — это поможет вовремя пополнить счет. Узнать больше!...
08 08 2026 4:26:55
SEO-продвижение сайта, торгующего натуральной косметикой...
07 08 2026 0:52:43
Используем маску ввода для оптимизации сбора телефонных номеров в формах на сайте: кейсы агентства Netpeak...
06 08 2026 18:42:48
Если у интернет-магазина, форума да и любого другого сайта нет мобильной версии, почти 40 процентов пользователей будут искать другой ресурс. Как удержать их? Узнать!...
05 08 2026 8:37:15
Блиц-инструкция и рекомендации по созданию эффективных описаний для мобильных приложений...
04 08 2026 15:34:32
Разбираем на примерах коллабораций, подрядчиков из регионов и тендендерных площадок...
03 08 2026 18:40:27
Правила, требования, особенности. А ещё примеры, которые помогут создать правильную, с точки зрения поисковиков, рекламу. Читать!...
02 08 2026 16:45:59
Совет Константина Леоновича (Sape.ru), 4 наших + 2 бонусных...
01 08 2026 15:10:55
Расширения, горячие клавиши и мгновенный перевод слов на другой язык — минимум лайфаков, которые можно использовать для удобства пользователей Google Chrome...
31 07 2026 16:29:31
Как автоматизировать рутину в Google Таблицах с помощью Google Apps Script...
30 07 2026 16:51:25
Следим за развитием событий и анализируем решение суда. Читать дальше!...
29 07 2026 0:52:19
Участники Netpeak Cluster поделились своими инсайтами....
28 07 2026 18:32:20
Интеграция видео в маркетинговую кампанию – решение, которое повысит ценность каждого посетителя сайта....
27 07 2026 20:27:57
Разбираемся, как определить самые эффективные источники лидов....
26 07 2026 6:46:45
Алгоритм настройки и запуска рекламы для SMM-, PPC-специалистов, блогеров и владельцев бизнеса....
25 07 2026 12:31:18
Учимся выстраивать коммуникацию по специальным сценариям....
24 07 2026 13:41:23
Помимо полезного и качественного продукта, услуги, компании нужен мощный маркетинг. И возможно это только благодаря хорошему директору по маркетингу. Только так это работает. Кто лучшие в этой нише в Казахстане? Узнать!...
23 07 2026 6:21:35
Как создать портрет покупателя и зачем он нужен бизнесу....
22 07 2026 15:11:28
Специалистам часто приходится проводить вебинары и для этого нужна адекватная площадка. В инсайдерском посте мы рассказываем, как выбирали подходящую платформу для проведения вебинаров и что из этого вышло....
21 07 2026 16:14:32
Данные по 24 миллионам кликов в 24 тематиках и 391 городу...
20 07 2026 17:53:11
Какой движок сайта стоит выбрать...
19 07 2026 17:27:20
Деловой этикет в переписке с бизнес-партнерами, сотрудниками, клиентами. Как заручиться доверием, укрепить деловые отношение и мотивировать подчиненных. Узнать!...
18 07 2026 14:19:35
Четыре способа исключить нерелевантные места размещения видеорекламы, а также полезные списки минус-слов и детских YouTube-каналов....
17 07 2026 3:55:48
Об особенностях реализации интернет-проектов в Великобритании, России и Казахстане и фишках успешного ведения бизнеса онлайн мы побеседовали с Владимиром Меркушевым — руководителем интернет-проектов успешной казахстанской компании Kolesa.kz....
16 07 2026 21:29:41
Еще:
понять и запомнить -1 :: понять и запомнить -2 :: понять и запомнить -3 :: понять и запомнить -4 :: понять и запомнить -5 :: понять и запомнить -6 :: понять и запомнить -7 ::