Покрытие: семантика корпуса топа и упущенные слова
Раздел «Покрытие» детального отчёта группирует слова из документов топа выдачи по доле документов, в которых они встречаются (от 100% до 40%), и сопоставляет этот словарь с текстом посадочной страницы проекта.
Инструмент показывает лексический срез поисковой ниши и автоматически находит упущенную LSI-семантику — слова, присутствующие у большинства лидеров выдачи, но забытые на вашей посадочной странице.
Где находится блок покрытия
В основном меню откройте «Анализ» → вкладка «Общий анализ» и нажмите на название кластера. В детальном отчёте прокрутите экран ниже графиков Z-метрик, метрик документов топа, Zipf-кривых, N-грамм и Метатегов до раздела «Покрытие».
Блок расположен перед блоком «Слова запросов кластера» и состоит из двух независимых аккордеонов.
Списки относятся к сохранённому анализу. После изменения страницы нажмите «Обновить анализ», чтобы проверить обновлённый текст.
Зачем нужен анализ покрытия корпуса топа
Корпус топа — это тексты проанализированных страниц выдачи. Общая лексика помогает определить, какие характеристики, условия покупки и вопросы раскрывают конкуренты. Сравнение с посадочной страницей показывает, что стоит рассмотреть при её доработке.
Блок «Покрытие» решает три ключевые задачи специалиста:
- Лексика ниши: слова сгруппированы по встречаемости у конкурентов — от общего словаря (100%–90%) до терминов, встречающихся в части документов (80%–40%).
- Автоматический gap-анализ посадочной страницы: избавляет от многочасового ручного чтения сайтов конкурентов. Система мгновенно сопоставляет словарь лидеров выдачи с текстом вашей страницы и формирует готовый список дефицитных лемм.
- Фокус на распространённых словах: в списках показываются слова, найденные хотя бы в 40% документов топа.
Структура блока: корпус и упущенная семантика
В исходном состоянии оба аккордеона свёрнуты, чтобы не загромождать отчёт длинными списками слов:

- 1 «🧠 Семантика корпуса» — раскрывает полный словарь документов топа выдачи, разбитый по группам охвата (100→40%).
- 2 «⚠️ Упущенная семантика» — раскрывает список слов топа, которых нет в очищенном тексте вашей посадочной страницы.
Что означают проценты покрытия (100%–40%)
Клик по аккордеону «Семантика корпуса» разворачивает словарь топа по семи корзинам охвата:

- 1 Заголовок аккордеона с шевроном — клик сворачивает и разворачивает список.
- 2 Группы покрытия (100% → 40%) — процент на бейдже показывает долю документов топа, в тексте которых встречается слово:
где DF(w) — количество документов сохранённого топа, содержащих лемму w, а N_docs — общий объём проанализированной выдачи по кластеру.
Процент на бейдже — нижняя граница группы. Например, группа 80% включает значения от 80% до менее 90%. При десяти документах 8 из 10 дают ровно 80%. Если документов двадцать, 19 из 20 дают 95% — слово попадёт в группу 90%.
Шкала разбита на семь фиксированных диапазонов с шагом 10%, оформленных тепловым цветовым градиентом от более горячих к холодным (100% — красный, 90% — оранжевый, 80% — жёлтый, 70% — grape, 60% — синий, 50% — teal, 40% — зелёный). Каждый диапазон выполняет свою роль при оценке текстового стандарта:
- 100% (Полный консенсус выдачи): слова, которые присутствуют абсолютно в каждом документе топа без единого исключения (например, 10 из 10 документов). Начните проверку пропусков с этой группы и определите, какие термины относятся к теме и предложению вашей страницы.
- 90% (Базовый отраслевой стандарт): слова, зафиксированные у подавляющего большинства лидеров выдачи (9 из 10 сайтов). Это приоритетная группа для сверки лексики посадочной с топом.
- 80% и 70% (Отраслевая специфика и свойства): термины, присутствующие у уверенного большинства сайтов (7–8 из 10). Как правило, в этот диапазон входят параметры выбора, характеристики товаров или услуг, сценарии применения и сервисные маркеры (условия доставки, гарантия, подбор, оплата). Именно здесь сосредоточен основной резерв для роста текстовой релевантности страницы.
- 60% и 50% (Вариативная семантика): слова, характерные примерно для половины документов топа. Они отражают разнообразие форматов раскрытия темы у конкурентов: подробные таблицы параметров, экспертные обзоры, блоки отзывов, фасетные фильтры или блоки сопутствующих категорий.
- 40% (Нижняя граница значимости): слова, встречающиеся у 4 из 10 сайтов топа. Служат для точечного расширения лексики, если тематика конкретного термина полностью совпадает с направлением вашего проекта.
- Порог 40%: слова с меньшей встречаемостью в этих списках не показываются. Смысловую уместность терминов оценивайте по ассортименту и содержанию страницы, в том числе в верхних группах.
Каждая группа оформлена бейджем с процентом охвата и счётчиком уникальных лемм. Внутри группы слова отсортированы по убыванию среднего внутристраничного TF-IDF на страницах, где они встречаются:
Внутристраничный TF-IDF равен доле слова в тексте, умноженной на натуральный логарифм числа уникальных слов страницы. Среднее берётся по страницам, содержащим слово: например, значения 0.1 и 0.2 дают 0.15. Чем выше средний вес, тем раньше слово в списке; смысловую уместность термина оценивает специалист.
Как работает блок «Упущенная семантика»
Клик по аккордеону «Упущенная семантика» разворачивает автоматический аудит расхождений между словарем лидеров выдачи и текстом вашей посадочной страницы:

- 1 Заголовок аккордеона «Упущенная семантика» — клик раскрывает перечень пробелов посадочной страницы.
- 2 Группы отсутствующих слов — отображают только те уровни охвата, где у страницы обнаружен реальный дефицит лексики:
- Алгоритм сопоставления: исходный HTML-код вашей посадочной страницы очищается от скриптов, стилей и служебных тегов. Полученный текст проходит морфологический разбор: слова приводятся к начальной форме (лемме), отсекаются общие стоп-слова, предлоги и союзы. Затем полученный набор лемм поэлементно сравнивается со словарем корпуса топа.
- Группы без пропусков скрыты: если посадочная страница уже содержит все леммы из группы 100% или 90%, эти строки в интерфейсе полностью скрываются. На демонстрационном скриншоте группы 100% и 90% закрыты на 100%, поэтому первой строкой выводится группа 80%.
- Счётчик слов: рядом с бейджем процента указано количество отсутствующих лемм. На скриншоте в группе 80% два слова: walnut, производитель. Проверьте, относятся ли они к ассортименту и содержанию вашей страницы.
- Пустые состояния и прочерки: при отсутствии групп выводится
«Нет данных по покрытию»или«Нет данных по упущенной семантике». Пустой список пропусков возможен при отсутствии данных посадочной и при полном покрытии словаря. Проверьте доступность анализа лендинга. В пустой группе вместо перечня выводится прочерк«—».
Методика работы: приоритизация доработок и ТЗ
Упущенные слова покрытия — это ориентир для смыслового обогащения страницы, а не повод для механической спам-вставки в один абзац. Оптимизация текста строится по принципу нисходящего приоритета:
- Проверить верхние группы (100% и 90%): если в них есть пропуски, определите, какие слова относятся к теме и предложению страницы. Добавьте подходящую информацию в H1, вводный текст, подзаголовки или другие содержательные блоки.
- Разобрать группы 80% и 70%: проверьте, не упущены ли характеристики, способы выбора или условия покупки. Распределяйте подходящие слова вместе с полезной информацией по функциональным зонам страницы:
- В подзаголовки
H2–H3и названия контентных секций; - В параметры фасетных фильтров каталога и строки таблиц технических характеристик;
- В описания товарных позиций, блоки преимуществ или сервисные разделы (доставка, гарантия, варианты оплаты).
- Выборочно использовать группы 60%–40%: не пытайтесь внедрить абсолютно все слова из нижней границы. Отбирайте только те леммы, которые соответствуют фактическому ассортименту и бизнес-модели вашего сайта.
- Передать в ТЗ для копирайтера: нажмите «Сгенерировать ТЗ» и выберите шаблон с нужными группами покрытия. В требования tz.md и validate.md попадут группы, включённые в шаблоне. Например, «Лайт» использует покрытие 70–100%. Подробнее — в руководстве по генерации ТЗ.
Частые вопросы
В чём разница между блоком «Покрытие» и блоком «Слова запросов кластера»?
«Покрытие» анализирует тексты документов конкурентов из топа выдачи (SERP) и считает процент сайтов, в которых встречается слово (Document Frequency). Блок «Слова запросов кластера» анализирует сами поисковые запросы кластера и считает долю слова от их суммарной частотности Wordstat. Покрытие показывает лексический стандарт документов выдачи, а Слова запросов — формулировки поискового спроса пользователей.
Почему диапазон покрытия ограничен 40% и нет корзин 30%, 20% или 10%?
Для этого блока задан порог 40% документов топа. Слова с меньшей встречаемостью не попадают в показываемый словарь. Уместность слов любой группы зависит от темы и содержания вашей страницы.
Почему в блоке «Упущенная семантика» могут отсутствовать корзины 100% или 90%?
Если посадочная страница уже содержит все слова из этих групп топа, пустые корзины в списке упущенных слов скрываются. Система сразу фокусирует внимание на тех диапазонах, где у страницы есть реальный дефицит лексики.
Учитываются ли формы слов (падежи, окончания, числа)?
Все слова приводятся к словарным основам (леммам) с исключением стоп-слов, союзов и предлогов. Если на странице использована любая грамматическая форма слова (другое число или падеж), лемматизатор сопоставит её с основой, и слово не будет ошибочно отмечено как упущенное.
Что отображается в блоке, если посадочная страница ещё не создана или не привязана?
Секция «Семантика корпуса» работает в обычном режиме и позволяет изучить словарь документов топа до написания текста. В секции «Упущенная семантика» при этом выводится статус «Нет данных по упущенной семантике».
Передаются ли упущенные слова покрытия в модуль генерации технического задания?
В ТЗ и проверочные требования попадают группы покрытия, включённые в выбранном шаблоне. Например, «Лайт» использует группы 70–100%. Нажмите «Сгенерировать ТЗ» и выберите шаблон с нужными группами.