Как найти и убрать страницы с тонким контентом в WordPress

Тонкий контент в WordPress — это не только короткие тексты. Чаще проблема возникает на страницах архивов, тегов, авторов, служебных шаблонов, пустых результатов поиска и посадочных страниц, где полезной информации меньше, чем технического шума. Такие URL обычно не дают ценности пользователю, но продолжают индексироваться и размывают качество сайта.

Ниже — рабочая схема: как найти такие страницы, как решить вопрос без массового удаления всего подряд и как проверить, что после правок сайт не потерял нужные страницы.

Когда страница считается проблемной

Не стоит ориентироваться только на количество слов. Для WordPress важнее сочетание признаков: страница индексируется, получает внутренние ссылки, но почти не отвечает на запрос пользователя. Это типично для:

  • архивов тегов с 1–2 записями;
  • страниц авторов без описания и без уникальной ценности;
  • пагинации, где на второй и следующих страницах мало контента;
  • результатов внутреннего поиска;
  • служебных страниц, которые попали в карту сайта или в выдачу по ошибке;
  • кастомных типов записей с пустыми полями и шаблоном без текста.

Если страница нужна пользователю, но выглядит бедно, сначала исправляют шаблон или наполнение. Если страница не нужна ни пользователю, ни поиску, её закрывают от индексации или убирают из обхода.

Диагностика: где искать тонкие страницы

Начинать лучше не с robots.txt, а с фактов. Сначала соберите список URL, которые уже есть в индексе или активно обходятся ботами. Для этого подойдут отчёты Google Search Console, серверные логи, карта сайта и выборочная проверка шаблонов.

Что смотреть в первую очередь

  • страницы с малым числом кликов и показов, но высоким числом URL в отчёте;
  • архивы таксономий, которые создаются автоматически;
  • страницы с одинаковыми title и H1;
  • URL без основного текста, где на странице только список записей;
  • страницы, которые возвращают 200 OK, хотя фактически не несут пользы.

Если у вас есть доступ к базе, можно быстро найти архивы и таксономии с малым количеством записей. Это не готовый аудит, но хороший старт для ручной проверки:

SELECT t.term_id, t.name, tt.taxonomy, COUNT(tr.object_id) AS posts_count
FROM wp_terms t
JOIN wp_term_taxonomy tt ON tt.term_id = t.term_id
LEFT JOIN wp_term_relationships tr ON tr.term_taxonomy_id = tt.term_taxonomy_id
GROUP BY t.term_id, t.name, tt.taxonomy
HAVING COUNT(tr.object_id) <= 2
ORDER BY posts_count ASC, t.name ASC;

Запрос помогает увидеть таксономии, которые почти не содержат материалов. Дальше уже решаете: объединять, дополнять или закрывать.

Что делать с каждой группой страниц

Универсального решения нет. Для разных типов страниц логика разная: где-то нужен редизайн шаблона, где-то — noindex, где-то — удаление с редиректом.

СценарийЧто делатьКомпромисс
Архив тега с 1 записьюОбъединить с другим тегом или закрыть от индексацииПотеря отдельной страницы тега
Авторский архив без описанияДобавить биографию, ссылки на материалы, фотоНужно поддерживать контент
Результаты поискаЗакрыть от индексации и убрать из sitemapНе будет попадать в поиск
Пустая посадочная страницаУдалить или сделать 301 на релевантную страницуНужен контроль ссылок

Вариант 1: улучшить страницу, а не прятать её

Если страница полезна по смыслу, но выглядит бедно, добавьте уникальный блок: описание категории, FAQ, подборку материалов, навигацию по теме. Для архивов это часто лучше, чем noindex. Поисковик видит, что страница не пустая, а пользователь получает ориентир.

Пример для шаблона категории:

<?php if ( is_category() && category_description() ) : ?>
  <div class="archive-description">
    <?php echo wp_kses_post( category_description() ); ?>
  </div>
<?php endif; ?>

Если описание уже есть, но его никто не заполняет, лучше сделать это обязательной частью редакционного процесса, а не надеяться на автоматическую генерацию.

Вариант 2: закрыть от индексации технические страницы

Для страниц поиска, пагинации служебных архивов и некоторых фильтров обычно достаточно noindex, follow. Это не удаляет страницу из обхода, но убирает её из индекса. Важно не путать это с блокировкой в robots.txt: если бот не может зайти на страницу, он не увидит мета-тег и не обработает её корректно.

На уровне WordPress можно добавить мета-robots для конкретных шаблонов:

<?php
add_action( 'wp_head', function () {
    if ( is_search() || is_author() && ! get_the_author_meta( 'description' ) ) {
        echo '<meta name="robots" content="noindex,follow" />' . "\n";
    }
}, 1 );

Этот пример стоит применять аккуратно. Авторские архивы не всегда нужно закрывать: если у автора есть нормальная биография и подборка статей, страница может быть полезной.

Вариант 3: удалить и сделать редирект

Если страница не имеет ценности и на неё есть внешние или внутренние ссылки, лучше удалить её с 301-редиректом на ближайший релевантный URL. Это безопаснее, чем оставлять пустую страницу с 200 OK.

Для простого редиректа в теме или мини-плагине:

<?php
add_action( 'template_redirect', function () {
    if ( is_page( 123 ) ) {
        wp_redirect( home_url( '/relevant-page/' ), 301 );
        exit;
    }
} );

Число 123 замените на ID страницы. Не используйте такой код массово без списка URL: сначала проверьте, что целевая страница действительно соответствует смыслу старой.

Пошаговый план внедрения

  1. Соберите список URL из Search Console, sitemap и логов.
  2. Разделите страницы на три группы: улучшить, закрыть, удалить.
  3. Проверьте шаблоны архивов, поиска, автора, таксономий и пагинации.
  4. Для нужных страниц добавьте контентные блоки и внутренние ссылки.
  5. Для технических страниц настройте noindex и уберите их из sitemap.
  6. Для удаляемых URL настройте 301-редиректы на релевантные страницы.
  7. После публикации изменений проверьте статус индексации и ответы сервера.

Как проверить, что решение сработало

Проверка нужна не только в браузере. Смотрите на три уровня: HTML, ответ сервера и поведение в индексации.

  • Откройте страницу и убедитесь, что в коде есть нужный meta robots или что шаблон действительно содержит добавленный контент.
  • Проверьте HTTP-статус: удалённая страница должна отдавать 301, а не 200.
  • Посмотрите карту сайта: технические URL не должны там оставаться.
  • В Search Console отправьте страницу на повторную проверку, если меняли индексацию.

Для быстрой проверки заголовков можно использовать:

curl -I https://example.com/search/test/

Если вы ожидаете редирект, в ответе должен быть 301 и заголовок Location. Если закрываете страницу от индексации, убедитесь, что она всё ещё доступна для обхода и не заблокирована на уровне robots.txt.

Частые ошибки и как их исправить

Закрывают в robots.txt то, что нужно было убрать из индекса

Это типичная ошибка. Если страница уже в индексе, одной блокировки обхода мало. Сначала дайте поисковику увидеть noindex или сделайте редирект, а потом уже при необходимости ограничивайте обход.

Ставят noindex на полезные страницы

Иногда под раздачу попадают категории, которые реально приводят трафик. Перед закрытием проверьте, есть ли у страницы поисковые показы, входящие ссылки и смысл для навигации.

Удаляют страницу без редиректа

Если на URL уже есть ссылки, 404 без плана — плохой вариант. Для старых посадочных страниц и материалов лучше 301 на ближайшую релевантную страницу.

Оставляют пустые архивы в sitemap

Если архив не нужен, уберите его из карты сайта. Иначе вы сами подсказываете поисковику, что страница важна, хотя на деле она не несёт ценности.

Что важно для безопасности и производительности

Когда вы правите шаблоны и добавляете условия в functions.php, не раздувайте тему лишней логикой. Лучше вынести изменения в маленький плагин или mu-plugin, чтобы не потерять их при обновлении темы.

Если на сайте много архивов и фильтров, следите за тем, чтобы не плодить новые URL с одинаковым содержимым. Иначе проблема тонкого контента быстро превращается в проблему дублей и лишней нагрузки на обход.

Для крупных сайтов полезно периодически пересматривать:

  • пустые категории и теги;
  • авторские архивы без наполнения;
  • страницы поиска;
  • пагинацию архивов;
  • кастомные таксономии, которые создаются автоматически, но не заполняются.

Если нужен более жёсткий контроль над дублями и техническими страницами, часть задач можно закрыть через Clearfy Pro, но только как инструмент для настройки, а не как замену аудиту. Сначала определите, какие URL реально мешают, и только потом меняйте правила индексации.

Как закрыть от индексации страницы авторов WordPress без потери полезных архивов
15.09.2026
Как отлаживать и анализировать запросы в WordPress с помощью WPData
23.09.2026
Как закрыть технические страницы WordPress от индексации через robots.txt и мета-теги
24.08.2026
Как использовать WPRemark для эффективного управления комментариями в WordPress
23.09.2026
Как создать эффективный индекс по метаданным в WordPress для ускорения запросов
23.09.2026