Тонкий контент в WordPress — это не только короткие тексты. Чаще проблема возникает на страницах архивов, тегов, авторов, служебных шаблонов, пустых результатов поиска и посадочных страниц, где полезной информации меньше, чем технического шума. Такие URL обычно не дают ценности пользователю, но продолжают индексироваться и размывают качество сайта.
Ниже — рабочая схема: как найти такие страницы, как решить вопрос без массового удаления всего подряд и как проверить, что после правок сайт не потерял нужные страницы.
Когда страница считается проблемной
Не стоит ориентироваться только на количество слов. Для WordPress важнее сочетание признаков: страница индексируется, получает внутренние ссылки, но почти не отвечает на запрос пользователя. Это типично для:
- архивов тегов с 1–2 записями;
- страниц авторов без описания и без уникальной ценности;
- пагинации, где на второй и следующих страницах мало контента;
- результатов внутреннего поиска;
- служебных страниц, которые попали в карту сайта или в выдачу по ошибке;
- кастомных типов записей с пустыми полями и шаблоном без текста.
Если страница нужна пользователю, но выглядит бедно, сначала исправляют шаблон или наполнение. Если страница не нужна ни пользователю, ни поиску, её закрывают от индексации или убирают из обхода.
Диагностика: где искать тонкие страницы
Начинать лучше не с robots.txt, а с фактов. Сначала соберите список URL, которые уже есть в индексе или активно обходятся ботами. Для этого подойдут отчёты Google Search Console, серверные логи, карта сайта и выборочная проверка шаблонов.
Что смотреть в первую очередь
- страницы с малым числом кликов и показов, но высоким числом URL в отчёте;
- архивы таксономий, которые создаются автоматически;
- страницы с одинаковыми title и H1;
- URL без основного текста, где на странице только список записей;
- страницы, которые возвращают 200 OK, хотя фактически не несут пользы.
Если у вас есть доступ к базе, можно быстро найти архивы и таксономии с малым количеством записей. Это не готовый аудит, но хороший старт для ручной проверки:
SELECT t.term_id, t.name, tt.taxonomy, COUNT(tr.object_id) AS posts_count
FROM wp_terms t
JOIN wp_term_taxonomy tt ON tt.term_id = t.term_id
LEFT JOIN wp_term_relationships tr ON tr.term_taxonomy_id = tt.term_taxonomy_id
GROUP BY t.term_id, t.name, tt.taxonomy
HAVING COUNT(tr.object_id) <= 2
ORDER BY posts_count ASC, t.name ASC;Запрос помогает увидеть таксономии, которые почти не содержат материалов. Дальше уже решаете: объединять, дополнять или закрывать.
Что делать с каждой группой страниц
Универсального решения нет. Для разных типов страниц логика разная: где-то нужен редизайн шаблона, где-то — noindex, где-то — удаление с редиректом.
| Сценарий | Что делать | Компромисс |
|---|---|---|
| Архив тега с 1 записью | Объединить с другим тегом или закрыть от индексации | Потеря отдельной страницы тега |
| Авторский архив без описания | Добавить биографию, ссылки на материалы, фото | Нужно поддерживать контент |
| Результаты поиска | Закрыть от индексации и убрать из sitemap | Не будет попадать в поиск |
| Пустая посадочная страница | Удалить или сделать 301 на релевантную страницу | Нужен контроль ссылок |
Вариант 1: улучшить страницу, а не прятать её
Если страница полезна по смыслу, но выглядит бедно, добавьте уникальный блок: описание категории, FAQ, подборку материалов, навигацию по теме. Для архивов это часто лучше, чем noindex. Поисковик видит, что страница не пустая, а пользователь получает ориентир.
Пример для шаблона категории:
<?php if ( is_category() && category_description() ) : ?>
<div class="archive-description">
<?php echo wp_kses_post( category_description() ); ?>
</div>
<?php endif; ?>Если описание уже есть, но его никто не заполняет, лучше сделать это обязательной частью редакционного процесса, а не надеяться на автоматическую генерацию.
Вариант 2: закрыть от индексации технические страницы
Для страниц поиска, пагинации служебных архивов и некоторых фильтров обычно достаточно noindex, follow. Это не удаляет страницу из обхода, но убирает её из индекса. Важно не путать это с блокировкой в robots.txt: если бот не может зайти на страницу, он не увидит мета-тег и не обработает её корректно.
На уровне WordPress можно добавить мета-robots для конкретных шаблонов:
<?php
add_action( 'wp_head', function () {
if ( is_search() || is_author() && ! get_the_author_meta( 'description' ) ) {
echo '<meta name="robots" content="noindex,follow" />' . "\n";
}
}, 1 );Этот пример стоит применять аккуратно. Авторские архивы не всегда нужно закрывать: если у автора есть нормальная биография и подборка статей, страница может быть полезной.
Вариант 3: удалить и сделать редирект
Если страница не имеет ценности и на неё есть внешние или внутренние ссылки, лучше удалить её с 301-редиректом на ближайший релевантный URL. Это безопаснее, чем оставлять пустую страницу с 200 OK.
Для простого редиректа в теме или мини-плагине:
<?php
add_action( 'template_redirect', function () {
if ( is_page( 123 ) ) {
wp_redirect( home_url( '/relevant-page/' ), 301 );
exit;
}
} );Число 123 замените на ID страницы. Не используйте такой код массово без списка URL: сначала проверьте, что целевая страница действительно соответствует смыслу старой.
Пошаговый план внедрения
- Соберите список URL из Search Console, sitemap и логов.
- Разделите страницы на три группы: улучшить, закрыть, удалить.
- Проверьте шаблоны архивов, поиска, автора, таксономий и пагинации.
- Для нужных страниц добавьте контентные блоки и внутренние ссылки.
- Для технических страниц настройте
noindexи уберите их из sitemap. - Для удаляемых URL настройте 301-редиректы на релевантные страницы.
- После публикации изменений проверьте статус индексации и ответы сервера.
Как проверить, что решение сработало
Проверка нужна не только в браузере. Смотрите на три уровня: HTML, ответ сервера и поведение в индексации.
- Откройте страницу и убедитесь, что в коде есть нужный
meta robotsили что шаблон действительно содержит добавленный контент. - Проверьте HTTP-статус: удалённая страница должна отдавать 301, а не 200.
- Посмотрите карту сайта: технические URL не должны там оставаться.
- В Search Console отправьте страницу на повторную проверку, если меняли индексацию.
Для быстрой проверки заголовков можно использовать:
curl -I https://example.com/search/test/Если вы ожидаете редирект, в ответе должен быть 301 и заголовок Location. Если закрываете страницу от индексации, убедитесь, что она всё ещё доступна для обхода и не заблокирована на уровне robots.txt.
Частые ошибки и как их исправить
Закрывают в robots.txt то, что нужно было убрать из индекса
Это типичная ошибка. Если страница уже в индексе, одной блокировки обхода мало. Сначала дайте поисковику увидеть noindex или сделайте редирект, а потом уже при необходимости ограничивайте обход.
Ставят noindex на полезные страницы
Иногда под раздачу попадают категории, которые реально приводят трафик. Перед закрытием проверьте, есть ли у страницы поисковые показы, входящие ссылки и смысл для навигации.
Удаляют страницу без редиректа
Если на URL уже есть ссылки, 404 без плана — плохой вариант. Для старых посадочных страниц и материалов лучше 301 на ближайшую релевантную страницу.
Оставляют пустые архивы в sitemap
Если архив не нужен, уберите его из карты сайта. Иначе вы сами подсказываете поисковику, что страница важна, хотя на деле она не несёт ценности.
Что важно для безопасности и производительности
Когда вы правите шаблоны и добавляете условия в functions.php, не раздувайте тему лишней логикой. Лучше вынести изменения в маленький плагин или mu-plugin, чтобы не потерять их при обновлении темы.
Если на сайте много архивов и фильтров, следите за тем, чтобы не плодить новые URL с одинаковым содержимым. Иначе проблема тонкого контента быстро превращается в проблему дублей и лишней нагрузки на обход.
Для крупных сайтов полезно периодически пересматривать:
- пустые категории и теги;
- авторские архивы без наполнения;
- страницы поиска;
- пагинацию архивов;
- кастомные таксономии, которые создаются автоматически, но не заполняются.
Если нужен более жёсткий контроль над дублями и техническими страницами, часть задач можно закрыть через Clearfy Pro, но только как инструмент для настройки, а не как замену аудиту. Сначала определите, какие URL реально мешают, и только потом меняйте правила индексации.