На небольшом сайте архивы категорий, тегов, дат и авторов часто выглядят безобидно. На практике именно они создают лишние страницы, которые дублируют друг друга по заголовкам, сниппетам и спискам записей. Если сайт уже индексируется, а в Search Console появляются страницы с низкой ценностью, сначала стоит проверить не контент, а структуру архивов.
Задача здесь не в том, чтобы «всё закрыть». Нужно оставить полезные страницы, а мусорные — убрать из индекса или вообще не генерировать. Для WordPress это обычно решается комбинацией настроек SEO-плагина, правок темы и, если нужно, небольшого кода.
Какие архивы чаще всего дают дубли
В WordPress дубли обычно появляются не из-за одной ошибки, а из-за набора мелких решений. Например, одна и та же запись доступна через категорию, тег, автора и дату. Если на архивных страницах выводится одинаковый список постов без уникального текста, поисковик видит несколько почти одинаковых страниц.
Типовые источники проблемы
- архивы тегов, где один тег повторяет категорию по смыслу;
- архивы авторов на сайтах с одним автором;
- архивы дат, которые не несут пользы пользователю;
- страницы пагинации, если они индексируются без необходимости;
- страницы вложений медиафайлов, которые дублируют контент записи;
- служебные таксономии и CPT-архивы без уникального наполнения.
Если у вас уже есть SEO-плагин, часть этих страниц может быть закрыта автоматически. Но на практике настройки часто меняют частично: теги закрыты, авторы открыты, вложения забыты, а пагинация остаётся индексируемой. Поэтому сначала нужна диагностика.
Диагностика проблемы: что проверить до изменений
Не начинайте с массового noindex. Сначала посмотрите, какие URL реально попали в индекс и какие из них приносят трафик. Иногда архив автора или тегов полезен, если на сайте много материалов и есть нормальная навигация.
Быстрый чек-лист
- в Search Console откройте отчёт по страницам и найдите архивы с низкими показами;
- проверьте, есть ли у архивов уникальные title и description;
- посмотрите исходный код страницы: есть ли
meta robots; - сравните канонический URL на архиве и на записи;
- проверьте, не индексируются ли страницы вложений;
- посмотрите, не создаёт ли тема отдельные шаблоны для тегов, авторов и дат без контента.
Если нужно быстро увидеть, как WordPress отдаёт архивы, можно проверить заголовки и каноникал прямо в браузере или через curl:
curl -I https://example.com/tag/wordpress/Ищите не только статус 200, но и то, что реально отдаёт тема или SEO-плагин в HTML. Для этого удобнее смотреть исходник страницы и искать robots и canonical.
Пошаговое решение: как убрать дубли без лишнего риска
Лучший порядок действий — сначала закрыть самые бесполезные архивы, затем привести в порядок вложения и пагинацию, а после этого проверить, не сломались ли важные страницы.
Шаг 1. Оставьте только те архивы, которые реально нужны
Если сайт ведётся одним автором, архив автора обычно не нужен. Если теги используются формально и дублируют категории, их тоже лучше закрыть. Даты почти всегда бесполезны для контентных проектов, если у вас не новостной формат.
В SEO-плагине это обычно настраивается без кода. Если у вас установлен Clearfy Pro, там есть инструменты для чистки сайта и удаления дублей; для таких задач это часто быстрее, чем править шаблоны вручную. Но даже с плагином важно понимать, что именно вы отключаете, а не просто нажимать все переключатели подряд.
Шаг 2. Закройте архивы от индексации, а не ломайте их
Если архив нужен пользователю, но не нужен поиску, используйте noindex,follow. Тогда страница останется доступной для навигации, но не будет конкурировать с основными материалами.
Для кастомной логики в теме или плагине можно добавить фильтр в functions.php или в мини-плагин. Пример ниже закрывает архивы тегов, авторов и дат от индексации, если вы не хотите делать это через SEO-плагин:
add_filter('wp_robots', function( $robots ) {
if ( is_tag() || is_author() || is_date() ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
});Это рабочий вариант для современных версий WordPress, где используется фильтр wp_robots. Но если SEO-плагин уже управляет robots meta, не дублируйте логику в коде: получите конфликт и непредсказуемый результат.
Шаг 3. Уберите страницы вложений с отдельного URL
Страницы медиафайлов часто индексируются как пустые или почти пустые страницы. Если они не нужны как отдельные посадочные, лучше редиректить вложения на сам файл или на родительскую запись.
В WordPress это можно сделать через фильтр:
add_filter('attachment_template', function( $template ) {
if ( is_attachment() ) {
wp_redirect( wp_get_attachment_url( get_queried_object_id() ), 301 );
exit;
}
return $template;
});Но такой подход стоит применять аккуратно: если у вас есть библиотека изображений, где страницы вложений используются как отдельные посадочные, редирект может быть лишним. В большинстве контентных сайтов это всё же полезная чистка.
Шаг 4. Проверьте пагинацию архивов
Пагинация сама по себе не проблема. Проблема начинается, когда страницы /page/2/, /page/3/ и дальше индексируются как отдельные слабые документы без ценности. Если архивы не нужны для поиска, обычно достаточно закрыть их через robots meta вместе с основным архивом.
Если же архив важен, убедитесь, что на страницах пагинации есть нормальные title, а canonical не указывает на первую страницу без причины. Это особенно важно для тем, которые генерируют одинаковые заголовки на всех страницах архива.
Когда лучше решить задачу через плагин, а когда через код
У каждого подхода есть свой компромисс. Плагин быстрее в настройке, код точнее в логике. Если сайт типовой, SEO-плагин обычно закрывает 80% задачи. Если у вас кастомная тема, несколько типов записей и нестандартные архивы, код даёт больше контроля.
| Подход | Когда подходит | Минус |
|---|---|---|
| SEO-плагин | типовой сайт, нужно быстро закрыть теги, авторов, даты | меньше гибкости, возможны конфликты настроек |
| Код в теме/плагине | кастомные архивы, точечные правила для CPT и таксономий | нужно тестировать после обновлений |
| Комбинация | часть архивов закрыта плагином, часть — кодом | важно не задублировать логику |
Если вы используете Clearfy Pro, его удобно брать как слой для чистки типовых дублей и служебных страниц. А точечные исключения уже добирать кодом. Такой подход обычно безопаснее, чем пытаться всё решить одной функцией.
Как проверить, что решение сработало
Проверка нужна не только в браузере, но и в индексации. После изменений не ограничивайтесь тем, что страница открывается. Смотрите, что именно видит поисковик.
Что проверить вручную
- в исходном коде архивов появился
noindexтам, где он нужен; - канонический URL указывает на правильную страницу;
- страницы вложений больше не доступны как отдельные посадочные;
- внутренние ссылки не ведут на закрытые архивы как на важные страницы;
- в Search Console новые URL не появляются как «Просканировано, но не проиндексировано» из-за мусорных архивов.
Полезно сравнить несколько страниц: главную категорию, тег, автора и пагинацию. Если у всех одинаковый title и description, это уже сигнал, что шаблон темы нужно доработать.
Для быстрой проверки robots meta можно использовать простой поиск по исходнику:
curl -s https://example.com/tag/wordpress/ | grep -i robotsЕсли у вас нет доступа к серверу, откройте страницу в браузере и посмотрите исходный код. Главное — не путать визуальное отображение с тем, что реально отдано в HTML.
Частые ошибки и как их исправить
Самая распространённая ошибка — закрыть от индексации всё подряд. После этого сайт теряет полезные точки входа, а внутренние ссылки начинают вести в пустоту.
Ошибка 1. Закрыли теги, но оставили архивы автора и даты
В результате дубли не исчезают, а просто меняют форму. Проверьте все архивные типы вместе, а не по одному.
Ошибка 2. Добавили noindex в код и одновременно включили настройку в SEO-плагине
Так можно получить конфликт, особенно если плагин переписывает robots meta после темы. Оставьте один источник правды: либо плагин, либо код.
Ошибка 3. Удалили архив, но не сделали редирект или нормальную страницу-замену
Если архив уже имел внешние ссылки или внутренний трафик, просто удалить его — плохая идея. В таком случае настройте 301 на релевантную категорию или оставьте страницу доступной с noindex.
Ошибка 4. Отключили страницы вложений, но забыли про медиа-ссылки в контенте
Если изображения в статьях ведут на пустые attachment pages, пользователь попадает не туда. Проверьте, как вставляются медиафайлы в редакторе и не создаёт ли тема отдельные ссылки на вложения.
Практические советы по безопасности и производительности
Чистка дублей влияет не только на SEO, но и на поддержку сайта. Чем меньше лишних шаблонов и архивов, тем проще обновлять тему и меньше риск случайно сломать навигацию.
- не правьте
functions.phpнапрямую на боевом сайте, если можно вынести код в мини-плагин; - после изменений очистите кеш страницы и, если есть, объектный кеш;
- не закрывайте архивы без проверки внутренних ссылок из меню, хлебных крошек и блоков похожих записей;
- если используете несколько SEO- и кеш-плагинов, проверьте, кто именно генерирует canonical и robots;
- после обновления темы повторно проверьте шаблоны архивов и страницы вложений.
Если задача повторяется на нескольких проектах, имеет смысл стандартизировать решение: один набор правил для архивов, один для вложений, один для пагинации. Тогда вы не будете каждый раз ловить одни и те же дубли вручную.
Когда нужно быстро убрать типовые дубли и подчистить служебные страницы, удобнее начать с настроек SEO-плагина или инструмента вроде Clearfy Pro, а уже потом дополнять логику кодом под конкретную тему и структуру сайта. Так проще сохранить контроль над индексацией и не перегрузить сайт лишними правками.