Архивы авторов и дат часто создают в WordPress лишние URL: они дублируют контент, размывают релевантность и тянут в индекс страницы, которые не дают пользователю ничего нового. На небольшом блоге это может быть незаметно, но на сайте с несколькими авторами, регулярными публикациями и активной пагинацией такие архивы быстро превращаются в источник мусора для поисковиков.
Задача здесь не в том, чтобы «всё закрыть», а в том, чтобы убрать из индекса именно тонкие архивы и при этом не сломать навигацию, хлебные крошки и внутренние ссылки. Ниже — рабочий сценарий: как диагностировать проблему, что менять в WordPress и как проверить результат.
Когда архивы авторов и дат становятся проблемой
Сначала стоит понять, действительно ли эти страницы мешают. Не каждый архив нужно закрывать. Если у автора есть сильная тематическая страница с подборкой материалов, а архив даты используется как полезная навигация, решение может быть мягче. Но если в индексе уже есть страницы вида /author/ivan/ и /2024/08/, а на них по сути только список записей без уникального текста, это типичный кандидат на исключение.
Признаки, что архивы лучше убрать из индекса
- в Search Console появляются URL архивов с низкой кликабельностью и без трафика;
- в отчётах по страницам много URL с одинаковыми заголовками и описаниями;
- архивы авторов дублируют страницу «О авторе» или список публикаций;
- архивы дат не несут самостоятельной ценности и существуют только как техническая навигация;
- сайт получает много страниц с тонким контентом, но полезные статьи индексируются хуже.
Диагностика: что именно индексируется сейчас
Перед правками проверьте, как WordPress и SEO-плагин отдают мета-данные. Откройте архив автора и архив даты в браузере и посмотрите исходный код страницы. Если там уже стоит noindex, возможно, проблема не в WordPress, а в том, что поисковик ещё не переобходил сайт или в sitemap остались лишние URL.
Полезно проверить три вещи:
- есть ли архивы в XML sitemap;
- какой
robots metaотдает страница; - не ведут ли внутренние ссылки на архивы из меню, хлебных крошек или блоков «Автор».
Если у вас подключён SEO-плагин, сначала смотрите его настройки. Если плагина нет или нужна точечная логика, проще и надёжнее управлять индексированием через код.
Пошаговое решение через код
Ниже вариант без выдуманных зависимостей: мы отключаем индексацию архивов авторов и дат, а также убираем их из sitemap, если карта генерируется через стандартные механизмы WordPress или через SEO-плагин, который уважает фильтры WordPress.
1. Отдаём noindex для архивов авторов и дат
Добавьте код в functions.php дочерней темы или в свой мини-плагин. Он не ломает сам архив, а только просит поисковики не индексировать страницу.
<?php
add_filter( 'wp_robots', function( array $robots ) {
if ( is_author() || is_date() ) {
$robots['noindex'] = true;
$robots['nofollow'] = false;
$robots['max-image-preview'] = 'large';
}
return $robots;
} );Что здесь важно: мы не ставим nofollow без необходимости. Для архивов это обычно лишнее. Поисковик может пройти по ссылкам внутри страницы, но сам архив не должен попадать в индекс.
2. Убираем архивы из XML sitemap
Если карта сайта формируется WordPress или SEO-плагином с поддержкой фильтров, можно исключить типы архивов на уровне генерации. Для стандартного sitemap WordPress есть фильтр wp_sitemaps_add_provider, но он работает с провайдерами, а не с отдельными URL. Для практики чаще используют настройки SEO-плагина. Если нужен именно код, безопаснее не ломать генератор, а отключить сами архивы в логике темы или плагина.
Например, если архивы авторов вам не нужны вообще, можно скрыть их из публичной части и оставить только для админки и внутренних функций:
<?php
add_action( 'init', function() {
if ( ! is_admin() ) {
remove_action( 'template_redirect', 'redirect_canonical' );
}
} );Этот пример здесь не как готовое решение, а как напоминание: не пытайтесь «лечить» индексирование через агрессивные редиректы без понимания последствий. Для архивов лучше использовать noindex и настройки sitemap, а не массово ломать маршрутизацию.
3. Если используете SEO-плагин
В большинстве случаев проще отключить индексацию архивов в интерфейсе плагина. Это особенно удобно, если редакторы сами управляют сайтом и не должны править код. Важно только не смешивать несколько источников правил: если плагин ставит index, а тема — noindex, вы получите непредсказуемое поведение.
| Подход | Плюсы | Минусы |
|---|---|---|
| Настройка в SEO-плагине | Быстро, понятно редактору, без кода | Зависит от конкретного плагина и его логики |
Код через wp_robots | Точно, прозрачно, легко версионировать | Нужен контроль за темой/плагином и тестирование |
| Редирект архивов | Полностью убирает страницу из обхода | Может сломать навигацию и аналитику, не всегда нужен |
Как проверить, что решение сработало
После внедрения не ограничивайтесь просмотром страницы в браузере. Проверьте результат так, как это делает поисковик.
- Откройте архив автора и архив даты.
- Посмотрите исходный код и найдите
noindexв robots meta. - Проверьте HTTP-ответ и убедитесь, что страница отдается с кодом 200, если вы не делали редирект.
- Посмотрите XML sitemap и убедитесь, что лишние архивы туда не попадают.
- В Search Console отправьте страницу на переобход, если она уже была в индексе.
Если архивы уже были проиндексированы, удаление из индекса не происходит мгновенно. Поисковику нужно увидеть новый сигнал несколько раз. Это нормальная задержка, а не ошибка в коде.
Частые ошибки и как их исправить
Ставят noindex только в robots.txt
Это распространённая ошибка. robots.txt управляет обходом, но не гарантирует исключение из индекса, если URL уже известен поисковику. Для архивов нужен именно noindex в HTML-ответе или через заголовки, а не только запрет в robots.
Закрывают архивы редиректом на главную
Так делают, когда хотят «быстро убрать всё лишнее». В итоге пользователь теряет навигацию, а поисковик получает неочевидную структуру сайта. Для архивов это обычно плохая идея: лучше оставить страницу доступной, но не индексируемой.
Оставляют архивы в sitemap
Даже если на странице стоит noindex, лишний URL в sitemap продолжает сигнализировать поисковику, что страница важна. В результате переобход затягивается, а отчёты становятся шумными. После настройки проверьте карту сайта отдельно.
Путают архивы авторов с полезными страницами
Если у вас на сайте есть сильные авторские страницы с биографией, списком публикаций и уникальным текстом, не закрывайте их автоматически. Сначала оцените, есть ли у страницы самостоятельная ценность. Иногда лучше доработать шаблон архива, чем прятать его от индекса.
Практические советы по безопасности и производительности
Любая правка, связанная с индексированием, должна быть предсказуемой. Не вносите такие изменения прямо в родительскую тему: после обновления они потеряются. Используйте дочернюю тему или небольшой mu-plugin. Это проще сопровождать и легче откатить.
Если сайт большой, не перегружайте логику условными проверками в каждом шаблоне. Один фильтр wp_robots обычно лучше, чем десяток разрозненных правок в шаблонах архивов. Так меньше шансов получить конфликт с темой или SEO-плагином.
Для сайтов, где одновременно нужно чистить дубли, архивы и служебные страницы, имеет смысл централизовать техническую SEO-логику. Если нужен инструмент без ручной сборки кода, можно посмотреть в сторону Clearfy Pro: https://wpshop.ru/plugins/clearfy. Но даже в этом случае полезно понимать, какие именно страницы вы закрываете и почему.
Когда лучше не закрывать архивы полностью
Иногда архивы дат полезны новостным сайтам, где пользователь реально ищет материалы за конкретный период. Архивы авторов тоже могут работать как витрина экспертизы, если у каждого автора есть своя тема и регулярные публикации. В таких случаях не спешите ставить массовый noindex. Сначала проверьте, можно ли улучшить шаблон: добавить описание, уникальный заголовок, блок с лучшими материалами и нормальную пагинацию.
Если же архив — это просто техническая страница без ценности, закрыть её от индексации намного разумнее, чем пытаться «дотянуть» её до полноценной посадочной страницы.