Архивы авторов и дат часто остаются в индексе по умолчанию, хотя для небольших сайтов они редко дают полезный трафик. Проблема обычно не в самом наличии этих страниц, а в том, что поисковик начинает считать их отдельными посадочными, а контент на них дублирует записи и рубрики. Если на сайте один автор или архивы дат пустые, их лучше либо закрыть от индексации, либо отдать 404/410 в зависимости от структуры проекта.
Ниже — рабочий сценарий без выдуманных хуков: сначала разберём, как понять, что именно индексируется, затем покажу два способа решения — через SEO-плагин и через код. Отдельно разберём, как проверить результат и какие ошибки чаще всего ломают настройку.
Когда архивы авторов и дат становятся проблемой
Сами по себе архивы не вредят. Вред начинается, когда:
- на сайте один автор, и архив автора дублирует главную ленту;
- архивы дат пустые или содержат слишком мало материалов;
- в архиве автора выводятся те же анонсы, что и на главной, без уникального текста;
- поисковик индексирует много служебных страниц вместо полезных материалов;
- в sitemap попадают URL, которые вы не хотите продвигать.
Если у вас новостной проект или блог с сильной исторической структурой, архивы дат могут быть полезны. Но для большинства корпоративных сайтов и экспертных блогов это лишние страницы, которые лучше убрать из индекса и не тратить на них краулинговый бюджет.
Диагностика: что именно сейчас индексируется
Перед правкой проверьте, как WordPress и SEO-плагин отдают архивы. Откройте в браузере:
/author/имя-автора//2026/08/или другой архив даты, если он включён;- исходный код страницы и метатег
robots; - заголовки ответа сервера, если хотите проверить поведение без браузерных искажений.
Если на странице уже стоит noindex, но она всё равно попадает в индекс, обычно проблема в одном из трёх мест: страница доступна через sitemap, на неё есть внутренние ссылки, или SEO-плагин конфликтует с темой/кешем и отдаёт старую версию метатега.
Что проверить в первую очередь
- Есть ли на странице строка
<meta name="robots" content="noindex,follow">. - Не добавляет ли тема собственный
robots-метатег. - Не включены ли архивы в XML-sitemap.
- Не закрыты ли архивы только в robots.txt — этого недостаточно для удаления уже проиндексированных URL.
Способ 1: закрыть архивы через SEO-плагин
Если на сайте уже стоит Yoast SEO, Rank Math или похожий плагин, это самый безопасный путь. В большинстве случаев достаточно отключить индексацию архивов в настройках таксономий и архивов. Плюс этого подхода в том, что плагин сам корректно проставит noindex и уберёт URL из sitemap, если это предусмотрено настройками.
Но есть нюанс: в разных плагинах логика отличается. После изменения настроек обязательно проверьте исходный код страницы и sitemap, а не только галочку в админке.
| Подход | Плюсы | Минусы |
|---|---|---|
| SEO-плагин | Быстро, без кода, обычно корректно для sitemap | Зависит от конкретного плагина и его настроек |
| Код в теме/плагине | Точный контроль, не зависит от интерфейса | Нужно следить за обновлениями и местом размещения кода |
| robots.txt | Просто закрыть обход | Не убирает уже проиндексированные страницы |
Способ 2: закрыть архивы авторов и дат кодом
Если вы не используете SEO-плагин или хотите жёстко зафиксировать поведение, можно добавить фильтры в functions.php дочерней темы или в небольшой mu-plugin. Для архивов авторов и дат у WordPress есть стандартные условные теги, а у популярных SEO-плагинов — фильтры для robots-метатега.
Ниже пример для Yoast SEO. Он добавляет noindex,follow на архивы авторов и дат. Код не трогает отдельные записи и рубрики.
<?php
add_filter( 'wpseo_robots', function( $robots ) {
if ( is_author() || is_date() ) {
return 'noindex,follow';
}
return $robots;
} );Если у вас Rank Math, логика похожая, но фильтр другой. Для него можно использовать:
<?php
add_filter( 'rank_math/frontend/robots', function( $robots ) {
if ( is_author() || is_date() ) {
$robots['index'] = 'noindex';
$robots['follow'] = 'follow';
}
return $robots;
} );Такой вариант хорош тем, что поведение фиксируется на уровне кода. Но если SEO-плагин обновит внутреннюю логику, всё равно нужно перепроверить итоговый HTML.
Пошаговое решение без лишних побочных эффектов
- Определите, нужны ли архивы вообще. Если на сайте один автор и нет редакционной истории, архив автора почти всегда лишний.
- Выберите способ: через SEO-плагин или через код. Не смешивайте оба варианта без необходимости.
- Добавьте
noindex,followдля архивов авторов и дат. - Исключите эти URL из XML-sitemap, если плагин это не сделал автоматически.
- Очистите кеш страницы, объектный кеш и CDN, если они есть.
- Проверьте, что старые версии страниц не отдаются из кеша.
Если архивы лучше удалить совсем
Иногда noindex недостаточно. Если архивы пустые и на них нет внутренней ценности, можно вернуть 404 или 410. Это уже более жёсткий сценарий, и его стоит применять аккуратно: если на архивы есть внешние ссылки или они уже в индексе, сначала оцените последствия для переобхода и внутренних переходов.
Для большинства сайтов безопаснее начать с noindex,follow. Это даёт поисковику сигнал не индексировать страницу, но сохраняет переход по ссылкам внутри архива.
Проверка результата после внедрения
После правки не ограничивайтесь просмотром страницы в браузере. Проверьте три вещи:
- в исходном коде страницы есть
noindex,follow; - URL отсутствует в XML-sitemap;
- внутренний поиск по сайту и меню не ведут на архивы без необходимости.
Если у вас есть доступ к Google Search Console, откройте проверку URL и посмотрите, как робот видит страницу. Важно не только наличие метатега, но и то, не блокируется ли страница случайно в robots.txt раньше времени. Если URL уже был в индексе, удаление может занять время — это нормальное поведение.
Дополнительно можно проверить ответ сервера через curl:
curl -I https://example.com/author/admin/В ответе вы не увидите noindex, если он задаётся только в HTML, но сможете убедиться, что страница отдаёт корректный статус и не ломается редиректами.
Частые ошибки и как их исправить
Закрыли только в robots.txt
Это частая ошибка. Disallow мешает обходу, но не гарантирует удаление уже известного URL из индекса. Для индексации нужен именно noindex или корректный статус ответа, если страница должна исчезнуть полностью.
Оставили архивы в sitemap
Если URL продолжает попадать в sitemap, поисковик снова и снова будет его переоценивать. Проверьте настройки SEO-плагина и исключите архивы из карты сайта.
Поставили noindex, но кеш не обновили
После изменения шаблона или фильтра старый HTML может продолжать отдаваться из кеша. Очистите кеш плагина, серверный кеш и CDN, если он используется.
Сломали архивы для всех ролей и типов
Иногда код пишут слишком широко и случайно закрывают не только архивы авторов и дат, но и нужные страницы. Используйте точные условия is_author() и is_date(), не подменяйте их общими проверками.
Практические советы по безопасности и производительности
Если вы вносите код вручную, лучше не править functions.php основной темы. Используйте дочернюю тему или небольшой mu-plugin, чтобы не потерять изменения после обновления. Для сайтов с регулярной публикацией полезно держать логику индексации в одном месте: так проще понять, почему конкретный URL появился или исчез из выдачи.
Если на сайте много служебных архивов, имеет смысл проверить и соседние проблемы: страницы поиска, пагинацию, теги без контента, пустые авторские архивы. Но не закрывайте всё подряд — сначала смотрите на реальную структуру трафика и внутренние ссылки.
Для более глубокой чистки дублей и служебных страниц можно посмотреть на Clearfy Pro: https://wpshop.ru/plugins/clearfy. Но даже с плагином всё равно стоит понимать, какие URL вы закрываете и зачем.
Если после внедрения архивы всё ещё всплывают в индексе, не ищите магию в дополнительном плагине. Сначала проверьте HTML, sitemap, кеш и внутренние ссылки. В WordPress именно эта связка чаще всего и создаёт проблему.