Как запретить индексацию архивов дат в WordPress: рабочие способы без дублей

Архивы по датам в WordPress часто остаются включёнными по умолчанию, хотя на большинстве сайтов они не несут отдельной ценности для поиска. В результате в индекс попадают страницы вида /2024/05/ или /2024/05/12/, которые дублируют логику рубрик, тегов и ленты записей. Если у сайта уже есть проблемы с дублями, каноникалами или размыванием краулингового бюджета, архивы дат обычно стоит либо закрыть от индексации, либо убрать из sitemap и навигации.

Ниже — не абстрактная теория, а рабочие варианты: через SEO-плагин, через код и через robots.txt. Для каждого способа есть диагностика, проверка и типовые ошибки.

Когда архивы дат действительно мешают

Не стоит отключать всё подряд только потому, что архив существует. Сначала проверьте, как он используется на сайте. Архивы дат имеют смысл, если вы ведёте новостной проект, где пользователь реально ищет публикации по периоду. Во всех остальных случаях они часто создают лишние URL без самостоятельного контента.

Признаки, что архивы лучше закрыть

  • в поиске уже есть страницы архивов дат, но они не дают трафик;
  • в sitemap попадают URL, которые не нужны пользователю;
  • в выдаче встречаются дубли с похожими сниппетами;
  • на сайте много коротких записей, и архивы дат собирают слабые страницы;
  • в логах краулера видно, что бот регулярно ходит по пустым или малоценным архивам.

Что проверить перед изменениями

  • есть ли у темы или плагина отдельная настройка для архивов дат;
  • не используются ли эти архивы в хлебных крошках или внутренних ссылках;
  • не завязаны ли на них рекламные блоки, фильтры или виджеты;
  • есть ли в sitemap URL архивов дат;
  • не закрыты ли они уже через noindex или robots.txt.

Диагностика: где именно появляется проблема

Сначала откройте архив даты в браузере и посмотрите исходный код страницы. Если в <head> уже есть meta name="robots" content="noindex, follow", значит задача частично решена и проблема может быть в sitemap или внутренних ссылках. Если такого тега нет, архив может индексироваться как обычная страница.

Полезно проверить ещё три места:

  1. XML sitemap — есть ли там архивы дат.
  2. robots.txt — не закрыт ли путь слишком грубо, если вам нужен только запрет индексации, а не обхода.
  3. Search Console — есть ли уже проиндексированные архивы и как они отмечены.

Если архивы дат уже в индексе, одного robots.txt может быть недостаточно: бот перестанет обходить страницу, но старый URL может ещё долго висеть в выдаче без обновления статуса. Для таких случаев надёжнее noindex на самой странице плюс удаление из sitemap.

Способ 1: отключить индексацию через SEO-плагин

Если на сайте стоит Yoast SEO, Rank Math или похожий плагин, это самый безопасный путь. Смысл простой: архивы остаются доступны для пользователя и бота, но получают noindex и не попадают в карту сайта.

В интерфейсе ищите настройки архивов или таксономий, где можно задать статус индексации для архивов дат. Названия пунктов отличаются, но логика одна: noindex для архивов дат и исключение их из sitemap.

Плюсы и компромиссы

ПодходПлюсМинус
SEO-плагинбыстро, без кода, легко откатитьзависит от настроек плагина и его логики генерации sitemap
Кодконтроль на уровне темы или mu-pluginнужно тестировать после обновлений
robots.txtпросто закрыть обходне всегда решает вопрос индексации старых URL

Если вы уже используете Clearfy Pro, там есть инструменты для чистки лишних архивов и дублей. Это удобно, когда нужно централизованно управлять техническими страницами, а не разносить логику по теме и отдельным сниппетам. Ссылка на плагин: Clearfy Pro.

Способ 2: поставить noindex через код

Если вы не хотите зависеть от интерфейса плагина, можно добавить правило в тему или, лучше, в небольшой mu-plugin. Для архивов дат WordPress даёт готовые условные теги: is_date(), is_year(), is_month(), is_day().

Ниже пример, который добавляет noindex, follow только на архивы дат:

<?php
add_action( 'wp_head', function () {
    if ( is_date() ) {
        echo '<meta name="robots" content="noindex, follow" />' . "\n";
    }
} );

Если у вас уже есть SEO-плагин, не дублируйте тег вручную без проверки. Два разных meta robots на одной странице — частая причина путаницы. Лучше убедиться, что плагин не выводит свой вариант, а затем оставить только один источник правды.

Как убрать архивы дат из sitemap кодом

У WordPress core нет универсального фильтра, который одинаково решает это для всех конфигураций, потому что sitemap часто формирует SEO-плагин. Если карта сайта генерируется самим WordPress, можно исключить архивы дат через фильтры конкретного провайдера sitemap. Но на практике чаще приходится настраивать это в плагине или отключать сам тип URL в его интерфейсе.

Если sitemap создаёт тема или кастомный код, проверьте, не добавляете ли вы туда архивы вручную. Это особенно важно, когда карта сайта собирается через собственный шаблон или отдельный генератор.

Способ 3: ограничить обход через robots.txt

robots.txt полезен, когда нужно снизить лишний обход, но он не заменяет noindex. Для архивов дат можно закрыть только сами пути, если вы уверены, что они не нужны ни поиску, ни пользователю.

User-agent: *
Disallow: /2024/
Disallow: /2024/05/
Disallow: /2024/05/12/

Этот вариант грубый и подходит не всем. Если вы закроете весь годовой каталог, бот перестанет ходить по всем вложенным URL. Это нормально только тогда, когда архивы дат вам действительно не нужны. Если же вы хотите оставить доступ для обхода, но убрать из индекса, используйте noindex на странице, а не Disallow.

Пошаговое решение для большинства сайтов

  1. Проверьте, есть ли архивы дат в sitemap и в индексе.
  2. Если используете SEO-плагин, включите noindex для архивов дат в его настройках.
  3. Уберите архивы дат из sitemap, если плагин не сделал это автоматически.
  4. Проверьте, не выводит ли тема ссылки на архивы дат в сайдбаре, футере или хлебных крошках.
  5. Если плагина нет, добавьте noindex, follow через код.
  6. При необходимости ограничьте обход через robots.txt, но только после понимания последствий.

Как проверить, что всё сработало

После внедрения не ограничивайтесь визуальной проверкой. Нужны минимум три контроля:

  • в исходном коде страницы архива должен появиться meta robots с noindex;
  • в sitemap не должно быть URL архивов дат;
  • в Search Console статус страницы должен измениться после переобхода.

Дополнительно откройте страницу через view-source: и найдите строку с robots. Если используете кэш, очистите его до проверки, иначе вы увидите старую версию страницы и сделаете ложный вывод.

Хорошая практика — проверить не только годовой архив, но и месячный и дневной, если они доступны. На некоторых сайтах закрывают только один уровень, а остальные остаются индексируемыми.

Частые ошибки и как их исправить

Закрыли архив в robots.txt, но он остался в выдаче

Это ожидаемо. Disallow запрещает обход, но не гарантирует удаление уже известного URL из индекса. Добавьте noindex или уберите внутренние ссылки на архив, затем дождитесь переобхода.

Поставили noindex, но страница всё равно попала в sitemap

Значит, источник sitemap не учитывает вашу настройку. Проверьте SEO-плагин, его XML sitemap и любые кастомные генераторы карты сайта. Иногда проблема в том, что карта строится отдельно от мета-тегов.

Два разных robots meta на одной странице

Такое бывает, когда код темы и SEO-плагин оба выводят свои правила. В итоге поисковик видит конфликтующие сигналы. Оставьте только один механизм: либо плагин, либо код.

Закрыли слишком широкий путь

Если в robots.txt прописать общий шаблон без проверки структуры URL, можно случайно закрыть нужные страницы. Перед правкой посмотрите реальные адреса архивов и не используйте догадки.

Практические советы по безопасности и производительности

Если архивы дат не нужны, их отключение даёт не только SEO-эффект. Вы уменьшаете число бесполезных страниц, которые бот должен обходить, а также снижаете риск появления дублей в навигации и sitemap. Но не стоит превращать это в массовую чистку без плана: сначала проверьте, какие URL реально участвуют в трафике и внутренних ссылках.

Для сайтов с большим количеством технических страниц удобно держать отдельный список того, что вы закрываете: архивы дат, архивы авторов, теги, вложения, служебные страницы. Это помогает не потерять нужный URL при следующем обновлении темы или SEO-плагина.

Если вам нужен более системный контроль над дублями и техническими страницами, имеет смысл посмотреть на инструменты вроде Clearfy Pro, но только как на средство управления конкретными настройками, а не как на замену проверке индексации.

Как сделать автоматический импорт постов в WordPress с помощью плагинов и кода
05.01.2026
Как использовать pre_get_posts для автоматизации выборок записей в WordPress
23.06.2026
Как создать собственный шорткод WordPress: подробное руководство
01.11.2025
Как автоматизировать обновления плагинов и тем WordPress без риска для сайта
31.01.2026
Как убрать дубли страниц из XML sitemap и robots.txt в WordPress
24.08.2026
×
-15%
на премиум-тему
Reboot

Создай сайт мечты
на WordPress!

Купить со скидкой »