wplinks.ru wordpress WPLinks.ru

Как отключить индексацию архивов авторов и дат в WordPress без потери полезных страниц

Архивы авторов и дат в WordPress часто выглядят безобидно, пока не начинаются типичные симптомы: в индексе появляются страницы с почти одинаковым контентом, в Search Console растёт число «Просканировано, но не проиндексировано», а в выдаче всплывают архивы, которые не несут самостоятельной ценности. Проблема не в самих архивах, а в том, что они дублируют логику рубрик, тегов и страниц блога.

Ниже — практический сценарий: как понять, что архивы действительно мешают, как закрыть их от индексации без поломки сайта и как проверить результат после внедрения.

Когда архивы авторов и дат становятся проблемой

Не каждый сайт должен закрывать эти архивы. Если у вас новостной проект, журнал с несколькими авторами и отдельными страницами профилей, архив автора может быть полезной посадочной страницей. Если же на сайте один автор, а архив даты просто собирает записи за месяц, пользы для поиска обычно мало.

Признаки, что архивы лучше отключить от индексации

  • в индексе есть URL вида /author/... и /2026/08/, но они не приводят трафик;
  • внутренние ссылки ведут на архивы, хотя основной контент уже доступен через рубрики и поиск;
  • в отчётах по покрытию много страниц с одинаковыми заголовками и сниппетами;
  • в sitemap попадают URL, которые вы не хотите продвигать;
  • на сайте один редактор или один автор, и архив автора просто повторяет ленту записей.

Диагностика: что именно индексируется сейчас

Перед правками стоит проверить, как WordPress и SEO-плагин уже отдают архивы. Иногда архивы закрыты в robots.txt, но всё равно доступны в индексе через внешние ссылки. Иногда наоборот — в HTML стоит noindex, но URL остаются в карте сайта.

Что проверить вручную

  • откройте архив автора и архив даты в браузере;
  • посмотрите исходный код страницы на наличие <meta name="robots" content="noindex,follow">;
  • проверьте, есть ли эти URL в XML sitemap;
  • в Search Console откройте отчёт по страницам и найдите архивные шаблоны;
  • сравните заголовок архива с заголовками записей: если он почти ничего не добавляет, индексировать его обычно не нужно.

Быстрая проверка через код

Если нужно понять, какой robots-метатег отдаёт конкретный шаблон, можно временно посмотреть его в исходнике или через браузерный просмотр страницы. Для автоматической проверки на стороне сервера удобнее использовать curl:

curl -I https://example.com/author/admin/

В ответе вы не увидите meta robots, но сможете проверить, нет ли неожиданных редиректов, 404 или каноникала на другой URL. Сам метатег смотрится в HTML-ответе страницы.

Как отключить индексацию архивов авторов и дат

Есть три рабочих подхода: через SEO-плагин, через тему/му-плагин и через фильтры WordPress. Для большинства сайтов самый безопасный вариант — использовать настройки SEO-плагина. Если нужен точечный контроль без зависимости от интерфейса, лучше сделать это кодом.

ПодходПлюсыМинусы
SEO-плагинБыстро, без кода, удобно для редактораЗависит от конкретного плагина и его настроек
Код в темеТочный контроль, не требует лишних плагиновМожно потерять настройку при смене темы
mu-pluginНе зависит от темы, переживает обновленияНужен доступ к файлам и аккуратная установка

Вариант 1: закрыть архивы через SEO-плагин

Если у вас установлен Yoast SEO, Rank Math или аналогичный плагин, ищите настройки для архивов автора и даты. Обычно там можно отключить индексацию или убрать архив из sitemap. Это предпочтительнее, если редактор сам управляет сайтом и не должен лезть в код.

Важно не путать noindex и удаление из sitemap. Если архив закрыт от индексации, но остаётся в карте сайта, поисковик всё равно будет его регулярно обходить. Это не критично, но лишний шум лучше убрать.

Вариант 2: добавить noindex через код

Если нужен независимый от плагинов способ, можно добавить фильтр в functions.php дочерней темы или, что лучше, в mu-plugin. Ниже пример для WordPress с поддержкой wp_robots:

<?php
add_filter( 'wp_robots', function( array $robots ) {
    if ( is_author() || is_date() ) {
        $robots['noindex'] = true;
        $robots['follow']  = true;
    }

    return $robots;
} );

Этот вариант добавляет noindex,follow только на архивы авторов и дат. Ссылки на странице остаются доступны для обхода, но сам архив не должен попадать в индекс как отдельная посадочная страница.

Вариант 3: убрать архивы из XML sitemap

Если SEO-плагин всё равно включает архивы в sitemap, их нужно исключить отдельно. В Yoast и Rank Math это делается через настройки таксономий и архивов. Если у вас кастомная генерация sitemap, проверьте, не добавляете ли вы туда архивные URL вручную.

Для сайтов без SEO-плагина лучше не писать собственный sitemap-генератор, если задача только в исключении архивов. Проще и надёжнее использовать штатный механизм плагина или отключить ненужные типы страниц на уровне его настроек.

Практический вариант для mu-plugin

Если вы ведёте несколько сайтов или не хотите зависеть от темы, удобнее вынести правило в mu-plugin. Тогда оно не сломается при обновлении шаблона.

<?php
/**
 * Plugin Name: Disable author and date archives indexing
 */

add_filter( 'wp_robots', function( array $robots ) {
    if ( is_author() || is_date() ) {
        $robots['noindex'] = true;
        $robots['follow']  = true;
    }

    return $robots;
} );

Файл можно положить в wp-content/mu-plugins/disable-archive-indexing.php. Если папки mu-plugins нет, создайте её вручную. WordPress подхватит файл без активации в админке.

Как проверить, что решение сработало

После внедрения не ограничивайтесь визуальной проверкой. Нужно убедиться, что архивы действительно отдают нужный robots и не попадают в карту сайта.

  • откройте архив автора и проверьте исходный код страницы;
  • найдите строку с noindex;
  • проверьте XML sitemap и убедитесь, что архивных URL там нет;
  • в Search Console отправьте URL на повторную проверку, если они уже были проиндексированы;
  • через несколько дней проверьте, не выросло ли число страниц с дублирующимися заголовками.

Если архив уже в индексе, noindex не удалит его мгновенно. Обычно поисковику нужно время на повторный обход. Удалять URL вручную имеет смысл только если архив создаёт явную проблему в выдаче и вы хотите ускорить процесс.

Частые ошибки и как их исправить

Закрыли архив в robots.txt вместо noindex

Это распространённая ошибка. Запрет в robots.txt мешает обходу, но не гарантирует удаление из индекса, если URL уже известен поисковику. Для архивов, которые нужно убрать из выдачи, надёжнее использовать noindex.

Отключили архив автора, но оставили его в sitemap

В результате поисковик продолжает регулярно находить URL и тратить на них обход. Это не всегда критично, но логика становится противоречивой: страница одновременно «не нужна» и «обязательна к обходу».

Сломали шаблон автора для сайта с несколькими редакторами

Если у вас у каждого автора есть уникальная страница с биографией, ссылками и подборкой материалов, не закрывайте архив без анализа. Иногда лучше оставить его индексируемым, но доработать контент шаблона: добавить описание, фото, ссылки на соцсети, список лучших материалов.

Поставили noindex только на HTML, но забыли о каноникале

Если архив канонизируется на сам себя или на другую страницу без логики, это может запутать поисковик. Проверьте, что канонический URL соответствует выбранной стратегии: либо архив закрыт и не нужен, либо он полноценная посадочная страница.

Когда архивы лучше не закрывать

Есть случаи, когда архивы авторов и дат полезны. Например, на медиа-сайте архив автора помогает собрать публикации конкретного эксперта, а архив даты может быть удобен для новостной ленты. Тогда вместо полного отключения лучше улучшить шаблон:

  • добавить уникальное описание архива;
  • показать только релевантные записи;
  • скрыть пустые или слабые архивы;
  • убрать из индекса только те шаблоны, которые не несут самостоятельной ценности.

Если нужен более широкий аудит дублей и технических страниц, удобно смотреть на связку настроек SEO и чистки сайта. В некоторых проектах это проще закрыть через один инструмент, чем держать набор разрозненных правок. Например, в Clearfy Pro есть отдельные настройки для удаления дублей и технической чистки сайта: https://wpshop.ru/plugins/clearfy.

Мини-чек-лист перед публикацией

  • архивы авторов и дат определены как ненужные для индексации;
  • на страницах есть noindex,follow;
  • архивы убраны из XML sitemap;
  • каноникал не конфликтует с выбранной логикой;
  • после правки проверен исходный код и отчёт Search Console;
  • важные страницы автора, если они есть, не закрыты случайно.

Если после внедрения в индексе остаются старые URL, это нормально на коротком отрезке. Смотрите не только на наличие страницы в поиске, но и на то, как она ведёт себя после повторного обхода: исчезает ли из sitemap, получает ли noindex и перестаёт ли конкурировать с основными страницами сайта.

×

AI-плагин от WPShop.ru

анализирует конкурентов

пишет статьи

готовит SEO

генерирует изображения

и еще кое-что...
WPGPT
Плагин, который наполняет ваш сайт WordPress
Узнать больше