На небольших и средних WordPress-сайтах архивы авторов и теги часто создают больше шума, чем пользы: в индексе появляются страницы без уникального контента, а в отчётах по сканированию растёт число дублей и тонких страниц. Если сайт не строится вокруг авторских профилей или таксономии тегов как отдельного раздела, эти архивы обычно лучше либо закрыть от индексации, либо аккуратно убрать из карты сайта и внутренней навигации.
Но делать это нужно не «на глаз». Ошибка в настройке легко приводит к тому, что поисковик продолжает тратить краулинговый бюджет на мусорные страницы, а иногда ещё и теряется полезная перелинковка. Ниже — рабочий сценарий: как понять, что именно мешает, как закрыть архивы правильно и как проверить результат.
Когда архивы автора и теги действительно вредят
Сначала стоит отделить техническую проблему от архитектуры контента. Не все сайты должны одинаково обращаться с тегами и авторами.
Сигналы, что архивы лучше закрыть
- на сайте один автор, и страница автора дублирует страницу «Об авторе» или главную;
- теги используются хаотично, по 1–2 записи на тег;
- в поиске уже есть много страниц вида
/tag/...или/author/...без трафика; - в отчётах Screaming Frog, Sitebulb или Search Console видно много URL с низкой ценностью;
- в шаблоне архивов нет уникального текста, а только список записей.
Когда закрывать не нужно
Если у вас редакционный сайт с несколькими авторами, у каждого есть полноценная биография, подборки материалов и отдельная ценность для пользователя, архив автора можно оставить открытым. То же касается тегов, если они реально помогают навигации и у каждого тега есть осмысленное описание, а не просто список постов.
Диагностика: что именно создаёт дубли
Перед правкой проверьте, откуда именно идут проблемы. В WordPress один и тот же архив может быть доступен по нескольким каналам: в HTML, в XML-карте сайта, через каноникал, в хлебных крошках и в поисковой выдаче.
Что проверить в первую очередь
- Откройте страницу автора и страницу тега в браузере.
- Посмотрите исходный код: есть ли
<meta name="robots" content="noindex,follow">. - Проверьте, попадают ли эти URL в XML sitemap.
- Убедитесь, что в шаблоне нет случайных ссылок на архивы в меню, сайдбаре и блоках «Похожие записи».
- Проверьте, не создаёт ли SEO-плагин отдельные правила для архивов автора и тегов.
Если у вас установлен SEO-плагин, сначала посмотрите его настройки. Часто проблема решается там без кода. Если же настройки уже запутаны или нужно точечно закрыть только часть архивов, проще сделать это через код.
Пошаговое решение через настройки и код
Ниже — два рабочих подхода. Первый подходит, если вы хотите быстро закрыть архивы через SEO-плагин. Второй — если нужно зафиксировать поведение на уровне темы или небольшого mu-plugin.
Вариант 1: через SEO-плагин
В большинстве SEO-плагинов есть отдельные переключатели для архивов автора и тегов. Логика обычно одна и та же: запрет индексации, исключение из sitemap и сохранение follow, чтобы поисковик мог проходить по ссылкам внутри архива, если они там есть.
Плюс этого подхода — минимум кода. Минус — зависимость от интерфейса плагина и его обновлений. Если сайт ведётся несколькими людьми, настройки могут случайно вернуть назад.
Вариант 2: через код в functions.php или mu-plugin
Если вам нужно стабильное решение, добавьте небольшой фрагмент в functions.php дочерней темы или, лучше, в отдельный mu-plugin. Так настройка не исчезнет при смене темы.
<?php
add_filter( 'wp_robots', function( array $robots ) {
if ( is_author() || is_tag() ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
} );
add_filter( 'wp_sitemaps_post_types', function( array $post_types ) {
// Если нужно убрать архивы из sitemap-поведения через SEO-плагин,
// обычно это делается его настройками. Этот фильтр здесь не для архивов,
// а как напоминание: не трогайте карту сайта без понимания структуры.
return $post_types;
} );
Этот код добавляет noindex,follow на страницы автора и тега. Он не удаляет их из сайта физически, а только говорит поисковику не индексировать такие страницы. Это безопаснее, чем массово удалять архивы и ломать ссылки.
Если вам нужно закрыть только теги, а авторов оставить открытыми, уберите is_author(). Если наоборот — оставьте только его.
Если нужно убрать архивы из sitemap
В WordPress core нет универсального фильтра, который одним движением убирает именно архивы автора и теги из XML-карты сайта для всех конфигураций. На практике это зависит от SEO-плагина. Поэтому здесь правильнее действовать через настройки плагина, а не через самодельные костыли.
Если вы используете Yoast SEO, Rank Math или аналогичный плагин, отключите показ таксономии тегов и архивов автора в XML sitemap в его настройках. После этого проверьте, что URL действительно исчезли из карты сайта, а не только стали noindex.
| Подход | Плюсы | Минусы | Когда выбирать |
|---|---|---|---|
| Настройки SEO-плагина | Быстро, без кода | Зависит от интерфейса и обновлений | Если сайт ведёт редактор или контент-менеджер |
| Код в mu-plugin | Стабильно, не зависит от темы | Нужна аккуратность и тестирование | Если нужен предсказуемый технический контроль |
| Удаление архивов из шаблона | Убирает лишние ссылки | Можно сломать навигацию | Если архивы вообще не нужны пользователям |
Как проверить, что решение сработало
После правки не ограничивайтесь визуальной проверкой. Нужно убедиться, что поисковик видит именно то, что вы задумали.
Проверка в браузере и через исходный код
- Откройте страницу автора и страницу тега.
- Проверьте наличие
noindex,followв meta robots или в HTTP-заголовках, если у вас так настроен сайт. - Убедитесь, что страница не отдаёт случайный
index,followиз другого плагина.
Проверка в Search Console
Используйте проверку URL и посмотрите, как Google видит страницу. Если страница ещё в индексе, это не всегда ошибка: после изменения статуса поисковику нужно время на переобход. Важно, чтобы новое правило было стабильно доступно при повторной проверке.
Проверка сканером
Прогоните сайт через Screaming Frog или аналогичный краулер и отфильтруйте URL с /tag/ и /author/. Вам нужно увидеть:
- правильный robots meta;
- отсутствие этих URL в sitemap;
- отсутствие лишних внутренних ссылок, если вы решили их убрать.
Частые ошибки и как их исправить
Ошибка 1. Закрыли страницу в robots.txt вместо noindex
Это частая путаница. Если вы просто запретили обход в robots.txt, поисковик может не увидеть директиву noindex на самой странице и URL останется в индексе как «запрещённый к сканированию». Для архивов автора и тегов обычно лучше использовать noindex,follow, а не запрет в robots.txt.
Ошибка 2. Закрыли архив, но оставили его в sitemap
Так поисковик получает противоречивые сигналы: в карте сайта URL есть, а на странице стоит noindex. Это не критическая поломка, но лишний шум. Сначала синхронизируйте sitemap, потом мета-robots.
Ошибка 3. Убрали архивы, но не почистили внутренние ссылки
Если теги остались в облаке тегов, в блоках записей и в хлебных крошках, они продолжают активно сканироваться. Иногда это нормально, если вы хотите сохранить переходы. Но если задача — убрать мусорные архивы, ссылки тоже нужно пересмотреть.
Ошибка 4. Использовали код в теме, а потом сменили тему
Это классическая проблема. Настройка исчезает вместе с темой. Для технических правил, связанных с индексацией, лучше использовать mu-plugin или отдельный мини-плагин.
Практические советы по безопасности и производительности
Технические правки для SEO лучше вносить аккуратно. Даже маленький фрагмент кода может повлиять на весь сайт, если его вставить не туда.
- Не правьте
functions.phpна боевом сайте через админку, если нет нормального бэкапа. - Сначала проверьте код на staging-версии.
- Если используете кэш-плагин, очистите кэш после изменения robots meta.
- Не ставьте сразу несколько SEO-плагинов с пересекающимися функциями.
- Если архивы автора нужны только для навигации, но не для индексации, оставляйте
follow— так вы не обрываете внутренние ссылки.
Если вам нужен более широкий аудит дублей, тонких страниц и лишних архивов, удобно сначала пройтись по сайту инструментом для SEO-чистки. В экосистеме WPShop для таких задач есть Clearfy Pro: он помогает убрать часть технического шума и навести порядок в типовых настройках WordPress. Подробности можно посмотреть здесь: https://wpshop.ru/plugins/clearfy.
Что делать, если архивы уже в индексе
Если страницы автора и теги уже успели попасть в индекс, не ждите мгновенного исчезновения. После внедрения noindex поисковику нужно переобойти URL. Ускорить процесс можно только косвенно: убедиться, что страница доступна, не блокируется robots.txt, и что на неё больше не ведут лишние внутренние ссылки.
Если архивы были важны для пользователей, но не для индекса, оставьте их доступными, но сократите количество пустых тегов и добавьте уникальные описания там, где это оправдано. Если же это чистый мусор, лучше закрыть их системно и не возвращаться к ручным правкам на каждой публикации.