Архивы тегов в WordPress часто создают лишние страницы в индексе: один и тот же набор записей может быть доступен через категории, теги, авторов и даты. Для небольшого сайта это не всегда проблема, но на контентных проектах такие дубли быстро размывают релевантность и тратят краулинговый бюджет. Самая частая ошибка — закрыть все теги «на всякий случай» или, наоборот, оставить их открытыми без проверки, что именно попадает в поиск.
Ниже — рабочий сценарий: как понять, есть ли проблема, чем закрывать архивы тегов в WordPress, как не сломать canonical и как проверить результат после внедрения.
Когда архивы тегов становятся проблемой
Теги полезны, если они помогают пользователю быстро собрать тематическую подборку. Но в SEO они часто дублируют категории или создаются без системы: один пост получает 5–10 тегов, часть из которых встречается только в одной записи. В результате WordPress генерирует много тонких страниц с малым количеством контента.
Типичные признаки дублей
- в поиске индексируются страницы тегов, которые не дают дополнительной ценности;
- в отчётах по индексации много URL вида
/tag/...с низким трафиком; - одни и те же записи доступны через несколько архивов, а canonical указывает не туда, куда вы ожидаете;
- внутренняя перелинковка ведёт на теги, которые не нужны как посадочные страницы.
Если архивы тегов реально используются как навигация по смысловым кластерам, их можно оставить открытыми. Но если это просто технический мусор, лучше закрыть их от индексации и не тратить ресурсы на пустые страницы.
Диагностика: что проверить до изменений
Сначала посмотрите, как WordPress и SEO-плагин сейчас обрабатывают теги. Не меняйте настройки вслепую: иногда проблема не в тегах, а в том, что на архиве слишком мало контента или неверно настроен canonical.
Проверка в браузере и через исходный код
- Откройте страницу тега.
- Посмотрите
<meta name="robots">в исходном коде. - Проверьте
rel="canonical". - Убедитесь, что в заголовках ответа нет противоречивых директив.
Если у вас есть доступ к терминалу, можно быстро проверить заголовки:
curl -I https://example.com/tag/wordpress/Ищите не только статус 200, но и отсутствие неожиданных редиректов, а также заголовков, которые могут конфликтовать с настройками SEO-плагина или сервера.
Что считать нормой
| Сценарий | Что делать | Компромисс |
|---|---|---|
| Теги нужны для навигации и имеют уникальный смысл | Оставить открытыми, но ограничить количество и следить за качеством | Нужен ручной контроль контента |
| Теги дублируют категории и не дают трафика | Закрыть от индексации или убрать из sitemap | Потеря части внутренней перелинковки |
| Теги уже в индексе, но ценности нет | Поставить noindex и дождаться переобхода | Исключение не мгновенное |
Пошаговое решение: как закрыть теги от индексации
Есть два рабочих пути: через SEO-плагин или кодом. Если у вас уже стоит плагин для SEO, проще использовать его настройки. Если нужен точечный контроль без лишнего интерфейса, можно задать поведение через фильтры WordPress.
Вариант 1. Через SEO-плагин
В большинстве случаев достаточно отключить индексацию архивов тегов в настройках таксономий. Это безопаснее, чем вручную править robots.txt: поисковик увидит явную директиву noindex на самих страницах.
Проверьте, чтобы одновременно выполнялись три условия:
- архив тега получает
noindex,followили аналогичную директиву; - страница не попадает в XML-sitemap;
- canonical не указывает на случайную страницу или на сам архив, если вы его закрываете.
Если используете Clearfy Pro, у него есть отдельные инструменты для чистки сайта и удаления дублей. Это удобно, когда нужно не только закрыть теги, но и убрать лишние архивы, которые WordPress создаёт по умолчанию. Смотрите настройки аккуратно: отключать стоит только то, что вы реально не используете как посадочные страницы. Ссылка на плагин: Clearfy Pro.
Вариант 2. Через код в functions.php или мини-плагин
Если нужен точечный контроль, можно добавить фильтр, который меняет robots-мета для архивов тегов. Это полезно, когда SEO-плагин не стоит или его настройки слишком общие.
add_filter( 'wp_robots', function( array $robots ) {
if ( is_tag() ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
} );Этот вариант работает на уровне генерации robots-мета. Он не удаляет страницу, а только подсказывает поисковику не индексировать её. Для большинства сайтов это правильнее, чем блокировать URL в robots.txt: если страница закрыта в robots, поисковик может не увидеть canonical и не обработать её так, как вы ожидаете.
Если нужно убрать теги из sitemap
Когда архивы тегов закрыты, их лучше не оставлять в карте сайта. Иначе вы сами продолжите подсказывать поисковику обходить ненужные URL. В SEO-плагинах это обычно отключается отдельно для таксономий. Если плагина нет, проверьте, не генерируется ли sitemap сторонним плагином или темой.
Важно: не путайте удаление из sitemap с удалением из индекса. Sitemap ускоряет обнаружение URL, но не управляет индексацией напрямую. Поэтому сначала задайте корректный robots-мета, а потом уже чистите карту сайта.
Как проверить, что решение сработало
После внедрения не ограничивайтесь визуальной проверкой. Нужно убедиться, что поисковик видит именно ту директиву, которую вы задали.
- Откройте страницу тега и проверьте исходный код.
- Убедитесь, что в
<meta name="robots">естьnoindex. - Проверьте, что canonical указывает на ожидаемый URL.
- Посмотрите XML-sitemap и убедитесь, что тегов там нет.
- Через несколько дней проверьте отчёты индексации в Google Search Console.
Если страница всё ещё в индексе, это не означает, что настройка не работает. Поисковику нужно время на переобход. Но если через переобход директива не меняется, значит проблема в конфликте плагинов, кэша или в том, что шаблон темы выводит свои мета-теги поверх SEO-плагина.
Частые ошибки и как их исправить
Закрыли теги в robots.txt
Это частая ошибка. Если вы запретили обход через robots.txt, поисковик может не увидеть noindex на самой странице. В итоге URL может дольше оставаться в индексе или обрабатываться не так, как вы планировали. Для удаления из индекса лучше использовать robots-мета, а не только блокировку обхода.
Поставили noindex, но оставили тег в sitemap
Такой конфликт мешает чистой обработке. Sitemap продолжает сигнализировать, что URL важен, а robots-мета говорит обратное. Исправление простое: уберите архивы тегов из карты сайта, если они не должны индексироваться.
Сделали noindex для всех таксономий подряд
Иногда под раздачу попадают и категории, которые реально нужны как посадочные страницы. Проверяйте настройки по таксономиям отдельно. Категория и тег — не одно и то же, и одинаковый подход здесь часто ошибочен.
Не учли кэш
После изменения шаблона или фильтра старый HTML может продолжать отдаваться из кэша. Очистите кэш плагина, серверный кэш и, если есть, CDN. Иначе вы будете проверять уже неактуальную версию страницы и делать неверные выводы.
Практические советы по безопасности и производительности
Если вы вносите код, не правьте functions.php темы на живом сайте без бэкапа. Лучше использовать дочернюю тему или небольшой mu-plugin, чтобы настройка не пропала после обновления темы.
Для производительности полезно не только закрыть лишние архивы, но и ограничить саму генерацию тегов в редакторе. Если редакторы массово добавляют одноразовые теги, база быстро захламляется, а админка начинает работать медленнее. Проще заранее договориться о правилах тегирования, чем потом чистить тысячи терминов.
- оставляйте только теги, которые реально используются как навигация;
- не дублируйте в тегах слова, уже покрытые категориями;
- проверяйте новые теги на наличие хотя бы нескольких связанных материалов;
- периодически удаляйте пустые и одноразовые термины.
Если нужен более широкий набор инструментов для удаления дублей и технической чистки WordPress, имеет смысл смотреть не на отдельные точечные хаки, а на связку настроек в одном месте. Это снижает риск конфликта между плагинами и упрощает поддержку.
Когда теги лучше не закрывать
Не все архивы тегов вредны. Если у вас редакционный проект, где теги — это осмысленные темы, а не мусорные метки, закрытие может ухудшить внутреннюю структуру сайта. В таком случае лучше:
- оставить только несколько сильных тегов;
- добавить уникальное описание архива;
- проверить, что на странице есть не только список записей, но и полезный текст;
- не плодить теги ради каждого слова из заголовка.
Практический критерий простой: если архив тега можно показать пользователю как полезную подборку, его можно оставить открытым. Если это просто техническая страница без ценности, закрывайте её от индексации и убирайте из sitemap.