Архивы авторов и дат часто становятся лишними страницами в индексе: они дублируют списки записей, не дают полезного контента и иногда создают цепочки редиректов или 404 после смены структуры сайта. На небольших проектах это выглядит как мелочь, но на практике такие URL мешают чистить индекс и усложняют SEO-аудит.
Ниже разберём рабочую схему: как понять, что именно у вас индексируется, чем отличается noindex от полного отключения архивов, и как закрыть их без побочных эффектов.
Когда проблема действительно есть
Сначала не трогайте код. Проверьте, что именно попало в индекс и как ведут себя архивы на сайте. Обычно проблема проявляется в одном из сценариев:
- в поиске есть страницы вида
/author/username/и/2024/05/; - архив автора открывается, но почти полностью дублирует ленту записей;
- архив дат нужен только для навигации, а не для SEO;
- после смены темы или структуры URL старые архивы начали отдавать 404;
- в sitemap попадают страницы, которые вы не хотите продвигать.
Что проверить в первую очередь
- откройте архив автора и архив даты в браузере;
- посмотрите исходный код страницы на наличие
noindexв meta robots; - проверьте, не добавляет ли SEO-плагин canonical на сам архив;
- сравните URL в Google Search Console с фактическими страницами сайта;
- убедитесь, что архивы не используются как единственный способ навигации по контенту.
Что выбрать: noindex, редирект или отключение архива
У каждого варианта своя задача. Ошибка многих проектов в том, что архивы просто скрывают из меню, но оставляют доступными для роботов и пользователей. Это не решает проблему дублей.
| Подход | Когда подходит | Минус |
|---|---|---|
noindex, follow | Архив нужен пользователям, но не должен индексироваться | Страница остаётся доступной, но может ещё какое-то время висеть в индексе |
| 301-редирект | Архив больше не нужен вообще | Нужно аккуратно выбрать целевую страницу |
| Полное отключение шаблона | Архивы не используются и не должны открываться | Нужно не сломать ссылки и логику темы |
Если архивы нужны как навигация для посетителей, обычно достаточно noindex. Если это мусорные URL без пользы — лучше редирект или отключение.
Пошаговое решение через код
Самый предсказуемый вариант — управлять архивами на уровне темы или небольшого mu-plugin. Так вы не зависите от настроек конкретного SEO-плагина и можете контролировать поведение точечно.
1. Добавить noindex на архивы автора и дат
Этот вариант не ломает доступ к страницам, но просит поисковики не индексировать их. Код можно добавить в functions.php дочерней темы или в отдельный плагин.
<?php
add_action('wp_head', function () {
if (is_author() || is_date()) {
echo '<meta name="robots" content="noindex,follow" />' . "\n";
}
}, 1);Если у вас уже стоит SEO-плагин, проверьте, не выводит ли он свой meta robots. Два разных тега robots на одной странице — плохая идея. В таком случае лучше отключить настройку в плагине и оставить один источник правды.
2. Закрыть архивы от индексации через robots.txt не стоит
Это частая ошибка. Disallow в robots.txt не удаляет URL из индекса, если он уже известен поисковику. Более того, если вы закроете страницу от обхода, робот может не увидеть noindex и не выполнить его корректно. Для архивов лучше использовать meta robots или редирект.
3. Отключить архив автора, если он не нужен
Если на сайте один автор или архивы не несут пользы, можно сразу перенаправлять их на главную или на страницу блога. Это безопаснее, чем оставлять пустой архив.
<?php
add_action('template_redirect', function () {
if (is_author()) {
wp_redirect(home_url('/blog/'), 301);
exit;
}
});Замените /blog/ на реальный URL страницы, где у вас собраны записи. Не отправляйте все архивы на главную бездумно: это ухудшает навигацию и может выглядеть как мягкий 404.
4. Скрыть архив дат, если он не нужен
Для архивов дат логика та же. Если они не используются в структуре сайта, можно отдавать 301 на релевантную страницу или оставить noindex, если они нужны посетителям.
<?php
add_action('template_redirect', function () {
if (is_date()) {
wp_redirect(home_url('/articles/'), 301);
exit;
}
});Если вы используете SEO-плагин
Во многих случаях проще закрыть архивы в настройках SEO-плагина, чем писать код. Но важно понимать, что именно делает плагин: ставит noindex, отключает архив, меняет canonical или просто убирает страницу из sitemap.
Проверьте настройки для архивов авторов и дат отдельно. Если плагин умеет только noindex, а вам нужен редирект, код всё равно понадобится. Если же архивы уже закрыты, не дублируйте это в теме ещё одним meta robots.
Если нужен более широкий технический аудит дублей, иногда удобнее использовать инструменты вроде Clearfy Pro: он закрывает часть типовых SEO-дублей и помогает не собирать это вручную по разным файлам темы. Но даже в этом случае логику редиректов лучше держать под контролем в коде или в одном понятном месте настроек.
Как проверить, что решение сработало
После внедрения не ограничивайтесь визуальной проверкой. Нужно убедиться, что страница отдаёт правильный статус, а поисковик видит именно то, что вы задумали.
- Откройте архив автора или даты и проверьте исходный код: должен быть один тег
meta name="robots"с нужным значением. - Проверьте HTTP-статус через DevTools или
curl -I: при редиректе должен быть301. - Убедитесь, что целевая страница открывается без цепочки редиректов.
- Посмотрите, исчез ли URL из sitemap, если вы его там не хотите видеть.
- В Search Console отправьте проверку URL и дождитесь повторного обхода.
Для быстрой проверки через командную строку удобно использовать:
curl -I https://example.com/author/admin/
curl -I https://example.com/2024/05/Если видите 200 OK и noindex в HTML — это нормальный вариант для архивов, которые должны оставаться доступными. Если видите 301 на нужный адрес — редирект настроен корректно.
Частые ошибки и как их исправить
Дублируют настройки в теме и SEO-плагине
В итоге на странице появляются конфликтующие meta robots или canonical. Оставьте один источник настройки: либо плагин, либо код.
Закрывают архивы через robots.txt
Это не удаляет URL из индекса. Если архив уже известен поисковику, он может продолжать отображаться без содержимого. Используйте noindex или 301.
Редиректят всё на главную
Такой подход часто ухудшает поведенческие сигналы и создаёт неочевидную навигацию. Лучше вести архив автора на страницу блога, а архив даты — на релевантный раздел или тоже закрыть noindex.
Забывают про старые ссылки
Если архивы уже были в индексе, одного изменения на сайте мало. Нужно дождаться переобхода, а иногда вручную запросить проверку URL в Search Console.
Ломают архивы для пользователей
Если на сайте есть редакционная команда, архив автора может быть полезен как страница профиля. В таком случае не отключайте его полностью — оставьте noindex, follow и проверьте, что шаблон содержит нормальное описание автора, а не пустую страницу.
Практические советы по безопасности и производительности
Если вы вносите код в functions.php, делайте это в дочерней теме или в отдельном мини-плагине. Так вы не потеряете изменения после обновления темы. Для production-сайта лучше хранить такие правки в одном небольшом файле, а не размазывать по шаблонам.
Перед изменениями сделайте резервную копию и проверьте, нет ли на сайте кэша страницы или CDN, который отдаёт старую версию HTML. После правок очистите кэш сайта, серверный кэш и кэш CDN, иначе вы будете проверять уже устаревший код.
Если архивы закрываются через редирект, следите за тем, чтобы не появлялись цепочки вида /author/ → /blog/ → /articles/. Один редирект лучше трёх. Для массовой проверки удобно смотреть заголовки ответа и карту редиректов в браузерных расширениях или в логах сервера.
В итоге рабочая схема обычно выглядит так: архивы, которые нужны людям, получают noindex, follow; архивы, которые не нужны никому, редиректятся на релевантную страницу; robots.txt не используется как основной инструмент для удаления дублей из индекса.