Одна строчка в robots.txt — и весь сайт пропадает из Яндекса на полгода

Анатолий Кузнецов
Анатолий Кузнецов
SEO-оптимизатор с 20-летним стажем. Автор блога hozyindachi.ru о продвижении и доработке сайтов.

Есть категория SEO-катастроф, которые случаются мгновенно и стоят бизнесу месяцев работы. Одна из самых коварных — ошибка в файле robots.txt. Это крошечный текстовый файл в корне сайта, буквально несколько строк, но именно он управляет тем, какие страницы поисковые роботы имеют право обходить. Одна неверная директива — и весь сайт исчезает из выдачи, а владелец неделями не понимает, почему трафик рухнул в ноль.

Одна строчка в robots.txt — и весь сайт пропадает из Яндекса на полгода

Самое страшное в этой ошибке — её незаметность. Сайт при этом работает идеально: страницы открываются, формы отправляются, всё выглядит нормально. Проблема видна только роботам, а они молча уходят. К тому времени, когда владелец разбирается, что произошло, позиции уже потеряны, и на восстановление уходят долгие месяцы. В этой статье я разберу, как именно происходит такая катастрофа, как её распознать и, главное, как не допустить.

Что такое robots.txt и почему он так опасен

robots.txt — это инструкция для поисковых роботов, которая лежит в корне сайта. В ней вы указываете, какие разделы можно обходить, а какие нет. Задумка полезная: она позволяет закрыть от индексации служебные страницы, корзину, личный кабинет, дубли. Но у этой мощи есть обратная сторона — файл не прощает ошибок.

Роковая директива выглядит так: строка, которая запрещает обход всего сайта целиком. Одно неверно поставленное правило — и вы говорите роботам «сюда нельзя вообще». Роботы послушно уходят, и постепенно все страницы выпадают из индекса. Причём в отличие от многих других ошибок, эта действует тотально: не одна страница, а весь ресурс. Именно поэтому опасные шаблонные настройки я вынес в отдельный разбор про опасные настройки robots.txt по умолчанию — там показано, как безобидные на вид строки закрывают половину сайта.

Понимание работы этого файла — часть общей грамотности в теме индексации. Как robots.txt связан с картой сайта и краулинговым бюджетом, я подробно разбираю в руководстве про индексацию сайта от А до Я. Без этой картины легко случайно навредить, пытаясь навести порядок.

Как происходит катастрофа: типичные сценарии

Никто не запрещает индексацию всего сайта специально. Ошибка всегда случайна, и сценариев её появления немного, но они повторяются из проекта в проект:

  • Переезд с тестового домена. На разработке сайт закрывают от индексации, чтобы черновик не попал в поиск. При переносе на боевой домен запрет забывают снять — и живой сайт остаётся невидимым.
  • Обновление CMS или темы. Некоторые системы перезаписывают robots.txt при обновлении, возвращая закрывающие директивы по умолчанию.
  • Ручная правка с опечаткой. Специалист хотел закрыть один раздел, но неверно указал путь и закрыл весь сайт.
  • Работа плагинов. SEO-плагины умеют генерировать robots.txt автоматически, и один неверный переключатель в настройках закрывает всё.

Общая черта всех сценариев — человек, который внёс правку, был уверен, что делает всё правильно. Именно поэтому ошибка живёт так долго: её никто не подозревает. Особенно часто она случается после доработок сайта, когда правят много всего сразу. Если вы заказываете изменения на сайте, обязательно включайте проверку robots.txt в приёмку — я всегда делаю это в рамках доработки сайта, потому что видел слишком много таких историй.

Почему восстановление занимает полгода

Логично спросить: если ошибку исправить, почему сайт не возвращается сразу? Ведь директиву убрали, робот снова может заходить. Проблема в том, что выпадение из индекса и возврат в него — процессы разной скорости. Выпадаешь быстро, возвращаешься медленно.

Когда сайт был закрыт, поисковик постепенно удалял его страницы из базы, а заодно снижал доверие к ресурсу — с его точки зрения сайт «пропал». После исправления робот должен заново обойти все страницы, переоценить их качество, вернуть в индекс и лишь потом постепенно поднять в выдаче. Это не мгновенный откат, а полноценное повторное освоение сайта. Плюс за время простоя конкуренты заняли ваши места, и теперь их нужно вытеснять заново.

Есть ещё один слой потерь, который редко считают, — накопленный за годы авторитет страниц. Поисковик доверяет ресурсу тем больше, чем дольше и стабильнее тот присутствует в выдаче и получает трафик. Когда сайт внезапно пропадает, часть этого доверия обнуляется, и после возврата его приходится наращивать заново. Именно поэтому старый сайт с историей теряет от такой ошибки больше, чем молодой: ему есть что терять, и восстановить накопленное сложнее, чем построить с нуля.

Скорость возврата зависит от размера сайта, его авторитета и того, насколько быстро вы устранили ошибку. Маленький сайт может восстановиться за пару месяцев, крупный — за полгода и дольше. Ускорить процесс помогает грамотная работа с картой сайта и переобходом — как её организовать, я разбираю в материале про карту сайта sitemap. Но полностью отменить период восстановления невозможно — вот почему цена ошибки так высока.

Как проверить свой robots.txt прямо сейчас

Хорошая новость: проверить файл можно за пять минут, и это стоит сделать каждому владельцу сайта. Вот последовательность действий:

  1. Откройте в браузере адрес вашего сайта и допишите к нему «/robots.txt». Файл откроется как обычный текст.
  2. Найдите строки с директивой запрета. Убедитесь, что там не закрыт весь сайт целиком, а закрыты только служебные разделы.
  3. Используйте инструмент проверки robots.txt в панели вебмастера — он покажет, какие страницы разрешены, а какие запрещены для робота.
  4. Проверьте несколько важных страниц: главную, ключевые разделы, карточки товаров. Они должны быть доступны роботу.
  5. Сверьте число страниц в индексе с ожидаемым — резкое расхождение сигналит о проблеме.

Если вы обнаружили, что важные разделы закрыты, не паникуйте, но действуйте быстро — каждый день простоя усугубляет ситуацию. После исправления сразу отправьте сайт на переобход. Комплексно проверить не только robots.txt, но и всю картину индексации помогает разбор темы индексации сайта в поисковых системах, где robots.txt — лишь одна из точек контроля.

Как настроить robots.txt правильно

Правильный robots.txt — это баланс: закрыть мусор, оставить полезное. Разберу базовые принципы грамотной настройки, чтобы вы не навредили себе.

Закрывайте только служебное. Корзина, оформление заказа, личный кабинет, страницы поиска по сайту, технические разделы — вот что действительно стоит скрывать от роботов. Весь остальной контент должен быть открыт.

Указывайте карту сайта. В robots.txt должна быть ссылка на sitemap — это помогает роботу быстрее находить все страницы. Один этот пункт заметно ускоряет обнаружение нового контента.

Помните и о том, что robots.txt управляет обходом, но не всегда управляет индексацией напрямую. Иногда закрытая в нём страница всё равно попадает в выдачу без описания, если на неё ведёт много внешних ссылок. Для гарантированного исключения страницы из поиска используют мета-тег на самой странице, а не запрет в robots.txt. Путать эти два инструмента — распространённая ошибка, из-за которой служебные страницы то остаются видимыми, то, наоборот, пропадают нужные разделы.

Проверяйте каждую директиву запрета. Перед тем как закрыть раздел, убедитесь, что путь указан точно и не задевает лишнего. Одна лишняя звёздочка или слеш — и запрет расползается на весь сайт.

Настройка robots.txt — это часть общей технической гигиены сайта. Она тесно связана с внутренней оптимизацией сайта по шагам, где важно не только что закрыто от индексации, но и как выстроена структура открытых страниц. Файл нельзя настраивать в отрыве от общей архитектуры сайта.

Профилактика: как не наступить на эти грабли

Лучшая защита от катастрофы — регулярный контроль. Ошибку в robots.txt невозможно предотвратить на сто процентов, но можно ловить её в первые часы, а не через полгода. Вот система, которую я рекомендую внедрить:

  • Проверка после каждого изменения сайта. Обновили CMS, поставили плагин, сделали доработку — сразу проверьте robots.txt.
  • Мониторинг индексации. Настройте регулярный контроль числа страниц в индексе. Резкое падение — сигнал тревоги.
  • Контроль трафика. Резкий обвал органического трафика без видимой причины — повод в первую очередь проверить именно robots.txt.
  • Уведомления вебмастера. Панели вебмастера присылают предупреждения о проблемах с индексацией — не игнорируйте их.

Если вы не уверены в своих силах или сайт слишком важен, чтобы рисковать, доверьте проверку специалисту. Я всегда включаю аудит robots.txt в бесплатный аудит сайта, а при необходимости разберу вашу ситуацию на SEO-консультации и покажу, как выстроить контроль. Ответы на частые вопросы про индексацию собраны в разделе частых вопросов.

Закажите продвижение сайта

Одна строка в robots.txt показывает, насколько хрупок трафик без постоянного контроля. Системное SEO-продвижение сайтов — это не только рост позиций, но и защита от таких катастроф: регулярный технический контроль, мониторинг индексации, быстрая реакция на сбои. Вдобавок я развиваю GEO — подготовку сайта к рекомендациям нейросетей и AI-поиска, чтобы ваш бренд советовали сами языковые модели. Начните с SEO-консультации, подключите продвижение в нейросетях и AI-поиске — и ваш сайт будет расти стабильно и в классическом поиске, и в ответах искусственного интеллекта, без риска внезапно пропасть из выдачи.

Увеличьте позиции и продажи вашего сайта

Профессиональное SEO-продвижение с гарантией результата. Выберите подходящую услугу:

Анатолий Кузнецов — SEO-оптимизатор

Остались вопросы по продвижению?

Меня зовут Анатолий Кузнецов, я SEO-оптимизатор с 20-летним стажем. Разберу ваш сайт, отвечу на вопросы и подскажу, что улучшить для роста позиций в Яндексе и Google.

Связаться со мной →

16 комментариев к “Одна строчка в robots.txt — и весь сайт пропадает из Яндекса на полгода”

  1. Регина Быстрова

    Кратко: robots это рубильник для робота. Перед публикацией проверяйте его дважды, одна строка решает судьбу всего сайта.

  2. Ким Соловков

    Спорно про полгода, у меня вернулось за три недели после снятия запрета и переобхода. Зависит от размера сайта наверное.

  3. Оксана Демина

    Совет: держите robots под контролем и в системе версий, чтобы видеть кто и когда менял этот критичный файл.

  4. Игорь Латышев

    robots не удаляет из индекса мгновенно, он лишь запрещает обход. Иногда закрытые страницы еще долго висят в выдаче.

  5. Юна Ткаченко

    Узнала себя, скопировала чужой robots с кучей запретов, не разобравшись. Закрыла важные разделы, трафик просел.

  6. Герман Лобанов

    Прошел этот кошмар. Теперь после любого деплоя первым делом открываю robots и проверяю что ничего лишнего не закрыто.

  7. Аида Панкратова

    Не всегда виноват robots, иногда noindex случайно в шаблоне сидит. Проверяйте оба места, а не только один файл.

  8. Марат Хохлов

    Разъясните разницу, чем отличается запрет в robots от запрета через мета тег noindex для страниц, когда что применять?

    1. Марат, разница принципиальная. robots запрещает роботу заходить на страницу, но если на нее есть ссылки, она может остаться в индексе без описания. Мета тег noindex наоборот пускает робота, но говорит не добавлять страницу в индекс, и это надежно ее убирает. Правило простое: чтобы выкинуть страницу из поиска, используйте noindex и не закрывайте ее при этом в robots, иначе робот не увидит запрет.

  9. Стелла Воронова

    Полезно. Добавлю что после исправления надо переотправить страницы на переобход в вебмастере, так быстрее вернется.

  10. Артур Мясников

    robots это мощь и опасность в одном файле. Одна ошибка в звездочке и полсайта в закрытом доступе для робота.

  11. Клавдия Ермакова

    У нас так магазин выпал перед сезоном. Программист выкатил тестовый robots на боевой, потеряли две недели продаж.

  12. Ефим Кулагин

    Не понимаю, почему после снятия запрета в robots сайт так долго возвращается в индекс, робот же должен сразу все переобойти?

    1. Ефим, robots лишь запрещает обход, но не удаляет из индекса мгновенно и не ускоряет возврат. После снятия запрета роботу надо заново обойти страницы, а он приходит по своему графику, у молодых сайтов реже. Ускорить можно, отправив ключевые страницы на переобход в вебмастере и обновив карту сайта. Тогда возврат идет неделями, а не месяцами.

  13. Нонна Ясная

    Спасибо, побежала проверять свой файл. Разработчик ставил заглушку на тесте, вдруг забыл убрать запрет.

  14. Юлиан Свиридов

    Одна строчка Disallow и весь сайт улетает. Проверяю robots первым делом при любом падении трафика, спасало не раз.

  15. Раиса Долгова

    Помогите советом, как проверить не закрыл ли я случайно весь сайт от индексации в robots, куда именно смотреть новичку?

    1. Раиса, откройте файл по адресу ваш-домен слэш robots.txt прямо в браузере и найдите строки с Disallow. Опасна строка Disallow слэш без уточнений, она закрывает весь сайт. Затем проверьте тот же файл в вебмастере через инструмент анализа robots, он покажет какие страницы запрещены. Это первое, что нужно смотреть при резком падении индексации у новичка.

  16. Валентин Ефимов

    Однажды закрыл сайт от индексации при переносе и забыл открыть. Три месяца падения трафика, пока не заметил Disallow слэш.

Оставьте комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

 Нажимая «оставить комментарий» вы принимаетеправила конфиденциальности 

Прокрутить вверх