Генератор robots.txt онлайн — создать файл за пару минут
Пресет под вашу CMS, свои строки Disallow и адрес карты сайта. Готовый текст robots.txt копируется одной кнопкой и кладётся в корень.
Файл robots.txt обычно копируют с форума, кладут в корень и забывают про него на годы. Через полгода выясняется, что в нём осталась строка Disallow: / с тестового домена, и сайта нет в поиске. Ошибка в этом файле стоит дороже, чем его отсутствие.
Форма выше собирает файл построчно. Выбираете пресет под свою CMS, дописываете свои запреты, указываете адрес карты сайта. Результат меняется в соседнем поле сразу.
Зачем сайту robots.txt
Файл говорит роботам, какие разделы обходить не нужно. Бюджет обхода не бесконечен. Без файла краулер тратит его на внутренний поиск, корзину, фильтры с параметрами и личный кабинет, а нужные страницы ждут своей очереди и попадают в индекс медленнее.
Как собрать файл
- Отметьте галочку согласия, иначе форма не отзывается.
- Выберите пресет: 1C-Bitrix, WordPress, Drupal, Tilda или универсальный, где открыто всё.
- Допишите свои пути в поле Disallow, по одному в строке: /search/, /cart/.
- Укажите полный адрес карты сайта, если она есть. Строка Sitemap встанет в конец файла.
- Нажмите «Скопировать», вставьте текст в robots.txt и положите файл в корень сайта.
Он должен открываться по адресу ваш-домен/robots.txt. У каждого поддомена свой файл, один общий на всех не сработает.
Генератор собирает один блок User-agent: *, то есть правила сразу для всех роботов. Отдельных секций для Яндекса и Google здесь нет, при необходимости допишете их руками.
Что уже лежит в пресетах
Каждая CMS сорит своими служебными адресами, поэтому наборы правил разные.
- 1C-Bitrix: /bitrix/, /search/, /auth/, /personal/ плюс параметры печати, регистрации и служебных действий.
- WordPress: /wp-admin/, /wp-includes/, /wp-json/, /xmlrpc.php, поиск по /?s=, архивы авторов и трекбеки.
- Drupal: /admin/, /user/, /node/add/, /search/, /filter/tips, /comment/reply/.
- Tilda: /search, /cart, /members/.
- Универсальный: правил нет, в файл уходит одна строка Allow: /.
Пресет это отправная точка, а не готовая настройка. Пробегитесь по строкам глазами: половины этих разделов у вас может не быть, зато найдётся свой служебный раздел, которого нет в списке.
Где чаще всего ошибаются
- Закрывают CSS и JS. Робот должен видеть страницу так же, как её видит посетитель, поэтому закрытые стили и скрипты портят оценку.
- Путают Disallow и noindex. Запрет обхода не убирает страницу из выдачи: по внешним ссылкам она там останется. Убирают метатегом noindex или заголовком X-Robots-Tag.
- Тащат директиву Host. Яндекс не учитывает её с 2018 года, Google не понимал никогда, а главное зеркало давно задаётся обычным 301-редиректом.
- Пишут несколько путей в одной строке. Одно правило живёт в одной строке, и слеш в начале пути обязателен.
Готовый файл прогоните через «Анализ robots.txt» в Яндекс Вебмастере или отчёт в Google Search Console. Важные страницы должны открываться роботу, служебные закрываться. Новую версию роботы подхватят не сразу, обычно в течение суток.
Частые вопросы
Куда загружать файл robots.txt?
Строго в корневой каталог сайта, чтобы файл открывался по адресу ваш-домен/robots.txt. В подпапках и на других адресах роботы его не ищут. У каждого поддомена должен быть собственный файл.
Чем Disallow отличается от noindex?
Disallow запрещает роботу обходить страницу, но не гарантирует её отсутствия в выдаче: если на страницу ведут внешние ссылки, она может остаться в индексе без описания. Метатег noindex или заголовок X-Robots-Tag, наоборот, убирают страницу из индекса — но чтобы робот их увидел, обход страницы должен быть разрешён. Совмещать Disallow с noindex на одной странице бессмысленно.
Нужно ли указывать Sitemap в robots.txt?
Желательно. Директива Sitemap с полным адресом карты сайта (включая протокол) помогает роботам быстрее находить новые и обновлённые страницы. Дополнительно карту стоит добавить в Яндекс Вебмастер и Google Search Console.
Что обычно закрывают в robots.txt интернет-магазина?
Служебные и дублирующие разделы: корзину и оформление заказа, личный кабинет, результаты внутреннего поиска, страницы сортировок и фильтров с GET-параметрами, версии для печати. Пресеты для Битрикс и WordPress в генераторе уже содержат типовой набор таких правил.
Как проверить, что robots.txt работает правильно?
Откройте инструмент «Анализ robots.txt» в Яндекс Вебмастере или отчёт по robots.txt в Google Search Console и проверьте несколько адресов: важные страницы должны быть разрешены, служебные — запрещены. После изменения файла роботы подхватывают новую версию не мгновенно, обычно в течение суток.
Нужна ли сегодня директива Host?
Нет. Яндекс перестал учитывать Host ещё в 2018 году, Google не поддерживал её никогда. Главное зеркало сайта теперь определяется 301-редиректами и настройками в панелях вебмастеров, а строку Host из старых файлов можно смело удалять.
Похожие инструменты
Транслитератор ЧПУ онлайн — из русского текста в URL-слаг
Русский заголовок превращается в аккуратный URL-слаг: латиница, дефис или подчёркивание, нижний регистр. Всё считается в браузере.
Счётчик символов онлайн — знаки, слова и лимиты для SEO
Вставьте текст и получите четыре цифры: знаки с пробелами и без, слова и абзацы. Всё считается в браузере, на сервер ничего не уходит.
Проверка заголовков сервера онлайн — HTTP-статус и редиректы
Показывает сырой ответ сервера по любому адресу: статус, цепочку переходов и заголовки целиком. Без регистрации, адреса не сохраняются.
Внедрения
Корпоративный сайт инжиниринговой компании: с двух заявок в месяц до стабильного потока
Подрядчик по промышленной вентиляции стеснялся своего сайта и не имел к нему доступов. Пересобрали структуру, кейсы и формы: поток заявок вырос.