Битые ссылки на сайте и редиректы: что из этого ломает цитируемость
Битые ссылки на сайте — это адреса, по которым сервер отвечает ошибкой 404, 410 или 5xx вместо страницы. Для классического поиска это медленная потеря: робот вернётся ещё пару раз, прежде чем выкинуть адрес из индекса. Для нейросети — мгновенная: ответ собирается в момент запроса, и страница, которая сейчас отдала ошибку, в источники просто не попадает. Редиректы работают в обе стороны: правильный 301 переносит на новый адрес всё накопленное, а цепочка из трёх перенаправлений теряет по дороге и робота, и человека. Ниже — чем делать проверку битых ссылок, чем 301 отличается от 302 и что чинить первым.
Битая ссылка — это код ответа сервера, а не пустая страница на экране
Битые ссылки на сайте — это адреса, по которым сервер вместо страницы отдаёт ошибку. Человек видит заглушку «страница не найдена», робот видит три цифры и по ним решает, что делать дальше: 404 — адреса нет, 410 — страница удалена насовсем, 5xx — сервер не справился. Разница принципиальная: заглушку можно нарисовать красиво, код ответа от этого не изменится.
Редирект, он же перенаправление или переадресация, — это ответ сервера из диапазона 3xx: «здесь пусто, иди по такому адресу». Сам по себе редирект не поломка, а рабочий инструмент переезда. Проблемы начинаются, когда перенаправлений много, они выстраиваются в цепочку или ведут не туда, куда рассчитывал автор.
Отдельный случай — soft 404: сервер отвечает «200, всё в порядке», а на странице текст «ничего не найдено» или мгновенный переход на главную. Формально адрес жив, по смыслу пуст. Поисковые системы такие страницы вычисляют и убирают из индекса, а AI-краулер уносит с собой пустоту вместо ответа.
| Код ответа | Что означает | Как реагирует поиск | Когда уместен |
|---|---|---|---|
| 200 | Страница отдана | Индексирует содержимое | Норма для всех рабочих адресов |
| 301 | Переехал навсегда | Переносит канонический адрес на новый | Смена URL, склейка www и https, переезд домена |
| 302 и 307 | Временно недоступен по этому адресу | Каноническим остаётся исходный адрес | Техработы, A/B-тест, временная развилка |
| 308 | Переехал навсегда, метод запроса сохраняется | Как 301 | Формы и запросы POST, API |
| 404 | Адрес не найден | Со временем исключает из индекса | Опечатка в ссылке, никогда не существовавший URL |
| 410 | Удалён навсегда, замены нет | Исключает быстрее, чем при 404 | Осознанное удаление раздела без аналога |
| 5xx | Сервер не смог обработать запрос | Откладывает обход и возвращается позже | Всегда авария, а не сценарий |
| soft 404 | Код 200, а по смыслу — «ничего нет» | Распознаёт как ошибку и исключает | Не уместен никогда |
Терминология: в англоязычных инструментах битые ссылки называются broken links, перенаправления — redirects, а программы обхода — website crawlers. Раздел справки Google по теме так и называется — Redirects and Google Search. Логика у всех search engines схожая, различия только в деталях обработки.
Обновлено: август 2026 — переписал таблицу кодов ответа под 307 и 308, которых не было в прошлой версии, и уточнил, что поисковый бот и AI-краулер реагируют на 404 по-разному: первый вернётся проверить ещё раз, второй просто соберёт ответ без вас. Добавил раздел о том, что делать, когда нейросеть цитирует уже удалённый адрес.
AI-краулер не возвращается за страницей, которая ответила 404
Поисковый робот живёт по расписанию: получил 404 — отложил адрес, зашёл через неделю, ещё через месяц, и только потом выкинул из индекса. У нейросети другой сценарий. Когда пользователь задаёт вопрос, платформа формулирует поисковые запросы, забирает выдачу, скачивает несколько страниц и собирает ответ из того, что успела прочитать. Страница, которая в этот момент ответила ошибкой, просто не попадает в набор источников. Никакого второго захода не будет: ответ уже собран без вас. Подробно эта механика разобрана в материале о том, как работают нейроответы.
Три точки, где ломается путь до нейроответа
- Вход. Краулер приходит по адресу из выдачи, карты сайта или чужой ссылки и получает ошибку. Материал существует, но для этого ответа его нет.
- Обход. Битые внутренние ссылки уводят робота в тупики и съедают лимит обхода. Глубокие страницы — как раз те, где лежат конкретные ответы, — до обхода не доживают. Как устроен этот лимит и чем поисковые боты отличаются от AI-краулеров, разбирал в статье об индексации сайта.
- Выход. Нейроответ отдаёт пользователю ссылку на источник. Если она ведёт в никуда, вы теряете не только визит: человек получает наглядное подтверждение, что источник ненадёжен.
Отношение к битым ссылкам у классического поиска и у нейросети разное, и это стоит держать в голове при расстановке приоритетов. Поиск прощает: у него есть время и повторные заходы. Генеративная выдача не прощает, потому что работает здесь и сейчас, в момент запроса.
GEO и SEO ломаются по-разному
SEO — про позиции в Яндексе и Google, и там 404 бьёт по индексу медленно, зато надолго. GEO — про то, назовёт ли нейросеть ваш бренд в ответе, и там ошибка сервера выбивает страницу из конкретного ответа мгновенно. GEO работает поверх SEO, а не вместо него: нейроответ чаще всего собирается из источников, которые уже видны в обычной выдаче, поэтому чинить приходится оба слоя.
Проверка битых ссылок: шесть инструментов и слепая зона каждого
Проверка битых ссылок одним сервисом не делается: каждый инструмент видит свой срез. Панели вебмастеров показывают то, что уже знает поисковая система. Краулер обходит сайт так, как это сделал бы робот. Логи показывают, что происходило на самом деле. Ниже — что даёт каждый и чего от него ждать не стоит.
| Инструмент | Что находит | Слепая зона | Ограничение |
|---|---|---|---|
| Google Search Console | Отчёт «Индексирование страниц»: адреса с 404, soft 404 и страницы с переадресацией | Только те URL, которые Google уже знает | Данные приходят с задержкой |
| Яндекс Вебмастер | Раздел «Ссылки»: внутренние ссылки с ошибками; исключённые страницы в «Индексировании» | Только то, что обошёл Яндекс | Нужны подтверждённые права на сайт |
| Screaming Frog SEO Spider | Полный обход: коды ответа, цепочки и петли редиректов, откуда стоит каждая ссылка | Не видит адреса, на которые нет ссылок внутри сайта | Бесплатная версия — до 500 адресов |
| curl или вкладка Network в браузере | Точный код ответа и весь путь перенаправлений по конкретному URL | Один адрес за раз, вручную | Не масштабируется на сайт целиком |
| Логи веб-сервера | Что реально запрашивали боты, включая AI-краулеры, и какой код получили | Ничего не говорит о ссылках, по которым никто не ходил | Нужен доступ к серверу и разбор выгрузки |
| Сервисы анализа ссылочного профиля | Входящие внешние ссылки, которые упираются в 404 на вашем сайте | Не видит внутренних проблем | Платный доступ |
Порядок действий, который мы используем в техническом аудите:
- Обойти сайт краулером и выгрузить все адреса с кодом, отличным от 200, вместе с колонкой «откуда стоит ссылка».
- Отдельно прогнать sitemap.xml: карта сайта не должна содержать ни 404, ни редиректов — только конечные адреса с кодом 200.
- Проверить служебные ссылки, которые краулер по умолчанию не обходит: canonical, hreflang, og:image, адреса в llms.txt и в структурированной разметке.
- Свериться с панелями Google и Яндекса — они знают адреса, на которые внутри сайта уже никто не ссылается.
- Посмотреть логи за месяц: какие URL запрашивали боты и сколько раз в ответ прилетело 404 или 5xx.
- Собрать список входящих внешних ссылок, ведущих на несуществующие страницы, — это готовые ссылки, которые сейчас работают в пустоту.
Проверяйте не только ссылки в тексте
Чаще всего забывают о четырёх местах: карта сайта, canonical, изображения в og-разметке и файлы, на которые ведут кнопки «скачать прайс». Битая ссылка на PDF выглядит для робота так же, как битая ссылка на страницу, а найти её вручную почти невозможно.
Найти битую ссылку в главном меню легко: она отваливается сразу и её замечают. Найти битую ссылку в теле статьи двухлетней давности вручную невозможно — только обходом. Именно поэтому проверять сайт нужно целиком и регулярно, а не по жалобам клиентов. Что ещё входит в такую регулярную проверку, собрано в чек-листе по проверке сайта на ошибки. Отдельно пройдите по адресам внутри разметки JSON-LD: битую ссылку на страницу организации, автора или услуги не видно ни в меню, ни в тексте, а для робота это несуществующий факт в машиночитаемом блоке.
301 переносит канонический адрес, 302 оставляет его на старом
Это главное различие, из-за которого редиректы попадают в любой разговор о SEO. Постоянное перенаправление говорит поисковой системе: новый адрес и есть настоящий, переносите на него всё накопленное. Временное сообщает обратное: исходный URL остаётся каноническим, вернёмся к нему позже. Ошибка в одну цифру — и полгода спустя в выдаче продолжает висеть старый адрес, а новый считается его копией.
| Тип | Сигнал для поиска | Когда применять | Чем рискуете |
|---|---|---|---|
| 301 | Постоянный: канонический адрес переезжает на новый | Смена структуры URL, склейка зеркал, переезд домена | Кэшируется браузерами — быстро откатить не выйдет |
| 302 и 307 | Временный: канонический адрес остаётся прежним | Техработы, тесты, временная гео-развилка | Оставленный надолго, консервирует старый URL в выдаче |
| 308 | Постоянный, сохраняет метод запроса | Формы, POST-запросы, API | Совсем старые клиенты его не понимают |
| meta refresh | Распознаётся как перенаправление, но медленнее | Практически не нужен | Задержка на стороне браузера, часть роботов не дожидается |
| JS-редирект | Срабатывает только при исполнении скрипта | Практически не нужен | AI-краулер может его не увидеть вообще |
Последняя строка таблицы — отдельная боль. Публичных подтверждений, что AI-краулеры массово исполняют JavaScript, нет, поэтому в аудитах мы исходим из худшего: перенаправление, которое живёт в скрипте, для нейросети не существует. То же касается ссылок, которые дорисовываются на клиенте, — почему так происходит, подробно разбирал в статье о том, почему AI-краулеры не видят контент.
Правило одного шага
Второй по частоте дефект после неверного кода — цепочки. Типичная история после переезда на https и смены структуры адресов выглядит так: http://site.ru/old ведёт на https://site.ru/old, тот на https://www.site.ru/old, а уже он на https://www.site.ru/new. Четыре шага там, где нужен один. Каждый шаг — отдельный запрос, лишнее время и лишний повод потерять робота по дороге. По документации Google бот идёт максимум по десяти переходам подряд, дальше считает цепочку ошибкой.
Мы формулируем это как правило одного шага: любой старый адрес обязан приводить на конечный за одно перенаправление, без промежуточных остановок. В редиректе важен не сам факт переезда, а число шагов и точность конечного адреса. Проверяется правило одного шага за минуту — командой curl с флагом отслеживания перенаправлений: если в выводе больше одного 3xx подряд, цепочку надо схлопывать.
Петля вместо перенаправления
Худший вариант цепочки — когда адрес A ведёт на B, а B обратно на A. Браузер показывает ошибку «слишком много перенаправлений», робот уходит ни с чем, а в панели вебмастера страница выглядит просто недоступной. Чаще всего петли возникают на стыке правил: одно правило добавляет слэш в конце адреса, другое его убирает.
Где битые ссылки заводятся чаще всего
За 150+ аудитов список причин почти не меняется от проекта к проекту. Крупные сайты с историей ломаются одинаково, и почти всегда — не по злому умыслу, а по инерции.
- Переезд на новую CMS без карты соответствия. Разработчик перенёс контент, но не составил таблицу «старый адрес → новый». Через месяц выясняется, что весь блог отвечает 404.
- Удаление товаров и услуг. Позиция ушла из каталога, страница исчезла, а ссылки на неё остались в подборках, статьях и внешних обзорах.
- Смена структуры адресов. Решили сделать человекопонятные URL или убрать из пути название категории — и получили сотни новых адресов вместо старых.
- Опечатки в ручных ссылках. Лишний пробел, кириллическая «с» вместо латинской, скопированный вместе с адресом хвост от служебного параметра.
- Умершие внешние источники. Ссылки на исследования, документы и новости, которых больше нет на сайте-первоисточнике.
- Битая ссылка в шаблоне. Один неверный адрес в подвале или меню — это сразу сотни битых страниц, потому что шаблон подставляется везде.
- Карта сайта на автопилоте. Плагин генерирует sitemap.xml по всем записям в базе, включая давно удалённые и закрытые от индексации.
В отчёте мы считаем отдельно долю битых внутренних ссылок и отдельно — долю цепочек, потому что чинятся они по-разному. И взвешиваем по месту: один битый адрес в главном меню весит больше, чем полсотни в архиве блога десятилетней давности. В битой ссылке важна не сама ошибка, а то, сколько путей к контенту она обрывает.
Самая дорогая история, которую я вижу регулярно: компания переезжает на новый сайт, дизайн стал лучше, а поисковый трафик за две недели падает вдвое. Открываем — половина старых адресов отдаёт 404, вторая половина ведёт на главную страницу тремя перенаправлениями подряд. Контент никуда не делся, просто до него больше нельзя дойти ни человеку по старой ссылке, ни роботу. Восстанавливается это за неделю работы, а вот доверие поиска — за несколько месяцев.
Что чинить первым: три корзины вместо одного списка
Выгрузка не-200 адресов на живом сайте обычно исчисляется сотнями строк, и попытка починить их подряд заканчивается тем, что не чинится ничего. Мы разносим адреса по трём корзинам, и дальше решение принимается почти механически.
- Есть прямая замена. Страница переехала или её содержимое поглотил другой материал — ставим 301 на ближайший по смыслу адрес. Именно по смыслу: перенаправление с карточки насоса на раздел «Насосы» уместно, на главную — нет.
- Замены нет, страница удалена осознанно. Отдаём 410 и убираем адрес из карты сайта. Это честный сигнал: не ищите здесь больше ничего.
- Адрес никогда не существовал. Опечатка в ссылке или неверный шаблон — чинить надо саму ссылку в исходнике, а не подкладывать под неё редирект.
После сортировки остаётся четыре обязательных действия. Схлопнуть цепочки по правилу одного шага и прописать конечные адреса прямо в меню, статьях и карте сайта — редирект должен оставаться страховкой для внешних ссылок, а не штатным способом навигации. Проверить входящие внешние ссылки, упирающиеся в 404: каждая из них — уже заработанный вес, который сейчас пропадает. Убедиться, что страница-заглушка отдаёт именно 404, а не 200 с красивым текстом. И повторить обход через две недели: часть правил обязательно окажется настроена не так, как задумано.
Массовый редирект на главную не работает
Соблазн закрыть все 404 одним правилом «всё на главную» велик, но поисковые системы давно распознают такой приём и трактуют его как soft 404 — то есть как ту же ошибку, только замаскированную. Пользователь при этом попадает не туда, куда шёл, и уходит. Если замены нет, честнее отдать 404 или 410 с нормальной заглушкой и ссылками на близкие разделы.
Если разбирать это самостоятельно некогда, весь технический слой закрывается за один заход — технический GEO-аудит из 42 пунктов, от 40 000 ₽: коды ответа, цепочки перенаправлений, доступность для AI-краулеров, разметка и скорость в одном отчёте с приоритетами.
Нейросеть цитирует адрес, которого больше нет: что делать
Вопрос, которого нет в обычных статьях про битые ссылки, но который возникает у каждого второго клиента после переезда сайта. Нейросети отдают ссылку на источник в самом ответе, и эта ссылка живёт своей жизнью: она может лежать в индексе платформы, в кэше, в чужой публикации, где скриншот ответа разошёлся по чатам. Пользователь кликает через месяц после того, как вы удалили страницу, и попадает в 404. У Google ссылка на источник приходит из двух разных мест: из сводки AI Overviews над обычной выдачей и из отдельной диалоговой вкладки AI Mode на базе Gemini, куда пользователь заходит сам и задаёт уточняющие вопросы.
Для битого адреса, который уже цитируют, работает ровно одно решение — 301 на живой материал, максимально близкий по теме, и обязательно за один шаг. При этом на новой странице важно сохранить сам ответ: тот же вопрос в заголовке, тот же короткий определяющий абзац в начале. Если фрагмент, за который вас процитировали, пропал при переносе, ссылка формально жива, но цитата больше не подтверждается — и в следующий раз в источники вы не попадёте. Как устроены такие фрагменты, разбирал отдельно в материале о цитируемости контента.
- Соберите список адресов, по которым вас уже цитировали, до того как что-то удалять. После удаления восстановить его будет не по чему.
- Ставьте 301 сразу при переезде, а не через месяц: пока адрес отдаёт 404, платформа успевает пересобрать ответ без вас.
- Не удаляйте раздел, если он приносит цитирования. Устаревший материал дешевле обновить, чем потом возвращать упоминания с нуля.
- Проверьте, что новый адрес открыт для AI-краулеров: перенаправление на страницу, закрытую в robots.txt, ничем не лучше 404. Кого пускать и кого закрывать — в разборе про robots.txt и AI-краулеров.
Когда битые ссылки чинить не нужно
Универсального порога «сколько 404 допустимо» не существует, и любой, кто называет конкретное число, его придумал. Значение имеет не количество, а место и тип. Есть ситуации, где чинить не нужно вовсе.
- Адрес удалён намеренно и замены нет. 404 или 410 — это правильный ответ, а не поломка. Ошибкой было бы прикрыть его редиректом.
- Битые исходящие ссылки в архиве десятилетней давности. Если раздел не приносит ни трафика, ни цитирований, время на его вычистку окупится последним.
- Служебные адреса, закрытые от индексации. Фильтры, сортировки, корзина, личный кабинет — роботам туда не нужно, и их коды ответа на видимость не влияют.
- Сайта нет в индексе вообще. Если страницы не обходятся и не индексируются, начинать надо не с битых ссылок, а с доступности сайта для роботов.
Что не сработает
- Плагин «автоисправления 404». Он подбирает похожий адрес по названию и уводит человека не туда, куда тот шёл. Робот видит перенаправление на нерелевантную страницу — это хуже честной ошибки.
- Заглушка с кодом 200. Красивая страница «упс, ничего не нашлось» с кодом успешного ответа — это soft 404. Поиск разберётся и накажет, нейросеть просто получит пустой источник.
- Удаление ссылки вместо исправления адреса. Если материал жив и просто переехал, убирать ссылку — значит терять внутренний путь к нему.
- Чистка битых ссылок вместо контента. Мы регулярно видим сайты с идеально настроенными перенаправлениями, где нет ни одного фрагмента, пригодного для цитирования. Технический порядок открывает дверь, но не пишет ответ за вас — что именно должно быть на сайте, собрано в чек-листе GEO-аудита.
Практический минимум, с которого стоит начать сегодня: обойти сайт краулером, выгрузить все не-200 адреса, отдельно проверить карту сайта и прогнать через curl десяток старых URL, по которым к вам раньше приходили. Если хотя бы один из них ведёт на главную или проходит через две-три остановки, у вас уже есть работа на ближайшую неделю. А если нужен внешний взгляд на то, что видит робот, начните с бесплатной GEO-диагностики — она покажет, доходят ли AI-краулеры до ваших страниц вообще.
FAQ
Как проверить битые ссылки на сайте бесплатно?
Три бесплатных способа перекрывают почти всё. Google Search Console показывает в отчёте «Индексирование страниц» адреса с 404 и переадресацией, Яндекс Вебмастер — внутренние ссылки с ошибками в разделе «Ссылки». Для полного обхода подойдёт Screaming Frog SEO Spider: бесплатная версия проверяет до 500 адресов, и небольшому сайту этого хватает. Отдельно прогоните sitemap.xml — в карте сайта не должно быть ни ошибок, ни перенаправлений.
Чем 301 отличается от 302 и что выбрать?
301 — постоянное перенаправление: поисковая система переносит канонический адрес на новый и со временем заменяет старый URL в выдаче. 302 и 307 — временные: каноническим остаётся исходный адрес, система ждёт, что вы вернётесь. Для переезда страницы, смены структуры адресов и склейки зеркал нужен 301. 302 уместен только там, где переход действительно временный: техработы, тест, сезонная развилка.
Влияют ли битые ссылки на попадание в ответы ChatGPT и Алисы?
Влияют, причём жёстче, чем на классическую выдачу. Нейросеть собирает ответ в момент запроса: она скачивает несколько страниц и берёт фрагменты из тех, что успела прочитать. Страница, ответившая 404, в этот набор не попадает, и второго захода не будет — ответ уже сформирован. Плюс битые внутренние ссылки уводят краулер в тупики, и до глубоких страниц он просто не доходит.
Можно ли перенаправить все несуществующие страницы на главную?
Нет, это распространённая ошибка. Поисковые системы распознают массовое перенаправление на главную и трактуют его как soft 404 — ту же ошибку, только замаскированную. Пользователь при этом попадает не туда, куда шёл. Правильно так: есть близкая по смыслу страница — 301 на неё, замены нет — честный 404 или 410 с заглушкой, где есть ссылки на основные разделы.
Что делать со старыми адресами после переезда сайта на новую CMS?
До запуска составьте карту соответствия «старый адрес → новый» по всем страницам, которые приносили трафик или цитирования. В день переезда настройте с них 301 — каждый за один шаг, без промежуточных остановок. После запуска обойдите сайт краулером и убедитесь, что нет цепочек и петель, а карта сайта содержит только конечные адреса. Повторите проверку через две недели: часть правил обычно работает не так, как задумывалось.
Сколько битых ссылок на сайте считается критичным?
Универсального порога нет, и любое конкретное число здесь придумано. Значение имеет не количество, а место: один битый адрес в главном меню или в карте сайта опаснее полусотни в архиве блога, до которого никто не доходит. Критичными считайте четыре категории — ссылки в шаблоне, адреса в sitemap.xml, страницы с внешними ссылками и URL, по которым вас уже цитировали нейросети.