Ссылка dofollow, а страница noindex: что это значит
Ещё один точный вопрос из чата: «ссылка dofollow, но у страницы стоит noindex — на это вообще не смотрят?». Смотрят, и это важнее атрибута ссылки.
Два разных запрета
| Что стоит | Где стоит | Что запрещает |
|---|---|---|
rel="nofollow" | На самой ссылке | Передачу веса по этой ссылке |
noindex | В мета-теге страницы | Попадание страницы в индекс |
Сочетание «dofollow-ссылка на noindex-странице» означает простое: страница в поиск не попадёт, а значит и ссылка с неё в расчёт почти наверняка не войдёт. Страница, которой нет в индексе, ничего не передаёт, каким бы ни был атрибут ссылки.
Как мы это учитываем
По каждой площадке ведётся доля публикаций, реально попавших в индекс. Замеренные цифры: 44,4% для первого уровня и 35,2% для второго. Площадки, у которых индексация стабильно нулевая, выключаются из ротации — сейчас выключено 27 из 72. Подробнее — сколько публикаций попадает в индекс.
Что делать вам
- Оценивать площадку не по атрибуту одной ссылки, а по тому, есть ли её страницы в индексе.
- Не платить отдельно за «гарантированный dofollow» — без индексации это пустая гарантия.
- Свою собственную страницу-акцептор проверить на тот же noindex: запрет на вашей стороне обнуляет весь запуск. См. noindex, nofollow и robots.txt.
Отдельный случай: страница в индексе, но ссылка в JavaScript
Бывает и так, что и индексация есть, и атрибут правильный, но ссылка появляется только после выполнения скриптов. Такую ссылку часть роботов не увидит — механика описана в статье про рендеринг JavaScript.
Как отличить одно от другого за минуту
Откройте страницу публикации, посмотрите исходный код и найдите мета-тег robots: если там noindex, дальше можно не смотреть. Если его нет — ищите свою ссылку в инспекторе элементов и проверяйте атрибут rel уже в отрисованном дереве. Две проверки в таком порядке экономят время: запрет на уровне страницы отменяет всё остальное.
Отдельно стоит знать, что запрет в robots.txt действует иначе: он не убирает страницу из индекса, а лишь мешает роботу прочитать её содержимое. Страница при этом может остаться в выдаче без описания — и ссылка с неё всё равно работать не будет.