Стаття 24.09.2026 11

Посилання всередині PDF: чому їх не бачить жоден чекер і що вони насправді дають

Google прямо каже: посилання в PDF обробляються так само, як у HTML, можуть передавати PageRank, а nofollow усередині PDF поставити неможливо. При цьому звичайні чекери посилань їх не бачать — вони шукають HTML-розмітку, якої в цьому форматі немає. Розбираємо 489 власних публікацій у PDF, показуємо три місця, де посилання губиться, і даємо протокол перевірки з шести кроків.

Посилання всередині PDF: чому їх не бачить жоден чекер і що вони насправді дають

Ваш сайт згадали в галузевому звіті, каталозі чи методичці — і все це лежить у PDF. Чи зараховується таке посилання? Google відповідав на це питання прямо, але відповідь давно забуто, а інструменти її не враховують: жоден звичайний чекер посилань не бачить того, що лежить усередині PDF. Ми розібрали 489 своїх публікацій у цьому форматі, знайшли три місця, де посилання губиться, і показуємо, як перевіряти такі посилання руками.

Що Google каже про посилання в PDF

Є офіційна відповідь, і вона недвозначна:

«Як правило, посилання у PDF-файлах обробляються так само, як посилання в HTML: вони можуть передавати PageRank та інші індексні сигнали, і ми можемо переходити за ними після того, як просканували PDF-файл. Зараз неможливо використовувати nofollow-посилання всередині PDF-документа».

Google Search Central Blog, «PDFs in Google search results», 1 вересня 2011

Зверніть увагу на другу половину цитати. Усередині PDF не можна поставити nofollow — у форматі просто немає місця, куди його записати. Це означає, що будь-яке посилання в проіндексованому PDF за замовчуванням відкрите, і питання «а раптом там nofollow» тут не виникає взагалі.

Чесне застереження про вік: допису п'ятнадцять років. Це досі найдетальніше офіційне висловлювання Google про PDF, і воно не відкликане, але з 2011 року формулювання могли змінитися без оголошення. Перевірювана частина — про відсутність nofollow у форматі — від часу не залежить: це властивість самого PDF, а не політики.

Із тієї самої відповіді варто забрати ще чотири факти: Google індексує PDF із 2001 року; індексується текстовий вміст, якщо файл не захищено паролем; зображення всередині PDF не індексуються; прибрати PDF із видачі можна заголовком X-Robots-Tag: noindex, бо мета-тега всередині файлу не існує.

Чому цих посилань не бачить жоден чекер

Ми взяли два живі PDF і перевірили їх двома способами: звичайним розбором розмітки, як це робить будь-який чекер посилань, і розбором самого формату.

Той самий файл: що бачить чекер і що в ньому є Жива перевірка двох PDF, опублікованих нами у вересні 2026 Звичайний чекер посилань Шукає теги <a href> у розмітці. Знаходить: 0 посилань. Атрибутів rel у файлі: 0. Вердикт: «посилання немає». Розбір PDF Читає /URI-анотації документа. Знаходить: посилання на цільову адресу. Відповідь сервера: 200, application/pdf, заголовка X-Robots-Tag немає. Вердикт: посилання є і індексується. Той самий файл: що бачить чекер і що в ньому є Жива перевірка двох PDF, опублікованих нами у вересні 2026 Звичайний чекер посилань Шукає теги <a href> у розмітці. Знаходить: 0 посилань. Атрибутів rel у файлі: 0. Вердикт: «посилання немає». Розбір PDF Читає /URI-анотації документа. Знаходить: посилання на цільову адресу. Відповідь сервера: 200, application/pdf, заголовка X-Robots-Tag немає. Вердикт: посилання є і індексується.
Перевірка 24 вересня 2026 року. Тега <a> у PDF не існує в принципі — розмітка там інша, тому HTML-парсер чесно повертає нуль.

Результат передбачуваний, якщо знати будову формату, і зовсім неочевидний, якщо не знати. У PDF немає тега <a> — там інша структура документа. Пошук за <a href> чесно повертає нуль, і інструмент рапортує «посилання немає», хоча посилання є і клікається.

Принагідно підтвердилося й твердження Google про nofollow: атрибутів rel у файлах не знайшлося жодного. Їх там і не може бути.

Три місця, де посилання губиться

Ми виявили це не в теорії. У нас самих облік PDF був зламаний, і розбір показав три незалежні причини — кожна окремо виглядає розумним інженерним рішенням.

Три місця, де PDF-посилання губиться дорогою Усі три ми знайшли у власному коді перевірки Парсер шукає HTML У PDF немає тегів розмітки. Регулярка по <a href> поверне нуль на будь-якому файлі Текстова перевірка Текст PDF лежить у стиснених потоках. Пошук підрядка в сирих байтах не знаходить нічого Фільтр за content-type Перевірка відповідає «не HTML — отже не сторінка» і відкидає файл цілком Три місця, де PDF-посилання губиться дорогою Усі три ми знайшли у власному коді перевірки Парсер шукає HTML У PDF немає тегів розмітки. Регулярка по <a href> поверне нуль на будь-якому файлі Текстова перевірка Текст PDF лежить у стиснених потоках. Пошук підрядка в сирих байтах не знаходить нічого Фільтр за content-type Перевірка відповідає «не HTML — отже не сторінка» і відкидає файл цілком
Кожна причина сама по собі виглядає розумною. Разом вони дають систему, яка впевнено рапортує про відсутність того, що є.

Перша: парсер шукає HTML. Друга: перевірка «чи є на сторінці наш текст» шукає підрядок у байтах файлу, а текст у PDF лежить у стиснених потоках — зовні його не видно. Третя: перевірка відповідає «вміст не HTML, отже це не сторінка» і відкидає файл цілком.

Результат: із 489 наших публікацій у PDF система впевнено вважала підтвердженими одиниці. Після того як розбір полагодили, підтвердилися 465, мертвих — нуль. Файли весь цей час були живі; сліпою була перевірка.

Це варто приміряти на себе. Якщо ви замовляли розміщення і частина з них — PDF (звіти, каталоги, презентації, методички), ваш підрядник майже напевно відзвітував по них «посилання не знайдено» або не відзвітував узагалі. Не тому що його немає.

Як дістати посилання з PDF

Посилання в PDF зберігаються в анотаціях типу /URI. У файлах, зроблених друком із браузера, вони лежать майже відкритим текстом, і дістати їх можна без спеціальних бібліотек:

1. Завантажити файл як є, без розбору як HTML
2. Знайти в байтах конструкції виду /URI (адреса)
3. Якщо не знайшлося — розпакувати стиснені потоки
   (між "stream" і "endstream") і повторити пошук
4. Окремо перевірити заголовок відповіді:
   чи є X-Robots-Tag із noindex

Четвертий крок важливий не менше за перші три. У PDF немає мета-тега robots, тому єдиний спосіб закрити файл від індексації — заголовок відповіді сервера. І єдиний спосіб це перевірити — подивитися заголовки, а не вміст.

Протокол перевірки: шість кроків

Крок 1

Переконатися, що файл віддається

Запитайте адресу і подивіться на код відповіді та Content-Type. Нормальна відповідь — 200 і application/pdf. Якщо прийшов HTML, ви завантажили сторінку-обгортку, а не сам файл, і далі перевіряти немає сенсу.

Перевірка: код 200, тип вмісту application/pdf, розмір файлу схожий на документ, а не на сторінку помилки.
Крок 2

Перевірити заголовок X-Robots-Tag

Це те саме місце, де PDF закривають від індексації. Мета-тега всередині файлу не буває, тому якщо в заголовках стоїть noindex, файл в індекс не потрапить — і посилання з нього нічого не дасть.

Перевірка: ви подивилися саме заголовки відповіді, а не вміст файлу, і noindex там немає.
Крок 3

Знайти посилання в анотаціях

Шукайте конструкції /URI з адресою. Якщо нічого не знайшлося, розпакуйте стиснені потоки і повторіть — частина файлів зберігає анотації всередині них.

Якщо й після цього порожньо, а в документі посилання візуально є — найімовірніше, це просто текст, набраний як адреса, без активної анотації. Таким «посиланням» воно є лише для людини.

Перевірка: ви знайшли свою адресу саме в анотації, а не в текстовому шарі документа.
Крок 4

Не шукати rel — його там немає

Крок, який економить час: у PDF немає механізму nofollow. Якщо посилання в анотації є і файл індексується, питання «чи відкрите воно» закрите будовою формату.

Перевірка: ви не витрачаєте час на пошук атрибутів, яких у форматі не передбачено.
Крок 5

Перевірити, що текст узагалі видобувається

Google індексує текстовий вміст PDF. Найпростіша перевірка — відкрити файл і спробувати виділити й скопіювати текст. Якщо він копіюється, пошуковик теж його прочитає. Якщо це картинка сторінки, вміст тримається на розпізнаванні і розраховувати на нього не варто.

Перевірка: текст виділяється мишею і копіюється у звичайний текстовий редактор.
Крок 6

Набратися терпіння

Це найнеприємніша частина. За нашими даними, PDF, опубліковані в листопаді–грудні 2025 року, уперше потрапили до посилального індексу стороннього сервісу у вересні 2026 — приблизно дев'ять місяців потому.

Застереження обов'язкове: це індекс одного комерційного сервісу, а не Google, і за одним спостереженням закономірність не будується. Але порядок величини варто тримати в голові: чекати тижні тут не доводиться.

Перевірка: ви зафіксували дату публікації і не робите висновків про ефект раніше, ніж через кілька місяців.

Що ми побачили у своїх даних — і чого не побачили

Після полагодження обліку ми зіставили строки. У вересні 2026 року посилальний індекс уперше пройшов по наших PDF-донорах, опублікованих майже рік тому, і в тому ж вікні у шести клієнтських доменів помітно виріс показник авторитетності домену — з одиниць до 17–21.

Тут треба зупинитися і сказати те, чого зазвичай не кажуть. Це збіг у часі, а не доказ. Показник авторитетності — метрика стороннього сервісу, а не Google, і зростає вона рівно тоді, коли сервіс знаходить нові посилання. Зв'язок із позиціями і трафіком із цього не випливає.

Найсильніше сумнів підкріплює контрприклад із тієї самої вибірки: в одного домену шістнадцять живих PDF із посиланнями — і нульовий рух. Якби механіка була прямою, ефект був би й там.

Що з цього можна взяти чесно: посилання в PDF існують, індексуються і враховуються посилальними індексами. Наскільки вони впливають на ранжування — із наших даних не випливає, і стверджувати це ми не будемо.

Чого робити не варто

Вважати звіт «посилання не знайдено» остаточним Якщо розміщення було в PDF, інструмент майже напевно шукав теги розмітки. Їх там немає за будовою формату.
Штампувати PDF заради посилань Нічого в правилах не змінюється від зміни формату: масова генерація документів заради посилань лишається посилальним спамом. Ідеться про те, щоб правильно враховувати розміщення, які й так є.
Забувати про заголовок відповіді Мета-тега robots у PDF не існує. Файл закривають заголовком, і перевірити це можна лише в заголовках.
Чекати швидкого результату Між публікацією і появою посилання в сторонньому індексі в нас минуло близько дев'яти місяців. Плануючи роботу, виходьте з місяців, а не тижнів.

Коротко

Google прямо каже, що посилання в PDF передають сигнали так само, як звичайні, і що nofollow усередині PDF поставити не можна. При цьому звичайні чекери їх не бачать — вони шукають HTML-розмітку, якої в цьому форматі не існує. Ми знайшли три незалежні місця, де таке посилання губиться, і майже всі свої 489 PDF-публікацій спершу вважали непідтвердженими.

Якщо робити одну дію: візьміть будь-який PDF, де на вас посилаються, і пошукайте в його байтах /URI. На це піде хвилина, а результат може розходитися з тим, що показує ваш інструмент.

Перевірити свій сайт

Сканування покаже, що заважає вашим сторінкам потрапляти в індекс.

Часті питання

Чи передають посилання з PDF вагу?
За офіційною відповіддю Google, посилання в PDF обробляються так само, як посилання в HTML: вони можуть передавати PageRank та інші індексні сигнали, і Google може переходити за ними після сканування файлу. Умова та сама, що й для звичайних сторінок: файл має бути доступний і не закритий від індексації.

Чи можна поставити nofollow у PDF?
Ні. Google прямо вказує, що використовувати nofollow-посилання всередині PDF-документа неможливо, і це властивість самого формату: місця для такого атрибута в ньому не передбачено. У наших перевірках атрибутів rel у PDF не знайшлося жодного.

Чому чекер посилань не бачить посилання в PDF?
Тому що він шукає теги розмітки, а в PDF їх немає — там інша структура документа. Посилання зберігаються в анотаціях типу URI. Доки інструмент не розбирає сам формат, він повертатиме нуль незалежно від вмісту.

Як закрити PDF від індексації?
Лише заголовком відповіді X-Robots-Tag зі значенням noindex. Мета-тега robots усередині PDF не існує, тому звичний спосіб для HTML-сторінок тут не працює.

Чи індексуються картинки всередині PDF?
За тією самою відповіддю Google — ні, зображення всередині PDF не індексуються. Щоб картинки брали участь у пошуку, їх треба розміщувати на звичайних сторінках.

Через скільки з'явиться ефект від посилання в PDF?
Швидко не буває. У нашому випадку між публікацією файлів і їхньою першою появою в посилальному індексі стороннього сервісу минуло близько дев'яти місяців. Це одне спостереження, а не закономірність, але планувати варто в місяцях.

Джерела

Google Search Central Blog, «PDFs in Google search results», 1 вересня 2011, автор Gary Illyes: обробка посилань у PDF, неможливість nofollow, індексація тексту, зображення всередині PDF, закриття через X-Robots-Tag.
Власний замір PromoPilot, 24 вересня 2026: жива перевірка PDF-публікацій — порівняння розбору розмітки й розбору формату, коди відповіді та заголовки.
Власні дані PromoPilot: 489 публікацій у форматі PDF за період з 31 жовтня 2025 по 18 вересня 2026; після виправлення розбору підтверджено 465, непідтверджених — нуль.

Поділитися:
Каскадний лінкбілдинг

3 рівні посилань + крауд для максимального ефекту. Спробуйте безкоштовно!

Спробувати безкоштовно
Бонус $30 при реєстрації

Почніть просування сайту вже зараз — бонус нараховується автоматично

Отримати бонус
SEO-інструменти
Як працюють каскади
L1 Статті на трастових майданчиках з DR 30–70
L2 Підсилення L1 посиланнями з блогів та Web 2.0
L3 Індексація та підтримка через профілі та коментарі
C Крауд-посилання для природного профілю
Докладніше
Зміст