Посилання всередині PDF: чому їх не бачить жоден чекер і що вони насправді дають
Google прямо каже: посилання в PDF обробляються так само, як у HTML, можуть передавати PageRank, а nofollow усередині PDF поставити неможливо. При цьому звичайні чекери посилань їх не бачать — вони шукають HTML-розмітку, якої в цьому форматі немає. Розбираємо 489 власних публікацій у PDF, показуємо три місця, де посилання губиться, і даємо протокол перевірки з шести кроків.
Ваш сайт згадали в галузевому звіті, каталозі чи методичці — і все це лежить у PDF. Чи зараховується таке посилання? Google відповідав на це питання прямо, але відповідь давно забуто, а інструменти її не враховують: жоден звичайний чекер посилань не бачить того, що лежить усередині PDF. Ми розібрали 489 своїх публікацій у цьому форматі, знайшли три місця, де посилання губиться, і показуємо, як перевіряти такі посилання руками.
Що Google каже про посилання в PDF
Є офіційна відповідь, і вона недвозначна:
«Як правило, посилання у PDF-файлах обробляються так само, як посилання в HTML: вони можуть передавати PageRank та інші індексні сигнали, і ми можемо переходити за ними після того, як просканували PDF-файл. Зараз неможливо використовувати nofollow-посилання всередині PDF-документа».
Google Search Central Blog, «PDFs in Google search results», 1 вересня 2011Зверніть увагу на другу половину цитати. Усередині PDF не можна поставити nofollow — у форматі просто немає місця, куди його записати. Це означає, що будь-яке посилання в проіндексованому PDF за замовчуванням відкрите, і питання «а раптом там nofollow» тут не виникає взагалі.
Чесне застереження про вік: допису п'ятнадцять років. Це досі найдетальніше офіційне висловлювання Google про PDF, і воно не відкликане, але з 2011 року формулювання могли змінитися без оголошення. Перевірювана частина — про відсутність nofollow у форматі — від часу не залежить: це властивість самого PDF, а не політики.
Із тієї самої відповіді варто забрати ще чотири факти: Google індексує PDF із 2001 року; індексується текстовий вміст, якщо файл не захищено паролем; зображення всередині PDF не індексуються; прибрати PDF із видачі можна заголовком X-Robots-Tag: noindex, бо мета-тега всередині файлу не існує.
Чому цих посилань не бачить жоден чекер
Ми взяли два живі PDF і перевірили їх двома способами: звичайним розбором розмітки, як це робить будь-який чекер посилань, і розбором самого формату.
Результат передбачуваний, якщо знати будову формату, і зовсім неочевидний, якщо не знати. У PDF немає тега <a> — там інша структура документа. Пошук за <a href> чесно повертає нуль, і інструмент рапортує «посилання немає», хоча посилання є і клікається.
Принагідно підтвердилося й твердження Google про nofollow: атрибутів rel у файлах не знайшлося жодного. Їх там і не може бути.
Три місця, де посилання губиться
Ми виявили це не в теорії. У нас самих облік PDF був зламаний, і розбір показав три незалежні причини — кожна окремо виглядає розумним інженерним рішенням.
Перша: парсер шукає HTML. Друга: перевірка «чи є на сторінці наш текст» шукає підрядок у байтах файлу, а текст у PDF лежить у стиснених потоках — зовні його не видно. Третя: перевірка відповідає «вміст не HTML, отже це не сторінка» і відкидає файл цілком.
Результат: із 489 наших публікацій у PDF система впевнено вважала підтвердженими одиниці. Після того як розбір полагодили, підтвердилися 465, мертвих — нуль. Файли весь цей час були живі; сліпою була перевірка.
Як дістати посилання з PDF
Посилання в PDF зберігаються в анотаціях типу /URI. У файлах, зроблених друком із браузера, вони лежать майже відкритим текстом, і дістати їх можна без спеціальних бібліотек:
1. Завантажити файл як є, без розбору як HTML 2. Знайти в байтах конструкції виду /URI (адреса) 3. Якщо не знайшлося — розпакувати стиснені потоки (між "stream" і "endstream") і повторити пошук 4. Окремо перевірити заголовок відповіді: чи є X-Robots-Tag із noindex
Четвертий крок важливий не менше за перші три. У PDF немає мета-тега robots, тому єдиний спосіб закрити файл від індексації — заголовок відповіді сервера. І єдиний спосіб це перевірити — подивитися заголовки, а не вміст.
Протокол перевірки: шість кроків
Переконатися, що файл віддається
Запитайте адресу і подивіться на код відповіді та Content-Type. Нормальна відповідь — 200 і application/pdf. Якщо прийшов HTML, ви завантажили сторінку-обгортку, а не сам файл, і далі перевіряти немає сенсу.
application/pdf, розмір файлу схожий на документ, а не на сторінку помилки.Перевірити заголовок X-Robots-Tag
Це те саме місце, де PDF закривають від індексації. Мета-тега всередині файлу не буває, тому якщо в заголовках стоїть noindex, файл в індекс не потрапить — і посилання з нього нічого не дасть.
noindex там немає.Знайти посилання в анотаціях
Шукайте конструкції /URI з адресою. Якщо нічого не знайшлося, розпакуйте стиснені потоки і повторіть — частина файлів зберігає анотації всередині них.
Якщо й після цього порожньо, а в документі посилання візуально є — найімовірніше, це просто текст, набраний як адреса, без активної анотації. Таким «посиланням» воно є лише для людини.
Не шукати rel — його там немає
Крок, який економить час: у PDF немає механізму nofollow. Якщо посилання в анотації є і файл індексується, питання «чи відкрите воно» закрите будовою формату.
Перевірити, що текст узагалі видобувається
Google індексує текстовий вміст PDF. Найпростіша перевірка — відкрити файл і спробувати виділити й скопіювати текст. Якщо він копіюється, пошуковик теж його прочитає. Якщо це картинка сторінки, вміст тримається на розпізнаванні і розраховувати на нього не варто.
Набратися терпіння
Це найнеприємніша частина. За нашими даними, PDF, опубліковані в листопаді–грудні 2025 року, уперше потрапили до посилального індексу стороннього сервісу у вересні 2026 — приблизно дев'ять місяців потому.
Застереження обов'язкове: це індекс одного комерційного сервісу, а не Google, і за одним спостереженням закономірність не будується. Але порядок величини варто тримати в голові: чекати тижні тут не доводиться.
Що ми побачили у своїх даних — і чого не побачили
Після полагодження обліку ми зіставили строки. У вересні 2026 року посилальний індекс уперше пройшов по наших PDF-донорах, опублікованих майже рік тому, і в тому ж вікні у шести клієнтських доменів помітно виріс показник авторитетності домену — з одиниць до 17–21.
Тут треба зупинитися і сказати те, чого зазвичай не кажуть. Це збіг у часі, а не доказ. Показник авторитетності — метрика стороннього сервісу, а не Google, і зростає вона рівно тоді, коли сервіс знаходить нові посилання. Зв'язок із позиціями і трафіком із цього не випливає.
Найсильніше сумнів підкріплює контрприклад із тієї самої вибірки: в одного домену шістнадцять живих PDF із посиланнями — і нульовий рух. Якби механіка була прямою, ефект був би й там.
Що з цього можна взяти чесно: посилання в PDF існують, індексуються і враховуються посилальними індексами. Наскільки вони впливають на ранжування — із наших даних не випливає, і стверджувати це ми не будемо.
Чого робити не варто
Коротко
Google прямо каже, що посилання в PDF передають сигнали так само, як звичайні, і що nofollow усередині PDF поставити не можна. При цьому звичайні чекери їх не бачать — вони шукають HTML-розмітку, якої в цьому форматі не існує. Ми знайшли три незалежні місця, де таке посилання губиться, і майже всі свої 489 PDF-публікацій спершу вважали непідтвердженими.
Якщо робити одну дію: візьміть будь-який PDF, де на вас посилаються, і пошукайте в його байтах /URI. На це піде хвилина, а результат може розходитися з тим, що показує ваш інструмент.
Сканування покаже, що заважає вашим сторінкам потрапляти в індекс.
Часті питання
Чи передають посилання з PDF вагу?
За офіційною відповіддю Google, посилання в PDF обробляються так само, як посилання в HTML: вони можуть передавати PageRank та інші індексні сигнали, і Google може переходити за ними після сканування файлу. Умова та сама, що й для звичайних сторінок: файл має бути доступний і не закритий від індексації.
Чи можна поставити nofollow у PDF?
Ні. Google прямо вказує, що використовувати nofollow-посилання всередині PDF-документа неможливо, і це властивість самого формату: місця для такого атрибута в ньому не передбачено. У наших перевірках атрибутів rel у PDF не знайшлося жодного.
Чому чекер посилань не бачить посилання в PDF?
Тому що він шукає теги розмітки, а в PDF їх немає — там інша структура документа. Посилання зберігаються в анотаціях типу URI. Доки інструмент не розбирає сам формат, він повертатиме нуль незалежно від вмісту.
Як закрити PDF від індексації?
Лише заголовком відповіді X-Robots-Tag зі значенням noindex. Мета-тега robots усередині PDF не існує, тому звичний спосіб для HTML-сторінок тут не працює.
Чи індексуються картинки всередині PDF?
За тією самою відповіддю Google — ні, зображення всередині PDF не індексуються. Щоб картинки брали участь у пошуку, їх треба розміщувати на звичайних сторінках.
Через скільки з'явиться ефект від посилання в PDF?
Швидко не буває. У нашому випадку між публікацією файлів і їхньою першою появою в посилальному індексі стороннього сервісу минуло близько дев'яти місяців. Це одне спостереження, а не закономірність, але планувати варто в місяцях.
Джерела
Google Search Central Blog, «PDFs in Google search results», 1 вересня 2011, автор Gary Illyes: обробка посилань у PDF, неможливість nofollow, індексація тексту, зображення всередині PDF, закриття через X-Robots-Tag.
Власний замір PromoPilot, 24 вересня 2026: жива перевірка PDF-публікацій — порівняння розбору розмітки й розбору формату, коди відповіді та заголовки.
Власні дані PromoPilot: 489 публікацій у форматі PDF за період з 31 жовтня 2025 по 18 вересня 2026; після виправлення розбору підтверджено 465, непідтверджених — нуль.