Половина сайту може бути поза індексом Google — і ви про це не знаєте
Сторінка поза індексом не бере участі в пошуку взагалі. Розбираємо на власних даних за дев'ятьма сайтами, чому сторінки випадають, як відрізнити проблему обходу від проблеми вмісту і в якому з двох випадків відправка на індексацію не допоможе.
Сторінка поза індексом не бере участі в пошуку взагалі. Не «показується нижче», не «отримує менше трафіку» — її просто немає: на неї не прийдуть за жодним запитом, скільки б посилань ви на неї не поставили і скільки б грошей у неї не вклали. При цьому майже ніхто не знає, яка частка власного сайту перебуває в цьому стані, бо мало хто перевіряє сайт цілком.
Розберемо, чому сторінки випадають з індексу, як відрізнити «не обійшли» від «обійшли і вирішили не брати» — це принципово різні проблеми з різним лікуванням — і що з цього взагалі піддається полагодженню.
Наскільки це поширено
Ми подивилися на власні дані. У нашому розділі індексації накопичилося 8 263 адреси з дев'яти сайтів; за перевіреними сторінками розклад такий: 4 258 в індексі, 2 783 немає — тобто приблизно 60% на 40%.
Але середня цифра тут марна, і це головне спостереження. Розкид між сайтами виявився величезним.
Чесно про те, як це виміряно і де межі висновку. Вибірка невелика: п'ять сайтів з обсягом, на якому цифра щось означає. Метод непрямий — сторінку вважаємо проіндексованою, якщо в неї є покази в Search Console за останні 16 місяців; сторінка може бути в індексі й не мати показів, тоді ми помилково порахуємо її випалою. Тому це не галузева статистика, а спостереження за своєю вибіркою.
Але висновок, який із нього випливає, від розміру вибірки не залежить: за чужими бенчмарками своє число передбачити не можна. Різниця між 28% і 95% — це різниця між «три чверті роботи не існує для пошуку» і «все гаразд», і дізнатися, де ви, можна лише вимірюванням.
Дві принципово різні причини
Коли сторінки немає в індексі, це може означати два зовсім різні стани, і плутати їх дорого.
Перше: Google її не обійшов. У звіті Search Console це статус Discovered — currently not indexed, «Виявлено — зараз не індексується». Google формулює причину прямо: сторінку знайдено, але обхід відкладено, щоб не перевантажувати сайт. Це проблема доступності й краулінгового бюджету.
Друге: Google її обійшов і вирішив не брати. Статус Crawled — currently not indexed, «Проскановано — зараз не індексується». Сторінку бачили, прочитали й не включили в індекс. І ось тут ключова деталь, про яку мовчать усі продавці послуг індексації:
Google про статус «Проскановано — зараз не індексується»: сторінка може бути проіндексована пізніше, а може й ні. Повторна відправка на індексацію не потрібна.
Google Search Console Help, звіт «Індексування сторінок»Тобто в цьому випадку повторна подача URL не допоможе — ні через інструмент перевірки, ні через API, ні через будь-який платний сервіс. Це не технічна заминка, а оцінка: вміст не визнали достатньо цінним, щоб тримати його в індексі. Лікується вмістом, а не відправкою.
Практичний висновок, який варто прийняти до того, як ви комусь заплатите: відправка на індексацію допомагає від першої проблеми і безсила проти другої. Це стосується і нашого власного розділу індексації — він пришвидшує обхід, але не може змусити Google визнати сторінку цінною.
Повний розбір причин
| Що показує Search Console | Що це означає | Що робити |
|---|---|---|
| Виявлено — зараз не індексується | Знайшли, але не обійшли: Google відклав обхід, щоб не навантажувати сайт | Пришвидшити обхід: карта сайту, внутрішні посилання на сторінку, зовнішні посилання, відправка URL. Тут відправка реально працює |
| Проскановано — зараз не індексується | Обійшли і не взяли. Оцінка вмісту, а не збій | Відправка НЕ допомагає. Посилювати вміст, об'єднувати тонкі сторінки, прибирати шаблонні |
| Дублікат без канонічної сторінки, обраної користувачем | Google визнав сторінку дублем, канонічну адресу ви не вказали | Проставити canonical або зробити вміст справді різним |
| Дублікат: Google обрав іншу канонічну, ніж ви | Ваш canonical проігноровано на користь іншої сторінки | Звірити обидві версії: зазвичай вони надто схожі, і вибір Google логічний |
| Сторінка з переадресацією | Адреса редиректить на іншу — індексується ціль, а не вона | Нічого, якщо редирект навмисний. Перевірити, що ціль — та, що потрібна |
| Сторінка з тегом noindex | Пряма заборона індексації в розмітці або заголовку | Прибрати noindex, якщо заборона не потрібна. Часта знахідка: лишився з етапу розробки |
| Заблоковано в robots.txt | Обхід заборонено файлом robots.txt | Зняти заборону. Важливо: robots.txt забороняє ОБХІД, а не індексацію — для заборони індексації потрібен noindex |
| Помилки 404 / 403 / 401 / 5xx | Сторінка недоступна для робота | Лагодити доступність. Якщо видалена навмисно — нічого |
| М'яка помилка 404 | Сторінка віддає код 200, але має вигляд «нічого не знайдено» | Віддавати чесний 404 або наповнити вмістом |
Як перевірити свій сайт
Три способи, від найгрубішого до найповнішого.
site:адреса-сторінки в пошуку. Знайшлася — в індексі, не знайшлася — ні. Годиться для швидкої перевірки конкретної адреси, але не дає картини за сайтом.Що б ви не обрали, дивитися треба на частку, а не на абсолютне число. «В індексі 1 200 сторінок» нічого не говорить, поки невідомо, скільки їх усього.
Що зазвичай виявляється причиною
За досвідом розбору чужих сайтів список підозрюваних доволі короткий.
noindex, що лишився з розробки, або закритий у robots.txt розділ, який давно час відкрити. Перевіряється за хвилину і трапляється частіше, ніж здається.Чого робити не варто
noindex, а він вимагає, щоб сторінку можна було обійти.Порядок дій
Якщо починати з нуля, розумна послідовність така.
Спершу виміряйте частку за сайтом цілком — без цього все інше є гаданням. Потім відкрийте звіт «Індексування сторінок» і подивіться, який статус переважає: «виявлено» чи «проскановано». Це розвилка, що визначає все подальше.
Якщо переважає «виявлено» — проблема в доступності й обході. Тут працюють карта сайту, внутрішня перелінковка, зовнішні посилання й пряма відправка URL, і результат зазвичай видно за тижні.
Якщо переважає «проскановано» — проблема у вмісті, і відправка не допоможе. Доведеться дивитися, що саме Google не визнав гідним індексу, і вирішувати: посилювати, об'єднувати чи прибирати.
І лише після цього має сенс вкладатися в просування конкретних сторінок. Посилання на сторінку поза індексом — це гроші, витрачені в порожнечу.
Збирає сторінки з карти сайту й Search Console, перевіряє пакетом. Перевірка безкоштовна й без обмежень за кількістю.
Часті запитання
Як дізнатися, скільки сторінок мого сайту в індексі Google?
Повну картину дає звіт «Індексування сторінок» у Search Console — він показує і кількість, і причини за кожною категорією. Окрему сторінку можна перевірити запитом site:адреса-сторінки. Для оцінки за всім сайтом потрібна масова перевірка списку адрес.
Чим відрізняється «виявлено» від «проскановано», якщо сторінки немає в індексі?
«Виявлено — зараз не індексується» означає, що Google знайшов сторінку, але ще не обійшов: це питання доступності й краулінгового бюджету. «Проскановано — зараз не індексується» означає, що сторінку обійшли і вирішили не включати в індекс: це оцінка вмісту.
Чи допоможе повторна відправка сторінки на індексацію?
Залежить від статусу. За «виявлено, але не обійдено» відправка пришвидшує обхід і працює. За «проскановано, але не індексується» Google прямо вказує, що повторна відправка не потрібна, — тут лікується вміст, а не подача.
Яка частка сторінок в індексі вважається нормальною?
Універсальної норми немає. За нашою вибіркою з п'яти сайтів частка коливалася від 28% до 95% за співставних обсягів, тож орієнтуватися на чужі цифри безглуздо — своє значення можна лише виміряти. При цьому 100% і не потрібні: службові сторінки, коректні дублі й пагінація в індексі бути не мають.
Чому сторінка не індексується, хоча помилок немає?
Найчастіша причина — вміст визнали недостатньо цінним: тонкі сторінки, шаблонні картки, що відрізняються одним параметром, автоматично згенеровані архіви. Друга за частотою — сторінка не має внутрішніх посилань і перебуває на периферії сайту.
Чи варто закривати зайві сторінки в robots.txt?
Для виключення з індексу — ні. Robots.txt забороняє обхід, а не індексацію: закрита сторінка може лишитися в індексі за зовнішніми посиланнями, але вже без вмісту. Для виключення потрібен тег noindex, а щоб Google його побачив, сторінку треба дозволити обходити.
Джерела
Google Search Console Help, звіт «Індексування сторінок»: перелік статусів, формулювання причин і рекомендації за кожною.
Власні дані PromoPilot, серпень 2026: 8 263 адреси з 9 сайтів, із перевірених 4 258 в індексі та 2 783 поза індексом. Проіндексованість визначалася за наявністю показів у Search Console за 16 місяців.