SEO з Ігорем Абрамовським
Які три основні етапи проходить сторінка: Crawling → Indexing → Serving?
Які три основні етапи проходить сторінка в Google? Розбираємо процес від сканування (crawling) та індексування (indexing) до показу у видачі (serving).

1. Що таке Crawling і що саме робить Googlebot на цьому етапі?

Crawling (сканування) — це процес первинного виявлення та завантаження вмісту (тексту, зображень, відео) з вебсторінок в Інтернеті. Це початковий етап, під час якого пошукові роботи систематично досліджують мережу.

Що саме робить Googlebot на цьому етапі:

Зчитує відомі URL-адреси: Googlebot починає обхід зі свого списку відомих адрес, сформованого на основі попередніх сканувань, надісланих карт сайту (Sitemaps) чи запитів із Search Console.

Завантажує та вилучає посилання: Робот надсилає HTTP-запит до сервера, завантажує вихідний код HTML і вилучає з нього всі знайдені посилання (href), додаючи нові адреси до черги сканування (Crawl Queue).

Рендерить JavaScript: Якщо контент на сторінці динамічний, Googlebot надсилає її до черги рендерингу (Render Queue). Спеціальна служба Web Rendering Service (WRS) на базі сучасної версії Chrome виконує скрипти та формує остаточний DOM, щоб бот зміг побачити весь прихований вміст, який інакше залишився б невидимим.

Керує навантаженням (crawl rate limit): Бот стежить за тим, щоб не перевантажити сервер сайту. Якщо сервер уповільнюється або повертає помилки HTTP 500, Googlebot зменшує швидкість сканування.


2. Що таке Indexing і яку інформацію Google намагається зрозуміти та зберегти про сторінку?

Indexing (індексування) — це процес ретельного аналізу, структурування та збереження просканованої сторінки у великій базі даних — індексі Google. Цей етап схожий на внесення прочитаної книги до каталогу великої бібліотеки.

Яку інформацію Google намагається зрозуміти та зберегти:

Текстовий контент та ключові теги: Пошукова система розбирає текст сторінки, заголовки <title>, структуру заголовків <h1>-<h6>, метадані та альтернативний опис зображень (alt-атрибути).

Сумантичний сенс та сутності: Google аналізує тему тексту, мову та зв'язує виявлені поняття із глобальною базою знань (Knowledge Graph), щоб розуміти зміст сторінки на рівні сутностей, а не просто окремих ключових слів.

Структуровані дані: Зчитує розмітку Schema (JSON-LD, Microdata), яка допомагає чітко розпізнати тип контенту (товари, ціни, відгуки, FAQ) та сформувати для них розширені сніппети.

Канонічність: Google аналізує, чи є контент сторінки унікальним. Алгоритми групують схожі та дубльовані сторінки у кластери й обирають один головний канонічний URL (саме він відображатиметься в результатах), зберігаючи інші як альтернативні версії.

Сигнали якості та авторитетності: Система зчитує первинні сигнали користувацького досвіду, мову, географічну локалізацію та оцінює якість сайту за стандартами E-E-A-T.

Усі зібрані відомості про документ зберігаються під унікальним ідентифікатором (DocID) у сховищі (наприклад, Alexandria).


Serving (показ результатів пошуку) — це фінальний етап роботи пошуку, коли у відповідь на введений користувачем запит Google шукає у своєму індексі найбільш релевантні та якісні сторінки та виводить їх на екран.

На цьому етапі системи Google:

Задіюють складні алгоритми (RankBrain, BERT) для інтерпретації запиту та пошуку відповідності у базі даних.

Аналізують контекст користувача (його поточне географічне положення, мову інтерфейсу, тип пристрою та актуальність інформації на момент запиту), щоб показати найвідповідніші результати.

Формують зовнішній вигляд видачі (SERP) за допомогою логічних шаблонів Tangram і Glue, інтегруючи у класичний список посилань інтерактивні елементи: карти Local Pack, блоки Featured Snippets, швидкі відповіді ШІ (AI Overviews), каруселі картинок та торгові пропозиції.


4. У чому головна різниця між Crawling, Indexing і Serving?

Різниця полягає у призначенні та послідовності цих трьох кроків:

Crawling (Сканування) — це процес збору. Googlebot діє як дослідник: знаходить сторінки та завантажує їх вміст на сервери Google.

Indexing (Індексування) — це процес розуміння та каталогізації. Системи Google аналізують, групують, визначають оригінальність завантаженого коду та записують його у базу даних.

Serving (Показ) — це процес відбору та відображення. Google оцінює запит користувача, вибирає з бази найкращі варіанти на основі сигналів ранжування та формує кінцеву сторінку результатів (SERP).


5. Чи може сторінка бути знайдена Google, але ще не просканована?

Так, може. Виявлення URL (URL discovery) та сканування — це технічно різні етапи. Googlebot може дізнатися про наявність нового URL з вашої карти сайту (sitemap) чи зовнішнього посилання. Проте, через обмеження вашого краулінгового бюджету (crawl budget) або затримки в черзі (Crawl Queue), робот може внести URL у чергу, але ще не завантажити його код. У Google Search Console такий URL отримує статус "Discovered – currently not indexed".


6. Чи може Google просканувати сторінку, але не проіндексувати її?

Так, може. Успішне сканування та завантаження коду сторінки не гарантують її додавання до пошукової бази. Googlebot завантажує вміст, але в процесі аналізу може відмовитися індексувати його, якщо:

Контент оцінений як малоцінний чи неоригінальний (thin or duplicate content).

Виявлено директиви, що забороняють індексацію (наприклад, метатег noindex).

Сторінка містить критичні технічні помилки рендерингу JavaScript або ознаки Soft 404. В Search Console такі сторінки позначаються сірим статусом "Crawled – currently not indexed".


7. Чи гарантує індексація сторінки, що вона буде показуватися в SERP за потрібними запитами?

Ні, не гарантує. Те, що сторінка успішно проіндексована, означає лише її технічне збереження в базі даних Google. Для того, щоб сторінка реально відображалася за потрібними ключовими словами, вона має виграти конкуренцію за ранжування. Якщо алгоритми вважають контент нерелевантним запиту користувача, якість тексту недостатньо високою чи авторитетність домену надто низькою, сторінка буде ранжуватися на далеких позиціях (наприклад, на 10-й сторінці видачі), де користувачі її ніколи не знайдуть.


8. Які фактори впливають на те, чи вибере Google проіндексовану сторінку для показу конкретному користувачу?

Основними критеріями вибору сторінки під час Serving є:

Релевантність пошуковому інтенту: Google аналізує значення запиту за допомогою моделей BERT/RankBrain і вибирає сторінки, які найкраще відповідають наміру користувача.

Контекстуальні чинники користувача: Місцезнаходження користувача, його мова та тип пристрою (мобільний/десктоп) безпосередньо впливають на фінальний склад результатів.

Якість контенту та E-E-A-T: Google оцінює оригінальність тексту, експертність автора та надійність всього сайту.

Зручність взаємодії (Page Experience): Швидкість завантаження сторінки (Core Web Vitals) та адаптивність для мобільних екранів (оскільки Google використовує Mobile-First indexing за замовчуванням).

Авторитетність (PageRank): Кількість та якість авторитетних зворотних посилань, що ведуть на сторінку.


9. Як у Google Search Console визначити, на якому саме етапі виникла проблема зі сторінкою?

Для діагностики використовуйте звіт Page Indexing (Індексація сторінок) та інструмент URL Inspection (Перевірка URL):

Проблема на етапі виявлення та сканування (Crawling):

Бачите статус "Discovered – currently not indexed" (Google знає про URL, але не відвідав його).

Статус "Blocked by robots.txt" — сканування заблоковано правилами доступу.

Звіт показує технічні помилки сервера (HTTP 5xx), таймаути чи збої в DNS під час спроби обходу.

Проблема на етапі аналізу та розуміння (Indexing):

Статус "Crawled – currently not indexed" — бот завантажив сторінку, але якість контенту, дублікати або технічний рендеринг завадили її збереженню.

Статус "Excluded by 'noindex' tag" — на сторінці виявлено директиву заборони індексації.

Статус "Alternate page with proper canonical tag" — Google знайшов сторінку, але вибрав її дубль-оригінал.

Проблема на етапі відображення (Serving / Ranking):

URL Inspection видає зелений статус "URL is on Google" (сторінка є в індексі), але у звіті Performance (Ефективність) у цієї сторінки нульові або мізерні покази за потрібними ключовими словами (проблема з якістю ранжування чи релевантністю інтенту).


10. Що SEO-фахівець може робити на кожному з трьох етапів, щоб допомогти Google правильно знайти, зрозуміти та показувати сторінку?

На етапі Crawling (Сканування):

Оптимізувати robots.txt: Переконатися, що важливі розділи та CSS/JS-файли не заблоковані для Googlebot, а технічне сміття — закрите.

Полегшити виявлення: Створити чисту XML-карту сайту (Sitemap), де містяться лише канонічні сторінки, та вчасно її оновлювати.

Прискорити сервер: Оптимізувати час відповіді сервера (TTFB) та швидкість завантаження сторінок (бажано до 100–500 мс), щоб підвищити ліміт сканування.

Покращити структуру: Усунути сторінки-сироти та вибудувати зрозумілу внутрішню перелінковку.

На етапі Indexing (Індексування):

Покращити контент: Писати унікальні тексти, які дають вичерпну відповідь на запити людей, уникаючи thin-контенту.

Налаштувати технічні теги: Чітко прописувати теги rel="canonical" та закривати службові сторінки через noindex.

Забезпечити рендеринг: Для JS-сайтів впровадити серверний рендеринг (SSR), щоб бот бачив готовий контент миттєво.

Додати мікророзметку: Використовувати розмітку Schema (JSON-LD) для спрощення ідентифікації сутностей алгоритмами.

На етапі Serving/Ranking (Показу та Ранжування):

Оптимізувати під інтент: Наповнювати сторінку контентом, який точно закриває потребу користувача (Search Intent).

Покращити мобільну версію: Оскільки Google аналізує сайт мобільним роботом (Mobile-First Indexing), мобільна версія має містити ідентичний контент і працювати бездоганно.

Працювати над авторитетом: Нарощувати масу зворотних посилань (backlinks) з надійних тематичних ресурсів.

Оптимізувати сніппети: Прописувати привабливі метатеги <title> та описання <meta description> для підвищення показника CTR у видачі.


Продовжуйте навчання

Останні матеріали цього курсу

Що SEO-фахівець може контролювати в Google, а що контролювати неможливо?
Автор: Ігор Абрамовський

Дізнайтеся межі контролю в SEO: якими процесами на сайті та у видачі Google ми можемо керувати, а які повністю залежать від зовнішніх алгоритмів.

Обговорення та запитання (0)

Поки що тут немає запитань або коментарів. Будьте першим, хто розпочне обговорення.

Додати повідомлення

Тип повідомлення