Безкоштовний екстрактор URL із XML Sitemap

Миттєво перетворіть XML-карти сайту на чисті списки URL. Витягуйте посилання для масової перевірки індексації та технічних SEO-аудитів. Експорт у TXT, CSV і PDF.

Перетворіть хаотичний код на робочі дані

Сирий XML (незручно)
<url>
  <loc>https://site.com/page1</loc>
  <lastmod>2023-10-01</lastmod>
</url>
<url>
  <loc>https://site.com/page2</loc>
  <priority>0.8</priority>
</url>
...
Чистий список URL (готовий до аудиту)
https://site.com/page1
https://site.com/page2
https://site.com/about
https://site.com/contact
...

Що таке екстрактор URL із Sitemap?

Екстрактор URL із Sitemap — спеціалізований SEO-інструмент, який парсить XML-карти сайту й повертає чистий текстовий список усіх URL. На відміну від сирого XML із метаданими на кшталт <lastmod> і <priority>, екстрактор прибирає розмітку й дає лише посилання. Якщо карти сайту для вас нові, почніть з офіційної документації Google: Огляд карт сайту (Google Search Central).

Інструмент потрібен SEO-фахівцям для масових аудитів, перевірки індексації або валідації міграцій без ручного копіювання сотень посилань. Парсинг іноді падає через файрволи, редиректи, некоректний XML або помилки сервера. Перегляньте таблицю з основними причинами збоїв і способами їх усунути. Додаткові джерела: офіційний протокол XML Sitemap (sitemaps.org) і довідка Google Search Console щодо карт сайту.

Завантажити з URL
Вставити XML

Введіть посилання на XML-карту сайту (наприклад, https://site.com/sitemap.xml).


Витягнуті URL: 0

Експорт Sitemap у дії

Короткий туторіал: як легко витягти всі URL з XML-карти для масової індексації чи перевірки.

⚡ Навіщо робити це вручну? Автоматизуйте в кабінеті.

Інструмент на цій сторінці дає текстовий файл. Для малих завдань цього досить. У вебзастосунку SpeedyIndex ви отримуєте повний процес без копіювання-вставки:

  • ✅ Витягти й проаналізувати: імпортуйте карти сайту прямо в проєкт.
  • 🔍 Миттєва перевірка: оберіть витягнуті посилання й одразу запустіть масову перевірку індексу (Google, Bing або Yandex).
  • 🚀 Індексація в один клік: знайшли непроіндексовані сторінки? Одразу надішліть їх у сервіс індексації.
Спробуйте безшовний процес у застосунку →

Аудити після витягування

Коли список URL готовий, виконайте ці технічні аудити, щоб оцінити стан сайту.

1. Перевірте статус індексації

Переконайтеся, що подані URL справді віддаються пошуковиками. Непроіндексовані URL із карти вказують на якісні або технічні блокери.

Перевірити індекс Google →

2. Аудит кодів відповіді

Проскануйте список на биті посилання (404) або помилки сервера (5xx), які марнують бюджет обходу.

3. Перевірте міграцію

Порівняйте витягнутий список із новою структурою сайту, щоб підтвердити коректність 301-редиректів.

Чекліст міграції →

Повний список типових шляхів Sitemap

Якщо стандартний /sitemap.xml повертає 404, вебмайстри часто використовують інші назви залежно від CMS чи сервера. Скористайтеся таблицею, щоб знайти файл.

Шаблон URL Платформа / сценарій
/sitemap.xml Стандарт. Shopify, Wix, Squarespace, Webflow, Ghost і більшість статичних HTML-сайтів.
/sitemap_index.xml WordPress (плагіни). За замовчуванням у Yoast SEO, RankMath і All in One SEO. Також для великих сайтів, що ділять дані на кілька файлів.
/wp-sitemap.xml WordPress (вбудовано). WordPress 5.5+, якщо немає стороннього SEO-плагіна.
/sitemap.php Динамічні PHP-сайти. Часто на форумах (vBulletin, XenForo) або власних PHP-скриптах, що генерують XML на льоту.
/sitemap.txt Простий текст. Старі системи або прості статичні сайти (стиль Yahoo!). Один URL на рядок.
/1_index_sitemap.xml PrestaShop. Часто з префіксом-номером ID магазину чи мови (наприклад, 2_index_sitemap.xml).
/sitemap.xml.gz Стиснуто. Для сайтів із великим обсягом (наприклад, новинних порталів), щоб заощадити трафік. Перед парсингом розпакуйте.
/feeds/posts/default?orderby=updated Blogger (Blogspot). Стандартний Atom-фід, який Google використовує як карту сайту.
/sitemap/sitemap.xml Фреймворки. Типова структура для Django, Laravel або сайтів із файлами в підпапках.
/news-sitemap.xml Google News. Окремий файл для видавців зі статтями за останні 48 годин.
/image-sitemap.xml SEO зображень. Окремий файл для посилань CDN і медіа (часто у фотопортфоліо).
Порада: головне джерело правди
Якщо нічого з переліченого не спрацювало, перевірте /robots.txt (наприклад, example.com/robots.txt). Там вебмайстри мають вказати розташування карти директивою: Sitemap: https://example.com/custom-name.xml.

Чому sitemap.xml не завантажується і не парситься: чекліст усунення несправностей

Якщо інструмент не може завантажити карту сайту (Завантажити з URL) або ви отримуєте порожній список URL, причина майже завжди одна з цих: антибот-блокування (Cloudflare/WAF), неправильний формат (gzip/HTML замість XML), синтаксичні помилки XML, редиректи й погані HTTP-коди (3xx/4xx/5xx), проблеми SSL/TLS, кодування або нестандартна структура карти. Нижче — детальний чекліст, який відповідає на питання: «Чому я не можу завантажити/розпарсити карту сайту?»

Тип проблеми Чому не працює (симптом) Що робити (виправлення)
Стиснута карта (.gz) URL віддає файл .gz (бінарний). Браузер може його показати, але автоматичне завантаження/копіювання часто дає неправильний формат. Download and unzip it locally (7‑Zip, etc.). Then use the “Вставити XML” tab, or paste the unzipped XML.
Cloudflare / WAF / антибот (403 Forbidden) Сервер блокує автоматичні запити (cURL/fetch): 403, CAPTCHA, JS-челендж, Bot Fight Mode, правила ModSecurity/WAF. Іноді файл відкривається в браузері, але інструмент його не завантажує. Відкрийте карту в браузері, натисніть Ctrl+U (перегляд коду), скопіюйте сирий XML і вставте на вкладку «Вставити XML». Також перевірте, чи WAF не блокує за User‑Agent, країною чи ASN.
Замість XML повернуто HTML (помилка/логін) URL карти насправді віддає HTML: сторінку 404, стіну логіну, «Access denied», антибот-сторінку або кастомну помилку. Парсер не знаходить теги <loc>. Відкрийте URL і перегляньте «View Source». Справжня карта — XML із <urlset>/<sitemapindex> і <loc>. Якщо це HTML, виправте URL карти або правила доступу на сервері.
Редиректи (301/302/307/308), ланцюжки або цикли URL карти проходить кілька редиректів або зациклюється. Фінальний URL може дати 403/404 або вести на інший домен/протокол/версію. Переконайтеся, що фінальний URL віддає 200 OK і XML. Скоротіть ланцюжки редиректів і використовуйте канонічний URL карти (зазвичай HTTPS + бажана версія WWW/без WWW).
Проблеми SSL/TLS (сертифікат, SNI, застарілі шифри) HTTPS увімкнено, але сертифікат прострочений/невалідний, ланцюжок зламаний, SNI налаштовано неправильно або TLS застарілий. Браузер може відкрити файл, а автоматичні клієнти падають на handshake. Виправте сертифікат SSL і конфігурацію TLS (повний ланцюжок, сучасні протоколи). Переконайтеся, що карта відкривається по HTTPS без попереджень.
Помилки сервера (5xx), таймаути, нестабільний хостинг Сервер повертає 500/502/503/504, зривається за таймаутом або відповідає надто повільно під час завантаження карти. Перевірте логи й ліміти сервера (PHP/CPU/RAM), налаштування CDN/origin і розмір відповіді. Додайте кеш, збільште ресурси або розбийте карту на менші файли.
Обмеження доступу (401/403), Basic Auth, staging Карта вимагає логін (Basic Auth/токени) або заблокована правилами IP/гео. Інструмент отримує 401/403. Зробіть карту публічно читабельною (принаймні для ботів пошуковиків). На staging або приберіть карту, або захистіть її навмисно.
Неправильний формат: RSS/Atom/JSON замість Sitemap XML URL схожий на карту сайту, але це фід або відповідь API. Він не відповідає протоколу Sitemap і може не містити <loc>. Знайдіть справжню карту: перевірте /robots.txt на рядок Sitemap: і спробуйте типові шляхи (/sitemap.xml, /sitemap_index.xml, /wp-sitemap.xml).
Некоректний XML (синтаксис) Незакриті теги, зламані простори імен, неекрановані символи (наприклад, & замість &) або зайвий текст перед першим <. Перевірте XML (наприклад, валідатором W3C), виправте синтаксис і спробуйте знову. Якщо перед XML є сміття, приберіть його й залиште лише документ XML.
Проблеми кодування (BOM, неправильно заявлено encoding) У файлі є BOM, дивне кодування або неправильна декларація encoding, яка ламає парсинг. Збережіть файл як UTF‑8 (без BOM) і переконайтеся, що заголовок коректний: <?xml version="1.0" encoding="UTF-8"?>. Потім вставте XML вручну.
Карта надто велика (розмір / ліміти браузера) Файл величезний (десятки МБ). Браузеру може не вистачити пам’яті, він зависне або не опрацює весь список. Розбийте карту на менші файли (краща практика: до 50 000 URL на файл) і використовуйте Sitemap Index або обробляйте частинами.
Ви завантажили Sitemap Index (не карту URL сторінок) Містить лише посилання на інші карти (дочірні), а не URL сторінок — тому в результаті може не бути сторінок. Спочатку витягніть URL дочірніх карт, потім розпарсіть кожну, щоб отримати фінальний список сторінок.
Немає тегів <loc> / нестандартна структура карти Карту згенеровано неправильно (немає тегів <loc>) або це кастомний XML, який не відповідає протоколу Sitemap. Виправте генерацію карти в CMS/плагіні. У WordPress перевірте SEO-плагін (Yoast/RankMath) або вбудований /wp-sitemap.xml.
CDN/кеш віддає різний контент (залежно від гео/UA) Сервер віддає різні відповіді залежно від User‑Agent, країни чи інших правил — XML одним, HTML/помилки іншим. Перегляньте правила CDN/WAF (варіації UA/гео) і дозвольте доступ до карти без жорстких антибот-перевірок. Вона має завжди віддавати той самий XML зі статусом 200.
Ліміт запитів (429 Too Many Requests) Сервер обмежує частоту запитів і повертає 429. Типово для слабкого хостингу або жорсткої безпеки. Збільште ліміти, додайте кеш і дозвольте доступ до карти. Якщо завантаження все одно падає, вставте XML вручну.

Для кого цей інструмент?

Екстрактор XML Sitemap заощаджує години ручної роботи: ви отримуєте чистий список URL і використовуєте його для технічного SEO, перевірки покриття індексу, лінкбілдингу, аудиту контенту та QA міграції — без обходу всього сайту й копіювання URL.

Технічні SEO-аудитори

Швидко отримайте список URL з карти для технічного аудиту: коди HTTP (404/410/5xx), редиректи й ланцюжки 301/302, дублікати та канонікали, блокування robots.txt або noindex. Це прямо впливає на бюджет обходу, частоту обходу й покриття індексу.

Приклад: експортуйте URL карти й запустіть масову перевірку статусів/редиректів, щоб за 10–15 хвилин побачити, які розділи падають і де марнується обхід.

Міграції сайту та QA редизайну

Коли змінюєте домен, переходите з HTTP на HTTPS, WWW/без WWW або перебудовуєте структуру, кожен старий URL має чисто вести на правильний новий через 301 — без циклів і довгих ланцюжків. Список URL із карти — найшвидший спосіб перевірити міграцію від початку до кінця.

Приклад: витягніть URL карти старого домену й порівняйте з новою структурою: які сторінки коректно редиректять на релевантні аналоги, а які ведуть на 404 або брудний ланцюжок.

Контент-команди та редактори

Зручно для інвентаризації та аудиту контенту: зберіть усі пости/сторінки в одну таблицю, згрупуйте в тематичні кластери, знайдіть дублікати й канібалізацію ключів, сплануйте оновлення, внутрішні посилання та покращення метатегів.

Приклад: експортуйте URL блогу з карти й зробіть трекер у Google Таблицях: статус індексу, трафік, дата оновлення, відповідальний і план покращень.

Лінкбілдинг і перевірка розміщень

Якщо купуєте посилання, публікуєте гостьові пости чи PR-розміщення, треба знати, що сторінки-донори справді в індексі Google і не зникають із видачі. Екстрактор карти швидко збирає пул URL донора, допомагає оцінити якість сторінок, провести аудит беклінків і зрозуміти, де зберігається реальна вага посилань. Також корисно для дослідження конкурентів і пошуку їхніх донорів.

Приклад: розпарсіть карту донора, знайдіть розділи «блог / новини / статті» й перевірте, що сторінки з вашими розміщеннями/беклінками проіндексовані (і не випали з індексу).

E-commerce і великі каталоги

Для e-commerce карти сайту — швидке джерело URL категорій і товарів. Легше перевірити покриття індексу, знайти проблеми з параметрами URL, фільтри (фасетна навігація), пагінацію та дублікати, які марнують бюджет обходу й гальмують індексацію.

Приклад: окремо експортуйте URL товарної та категорійної карт і порівняйте покриття індексу: що проіндексовано, а що відсутнє через дублікати, канонікали, параметри чи ліміт бюджету обходу.

PBN, прострочені домени та нішеві дослідження

Працюючи з простроченими доменами, перебудовою сайтів чи PBN, часто потрібен швидкий зріз структури й «залишкового індексу». Якщо карта є, список URL ідеальний для швидкого скринінгу: які сторінки існують, що ймовірно індексується і що варто відновлювати першим.

Приклад: перед купівлею чи перебудовою домену витягніть URL карти (якщо є), перевірте, які сторінки в індексі, перегляньте структуру й пріоритезуйте розділи для відновлення.

Поширені запитання

Чому інструмент не може завантажити мою карту сайту?

Збої завантаження зазвичай спричиняють файрволи на сервері (Cloudflare або ModSecurity), які блокують автоматичні запити. Відкрийте карту в браузері, скопіюйте вихідний код (Ctrl+U) і скористайтеся вкладкою «Вставити XML» вручну.

Чи можна витягти URL із файлу Sitemap Index?

Так. Якщо ви подасте Sitemap Index (батьківський файл із посиланнями на інші карти), інструмент витягне адреси дочірніх карт. Далі обробіть кожну дочірню карту окремо, щоб отримати фінальні URL сторінок.

Чи підтримуються карти зображень і відео?

Так. Парсер шукає стандартні теги location. Для карт зображень витягує URL батьківської сторінки. Підтримуються стандартні XML-простори імен WordPress, Shopify і Magento.

Скільки URL можна витягти за раз?

Інструмент працює в браузері й спокійно обробляє файли до 10 МБ (близько 50 000 URL). Для дуже великих файлів розділіть їх або збільште пам’ять браузера.

Чи зберігає екстрактор атрибути hreflang?

Зараз інструмент витягує основний тег <loc> (location) для перевірки індексації. Атрибути <xhtml:link> для альтернативних мов не парсяться, щоб список лишався чистим для масових аудитів.

Чому важлива дата Last Modified?

Google використовує тег <lastmod>, щоб зрозуміти, чи сторінка змінилася після останнього обходу. Цей екстрактор прибирає метадані й дає сирий список URL — саме такий формат потрібен масовим чекерам і краулерам.

Чи безпечні витягнуті дані?

Так. Парсинг відбувається локально в браузері (на клієнті) або через безстановий проксі. Ми не зберігаємо й не логуємо дані вашої карти сайту.

Як знайти URL карти сайту?

Почніть із двох найшвидших перевірок: (1) відкрийте https://example.com/robots.txt і знайдіть рядок Sitemap:, (2) спробуйте типові шляхи /sitemap.xml, /sitemap_index.xml або /wp-sitemap.xml (WordPress). Багато CMS також дають посилання на карту в налаштуваннях SEO-плагіна.

Як отримати XML-дані з сайту?

Відкрийте XML-URL прямо в браузері (наприклад, URL карти). Якщо сайт блокує автоматичне завантаження (403/WAF), натисніть Ctrl+U (перегляд коду), скопіюйте сирий XML і вставте на вкладку «Вставити XML». Так обходите CORS і багато обмежень fetch.

Чи актуальні карти сайту у 2026 році?

Так. XML-карти сайту досі ключовий технічний SEO-файл для виявлення й пріоритезації обходу — особливо для великих сайтів, каталогів e-commerce, новин і проєктів із частими оновленнями. Карти не гарантують індексацію, але допомагають пошуковикам знаходити важливі URL, читати сигнали оновлення (<lastmod>) і менше пропускати сторінки.

Як витягти URL із XML-файлу?

У стандартній карті URL зберігаються в тегу <loc>. Інструмент витягує всі значення <loc> і дає чистий список — один URL на рядок — для копіювання чи експорту в TXT/CSV/PDF.

Як завантажити файл sitemap.xml?

Відкрийте URL карти в браузері (наприклад, https://example.com/sitemap.xml). Далі (1) права кнопка → «Зберегти як…» або (2) DevTools → Network, перезавантажте сторінку, клацніть запит карти й збережіть відповідь. Якщо WAF блокує завантаження, натисніть Ctrl+U (перегляд коду) і скопіюйте сирий XML.

Чи є в Google генератор карти сайту?

Google не дає універсальної кнопки «згенерувати карту» в Search Console. На практиці карти створює CMS (WordPress, Shopify, Magento тощо), SEO-плагін (Yoast/RankMath) або бекенд/фреймворк. Після генерації URL карти подають у Google Search Console.

Як завантажити XML із браузера?

Якщо XML відкривається в браузері, зазвичай можна клацнути правою кнопкою й обрати «Зберегти як…». Якщо ні — Ctrl+U (перегляд коду), щоб скопіювати сирий XML, або DevTools → Network, щоб відкрити запит і зберегти тіло відповіді.

Як користуватися XML-картою сайту?

Типовий процес: (1) згенеруйте карту в CMS/SEO-плагіні, (2) переконайтеся, що вона віддає 200 OK і містить коректні URL у <loc>, (3) подайте її в Google Search Console, (4) стежте за покриттям і статусами індексації, (5) експортуйте URL для масових аудитів (індекс, коди відповіді, редиректи, QA міграції). Цей екстрактор допомагає на кроці (5): XML → чистий список URL.

Перевірте індексацію витягнутих URL

Завантажте чистий список URL у масовий чекер, щоб підтвердити індексацію в Google, Bing і Yandex.

Доступ через вебзастосунок • 100 безкоштовних токенів