Генератор robots.txt
Оберіть, яким кравлерам дозволено читати ваш сайт, — і генератор складе для нього валідний robots.txt. Щоб заблокувати AI-кравлера, достатньо двох рядків — User-agent: GPTBot, а під ним Disallow: /. Генератор так само згрупує всіх заблокованих кравлерів, залишить Google і Bing на спільних правилах і додасть sitemap у кінці.
Почніть із готового набору: рекомендований блокує кравлерів, що збирають дані для навчання моделей, але пропускає пошукових і тих, що формують AI-відповіді. Потім перевірте будь-який URL — на згенерованому файлі або на живому robots.txt будь-якого сайту.
Генератор robots.txt
Файл збирається у вашому браузері. «Завантажити з сайту» просить наш сервер прочитати публічний robots.txt — нічого не зберігається.Почніть із готового набору
Оберіть найближчу до вашої політику, а потім змініть правила для окремих кравлерів нижче.
AI- і пошукові кравлери
Кожен заблокований кравлер отримує Disallow: / для всього сайту. Дозволеним окреме правило не потрібне: вони виконують шляхи, задані для всіх кравлерів.
AI-пошук і відповіді
Завантажують сторінки, які асистенти цитують або відкривають на прохання користувача. Заблокуєте — вас не цитуватимуть.
OAI-SearchBotOpenAI
Формує індекс, з якого цитує пошук ChatGPT. Блокування прибирає вас із відповідей ChatGPT.
ChatGPT-UserOpenAI
Завантажує сторінку, коли користувач прямо просить ChatGPT відкрити ваше посилання. Блокування ламає це завантаження на вимогу.
Claude-UserAnthropic
Завантажує сторінку, коли користувач Claude прямо просить ваше посилання.
PerplexityBotPerplexity
Індексує сторінки, які Perplexity цитує у відповідях. Блокування прибирає вас із його цитувань.
AmazonbotAmazon
Живить відповіді Alexa та AI-функції Amazon.
Навчання моделей
Збирають тексти для навчання AI-моделей. Їхнє блокування не впливає на позиції в Google і Bing.
GPTBotOpenAI
Збирає сторінки для навчання моделей OpenAI. Блокування не пускає вас у навчальні дані, але не впливає на цитування в пошуку ChatGPT.
ClaudeBotAnthropic
Кравлер Anthropic для навчальних даних моделей.
Google-ExtendedGoogle
Керує використанням вашого контенту для навчання та обґрунтування Gemini. На звичайне ранжування в Google це НЕ впливає.
Applebot-ExtendedApple
Керує використанням контенту для навчання Apple Intelligence. Звичайне індексування Applebot — окремо.
meta-externalagentMeta
Кравлер Meta для AI-продуктів і навчання моделей.
BytespiderByteDance
Кравлер ByteDance. Його часто блокують за ігнорування очікуваної частоти сканування; поза екосистемою TikTok втрати від блокування невеликі.
CCBotCommon Crawl
Архів Common Crawl опосередковано живить багато відкритих датасетів і моделей.
Класичний пошуковий індекс
Власні кравлери Google і Bing. AI Overviews і Copilot будуються на цих індексах, тож блокування прибирає вас і з пошуку, і з цих відповідей.
GooglebotGoogle
Класичний кравлер Google. AI Overviews будуються на цьому індексі, тож блокування прибирає вас і з пошуку, і з AI Overviews.
BingbotMicrosoft
Кравлер Bing. Відповіді Microsoft Copilot спираються на індекс Bing.
Шляхи для всіх кравлерів
Ці правила потрапляють у групу User-agent: * і діють для всіх дозволених кравлерів. Один шлях на рядок.
* означає будь-які символи, а $ — кінець URL, як у /*.pdf$
Знову відкриває частину закритої теки. Перемагає довше, точніше правило.
Sitemap
Повний URL вашого XML-sitemap, щоб кравлери знаходили всі сторінки.
Параметри файлу
# Generated with seonix.ai User-agent: GPTBot User-agent: ClaudeBot User-agent: Google-Extended User-agent: Applebot-Extended User-agent: meta-externalagent User-agent: Bytespider User-agent: CCBot Disallow: / User-agent: * Disallow:
Завантажте його в корінь сайту, щоб він відкривався за адресою yourdomain.com/robots.txt
Уже завантажили? Перевірте живий файл у «Перевірці AI-кравлерів»
Тестер robots.txt
Перевіряємо: згенерований файлПеревірте, чи може кравлер завантажити URL за цими правилами і який рядок це вирішує.
GPTBot не може сканувати /
- Вирішальне правило
Disallow: /- Застосована група
User-agent: GPTBot(власна група)
Як користуватися
- 01
Оберіть набір правил
Дозвольте всіх кравлерів, заблокуйте лише навчання AI (рекомендований компроміс) або всіх AI-кравлерів. Потім перемикайте окремих кравлерів між «Дозволити» і «Заблокувати».
- 02
Додайте шляхи та sitemap
Перелічіть теки, куди не слід заходити жодному кравлеру, як-от /admin/ чи /cart/, винятки, які всередині них треба відкрити, і повний URL вашого XML-sitemap.
- 03
Перевірте перед публікацією
У тестері оберіть кравлера й шлях — і побачите, чи дозволено доступ і який рядок це вирішує. Там же можна завантажити живий robots.txt будь-якого сайту.
- 04
Покладіть файл у корінь сайту
Завантажте robots.txt і розмістіть його в корені домену, щоб він відкривався за адресою yourdomain.com/robots.txt. Деінде кравлери його не шукають.
Що robots.txt може, а чого — ні
robots.txt — це прохання, а не замок. Добросовісні кравлери його дотримуються; бота, який його ігнорує, можна зупинити лише на рівні сервера, CDN чи файрвола.
Блокування URL не прибирає його з результатів пошуку: Google усе одно може показати заблоковану сторінку, знайдену за посиланнями, — просто без опису. Щоб сторінки не було в індексі, дозвольте її сканувати й додайте метатег noindex або заголовок X-Robots-Tag.
Файл публічний — будь-хто може відкрити yourdomain.com/robots.txt, — тож згадка приватної теки лише привертає до неї увагу. Захищайте закриті розділи паролем, а не Disallow.
Параметра crawl-delay тут немає, бо Google цю директиву ігнорує. До того ж robots.txt діє лише для хоста, на якому лежить, тож кожному піддомену потрібен власний файл.
Усе працює у вашому браузері. Єдиний виняток — необовʼязкова кнопка «Завантажити із сайту» в тестері: наш сервер читає публічний robots.txt цього сайту, повертає його і нічого не зберігає.
Seonix помічає помилки в robots.txt, перш ніж вони коштуватимуть вам трафіку
Безкоштовний аудит сайту від Seonix помічає AI-кравлерів, заблокованих у robots.txt, robots.txt, що блокує sitemap, відсутній robots.txt і метатеги, які обмежують використання сторінок AI. А далі Seonix знаходить, що шукають ваші покупці, і за розкладом публікує на вашому сайті статті з відповідями — більш ніж 50 мовами.
SEO на автопілоті для вашого сайту
Seonix досліджує, пише й публікує статті — і стежить за технічною стороною — хоч би де жив ваш сайт.
Сайти на WordPress
Безкоштовний плагін Seonix підключається в один клік: статті публікуються як нативні пости, а SEO-виправлення та llms.txt плагін бере на себе.
Автоматизація SEO для WordPressSaaS-продукти
Ваш AI-агент підключає застосунок до Seonix одним промтом; далі статті під реальні запити публікуються на вашому домені за розкладом.
SEO для SaaS на автопілотіСамописні сайти
WordPress не потрібен: сайт відкриває один невеликий ендпоінт, і статті з'являються як нативні сторінки у вашому дизайні.
SEO для самописних сайтівЧасті запитання
Як заблокувати GPTBot у robots.txt?
Чи варто блокувати AI-кравлерів?
Чи зупиняє robots.txt навчання AI?
Де має лежати файл robots.txt?
Чим robots.txt відрізняється від noindex?
Інші безкоштовні інструменти
AI SEO Checker
Чи можуть ChatGPT, Perplexity і Google AI Overviews прочитати й процитувати вашу сторінку? Оцінка й головні виправлення.
Перевірка AI-кравлерів
Побачте, яким AI-кравлерам дозволяє ваш robots.txt і чого коштує блокування кожного.
Генератор llms.txt
Створіть валідний за специфікацією llms.txt, який показує моделям, які ваші сторінки важливі.
