DevToolPal
TR

Robots.txt Oluşturucu

Bir robots.txt dosyası oluşturun: user-agent başına yollara izin verin veya engelleyin, site haritası ve crawl-delay ekleyin, yapay zekâ tarayıcılarını tek tıkla engelleyin.

Yerelde çalışır, asla yüklenmez

Seçenekler

robots.txt

0 karakter · 0 B

Bu araç ne yapar

Robots.txt oluşturucu, tarayıcılara sitenizin hangi bölümlerini indirebileceklerini söyleyen robots.txt dosyasını yazar. Ana kural grubunun user-agent’larını seçin, engellenecek yolları ve izin verilen istisnaları listeleyin, isterseniz bir crawl-delay ve bir veya daha fazla site haritası URL’si ekleyin; dosya siz yazdıkça güncellenir.

Hazır ayarlar yaygın durumları tek tıkla karşılar: Tümüne izin ver, Tümünü engelle (test siteleri için kullanışlı) ve bir WordPress başlangıcı. Ayrı bir ayar, yapay zekâ tarayıcılarını yalnızca model eğitimi için ya da yapay zekâ araması ve asistan getirme ajanları dahil tamamen engeller; SEO tarayıcıları gibi diğer botları da adlarıyla engelleyebilirsiniz. Yollar, user-agent adları ve site haritası URL’leri denetlenir; böylece unutulmuş bir baştaki eğik çizgi ya da göreli bir site haritası, sessizce bozuk bir dosya üretmek yerine bildirilir.

Nasıl kullanılır

  1. Bir hazır ayarla başlayın ya da her şeye izin veren varsayılanı koruyun.
  2. Engellenen yollar alanına tarayıcıların girmemesi gereken klasörleri veya desenleri virgülle ayırarak yazın, örneğin /admin/, /cart/, /*?sort=. Bunların içindeki istisnalar için İzin verilen yollar alanını kullanın.
  3. Arama motorlarının ayrıca gönderilmeden bulabilmesi için site haritası URL’nizi ekleyin.
  4. Yapay zekâ tarayıcılarına nasıl davranılacağını seçin ve engellenecek diğer botları ekleyin.
  5. Dosyayı robots.txt olarak indirin ve https://example.com/robots.txt adresinden sunulacak şekilde alan adınızın köküne yükleyin. Her alt alan adının kendi dosyası olmalıdır.

Örnek

/admin/ yolunu /admin/public/ istisnasıyla engellemek, bir site haritası eklemek ve yapay zekâ eğitim tarayıcılarını engellemek şunu üretir:

# All crawlers
User-agent: *
Disallow: /admin/
Allow: /admin/public/

# AI training crawlers
User-agent: GPTBot
User-agent: ClaudeBot
User-agent: Google-Extended
User-agent: CCBot
Disallow: /

Sitemap: https://example.com/sitemap.xml

(Yapay zekâ grubu burada kısaltılmıştır; araç tüm tarayıcıları listeler.) Ardından kurallar gelen birden çok User-agent satırı, hepsine uygulanan tek bir grup oluşturur ve bir tarayıcı yalnızca kendisini adıyla anan en özel gruba uyar.

İpuçları

  • * herhangi bir karakter dizisiyle, $ ise URL’nin sonuyla eşleşir; bu yüzden /*.pdf$ tüm PDF’leri engeller.
  • Allow ve Disallow birlikte eşleştiğinde Google en uzun (en özel) kuralı uygular.
  • Sayfaların görüntülenmesi için gereken CSS ve JavaScript dosyalarını engellemeyin; aksi hâlde arama motorları sayfalarınızı yanlış değerlendirebilir.
  • Değişikliklere güvenmeden önce Google Search Console’daki robots.txt raporuyla test edin.

SSS

› robots.txt'deki Disallow bir sayfayı Google'dan kaldırır mı?

Hayır. Disallow kurallara uyan tarayıcıların bir URL'yi indirmesini engeller, ancak başka siteler bağlantı veriyorsa URL yine de (özet olmadan) dizine eklenebilir. Bir sayfayı arama sonuçlarının dışında tutmak için taranmasına izin verin ve noindex robots meta etiketini ya da X-Robots-Tag başlığını kullanın.

› Araç hangi yapay zekâ tarayıcılarını engeller?

Eğitim tarayıcılarını engelle; GPTBot, ClaudeBot, anthropic-ai, Google-Extended, Applebot-Extended, CCBot, Bytespider, Meta-ExternalAgent, Amazonbot ve model eğitimi için veri toplayan diğer botları ekler. Tüm yapay zekâ botlarını engelle ayrıca OAI-SearchBot, ChatGPT-User, Claude-SearchBot, Claude-User, PerplexityBot ve Perplexity-User gibi yapay zekâ arama dizinleyicilerini ve asistan getirme ajanlarını da ekler; bu da sayfalarınızın yapay zekâ yanıtlarında alıntılanmasını engelleyebilir.

› Tüm tarayıcılar robots.txt'ye uyar mı?

Saygın arama motorları ve büyük yapay zekâ şirketleri uyduklarını söyler, ancak robots.txt bir erişim denetimi değil, bir gelenektir. Kazıyıcılar onu yok sayabilir; bu yüzden özel içeriği kimlik doğrulamayla koruyun, kötü niyetli botlar için sunucu kuralları veya güvenlik duvarı kullanın.

› Crawl-delay destekleniyor mu?

Bing, Yandex ve bazı diğer tarayıcılar Crawl-delay'e uyar; Google ise onu yok sayar ve tarama hızını sunucunuzun yanıt hızına göre otomatik ayarlar.