İçeriğe atla
SPCXTools

Robots.txt Oluşturucu

Arama motoru tarayıcılarını kontrol etmek ve yapay zeka botlarını engellemek için özel bir robots.txt dosyası oluşturun ve indirin.

Yerel çalışır — dosyalarınız cihazınızdan dışarı çıkmaz

Araç yükleniyor…

Robots.txt Oluşturucu nasıl kullanılır

  1. 1Tüm arama motorlarının sitenizi taramasına izin vermek veya engellemek için varsayılan bir kural seçin.
  2. 2Belirli kullanıcı aracıları (user-agent) ve yollar için özel kurallar ekleyin (örn. /admin/ veya /private/ erişimini engelleyin).
  3. 3Agresif botların sunucunuza aşırı yüklenmesini önlemek için isteğe bağlı bir tarama gecikmesi ayarlayın.
  4. 4Yaygın yapay zeka botlarının içeriğinizi çekmesini önleyen kuralları anında eklemek için "Yapay zeka tarayıcılarını engelle" kutusunu işaretleyin.
  5. 5Site haritası URL'lerinizi girin, ardından oluşturulan kodu kopyalayın veya dosyayı doğrudan cihazınıza indirin.

Hızlı ve gizli robots.txt oluşturucu

Arama motorlarının ve web kazıyıcıların web sitenizle etkileşimini yönetmek, SEO ve sunucu performansı için son derece önemlidir. Bu robots.txt oluşturucu, manuel olarak kod yazmanıza gerek kalmadan sitenizin tarayıcı talimatlarını oluşturmanız, yönetmeniz ve dışa aktarmanız için görsel bir arayüz sunar.

Araç tamamen tarayıcınızda çalıştığı için site yapınız, gizli dizinleriniz ve yapılandırma ayarlarınız tamamen gizli kalır. Oluşturucuya girdiğiniz hiçbir veri sunucuya gönderilmez. Hemen kopyalayabileceğiniz veya indirebileceğiniz, anında güncellenen canlı bir çıktı elde edersiniz.

Temel özellikler ve yetenekler

Varsayılan Erişim Politikaları: Tüm botlar için temel davranışı belirleyerek başlayın. Her şeye izin vermeyi (çoğu herkese açık web sitesi için standarttır) veya hiçbir şeye izin vermemeyi (test ortamları veya özel ağlar için kullanışlıdır) seçebilirsiniz.

Özel Yönergeler: Belirli botları veya yolları hedefleyen özel kurallar ekleyin. Belirli botların bazı dosyalara erişmesine izin verirken, tüm tarayıcıların /admin/ veya /search gibi hassas dizinlere erişmesini engelleyebilirsiniz.

Yapay Zeka Botlarını Engelleme: Büyük dil modellerinin yaygınlaşmasıyla birlikte, birçok web sitesi sahibi içeriklerinin yapay zeka eğitimi için taranmasını istemiyor. Bu araç, yapay zeka tarayıcılarını engellemek için özel robots.txt kuralları içerir. Tek bir kutuyu işaretleyerek GPTBot, ClaudeBot, PerplexityBot, Google-Extended, Applebot-Extended ve Bytespider gibi en yaygın yapay zeka botları için anında Disallow: / yönergeleri ekleyebilirsiniz.

Tarama Gecikmesi: Sunucunuz otomatik botlardan gelen yoğun trafik nedeniyle zorlanıyorsa bir tarama gecikmesi ayarlayabilirsiniz. Bu özellik, botlara istekler arasında belirlediğiniz saniye kadar beklemesini söyleyen bir Crawl-delay yönergesi oluşturur.

Site Haritası Entegrasyonu: robots.txt site haritası yönergesi, arama motorlarına XML site haritalarınızı nerede bulacaklarını göstermenin en etkili yoludur. Birden fazla site haritası URL'sini (her satıra bir tane gelecek şekilde) yapıştırabilirsiniz; araç bunları uygun şekilde biçimlendirerek dosyanızın en altına ekler.

Etkili bir robots.txt dosyası nasıl oluşturulur

robots.txt dosyası oluştururken, tarayıcıların talimatları nasıl okuduğunu anlamak önemlidir. Dosya, her biri bir User-agent bildirimiyle başlayan ve ardından geçerli kuralların sıralandığı bloklara ayrılır.

  1. User-agent'ı Belirleyin: User-agent, botun adıdır. Yıldız (*) işareti kullanmak, kuralı tüm botlar için geçerli kılar. Sadece Google'ın görsel botunu hedeflemek isterseniz Googlebot-Image kullanmalısınız.
  2. Yolu Belirleyin: Yollar, alan adınızın kök dizinine göredir ve eğik çizgi (/) ile başlamalıdır. Bütün bir dizini engellemek için sonuna eğik çizgi ekleyin (örn. /private/). Belirli bir dosyayı engellemek için dosya uzantısını belirtin (örn. /data.csv).
  3. Öncelik Sırası: Çoğu modern tarayıcı, kendi adıyla eşleşen en spesifik user-agent bloğunu dikkate alır. Googlebot sitenizi ziyaret ettiğinde User-agent: * bloğunu yok sayarak doğrudan User-agent: Googlebot altındaki kuralları izler. Bu oluşturucu, temiz ve geçerli bir çıktı elde etmeniz için kurallarınızı user-agent'a göre otomatik olarak düzenler.

Sınırlamaları anlamak

Bir robots txt oluşturucu sözdizimini yazmayı kolaylaştırsa da, bu dosyanın neleri yapamayacağını anlamak çok önemlidir.

Bir güvenlik önlemi değildir. robots.txt dosyanızda bir yolu engellemek, saygılı botlara o sayfayı taramamalarını söyler, ancak kötü niyetli kazıyıcılar bu dosyayı tamamen görmezden gelir. Ayrıca, herkes tarayıcısından ilgili adrese giderek robots.txt dosyanızı okuyabilir; bu da gizli dizinlerinizin yerini herkese açık bir şekilde duyurduğunuz anlamına gelir. Gerçek güvenlik için uygun kimlik doğrulama yöntemlerini ve 401 Unauthorized veya 403 Forbidden gibi uygun HTTP Durum Kodları'nı kullanın.

Dizinden çıkarılmayı garanti etmez. Bir sayfa robots.txt içinde engellenmişse, Google o sayfayı taramaz. Ancak, bu sayfaya web'deki başka bir yerden bağlantı verilmişse, Google URL'nin kendisini yine de dizine ekleyebilir (genellikle "Bu sayfa için bilgi mevcut değil" gibi bir mesaj göstererek). Amacınız bir sayfayı arama motoru sonuçlarından tamamen kaldırmaksa, robots.txt dosyasında taramaya izin vermeli ve bunun yerine bir noindex HTML etiketi kullanmalısınız. Doğru etiketleri Meta Etiket Oluşturucu'muzu kullanarak oluşturabilirsiniz.

Yayına alma ve test

Kurallarınızı yapılandırdıktan sonra dosyayı kaydetmek için indir'e tıklayın. Dosyanın adı tam olarak robots.txt (tamamı küçük harf) olmalı ve alan adınızın kök dizinine yüklenmelidir. Örneğin, https://yourdomain.com/robots.txt. Dosyayı https://yourdomain.com/assets/robots.txt gibi bir alt klasöre koyarsanız, arama motoru botları dosyayı bulamaz ve herhangi bir kısıtlamanız olmadığını varsayar.

Sıkça sorulan sorular

robots.txt dosyası nedir?
robots.txt dosyası, bir web sitesinin kök dizinine yerleştirilen basit bir metin dosyasıdır. Web robotlarına (Googlebot gibi) sitenizden hangi sayfaları veya dosyaları isteyip isteyemeyecekleri konusunda talimatlar verir.
Yapay zeka botlarını nasıl engellerim?
Bu araçtaki "Yapay Zekayı Engelle" seçeneğini işaretlemek; GPTBot, ChatGPT-User, ClaudeBot, PerplexityBot, Google-Extended ve benzeri bilinen yapay zeka veri kazıyıcılarını (scraper) engelleyen kuralları otomatik olarak ekler. Bu sayede botlara, web sitenizin içeriğini büyük dil modellerini eğitmek için kullanmamaları gerektiği bildirilir.
Tarama gecikmesi (crawl delay) ne işe yarar?
Tarama gecikmesi komutu, botlara sunucunuza yapacakları ardışık istekler arasında kaç saniye beklemeleri gerektiğini söyler. Agresif tarayıcılar çok fazla bant genişliği tüketiyorsa veya web sitenizi yavaşlatıyorsa kullanışlıdır. Google gibi bazı arama motorlarının bu komutu dikkate almadığını, ancak diğer birçoğunun buna uyduğunu unutmayın.
robots.txt dosyasını nereye eklemeliyim?
Web sitenizin en üst düzey kök dizinine yerleştirilmelidir. Örneğin, alan adınız example.com ise, dosyaya tam olarak https://example.com/robots.txt adresinden erişilebilmelidir. Bir alt dizine yerleştirilirse tarayıcılar dosyayı bulamaz.
Bu aracı kullanırken web sitesi verilerim bir sunucuya gönderiliyor mu?
Hayır. Bu robots.txt oluşturucu tamamen web tarayıcınızda yerel olarak çalışır. Kurallarınız, yollarınız ve site haritası URL'leriniz hiçbir zaman sunucularımıza yüklenmez veya kaydedilmez.
robots.txt sayfalarımı arama sonuçlarından gizler mi?
Her zaman değil. Arama motorlarının sayfa içeriğini taramasını engellese de, başka sitelerden bağlantı verilmişse URL arama sonuçlarında çıkmaya devam edebilir. Bir sayfayı arama motoru dizinlerinden tamamen kaldırmak için bunun yerine "noindex" meta etiketi kullanmalısınız.