Arama Motoru Tarayıcı Yönergesi & Güvenlik

Hatasız Robots.txt Oluşturucu

WordPress, E-Ticaret, Laravel veya özel PHP yazılımınız için Googlebot ve arama motorlarının sitenizi hatasız taramasını sağlayan robots.txt yönergelerini anında üretin ve doğrulayın.

Hazır Şablonlar İle Hızlı Başlayın
Tarama Yönerge Parametreleri
robots.txt Canlı Çıktı
Standartlara uygun ve geçerli yönergeler oluşturuldu.
robots.txt İndir
1

Şablonu Belirleyin

WordPress, WooCommerce veya Laravel gibi altyapınıza uygun hazır şablonu seçip form alanlarını doldurun.

2

Doğrulayın & İndirin

Sağdaki canlı panelde bot yönergelerini ve güvenlik uyarılarını inceleyin; tek tıkla robots.txt dosyanızı indirin.

3

Kök Dizine Yükleyin

FTP veya cPanel File Manager aracılığıyla public_html / www kök dizininize robots.txt olarak yükleyin.

Robots.txt (Robots Exclusion Protocol - RFC 9309) ve Tarama Bütçesi Rehberi

Arama motoru optimizasyonunun (SEO) en temel ve aynı zamanda en tehlikeli dosyası robots.txt protokolüdür. Web sitenizin kök dizininde yer alan bu yalın metin dosyası, arama motoru örümceklerine (Googlebot, Bingbot, YandexBot vb.) ve yapay zeka tarayıcılarına (GPTBot, ClaudeBot) sitenizin hangi dizinlerini tarayabileceğini, hangi yollardan uzak durması gerektiğini bildirir. Doğru yapılandırılmış bir robots.txt dosyası tarama bütçenizi (crawl budget) optimize ederek kritik sayfalarınızın indekslenme hızını katlarken; yanlış yerleştirilen tek bir eğik çizgi (Disallow: /) milyonlarca liralık bir web sitesinin Google dizininden saatler içinde tamamen silinmesine yol açabilir. inovoice Robots.txt Oluşturucu & Doğrulayıcı, RFC 9309 standartlarına tam uyumlu hatasız yönergeler hazırlamanızı sağlar.

1. Robots Exclusion Protocol (REP) Standartları ve RFC 9309

Robots.txt standardı ilk kez 1994 yılında Martijn Koster tarafından gayriresmi bir uzlaşı olarak ortaya atılmış; 2022 yılında ise Internet Engineering Task Force (IETF) tarafından resmi olarak RFC 9309 numarasıyla internet standardı haline getirilmiştir. Bu standarda göre:

  • Robots.txt dosyası mutlaka web sitesinin en üst kök dizininde (https://alanadiniz.com/robots.txt) yer almalıdır. Alt dizinlerdeki (örneğin /tr/robots.txt) dosyalar botlar tarafından tamamen yok sayılır.
  • Dosya UTF-8 formatında kodlanmış düz metin (text/plain) olmalı ve HTTP 200 durum koduyla sunulmalıdır. Dosya boyutu maksimum 500 Kibibyte (KiB) sınırını aşmamalıdır; aşan kısımlar Googlebot tarafından kesilir.
  • Eğer sunucu robots.txt için 5xx Sunucu Hatası döndürürse, Googlebot sitenize zarar vermemek adına tüm tarama işlemlerini geçici olarak durdurur. 404 Bulunamadı kodu dönerse, hiçbir kısıtlama olmadığını varsayarak tüm siteyi tarar.

2. Temel Direktifler, Sözdizimi Kuralları ve Joker Karakterler (Wildcards)

Robots.txt dosyası yukarıdan aşağıya doğru satır satır işlenen yönerge bloklarından oluşur:

  1. User-agent: Yönergenin hangi arama motoru veya bot için geçerli olduğunu tanımlar. Yıldız sembolü (User-agent: *) tüm genel botları kapsar. Özel bir bot hedeflenecekse (örneğin User-agent: Googlebot veya User-agent: GPTBot) ayrı bir blok açılır.
  2. Disallow: Botların erişmesini istemediğiniz dizin veya URL yolunu belirtir. Örneğin Disallow: /admin/ yazıldığında /admin/ ile başlayan hiçbir sayfa taranmaz.
  3. Allow: Engellenmiş bir ana dizin altındaki belirli bir dosya veya alt klasöre istisnai izin vermek için kullanılır. Örneğin Disallow: /wp-admin/ kuralının hemen altına Allow: /wp-admin/admin-ajax.php eklenerek tema/eklenti AJAX çağrılarının taranması sağlanır.
  4. Sitemap: XML site haritanızın tam mutlak URL adresini (Sitemap: https://siteniz.com/sitemap_index.xml) belirtir. Botların yeni içerikleri keşfetmesini hızlandırır. Birden fazla sitemap satırı eklenebilir.
  5. Joker Karakterler (* ve $):
    • * (Yıldız): Sıfır veya daha fazla karakteri temsil eder. Örneğin Disallow: /*?*sort= yönergesi içinde soru işareti ve sort parametresi geçen tüm dinamik filtre URL'lerini engeller.
    • $ (Dolar): URL'nin tam olarak bittiği yeri simgeler. Örneğin Disallow: /*.pdf$ yönergesi sadece .pdf uzantısıyla biten dosyaları engeller.
# inovoice Kurumsal E-Ticaret Robots.txt Mimarisi Örneği
User-agent: *
Disallow: /sepet/
Disallow: /odeme/
Disallow: /hesabim/
Disallow: /admin/
Disallow: /*?*search=
Disallow: /*?*filter_*
Allow: /wp-admin/admin-ajax.php
Allow: /*.css$
Allow: /*.js$

# Yapay Zeka Botlarının Veri Kazımasını Engelleme
User-agent: GPTBot
Disallow: /

User-agent: CCBot
Disallow: /

Sitemap: https://inovoice.com.tr/sitemap.xml

3. En Kritik SEO İkilemi: Disallow ile Noindex Arasındaki Fark

SEO sektöründe yapılan en yaygın ve tehlikeli hata; arama sonuçlarından kaldırılmak istenen sayfaların robots.txt ile engellenmesidir. Bu iki kavramın çalışma mantığı tamamen farklıdır:

  • Disallow (Tarama Engeli): Botun o sayfaya gidip HTML kodunu indirmesini ve çalıştırmasını engeller. Ancak bu sayfa internette başka bir sayfadan veya siteden link alıyorsa, Google o sayfayı dizine ekleyebilir. Arama sonuçlarında "Bu sonuç için sayfa sahibinin uyguladığı robots.txt nedeniyle bir açıklama sunulamıyor" uyarısıyla URL açık kalır.
  • Noindex (İndeks Engeli): Sayfanın arama motoru dizininden tamamen çıkarılmasını sağlar. Bunun çalışabilmesi için botun sayfayı tarayabilmesi gerekir! Eğer bir sayfayı hem robots.txt ile Disallow yapıp hem sayfaya noindex etiketi koyarsanız; bot sayfayı tarayamayacağı için noindex etiketini göremez ve sayfa Google arama sonuçlarında kalmaya devam eder!

4. Tarama Bütçesi (Crawl Budget) ve E-Ticaret Optimizasyonu

Google her web sitesine, sitenin popülaritesine, sunucu hızına ve büyüklüğüne göre günlük belirli bir Tarama Bütçesi (Crawl Budget) tahsis eder. 50.000 ürünlü bir e-ticaret sitesinde; renk, beden, fiyat aralığı ve sıralama filtreleri kombinasyonlar oluşturarak milyonlarca önemsiz URL (Faceted Navigation) türetebilir.

Eğer bu gereksiz parametreler robots.txt üzerinden engellenmezse; Googlebot tüm günlük tarama kotasını anlamsız filtre sayfalarını tarayarak tüketir ve yeni eklediğiniz asıl kârlı ürünlerinizi veya güncel blog yazılarınızı aylarca indeksleyemez.

5. Gerçekçi Kurumsal Vaka Analizleri

Vaka 1: 60.000 Ürünlü E-Ticaret Sitesinde Tarama Bütçesi Kurtarma Operasyonu

Büyük bir anne-bebek e-ticaret sitesinde Google Search Console "Tarama İstatistikleri" raporunda botun günde 150.000 istek yaptığı, ancak yeni eklenen ürünlerin dizine girmesinin 3 haftayı bulduğu tespit edilmiştir. Log analizinde Googlebot'un zamanının %72'sini sonsuz filtre sayfalarında (?color=...&size=...&price=...) harcadığı anlaşılmıştır.

  • Uygulanan Çözüm: Robots.txt dosyasına parametre regex kuralları eklendi: Disallow: /*?*filter_ ve Disallow: /*?*sort=.
  • Elde Edilen Sonuç: Boşa harcanan tarama trafiği 48 saat içinde %85 azaldı. Googlebot tarama enerjisini yeni eklenen ürün sayfalarına yöneltti; ortalama ürün indeksleme süresi 21 günden 4 saate düştü ve sitenin organik trafiği 2 ay içinde %42 artış kaydetti.

Vaka 2: Canlıya Alınırken Unutulan "Disallow: /" Faciası ve Kriz Yönetimi

Kurumsal bir B2B makine üreticisi, yeni web sitesi tasarımını test (staging) sunucusundan canlı alan adına taşırken yazılım ekibi test ortamındaki Disallow: / kuralını robots.txt dosyasında unutmuştur.

  • Yaşanan Kriz: 5. günün sonunda şirketin Google'daki 120 anahtar kelimelik ilk 3 sıra pozisyonu SERP'ten silinmeye başlamış, organik form talepleri bıçak gibi kesilmiştir.
  • Müdahale Protokolü: inovoice acil müdahalesiyle robots.txt temizlendi, Google Search Console üzerinden "robots.txt'yi yeniden test et ve bildir" isteği tetiklendi ve ana XML site haritası Google API aracılığıyla anlık 'Ping' edildi. Site sıralamaları 96 saat içinde eski pozisyonlarına başarıyla döndürüldü.

6. Popüler Platformlar İçin Doğru Robots.txt Kıyaslama Tablosu

Web Altyapısı Önerilen Disallow Yolları Zorunlu Allow İstisnaları Kritik Dikkat Noktası
WordPress / Blog /wp-admin/, /trackback/, /xmlrpc.php /wp-admin/admin-ajax.php /wp-content/ ve /wp-includes/ engellenmemeli (CSS/JS kilitlenir)
WooCommerce / E-Ticaret /cart/, /checkout/, /my-account/, /*?add-to-cart= /wp-content/uploads/ Filtre ve sıralama parametreleri joker karakterle kısıtlanmalı
Laravel / Özel PHP /admin/, /storage/logs/, /api/internal/ /assets/, /build/ Blade şablonlarının kullandığı derlenmiş CSS/JS yolları açık olmalı
Shopify /checkout, /carts, /orders, /search Shopify CDN varlıkları Shopify robots.txt dosyasını 'robots.txt.liquid' şablonundan yönetir
Next.js / Headless /api/, /_next/data/ /_next/static/ SSR/SSG sayfalarında statik build klasörlerinin taranabilmesi şarttır

7. Robots.txt Yapılandırmasında Yapılan 6 Kritik Hata

Hata 1: CSS ve JavaScript Dosyalarını Engelleyerek Render'ı İmkansız Kılmak
Googlebot artık sayfaları modern bir tarayıcı gibi render etmekte (görsel olarak çizmekte) ve mobil uyumluluğu kontrol etmektedir. Eğer /assets/ veya /css/ klasörlerini Disallow yaparsanız, Google sitenizi kırık/bozuk algılar ve mobil uyumluluk cezası verir.
Hata 2: Canlı Sitede Yanlışlıkla "Disallow: /" Bırakmak
Staging ortamında test edilirken botların girmesini engellemek için konulan tek bir eğik çizgi canlıya aktarılırken silinmezse, şirketin tüm organik trafiği günler içinde sıfırlanır. Canlıya çıkış kontrol listesinde robots.txt ilk sırada denetlenmelidir.
Hata 3: Gizli / Hassas Sayfaları Robots.txt ile İfşa Etmek
Robots.txt dosyası herkese açık (public) bir dosyadır. Disallow: /gizli-musteri-listesi-2026/ gibi bir satır yazmak kötü niyetli korsanlara doğrudan hedef göstermektir. Hassas sayfalar robots.txt ile değil, parola ve sunucu düzeyinde erişim kısıtlamasıyla korunmalıdır.
Hata 4: Büyük/Küçük Harf (Case Sensitivity) Duyarlılığını Unutmak
Robots.txt protokolü büyük/küçük harfe duyarlıdır. Disallow: /admin/ yönergesi /Admin/ veya /ADMIN/ adreslerini engellemez. URL yapınızın harf standardına göre kurallar kurgulanmalıdır.
Hata 5: Sayfayı Dizinden Kaldırmak İçin Disallow Kullanmak
Bir URL'yi Google dizininden kaldırmak istiyorsanız o sayfayı robots.txt'den engellememelisiniz. Bot sayfayı ziyaret edebilmeli ve sayfanın kaynak kodundaki <meta name="robots" content="noindex"> etiketini okuyup dizinden silmelidir.
Hata 6: Sitemap Direktifine Göreceli (Relative) Yol Yazmak
Sitemap: /sitemap.xml gibi göreceli yollar geçersizdir. Arama motorları mutlak URL bekler: Sitemap: https://inovoice.com.tr/sitemap.xml şeklinde protokol ve alan adı eksiksiz yazılmalıdır.

Sıkça Sorulan Sorular

Robots.txt, IETF RFC 9309 standardına dayalı olarak arama motoru örümceklerine (Googlebot, Bingbot vb.) web sitesinin hangi dizin ve URL yollarını tarayıp hangilerini taramaması gerektiğini bildiren kritik bir yönerge protokolüdür. Yönetim panelleri, filtre parametreleri ve geçici dosyaların taranmasını engelleyerek sunucu yükünü dengeler ve tarama bütçesini (crawl budget) korur.
Disallow yönergesi botun sayfayı ziyaret etmesini (taramasını) engeller; ancak sayfa harici bir siteden link alıyorsa URL Google dizinine eklenebilir ve arama sonuçlarında başlıksız/açıklamasız görünebilir. 'noindex' meta etiketi ise sayfanın arama sonuçlarından tamamen silinmesini sağlar. Bir sayfayı dizinden kaldırmak için robots.txt'den engellememeli, botun sayfaya girip 'noindex' etiketini okumasına izin verilmelidir.
"Disallow: /" yönergesi, web sitesinin kök dizini dahil tüm içeriğini arama motorlarının taramasına tamamen kapatır. Bu komut yalnızca geliştirme (staging) ve test ortamlarında kullanılmalıdır. Canlı yayındaki bir web sitesine yanlışlıkla eklendiğinde sitenin Google'daki tüm organik indeksleri ve sıralamaları günler içinde SERP'ten silinir.
Tarama bütçesi, Google botlarının belirli bir süre içinde sitenizde tarayabileceği maksimum sayfa sayısıdır. Büyük e-ticaret sitelerinde filtreler, sıralama varyasyonları, sepet ve oturum sayfaları yüz binlerce sonsuz URL türetir. Bu yollar robots.txt üzerinden 'Disallow: /*?*sort=' gibi kurallarla engellenerek botun yalnızca gerçek ürün ve kategori sayfalarını taraması sağlanır.
Yapay zeka modellerinin içeriğinizi izinsiz tarayıp eğitilmesini önlemek için robots.txt dosyasına 'User-agent: GPTBot', 'User-agent: CCBot' ve 'User-agent: ClaudeBot' tanımları eklenip altına 'Disallow: /' yazılarak bu botların siteye erişimi tamamen durdurulabilir.
Robots.txt dosyası her zaman web sitesinin en üst kök dizinine (root domain) yüklenmelidir ve doğrudan 'https://siteniz.com/robots.txt' adresinden HTTP 200 koduyla açılmalıdır. Alt klasörlere (örneğin /blog/robots.txt) konulan dosyalar botlar tarafından geçersiz sayılır. Google Search Console 'robots.txt Test Aracı' üzerinden canlıda doğrulanabilir.
Teknik SEO & Bot Mimarisi

Tarama Bütçenizi (Crawl Budget) Optimize Edin

inovoice; sunucu log analizleri, indeksleme optimizasyonu ve ileri düzey robots yönergeleriyle web sitenizin organik arama performansını zirveye taşır.

Teknik SEO Desteği Alın →
✓ Kopyalandı!
Teklif Alın

Projenizi Anlatın

Fikirlerinizi gerçeğe dönüştürmek için ilk adımı atın. Uzman ekibimiz hemen dönüş yapsın.

Talebiniz başarıyla alındı.
Size en kısa sürede ulaşacağız.
Hemen Ara WhatsApp Teklif Al