Robots.txt dosyası hazırlama, arama motoru botlarına (Googlebot, Bingbot vb.) web sitenizin hangi sayfalarını tarayıp hangilerini taramaması gerektiğini talimatlarla bildiren en temel teknik SEO sürecidir. Web sitenizin kök dizinine (public_html) yerleştirilen bu basit metin dosyası; tarama bütçenizi (crawl budget) verimli kullanmanızı sağlar, admin paneli gibi hassas alanların taranmasını engeller ve gereksiz sunucu yükünün önüne geçer. Doğru bir robots.txt dosyası oluşturmak için; doğru komut dizilimini (User-agent, Disallow, Allow, Sitemap) tanımlamak ve dosyayı ana dizine robots.txt ismiyle kaydetmek yeterlidir.
Arama motorları bir web sitesini ziyaret ettiğinde ilk olarak bu dosyayı okur. Eğer robots.txt dosyanızda hatalı bir yönlendirme veya yanlış kural varsa, sitenizin Google indeksleri birkaç gün içinde silinebilir ya da yeni içerikleriniz arama sonuçlarında hiç görünmeyebilir. Bu rehberde, sıfırdan hatasız bir robots.txt dosyasının nasıl hazırlanacağını, WordPress ve özel yazılımlar için ideal şablonları ve yapılan kritik teknik hataları detaylarıyla ele alıyoruz.
Robots.txt Dosyası Hazırlamak İçin Temel Gereksinimler
Arama motoru standartlarına (Robots Exclusion Protocol) uygun bir dosya oluşturmadan önce aşağıdaki araçlara ve temel teknik bilgilere ihtiyacınız vardır:
- Metin Düzenleyici: Dosyayı oluşturmak için Notepad, Notepad++, Visual Studio Code veya Sublime Text gibi düz metin (plain text) işleyebilen bir yazılım kullanılmalıdır. Microsoft Word gibi biçimlendirilmiş metin araçları kesinlikle kullanılmamalıdır.
- FTP veya CPanel / Plesk Erişimi: Hazırlanan dosyayı sitenizin ana dizinine (root directory – genellikle
public_htmlveyahttpdocs) yükleyebilmek için dosya yöneticisi erişimi. - Sitemap (Site Haritası) Bağlantısı: Sitenizin aktif XML site haritası URL adresi (Örn:
https://siteadresiniz.com/sitemap.xml). - SEO Eklentisi (İsteğe Bağlı): WordPress kullanıcıları için Yoast SEO, Rank Math veya SEOPress gibi doğrudan panel üzerinden düzenleme imkanı sunan eklentiler.
- Arama Motoru Bot Bilgisi: Hangi botlara özel kurallar atayacağınızı belirlemek için bot isimlerinin (User-agent) bilinmesi.
Adım Adım Robots.txt Dosyası Hazırlama Rehberi
Aşağıdaki adımları sırasıyla takip ederek web siteniz için ideal, güvenli ve arama motoru dostu bir robots.txt dosyası oluşturabilirsiniz.
1. Adım: Dosya Biçimini ve Komut İstemlerini Anlama
Robots.txt dosyası basit direktiflerden oluşur. Dosyanızı hazırlarken kullanacağınız 4 temel terim şunlardır:
- User-agent: Kuralın hangi arama motoru botu için geçerli olduğunu belirtir. Tüm botlar için yıldız (
*) sembolü kullanılır. - Disallow: Botların erişmesini istemediğiniz dizin veya sayfa yolunu kapatır.
- Allow: Disallow ile kapatılan bir ana dizinin içerisindeki belirli bir alt sayfaya veya klasöre istisna olarak izin verir.
- Sitemap: XML site haritanızın tam adresini gösterir. Arama motorlarının sitenizi talamasını hızlandırır.
2. Adım: Metin Dosyasını Oluşturma
Bilgisayarınızda boş bir metin belgesi açın ve adını küçük harflerle robots.txt koyun. Dosya uzantısının mutlaka .txt olduğundan emin olun.
3. Adım: Standart ve Güvenli İzin Kurallarını Yazma
Genel bir web sitesi veya e-ticaret platformu işletiyorsanız, dosyanızın içerisine aşağıdaki temel şablonu ekleyebilirsiniz:
User-agent: *
Disallow: /admin/
Disallow: /private/
Disallow: /cart/
Disallow: /checkout/
Allow: /wp-admin/admin-ajax.phpSitemap: https://siteadresiniz.com/sitemap.xml
4. Adım: WordPress Sitemleri İçin İdeal Robots.txt Yapılandırması
Eğer altyapınız WordPress ise, Google’ın sitenizin görsel ve kod tasarımlarını (CSS ve JavaScript) rahatça okuyabilmesi için özel bir yapı kullanmalısınız. İdeal WordPress robots.txt içeriği şu şekilde olmalıdır:
User-agent: *
Disallow: /wp-admin/
Allow: /wp-admin/admin-ajax.php
Disallow: /readme.html
Disallow: /license.txtSitemap: https://siteadresiniz.com/sitemap_index.xml
5. Adım: Dosyayı Sunucunun Kök Dizinine Yükleme
Hazırladığınız dosyayı FTP programı (FileZilla vb.) veya cPanel Dosya Yöneticisi aracılığıyla sitenizin public_html klasörünün içine yükleyin. Yükleme tamamlandıktan sonra taraıcınızın adres çubuğuna https://siteadresiniz.com/robots.txt yazarak dosyanın erişilebilir olduğunu doğrulayın.
6. Adım: Google Search Console Üzerinden Test Etme
Dosyanızı canlıya aldıktan sonra Google Search Console paneline girin. Sol menüde yer alan “Ayarlar” sekmesinden “Robots.txt” bölümüne tıklayarak Googlebot’un dosyanızı sorunsuz okuyup okumadığını ve herhangi bir biçimlendirme hatası (Syntax Error) verip vermediğini kontrol edin.
Robots.txt Hazırlarken Yapılan Kritik Hatalar ve Püf Noktaları
Teknik SEO çalışmalarında yapılan en küçük bir robots.txt hatası, organik trafiğinizin tamamen durmasına yol açabilir. Bu nedenle şu püf noktalarına ve risklere son derece dikkat etmelisiniz:
- Sitenin Tamamını İndekse Kapatmak: Yanlışlıkla yazılan
Disallow: /komutu, tüm web sitenizin Google tarafından taranmasını ve dizine eklenmesini engeller. Bu komut yalnızca test aşamasındaki (Staging) sitelerde kullanılmalıdır. Siteniz canlıdaysa eğik çizgi (/) işaretinden sonra klasör adı belirtilmelidir. - CSS ve JavaScript Dosyalarını Engellemek: Eskiden yapılan bir teknik hata olarak
/wp-includes/veya.js/.cssuzantıları engellenirdi. Modern Googlebot, sayfayı tıpkı bir insan gibi işler (Render eder). Kod dosyalarını engellerseniz Google sitenizin tasarımını göremez ve mobil uyumluluk puanınızı düşürür. - Robots.txt Dosyasını Bir Güvenlik Duvarı Sanmak: Gizli kalmasını istediğiniz müşteri verileri veya şifreli sayfaları engellemek için bu dosyayı kullanmayın. Robots.txt herkese açık bir dosyadır. Engellediğiniz klasör adları kötü niyetli kişiler tarafından kolayca görüntülenebilir. Hassas verileri korumak için şifreleme ve
noindexmeta etiketleri kullanılmalıdır. - Büyük/Küçük Harf Duyarlılığı (Case Sensitivity): Robots.txt dosyaları büyük/küçük harfe duyarlıdır. Örneğin
Disallow: /Kategori/komutu,/kategori/adresini engellemez. URL yapınızla tam eşleşme sağlamalısınız. - Noindex Direktifini Robots.txt İçinde Kullanmak: Google, robots.txt dosyası içerisindeki
Noindex:komutunu resmi olarak desteklemeyi bıraktığını duyurmuştur. Bir sayfanın Google’da çıkmasını engellemek istiyorsanız, o sayfanın HTML kodları arasına<meta name="robots" content="noindex">etiketini eklemelisiniz.
Sıkça Sorulan Sorular (FAQ)
Robots.txt dosyası zorunlu mudur? Dosya olmazsa ne olur?
Robots.txt dosyası teknik olarak zorunlu değildir. Web sitenizde bu dosya bulunmuyorsa arama motoru botları tüm sayfalarınızı taranabilir olarak kabul eder ve sitenizi indekslemeye devam eder. Ancak büyük sitelerde tarama bütçesinin boşa harcanmaması ve yönetim paneli gibi sayfaların engellenmesi için kullanılması şiddetle tavsiye edilir.
Disallow ile engellediğim bir sayfa Google’da tamamen silinir mi?
Hayır, silinmeyebilir. Eğer başka bir web sitesi engellediğiniz o sayfaya dış bağlantı (backlink) verirse, Google içeriği tarayamasa bile sayfayı “İçerik taranamadı” uyarısıyla indeksine ekleyebilir. Sayfanın Google’dan kesin olarak silinmesi için robots.txt ile engellemek yerine sayfaya `noindex` etiketi eklemelisiniz.
WordPress kullanıyorum, robots.txt dosyam nerede?
WordPress varsayılan olarak sanal (sanal/virtual) bir robots.txt dosyası oluşturur. Fiziksel olarak sunucunuzda görünmeyebilir. Yoast SEO veya Rank Math gibi eklentiler kurarak eklenti ayarlarından “Robots.txt Düzenle” seçeneğini kullanabilir ya da sunucunuza kendiniz fiziksel bir robots.txt dosyası yükleyerek varsayılan dosyanın üzerine yazabilirsiniz.
Robots.txt dosyasında yaptığım değişiklikler ne kadar sürede geçerli olur?
Googlebot sitenizi ziyaret sıklığına bağlı olarak değişiklikleri genellikle birkaç saat ile birkaç gün arasında algılar. Süreci hızlandırmak için Google Search Console üzerindeki “URL Denetimi” aracını kullanarak ana sayfanızı yeniden taratabilir veya Search Console Ayarlar menüsünden Robots.txt dosyanızı manuel olarak yeniden çekilmeye zorlayabilirsiniz.