İçeriğe atla

Robots.txt Nedir? Nasıl Oluşturulur?

Robots.txt nedir, ne işe yarar ve nasıl oluşturulur? Robots.txt formatı, test araçları ve doğru kullanım rehberini Peaksense ile keşfedin.

EK
Ebru Köseoğlu
26 Haziran 2026
4 dk okuma süresi
SEO

Robots.txt nedir diye sorulduğunda, bu bir talimat dosyasıdır. Sitenizin kök dizinine yerleştirilen bu metin dosyası, arama motoru botlarına (spider, crawler olarak da bilinir) hangi sayfaları ziyaret edebileceklerini, hangilerini atlayacaklarını söyler.

Googlebot, Bingbot veya başka bir tarayıcı bot sitenize geldiğinde ilk iş olarak /robots.txt adresini kontrol eder. Bu dosyada verilen direktiflere göre hareket eder. Yani bu dosya, sitenizin dijital kapısındaki bir yönlendirme tabelası gibi düşünülebilir.

Peki pratikte ne işe yarar? İşte birkaç temel kullanım senaryosu:

  • Admin paneli, üye giriş sayfası gibi özel alanların taranmasını engellemek

  • Test ortamlarının veya yinelenen içeriklerin indekse girmesini önlemek

  • Crawl bütçesini verimli kullanarak önemli sayfaların daha sık taranmasını sağlamak

  • Sitemap dosyasının konumunu botlara bildirmek

  • Belirli botların siteye erişimini tamamen kısıtlamak

Önemli Not: Robots.txt, botlara bir tavsiye niteliğindedir; zorlayıcı bir güvenlik mekanizması değildir. Kötü niyetli botlar bu direktifleri görmezden gelebilir. Gerçek gizlilik için şifreleme veya kimlik doğrulama yöntemleri kullanılmalıdır.

Robots.txt Dosyası Nedir ve Formatı Nasıldır?

Robots.txt dosyası, düz metin formatında yazılmış, belirli bir sözdizimi kurallarına sahip bir konfigürasyon dosyasıdır. Sitenizin ana dizininde, yani /robots.txt yolunda bulunmak zorundadır. Başka bir yere koyduğunuzda botlar tarafından bulunamaz.

Temel Robots.txt Format Kuralları

Robots.txt format yapısı oldukça sade görünse de dikkat edilmesi gereken bazı nüanslar içerir. Her kural bloğu (record) şu iki temel direktiften oluşur:

# Bu bir yorum satırıdır

# User-agent: hangi botu hedef aldığınızı belirtir

User-agent: Googlebot

Disallow: /admin/

Disallow: /test/

Allow: /api/public/

# Tüm botlar için genel kural

User-agent: *

Disallow: /private/

# Sitemap konumu

Sitemap: https://www.siteniz.com/sitemap.xml

  • User-agent: hangi botun hedef alındığını belirtir. * tüm botları kapsar.

  • Disallow: botun erişmemesini istediğiniz yolları tanımlar.

  • Allow: Disallow ile kısıtlanmış bir alanın alt dizinini açmak için kullanılır.

  • Sitemap: sitenizin XML sitemap adresini belirtir.

Dikkat: Robots.txt büyük-küçük harf duyarlıdır. /Admin/ ile /admin/ farklı yollar olarak değerlendirilir. Ayrıca boş bir Disallow satırı tüm sitenin taranmasına izin verdiği anlamına gelir.

Robots.txt Nasıl Olmalı? 

Robots.txt nasıl olmalı sorusu, özellikle yeni proje sahiplerinin kafasını en çok karıştıran konulardan biridir. Yıllar içinde gözlemlenen en yaygın hatalar şunlardır:

  • Tüm siteyi engelleyen 'Disallow: /' direktifini yanlışlıkla bırakmak

  • İndekslenmiş olmasını istediğiniz sayfaları engellemek

  • Robots.txt'i güvenlik mekanizması olarak kullanmaya çalışmak

  • Canonical tag veya noindex direktifiyle çelişen kurallar oluşturmak

  • Sitemap yolunu güncel tutmamak

Robots.txt Test Aracı Nasıl Çalışır?

Dosyayı oluşturdunuz, yayına aldınız peki doğru çalışıyor mu? İşte bu noktada robots.txt test aracı devreye giriyor. Bu araçlar, yazdığınız kuralların belirli bir URL için nasıl uygulandığını simüle etmenizi sağlar.

En popüler robots.txt tester Google Search Console bünyesindedir. Google'ın bu aracı, Googlebot'un sitenizi nasıl algıladığını gerçek zamanlı olarak test etmenizi sağlar. Kullanımı son derece basittir:

  • Google Search Console'a giriş yapın ve ilgili mülkü seçin

  • Sol menüden 'Dizin Oluşturma' bölümüne geçin

  • robots.txt test aracını açın

  • Test etmek istediğiniz URL'yi girin ve 'Test Et' butonuna tıklayın

  • Araç, o URL'nin engellenip engellenmediğini ve hangi kuralın uygulandığını gösterir

Bunun yanı sıra çeşitli üçüncü taraf robots.txt tester araçları da mevcuttur. Bunlar genellikle dosyanızı yapıştırmanıza veya URL üzerinden çekmenize, ardından farklı botlar için simülasyon yapmanıza izin verir. Özellikle Google dışındaki arama motorlarının (Bing, Yandex vb.) davranışını test etmek isteyenler için faydalı alternatiflerdir.

Robots.txt Kullanımı ve Kuralları

Robots.txt kullanımı söz konusu olduğunda, akılda tutulması gereken bazı temel prensipler vardır. Bu prensipler hem teknik açıdan doğru bir dosya oluşturmanıza hem de arama motorlarıyla sağlıklı bir ilişki kurmanıza yardımcı olur.

robotstxt_dosya_anatomisi

Robots.txt Oluşturma: Adım Adım

Robots.txt oluşturma için özel bir yazılıma ihtiyaç duymazsınız. Basit bir metin editörü yeterlidir. Ancak şu adımları dikkatle takip etmek önemlidir:

  • Dosyayı UTF-8 formatında kaydedin, başka bir kodlama kullanmayın

  • Dosya adı kesinlikle robots.txt olmalı, büyük harf içermemeli

  • Dosyayı sitenizin kök dizinine yükleyin: https://siteniz.com/robots.txt

  • Her User-agent bloğunu boş bir satırla birbirinden ayırın

  • Yorum satırları için # karakterini kullanın

Robots.txt dosyası oluşturma sürecinde WordPress, Shopify veya diğer büyük CMS platformlarını kullanıyorsanız işiniz çok daha kolaydır. Bu platformların büyük çoğunluğu, admin paneli üzerinden robots.txt dosyasını düzenlemenize olanak tanıyan yerleşik araçlara ya da eklentilere sahiptir. Yoast SEO, Rank Math gibi popüler eklentiler bu dosyayı arayüz üzerinden yönetmenizi sağlar.

Gelişmiş Kullanım Senaryoları

Temel kullanımın ötesine geçmek isteyenler için robots.txt çok daha güçlü bir araç hâline gelebilir. Örneğin wildcard karakteri (*) ve $ sembolü ile çok daha esnek kurallar tanımlanabilir:

# Tüm PDF dosyalarını engelle

User-agent: *

Disallow: /*.pdf$

# URL parametresi içeren tüm sayfaları engelle

Disallow: /*?*

# Sadece belirli bir botu tamamen engelle

User-agent: AhrefsBot

Disallow: /

Robots.txt ve SEO İlişkisi

Pek çok kişinin gözden kaçırdığı nokta şudur: robots.txt, yalnızca teknik bir konfigürasyon dosyası değildir. Doğru kullanıldığında SEO stratejinizin güçlü bir bileşeni olabilir; yanlış kullanıldığında ise tüm çalışmalarınızı yerle bir edebilir.

Arama motorlarının her site için belirli bir 'crawl bütçesi' vardır. Bu bütçe, botun belirli bir zaman diliminde sitenizde kaç sayfa tarayabileceğini ifade eder. Gereksiz sayfaları (eski URL parametreleri, yinelenen içerikler, dahili arama sonuç sayfaları vb.) engellemek, bütçenin değerli sayfalara ayrılmasını sağlar. Bu da önemli içeriklerinizin daha hızlı indekslenmesi anlamına gelir.

Öte yandan dikkat edilmesi gereken kritik bir nokta var: robots.txt ile engellenen bir sayfa indeksten kaldırılmaz. Eğer bir sayfanın arama sonuçlarında görünmesini istemiyorsanız, robots.txt yerine noindex meta etiketini kullanmalısınız. Robots.txt yalnızca taramayı engeller, görünürlüğü değil.

Ayrıca canonical tag stratejinizle robots.txt direktiflerinizin çelişmemesine özen gösterin. Canonical etiketiyle 'bu sayfa asıl içerik' dediğiniz bir URL'yi aynı zamanda robots.txt ile engellerseniz, Google'a çelişkili sinyaller göndermiş olursunuz. Bu durum indeksleme sorunlarına ve sıralama kaybına yol açabilir.

Robots.txt Nedir? Nasıl Oluşturulur? - PeakSense