TEKNİK REHBER · BOT VE ERİŞİM YÖNETİMİ

AI botları, robots.txt ve llms.txt

AI görünürlüğü tartışmalarında tarama, indeksleme, arama sonuçlarında kaynak olma ve model eğitimi sıkça birbirine karıştırılır. robots.txt bir güvenlik duvarı değildir; noindex ile aynı amaçta kullanılmaz. OAI-SearchBot ile GPTBot farklı tercihlerdir. llms.txt ise bazı sistemler için yardımcı bir içerik haritası olabilir, fakat Google Arama bunu özel bir görünürlük sinyali olarak kullanmadığını açıkça belirtir.

KISA CEVAP

robots.txt, belirli botların hangi URL’leri tarayabileceğini bildiren gönüllü bir erişim kuralıdır; gizli bilgiyi korumaz ve bir URL’nin indekslenmemesini tek başına garanti etmez. OAI-SearchBot ChatGPT arama sonuçları, GPTBot model geliştirme amacıyla kullanılan içerik taraması için ayrı tercihler sunar. llms.txt ise topluluk tarafından önerilmiş bir içerik sunum formatıdır; Google görünürlüğü için gerekli değildir.

Tarama, indeksleme, kaynak gösterimi ve eğitim aynı şey değildir

01

Tarama

Botun URL’ye erişip içeriği alabilmesidir. robots.txt bu erişim için kural bildirebilir.

02

İndeksleme

İçeriğin arama sisteminin dizinine alınmasıdır. Tarama izni indekslenme garantisi değildir.

03

Kaynak gösterimi

Arama veya AI cevabında sayfanın bağlantı ya da citation olarak kullanılmasıdır.

04

Model geliştirme

İçeriğin üretken model sistemlerini geliştirmek için kullanılabilmesine ilişkin ayrı tercihtir.

Aynı bot sağlayıcısının bu amaçlar için farklı user-agent kullanması mümkündür. Bu nedenle “AI botlarını açtık” veya “AI’dan çıktık” gibi tek cümlelik kararlar yeterli değildir; amaç bazında bot, URL ve veri sınıfı belirlenmelidir.

robots.txt erişim bildirir; güvenlik ve gizlilik sağlamaz

Google Search Central, robots.txt dosyasını esas olarak tarayıcı trafiğini yönetme aracı olarak tanımlar. Bir URL robots.txt ile engellense bile başka sayfalardan bağlantı alıyorsa URL adresi indeks sonuçlarında görünebilir. Gizli içerik için kimlik doğrulama, sunucu yetkilendirmesi veya gerektiğinde kaldırma gerekir.

HedefUygun kontrolNot
Botun yolu taramamasırobots.txt DisallowSaygın botların gönüllü uyumuna dayanır.
Sayfanın Google’da görünmemesinoindex meta veya X-Robots-TagBotun kuralı görebilmesi için sayfa taranabilir olmalıdır.
Özel içeriğin korunmasıKimlik doğrulama ve sunucu erişim kontrolürobots.txt dosyası yolları kamuya açık biçimde listeler.
Silinmiş URL’nin kaldırılması404/410, yönlendirme ve arama kaldırma süreçleriAmaç ve URL geçmişine göre planlanır.
Crawl yükünün azaltılmasırobots kuralları, mimari ve sunucu optimizasyonuÖnemli CSS/JS kaynaklarını engellemek sayfanın anlaşılmasını bozabilir.

robots.txt içinde noindex satırı kullanmak standart bir indeksleme yöntemi değildir. Ayrıca robots ile engellenen bir sayfadaki meta noindex kuralı bot tarafından görülemeyebilir.

OAI-SearchBot ve GPTBot ayrı amaçlara sahiptir

OpenAI’nin resmî bot dokümantasyonuna göre OAI-SearchBot, web sitelerinin ChatGPT arama özelliklerindeki sonuçlarda gösterilmesi için kullanılır. GPTBot ise OpenAI’nin üretken AI temel modellerini geliştirmede kullanılabilecek içeriği tarar. Site sahibi birini açıp diğerini kapatabilir; bu tercihler bağımsızdır.

User-agentAmaçKarar sorusu
OAI-SearchBotChatGPT arama cevaplarında web kaynaklarını yüzeye çıkarma.Kamusal içeriğin ChatGPT aramasında kaynak olmasını istiyor muyuz?
GPTBotÜretken AI temel modellerinin daha yararlı ve güvenli hâle getirilmesine yönelik tarama.Kamusal içeriğin bu model geliştirme kullanımına açık olmasını istiyor muyuz?
ChatGPT-UserKullanıcının açık isteği üzerine bir sayfayı ziyaret eden user-agent.Kullanıcı tarafından başlatılan erişim için hangi sunucu ve güvenlik kuralları geçerli?

Bot adıyla gelen her isteğe güvenilmemelidir. User-agent kolayca taklit edilebilir; yüksek güven gerektiren kontrollerde sağlayıcının yayımladığı IP aralıkları ve sunucu günlükleri birlikte değerlendirilmelidir.

Google için temel SEO ve görünür içerik hâlâ ana zemindir

Google’ın üretken AI arama rehberi; taranabilir teknik yapı, özgün ve yararlı içerik, açık iç bağlantılar, erişilebilir metin ve görünür içerikle eşleşen yapılandırılmış verinin önemini vurgular. Özel AI metin dosyaları veya yeni bir schema türü Google’ın üretken AI özelliklerinde görünmek için gerekli değildir.

  • Önemli sayfalar robots.txt, CDN veya güvenlik katmanı tarafından yanlışlıkla engellenmemeli.
  • Ana içerik JavaScript hatasına bağlı kalmadan erişilebilir metin biçiminde bulunmalı.
  • İç bağlantılar konu merkezleri ve rehberler arasındaki ilişkiyi açıklamalı.
  • Yapılandırılmış veri sayfada görünen bilgiyle aynı olmalı.
  • Sitemap güncel URL’leri taşımalı; ancak sitemap indeksleme garantisi sayılmamalı.
  • Performans Search Console ve sunucu kanıtlarıyla izlenmeli.

llms.txt bir öneridir; evrensel bot kontrol standardı değildir

llms.txt, sitenin önemli içeriklerini Markdown benzeri sade bir listede AI sistemlerine sunmayı öneren topluluk kökenli bir formattır. robots.txt yerine geçmez; erişim yetkisi tanımlamaz; bir sağlayıcının dosyayı okuyacağını veya arama sonuçlarında avantaj sağlayacağını garanti etmez.

Google’ın resmî konumu: Google Arama, üretken AI özellikleri dâhil görünürlük için llms.txt veya başka “özel” AI metin dosyalarına ihtiyaç olmadığını ve bunları özel bir sıralama/görünürlük sinyali olarak kullanmadığını belirtir.

Buna rağmen site, farklı sistemler veya dokümantasyon tüketicileri için düşük maliyetli bir içerik haritası olarak llms.txt tutabilir. Bu durumda dosya otomatik üretilebilmeli, canonical URL’lerle eşleşmeli, eski sayfaları taşımamalı ve “AI görünürlüğü garantisi” olarak pazarlanmamalıdır.

Amaç bazlı bot ve dosya karar matrisi

AmaçBirincil kontrolDestekleyici kontrolGaranti etmeyeceği şey
Google taranabilirliğiGooglebot robots ve sunucu erişimiSitemap, iç bağlantı, URL InspectionSıralama veya indekslenme
ChatGPT arama kaynağı olmaOAI-SearchBot izni ve IP erişimiKaliteli kamusal içerik ve ölçümHer sorguda citation veya trafik
Model geliştirme tercihiGPTBot kuralıHukuki/veri politikası değerlendirmesiİnternetteki diğer kopyaların kontrolü
Özel sayfanın korunmasıKimlik doğrulamaYetkilendirme, noindex, ağ politikasıPaylaşılmış kopyaların silinmesi
Sade içerik haritasıOpsiyonel llms.txtSitemap ve HTML navigasyonGoogle veya başka sağlayıcıda görünürlük

Canlı ortamda nasıl doğrulanır?

  1. Dosya erişimi: /robots.txt, sitemap ve varsa llms.txt doğru host ve HTTPS üzerinde yanıt veriyor mu?
  2. Kural testi: Önemli botlar için Allow/Disallow sonucu beklenen URL’lerde kontrol edilir.
  3. Sunucu logu: User-agent, IP, durum kodu, istek yolu ve tarih birlikte incelenir.
  4. Arama araçları: Search Console URL Inspection ve Bing Webmaster Tools tarama raporları kullanılır.
  5. Değişiklik kaydı: Kuralın nedeni, sahibi, tarihi ve geri alma planı yazılır.
  6. Periyodik kontrol: Yeni botlar, sağlayıcı belgeleri ve IP listeleri takip edilir.

Örnek: arama ve eğitim tercihlerini ayırmak

User-agent: OAI-SearchBot
Allow: /

User-agent: GPTBot
Disallow: /

User-agent: Googlebot
Allow: /

Sitemap: https://ornek.com/sitemap.xml

Bu yalnız açıklayıcı örnektir. Gerçek dosyada yönetim klasörleri, geçici çıktılar, arama sayfaları veya özel URL desenleri sitenin mimarisine göre değerlendirilmelidir. robots.txt özel verinin güvenlik kontrolü olarak kullanılmamalıdır.

Yaygın yanlışlar

  • robots.txt ile engellenen sayfanın kesinlikle arama sonuçlarından silineceğini varsaymak.
  • Bütün AI botlarını tek user-agent veya tek amaç saymak.
  • llms.txt dosyasını Google sıralama faktörü ya da GEO garantisi olarak sunmak.
  • Bot user-agent adını kimlik doğrulaması kabul etmek.
  • Önemli CSS ve JavaScript kaynaklarını engelleyip sayfanın anlaşılmasını bozmak.
  • Bot kuralı değişikliğini canlı log ve arama araçlarıyla doğrulamamak.

Kaynaklar ve gözden geçirme notu

Bu rehberde değişebilir veya teknik iddialar için öncelikle resmî kurum, ürün geliştiricisi ve birincil araştırma kaynakları kullanılmıştır. Bağlantılar 27 Temmuz 2026 tarihinde gözden geçirilmiştir.

  1. 01
    OpenAI Developers — Overview of OpenAI Crawlers

    OAI-SearchBot, GPTBot ve ChatGPT-User rollerini ve bağımsız robots tercihlerini açıklar.

  2. 02
    Google Search Central — Introduction to robots.txt

    robots.txt kullanım amacını, sınırlarını ve güvenlik kontrolü olmadığını açıklar.

  3. 03
    Google Search Central — Robots meta tag specifications

    noindex ve X-Robots-Tag kuralları ile robots.txt etkileşimini tanımlar.

  4. 04
    Google Search Central — Generative AI optimization guide

    Google için llms.txt gereksinimi olmadığını ve temel SEO yaklaşımını açıklar.

  5. 05
    llms.txt proposal

    llms.txt dosyasının önerilen formatını ve amaçlanan kullanımını tanımlayan proje kaynağı.

Yayın sorumluluğu: Bu içerik kişisel yazar profili kullanılmadan Vatansever Bilişim Anonim Şirketi kurumsal yayın sorumluluğunda hazırlanmıştır. Genel bilgilendirme niteliğindedir; belirli bir kurum için hukuki görüş, yatırım tavsiyesi, güvenlik veya sonuç garantisi değildir.
İLGİLİ HİZMET

Bot erişimi ve AI görünürlüğünü iddia değil kanıtla yönetin.

robots, sitemap, yapılandırılmış veri, sunucu logları ve içerik yönetişimini tek teknik kontrol modelinde birleştirin.