2026 SEO & GEO Eğitimi

Ders 17/25 · Konu dersi · 60 dk · Online canlı

Yapay zekâ botları: robots.txt, GPTBot ve llms.txt

Bu derste sitenize gelen yapay zekâ botlarını tanıyor ve bir envanterini çıkarıyorsunuz: hangisi model eğitmek için geliyor, hangisi arama dizini için, hangisi bir kullanıcının isteğiyle. Engelleme kararını bugün vermiyoruz; önce hangi botun ne yaptığını şirketlerin kendi belgelerinden okuyoruz.

Proje adımı 17/25Bot envanteri: eğitim, arama ve kullanıcı tetiklemeli botlar

Kısa cevap

Yapay zekâ şirketlerinin botları sitenize üç ayrı iş için gelir: model eğitmek, arama dizini oluşturmak ve bir kullanıcının isteğiyle tek bir sayfayı açmak. Bu ayrım önemlidir, çünkü yanlış botu engellemek ters sonuç verir. OpenAI’de eğitim botu GPTBot, arama botu OAI-SearchBot’tur; ChatGPT aramasında görünmeyi ikincisi belirler. Google-Extended yalnızca Gemini eğitimini yönetir, AI Overviews’ta görünmeyi etkilemez. llms.txt ise bugün için karşılığı olmayan bir dosya: Ahrefs’in Haziran 2026 çalışmasında bu dosyaların yüzde 97’si bir ay boyunca hiç istek almadı.

Bu derste

  1. 01Botları üç türe ayırıyoruz: eğitim, arama, kullanıcı tetiklemeli.
  2. 02OpenAI, Perplexity, Anthropic ve Google’ın botlarını kendi belgelerinden okuyoruz.
  3. 03Google’da AI Overviews ve AI Mode’u neyin yönettiğini, neyin yönetmediğini ayırıyoruz.
  4. 04llms.txt hakkındaki iddiayı sunucu kaydı verisiyle sınıyoruz.
  5. 05Yapay zekâ cevaplarının kimi kaynak gösterdiğine ve bunun ne kadar oynak olduğuna bakıyoruz.
  6. 06Kendi sitemiz için bot envanterini çıkarıyoruz.

Proje adımı 17/25

Bu dersten sonra elinizde ne var?

Dersin sonunda deponuzda docs/bot-envanteri.md dosyası var. Her satır bir bot: hangi şirketin, ne için geliyor, robots.txt kuralına uyduğunu söylüyor mu, belgesinin adresi ne. Son sütun boş: kararınız. O sütunu bu ayın ödevinde dolduracaksınız.

Kabul ölçütleri05

  • En az on bot, üç türden biriyle etiketli.
  • Her botun yanında şirketin kendi belgesinin adresi ve sizin açtığınız tarih.
  • “robots.txt’e uyuyor mu” sütunu belgede yazdığı gibi dolduruldu.
  • Search Console’daki üretken yapay zekâ ayarının şu anki durumu not edildi.
  • Karar sütunu bilerek boş; robots.txt dosyasına henüz dokunulmadı.

Dersi başlat

Bu ders canlı işleniyor

Kayıtlı bir video değil. Ayda bir gün, beş saat canlı buluşuyoruz; bu ders 4. ayın 2. saatinde, sizin sitenizin üzerinde işleniyor. Programa başvuruyla katılınıyor ve program 1. dersten başlıyor. Başvurunuzu buradan başlatırsanız hangi dersle ilgilendiğinizi de görmüş oluruz.

Süre
5 ay · 25 ders
Biçim
Online canlı, ayda bir gün
İlk dönem
Tarihi duyurulacak
Ücret
99.000 TL + KDVKDV dahil 118.800 TL

Üç tür bot

OpenAI’nin belgesi ayrımı en açık yapan. GPTBot, üretken yapay zekâ modellerini eğitmek için içerik topluyor; onu engellemek içeriğinizin eğitimde kullanılmamasını istediğinizi söylüyor. OAI-SearchBot ise ChatGPT’nin arama özelliklerinde siteleri göstermek için çalışıyor. Belgedeki cümle şu: OAI-SearchBot’a kapalı siteler ChatGPT’nin arama cevaplarında gösterilmez, yalnızca gezinme bağlantısı olarak görünebilir. Üçüncüsü ChatGPT-User: bir kullanıcı ChatGPT’den belirli bir sayfayı açmasını istediğinde çalışıyor ve belge, robots.txt kurallarının bu durumda geçerli olmayabileceğini yazıyor.

Perplexity’de iki bot var. PerplexityBot arama sonuçlarında siteleri gösterip bağlantı vermek için tarıyor; şirket bunun temel modelleri eğitmek için kullanılmadığını belirtiyor. Perplexity-User kullanıcının sorusuna cevap verirken sayfayı açıyor ve belgedeki ifadeyle, isteği kullanıcı yaptığı için robots.txt kurallarını genellikle yok sayıyor.

Anthropic üç bot sayıyor: eğitim için ClaudeBot, arama kalitesi için Claude-SearchBot ve kullanıcı istekleri için Claude-User. Şirket botlarının robots.txt’teki taramama yönergelerine uyduğunu ve Crawl-delay alanını desteklediğini yazıyor.

Buradan çıkan kural: bir botu engellemeden önce hangi türden olduğuna bakın. Eğitim botunu engellemek aramadaki görünürlüğünüzü etkilemez. Arama botunu engellemek ise o asistanın cevaplarından çıkmanız demektir.

Google’da durum farklı

Google’da AI Overviews ve AI Mode ayrı bir botla değil, bildiğiniz Googlebot’un taradığı arama diziniyle çalışıyor. Bu yüzden robots.txt’te onlar için ayrı bir satır yok.

Google-Extended sık karıştırılıyor. Google’ın tarayıcı listesindeki tanıma göre bu, yayıncıların sitelerinden taranan içeriğin gelecekteki Gemini modellerinin eğitiminde kullanılıp kullanılmayacağını yönetmesi için bir belirteç. Ayrı bir kullanıcı aracısı bile yok; tarama mevcut Google botlarıyla yapılıyor. Belge iki şeyi açıkça yazıyor: Google-Extended bir sitenin Google Arama’ya dahil edilmesini etkilemez ve sıralama sinyali olarak kullanılmaz.

AI Overviews ve AI Mode’da görünüp görünmemeyi yöneten ayar Search Console’da. Yardım sayfasına göre 31 Ağustos 2026’dan beri bütün sitelere açık ve üç seçeneği var: dahil et (varsayılan), hariç tut ve üst mülkten devral. Hariç tuttuğunuzda sitenize verilen bağlantılar ve içeriğiniz bu özelliklerde görünmüyor; değişikliğin yansıması genellikle birkaç gün sürüyor. Ayar yapay zekâ eğitimini etkilemiyor ve noindex’ten farklı: siteniz normal arama sonuçlarında kalıyor.

llms.txt: iddia ve veri

llms.txt, sitenizin içeriğini dil modelleri için özetleyen bir metin dosyası önerisi. Çevresinde bir hizmet pazarı oluştu: dosyayı hazırlayan eklentiler, denetleyen araçlar, satan ajanslar. Biz iddiayı üç kaynakla sınıyoruz.

Google’dan John Mueller 17 Haziran 2025’te şunu yazdı: şu anda hiçbir yapay zekâ sistemi llms.txt kullanmıyor. Google’ın Temmuz 2026 tarihli rehberi de aynı yerde: Google Arama’da görünmek için yeni makine okunur dosyalar, yapay zekâ metin dosyaları ya da Markdown oluşturmanız gerekmiyor.

Üçüncü kaynak veri. Ahrefs 15 Haziran 2026’da 137.210 alan adının Mayıs 2026 sunucu kayıtlarını inceledi. Alan adlarının yüzde 28’i geçerli bir llms.txt yayınlıyordu. Yaklaşık 38.000 dosyanın yüzde 97’si ay boyunca tek bir istek almadı. İstek alan az sayıdaki dosyada da tablo umut verici değil: dosyayı isteyen botların yüzde 77’si yapay zekâ aracı değildi; en büyük grup yüzde 21,7 ile SEO denetim araçlarıydı. Yani dosyayı en çok, dosyanın var olup olmadığını denetleyen araçlar okuyor.

Hükmümüz şu: dosyayı koymanın bir zararı yok, satmanın ise dürüst bir yanı yok.

Kimi kaynak gösteriyorlar?

Semrush 10 Kasım 2025’te yayımladığı çalışmada 13 hafta boyunca 230 bin promptun cevaplarındaki 100 milyondan fazla atıfı izledi. ChatGPT’de Ağustos başında cevapların yüzde 60’a yakınında Reddit, yüzde 55 kadarında Wikipedia kaynak gösteriliyordu. Eylül ortasında Reddit yüzde 10 civarına, Wikipedia yüzde 20’nin altına indi. Aynı haftalarda Google AI Mode ve Perplexity’de tablo neredeyse hiç değişmedi.

Bu veriden “Reddit’e yazın” ya da “Reddit öldü” sonucu çıkmıyor. Çıkan sonuç şu: atıf dağılımı platforma göre değişiyor ve bir platformda birkaç hafta içinde altüst olabiliyor. Bir rakamı ezberlemek yerine ölçmeyi öğreniyoruz; gelecek saatte kendi prompt setinizi kuracaksınız.

Sık yapılan
yanlışlar

Hâlâ anlatılan ama artık geçerli olmayan bilgiler. Her düzeltmenin yanında dayandığı kaynak var.

Yaygın inanış“llms.txt eklersem yapay zekâ aramalarında öne çıkarım.”
DoğrusuGoogle bu dosyayı kullanmadığını yazıyor; John Mueller Haziran 2025’te hiçbir yapay zekâ sisteminin kullanmadığını söyledi. Ahrefs’in Haziran 2026 çalışmasında yaklaşık 38.000 llms.txt dosyasının yüzde 97’si bir ay boyunca hiç istek almadı ve gelen isteklerin çoğu SEO araçlarındandı.[7][8][9]
Yaygın inanış“ChatGPT’de görünmemek için GPTBot’u engellemem yeterli.”
DoğrusuYanlış bot. GPTBot model eğitimi için tarıyor. ChatGPT’nin arama cevaplarında görünüp görünmemenizi OAI-SearchBot belirliyor; OpenAI’nin belgesi bunu açıkça yazıyor. Tersi de geçerli: GPTBot’a izin vermek sizi ChatGPT aramasında görünür yapmaz.[1]
Yaygın inanış“Google-Extended’ı engellersem AI Overviews’tan çıkarım.”
DoğrusuGoogle-Extended yalnızca Gemini modellerinin eğitimini yönetiyor; Google’ın belgesine göre Arama’ya dahil edilmeyi etkilemiyor. AI Overviews ve AI Mode için ayar Search Console’daki üretken yapay zekâ denetiminde.[4][5]
Yaygın inanış“Yapay zekâ cevapları en çok Reddit’i kaynak gösteriyor; öyleyse Reddit’e yazmalıyım.”
DoğrusuSemrush’ın çalışmasında Reddit’in ChatGPT cevaplarındaki payı birkaç hafta içinde yüzde 60’a yakın bir düzeyden yüzde 10 civarına indi; diğer platformlarda ise değişmedi. Bir platformun bir ayki kaynak dağılımına göre strateji kurmak, zemini kayan bir yere bina yapmaktır.[10]

Sık sorulanlar

Sorunuzun yanıtı burada yoksa bize yazın.

GPTBot nedir?

OpenAI’nin, üretken yapay zekâ modellerini eğitmek için web’i tarayan botu. robots.txt kurallarına uyduğunu belirtiyor. Onu engellemek içeriğinizin model eğitiminde kullanılmamasını istediğiniz anlamına geliyor; ChatGPT’nin arama cevaplarındaki görünürlüğünüzü etkilemiyor.

Yapay zekâ botlarını engellemeli miyim?

Tek bir doğru cevap yok; bir iş kararı. Arama botlarını engellerseniz o asistanların cevaplarında kaynak olmazsınız. Eğitim botlarını engellemek görünürlüğünüzü etkilemez, içeriğinizin eğitimde kullanılmasına itirazınızı bildirir. Kararı, gerekçesiyle birlikte bu ayın ödevinde veriyorsunuz.

Bir isteğin gerçekten o şirketin botundan geldiğini nasıl anlarım?

Kullanıcı aracısı adı taklit edilebilir. OpenAI ve Perplexity botlarının IP aralıklarını JSON dosyaları olarak yayımlıyor; Anthropic de öyle. Sunucu kaydındaki IP adresini bu listeyle karşılaştırırsınız. Bunu 24. derste uygulamalı yapıyoruz.

llms.txt dosyasını sitemden kaldırmalı mıyım?

Gerek yok; bilinen bir zararı da yok. Yalnızca ona vakit ve para harcamayın ve size “yapay zekâ SEO’su” adıyla satılmasına izin vermeyin. İleride bir sistem bu dosyayı gerçekten kullanmaya başlarsa bunu o şirketin kendi belgesinden öğrenirsiniz.

Kaynaklar

Bu dersteki bilgiler aşağıdaki sayfalara dayanıyor. Sayfaların hepsi en son tarihinde açılıp okundu.

Eğitmen: Son güncelleme:

  1. 01
  2. 02
  3. 03
    Does Anthropic crawl data from the web, and how can site owners block the crawler?

    Claude Help Centersayfa güncellemesi:

  4. 04
    List of Google’s common crawlers

    Google for Developerssayfa güncellemesi:

    Google-Extended tanımı.

  5. 05
    Search generative AI control

    Search Console Help

    Ayar 31 Ağustos 2026’dan beri bütün sitelere açık.

  6. 06
    AI features and your website

    Google Search Centralsayfa güncellemesi:

  7. 07
    Optimizing your website for generative AI features on Google Search

    Google Search Centralsayfa güncellemesi:

  8. 08
    Google: No AI System Currently Uses LLMs.txt

    Search Engine Roundtablesayfa güncellemesi:

    John Mueller’in 17 Haziran 2025 tarihli Bluesky paylaşımı.

  9. 09
    We Analyzed 137K Sites: 97% of llms.txt Files Never Get Read

    Ahrefs (Louise Linehan)sayfa güncellemesi:

  10. 10
    The Most-Cited Domains in AI: A 3-Month Study

    Semrush (Luke Harsel)sayfa güncellemesi:

Bu dersi
kendi sitenizde uygulayın

Beş ay, yirmi beş ders, tek proje. Program bittiğinde elinizde bir belge değil, kendi alan adınızda yayında olan bir site kalıyor.