GEON GEON
GEO Rehber 2 hafta önce 7 dk

llms.txt Gerçekten Okunuyor mu? Kendi Loglarınızda Nasıl Ölçersiniz

llms.txt'in okunup okunmadığı tartışması iddiadan ibaret: Google okumadığını açıkça söylüyor, OpenAI ve Anthropic'in resmi bot dokümanları dosyadan hiç bahsetmiyor, Perplexity da yalnızca kendi index'ine link veriyor. Kendi dosyanızın gerçekten çekilip çekilmediğini ölçmenin yöntemi burada — GEON'un kendi llms.txt'i dahil, çünkü biz de henüz ölçmedik.

llms.txt Gerçekten Okunuyor mu? Kendi Loglarınızda Nasıl Ölçersiniz

llms.txt tartışması iddiadan ibaret ve iki yöne aynı anda çekiliyor: bir taraf her sitenin bir tane yayımlaması gerektiğini söylüyor, diğer taraf hiçbir AI motorunun okumadığını iddia ediyor. İkisi de aynı sorunu paylaşıyor — hiçbiri ölçüme dayanmıyor. Bu yazı üçüncü bir iddia eklemiyor; llms.txt dosyanızın gerçekten çekilip çekilmediğini kendi sunucu logunuzda nasıl ölçeceğinizi anlatıyor. Ve dürüstçe başlayalım: GEON da bir /llms.txt yayımlıyor ve bu yazıyı yazana kadar kendi dosyamızı hiç ölçmedik.

llms.txt spesifikasyonu aslında ne öneriyor

llms.txt önerisi Answer.AI kurucusu Jeremy Howard tarafından 3 Eylül 2024'te yayımlandı ve robots.txt'in aksine bir tarayıcı direktifi değil. Spesifikasyonun kendi ifadesi net: dosyanın kullanım anı "inference" — yani bir kullanıcının bir asistandan yardım istediği an. Orijinal metinde şöyle yazıyor: "will mainly be useful for inference, i.e. at the time a user is seeking assistance." Format da bunu yansıtıyor: kök dizinde bir Markdown dosyası, zorunlu tek bölüm bir H1 başlık, opsiyonel bir özet blok alıntısı, ve H2 ile ayrılmış küratörlü link listeleri. robots.txt'in User-agent/Disallow sözdiziminden hiçbir iz yok; spesifikasyon metninde "crawler", "disallow" ya da "user-agent" kelimeleri hiç geçmiyor.

Bu ayrım önemli çünkü robots.txt 2022'de RFC 9309 olarak resmi bir IETF standardına dönüştü ve dört büyük AI sağlayıcı da ona uymayı taahhüt ediyor. llms.txt'in böyle bir kurumsal karşılığı yok; tek bir kişinin önerdiği, hâlâ topluluk girdisine açık bir konvansiyon. Bir motorun onu okuması ya da okumaması bir standart ihlali değil — çünkü zaten bir yükümlülük tanımlamıyor.

Sağlayıcılar ne diyor, ne demiyor

Dört büyük sağlayıcının kamuya açık metinlerini tek tek kontrol ettik.

Google açık ve olumsuz. Google'ın AI optimizasyon rehberi (son güncelleme 10 Temmuz 2026) şöyle diyor: "Google Arama'da — üretken yapay zeka özellikleri dahil — görünmek için yeni makine-okunur dosyalar, AI metin dosyaları, işaretleme ya da Markdown oluşturmanıza gerek yok; çünkü Google Arama bunları zaten kullanmıyor." Bu, dört sağlayıcı arasında bulduğumuz tek doğrudan ve tarihli "okumuyoruz" ifadesi.

Temmuz 2026 itibarıyla, OpenAI ve Anthropic'in resmi bot dokümanları konuyu hiç açmıyor. OpenAI'ın GPTBot, OAI-SearchBot ve ChatGPT-User'ın kimliğini ve robots.txt davranışını anlattığı sayfa robots.txt uyumunu satır satır işliyor, ama llms.txt'ten sadece kendi dokümantasyon index'ine link vermek için bahsediyor — üçüncü parti sitelerin llms.txt dosyasını tüketip tüketmediğine dair tek kelime yok. Anthropic'in ClaudeBot, Claude-User ve Claude-SearchBot davranışını anlatan resmi destek makalesi de aynı şekilde: robots.txt'i uzun uzun anlatıyor, ama sayfada "llms.txt" kelimesi bir kez bile geçmiyor. Bu bir çelişki değil, bir boşluk — ve boşluğun kendisi de bir bulgu.

Temmuz 2026 itibarıyla, Perplexity kendi dosyasına link veriyor, üçüncü partiler için susuyor. Perplexity'nin bot dokümantasyonu llms.txt'i tam olarak bir kez anıyor: kendi API dokümantasyonunun index'ine giden bir link olarak. PerplexityBot ya da Perplexity-User'ın sitenizdeki llms.txt'i okuyup okumadığına dair bir cümle yok.

Kanıt neye benziyor: 137 bin sitelik bir ölçüm

Bu boşlukta bulduğumuz tek büyük ölçekli ölçüm Ahrefs'ten geldi. Ahrefs Mayıs 2026'da 137.210 domaini tarayıp geçerli bir llms.txt dosyası olanları işaretledi — %28'i (yaklaşık 38.360 domain) yayımlıyordu. Sonuç şöyle: geçerli dosyaya sahip domainlerin %97'si Mayıs ayında dosya için hiç istek almadı. Kalan %3'lük istek trafiğinin de %96'sı bot kaynaklıydı, insan değil. Bu botların içinde bile asıl aranan grup — OAI-SearchBot, PerplexityBot, Claude'un arama tarayıcısı gibi "AI retrieval bot" kategorisi — toplam istek trafiğinin sadece %1,1'ini oluşturdu; Ahrefs'in verisine göre üçü birlikte tüm veri setinde "sadece birkaç yüz istek" ürettiler. Bu, iddianın değil ölçümün ne söylediğine iyi bir örnek: llms.txt'in var olması onun okunduğu anlamına gelmiyor, ama okunmadığı anlamına da gelmiyor — sadece bu 137 bin site için Mayıs 2026'da böyle olduğunu gösteriyor.

GEON'un kendi llms.txt dosyası

Açık konuşalım: GEON da /llms.txt yayımlıyor, iki parça hâlinde. public/llms.txt repoda statik bir yedek olarak duruyor; ama gerçekten yayımlanan dosya build sırasında generate-llms-txt.ts tarafından yeniden üretiliyor ve bu yedeğin üzerine yazılıyor — güncel blog yazısı listesini tarihe göre sıralayıp llmstxt.org formatına uygun bir H1, özet blok alıntısı ve küratörlü link listeleri hâlinde yayımlıyor. Format spesifikasyona sadık. Ama şu ana kadar production loglarımızda bu dosyaya kaç istek geldiğini, hangi user-agent'lardan geldiğini ölçmedik. Bu yazının geri kalanı o ölçümü nasıl yapacağınızı anlatıyor — aynı yöntemi kendi dosyamıza da uygulayacağız.

Ölçüm yöntemi: log'unuzda /llms.txt'i nasıl ayırt edersiniz

Sunucu logu okuma temellerini — UA doğrulama, reverse DNS, log formatı — ayrı bir yazıda anlattık; burada tekrarlamıyoruz. Burada sadece llms.txt'e özgü olanı ele alıyoruz.

/llms.txt isteği loglarınızda kendine has bir satır: tek bir sabit path, çoğu sayfanın aksine neredeyse hiç insan ziyaretçi tarafından tetiklenmiyor. Bu onu filtrelemeyi kolaylaştırıyor.

Önce dosyanın gerçekten istendiğini görün:

grep '"GET /llms.txt HTTP' access.log

Bot bazında kırılım için:

grep '"GET /llms.txt HTTP' access.log | \
  grep -oE '(GPTBot|OAI-SearchBot|ChatGPT-User|ClaudeBot|Claude-User|Claude-SearchBot|PerplexityBot|Perplexity-User)' | \
  sort | uniq -c | sort -rn

Status kod dağılımı, dosyanın kendisinin 404 dönüp dönmediğini yakalar:

grep '"GET /llms.txt HTTP' access.log | awk '{print $9}' | sort | uniq -c

Pozitif sonuç şöyle görünür: bilinen bir AI botunun user-agent'ıyla gelen, 200 status kodlu bir GET isteği — ve reverse DNS ile doğrulanmış bir IP. Bu size sadece dosyanın çekildiğini söyler; içeriğin herhangi bir yanıtta gerçekten kullanıldığını göstermez — o bağlantı sağlayıcı tarafında kalır, log dışarıdan görünmez.

Negatif sonuç ise şunu kanıtlamaz: gözlem penceresinde hiç istek görmemeniz, o motorun llms.txt'i "asla okumadığı" anlamına gelmez. Üç açıklama mümkün: gözlem süreniz yetersiz olabilir (Ahrefs'in kendi çalışması bile 137 bin site üzerinden tam bir ay gözlem yaptı ve yine de %97 sessizlik buldu — tek bir site için bu, birkaç günlük bir pencerenin hiçbir şey kanıtlamayacağı anlamına gelir); dosyanız henüz keşfedilmemiş olabilir (sitemap.xml'in aksine llms.txt için robots.txt üzerinden standart bir keşif mekanizması yok, bot sabit path'i zaten bilmek zorunda); ya da gözlem penceresindeki sorgularınız o motor için sitenizi hiç gerektirmemiş olabilir.

Ne kadar beklemeli: en az 30 gün log tutun, haftalık toplayın. Sunucu logu rehberimizde anlattığımız gibi AI botları toplu ve düzensiz çalışıyor; ilk boş hafta hiçbir şey kanıtlamaz.

Üç aksiyon net: llms.txt'inizin gerçekten 200 döndüğünü doğrulayın; yukarıdaki filtreyi mevcut log işlem hattınıza — yeni bir pipeline değil, tek satırlık bir ekleme olarak — koyun; ve en az 30 gün ölçüp sonucu bir ölçüm olarak raporlayın, bir iddia olarak değil. GEON görünürlük denetimi llms.txt dosyanızın var olup olmadığını ve doğru formatta olup olmadığını zaten kontrol ediyor; okunup okunmadığını ölçmek ise sadece loglarınızın cevaplayabileceği bir soru — ve artık onlara nasıl soracağınızı biliyorsunuz.

Deniz

Deniz

İçerik & GEO Stratejisi

İlgili Yazılar

GEO Rehber

Sitemiz AI Motorlarına Görünmezdi: Bir Prerender/Deploy Hatasının Anatomisi

6 dk
GEO Rehber

robots.txt 2026: Tek Bir Disallow Satırı Yetmiyor

7 dk
GEO Rehber

AI Arama Motorlarında Kapak Görseli Stratejisi

6 dk