SEO

llms.txt Nedir? Yapay Zekâya Sitenizi Anlatan Dosya

12 dk okuma

llms.txt nedir, içinde ne bulunur ve robots.txt ile sitemap.xml’den farkı nedir? Motorların bu dosyayı gerçekten okuyup okumadığına dair dürüst bir değerlendirme, iyi bir dosyanın beş kuralı ve altı sitede kullandığımız otomatik kurulum yöntemi.

Kısa Cevap: llms.txt Nedir?

llms.txt, sitenizin kök dizininde duran, Markdown biçiminde yazılmış düz bir metin dosyasıdır. İçinde önce sitenin ne yaptığı birkaç cümleyle özetlenir, sonra en önemli sayfalar başlık ve tek cümlelik açıklamalarıyla listelenir. Amacı tek cümleye sığıyor: bir dil modeli sitenize baktığında yüzlerce sayfanın arasından doğru olanı ayıklamaya uğraşmasın, kendi ağzınızdan yazılmış burada ne var cevabını okusun.

Öneri Jeremy Howard tarafından llmstxt.org adresinde yayımlandı ve kısa sürede arama camiasında konuşulur oldu. Adresi sabittir: dosya her zaman alanadiniz.com/llms.txt altında aranır. Çoğu uygulamada ikinci bir dosya daha bulunur — llms-full.txt — ve o, listelenen sayfaların tam metnini tek dosyada toplar.

Buraya kadarı tanım. Asıl soru başka: bu dosya işe yarıyor mu? Bu yazıda hem dosyanın ne olduğunu hem de dürüst sınırlarını anlatacağız, çünkü llms.txt nedir sorusuna verilen cevapların çoğu ikinci kısmı atlıyor ve ortada bir standart varmış izlenimi bırakıyor.

Dosyanın İçinde Tam Olarak Ne Var?

Biçim kasıtlı olarak sade tutulmuş: bir başlık (site adı), isteğe bağlı bir özet paragrafı, sonra bölüm başlıkları altında bağlantı listeleri. Her bağlantının yanında bir cümlelik açıklama olması bekleniyor. Bir hizmet sitesinde bölümler tipik olarak şöyle ayrılır:

  • Hizmetler — ne sattığınız; her hizmet sayfası tek satırlık açıklamayla
  • Fiyat ve süreç — ücretlendirme mantığını ve çalışma biçimini anlatan sayfalar
  • Rehberler — sektöre dair bilgi veren, satış yapmayan içerikler
  • Kurumsal — kim olduğunuz, nerede olduğunuz, size nasıl ulaşıldığı
  • İsteğe bağlı — modelin gerekmedikçe atlayabileceği ikincil sayfalar

llms.txt nedir diye bakarken en çok kaçırılan nokta şu: bu bir bağlantı çöplüğü değil. Bütün URL'leri listeleme işini sitemap.xml zaten yapıyor. llms.txt'in katma değeri tam tersi yönde — seçmek. İki yüz sayfalık bir sitede hangi on beş sayfanın sizi doğru anlattığına siz karar veriyorsunuz. Seçemiyorsanız dosya da bir işe yaramaz.

robots.txt, sitemap.xml ve llms.txt Üç Ayrı Soruya Cevap Verir

Bu üç dosya sık sık birbirine karıştırılıyor. Oysa her biri farklı bir soruyu yanıtlar:

  • robots.txt — izin dosyasıdır. "Şu dizine girebilirsin, şuraya giremezsin."
  • sitemap.xml — envanterdir. "Sitede şu adresler var, şu tarihte güncellendiler."
  • llms.txt — brifingdir. "Bu site şunu yapar, önce şu sayfalara bak."

Üçü birbirinin yerine geçmez ve birbiriyle çelişmemesi gerekir. Sık gördüğümüz bir tutarsızlık şudur: robots.txt'te yapay zekâ tarayıcıları engellenmiş, buna rağmen siteye llms.txt konmuş. Bu, kapıyı kilitleyip kapının üstüne "içeride şunlar var" diye not asmaya benzer. Önce hangi tarayıcıya izin verdiğinize karar verin, dosyayı ondan sonra yazın.

Motorlar llms.txt'i Gerçekten Okuyor mu?

Burada net konuşmak gerekiyor, çünkü llms.txt nedir anlatılırken bu konu fazlasıyla iyimser aktarılıyor. Büyük sağlayıcıların hiçbiri llms.txt'i desteklediğini resmen duyurmuş değil. OpenAI, Anthropic, Perplexity ve Google'ın yayımladığı tarayıcı belgelerinde bu dosyaya dair bir taahhüt yok; dosyanın adresi bir yönerge değil, topluluk tarafından benimsenmiş bir gelenek.

llms.txt bir standart değil, bir öneridir. Kurmanın maliyeti düşüktür, ama tek başına bir görünürlük vaadi taşımaz.

İddiaya değil ölçüme bakmayı tercih ediyorsanız elinizde zaten bir araç var: kendi sunucu günlüğünüz. GPTBot, ClaudeBot, PerplexityBot ve Google-Extended gibi ajanların sitenize gelen istekleri günlüklerde görünür; hangi dosyaları çektikleri de görünür. Bir tarayıcının sizin llms.txt dosyanızı isteyip istemediğini, bu konuda yazılmış her yazıdan daha kesin biçimde oradan öğrenirsiniz. Kurulumdan sonra bir süre günlüğe bakmak, llms.txt nedir sorusunu kendi siteniz özelinde cevaplamanın en dürüst yoludur.

Peki Neden Yine de Kuruyoruz?

Cevabı basit bir hesap: maliyeti neredeyse sıfır, riski yok, yan faydası gerçek. Dosya yarın yaygın biçimde okunmaya başlarsa hazır olursunuz; okunmazsa kaybınız birkaç saatlik iştir. Ama asıl sebep bu bile değil.

Asıl fayda: kendinizi tarif etmeye mecbur kalmak

Bir llms.txt yazmaya oturduğunuzda cevaplamak zorunda kaldığınız sorular şunlar: Bu site ne yapar? En önemli beş sayfası hangisi? Her birini tek cümlede nasıl anlatırım? Bu üç sorunun net cevabı olmayan bir sitenin yapay zekâ cevaplarında anılmaması sürpriz değildir. Aynı belirsizlik ana sayfanızın ilk ekranında, başlık etiketlerinizde ve meta açıklamalarınızda da vardır — llms.txt sadece onu görünür kılar. SEO uyumlu web tasarımın maddeleri ile bu dosyanın istedikleri büyük ölçüde örtüşür; ikisi de aynı disiplini ister.

İkinci fayda: insanlar da okuyor

Sitesine llms.txt koyan firmaların bir kısmı, dosyayı sonradan başka işlerde kullandığını fark ediyor. İyi yazılmış bir llms.txt aynı zamanda kısa bir kurum brifingidir: yeni gelen bir çalışana, bir ajansa ya da bir tedarikçiye "sitede ne var" sorusunun cevabı olarak verilebilir. Dosyanın bu tarafı hiçbir motorun kararına bağlı değil.

Altı Sitede Nasıl Kurduk: Elle Değil, Veritabanından

Yönettiğimiz altı sitenin hepsinde llms.txt ve llms-full.txt var, ama hiçbiri elle yazılmış statik bir dosya değil. Bu bilinçli bir tercih ve sebebi tecrübeyle sabit: elle yazılan bir llms.txt'in ömrü kısadır. İki yeni hizmet sayfası eklersiniz, bir yazının adresini değiştirirsiniz, dosya sessizce yanlışa döner ve aylarca kimse fark etmez. Yanlış bir llms.txt, hiç olmayandan daha zararlıdır — çünkü modele artık var olmayan adresler verir.

Kurduğumuz düzen şöyle işliyor. Dosyayı bir üreteç basıyor; sayfa tablosundan yayında olan sayfaları, blog tablosundan yayında olan yazıları çekiyor, bölümlere ayırıyor ve her satıra o kaydın kendi özetini yazıyor. Sunucu tarafındaki bir yeniden yazma kuralı /llms.txt adresini bu üretece yönlendiriyor, yani ziyaretçi için adres değişmiyor. Panelden bir yazı yayınlandığı anda dosya kendiliğinden güncelleniyor; kimsenin bir şey hatırlaması gerekmiyor.

Bir de yedek katman var. Veritabanı bir sebeple cevap veremezse üreteç boş dosya basmıyor; devreye statik bir kopya giriyor. Yapay zekâ tarayıcısı geldiğinde boş ya da hatalı bir dosya bulmasındansa biraz eski bir dosya bulması yeğdir.

İyi Bir llms.txt'in Beş Kuralı

  • Az sayfa, doğru sayfa. Sitedeki her adresi değil, sizi anlatan sayfaları listeleyin. Uzun liste seçim yapmamanın itirafıdır.
  • Açıklamalar satış cümlesi olmasın. "Sektörün lideriyiz" bir bilgi taşımaz. "Bilecik ve İstanbul'dan çalışan, kurumsal web sitesi ve özel yazılım geliştiren ekip" taşır.
  • Adresler tam ve mutlak olsun. Göreli yol yerine tam adres yazın; dosya kopyalandığında ya da başka bağlamda okunduğunda bağlantılar kırılmasın.
  • Somut olun. Modeller belirsiz cümleleri özetleyemez. Ne yaptığınız, kime yaptığınız ve nerede olduğunuz açıkça yazılmalı.
  • Otomatik üretin. Elle güncellenen bir dosya er geç eskir. Küçük bir sitede bile üretimi bir betiğe bağlamak birkaç saatlik iştir ve bir daha unutulur.

llms-full.txt Gerekli mi?

İkinci dosya, listelenen sayfaların tam metnini tek bir yerde toplar. Mantığı şu: model dosyayı okuduğunda on beş ayrı adrese gitmek zorunda kalmasın, ihtiyacı olan metnin tamamını bir kerede alsın. Küçük ve orta ölçekli siteler için mantıklı; içeriği binlerce sayfaya yayılmış bir sitede ise dosya kullanılamayacak kadar şişer.

Pratik ölçümüz şöyle: sayfa metinlerinin toplamı makul bir boyutta kalıyorsa llms-full.txt üretin, kalmıyorsa yalnızca llms.txt ile yetinip tam metni sayfaların kendisine bırakın. Ürettiğiniz her iki dosyanın da düz metin olarak servis edildiğini ve gerçekten güncel içerik döndürdüğünü kurulumdan sonra bir kez doğrulayın. Bizim kurduğumuz sitelerde iki dosya da aynı üreteçten çıkıyor; biri seçilmiş bağlantı listesini, diğeri o sayfaların metnini basıyor.

WordPress'te llms.txt Nasıl Kurulur?

WordPress tarafında üç yol var. Bazı SEO eklentileri (Yoast ve All in One SEO gibi) dosyayı kendisi üretiyor; sadece bu iş için yazılmış küçük eklentiler var; üçüncü yol da dosyayı kendi üretecinizle basmak. Eklenti yolu hızlıdır ama listeye neyin gireceğine çoğunlukla eklenti karar verir — az önceki "az sayfa, doğru sayfa" kuralını uygulamak isterseniz bu bir sınırlamadır.

Hangi yolu seçerseniz seçin, WordPress'e özgü bir tuzağı bilin: sitenin kök dizinine koyduğunuz statik bir dosya ya da eklediğiniz özel bir yönlendirme kuralı, WordPress'in kendi genel yakalama kuralından sonra tanımlandıysa hiç çalışmaz. İstek dosyaya ulaşmadan önce WordPress'e kapılır ve karşınıza 404 çıkar. Özel kurallar, sunucu yapılandırmasındaki ilk genel yakalama bloğundan önce durmalıdır. Bu ayrıntıyı bir sitede yaşayarak öğrendik; adres tarayıcıda açılmıyordu ve dosya yerli yerindeydi.

llms.txt Nedir Derken Sık Yapılan Dört Hata

Kurulumları incelerken tekrar tekrar aynı dört hatayı görüyoruz.

  • Dosyayı sitemap'in kopyası yapmak. Yüzlerce satırlık, açıklamasız bir bağlantı listesi llms.txt değildir; sitemap.xml'in okunması zor bir sürümüdür.
  • Yanlış içerik türü. Sunucu dosyayı HTML olarak servis ederse ya da 404 döndürürse dosya var sayılmaz. Kurduktan sonra adresi tarayıcıda açıp gerçekten düz metin geldiğini doğrulayın.
  • robots.txt ile çelişmek. Yapay zekâ tarayıcılarını engelleyip llms.txt yayımlamak, birbirini iptal eden iki karardır.
  • Dosyayı iş sanmak. En yaygın hata bu. llms.txt kurmak bir görünürlük çalışması değil, o çalışmanın en küçük ve en kolay parçasıdır.

llms.txt'ten Önce Yapılması Gereken İş

Bir dosyanın markanızı yapay zekâ cevaplarına sokacağını düşünüyorsanız sıralamayı baştan yanlış kuruyorsunuz. Dil modelleri sizi çoğunlukla sitenizden değil, sizin hakkınızda yazılmış başka kaynaklardan tanır: dizinler, pazaryerleri, forum başlıkları, haber ve blog içerikleri. Kendi dört sitemizi ölçtüğümüz 192 gözlemlik çalışmada gördüğümüz manzara tam olarak buydu: sorular sektörle ilgili olduğunda cevapları büyük ölçüde pazaryerleri ve dizinler dolduruyordu, siteler kendileri değil.

Bu yüzden doğru sıralama şu: önce ölçün, sonra düzeltin, dosyayı da yolun üstünde bir yerde kurun. Ölçmeden yapılan her iyileştirme tahmindir ve tahminin faturasını sonra ödersiniz. Ölçümün nasıl yapıldığını, tek sorunun neden ölçüm sayılmadığını ve hangi dört sayıya bakılması gerektiğini yapay zekâ görünürlüğü nasıl ölçülür yazısında adım adım anlattık. Kavramların tanımına — GEO ile AEO'nun farkına — ihtiyacınız varsa bu yazıdan başlayabilirsiniz.

Nereden Başlamalı

Pratik bir sıra öneriyoruz. Önce sunucu günlüğünüzü açın ve yapay zekâ tarayıcılarının sitenize gelip gelmediğine bakın; gelmiyorlarsa çözülecek sorun dosya değil, erişim ve içeriktir. Sonra robots.txt'inizi okuyun ve hangi ajanlara izin verdiğinize bilinçli bir karar verin. Ardından en önemli on beş sayfanızı seçip her birine tek cümlelik dürüst bir açıklama yazın — bu, işin gerçekten düşünmeyi gerektiren kısmıdır. En son adım dosyayı üretmek; ve mümkünse elle değil, siteniz büyüdükçe kendi kendini güncelleyecek biçimde.

llms.txt nedir sorusunun bizce en doğru cevabı şu: markanızın yapay zekâya nasıl göründüğünü düzeltmeye çalışırken atacağınız ilk ve en ucuz adım. Tek başına yeterli değil, ama sizi asıl işi düşünmeye zorladığı için değerli. Bu işi baştan sona birlikte yürütmek isterseniz Yapay Zekâ Görünürlüğü sayfasında ölçümün nasıl çalıştığını ve sonrasında neyin düzeltildiğini anlattık.

Sıkça Sorulan Sorular

İşletmeniz İçin Doğru Çözümü Birlikte Bulalım

Web sitesi, SEO veya chatbot ihtiyaçlarınız için size özel bir teklif hazırlayalım.

Projenizin tutarını şimdi, burada görün

İhtiyacınız olan kalemleri işaretleyin, tutar anında hesaplansın. Telefon açmanıza ya da teklif beklemenize gerek yok.

Fiyatı hesapla