SEO & Discoverability

llms.txt nasıl yazılır—ve gerçekten işe yarayıp yaramadığı

AI tarayıcıları, içerik özetleri ve modele dönük site talimatları için ortaya çıkan dosyaya yönelik pratik bir rehber.

The Wux Webtools Team The Wux Webtools Team 11 dakika okuma Yapay zeka destekli, insan tarafından gözden geçirilmiş
Abstract illustration of an llms.txt file guiding AI crawler paths through a website structure.
İçindekiler
  1. Kısa versiyon
  2. llms.txt neyi çözmek için tasarlandı
  3. llms.txt gerçekten bir işe yarıyor mu?
  4. AI tarayıcılarını güvenilir biçimde engellemez
  5. Yorumlamaya yardımcı olabilir
  6. İçerik politikanızı netleştirebilir
  7. llms.txt içine ne koymalı
  8. llms.txt içine ne koymamalı
  9. llms.txt ile robots.txt arasındaki ilişki
  10. Pratik bir yazım süreci
  11. 1. Dosyanın işini belirleyin
  12. 2. Kanonik sayfaları belirleyin
  13. 3. Makineler ve insanlar için yazın
  14. 4. Politika dilini dikkatli ekleyin
  15. 5. Yayımlayın ve bakımını yapın
  16. Her sitenin buna ihtiyacı var mı?
  17. SEO etkileri
  18. Son öneri

Kısa versiyon

llms.txt, büyük dil modellerine sitenizin ne olduğunu, hangi sayfaların önemli olduğunu ve içeriğinizin nasıl anlaşılması gerektiğini anlatmak için ortaya çıkan bir gelenektir. Genellikle https://example.com/llms.txt adresinde bulunur, Markdown ile yazılır ve temiz, yararlı kaynaklara bağlantı verir.

robots.txt ile aynı şey değildir. Resmî bir web standardı değildir. AI eğitimi için kullanımı güvenilir biçimde engellemez. Bir AI şirketini isteklerinize uymaya zorlamaz.

Yine de yazmaya değer olabilir.

İyi bir llms.txt, AI sistemlerinin, aracıların, arama asistanlarının ve dahili araçların sitenizi doğru özetlemesini kolaylaştırmanın düşük maliyetli bir yoludur. Aynı zamanda zorlayıcı bir düzenleme aracıdır: hangi içeriğin kanonik olduğunu, hangi içeriğin bayatladığını ve yeniden kullanım için hangi şartların geçerli olduğunu belirlemeniz gerekir. Dosyayı şu anda yalnızca birkaç sistem okuyor olsa bile bu yararlıdır.

llms.txt neyi çözmek için tasarlandı

Çoğu web sitesi insanlar ve arama tarayıcıları için oluşturulur. Gezinme öğeleri, çerez banner’ları, ürün kartları, yinelenen kategori sayfaları, eski PDF’ler, izleme parametreleri ve yalnızca görsel olarak anlamlı olan içerikler barındırırlar.

LLM’lerin aynı sunum katmanına ihtiyacı yoktur. Şunlara ihtiyaç duyarlar:

  • sitenin kısa bir açıklaması;
  • en yetkili sayfalara bağlantılar;
  • ürünler, dokümanlar, politikalar veya yazarlık hakkında sade bir bağlam;
  • lisanslama ve kullanım tercihleri;
  • varsa yapılandırılmış veya Markdown sürümlere işaret eden bağlantılar.

llms.txt önerisi, tanıdık bir web fikrini ödünç alır: alan adının köküne öngörülebilir bir metin dosyası koymak. Esas olarak tarama izinleriyle ilgili olan robots.txt’den farklı olarak llms.txt çoğunlukla yönlendirme ile ilgilidir.

Bunu bir kapı değil, bir harita olarak düşünün.

llms.txt gerçekten bir işe yarıyor mu?

Bugün dürüst cevap şu: bazen, ama birçok kişinin umduğu şekilde değil.

AI tarayıcılarını güvenilir biçimde engellemez

Amacınız taramayı veya eğitimi önlemekse, llms.txt yanlış birincil mekanizmadır. Hariç tutma kurallarına saygı duyan tarayıcıların robots.txt, belirli user-agent yönergeleri, HTTP header’ları veya sözleşmesel/lisanslama sinyallerine bakma olasılığı daha yüksektir. O durumda bile uyum, tarayıcı operatörüne bağlıdır.

Web’in bu konuda uzun bir geçmişi var. robots.txt de daha sonra RFC 9309’da resmileştirilen gönüllü bir protokoldür. Çalışmasının nedeni dosyanın sihirli bir yaptırım gücü olması değil, büyük tarayıcıların ona uymayı seçmesidir.

llms.txt, robots.txt’ye kıyasla daha az benimsenmiş ve daha az standartlaşmıştır. “İçeriğinizi AI’den koruduğu” yönündeki iddialara şüpheyle yaklaşın.

Yorumlamaya yardımcı olabilir

llms.txt’nin daha umut verici olduğu yer, içeriğin yorumlanmasıdır.

Bir AI asistanı şirketiniz, dokümantasyonunuz, araştırmanız, fiyatlandırmanız, API’niz veya editoryal politikanız hakkında soruları yanıtlamaya çalışıyorsa, kök düzeyinde kısa bir dosya tahmin yürütmeyi azaltabilir. Sistemi gerçekten bakımını yaptığınız sayfalara yönlendirebilir ve güncelliğini yitirmiş parçalardan uzaklaştırabilir.

Bu, büyük arşivlere sahip siteler için önemlidir. Bir model veya aracı, 2026 tarihli bir politika sayfasından önce 2019 tarihli bir destek makalesini bulabilir. llms.txt dosyanız fiilen şunu söyleyebilir: “Buradan başla. Yetkili kaynaklar bunlar.”

Bu gösterişli değildir, ama yararlıdır.

İçerik politikanızı netleştirebilir

Herkese açık, AI’ye dönük bir politika sessizlikten iyidir; özellikle yayıncılar, dokümantasyon ekipleri ve hassas marka ya da tıbbi/hukuki/finansal materyale sahip şirketler için.

Bu, tehditkâr bir hukuki metin duvarı yazmanız gerektiği anlamına gelmez. Şunları açıkça belirtebilirsiniz:

  • AI sistemlerinin herkese açık sayfalarınızı özetleyip özetleyemeyeceği;
  • içeriğinizin model eğitimi için kullanılıp kullanılamayacağı;
  • atıfın nasıl yapılmasını istediğiniz;
  • hangi sayfaların kanonik kabul edilmesi gerektiği;
  • lisanslama veya veri ortaklıkları için kiminle iletişime geçileceği.

Bu, daha geniş editoryal şeffaflıkla iyi eşleşir. AI destekli içerik yayımlıyorsanız, llms.txt dosyanız herkese açık açıklamanızla çelişmemelidir. Pratik bir başlangıç noktası için küçük bir web sitesinde dürüst AI açıklamasının nasıl göründüğüne dair rehberimize bakın.

llms.txt içine ne koymalı

Evrensel olarak uygulanan bir şema yoktur, ancak mevcut gelenek Markdown’dır. Kısa, açık ve sade tutun.

Yararlı bir yapı şöyle görünür:

# Example Company

> Example Company publishes practical guides and reference material for independent web developers.

## Canonical resources

- Homepage: https://example.com/
- Documentation: https://example.com/docs/
- Pricing: https://example.com/pricing/
- Editorial policy: https://example.com/editorial-policy/
- Contact: https://example.com/contact/

## Content use policy

Public pages may be summarized with attribution to Example Company and a link to the source page.

Use of our content for model training, dataset creation, or bulk republication requires written permission.

## Preferred citation

When citing our content, link to the canonical URL and include the page title.

## Notes for AI systems

- Prefer current documentation under /docs/ over archived blog posts.
- Do not treat user comments as official guidance.
- Product screenshots may be outdated; use written documentation as the source of truth.

Bu, birçok site için yeterlidir.

Daha büyük siteler için ürün alanları, API dokümanları, araştırma, basın sayfaları veya yasal politikalar için bölümler ekleyin. Her şeyi listeleme isteğine direnin. Dosya ne kadar kapsamlı hâle gelirse, başlangıç noktası olarak o kadar az kullanışlı olur.

llms.txt içine ne koymamalı

İçine özel bilgi koymayın. Bu çok açık görünebilir, ancak kök düzeyindeki metin dosyaları çoğu zaman operasyonel notların döküldüğü yerlere dönüşür.

Şunları eklemekten kaçının:

  • yayımlanmamış URL’ler;
  • dahili staging bağlantıları;
  • API keys veya tokens;
  • özel iletişim bilgileri;
  • güvenlik talimatları;
  • ambargolu ürün bilgileri;
  • tarayıcıların yok saymasını umduğunuz “gizli” sayfalar.

Bir şey herkese açık olmamalıysa, herkese açık bir dosyada ondan bahsetmeyin.

Ayrıca belirsiz hukuki tiyatrodan kaçının. “Tüm AI kullanımı sonsuza dek yasaktır” ifadesi hayal kırıklığını gösterebilir, ancak güvenilir bir teknik kontrol oluşturmaz. Kuruluşunuzun gerçekten uygulanabilir kısıtlamalara ihtiyacı varsa, hukuk danışmanlarını sürece dahil edin ve tarayıcı kontrollerini, lisans şartlarını ve erişim kontrollerini birlikte kullanın.

llms.txt ile robots.txt arasındaki ilişki

Tarama yönergeleri için robots.txt kullanın. Bağlam için llms.txt kullanın.

Basitleştirilmiş ayrım:

| Dosya | Ana amaç | Uygulanabilir mi? | En iyi kullanım alanı | |---|---|---:|---| | robots.txt | Tarama izinleri | Gönüllü ama yaygın olarak tanınır | Tarayıcılara path ve user agent bazında izin vermek veya engellemek | | llms.txt | LLM’ye dönük özet ve rehberlik | Şu anda standartlaşmış değil | Kanonik bağlantılar, içerik politikası, yorumlama notları | | Şartlar sayfası | Yasal koşullar | Yargı alanına ve olgulara bağlıdır | Lisanslama, izin verilen yeniden kullanım, ticari kısıtlamalar | | HTTP header’ları | Sayfa düzeyinde teknik sinyaller | Tarayıcı desteğine bağlıdır | Dizinleme, önbellekleme ve yanıt davranışı |

Zaten tarayıcı davranışında hata ayıklıyorsanız, metin dosyasında durmayın. Sitenizin dosyayı gerçekten doğru sunup sunmadığını, yönlendirmelerin beklendiği gibi davranıp davranmadığını ve header’ların politikanızla eşleşip eşleşmediğini kontrol edin. Production ortamında yönlendirmelerde ve HTTP header’larında hata ayıklamak için küçük bir araç seti üzerine ayrı bir rehber yazdık; çünkü birçok “politika” kararının sessizce başarısız olduğu yer burasıdır.

Pratik bir yazım süreci

Mantıklı bir iş akışı şöyle olabilir.

1. Dosyanın işini belirleyin

Bir ana hedef seçin:

  • AI sistemlerinin sitenizi doğru tanımlamasına yardımcı olmak;
  • aracıları güncel dokümantasyona yönlendirmek;
  • yeniden kullanım ve atıf tercihlerini belirtmek;
  • arşivlenmiş veya kullanıcı tarafından oluşturulmuş içerik etrafındaki karışıklığı azaltmak.

llms.txt dosyasının her AI yönetişimi sorununu çözmesini beklerseniz, hiçbirini çözmez.

2. Kanonik sayfaları belirleyin

Siteyi en iyi temsil eden 5–20 URL’yi seçin. Yüksek trafikli sayfalar yerine istikrarlı ve bakımı yapılan sayfaları tercih edin. Bir SaaS şirketi için bu, ana sayfa, dokümanlar, fiyatlandırma, güvenlik, gizlilik, API referansı, durum ve iletişim olabilir. Bir yayıncı için konu merkezleri, editoryal standartlar, yazar sayfaları, düzeltme politikası ve lisanslama olabilir.

3. Makineler ve insanlar için yazın

Sade Markdown başlıkları kullanın. Pazarlama metninden kaçının. Sitenin ne olduğunu bir veya iki cümlede söyleyin.

Kötü:

Yeni nesil çözümlerle dijital mükemmelliğin geleceğinde devrim yaratıyoruz.

Daha iyi:

Acme Docs, Acme’nin payments API’si için authentication, webhooks, SDKs ve migration guides dahil olmak üzere teknik dokümantasyon yayımlar.

4. Politika dilini dikkatli ekleyin

Politika bölümünüz aşırı iddialı olmadan anlaşılır olmalıdır. Örneğin:

Herkese açık sayfalar arama, erişilebilirlik ve kullanıcı yardımı için atıfla özetlenebilir. Toplu kopyalama, dataset oluşturma veya model eğitimi izin gerektirir.

Bu uyumu garanti etmez, ancak sessizlikten daha nettir.

5. Yayımlayın ve bakımını yapın

Dosyayı /llms.txt konumuna yerleştirin. text/plain veya uyumlu bir metin yanıtı olarak sunun. Yalnızca kanonik URL’lere bağlantı verin. Bilgi mimariniz değiştiğinde gözden geçirin.

Bayat bir llms.txt, hiç dosya olmamasından daha kötüdür; çünkü artık doğru olmayan talimatları kendinden emin biçimde verir.

Her sitenin buna ihtiyacı var mı?

Hayır.

Beş sayfalık bir broşür sitesinin muhtemelen llms.txt dosyasına ihtiyacı yoktur. Yerel bir restoranın da, AI asistanlarının sıkça yanlış aktardığı yapılandırılmış politikaları veya rezervasyon bilgileri yoksa buna ihtiyacı yoktur.

Şu durumlarda daha kullanışlı hâle gelir:

  • sitenizde çok sayıda dokümantasyon varsa;
  • eski içerik yeni içerikle rekabet ediyorsa;
  • araştırma veya editoryal materyal yayımlıyorsanız;
  • lisanslama ve atıf önemliyse;
  • AI asistanları sayfalarınızı sık sık özetliyorsa;
  • dahili ekiplerin herkese açık içerik için ortak bir politikaya ihtiyacı varsa.

Dahili yönetişim çalışmasının parçası olarak da yararlıdır. Birçok şirkette çalışanlar web sayfalarını, dokümanları ve müşteri materyallerini zaten AI sistemlerine yapıştırıyor. Bu tanıdık geliyorsa, herkese açık bir metin dosyasının riski çözeceğini varsaymadan önce temel bir shadow AI denetimi yapın.

SEO etkileri

llms.txt, yerleşik anlamda bir sıralama faktörü değildir. Gelecek hafta trafik artışı beklediğiniz için yazmayın.

Dolaylı SEO gerekçesi daha mütevazıdır:

  • kanonik düşünmeyi zorunlu kılar;
  • AI aracılı arama ve yanıt sistemlerinin sitenizi anlamasına yardımcı olabilir;
  • atıf tercihlerini netleştirir;
  • arşivlenmiş sayfalar etrafındaki belirsizliği azaltır;
  • herkese açık, incelenebilir bir AI içerik politikası oluşturur.

Bazı siteler için buna değer. Sihirli bir optimizasyon katmanı değildir.

llms.txt’nin en iyi sürümü küçük, güncel ve sitenizin geri kalanıyla uyumludur. Robots kurallarınız, şartlar sayfanız, sitemap’iniz, canonical tags ve llms.txt dosyanızın hepsi farklı şeyler söylüyorsa, sorun AI taraması değildir. Sorun yönetişimdir.

<!-- tool-cta:start -->

💡 Bunu deneyin: llms.txt yaptırım gücü taşımadığından, onu yaptırım gücü olan kurallarla eşleştirin ve standartlara uyan tarayıcıların doğru davranması için bunları Robots.txt Tester içinde kontrol edin.

<!-- tool-cta:end -->

Son öneri

Sitenizde dokümantasyon, editoryal içerik veya lisanslama kaygıları varsa basit bir llms.txt oluşturun. Birkaç düzine satırın altında tutun. Kanonik kaynaklara işaret etmek ve yeniden kullanım tercihlerinizi belirtmek için kullanın.

Ancak iletişimi kontrolle karıştırmayın.

Engelleme için elinizdeki tarayıcı mekanizmalarını kullanın ve sınırlarını anlayın. Politika için net şartlar yayımlayın. Güven için okuyuculara karşı şeffaf olun. llms.txt, bu yapının içinde yararlı bir sinyal olarak yer alır—bir kalkan olarak değil.

Sıkça sorulan sorular

llms.txt resmî bir standart mı?
Hayır. RFC 9309’da açıklanan robots.txt protokolü gibi resmî bir web standardı değil, ortaya çıkan bir öneri ve gelenektir.
llms.txt, AI şirketlerinin içeriğimle eğitim yapmasını durdurur mu?
Güvenilir biçimde durdurmaz. Tercihinizi belirtebilirsiniz, ancak uyum tarayıcıya veya AI şirketine bağlıdır. Daha güçlü kontroller gerektiğinde robots.txt, erişim kontrolleri, lisans şartları ve hukuki rehberlik kullanın.
llms.txt dosyasını nereye koymalıyım?
Alan adınızın köküne, örneğin https://example.com/llms.txt konumuna yerleştirin ve düz metin veya Markdown tarzı bir dosya olarak herkese açık erişilebilir olduğundan emin olun.
llms.txt sitemdeki her sayfayı içermeli mi?
Hayır. En yetkili ve istikrarlı kaynaklara işaret etmelidir. Kısa, özenle seçilmiş bir dosya, uzun ve yinelenen bir sitemap’ten daha yararlıdır.
llms.txt SEO’ya yardımcı olur mu?
Yerleşik bir sıralama faydası yoktur. Değeri dolaylıdır: daha net kanonik sayfalar, AI’ye dönük daha iyi bağlam ve herkese açık bir içerik kullanım politikası.

Kaynaklar ve ileri okuma

  1. llms.txt proposal
  2. RFC 9309: Robots Exclusion Protocol
  3. Google Search Central: robots.txt introduction and guide
  4. OpenAI: Web crawlers and user agents
Yazar hakkında
The Wux Webtools Team

Son güncelleme:

Devamını oku