llms.txt nasıl yazılır—ve gerçekten işe yarayıp yaramadığı
AI tarayıcıları, içerik özetleri ve modele dönük site talimatları için ortaya çıkan dosyaya yönelik pratik bir rehber.
İçindekiler
- Kısa versiyon
- llms.txt neyi çözmek için tasarlandı
- llms.txt gerçekten bir işe yarıyor mu?
- AI tarayıcılarını güvenilir biçimde engellemez
- Yorumlamaya yardımcı olabilir
- İçerik politikanızı netleştirebilir
- llms.txt içine ne koymalı
- llms.txt içine ne koymamalı
- llms.txt ile robots.txt arasındaki ilişki
- Pratik bir yazım süreci
- 1. Dosyanın işini belirleyin
- 2. Kanonik sayfaları belirleyin
- 3. Makineler ve insanlar için yazın
- 4. Politika dilini dikkatli ekleyin
- 5. Yayımlayın ve bakımını yapın
- Her sitenin buna ihtiyacı var mı?
- SEO etkileri
- Son öneri
Kısa versiyon
llms.txt, büyük dil modellerine sitenizin ne olduğunu, hangi sayfaların önemli olduğunu ve içeriğinizin nasıl anlaşılması gerektiğini anlatmak için ortaya çıkan bir gelenektir. Genellikle https://example.com/llms.txt adresinde bulunur, Markdown ile yazılır ve temiz, yararlı kaynaklara bağlantı verir.
robots.txt ile aynı şey değildir. Resmî bir web standardı değildir. AI eğitimi için kullanımı güvenilir biçimde engellemez. Bir AI şirketini isteklerinize uymaya zorlamaz.
Yine de yazmaya değer olabilir.
İyi bir llms.txt, AI sistemlerinin, aracıların, arama asistanlarının ve dahili araçların sitenizi doğru özetlemesini kolaylaştırmanın düşük maliyetli bir yoludur. Aynı zamanda zorlayıcı bir düzenleme aracıdır: hangi içeriğin kanonik olduğunu, hangi içeriğin bayatladığını ve yeniden kullanım için hangi şartların geçerli olduğunu belirlemeniz gerekir. Dosyayı şu anda yalnızca birkaç sistem okuyor olsa bile bu yararlıdır.
llms.txt neyi çözmek için tasarlandı
Çoğu web sitesi insanlar ve arama tarayıcıları için oluşturulur. Gezinme öğeleri, çerez banner’ları, ürün kartları, yinelenen kategori sayfaları, eski PDF’ler, izleme parametreleri ve yalnızca görsel olarak anlamlı olan içerikler barındırırlar.
LLM’lerin aynı sunum katmanına ihtiyacı yoktur. Şunlara ihtiyaç duyarlar:
- sitenin kısa bir açıklaması;
- en yetkili sayfalara bağlantılar;
- ürünler, dokümanlar, politikalar veya yazarlık hakkında sade bir bağlam;
- lisanslama ve kullanım tercihleri;
- varsa yapılandırılmış veya Markdown sürümlere işaret eden bağlantılar.
llms.txt önerisi, tanıdık bir web fikrini ödünç alır: alan adının köküne öngörülebilir bir metin dosyası koymak. Esas olarak tarama izinleriyle ilgili olan robots.txt’den farklı olarak llms.txt çoğunlukla yönlendirme ile ilgilidir.
Bunu bir kapı değil, bir harita olarak düşünün.
llms.txt gerçekten bir işe yarıyor mu?
Bugün dürüst cevap şu: bazen, ama birçok kişinin umduğu şekilde değil.
AI tarayıcılarını güvenilir biçimde engellemez
Amacınız taramayı veya eğitimi önlemekse, llms.txt yanlış birincil mekanizmadır. Hariç tutma kurallarına saygı duyan tarayıcıların robots.txt, belirli user-agent yönergeleri, HTTP header’ları veya sözleşmesel/lisanslama sinyallerine bakma olasılığı daha yüksektir. O durumda bile uyum, tarayıcı operatörüne bağlıdır.
Web’in bu konuda uzun bir geçmişi var. robots.txt de daha sonra RFC 9309’da resmileştirilen gönüllü bir protokoldür. Çalışmasının nedeni dosyanın sihirli bir yaptırım gücü olması değil, büyük tarayıcıların ona uymayı seçmesidir.
llms.txt, robots.txt’ye kıyasla daha az benimsenmiş ve daha az standartlaşmıştır. “İçeriğinizi AI’den koruduğu” yönündeki iddialara şüpheyle yaklaşın.
Yorumlamaya yardımcı olabilir
llms.txt’nin daha umut verici olduğu yer, içeriğin yorumlanmasıdır.
Bir AI asistanı şirketiniz, dokümantasyonunuz, araştırmanız, fiyatlandırmanız, API’niz veya editoryal politikanız hakkında soruları yanıtlamaya çalışıyorsa, kök düzeyinde kısa bir dosya tahmin yürütmeyi azaltabilir. Sistemi gerçekten bakımını yaptığınız sayfalara yönlendirebilir ve güncelliğini yitirmiş parçalardan uzaklaştırabilir.
Bu, büyük arşivlere sahip siteler için önemlidir. Bir model veya aracı, 2026 tarihli bir politika sayfasından önce 2019 tarihli bir destek makalesini bulabilir. llms.txt dosyanız fiilen şunu söyleyebilir: “Buradan başla. Yetkili kaynaklar bunlar.”
Bu gösterişli değildir, ama yararlıdır.
İçerik politikanızı netleştirebilir
Herkese açık, AI’ye dönük bir politika sessizlikten iyidir; özellikle yayıncılar, dokümantasyon ekipleri ve hassas marka ya da tıbbi/hukuki/finansal materyale sahip şirketler için.
Bu, tehditkâr bir hukuki metin duvarı yazmanız gerektiği anlamına gelmez. Şunları açıkça belirtebilirsiniz:
- AI sistemlerinin herkese açık sayfalarınızı özetleyip özetleyemeyeceği;
- içeriğinizin model eğitimi için kullanılıp kullanılamayacağı;
- atıfın nasıl yapılmasını istediğiniz;
- hangi sayfaların kanonik kabul edilmesi gerektiği;
- lisanslama veya veri ortaklıkları için kiminle iletişime geçileceği.
Bu, daha geniş editoryal şeffaflıkla iyi eşleşir. AI destekli içerik yayımlıyorsanız, llms.txt dosyanız herkese açık açıklamanızla çelişmemelidir. Pratik bir başlangıç noktası için küçük bir web sitesinde dürüst AI açıklamasının nasıl göründüğüne dair rehberimize bakın.
llms.txt içine ne koymalı
Evrensel olarak uygulanan bir şema yoktur, ancak mevcut gelenek Markdown’dır. Kısa, açık ve sade tutun.
Yararlı bir yapı şöyle görünür:
# Example Company
> Example Company publishes practical guides and reference material for independent web developers.
## Canonical resources
- Homepage: https://example.com/
- Documentation: https://example.com/docs/
- Pricing: https://example.com/pricing/
- Editorial policy: https://example.com/editorial-policy/
- Contact: https://example.com/contact/
## Content use policy
Public pages may be summarized with attribution to Example Company and a link to the source page.
Use of our content for model training, dataset creation, or bulk republication requires written permission.
## Preferred citation
When citing our content, link to the canonical URL and include the page title.
## Notes for AI systems
- Prefer current documentation under /docs/ over archived blog posts.
- Do not treat user comments as official guidance.
- Product screenshots may be outdated; use written documentation as the source of truth.
Bu, birçok site için yeterlidir.
Daha büyük siteler için ürün alanları, API dokümanları, araştırma, basın sayfaları veya yasal politikalar için bölümler ekleyin. Her şeyi listeleme isteğine direnin. Dosya ne kadar kapsamlı hâle gelirse, başlangıç noktası olarak o kadar az kullanışlı olur.
llms.txt içine ne koymamalı
İçine özel bilgi koymayın. Bu çok açık görünebilir, ancak kök düzeyindeki metin dosyaları çoğu zaman operasyonel notların döküldüğü yerlere dönüşür.
Şunları eklemekten kaçının:
- yayımlanmamış URL’ler;
- dahili staging bağlantıları;
- API keys veya tokens;
- özel iletişim bilgileri;
- güvenlik talimatları;
- ambargolu ürün bilgileri;
- tarayıcıların yok saymasını umduğunuz “gizli” sayfalar.
Bir şey herkese açık olmamalıysa, herkese açık bir dosyada ondan bahsetmeyin.
Ayrıca belirsiz hukuki tiyatrodan kaçının. “Tüm AI kullanımı sonsuza dek yasaktır” ifadesi hayal kırıklığını gösterebilir, ancak güvenilir bir teknik kontrol oluşturmaz. Kuruluşunuzun gerçekten uygulanabilir kısıtlamalara ihtiyacı varsa, hukuk danışmanlarını sürece dahil edin ve tarayıcı kontrollerini, lisans şartlarını ve erişim kontrollerini birlikte kullanın.
llms.txt ile robots.txt arasındaki ilişki
Tarama yönergeleri için robots.txt kullanın. Bağlam için llms.txt kullanın.
Basitleştirilmiş ayrım:
| Dosya | Ana amaç | Uygulanabilir mi? | En iyi kullanım alanı | |---|---|---:|---| | robots.txt | Tarama izinleri | Gönüllü ama yaygın olarak tanınır | Tarayıcılara path ve user agent bazında izin vermek veya engellemek | | llms.txt | LLM’ye dönük özet ve rehberlik | Şu anda standartlaşmış değil | Kanonik bağlantılar, içerik politikası, yorumlama notları | | Şartlar sayfası | Yasal koşullar | Yargı alanına ve olgulara bağlıdır | Lisanslama, izin verilen yeniden kullanım, ticari kısıtlamalar | | HTTP header’ları | Sayfa düzeyinde teknik sinyaller | Tarayıcı desteğine bağlıdır | Dizinleme, önbellekleme ve yanıt davranışı |
Zaten tarayıcı davranışında hata ayıklıyorsanız, metin dosyasında durmayın. Sitenizin dosyayı gerçekten doğru sunup sunmadığını, yönlendirmelerin beklendiği gibi davranıp davranmadığını ve header’ların politikanızla eşleşip eşleşmediğini kontrol edin. Production ortamında yönlendirmelerde ve HTTP header’larında hata ayıklamak için küçük bir araç seti üzerine ayrı bir rehber yazdık; çünkü birçok “politika” kararının sessizce başarısız olduğu yer burasıdır.
Pratik bir yazım süreci
Mantıklı bir iş akışı şöyle olabilir.
1. Dosyanın işini belirleyin
Bir ana hedef seçin:
- AI sistemlerinin sitenizi doğru tanımlamasına yardımcı olmak;
- aracıları güncel dokümantasyona yönlendirmek;
- yeniden kullanım ve atıf tercihlerini belirtmek;
- arşivlenmiş veya kullanıcı tarafından oluşturulmuş içerik etrafındaki karışıklığı azaltmak.
llms.txt dosyasının her AI yönetişimi sorununu çözmesini beklerseniz, hiçbirini çözmez.
2. Kanonik sayfaları belirleyin
Siteyi en iyi temsil eden 5–20 URL’yi seçin. Yüksek trafikli sayfalar yerine istikrarlı ve bakımı yapılan sayfaları tercih edin. Bir SaaS şirketi için bu, ana sayfa, dokümanlar, fiyatlandırma, güvenlik, gizlilik, API referansı, durum ve iletişim olabilir. Bir yayıncı için konu merkezleri, editoryal standartlar, yazar sayfaları, düzeltme politikası ve lisanslama olabilir.
3. Makineler ve insanlar için yazın
Sade Markdown başlıkları kullanın. Pazarlama metninden kaçının. Sitenin ne olduğunu bir veya iki cümlede söyleyin.
Kötü:
Yeni nesil çözümlerle dijital mükemmelliğin geleceğinde devrim yaratıyoruz.
Daha iyi:
Acme Docs, Acme’nin payments API’si için authentication, webhooks, SDKs ve migration guides dahil olmak üzere teknik dokümantasyon yayımlar.
4. Politika dilini dikkatli ekleyin
Politika bölümünüz aşırı iddialı olmadan anlaşılır olmalıdır. Örneğin:
Herkese açık sayfalar arama, erişilebilirlik ve kullanıcı yardımı için atıfla özetlenebilir. Toplu kopyalama, dataset oluşturma veya model eğitimi izin gerektirir.
Bu uyumu garanti etmez, ancak sessizlikten daha nettir.
5. Yayımlayın ve bakımını yapın
Dosyayı /llms.txt konumuna yerleştirin. text/plain veya uyumlu bir metin yanıtı olarak sunun. Yalnızca kanonik URL’lere bağlantı verin. Bilgi mimariniz değiştiğinde gözden geçirin.
Bayat bir llms.txt, hiç dosya olmamasından daha kötüdür; çünkü artık doğru olmayan talimatları kendinden emin biçimde verir.
Her sitenin buna ihtiyacı var mı?
Hayır.
Beş sayfalık bir broşür sitesinin muhtemelen llms.txt dosyasına ihtiyacı yoktur. Yerel bir restoranın da, AI asistanlarının sıkça yanlış aktardığı yapılandırılmış politikaları veya rezervasyon bilgileri yoksa buna ihtiyacı yoktur.
Şu durumlarda daha kullanışlı hâle gelir:
- sitenizde çok sayıda dokümantasyon varsa;
- eski içerik yeni içerikle rekabet ediyorsa;
- araştırma veya editoryal materyal yayımlıyorsanız;
- lisanslama ve atıf önemliyse;
- AI asistanları sayfalarınızı sık sık özetliyorsa;
- dahili ekiplerin herkese açık içerik için ortak bir politikaya ihtiyacı varsa.
Dahili yönetişim çalışmasının parçası olarak da yararlıdır. Birçok şirkette çalışanlar web sayfalarını, dokümanları ve müşteri materyallerini zaten AI sistemlerine yapıştırıyor. Bu tanıdık geliyorsa, herkese açık bir metin dosyasının riski çözeceğini varsaymadan önce temel bir shadow AI denetimi yapın.
SEO etkileri
llms.txt, yerleşik anlamda bir sıralama faktörü değildir. Gelecek hafta trafik artışı beklediğiniz için yazmayın.
Dolaylı SEO gerekçesi daha mütevazıdır:
- kanonik düşünmeyi zorunlu kılar;
- AI aracılı arama ve yanıt sistemlerinin sitenizi anlamasına yardımcı olabilir;
- atıf tercihlerini netleştirir;
- arşivlenmiş sayfalar etrafındaki belirsizliği azaltır;
- herkese açık, incelenebilir bir AI içerik politikası oluşturur.
Bazı siteler için buna değer. Sihirli bir optimizasyon katmanı değildir.
llms.txt’nin en iyi sürümü küçük, güncel ve sitenizin geri kalanıyla uyumludur. Robots kurallarınız, şartlar sayfanız, sitemap’iniz, canonical tags ve llms.txt dosyanızın hepsi farklı şeyler söylüyorsa, sorun AI taraması değildir. Sorun yönetişimdir.
<!-- tool-cta:start -->
💡 Bunu deneyin: llms.txt yaptırım gücü taşımadığından, onu yaptırım gücü olan kurallarla eşleştirin ve standartlara uyan tarayıcıların doğru davranması için bunları Robots.txt Tester içinde kontrol edin.
<!-- tool-cta:end -->
Son öneri
Sitenizde dokümantasyon, editoryal içerik veya lisanslama kaygıları varsa basit bir llms.txt oluşturun. Birkaç düzine satırın altında tutun. Kanonik kaynaklara işaret etmek ve yeniden kullanım tercihlerinizi belirtmek için kullanın.
Ancak iletişimi kontrolle karıştırmayın.
Engelleme için elinizdeki tarayıcı mekanizmalarını kullanın ve sınırlarını anlayın. Politika için net şartlar yayımlayın. Güven için okuyuculara karşı şeffaf olun. llms.txt, bu yapının içinde yararlı bir sinyal olarak yer alır—bir kalkan olarak değil.