Sådan skriver du llms.txt—og om det faktisk gør noget
En praktisk guide til den nye fil til AI-crawlere, indholdsresuméer og siteinstruktioner rettet mod modeller.
Indholdsfortegnelse
- Den korte version
- Hvad llms.txt skal løse
- Gør llms.txt faktisk noget?
- Den blokerer ikke pålideligt for AI-crawlere
- Den kan hjælpe med fortolkning
- Den kan tydeliggøre din indholdspolitik
- Hvad du skal lægge i llms.txt
- Hvad du ikke skal lægge i llms.txt
- Hvordan llms.txt hænger sammen med robots.txt
- En praktisk skriveproces
- 1. Beslut filens opgave
- 2. Identificer kanoniske sider
- 3. Skriv for maskiner og mennesker
- 4. Tilføj politiktekst med omhu
- 5. Publicer og vedligehold den
- Bør alle sites have en?
- SEO-konsekvenser
- En afsluttende anbefaling
Den korte version
llms.txt er en ny konvention til at fortælle store sprogmodeller, hvad dit site er, hvilke sider der er vigtige, og hvordan dit indhold bør forstås. Den ligger typisk på https://example.com/llms.txt, er skrevet i Markdown og linker til rene, nyttige ressourcer.
Det er ikke det samme som robots.txt. Det er ikke en officiel webstandard. Den blokerer ikke pålideligt for AI-træning. Den tvinger ikke en AI-virksomhed til at følge dine ønsker.
Alligevel kan den være værd at skrive.
En god llms.txt er en billig måde at gøre dit site lettere for AI-systemer, agenter, søgeassistenter og interne værktøjer at opsummere korrekt. Den fungerer også som en afklarende øvelse: Du er nødt til at beslutte, hvilket indhold der er kanonisk, hvilket indhold der er forældet, og hvilke vilkår der gælder for genbrug. Det er nyttigt, selv hvis kun få systemer aktuelt læser filen.
Hvad llms.txt skal løse
De fleste websites er bygget til mennesker og søgecrawlere. De indeholder navigation, cookiebannere, produktkort, duplikerede kategorisider, gamle PDF'er, sporingsparametre og indhold, der kun giver mening visuelt.
LLM'er har ikke brug for det samme præsentationslag. De har brug for:
- en kortfattet beskrivelse af sitet;
- links til de mest autoritative sider;
- kontekst i almindeligt sprog om produkter, dokumentation, politikker eller ophav;
- licens- og brugspræferencer;
- henvisninger til strukturerede versioner eller Markdown-versioner, hvor de findes.
Forslaget om llms.txt låner en velkendt webidé: Læg en forudsigelig tekstfil i roden af domænet. I modsætning til robots.txt, som primært handler om crawltilladelser, handler llms.txt mest om orientering.
Tænk på den som et kort, ikke en port.
Gør llms.txt faktisk noget?
I dag er det ærlige svar: nogle gange, men ikke på den måde, mange håber.
Den blokerer ikke pålideligt for AI-crawlere
Hvis dit mål er at forhindre crawling eller træning, er llms.txt den forkerte primære mekanisme. Crawlere, der respekterer udelukkelsesregler, vil sandsynligvis i højere grad kigge på robots.txt, specifikke user-agent-direktiver, HTTP-headers eller kontraktlige/licensmæssige signaler. Selv da afhænger efterlevelsen af crawleroperatøren.
Webbet har en lang historie her. robots.txt er i sig selv en frivillig protokol, som senere blev formaliseret i RFC 9309. Den virker, fordi større crawlere vælger at respektere den, ikke fordi filen har magisk håndhævelseskraft.
llms.txt har mindre udbredelse og mindre standardisering end robots.txt. Mød enhver påstand om, at den “beskytter dit indhold mod AI”, med skepsis.
Den kan hjælpe med fortolkning
Der, hvor llms.txt er mere lovende, er ved fortolkning af indhold.
Hvis en AI-assistent forsøger at besvare spørgsmål om din virksomhed, dokumentation, forskning, priser, API eller redaktionelle politik, kan en kortfattet fil på rodniveau reducere gætværk. Den kan pege systemet mod de sider, du faktisk vedligeholder, og væk fra forældede fragmenter.
Det betyder noget for sites med store arkiver. En model eller agent kan finde en supportartikel fra 2019 før en politikside fra 2026. Din llms.txt kan i praksis sige: “Start her. Dette er de autoritative ressourcer.”
Det er ikke glamourøst, men det er nyttigt.
Den kan tydeliggøre din indholdspolitik
En offentlig AI-rettet politik er bedre end tavshed, især for udgivere, dokumentationsteams og virksomheder med følsomt brandmateriale eller medicinsk/juridisk/finansielt materiale.
Det betyder ikke, at du skal skrive en truende mur af juridisk tekst. Det betyder, at du klart kan angive:
- om AI-systemer må opsummere dine offentlige sider;
- om dit indhold må bruges til modeltræning;
- hvordan du ønsker, at kreditering håndteres;
- hvilke sider der bør betragtes som kanoniske;
- hvem man skal kontakte om licensering eller datapartnerskaber.
Det passer godt sammen med bredere redaktionel transparens. Hvis du udgiver AI-assisteret indhold, bør din llms.txt ikke modsige din offentlige oplysning. Som et praktisk udgangspunkt kan du se vores guide til ærlig AI-oplysning på et lille website.
Hvad du skal lægge i llms.txt
Der findes ikke et universelt håndhævet skema, men den aktuelle konvention er Markdown. Hold den kort, eksplicit og kedelig.
En nyttig struktur ser sådan ud:
# Example Company
> Example Company publishes practical guides and reference material for independent web developers.
## Canonical resources
- Homepage: https://example.com/
- Documentation: https://example.com/docs/
- Pricing: https://example.com/pricing/
- Editorial policy: https://example.com/editorial-policy/
- Contact: https://example.com/contact/
## Content use policy
Public pages may be summarized with attribution to Example Company and a link to the source page.
Use of our content for model training, dataset creation, or bulk republication requires written permission.
## Preferred citation
When citing our content, link to the canonical URL and include the page title.
## Notes for AI systems
- Prefer current documentation under /docs/ over archived blog posts.
- Do not treat user comments as official guidance.
- Product screenshots may be outdated; use written documentation as the source of truth.
Det er nok for mange sites.
For større sites kan du tilføje sektioner for produktområder, API-dokumentation, forskning, pressesider eller juridiske politikker. Modstå fristelsen til at liste alt. Jo mere omfattende filen bliver, desto mindre nyttig er den som udgangspunkt.
Hvad du ikke skal lægge i llms.txt
Læg ikke private oplysninger i den. Det lyder indlysende, men tekstfiler på rodniveau bliver ofte lossepladser for operationelle noter.
Undgå at inkludere:
- ikke-publicerede URL'er;
- interne staging-links;
- API-nøgler eller tokens;
- private kontaktoplysninger;
- sikkerhedsinstruktioner;
- embargooplysninger om produkter;
- “hemmelige” sider, som du håber, crawlere vil ignorere.
Hvis noget ikke bør være offentligt, skal du ikke nævne det i en offentlig fil.
Undgå også vagt juridisk teater. “Al AI-brug er forbudt for evigt” kan udtrykke frustration, men det skaber ikke en pålidelig teknisk kontrol. Hvis din organisation reelt har brug for håndhævelige begrænsninger, bør du involvere juridisk rådgivning og bruge crawlerkontroller, licensvilkår og adgangskontroller sammen.
Hvordan llms.txt hænger sammen med robots.txt
Brug robots.txt til crawldirektiver. Brug llms.txt til kontekst.
En forenklet opdeling:
| Fil | Primært formål | Kan håndhæves? | Bruges bedst til | |---|---|---:|---| | robots.txt | Crawltilladelser | Frivillig, men bredt anerkendt | At tillade eller afvise crawlere efter sti og user agent | | llms.txt | LLM-rettet resumé og vejledning | Ikke aktuelt standardiseret | Kanoniske links, indholdspolitik, fortolkningsnoter | | Vilkårsside | Juridiske betingelser | Afhænger af jurisdiktion og fakta | Licensering, tilladt genbrug, kommercielle begrænsninger | | HTTP-headers | Tekniske signaler på sideniveau | Afhænger af crawlerunderstøttelse | Indeksering, caching og responsadfærd |
Hvis du allerede fejlsøger crawleradfærd, skal du ikke stoppe ved tekstfilen. Tjek, om dit site faktisk serverer filen korrekt, om redirects opfører sig som forventet, og om headers matcher din politik. Vi skrev en separat guide til fejlsøgning af redirects og HTTP-headers i produktion, fordi det er her, mange “politik”-beslutninger stille fejler.
En praktisk skriveproces
Her er en fornuftig arbejdsgang.
1. Beslut filens opgave
Vælg ét primært mål:
- hjælpe AI-systemer med at beskrive dit site præcist;
- guide agenter mod aktuel dokumentation;
- angive præferencer for genbrug og kreditering;
- reducere forvirring omkring arkiveret eller brugergenereret indhold.
Hvis du prøver at få llms.txt til at løse alle AI-governanceproblemer, løser den ingen af dem.
2. Identificer kanoniske sider
Vælg de 5–20 URL'er, der bedst repræsenterer sitet. Foretræk stabile, vedligeholdte sider frem for sider med høj trafik. For en SaaS-virksomhed kan det være forside, dokumentation, priser, sikkerhed, privatliv, API-reference, status og kontakt. For en udgiver kan det være emnehubs, redaktionelle standarder, forfattersider, korrektionspolitik og licensering.
3. Skriv for maskiner og mennesker
Brug enkle Markdown-overskrifter. Undgå marketingtekst. Sig, hvad sitet er, i én eller to sætninger.
Dårligt:
Vi revolutionerer fremtiden for digital ekspertise med næste generations løsninger.
Bedre:
Acme Docs udgiver teknisk dokumentation til Acmes betalings-API, herunder autentificering, webhooks, SDK'er og migreringsguider.
4. Tilføj politiktekst med omhu
Din politiksektion bør være forståelig uden at være for selvsikker. For eksempel:
Offentlige sider må opsummeres til søgning, tilgængelighed og brugerassistance med kreditering. Massekopiering, oprettelse af datasæt eller modeltræning kræver tilladelse.
Det garanterer ikke efterlevelse, men det er klarere end tavshed.
5. Publicer og vedligehold den
Placér den på /llms.txt. Servér den som text/plain eller et kompatibelt tekstsvar. Link kun til kanoniske URL'er. Gennemgå den, når din informationsarkitektur ændrer sig.
En forældet llms.txt er værre end ingen fil, fordi den giver selvsikre instruktioner, som ikke længere er sande.
Bør alle sites have en?
Nej.
Et brochure-site på fem sider har sandsynligvis ikke brug for llms.txt. En lokal restaurant har ikke brug for en, medmindre den har strukturerede politikker eller bookingoplysninger, som AI-assistenter ofte gengiver forkert.
Den bliver mere nyttig, når:
- dit site har meget dokumentation;
- gammelt indhold konkurrerer med nyt indhold;
- du udgiver forskning eller redaktionelt materiale;
- licensering og kreditering betyder noget;
- AI-assistenter ofte opsummerer dine sider;
- interne teams har brug for en fælles politik for offentligt indhold.
Den er også nyttig som del af en intern governanceøvelse. Mange virksomheder har allerede medarbejdere, der indsætter websider, dokumenter og kundemateriale i AI-systemer. Hvis det lyder bekendt, så gennemfør en grundlæggende shadow AI-audit, før du antager, at en offentlig tekstfil løser risikoen.
SEO-konsekvenser
llms.txt er ikke en rankingfaktor i nogen etableret forstand. Skriv ikke en, fordi du forventer et trafikløft i næste uge.
Den indirekte SEO-sag er mere beskeden:
- den tvinger til kanonisk tænkning;
- den kan hjælpe AI-medierede søge- og svarsystemer med at forstå dit site;
- den tydeliggør præferencer for kreditering;
- den reducerer tvetydighed omkring arkiverede sider;
- den skaber en offentlig, inspicerbar AI-indholdspolitik.
Det er værdifuldt for nogle sites. Det er ikke et magisk optimeringslag.
Den bedste version af llms.txt er lille, aktuel og afstemt med resten af dit site. Hvis dine robots-regler, din vilkårsside, dit sitemap, dine canonical-tags og din llms.txt alle siger forskellige ting, er problemet ikke AI-crawling. Problemet er governance.
<!-- tool-cta:start -->
💡 Prøv dette: Da llms.txt ikke kan håndhæves, skal du kombinere den med regler, der kan håndhæves, og kontrollere dem i Robots.txt Tester, så crawlere, der følger standarder, opfører sig korrekt.
<!-- tool-cta:end -->
En afsluttende anbefaling
Hvis dit site har dokumentation, redaktionelt indhold eller licensmæssige bekymringer, så opret en enkel llms.txt. Hold den under nogle få dusin linjer. Brug den til at pege på kanoniske ressourcer og angive dine præferencer for genbrug.
Men forveksl ikke kommunikation med kontrol.
Til blokering skal du bruge de crawler-mekanismer, du har til rådighed, og forstå deres begrænsninger. Til politik skal du publicere klare vilkår. Til tillid skal du være transparent over for læserne. llms.txt hører hjemme i den stak som et nyttigt signal—ikke som et skjold.