llms.txt
llms.txt är en föreslagen konvention för en markdown-fil i roten av en webbplats som listar dess viktigaste sidor med korta beskrivningar, så att en språkmodell kan hitta relevant material utan att tolka navigation, skript och layout. Den föreslogs av Jeremy Howard 2024.
Så ser filen ut
Den ligger på /llms.txt och är markdown, inte ett direktivformat. Konventionen är en h1 med webbplatsens namn, ett kort citatblock som sammanfattning, och sedan listor av länkar med en rad beskrivning per länk:
# NorthernGo
> En AI-appbyggare som kan generera applikationer lokalt i webbläsaren.
## Guider
- [Koppla in Supabase](https://northerngo.com/sv/guider/connect-supabase/): Lägg till en databas i en genererad app.
- [Lokal AI med WebGPU](https://northerngo.com/sv/guider/webgpu-react-local-ai/): Så fungerar generering i webbläsaren.
En syskonfil /llms-full.txt innehåller hela texten i dokumentationen i en enda fil, för fall där en modell ska läsa allt i stället för att navigera.
Resonemanget är enkelt. HTML är ett renderingsformat; en modell som hämtar en sida betalar av sitt kontextfönster för märkspråk, menyer och kakbanners innan den når meningen den behöver. Markdown tar bort den kostnaden, och en kurerad lista är mer användbar än en sitemap eftersom den säger vad varje sida är till för.
Vem det är till för
Den tydligaste passformen är dokumentation, API:er och referensmaterial — webbplatser där en assistent som hjälper en utvecklare tjänar på att bli pekad mot rätt sida. Flera företag inom utvecklarverktyg publicerar en, och några AI-verktyg för kod läser den om du pekar dem mot den.
Vad du bör se upp med
Det är inte robots.txt, och det styr ingenting. Det är den vanligaste sammanblandningen. robots.txt är en väletablerad konvention som crawlare respekterar för åtkomst; llms.txt ger ingen behörighet och förbjuder ingenting. Att lägga till den hindrar inte AI-träning på ditt innehåll, och att ta bort den gör det inte heller. Är åtkomstkontroll det du vill ha är det robots.txt, en brandvägg eller ett licensavtal.
Det andra att vara ärlig om: spridningen är obevisad. I dagsläget har ingen större AI-leverantör offentligt förbundit sig att hämta eller använda filen som del av normal hämtning, och sökmotorerna har inte ställt sig bakom den. Att publicera en är billigt och rimligen nyttigt; att behandla den som en spak för ranking eller citeringar har inte stöd i belägg.
Publicerar du en: håll den korrekt. En fil som listar sidor som flyttat är värre än ingen fil, och det är precis den sorts artefakt som skrivs en gång och aldrig uppdateras. Verklig synlighet i AI-svar kommer från arbetet som beskrivs under generative engine optimization, inte från ett manifest.
Vanliga frågor
Hindrar llms.txt AI-företag från att träna på min webbplats?
Nej. Det är ett hjälpsamt register, inte en behörighetsfil, och det har ingen begränsande verkan alls. För att begränsa crawlning behövs direktiv i robots.txt för de specifika crawlarna, och för något som ska upprätthållas snarare än efterfrågas är inloggning eller en brandväggsregel den enda tillförlitliga mekanismen.
Är det värt att publicera en llms.txt-fil?
Har du dokumentation och kan generera filen automatiskt från innehåll du redan underhåller, ja — kostnaden är nära noll och nackdelen är bara en inaktuell fil. Skulle den skrivas och uppdateras för hand är arbetet bättre använt på att göra själva sidorna tydligare och mer citerbara.
Bygg det själv
NorthernGo förvandlar en beskrivning i ren text till en fungerande webbapp med databas, inloggning och en live-adress. Lokal AI-generering körs på ditt eget grafikkort, är obegränsad och ingår gratis i alla prisplaner.