llms.txt: co to je a jestli to má vůbec smysl
· 8 min čtení
Slyšíte to ze všech stran. llms.txt je prý nový must-have pro éru AI. Bez něj vás ChatGPT ani Perplexity nenajdou, obsah zůstane neviditelný a konkurence vás předběhne. Zní to logicky. Robots.txt máme pro Google, tak proč ne soubor pro jazykové modely?
Je to ale pravda? Krátká odpověď: zatím ne. Delší odpověď je zajímavější a stojí za pár minut čtení.
Tenhle článek není další návod ve stylu "nasaďte llms.txt a vyhrajete AI". Je to poctivý pohled na to, co ten soubor je, kdo ho reálně čte a jestli se vám ho vyplatí řešit. Spoiler: pro většinu webů je to teď ztráta času. Ale ne pro všechny.
1. Co je llms.txt (a llms-full.txt) - k čemu měl sloužit
llms.txt je obyčejný textový soubor ve formátu Markdown. Umístí se do kořene webu, tedy na adresu vasedomena.cz/llms.txt. Návrh přišel v roce 2024 od Jeremyho Howarda, spoluzakladatele fast.ai.
Myšlenka za tím je rozumná. Klasické HTML stránky jsou plné navigace, reklam, patiček a skriptů. Jazykový model se v tom šumu musí prokousat k tomu, co je skutečně důležité. llms.txt měl být zkratka. Čistý, strukturovaný přehled toho nejdůležitějšího obsahu, servírovaný modelu na stříbrném podnose.
Existují dvě varianty. llms.txt je stručný rozcestník s odkazy na klíčové stránky a krátkými popisky. llms-full.txt obsahuje kompletní obsah dokumentace na jednom místě, připravený k přímému vložení do kontextového okna modelu.
Důležité je pochopit rozdíl oproti robots.txt. Robots.txt říká, kam crawler smí a kam ne. llms.txt měl naopak říkat, co je pro model nejzajímavější. Není to zákaz. Je to doporučení, kudy jít.
2. Kdo to reálně čte
A tady přichází ta nepříjemná část. llms.txt čte skoro nikdo.
Existuje studie, která prošla 137 000 domén s nasazeným souborem llms.txt. Výsledek je tvrdý. U 97 procent těch souborů si je žádný AI crawler nikdy ani nevyžádal. Soubor tam ležel, majitel ho poctivě vytvořil a udržoval, a na druhé straně o něj nikdo nestál.
John Mueller z Googlu to řekl bez obalu. Podle něj žádná AI služba momentálně llms.txt nepoužívá. Přirovnal ho ke značce keywords v meta tazích, tedy k něčemu, co weby vyplňovaly roky, aniž by to mělo jakýkoli efekt.
Nezůstalo u názorů. Ahrefs i Semrush provedly vlastní testy napříč velkými vzorky webů. Hledaly korelaci mezi přítomností llms.txt a výkonem v AI vyhledávání, tedy citacemi a zmínkami v odpovědích modelů. Nenašly žádnou. Weby se souborem si nevedly lépe než weby bez něj.
Proč to tak je? Modely jako ChatGPT nebo Perplexity při odpovídání typicky načtou konkrétní stránku, kterou už našly přes klasický index. Nechodí nejdřív hledat llms.txt. Ekosystém, který by ten soubor systematicky využíval, prostě neexistuje.
3. Postoj velké čtyřky
Nejzajímavější je sledovat, co samotné AI firmy dělají, ne co říkají. Deklarace jsou jedna věc. Reálné chování crawlerů druhá.
| Hráč | Co se o llms.txt tvrdí | Co reálně dělá |
|---|---|---|
| Gemini prý těží z čistého obsahu | John Mueller: žádná AI služba llms.txt nepoužívá. Google ho ignoruje | |
| OpenAI | Podporuje strukturovaný obsah | llms.txt má jen na vlastní dokumentaci, cizí soubory systematicky nečte |
| Anthropic | Standard sám používá | llms.txt nasazený na docs.anthropic.com, ale jako čtenář cizích webů ho neřeší |
| Perplexity | Zaměřená na citace zdrojů | Cituje z živého indexu, ne z llms.txt souborů |
Vidíte ten vzorec? OpenAI, Anthropic i Perplexity mají llms.txt nasazený. Ale výhradně na své vlastní dokumentaci, aby vývojáři a modely lépe pracovali s jejich API.
To je klíčové rozlišení. Jako vydavatelé dokumentace ten standard používají. Jako konzumenti cizího obsahu ho ale neberou v potaz. Nikdo z nich neprohlásil, že by při procházení webu llms.txt aktivně vyhledával a upřednostňoval.
Jinými slovy. Firmy, které stojí za standardem, ho používají pro sebe. Pro váš firemní web z něj zatím nekouká nic.
4. Kdy to smysl dává a kdy ne
Neznamená to, že je llms.txt úplně k ničemu. Existuje kontext, kde dává smysl. Jen to nejspíš není ten váš.
Smysl to dává u technické dokumentace a API docs. Podívejte se, kdo standard reálně nasadil. Anthropic na své dokumentaci. Stripe u své platební dokumentace. Mintlify, platforma pro tvorbu dokumentace, to nabízí svým zákazníkům automaticky.
Co mají společného? Rozsáhlou strukturovanou dokumentaci, kterou vývojáři aktivně vkládají do AI nástrojů. Programátor si zkopíruje llms-full.txt a vloží ho do Claude nebo ChatGPT, aby mu model pomohl s integrací. Tady je použití konkrétní a okamžité.
A kdy to smysl nedává? U běžného firemního webu, blogu nebo e-shopu. Nikdo si nekopíruje llms-full.txt vašeho e-shopu s botami do ChatGPT. Zákazník hledá produkt přes klasické vyhledávání nebo se ptá AI, která si sáhne do svého indexu. Váš pečlivě sestavený soubor přitom mine.
Rozdíl je v tom, jak lidé s obsahem pracují. Dokumentaci vývojáři cíleně krmí do modelů. Marketingový web ne. Proto u prvního llms.txt sedí a u druhého leží ladem.
5. Jak ho nasadit za 10 minut
Řekněme, že provozujete dokumentaci a chcete to zkusit. Nebo jste prostě zvědaví. Nasazení je triviální, ale pořadí priorit je zásadní.
Nejdřív se ujistěte, že máte pořádně vyřešené základy. Funkční robots.txt, který AI crawlerům nezakazuje přístup. Web, který je bezchybně zaindexovaný. Obsah, který má reálnou kvalitu a hodnotu. Teprve když tohle stojí, má smysl řešit llms.txt. Nasazovat ho na děravý web je jako leštit kliku u domu bez střechy.
Samotný postup je jednoduchý. Vytvořte soubor llms.txt. Na první řádek dejte hlavní nadpis s názvem projektu. Přidejte krátký odstavec, který popíše, o čem web je.
Pak vypište odkazy na nejdůležitější stránky, seskupené do sekcí. Ke každému odkazu připojte jednu větu popisu. Formát je čitelný Markdown, žádná složitá syntaxe.
Soubor nahrajte do kořene webu. Volitelně vytvořte i llms-full.txt s kompletním obsahem dokumentace. Hotovo. Zabralo to deset minut a nikoho to nebolí. Jen si nedělejte iluze, že tím právě vyhráváte AI viditelnost.
6. Co dělat místo toho pro AI viditelnost
Tady je jádro celého článku. Pokud vám opravdu jde o to být vidět v AI odpovědích, zkratky neexistují. GEO, tedy optimalizace pro generativní vyhledávání, je z devadesáti procent poctivé SEO.
AI modely nečerpají z magického souboru. Čerpají z webu, který už umí procházet klasické vyhledávače. Když vás Google nezaindexuje a nepovažuje za důvěryhodný zdroj, nezachrání vás žádný llms.txt.
Zaměřte se na věci, které fungují prokazatelně. Bezchybná indexace, aby se k vám modely vůbec dostaly. Skutečně kvalitní obsah, který odpovídá na konkrétní otázky. Citovatelnost, tedy jasná struktura, fakta, čísla a formulace, které model může snadno převzít do odpovědi.
K tomu autorita. Zmínky na jiných webech, zpětné odkazy, konzistentní jméno napříč zdroji. AI dává přednost tomu, co se opakovaně objevuje u důvěryhodných vydavatelů. Tohle se nedá obejít jedním souborem v kořeni webu.
Pokud chcete pochopit, jak celý koncept funguje do hloubky, přečtěte si co je GEO a jak se liší od klasického SEO. A pokud řešíte, jak konkrétně zvýšit viditelnost svého webu v AI odpovědích, podívejte se na optimalizaci pro AI vyhledávání.
Chci být vidět v AI odpovědíchTip od SEO specialisty
Sledujte serverové logy, ne dojmy. Jestli vás láká zjistit, jestli má llms.txt smysl zrovna pro vás, nespoléhejte na články ani na cizí studie. Máte důkaz přímo u sebe.
Otevřete si logy svého serveru nebo report z analytiky a podívejte se na user agenty AI crawlerů. Hledejte GPTBot od OpenAI, ClaudeBot od Anthropicu, PerplexityBot a podobné. Zjistíte dvě věci najednou.
Za prvé, jestli si vůbec někdo vyžádal váš /llms.txt. Ve valné většině případů uvidíte přesně to, co ukázala studie na 137 000 doménách. Nula požadavků. Za druhé, a to je cennější, uvidíte, které vaše normální stránky AI boti reálně procházejí. To vám řekne mnohem víc než jakýkoli trend. Optimalizujte pro to, co se skutečně děje, ne pro to, co se o AI píše.
Často kladené otázky (FAQ)
vasedomena.cz/llms.txt. Měl sloužit jako strukturovaný přehled nejdůležitějšího obsahu pro jazykové modely. V praxi ho zatím skoro žádný AI crawler nevyužívá.llms.txt je stručný rozcestník s odkazy na klíčové stránky a krátkými popisky. llms-full.txt obsahuje kompletní obsah, typicky celou dokumentaci, na jednom místě, připravený k přímému vložení do kontextu modelu. První je mapa, druhý je celá kniha.llms-full.txt cíleně vkládají do AI nástrojů. Pro běžný firemní web nebo e-shop přínos zatím není.