Roboty a prístup

llms.txt — súbor, ktorý hovorí jazykovým modelom, kto ste.

Je to obyčajný textový súbor v koreni domény. Nie je to potvrdený štandard a žiadny model negarantuje, že ho prečíta. Napriek tomu ho odporúčame — dôvody aj výhrady sú nižšie.

Čo llms.txt je

Je to súbor v Markdowne, ktorý leží na vasadomena.sk/llms.txt. Obsahuje zhrnutie toho, čo firma robí, zoznam služieb s odkazmi, kontakt a prípadne referencie — napísané tak, aby to jazykový model prečítal bez toho, aby sa musel prehrabávať cez navigáciu, cookie lišty a JavaScript.

Myšlienka je jednoduchá: web je napísaný pre človeka s prehliadačom. Model, ktorý má za tri sekundy pochopiť, čo ste zač, sa cez rozloženie stránky prebíja zbytočne. llms.txt je skratka — jedna stránka čistého textu, ktorá odpovedá na otázku „kto ste a čo robíte“.

Formát navrhol Jeremy Howard v roku 2024 a stavia na tom istom princípe ako robots.txt alebo sitemap.xml: dohodnuté miesto, kde stroj nájde, čo hľadá, bez hádania.

Nezamieňať s robots.txt

Sú to dve rôzne veci a riešia opačné otázky.

robots.txt hovorí či smie robot na váš web. Je to povolenie alebo zákaz prístupu. llms.txt nehovorí nič o prístupe — dáva obsah. Môžete mať jedno bez druhého a ani jedno nenahrádza to druhé. Ak máte v robots.txt zakázaného agenta, llms.txt mu to nesprístupní.

Rozdiel sa dá zhrnúť tabuľkou:

robots.txtllms.txt
odpovedá nasmieš sem?toto som zač
formátdirektívyMarkdown
štandardod roku 1994, rešpektovanýnávrh, negarantovaný
čo sa stane bez nehoplatí povolenémodel si obsah vezme zo stránok

Overte si to sami, trvá to desať sekúnd

Otvorte vasadomena.sk/llms.txt. Buď uvidíte text, alebo nie.

Pozor na falošný pozitív. Ak sa vám namiesto textu zobrazí domovská stránka alebo akákoľvek grafika, súbor nemáte — server len na neexistujúcu adresu vrátil niečo iné. Toto je najčastejší dôvod, prečo si firma myslí, že llms.txt má.

Overiť sa to dá tak, že si vypýtate adresu, ktorá určite neexistuje, napríklad vasadomena.sk/llms-nezmysel.txt: ak dostanete to isté, je to catch-all pravidlo, nie váš súbor. Z príkazového riadka to potvrdí curl -I https://vasadomena.sk/llms.txt — hľadáte content-type: text/plain. Ak tam je text/html, dostávate stránku, nie súbor.

Čo do neho patrí a v akom poradí

Poradie nie je kozmetika. Model, ktorý súbor spracúva, má obmedzenú pozornosť a prvé riadky váži viac. Držte sa tejto postupnosti:

  1. Nadpis a jednovetové zhrnutie. Kto ste, kde ste, čo robíte. Toto je jediná veta, ktorú model prečíta určite.
  2. Kontakt a pôsobnosť. E-mail, telefón, adresa, jazyky, krajiny.
  3. Služby alebo produkty — každá s odkazom na svoju stránku a jednou vetou, čo znamená.
  4. Overiteľné čísla — registračné údaje, počet pobočiek, rozsah pôsobenia, čokoľvek, čo sa dá skontrolovať.
  5. Odkazy na potvrdenia — obchodný register, profil na mapách, profily na sieťach.

Čo tam nepatrí: čokoľvek, čo nie je aj na webe. Model, ktorý nájde v llms.txt tvrdenie, ktoré na stránkach nevidí, nemá ako overiť, ktoré platí. A hlavne: žiadne čísla, ktoré neviete doložiť. Vymyslený údaj v strojovo čitateľnom súbore sa šíri ďalej presne tak, ako ste ho napísali.

Ako ho udržať pri živote

Toto je časť, ktorú návody vynechávajú, a pritom rozhoduje o tom, či bude súbor o rok ešte pravdivý.

Čísla, ktoré rastú, sa musia počítať, nie prepisovať. Ak v llms.txt uvediete „40 článkov“ alebo „82 certifikátov“, o mesiac to nebude platiť a nikto si nespomenie. Ak sa súbor generuje pri zostavení webu z tých istých dát, z ktorých sa generuje web, nemôže zostarnúť. Ak sa píše ručne, dajte doň len to, čo sa nemení.

Odkazy sa musia kontrolovať. Mŕtvy odkaz v llms.txt je horší než žiadny — tvrdíte niečo, čo sa nedá overiť.

Dátum poslednej zmeny doň nedávajte, ak ho neviete udržiavať. Starý dátum hovorí „toto nikto nesleduje“ hlasnejšie než jeho absencia.

Hraničné prípady

Veľký web s tisíckami stránok

llms.txt nie je sitemap a nemá vymenovať všetko. Pri veľkom webe doň patria len rozcestníky — kategórie, hlavné sekcie — a zvyšok rieši sitemap. Zoznam piatich tisíc adries v Markdowne nikto nespracuje.

Viacjazyčný web

Formát nemá dohodnutý spôsob, ako vyjadriť jazykové mutácie. Praktické riešenie je jeden súbor v hlavnom jazyku s odkazmi na mutácie, alebo samostatný llms.txt na každej jazykovej doméne. Druhé je čistejšie, ak sú domény oddelené.

Niekto vám ho skopíruje

Stane sa to a nedá sa tomu zabrániť — je to verejný textový súbor. Preto doň nepatria veci, na ktorých stojí vaša výhoda, ale veci, ktoré vás identifikujú: registračné čísla, adresa, konkrétne odkazy. Tie skopírovať nejde bez toho, aby to bolo zjavné.

Buďme úprimní: čo llms.txt nie je

Nie je to schválený štandard. Je to návrh, ktorý zatiaľ neprijala žiadna z veľkých firiem ako záväzný, a nikto negarantuje, že ho ChatGPT, Gemini alebo Perplexity čítajú. Kto vám tvrdí opak, buď to nevie, alebo vám niečo predáva.

Nie je to ani spôsob, ako sa dostať do odpovede modelu. Ak o vás na webe neexistujú overiteľné zdroje, llms.txt to nenahradí — povie len to, čo tvrdíte sami o sebe, a to je najslabší druh dôkazu.

Prečo ho teda odporúčame? Lebo náklad je dvadsať minút práce a jeden textový súbor, riziko je nulové, a ak sa formát ujme, máte ho pripravený. Je to lacná stávka, nie zázrak. Kto od neho čaká skok vo viditeľnosti, bude sklamaný.

Časté otázky

Je llms.txt oficiálny štandard?

Nie. Je to návrh formátu, ktorý zatiaľ žiadny veľký poskytovateľ neprijal ako záväzný. Odporúčame ho preto, že jeho vytvorenie je lacné a nemôže uškodiť, nie preto, že by bol garantovaný.

Nahrádza llms.txt súbor robots.txt?

Nie, riešia rozdielne veci. robots.txt určuje, či robot smie na web. llms.txt mu dáva obsah. Potrebujete oba.

Ako často ho treba aktualizovať?

Vždy, keď sa zmení niečo, čo je v ňom napísané — pribudne služba, zmení sa kontakt alebo adresa. Ak sú v ňom čísla, ktoré rastú, treba ich prepisovať ručne; nič ich neprepočíta za vás. Najbezpečnejšie je generovať ho pri zostavení webu z tých istých dát ako web.

Ako veľký má llms.txt byť?

Toľko, koľko sa dá prečítať na jeden raz — rádovo desiatky riadkov, nie tisíce. Nie je to náhrada sitemapy. Pri veľkom webe doň patria rozcestníky, nie zoznam všetkých adries.

Čo ak mi ho niekto skopíruje?

Zabrániť sa tomu nedá, je to verejný súbor. Preto doň patria údaje, ktoré vás identifikujú — registračné čísla, adresa, vlastné odkazy — a nie to, na čom stojí vaša výhoda.

Chcete vedieť, ako je na tom váš web?

Pošlite nám adresu a pripravíme krátky audit s konkrétnymi nálezmi — pri každom je napísané, kde si ho overíte sami. Zadarmo, do 48 hodín.