Na jakie pytania odpowiada to hasło
- Czy plik llms.txt pomaga w widoczności w ChatGPT i Perplexity?
- Co powinno się znaleźć w llms.txt?
llms.txt: wyjaśnienie
Pomysł jest prosty: robots.txt mówi robotom, czego nie wolno skanować, sitemap XML wymienia wszystkie adresy technicznie, a llms.txt miałby mówić modelom, co w serwisie jest najważniejsze i w dwóch–trzech zdaniach na sekcję – czym to jest. W wersji rozbudowanej (llms-full.txt) trafia pełna treść kluczowych stron. Plik piszesz jak spis treści dla maszyny: nazwa firmy i kategorii, opis oferty, linki do stron usług, bazy wiedzy, porównań i danych firmowych, każdy z jednym zdaniem kontekstu.
Wdrożenie jest tanie – to jeden plik tekstowy – dlatego traktujemy je jako standard higieny w audytach dostępu AI, obok sprawdzenia, czy crawlerzy AI w ogóle mają dostęp w robots.txt.
Uczciwie o skuteczności: to jest propozycja standardu, nie ustalony kanon. Nie ma twardego potwierdzenia, że główne modele wprost czytają llms.txt przy każdej odpowiedzi, a część rynku traktuje go ostrożnie – dlatego pozycjonujemy go właściwie: to tani, szybki ruch, który może pomóc w ekstrakcji treści i niczego nie psuje, ale nie jest zamiennikiem pracy nad treścią, encjami i wzmiankami.
Serwis, który ma w pliku reklamę świetnej oferty, a w treściach nic, czego model mógłby użyć, nie zyska widoczności z samego istnienia pliku.
Odwrotnie też działa: serwis z gęstymi, cytowalnymi treściami jest widoczny bez llms.txt. Plik pełni więc rolę uzupełnienia – uporządkowania drogi wejścia dla modeli, które chcą z serwisu skorzystać – a nie dźwigni.