Dostęp

Boty i llms.txt to higiena


Abstrakcyjne still: ścieżka L, linia akcentu i trzy obrysowane belki.

robots.txt, llms.txt, sitemapy i nagłówki to higiena. Mówią crawlerom, co wolno czytać. To nie bilet do ChatGPT, Gemini ani niczyjego alokatora.

Jeśli bot nie dosięgnie strony, żaden spam FAQ nie sprawi, że model Cię zacytuje. Najpierw dostęp do plików. Potem fakty do wyciągnięcia. Potem znów pomiar.

llms.txt to publiczna mapa — dokument uprzejmości. Część retrieverów zagląda. Część ignoruje. Sprzedaż tego jako dźwigni rangi to kłamstwo kategorii. Inwentaryzujemy to, co wypuszczasz, i oznaczamy rozjazdy: sitemapa sprzeczna z robots, nagłówek blokujący bota, którego zaprosiłeś, HTML inny niż ten, który widzi człowiek.

Ten sam publiczny HTML dla ludzi i crawlerów. Bez cloakingu. Bez widelca user-agent. To prawo produktu, nie nastrój. Odkrycie — zgłoszenie URL, otwarcie ścieżki — to nie gwarancja cytatu. To szansa, że Cię przeczytają.

Analityka agentów, gdy ją pokazujemy, pochodzi z logów, które już masz. Ruch treningowy, pobrania i hity indeksowania to różne roboty. Zlewanie ich w „ruch AI” to kolejne słowo-mgła.

Lekki payload dla agentów, z HTML dla ludzi bez zmian, to późniejszy pomysł w tym stosie. To nie cloaking. Tego też nie ma w ofercie v1. Nie kupuj historii o niewidzialnej drugiej stronie.

Uczciwa sekwencja jest nudna, dlatego działa: czy bot pobierze, czy człowiek zacytuje fragment, czy kolejny miesięczny wycinek się ruszył. Higiena, nie folklor.

Wszystkie idee