Baza wiedzy

Dlaczego Twoja strona nie istnieje dla ChatGPT i Google AI

Roboty modeli językowych nie wykonują JavaScriptu. Jeśli treść Twojej strony renderuje się dopiero w przeglądarce, ChatGPT, Perplexity i Google AI Overviews widzą pustą stronę — niezależnie od tego, jak dobrze wygląda dla człowieka.

Opublikowano · Jakub Butryn, Founder · Lead engineer

Co widzi robot, a co widzi człowiek

Klasyczny Googlebot potrafi wyrenderować JavaScript, choć robi to z opóźnieniem i nie zawsze. Roboty zbierające dane dla modeli językowych — GPTBot, ClaudeBot, PerplexityBot, CCBot i pozostałe — pobierają surowy HTML i na tym kończą. Aplikacja jednostronicowa bez treści w HTML jest dla nich pustym dokumentem.

Test zajmuje kilkanaście sekund: pobierz własną stronę poleceniem curl i zobacz, co faktycznie przyszło. Jeśli w odpowiedzi jest tylko pusty kontener i odwołanie do pliku JavaScript, model nie ma czego cytować.

Trzy warstwy, które trzeba mieć

Pierwsza: treść dostępna w surowym HTML — realne akapity, nagłówki i linki serwowane od razu, nie dorysowywane po stronie klienta. Druga: dane strukturalne w formacie JSON-LD, które jednoznacznie mówią, czym jest podmiot, co oferuje i ile to kosztuje. Trzecia: pliki sterujące dostępem robotów — robots.txt, sitemap.xml oraz llms.txt.

Odpowiedź w pierwszym zdaniu

Silniki odpowiedzi wycinają fragmenty, nie całe strony. Fragment, który da się pokazać samodzielnie, musi być samodzielnie zrozumiały. Stąd reguła: nagłówek jest pytaniem, a pierwsze zdanie pod nim pełną odpowiedzią, bez odwołań do „powyższego akapitu”.

Konkret zwiększa szansę cytowania: liczba, jednostka, zakres czasu i nazwa własna są chętniej przenoszone do odpowiedzi niż zdanie ogólne.

Nie blokuj robotów AI, jeśli chcesz być cytowany

Duża część poradników zaleca blokowanie GPTBota i pokrewnych w robots.txt, żeby chronić treść przed treningiem modeli. To decyzja biznesowa z ceną: zablokowany robot to brak obecności w odpowiedziach generowanych przez ten silnik. Jeśli celem jest widoczność, wpuszcza się je świadomie i jawnie.

Najczęstsze pytania

Czy roboty AI wykonują JavaScript?

Nie. Roboty zbierające treść dla modeli językowych, takie jak GPTBot, ClaudeBot, PerplexityBot czy CCBot, pobierają surowy HTML i nie uruchamiają JavaScriptu. Strona renderowana wyłącznie po stronie klienta jest dla nich pustym dokumentem.

Czym jest plik llms.txt?

llms.txt to plik tekstowy w katalogu głównym domeny, opisujący w Markdownie, czym jest serwis i gdzie leżą jego najważniejsze treści. Powstał po to, żeby modele językowe mogły szybko zorientować się w witrynie bez przeszukiwania całego HTML-a.

Jak sprawdzić, co widzi robot na mojej stronie?

Pobierz stronę bez wykonywania JavaScriptu, na przykład poleceniem curl -A "GPTBot" https://twojadomena.pl, i przeczytaj odpowiedź. To dokładnie ten HTML, na którym pracuje robot modelu językowego.

Omów swój przypadek — konsultacja bezpłatna Telegram @sotius