Baza wiedzy
Dlaczego Twoja strona nie istnieje dla ChatGPT i Google AI
Roboty modeli językowych nie wykonują JavaScriptu. Jeśli treść Twojej strony renderuje się dopiero w przeglądarce, ChatGPT, Perplexity i Google AI Overviews widzą pustą stronę — niezależnie od tego, jak dobrze wygląda dla człowieka.
Opublikowano · Jakub Butryn, Founder · Lead engineer
Co widzi robot, a co widzi człowiek
Klasyczny Googlebot potrafi wyrenderować JavaScript, choć robi to z opóźnieniem i nie zawsze. Roboty zbierające dane dla modeli językowych — GPTBot, ClaudeBot, PerplexityBot, CCBot i pozostałe — pobierają surowy HTML i na tym kończą. Aplikacja jednostronicowa bez treści w HTML jest dla nich pustym dokumentem.
Test zajmuje kilkanaście sekund: pobierz własną stronę poleceniem curl i zobacz, co faktycznie przyszło. Jeśli w odpowiedzi jest tylko pusty kontener i odwołanie do pliku JavaScript, model nie ma czego cytować.
Trzy warstwy, które trzeba mieć
Pierwsza: treść dostępna w surowym HTML — realne akapity, nagłówki i linki serwowane od razu, nie dorysowywane po stronie klienta. Druga: dane strukturalne w formacie JSON-LD, które jednoznacznie mówią, czym jest podmiot, co oferuje i ile to kosztuje. Trzecia: pliki sterujące dostępem robotów — robots.txt, sitemap.xml oraz llms.txt.
Odpowiedź w pierwszym zdaniu
Silniki odpowiedzi wycinają fragmenty, nie całe strony. Fragment, który da się pokazać samodzielnie, musi być samodzielnie zrozumiały. Stąd reguła: nagłówek jest pytaniem, a pierwsze zdanie pod nim pełną odpowiedzią, bez odwołań do „powyższego akapitu”.
Konkret zwiększa szansę cytowania: liczba, jednostka, zakres czasu i nazwa własna są chętniej przenoszone do odpowiedzi niż zdanie ogólne.
Nie blokuj robotów AI, jeśli chcesz być cytowany
Duża część poradników zaleca blokowanie GPTBota i pokrewnych w robots.txt, żeby chronić treść przed treningiem modeli. To decyzja biznesowa z ceną: zablokowany robot to brak obecności w odpowiedziach generowanych przez ten silnik. Jeśli celem jest widoczność, wpuszcza się je świadomie i jawnie.
Najczęstsze pytania
- Czy roboty AI wykonują JavaScript?
Nie. Roboty zbierające treść dla modeli językowych, takie jak GPTBot, ClaudeBot, PerplexityBot czy CCBot, pobierają surowy HTML i nie uruchamiają JavaScriptu. Strona renderowana wyłącznie po stronie klienta jest dla nich pustym dokumentem.
- Czym jest plik llms.txt?
llms.txt to plik tekstowy w katalogu głównym domeny, opisujący w Markdownie, czym jest serwis i gdzie leżą jego najważniejsze treści. Powstał po to, żeby modele językowe mogły szybko zorientować się w witrynie bez przeszukiwania całego HTML-a.
- Jak sprawdzić, co widzi robot na mojej stronie?
Pobierz stronę bez wykonywania JavaScriptu, na przykład poleceniem curl -A "GPTBot" https://twojadomena.pl, i przeczytaj odpowiedź. To dokładnie ten HTML, na którym pracuje robot modelu językowego.
Omów swój przypadek — konsultacja bezpłatna Telegram @sotius