Czy asystenci AI widzą Twoją stronę
Sprawdź, czy ChatGPT, Claude, Perplexity i AI Overviews mogą odczytać Twoją stronę — i czy w ogóle im na to pozwalasz. Analizujemy reguły dla robotów AI w robots.txt, treść dostępną bez JavaScriptu, strukturę HTML, dane strukturalne, plik llms.txt oraz obecność autora i daty.
Co sprawdza test gotowości dla AI
Polityka wobec robotów AI — Reguły w robots.txt dla GPTBot, ClaudeBot, Google-Extended, PerplexityBot, CCBot, Bytespider, Applebot-Extended i pozostałych. Rozróżniamy roboty trenujące modele od wyszukujących, które pobierają stronę, żeby zacytować ją w odpowiedzi razem z linkiem. Brak reguł oznacza pełny dostęp i oceniamy to dobrze — punkty odejmujemy wyłącznie za zablokowanie robotów wyszukujących.
Czy treść da się w ogóle wyodrębnić — Semantyczny kontener głównej treści (<main> lub <article>) i udział tekstu w kodzie HTML, a gdy renderer zdążył zadziałać — porównanie surowego HTML-a z wersją po wykonaniu JavaScriptu. Większość robotów AI nie uruchamia JS i dostaje wtedy pusty szkielet strony.
Dane strukturalne — Obecność i kompletność JSON-LD: schemat opisujący podmiot (Organization, LocalBusiness lub Person) oraz schemat pasujący do treści (Article, Product, FAQPage, HowTo). Pozwalają maszynie odczytać fakt wprost, zamiast wnioskować go z tekstu.
llms.txt oraz autor i data — Plik /llms.txt wskazujący modelom najważniejsze treści — propozycja z 2024 roku, której żaden duży dostawca jeszcze nie honoruje, więc jej brak prawie nie obniża wyniku. Do tego autor i data publikacji lub aktualizacji: asystent decydujący, czy zacytować źródło, szuka tego samego co człowiek weryfikujący informację.
Mierzymy, czy asystent może odczytać stronę i czy wolno mu to zrobić. Nie mierzymy i nie obiecujemy pozycji w odpowiedziach AI — tego nie da się ustalić z zewnątrz, bo modele nie publikują swoich źródeł ani kryteriów wyboru. Jeśli jakiekolwiek narzędzie podaje Ci „wynik widoczności w ChatGPT”, warto zapytać, skąd go wzięło. Wagi i progi opisujemy w metodologii.
Trenujące kontra wyszukujące — rozróżnienie, które decyduje o ruchu
Roboty AI dzielą się na dwie grupy o zupełnie różnych skutkach dla Ciebie, a większość poradników wrzuca je do jednego worka i każe blokować wszystko.
Roboty trenujące (GPTBot, ClaudeBot, Google-Extended, CCBot) pobierają treść, żeby wykorzystać ją do uczenia modeli. Nie odsyłają do Ciebie nikogo. Blokowanie ich jest w pełni uzasadnioną decyzją biznesową i nie kosztuje ruchu.
Roboty wyszukujące (OAI-SearchBot, Claude-SearchBot, PerplexityBot) pobierają stronę w momencie, gdy ktoś zadaje pytanie, i cytują ją w odpowiedzi razem z linkiem. To one przynoszą odwiedzających. Zablokowanie ich to dokładnie to samo, co wypisanie się z wyników wyszukiwania.
Dlatego nasz test odejmuje punkty tylko za blokadę wyszukujących. Blokada trenujących jest neutralna — to Twój wybór, a nie błąd.
Jak ustawić to świadomie
1. Zablokuj trening, zostaw cytowanie Najczęściej rozsądny kompromis: Twoja treść nie zasila uczenia modeli, ale nadal może być cytowana z linkiem, gdy ktoś zadaje pytanie na Twój temat.
User-agent: GPTBot
User-agent: ClaudeBot
User-agent: CCBot
User-agent: Google-Extended
Disallow: /
User-agent: OAI-SearchBot
User-agent: Claude-SearchBot
User-agent: PerplexityBot
Allow: /
2. Opakuj treść semantycznie Główna treść w <main> lub <article>, nawigacja w <nav>, stopka w <footer>. Bez tego robot zgaduje, gdzie kończy się menu, a zaczyna artykuł. Ten sam zabieg poprawia dostępność, więc liczy się podwójnie.
<main>
<article>
<h1>Tytuł</h1>
<p>Treść, która ma być cytowana…</p>
</article>
</main>
3. Renderuj treść po stronie serwera To najcięższy pojedynczy sygnał w tym filarze po polityce robotów. Google zwykle poradzi sobie z JavaScriptem; asystenci AI zwykle nie. Jeśli treść pojawia się dopiero po wykonaniu skryptów, dla nich strona jest pusta. SSR albo generowanie statyczne rozwiązuje problem u źródła.
4. Podaj fakty wprost w JSON-LD Organization lub LocalBusiness dla firmy, plus typ dopasowany do treści strony. Maszyna odczyta wtedy nazwę, adres czy autora jako dane, zamiast wnioskować je z akapitu.
{"@context":"https://schema.org","@type":"Organization","name":"Twoja Firma","url":"https://twojadomena.pl"}
5. Dodaj autora i datę Model wybierający, które źródło zacytować, szuka sygnałów wiarygodności dokładnie tam, gdzie szuka ich człowiek. Autor i data aktualizacji są najtańszymi z nich.
<meta name="author" content="Imię Nazwisko">
<meta property="article:published_time" content="2026-09-22">
Czego ten test nie powie
Nie powie, czy ChatGPT cytuje Twoją stronę ani na którym miejscu. Modele nie udostępniają rejestru źródeł, a odpowiedź na to samo pytanie bywa różna między sesjami i regionami. Każdy „wynik widoczności w AI” jest więc albo próbkowaniem kilku promptów, albo wprost zmyśleniem.
Nie oceni też jakości ani prawdziwości Twoich treści. Mierzymy warstwę techniczną: dostęp, wyodrębnialność, strukturę i atrybucję. To, czy treść zasługuje na cytowanie, pozostaje kwestią redakcyjną.
Wreszcie: llms.txt jest propozycją, nie standardem. Dodajemy go do oceny, bo nic nie kosztuje i może się przydać, ale świadomie z niską wagą — żaden duży dostawca go dziś nie honoruje.
Najczęstsze pytania
Czy powinienem blokować roboty AI? To zależy od tego, które. Blokowanie robotów trenujących (GPTBot, ClaudeBot, Google-Extended, CCBot) jest uzasadnioną decyzją i nie kosztuje ruchu, bo one nikogo do Ciebie nie odsyłają. Blokowanie robotów wyszukujących (OAI-SearchBot, Claude-SearchBot, PerplexityBot) odcina cytowania z linkiem, czyli realne wizyty. Rozróżnienie jest ważniejsze niż sama decyzja.
Czy dane strukturalne poprawiają widoczność w AI? Pomagają maszynie odczytać fakt wprost zamiast wnioskować go z tekstu, co zmniejsza ryzyko przekłamania nazwy, adresu czy autorstwa. Nie jest to jednak przełącznik widoczności i nikt nie potwierdził, by model wybierał źródła na podstawie obecności JSON-LD. Traktuj je jako higienę, nie dźwignię.
Moja strona działa na JavaScripcie. Czy to problem? Dla asystentów AI zwykle tak. Google od lat renderuje JavaScript i najczęściej sobie poradzi, ale większość robotów AI pobiera surowy HTML i nie wykonuje skryptów — widzą wtedy pusty szkielet. Renderowanie po stronie serwera lub generowanie statyczne usuwa ten problem u źródła.
Czy llms.txt jest potrzebny? Nie jest wymagany. To propozycja z 2024 roku, której żaden duży dostawca AI jeszcze nie honoruje, dlatego ma u nas niską wagę, a jego brak prawie nie obniża wyniku. Kosztuje kilka minut i może się przydać, jeśli standard się przyjmie — ale nie jest to pierwsza rzecz do zrobienia.
Czy test jest darmowy i czy trzeba się rejestrować? Test jest darmowy i nie wymaga logowania ani podawania e-maila. Gotowość dla AI to jeden z ośmiu filarów pełnego audytu SEOMaster.
Powiązane materiały
Gotowość strony na AI — poradnik · Dane strukturalne od zera · SSR, SSG czy CSR — co wybrać