Czy asystenci AI widzą strony dealerów samochodowych
O widoczności w odpowiedziach asystentów mówi się dziś głównie w kategoriach blokowania robotów. Wzięliśmy 386 domen polskich dealerów i serwisów i sprawdziliśmy to wprost. Okazało się, że blokady prawie nie istnieją, a prawdziwy problem leży zupełnie gdzie indziej i jest znacznie bardziej banalny.
Co dokładnie sprawdzaliśmy
Dla każdej domeny pobraliśmy stronę główną, plik robots.txt i plik llms.txt. Z tego policzyliśmy cztery rzeczy: czy któryś z siedmiu robotów zbierających treść dla asystentów ma zakaz wejścia, ile tekstu zostaje na stronie po odrzuceniu skryptów, czy w dokumencie są dane uporządkowane opisujące firmę i czy wypełniony jest opis w metadanych.
Drugi punkt wymaga wyjaśnienia, bo jest najważniejszy. Roboty zbierające dane na potrzeby modeli w większości nie uruchamiają skryptów. Strona, której treść dokleja się dopiero w przeglądarce, wygląda u człowieka normalnie, a w samym dokumencie ma kilkaset znaków. Dla robota to pusta kartka.
Sto trzydzieści jeden domen nie oddało strony w ogóle
Zanim doszliśmy do treści, odpadła jedna trzecia próbki. To nie jest błąd pomiaru, tylko pierwszy wynik: dla tych domen pytanie o widoczność w AI jest bezprzedmiotowe, bo nie ma czego odwiedzić.
Dlaczego 131 domen nie oddało strony
Z 386 domen z listy. Każda próbowana była pod adresem z www i bez, a przy błędzie certyfikatu także z jego pominięciem i bez szyfrowania.
Domena nie wskazuje żadnego serwera. Zwykle nieodnowiona albo porzucona.
Przekroczony czas oczekiwania, mimo dwudziestu pięciu sekund na próbę.
Strona nie wstała nawet po pominięciu weryfikacji certyfikatu.
Serwer odrzucił zapytanie kodem 403, zwykle ochrona przed ruchem automatycznym.
Błędy serwera i przypadki jednostkowe.
Pomiar Fluxlab, wrzesień 2026. Trzy zapytania na domenę, bez logowania i bez obchodzenia zabezpieczeń.
Wśród 255 domen, które stronę oddały, kolejnych 56 zrobiło to dopiero po pominięciu weryfikacji certyfikatu, a 34 wyłącznie bez szyfrowania. Przeglądarka pokazuje w takich przypadkach ostrzeżenie na pełnym ekranie, zanim odwiedzający zobaczy cokolwiek z oferty.
Blokady robotów AI praktycznie nie istnieją
Spodziewaliśmy się, że to będzie główny wynik badania. Nie jest. Spośród 255 działających stron zakaz wejścia dla robotów zbierających treść dla asystentów ma dwie, czyli 0,8 procent. Obie blokują wszystkie siedem naraz, co wygląda na regułę ogólną napisaną przeciwko robotom kopiującym treść, a nie na świadomą decyzję akurat o asystentach.
Dla porównania: wśród dużych polskich wydawców blokady są normą. Sprawdziliśmy jeden tytuł prasowy i blokuje pięć z siedmiu tych samych robotów. Tam jest to decyzja biznesowa o nieoddawaniu treści, z której się żyje. U dealera takiej decyzji nie ma, bo nie ma czego bronić: opis serwisu i lista modeli to nie jest towar, który ktoś kupuje osobno.
Prawdziwy problem: nie ma czego zacytować
Czego brakuje na 255 działających stronach
Odsetek stron, u których dany element nie występuje.
137 stron. Maszyna musi zgadnąć z układu strony, czym jest firma.
147 stron. Brakuje zdania, które najczęściej trafia do podsumowania.
77 stron. Brak nie blokuje niczego, ale nie ma też żadnych wskazówek.
41 stron ma poniżej 600 znaków tekstu w samym dokumencie.
2 strony. To o tym mówi się najwięcej, a występuje najrzadziej.
Pomiar Fluxlab, wrzesień 2026. Próbka 255 domen, które oddały stronę główną.
Zestawienie ostatnich dwóch słupków jest całą treścią tego badania. Zakaz wejścia dotyczy dwóch stron, a pusty dokument czterdziestu jeden. Dwadzieścia razy częstszy problem polega nie na tym, że robot nie chce wejść, tylko na tym, że po wejściu nie znajduje nic.
Mediana ilości tekstu w dokumencie to 3 331 znaków, czyli mniej więcej jedna strona maszynopisu. Sto cztery strony na 255 mają poniżej dwóch tysięcy znaków. To jest materiał, z którego asystent ma zbudować zdanie o tym, czym firma się zajmuje i komu ją polecić.
Komplet czterech warunków, czyli brak blokady, treść w dokumencie, dane uporządkowane i wypełniony opis, spełnia 63 strony na 255, czyli niecałe 25 procent.
Jedna rzecz, która nas zaskoczyła
Plik llms.txt, czyli krótki opis serwisu pisany wprost pod modele językowe, ma 53 domeny z 255, czyli co piąta. Spodziewaliśmy się pojedynczych przypadków, bo to rozwiązanie świeże i nieobowiązkowe.
Po zajrzeniu do środka obraz się wyjaśnia. Część plików jest pisana ręcznie i wygląda na przemyślaną, z opisem marek i zakresu usług. Cztery zaczynają się od stopki „wygenerowany przez\" i nazwy popularnej wtyczki optymalizacyjnej. Innymi słowy: to nie jest fala świadomych decyzji, tylko w dużej części efekt uboczny aktualizacji wtyczki, która zaczęła generować ten plik sama.
Wniosek jest dla nas dwuznaczny. Z jednej strony to dowód, że narzędzia same popychają rynek w tę stronę. Z drugiej, plik wygenerowany automatycznie zawiera to samo, co i tak jest na stronie, więc firmie, która nie ma czego powiedzieć, nie pomoże.
Czego nie zmierzyliśmy i nie będziemy udawać, że wiemy
Nie sprawdzaliśmy, czy którykolwiek asystent faktycznie poleca te firmy, bo takiego pomiaru nie da się zrobić uczciwie. Odpowiedzi różnią się między użytkownikami i zmieniają w czasie, więc pojedyncze zapytanie niczego nie dowodzi. Zmierzyliśmy warunki wstępne, na które właściciel strony ma wpływ, a nie wynik, na który nie ma go nikt.
Nie sprawdzaliśmy też podstron. Strona główna to najlepszy pojedynczy wskaźnik i jednocześnie najmniejsze obciążenie cudzego serwera, ale serwis może mieć dobrze opisane podstrony ofertowe przy ubogiej stronie głównej.
Co z tego wynika praktycznie
Kolejność działań wynika wprost z liczb. Najpierw sprawdzić, czy strona ma treść w samym dokumencie, bo bez tego reszta nie ma znaczenia. Potem dopisać dane uporządkowane i opis w metadanych, co jest robotą na godziny, nie na tygodnie. Blokady robotów sprawdzić na końcu, bo statystycznie ich nie ma.
Te same cztery punkty sprawdza nasze darmowe narzędzie, na dowolnej domenie, bez rejestracji. Jeśli interesuje Cię, co jeszcze na tych samych 386 domenach wyszło nie tak, mamy też przegląd stanu technicznego oraz badanie zabezpieczeń poczty.
Pytania
- Czy takie sprawdzenie jest legalne?
- Tak. Pobraliśmy stronę główną, plik robots.txt i plik llms.txt, czyli dokładnie to, co pobiera przeglądarka każdego odwiedzającego i każda wyszukiwarka. Jedna domena to trzy zapytania, czyli mniej niż jedno wejście człowieka. Nie logowaliśmy się nigdzie, nie wysłaliśmy żadnej wiadomości i nie obchodziliśmy żadnych zabezpieczeń.
- Dlaczego liczycie od 255, a nie od 386?
- Bo 131 domen w ogóle nie oddało strony. To jest osobny wynik, opisany niżej, i mieszanie go z resztą zaciemniałoby obraz. Liczenie domeny bez wpisu w rejestrze nazw jako strony bez danych uporządkowanych byłoby liczeniem tego samego problemu dwa razy.
- Czy blokowanie tych robotów to błąd?
- Nie zawsze. Wydawca, który żyje ze sprzedaży własnych treści, ma dobry powód, żeby nie oddawać ich za darmo do trenowania modeli, i duże redakcje faktycznie je blokują. Dealer samochodowy zwykle takiego powodu nie ma: jego treść to opis usług i oferta, a blokada odcina go od kanału, w którym ktoś właśnie pyta o serwis albo o auto.
- Czy to znaczy, że strona bez danych uporządkowanych nie pojawi się w odpowiedzi asystenta?
- Nie, to nie jest warunek konieczny. Znaczy tyle, że maszyna musi wywnioskować z układu strony, czym jest firma i co oferuje, zamiast odczytać to wprost. Przy wnioskowaniu myli się częściej, a najczęściej myli się o zakres usług i o lokalizację, czyli dokładnie o to, co rozstrzyga, czy ktoś dostanie polecenie.
- Skąd wiadomo, że roboty nie uruchamiają skryptów?
- Z dokumentacji dostawców i z zachowania widocznego po stronie serwera. Część z nich potrafi już renderować, ale nie jest to regułą ani gwarancją. Strona, której treść siedzi w samym dokumencie, działa u wszystkich; strona zależna od skryptów działa u części. Przy porównywalnym koszcie wybór jest oczywisty.