Boty AI w sklepie: które wpuścić, które zablokować i czym za to płacisz
Ktoś radzi Ci zablokować boty AI, bo „kradną treści”. Rada brzmi rozsądnie, zajmuje jedną linijkę w pliku technicznym i nic nie kosztuje — a przy sklepie internetowym bywa jedną z droższych decyzji w roku, bo odcina przy okazji coś zupełnie innego, niż się wydaje.
Zacznijmy więc od tego, czego najczęściej brakuje w rozmowach na ten temat: od tego, jak w ogóle powstaje odpowiedź, w której asystent komuś poleca sklep. Dopiero z tego wynika, co warto blokować, a co działa przeciwko Tobie.
W skrócie: jeśli chcesz, żeby asystenci polecali Twój sklep, domyślną decyzją jest nie blokować niczego — i tak zaczynamy u klientów. Blokowanie ma sens wtedy, gdy Twoje treści są wartością samą w sobie: autorskie badania, własna fotografia produktowa, materiały, na których zarabiasz osobno. Nawet wtedy warto wiedzieć, że trzy pozycje z typowych list do blokowania kosztują widoczność, a jednego dostawcy ten plik w ogóle nie obejmuje.
Jak asystent wybiera sklep, który poleci
Są dwie drogi i obie trzeba znać, bo decydują o wszystkim, co dalej.
Przy pierwszej asystent wychodzi do sieci w momencie zadania pytania: szuka, otwiera znalezione strony i buduje z nich odpowiedź, zwykle podając odnośniki. Tak dzieje się przy pytaniach wymagających świeżych danych — o konkretny model, cenę, dostępność. Za tę drogę odpowiadają automaty wyszukiwarkowe, bo to one wcześniej zebrały strony do indeksu, z którego asystent korzysta.
Przy drugiej asystent odpowiada z własnej pamięci, czyli z tego, czego model nauczył się w trakcie trenowania, i nie otwiera przy tym niczego. Tak dzieje się przy pytaniach ogólniejszych: „jaki sklep z kawą polecasz”, „gdzie kupować sprzęt ogrodniczy dla firmy”, „który sklep z suplementami jest wiarygodny”. To są pytania zakupowe, tylko bez konkretnego modelu w treści — i w praktyce bardzo częste.
Ta druga droga jest powodem, dla którego temat blokad jest trudniejszy, niż się wydaje. Treści, które nie trafiły do zbiorów treningowych, nie trafiają też do pamięci modelu — a więc sklep, który zablokował automaty treningowe, nadal bywa cytowany, kiedy asystent szuka, ale znika z puli, z której model cokolwiek o nim wie, kiedy nie szuka.
Automaty i ich role
Z tych dwóch dróg wynika podział, bez którego żadna lista botów AI nie jest czytelna.
Pierwsza grupa zbiera treści do trenowania modeli i odpowiada za drugą z opisanych dróg — za to, czy model w ogóle wie, że Twój sklep istnieje i czym się zajmuje. Druga buduje indeks, z którego asystent korzysta, szukając w locie, i odpowiada za drogę pierwszą. Trzecia otwiera konkretną stronę na życzenie użytkownika, gdy ktoś wkleił adres albo kazał coś sprawdzić — i to jest grupa, na którą plik z regułami w dużej mierze nie działa, bo kilku dostawców wprost deklaruje, że przy takim pobraniu reguł nie sprawdza.
Do tego dochodzą funkcje poboczne, jak sprawdzanie stron docelowych reklam czy podglądy odnośników. Nie mają znaczenia dla Twojej decyzji, choć bywają widoczne w logach.
Kto co robi: stan na wrzesień 2026
Poniżej lista botów AI dziewięciu dostawców, z podziałem na to, za co każdy z nich odpowiada. Stan na wrzesień 2026 — przy tym tempie zmian warto sprawdzić datę, zanim się na niej oprzesz.
| dostawca | trenowanie modeli | wyszukiwanie w asystencie | na żądanie użytkownika |
|---|---|---|---|
| OpenAI | GPTBot | OAI-SearchBot | ChatGPT-User |
| Anthropic | ClaudeBot | Claude-SearchBot | Claude-User |
Google-Extended (token sterujący) | Googlebot | Google-Agent i pozostałe pobieracze | |
| Meta | meta-externalagent | meta-webindexer | meta-externalfetcher |
| Perplexity | — | PerplexityBot | Perplexity-User |
| Apple | Applebot-Extended (token sterujący) | Applebot | — |
| Microsoft | brak takiego identyfikatora | bingbot | — |
| Amazon | Amazonbot | Amzn-SearchBot | — |
| ByteDance | Bytespider | — | — |
Osobno stoi CCBot — automat organizacji archiwizującej sieć. Sam nie trenuje żadnego modelu, ale zbudowane przez niego archiwum posłużyło do wytrenowania praktycznie każdego dużego modelu i jest wykorzystywane także przez narzędzia badawcze i analityczne. Dla niewielkiego polskiego sklepu bywa to główna droga, którą jego treści w ogóle trafiają do tych zbiorów.
Dwie rzeczy warte odnotowania pod tabelą. U Perplexity nie ma czego blokować przed trenowaniem, bo dokumentacja stwierdza, że żaden z dwóch automatów nie zbiera treści dla modeli podstawowych. Meta zapisuje w swojej dokumentacji zdanie, które warto znać: zezwolenie na automat wyszukiwania pomaga cytować i linkować Twoje treści w odpowiedziach ich asystenta.
Czym płacisz za blokadę
Tutaj jest sedno i miejsce, w którym ten tekst rozchodzi się z większością poradników — bo tamte kończą sprawę zdaniem „zablokuj trenowanie, zostaw wyszukiwanie” i idą dalej.
Blokada automatów wyszukiwarkowych jest oczywistym wycofaniem się z widoczności. Dokumentacja jednego z dostawców mówi to wprost: witryny, które wypisały się z jego automatu wyszukiwania, nie będą pokazywane w wynikach wyszukiwania wewnątrz asystenta. Nikt rozsądny nie robi tego przypadkiem, choć zdarza się to przy okazji „blokowania AI” hurtem.
Blokada automatów treningowych wygląda na niegroźną i przy większości z nich faktycznie kosztuje niewiele — poza tym, o czym była mowa wyżej: model przestaje cokolwiek wiedzieć o Twojej marce, gdy odpowiada bez szukania. Są jednak trzy pozycje, przy których cena jest konkretna i warto je znać z nazwy.
Token sterujący Google nie dotyczy wyłącznie trenowania. Google pisze, że treść wyłączona tym wpisem nie zostanie użyta także do budowania odpowiedzi w aplikacji Gemini w momencie, gdy ktoś zadaje pytanie. Blokada jest więc rezygnacją z cytowań u tego dostawcy, a nie samym wypisaniem się ze zbiorów treningowych. Co istotne, nie dotyczy to podsumowań AI w samej wyszukiwarce — te działają na zwykłym robocie Google i pozostają bez zmian.
Automat archiwizujący sieć to dla sklepu najsłabszy kandydat do blokowania. Nie trenuje modeli, a jego archiwum bywa jedyną drogą, którą treści niewielkiej polskiej witryny trafiają do zbiorów używanych przy trenowaniu. Blokada odcina tę drogę w zamian za ochronę opisów produktów, które rzadko są warte ochrony.
Automat treningowy Amazona również ma cenę, bo ten sam dostawca buduje odpowiedzi produktowe — choć akurat tę informację mamy z opracowań branżowych, a nie z dokumentacji producenta, i tak ją traktujemy.
Wniosek jest prosty i niewygodny dla miłośników gotowych list: jeśli celem jest bycie polecanym, blokowanie działa przeciwko temu celowi. Blokada ma sens przy treściach, które są wartością samą w sobie — i jest wtedy świadomą wymianą widoczności na prawa do nich.
Pułapki, przez które decyzja bywa inna, niż się wydaje
Microsoftu ten plik w ogóle nie obejmuje
To jest pułapka, w którą wpadają wszyscy, którzy „zablokowali AI” i uznali temat za zamknięty, bo Microsoft nie udostępnia w pliku z regułami żadnego identyfikatora służącego do wypisania się z trenowania. Jego mechanizm działa w kodzie strony, przez dwa znaczniki: pierwszy ogranicza wykorzystanie treści do adresu, tytułu i krótkiego fragmentu, drugi wyłącza ją z odpowiedzi asystenta i z trenowania modeli. Microsoft zapewnia przy tym wprost, że treść oznaczona którymkolwiek z nich nadal pojawia się w zwykłych wynikach wyszukiwania.
Jeśli więc dopisałeś do pliku dziesięć blokad i uważasz, że temat masz z głowy, wobec Microsoftu nie zrobiłeś nic. To nie jest przy tym rzecz do zrobienia samodzielnie w panelu — wymaga zmiany w kodzie strony, więc trafia na listę zadań dla osoby opiekującej się sklepem.
Dwa identyfikatory, których nigdy nie zobaczysz w logach
Identyfikator sterujący Google nie ma własnego oznaczenia, którym przedstawia się przy wejściu na stronę — dokumentacja mówi, że służy wyłącznie do sterowania, a nie do pobierania. Podobnie działa token Apple: nie pobiera stron, a jedynie decyduje o tym, jak zostaną wykorzystane dane pobrane przez zwykły automat tego dostawcy, przy czym strony, które go zabraniają, nadal mogą pojawiać się w wynikach wyszukiwania. Jeśli ktoś szuka tych dwóch w logach i ich nie znajduje, to nie znaczy, że coś jest źle skonfigurowane — one po prostu nigdy tam nie będą.
Automat, o którym dostawca nie mówi nic
Trzecia pułapka dotyczy ByteDance, firmy stojącej za TikTokiem, która nie publikuje dokumentacji swojego automatu: nie podaje jego przeznaczenia, nie deklaruje respektowania reguł, nie opisuje sposobu blokowania. W praktyce bywa on obserwowany przy pobieraniu stron mimo zakazu i przy ruchu intensywniejszym, niż wynikałoby z rozmiaru witryny, a narzędzia sprawdzające identyfikatory u dostawców zwyczajnie go pomijają, bo nie ma czego sprawdzać. Wpis w pliku z regułami nie jest tu więc narzędziem, na którym można polegać — jeśli ten automat realnie obciąża Twój serwer, rozwiązania szuka się po stronie serwera i jest to już rozmowa o wydajności, nie o widoczności.
Jeśli nie masz pewności, kto ma dziś dostęp do Twojego sklepu i co z niego wyczytuje, prześlij nam jego adres — sprawdzamy to w darmowym raporcie GEO.
Co zrobić u siebie
Od tego miejsca jest technicznie, bo pojawiają się gotowe bloki reguł. Jeśli zmiany w sklepie wykonuje u Ciebie ktoś inny, przekaż mu wybrany wariant i przejdź do listy kontrolnej.
Wariant A: nie blokuję niczego — i to jest nasza rekomendacja dla sklepu
Nie robisz nic. Treści mogą posłużyć do trenowania, sklep może pojawiać się w odpowiedziach asystentów i w ich wynikach, a model ma szansę wiedzieć o Twojej marce także wtedy, gdy odpowiada bez szukania.
Dla zdecydowanej większości sklepów to jest wybór właściwy. Widoczność jest tym, po co sklep istnieje w sieci, a opisy produktów i kategorii rzadko bywają wartością, którą trzeba chronić przed uczeniem modelu — w odróżnieniu od autorskich badań czy zdjęć, na których ktoś zarabia osobno.
Wariant B: blokuję trenowanie tam, gdzie to nie kosztuje widoczności
Dla sklepów, które chcą zachować treści dla siebie, ale nie zamierzają płacić za to obecnością w odpowiedziach. Poniższy blok celowo nie zawiera trzech pozycji opisanych w sekcji o cenie — tokenu Google, automatu archiwizującego sieć ani automatu Amazona.
# Wypisanie treści z trenowania modeli tam,
# gdzie nie kosztuje to obecności w odpowiedziach asystentów.User-agent: GPTBot Disallow: /
User-agent: ClaudeBot Disallow: /
User-agent: Applebot-Extended Disallow: /
User-agent: meta-externalagent Disallow: /
User-agent: Bytespider Disallow: /
Jeśli po przeczytaniu sekcji o cenie chcesz iść dalej i wypisać się również tam, gdzie to kosztuje, dopisujesz świadomie Google-Extended, CCBot oraz Amazonbot — wiedząc, że pierwszy odcina od cytowań w asystencie Google, drugi od drogi, którą treści trafiają do zbiorów treningowych, a trzeci prawdopodobnie od odpowiedzi produktowych u Amazona.
Pamiętaj też, że ten blok nie obejmuje Microsoftu — przy pełnym wypisaniu się z trenowania trzeba dołożyć znaczniki w kodzie strony.
Wariant C: wycofuję się z widoczności u dostawców AI
Decyzja biznesowa, nie techniczna, i w sklepie rzadko uzasadniona. Poza blokadami z wariantu B dochodzą automaty wyszukiwarkowe:
# Wycofanie się z widoczności u dostawców AI.
# Skutek: sklep nie będzie pokazywany w odpowiedziach wyszukiwania
# wewnątrz tych produktów.User-agent: OAI-SearchBot Disallow: /
User-agent: Claude-SearchBot Disallow: /
User-agent: PerplexityBot Disallow: /
User-agent: meta-webindexer Disallow: /
W żadnym z trzech wariantów nie blokuj automatów wyszukiwarek — ani Google, ani Microsoftu. To są zwykłe roboty wyszukiwarek i ich blokada usuwa sklep z wyszukiwarki, a nie z asystentów.
Na koniec rzecz praktyczna: zmiana nie działa od ręki. Trzej dostawcy podają zgodnie, że dostosowanie się ich systemów zajmuje do około doby, a Meta dodaje, że automaty mogą przez ten czas trzymać zawartość pliku w pamięci podręcznej. Po zmianie warto odczekać dobę i nie robić w międzyczasie kolejnych poprawek.
Czego ten plik nie załatwia
Dwie rzeczy warto wiedzieć, zanim uznasz temat za zamknięty.
Nie chroni treści przed skopiowaniem. Reguła w tym pliku jest prośbą, a nie zabezpieczeniem — kilku dostawców wprost deklaruje, że przy pobraniu wykonanym na życzenie użytkownika reguł nie sprawdza, a jeden automat w ogóle nie ma dokumentacji i bywa obserwowany przy ich ignorowaniu. Treść, która ma być naprawdę niedostępna, musi być za logowaniem.
Nie obejmuje pobrań na żądanie użytkownika. Kiedy ktoś wkleja asystentowi adres Twojej strony i prosi o streszczenie, większość dostawców uznaje, że to człowiek otworzył stronę — i reguł nie sprawdza. Wyjątkiem jest Anthropic, który jako jedyny z przejrzanych nie wyłącza swojego automatu użytkownikowego spod reguł.
Jeśli natomiast w logach pojawia się automat, który wygląda podejrzanie, warto go zweryfikować, ale jest to zadanie dla osoby utrzymującej sklep. Każdy poważny dostawca publikuje sposób sprawdzenia, czy żądanie faktycznie od niego pochodzi — osoba od wdrożeń będzie wiedziała, co z tym zrobić.
Zanim uznasz temat za zamknięty
- Otwórz adres sklepu z dopiskiem
/robots.txti przeczytaj, co tam stoi. - Poszukaj nazw z kolumny „wyszukiwanie w asystencie”. Jeśli którakolwiek ma przy sobie słowo
Disallow, ustal, czy to była świadoma decyzja — bo to ona kosztuje najwięcej. - Sprawdź, czy nie blokujesz robotów wyszukiwarek Google i Microsoftu.
- Sprawdź, czy nie blokujesz tokenu Google ani automatu archiwizującego sieć — obie pozycje trafiają na listy do blokowania częściej, niż powinny.
- Zapisz datę sprawdzenia przy swojej konfiguracji. Lista sprzed roku wygląda identycznie jak sprawdzona wczoraj.
- Po każdej zmianie odczekaj dobę, zanim zaczniesz wyciągać wnioski.
- Jeśli czegokolwiek z tego nie rozumiesz, pokaż plik osobie opiekującej się sklepem. Ten plik jest pisany dla automatów, nie dla ludzi.
Najczęstsze pytania
Czy jeśli zablokuję boty AI, zaszkodzi to mojej pozycji w Google?
Samo zablokowanie automatów AI nie wpływa na pozycje w wyszukiwarce — Google pisze wprost, że jego token sterujący nie jest sygnałem rankingowym i nie wpływa na obecność w wyszukiwarce. Łatwo jednak przy okazji zablokować zwykłego robota Google, a to już usuwa sklep z wyników. Dlatego warto sprawdzić, co dokładnie zostało wpisane do pliku.
Czy warto blokować boty AI w sklepie internetowym?
Jeśli chcesz, żeby asystenci polecali Twój sklep — nie. Blokada ma sens przy treściach, które są wartością samą w sobie: autorskich badaniach, własnej fotografii produktowej, materiałach, na których zarabiasz osobno. Przy zwykłych opisach produktów i kategorii działa przeciwko Tobie.
Czy zablokowanie GPTBota sprawi, że znikam z ChatuGPT?
Nie bezpośrednio. Ten automat zbiera treści do trenowania modeli, a za obecność w wynikach wyszukiwania wewnątrz asystenta odpowiada u tego dostawcy inny. Blokada oznacza natomiast, że model nie nauczy się niczego o Twoim sklepie — czyli nie wymieni go, odpowiadając z pamięci, bez szukania w sieci.
Kilka lat temu ktoś wpisał mi do robots.txt blokadę botów AI. Czy powinienem to cofnąć?
Najpierw sprawdź, co dokładnie zostało zablokowane. Jeśli na liście są automaty odpowiadające za wyszukiwanie wewnątrz asystentów, podjęto za Ciebie decyzję o wycofaniu się z widoczności i najprawdopodobniej warto ją cofnąć. Jeśli są tam wyłącznie automaty treningowe, decyzja jest do przemyślenia, ale mniej pilna.
Jak sprawdzić, czy boty AI mają dostęp do mojego sklepu?
Wejdź na adres swojego sklepu z dopiskiem /robots.txt i poszukaj w wyświetlonym tekście nazw automatów wraz ze słowem Disallow. Jeśli treść nic Ci nie mówi, pokaż ją osobie opiekującej się sklepem — ten plik jest pisany dla automatów, nie dla ludzi.
Czy zablokowanie botów AI ochroni moje opisy produktów przed skopiowaniem?
Nie. Reguły w tym pliku są prośbą, a nie zabezpieczeniem, i część automatów wprost deklaruje, że przy pobraniu na życzenie użytkownika ich nie sprawdza. Treść, która ma być naprawdę niedostępna, musi być za logowaniem.
Jakie boty AI najczęściej odwiedzają sklep internetowy?
Automaty OpenAI, Anthropic, Google, Meta, Perplexity, Apple, Microsoftu, Amazona i ByteDance, a do tego automat archiwizujący sieć. Każdy z tych dostawców ma zwykle kilka automatów o różnych zadaniach, dlatego warto patrzeć nie na nazwę dostawcy, tylko na funkcję konkretnego automatu.
Dlaczego mój sklep nie pojawia się w odpowiedziach asystentów, choć niczego nie blokuję?
Dostęp jest warunkiem koniecznym, ale nie wystarczającym. Asystent musi mieć jeszcze co z Twojego sklepu wyczytać — uporządkowane dane produktowe, odpowiedzi na pytania klientów, czytelne opisy kategorii — opisaliśmy to w tekście od czego zacząć pracę nad widocznością w AI.
Jedna decyzja, nie jeden wpis
Cała trudność tego tematu polega na tym, że wygląda na techniczny, a jest handlowy. Blokada automatów treningowych to decyzja o tym, czy Twoje treści mają uczyć modele — i czy model ma cokolwiek o Twojej marce wiedzieć, gdy odpowiada bez szukania. Blokada automatów wyszukiwarkowych to decyzja o tym, czy chcesz być widoczny w odpowiedziach, po które sięgają dziś Twoi klienci. Łączy je wyłącznie to, że wpisuje się je do tego samego pliku — i właśnie dlatego tak łatwo podjąć jedną, myśląc, że podejmuje się drugą.
Otwórz więc adres swojego sklepu z dopiskiem /robots.txt i sprawdź, czy ktoś kiedyś nie podjął jej za Ciebie.
Jak ten plik działa na Twojej platformie, opisaliśmy w osobnych tekstach: jak działa plik robots.txt w PrestaShop i jak działa plik robots.txt w WooCommerce. A jeśli wolisz mieć to sprawdzone z zewnątrz, zamów darmowy raport GEO. Jeśli wolisz od razu zobaczyć, ile kosztuje wdrożenie i co obejmuje, mamy zakres i ceny pakietów GEO.

Ponad 9 lat na rynku, setki wdrożonych realizacji
Nasi klienci rozpoczynają z nami współpracę, ponieważ potrzebują cyfrowej transformacji. Zostają z nami, ponieważ znajdują w WebCrafters solidnego partnera biznesowego, wspierającego ich kompleksowo od strony technologicznej.
Nie jesteśmy tylko software housem. Jesteśmy Twoim zewnętrznym działem IT, który zadba o Twój biznes tak samo, jak zespół programistów, designerów i project managerów, który pracowałby bezpośrednio w Twojej firmie.
Zbuduj z nami swój nowy produkt!
Umów się na bezpłatną konsultację z ekspertem i porozmawiajmy
o Twoich oczekiwaniach.
