Rozdział 10 · mechanika

Jak działają wyszukiwarki AI
— pięć bramek

Fanout, retrieval, grounding, ekstrakcja i generacja — pięć etapów, z których każdy odsiewa według innych reguł i ma inną dźwignię.

MK
AutorMaciej Kulkowskipraktyk SEO · Double Digital
Czas czytania11 minz infografikami
Spis treści rozdziału +

Wyszukiwarki AI nie szukają tego, co wpisał użytkownik. Rozbijają pytanie na własne pod-zapytania, pobierają źródła, wybierają z nich fragmenty i dopiero z tego składają odpowiedź. Ten rozdział prowadzi przez pięć bramek tej drogi i pokazuje, którą z nich da się wygrać treścią, a której nie.

!
Najważniejsza myśl

85% stron pobranych przez ChatGPT nigdy nie zostaje zacytowanych. Wizyta bota w logach serwera oznacza przejście drugiej bramki, a nie sukces.

CZĘŚĆ 01

Czym jest wyszukiwarka AI i czym różni się od Google?

Wyszukiwarka AI to system, który na zapytanie użytkownika zwraca wygenerowaną odpowiedź zamiast listy linków, opierając ją na treściach pobranych w trakcie odpowiadania. Od klasycznej wyszukiwarki różni się tym, że nie pokazuje wyników, tylko je streszcza, a źródła podaje jako przypisy do własnego tekstu.

  • Odpowiedź powstaje od nowa przy każdym zapytaniu. To nie jest odczyt gotowego rankingu.
  • Model łączy dwa źródła wiedzy. To, czego się nauczył, i to, co właśnie pobrał.
  • Lista narzędzi zmienia się co kwartał. Mechanizm pozostaje wspólny.

Wszystkie liczby w tym rozdziale pochodzą z naszej meta-analizy 75 badań o AI SEO, a konkretnie z jej rozdziału o mechanice. Każdą podajemy z nazwą badania i wielkością próby, bo w tej dziedzinie różnica między pomiarem a marketingiem vendora bywa niewidoczna.

BramkaCo się dziejeLiczba, która to opisuje
1. FanoutSilnik rozbija pytanie na własne pod-zapytania95% z nich ma zerowy wolumen w narzędziach SEO
2. RetrievalWybór źródeł do puli, z której powstanie odpowiedź85% pobranych stron nigdy nie zostaje zacytowanych
3. GroundingPodział budżetu tekstu między wybrane źródłaok. 2 000 słów budżetu na jedno zapytanie
4. EkstrakcjaWycięcie konkretnych zdań z pobranych stronmediana ok. 32% znaków strony, silny lead bias
5. GeneracjaZłożenie odpowiedzi i wybór wymienianych marekcytowanie i wzmianka to osobne zdarzenia
01Fanoutpod-zapytania silnika
02Retrievalselekcja źródeł
03Groundingbudżet ~2000 słów
04Ekstrakcjawycięcie zdań
Bramka piątaGeneracja: model składa odpowiedź i wybiera wymieniane marki na podstawie wiedzy wyuczonej, a nie tylko pobranych źródeł. Można wygrać cytowanie i przegrać rekomendację.
Droga od pytania użytkownika do cytowania. Każda bramka odsiewa według innych reguł i ma inną dźwignię po stronie treści.

Trening a grounding — dwa źródła wiedzy modelu

Model językowy odpowiada z dwóch źródeł naraz. Pierwsze to trening: wiedza wyuczona z danych zebranych do pewnego momentu, w tym to, co internet napisał o Twojej marce. Drugie to grounding: treści pobrane na żywo w trakcie odpowiadania na konkretne pytanie.

Rozróżnienie ma praktyczne konsekwencje. Na warstwę treningową nie wpłyniesz w tydzień, bo to efekt lat obecności w sieci. Na warstwę groundingu wpływasz od razu — decyduje o niej to, czy Twoja treść jest dostępna, aktualna i napisana tak, żeby dało się z niej wyciąć odpowiedź.

Które narzędzia zaliczamy do wyszukiwarek AI

Do tej kategorii należą asystenci z dostępem do sieci (ChatGPT z wyszukiwaniem, Claude, Gemini), wyszukiwarki generatywne budujące odpowiedź z cytowaniami (Perplexity) oraz warstwy AI wbudowane w klasyczne wyszukiwarki, czyli AI Overviews i tryb AI w Google.

Pełne zestawienie narzędzi wraz z ich mocnymi stronami opisaliśmy osobno w przeglądzie wyszukiwarek AI. Tutaj interesuje nas nie lista, tylko wspólna dla nich wszystkich mechanika.

CZĘŚĆ 02

Bramka 1 — fanout: model nie szuka tego, co wpisałeś

Fanout to rozbicie pytania użytkownika na własne pod-zapytania silnika. Model dopisuje słowa, których nikt nie wpisał — najczęściej „best” i „reviews” — i szuka odpowiedzi na kilka pytań naraz, żeby złożyć z nich jedną odpowiedź. Dlatego 95% tych zapytań ma zerowy wolumen w klasycznych narzędziach do słów kluczowych.

  • Jedno pytanie użytkownika to kilka zapytań silnika. Każde szuka czego innego.
  • 32,9% cytowanych stron weszło do odpowiedzi wyłącznie przez fanout. Nie przez frazę główną.
  • Silniki mają różne osobowości. Liczba pod-zapytań na prompt różni się kilkukrotnie.

Co model dopisuje do Twojego pytania

Wszystkie wyszukiwarki AI zaczynają tak samo. Peec przeanalizował 5 milionów fanoutów z ChatGPT, Perplexity i Groka. Najczęściej dopisywanym słowem jest „best”: przy pytaniach o rekomendację przeformułowanie na „best of” następuje w 24,3% fanoutów. Trzecie najczęstsze słowo to „reviews” — model szuka recenzji, nawet gdy nikt o nie nie pytał.

Dla treści oznacza to jedno: strona, która nie odpowiada na pytania okołozakupowe („czy warto”, „opinie”, „porównanie”), wypada z odpowiedzi, mimo że świetnie odpowiada na pytanie zadane wprost. Ramy analityczne dla tego zjawiska opisuje też framework fan-outu Zyppy.

Skala rozbicia zależy od silnika. Dejan Petrovic przeanalizował 365 920 fanoutów trzech dostawców i zmierzył, że Perplexity generuje średnio 1,4 pod-zapytania na prompt, ChatGPT 2,1, a Grok aż 6,8 — przy tym samym pytaniu użytkownika.

Dlaczego narzędzia do słów kluczowych tego nie widzą

Wolumen wyszukiwań mierzy, ilu ludzi wpisuje daną frazę. Fanout to zapytanie, którego nie wpisuje nikt — generuje je maszyna w trakcie odpowiadania. Narzędzie zbudowane do liczenia tego pierwszego z definicji pokaże przy nim zero.

Konsekwencja dla planowania treści jest niewygodna: część tematów, które klasyczny research każe odrzucić jako bezwartościowe, jest dokładnie tym, czego szuka silnik. Metodykę doboru fraz opisuje rozdział o analizie słów kluczowych — a fanout jest jej granicą.

CZĘŚĆ 03

Bramka 2 i 3 — retrieval i grounding

Retrieval to selekcja źródeł do puli, z której model będzie czerpał, a grounding to podział ograniczonego budżetu tekstu między te źródła. Pobranie strony nie oznacza jeszcze cytowania: 85% stron pobranych przez ChatGPT nigdy nie zostaje zacytowanych, a budżet groundingu wynosi około 2 000 słów na jedno zapytanie.

  • O wejściu do puli decyduje w dużej mierze klasyczna pozycja. Ranking jest biletem wstępu.
  • Budżet jest stały i dzielony według rangi. Pierwsze źródło dostaje najwięcej miejsca.
  • Krótsza, gęsta strona oddaje więcej swojej treści. To mechanizm, nie preferencja stylistyczna.
AirOps548 534 strony, 43 233 zapytaniaUdział stron pobranych przez ChatGPT, które trafiają do odpowiedzi
Pobrane i niezacytowane (85%)Pobrane i zacytowane (15%)
8515
1
Retrieval to wejście do gry, nie wynikWizyta bota w logach oznacza przejście drugiej bramki z pięciu.
Proporcja stron pobranych i zacytowanych w odpowiedziach ChatGPT według analizy AirOps przytoczonej w Raporcie AI SEO Double Digital.

85% pobranych stron odpada przed oceną treści

To najtrudniejsza bramka wyszukiwarek AI. Liczba pochodzi z analizy AirOps na 548 534 stronach i 43 233 zapytaniach: tylko 15% pobranych adresów trafia do odpowiedzi jako cytowanie. Retrieval to więc dopiero wejście do gry, a nie wynik.

Praktyczny wniosek dotyczy raportowania. Widok w logach serwera, w którym GPTBot regularnie odwiedza serwis, bywa pokazywany jako sukces — a oznacza wyłącznie, że przeszliście pierwszą bramkę. Konfigurację dostępu opisuje rozdział o technicznym SEO.

Budżet ~2000 słów i podział tortu

Grounding ma stały budżet, który silnik dzieli między wybrane źródła według ich rangi. Im wyżej źródło w tej hierarchii, tym więcej jego tekstu trafia do kontekstu, z którego powstaje odpowiedź.

Ranga źródłaPrzydzielony fragmentCo z tego wynika
#1ok. 531 słówNajwiększa szansa, że model zacytuje właśnie Twoje zdanie
#5ok. 266 słówPołowa miejsca — liczy się, co jest na początku sekcji
Cały budżetok. 2 000 słów na zapytanieMiejsca jest mniej niż treści na jednej długiej stronie

Plateau przydziału pojawia się przy około 540 słowach: powyżej tej granicy dokładanie tekstu do jednej sekcji nie zwiększa już tego, co model z niej weźmie.

Dlaczego gęstość bije długość

Z budżetu wynika najbardziej praktyczna liczba całego rozdziału. Badanie Dejana na 883 262 snippetach pokazuje, że strona poniżej 1000 słów oddaje do groundingu 61% swojej treści, a strona powyżej 3000 słów tylko 13%.

Nie znaczy to, że długie teksty są bezwartościowe — znaczy, że do odpowiedzi trafia z nich mniejsza część. Sweet spot cytowalności to według AirOps 500–2000 słów, a sposób pisania takich sekcji opisuje rozdział o treściach SEO.

CZĘŚĆ 04

Bramka 4 i 5 — ekstrakcja i generacja

Ekstrakcja to wybór konkretnych zdań z pobranych stron, a generacja to złożenie z nich odpowiedzi. Model wycina dosłowne fragmenty, silnie preferując początek strony i początek sekcji, a w finalnym tekście może wymienić inną markę niż ta, którą zacytował jako źródło. W wyszukiwarkach AI wygrywa zdanie, nie strona.

  • Cytowany jest fragment. Pierwsze zdanie sekcji ma nieproporcjonalną wagę.
  • Grounding jest ulotny. Pobrane treści znikają z kontekstu po jednej turze rozmowy.
  • Cytowanie i wzmianka to dwa zdarzenia. Można wygrać jedno i przegrać drugie.

Lead bias: dlaczego liczy się pierwsze zdanie

Model wycina ze strony dosłowne zdania, a mediana wyciętego materiału to około jednej trzeciej znaków strony. Wybór nie jest równomierny: fragmenty z początku dokumentu i z początku sekcji mają wyraźnie większą szansę trafić do odpowiedzi.

Stąd reguła pisania, która wraca w całej Akademii: nagłówek w formie pytania, a pod nim pełna odpowiedź w pierwszym zdaniu. Zdanie rozbiegowe typu „w tym artykule wyjaśnimy” zajmuje dokładnie to miejsce, które model przeczyta najuważniej.

Różnice między silnikami widać także tutaj. Dejan Petrovic w analizie 365 920 fanoutów pokazał, że Google pyta pytaniami, OpenAI nazywa encje, a Amazon opisuje przymiotnikami — a to przekłada się na to, jakie fragmenty każdy z nich wybiera.

Cytowanie to nie rekomendacja

Ostatnia bramka jest najbardziej zaskakująca. Model może wziąć Twoją stronę jako źródło i w tej samej odpowiedzi polecić konkurenta, bo wzmianka marki pochodzi z jego wiedzy wyuczonej, a nie z pobranego tekstu.

Dlatego w wyszukiwarkach AI mierzy się dwie rzeczy osobno: udział odpowiedzi, w których jesteś cytowany jako źródło, i udział odpowiedzi, w których jesteś wymieniony jako rozwiązanie. Konsekwencje biznesowe tego rozróżnienia opisuje rozdział o SEO w erze AI.

Grounding jest ulotny

Treść pobrana na potrzeby jednej odpowiedzi nie zostaje w pamięci modelu: grounding jest kasowany po jednej turze rozmowy. Zadane ponownie to samo pytanie uruchamia cały proces od nowa, z możliwie innym zestawem źródeł.

To wyjaśnia zjawisko, które wprawia w zakłopotanie przy pierwszych testach: marka widoczna rano potrafi zniknąć po południu, bez żadnej zmiany na stronie. Widoczność w wyszukiwarkach AI jest rozkładem prawdopodobieństwa, nie pozycją.

CZĘŚĆ 05

Co z tego wynika dla Twojej strony?

Z mechaniki pięciu bramek wynika lista działań krótsza, niż sugeruje rynek: zapewnij dostęp botom, pisz sekcjami będącymi pełnymi odpowiedziami, umieszczaj konkret w pierwszym zdaniu i buduj obecność w źródłach zewnętrznych. Optymalizacja pod odpowiedzi generatywne nazywa się AEO, a jej szersza wersja GEO.

  • Każda bramka ma inną dźwignię. Mieszanie ich to główny błąd branżowych porad.
  • AEO i GEO to warstwa nad SEO. Nie zamiennik, tylko nadbudowa.
  • Mierzysz prawdopodobieństwo cytowania. Nie pozycję i nie jeden zrzut ekranu.

Cztery działania, które wynikają wprost z mechaniki

  1. Sprawdź dostęp. Robots.txt i renderowanie — bez tego nie ma bramki drugiej.
  2. Pisz sekcjami-odpowiedziami. Nagłówek pytaniem, odpowiedź w pierwszym zdaniu.
  3. Tnij watę. Przy stałym budżecie groundingu każde zdanie bez informacji zajmuje miejsce lepszemu.
  4. Buduj obecność poza domeną. Wzmianki w źródłach, które modele czytają, wpływają na ostatnią bramkę.

Kolejność nie jest dowolna: pierwsze dwa punkty wykonasz w tydzień, trzeci przy najbliższej aktualizacji treści, a czwarty jest pracą ciągłą. Odwrócenie tej kolejności to najczęstszy sposób na wydanie budżetu bez efektu w wyszukiwarkach AI.

AEO, GEO i SEO — co znaczą te skróty

SEO to optymalizacja pod wyniki wyszukiwania. AEO (Answer Engine Optimization) to optymalizacja pod silniki odpowiedzi: praca nad tym, żeby Twoja treść nadawała się na cytowany fragment. GEO (Generative Engine Optimization) obejmuje szerzej całą obecność marki w treściach, z których modele budują odpowiedzi.

W praktyce te trzy rzeczy dzielą 80% zadań: dostęp, struktura, jakość i autorytet. Różnią się jednostką sukcesu — pozycja, cytowanie i wzmianka to trzy różne rzeczy, które trzeba mierzyć osobno.

Od czego zacząć jutro

Jeśli czytasz ten rozdział jako ostatni w Akademii, masz już komplet: dostęp opisuje rozdział o technicznym SEO, sposób pisania rozdział o treściach SEO, a konsekwencje biznesowe rozdział o SEO w erze AI.

Kolejnym krokiem jest pomiar: wybierz dziesięć pytań, na które chcesz być odpowiedzią, zadaj je cyklicznie i policz, w ilu odpowiedziach się pojawiasz. Jeśli wolisz oddać to w cudze ręce, zajmuje się tym nasza usługa widoczności w wyszukiwarkach AI, prowadzona jako Google Premier Partner 2026.

FAQ — Najczęściej zadawane pytania

  1. Jak działają wyszukiwarki AI?

    W pięciu krokach: rozbijają Twoje pytanie na własne pod-zapytania (fanout), pobierają zestaw źródeł (retrieval), przydzielają im ograniczony budżet tekstu (grounding), wycinają z nich konkretne zdania (ekstrakcja) i składają z tego odpowiedź (generacja). Każdy krok odsiewa według innych reguł, dlatego wysoka pozycja w Google pomaga, ale niczego nie gwarantuje.

  2. Czym różni się wyszukiwarka AI od Google?

    Klasyczna wyszukiwarka pokazuje listę wyników i zostawia wybór użytkownikowi, wyszukiwarka AI streszcza kilka źródeł w jedną odpowiedź i podaje je jako przypisy. Google łączy dziś oba modele: nad listą organiczną wyświetla AI Overviews, czyli wygenerowaną odpowiedź opartą na pobranych stronach.

  3. Co to jest query fan-out?

    To rozbicie pytania użytkownika na własne pod-zapytania silnika, który dopisuje słowa takie jak „best” czy „reviews”. Przy pytaniach o rekomendację przeformułowanie na „best of” pojawia się w 24,3% fanoutów, a 95% tych zapytań ma zerowy wolumen w klasycznych narzędziach SEO — nikt ich nie wpisuje, bo generuje je maszyna.

  4. Dlaczego moja strona jest pobierana, ale nie cytowana?

    Bo pobranie to dopiero druga z pięciu bramek. Według analizy AirOps na 548 534 stronach 85% adresów pobranych przez ChatGPT nigdy nie zostaje zacytowanych. O cytowaniu decyduje dalej to, ile miejsca dostaniesz w budżecie groundingu i czy z Twojego tekstu da się wyciąć samodzielne zdanie odpowiadające na pod-zapytanie.

  5. Czy pod AI trzeba pisać krótsze teksty?

    Nie krótsze, tylko gęstsze i podzielone na samodzielne sekcje. Strona poniżej 1000 słów oddaje do groundingu 61% swojej treści, a strona powyżej 3000 słów tylko 13% — przy stałym budżecie około 2 000 słów na zapytanie. Wygrywa tekst, w którym każda sekcja jest pełną odpowiedzią, a nie fragmentem większej narracji.

  6. Co to jest AEO i GEO?

    AEO (Answer Engine Optimization) to optymalizacja treści pod silniki odpowiedzi, czyli praca nad tym, żeby dało się z niej wyciąć cytowany fragment. GEO (Generative Engine Optimization) obejmuje szerzej obecność marki we wszystkich treściach, z których modele budują odpowiedzi. Obie warstwy stoją na klasycznym SEO, nie zastępują go.

  7. Jak uruchomić AI w Google?

    AI Overviews pojawiają się automatycznie nad wynikami dla części zapytań i nie wymagają włączania. Tryb AI (AI Mode) dostępny jest jako osobna zakładka w wynikach wyszukiwania tam, gdzie Google go udostępnił. Z perspektywy właściciela strony ważniejsze od włączania jest to, czy Twoje treści są dostępne dla robotów, które te odpowiedzi zasilają.

  8. Jakie są 10 najpopularniejszych wyszukiwarek internetowych?

    Największą pozostaje Google, za nim Bing, Yandex, Baidu, Yahoo, DuckDuckGo, Ecosia, Brave Search, Naver i Seznam. Osobną kategorią są wyszukiwarki generatywne, takie jak Perplexity czy ChatGPT z wyszukiwaniem — ich zestawienie i mocne strony opisaliśmy w przeglądzie wyszukiwarek AI.

DO ZAPAMIĘTANIA

Wyszukiwarki AI w siedmiu zdaniach

  • 01Odpowiedź AI powstaje od nowa przy każdym zapytaniu — to nie odczyt rankingu.
  • 02Fanout rozbija Twoje pytanie na pod-zapytania, których 95% ma zerowy wolumen.
  • 0332,9% cytowanych stron weszło do odpowiedzi wyłącznie przez fanout, nie przez frazę główną.
  • 0485% stron pobranych przez model nigdy nie zostaje zacytowanych.
  • 05Budżet groundingu to około 2 000 słów na zapytanie, dzielone według rangi źródła.
  • 06Strona poniżej 1000 słów oddaje 61% treści, powyżej 3000 słów tylko 13%.
  • 07Cytowanie i wzmianka marki to dwa osobne zdarzenia — mierz je osobno.
MK
ROZDZIAŁ NAPISANY PRZEZMaciej Kulkowski

SEO, paid media i strategie widoczności w Double Digital

Audyt Google Ads

Formularz audyt Google Ads

Natalia Kobielska

Office Manager

Bezpłatna konsultacja Google Ads

Główny formularz kontatkowy

Natalia Kobielska

Office Manager

Bezpłatna konsultacja

Główny formularz kontatkowy

Natalia Kobielska

Office Manager

Precyzyjna wycena Google Ads

Główny formularz kontatkowy

Natalia Kobielska

Office Manager

Precyzyjna oferta
Google Ads

Główny formularz kontatkowy

Natalia Kobielska

Office Manager

Profesjonalne prowadzenie
kampanii Google Ads

Główny formularz kontatkowy

Natalia Kobielska

Office Manager

Chcesz powtórzyć
takie wyniki?

Case Study – Popup

Natalia Kobielska

Office Manager

Chcesz lepszych wyników?

Główny formularz kontatkowy

Natalia Kobielska

Office Manager

Zbudujmy SEO, które działa w erze AI

Główny formularz kontatkowy

Natalia Kobielska

Office Manager

Zbudujmy strategię, która robi różnicę.

Główny formularz kontatkowy

Natalia Kobielska

Office Manager

Sprawdźmy, co blokuje Twoje konwersje.

Główny formularz kontatkowy

Natalia Kobielska

Office Manager

Podgląd raportu AI
DEMO

Widoczność SEO dla:
buty do biegania damskie

Najważniejsze wnioski

1
Uporządkuj nagłówki i dodaj frazę w kluczowych miejscach – H1 i nagłówki sekcji powinny jasno sygnalizować temat strony.
2
Dodaj mini FAQ, by odpowiedzieć na intencje użytkownika – To wzmacnia dopasowanie semantyczne i poprawia interpretację AI.
3
Popraw szybkość ładowania – Usuń elementy blokujące LCP/CLS, by zwiększyć ocenę techniczną.

Odbierz do 9000 PLN na kampanię Google Ads

Formularz kupon Google Ads

Natalia Kobielska

Office Manager

Analiza AI pod konkretną frazę.
W mniej niż minutę
.

Analiza

Natalia Kobielska

Office Manager

Uruchom Google CSS.
Płać mniej za kliknięcia.

Google CSS

Natalia Kobielska

Office Manager

Double Digital

Bezpłatna konsultacja

Porozmawiajmy
o wyniku.

Performance, SEO, AI i analityka w jednym zespole. Bez silosów i bez optymalizacji pod puste wskaźniki.

Napisz do nas

Powiedz krótko, czego potrzebujesz.

Główny formularz kontatkowy
Double Digital — marketing nastawiony na wynik biznesowy