PerplexityBot
PerplexityBot to robot wyszukiwarki Perplexity, który indeksuje strony na potrzeby wyświetlania ich jako źródeł w generowanych odpowiedziach. W odróżnieniu od robotów trenujących modele jego zadaniem jest budowa indeksu wykorzystywanego na bieżąco — dlatego blokada oznacza rezygnację z możliwości bycia cytowanym w tym serwisie.
Rola w ekosystemie odpowiedzi
Perplexity buduje odpowiedzi na podstawie treści z sieci i podaje odnośniki do źródeł. Obecność w tym indeksie decyduje o tym, czy serwis może zostać przywołany jako źródło i otrzymać z tego tytułu ruch.
To odróżnia sytuację od robotów trenujących: tam treść zasila model bez bezpośredniego odesłania, tu cytowanie z odnośnikiem jest częścią mechanizmu.
Dwa roboty o różnych zadaniach
Podobnie jak inni dostawcy, Perplexity rozdziela indeksowanie od pobierania na żądanie użytkownika.
- PerplexityBot — indeksuje strony na potrzeby wyszukiwania i cytowania
- Perplexity-User — pobiera konkretną stronę, gdy użytkownik poprosi o jej odczytanie
Czy warto blokować
Blokada PerplexityBota ma inny bilans niż blokada robota trenującego. Odcina nie tylko wykorzystanie treści, ale też szansę na pojawienie się w odpowiedziach z odnośnikiem prowadzącym do serwisu.
Dla większości serwisów zainteresowanych ruchem racjonalnym wyborem jest pozostawienie dostępu. Blokada bywa uzasadniona przy treściach płatnych lub objętych ograniczeniami licencyjnymi.
Co zwiększa szansę na cytowanie
Mechanizmy dobierania źródeł premiują treści, z których łatwo wyodrębnić samodzielną odpowiedź: jasną definicję na początku, konkretne liczby z podanym źródłem i strukturę nagłówków odpowiadającą pytaniom.
Objętość tekstu nie jest tu czynnikiem decydującym — krótkie, precyzyjne fragmenty bywają cytowane częściej niż długie opracowania bez wyraźnej struktury.
Najczęściej zadawane pytania
Tak, reguły kierowane do jego user-agenta są uwzględniane. Blokada oznacza jednak rezygnację z obecności w indeksie wykorzystywanym do cytowania źródeł.
PerplexityBot indeksuje strony na potrzeby wyszukiwania i cytowania z odnośnikiem. GPTBot pobiera treści do trenowania modeli, bez mechanizmu odesłania do źródła.
Nie. Dotyczy wyłącznie serwisu Perplexity i nie ma związku z indeksacją w wyszukiwarce Google.
Umieszczając jednoznaczną definicję na początku, podając liczby wraz ze źródłem i budując nagłówki tak, by odpowiadały pytaniom użytkowników.
Nie jest to warunek konieczny. Mechanizmy dobierania źródeł kierują się przede wszystkim tym, jak łatwo wyodrębnić z treści samodzielną odpowiedź.