Kogo wymienia AI, gdy klient pyta o agencję SEO w Polsce [TEST]

rankforAI
Jako zespół Rankfor.AI postanowiliśmy kontynuować test redakcji portalu NowyMarketing, w którym 6 modeli LLM podało najlepsze ich zdaniem agencje SEO. W naszej wersji zadaliśmy modelom aż 1080 zapytań przez API. Zobacz, co dzieje się, gdy zamiast jednego „rzutu kością” uruchomimy twardą analitykę.
O autorze
4 min czytania 2026-09-17

Jak badaliśmy modele LLM? Metodologia Rankfor.AI

Aby wyeliminować wariantowość pojedynczego wyszukiwania i sprawdzić rzeczywiste mechanizmy rekomendacji AI, przeprowadziliśmy badanie oparte na twardej analityce danych. Zamiast testów w interfejsach czatowych, postawiliśmy na powtarzalne zapytania przez API.

  • Zadaliśmy 12 pytań z poziomu polskiego klienta. Pierwsze z nich to dosłowne pytanie z testu NowyMarketing.
  • Zapytaliśmy 6 modeli z poziomu API. Były to: GPT-5.6, Claude Sonnet 5, Gemini 3.7 Flash, Grok 4.5, Mistral Large i Perplexity Sonar. Ważną informacją jest to, że Perplexity szuka tylko w sieci. Mistral zajął w naszym teście miejsce Copilota, który nie ma publicznego API.
  • Każde pytanie w każdym modelu powtórzyliśmy 15 razy. Uzyskaliśmy w ten sposób 1080 odpowiedzi. Zebraliśmy je 7 września 2026, pomiędzy 23:28 a 0:01 czasu polskiego.
  • Liczyliśmy odpowiedzi, w których pada nazwa firmy. Firma liczyła się raz na odpowiedź. Nazwy pochodzą z pełnej treści odpowiedzi. Narzędzia i platformy, na przykład Senuto i WhitePress, pominęliśmy.
  • Przedziały ufności 95% (Wilson) dla tych sześciu modeli są w załączonym raporcie przy każdej liczbie dla pytania z testu.
  • Wzmianka opisuje tekst odpowiedzi AI. Jakości agencji i udziału w rynku nasz test nie ocenia.
  • Test redakcji i nasza wersja różnią się sposobem pytania: aplikacje czatu w trybie incognito wobec API z zapisanymi wersjami modeli.

Najważniejsze liczby

  • Pytanie z testu redakcji, 90 odpowiedzi. Na pytanie „Jaka jest najlepsza agencja SEO w Polsce?” Delante pada w 61,1% odpowiedzi, Widoczni w 55,6%, Bluerank w 52,2%, DevaGroup w 47,8%. Te cztery agencje tworzą czołówkę, a różnice między nimi mieszczą się w granicach przypadku.

  • Agencja spoza listy. Whites, której nie było wśród 14 agencji z testu, pada w 34,4% odpowiedzi na to samo pytanie i zajmuje piąte miejsce.
  • Układ 18 odpowiedzi. W 20 000 losowań po 3 odpowiedzi z każdego modelu Delante sam prowadzi w 46% losowań, Widoczni w 14%, Bluerank w 9%. W 27% na pierwszym miejscu jest remis. Delante, Widoczni i Semcore trafiają razem do pierwszej trójki, licząc remisy, w około 1% losowań.
  • Semcore i Verseo. W teście redakcji Semcore był w 14 z 18 odpowiedzi (78%), Verseo w 12 z 18 (67%). U nas na tym samym pytaniu: Semcore 26 z 90 (28,9%), Verseo 19 z 90 (21,1%). Żadne z 20 000 losowań nie dało Semcore 14 ani Verseo 12 odpowiedzi z 18.
  • Wyszukiwanie w sieci. Perplexity, jedyny badany model z wyszukiwaniem, wymienia Eactive w 71,7% odpowiedzi, a pięć modeli bez wyszukiwania w 1,7%. Up&More: 62,2% wobec 2,0%. DevaGroup: 0% wobec 52,4%. Wszystkie 12 pytań, 180 i 900 odpowiedzi.
  • Źródła Perplexity. Każda ze 180 odpowiedzi cytuje co najmniej jeden ranking ze strony agencji. Rankingi ze stron Widoczni, Up&More i Propseo są cytowane w każdej ze 180 odpowiedzi. Sześć odpowiedzi cytuje test NowyMarketing z 7 września br.

  • Modele się różnią. GPT-5.6 wymienia Delante w 91,1% odpowiedzi, Grok w 84,4%, Gemini w 100% (Widoczni 97,2%). W Claude Delante ma 27,8%, a Grupa iCEA 26,7%. Mistral stawia na DevaGroup (98,9%) i wymienia Delante w 4 ze 180 odpowiedzi. Perplexity stawia na Widoczni (88,3%).

  • Odpowiedzi bez agencji. Claude w 120 ze 180 odpowiedzi (66,7%) nie podaje nazwy żadnej agencji. Gemini, Mistral i Perplexity podają ją zawsze.
  • 89 nazw firm. We wszystkich 1080 odpowiedziach modele wymieniają 89 nazw firm. Część to warianty jednej firmy, na przykład Havas Media i Havas Media Group. 23 agencje spoza listy z testu padają częściej niż Onely, najrzadziej wymieniana agencja z tej listy (22 odpowiedzi, wszystkie od Mistrala).

  • Obecność i pierwsze miejsce. Delante pada w 64,2% odpowiedzi i otwiera listę w 38,1%. Widoczni: 54,5% i 6,6%. DevaGroup: 43,7% i 13,0%.

  • Powtórzenia. W 42 z 72 par pytania i modelu (58,3%) jeszcze w 13., 14. albo 15. powtórzeniu pojawiła się firma, której wcześniej w tej parze nie było.
  • Narzędzie na liście agencji. Mistral umieszcza Senuto, markę znaną z narzędzia do analizy SEO, na liście agencji SEO w 180 ze 180 odpowiedzi. W zestawieniu agencji Senuto nie liczymy.

Komentarz

Dmitrij Żatuchin

założyciel Rankfor.AI

Redakcja zadała właściwe pytanie: kogo poleca AI, gdy pyta klient. Zadaliśmy je sześciu modelom po 15 razy. Czołówka się zgadza. Delante i Widoczni są na czele w teście redakcji i we wszystkich naszych 1080 odpowiedziach. Od trzeciego miejsca lista zależy od tego, który model pytamy i czy ten model szuka w sieci.

Jedna odpowiedź czatu to jeden rzut kością. Z naszych odpowiedzi 20 000 razy wylosowaliśmy układ testu redakcji: po trzy odpowiedzi z każdego modelu. Delante sam wygrywa w 46% losowań, a w 27% na pierwszym miejscu jest remis. To samo podium, co w teście, wypada w około 1% losowań. Ranking z jednego przebiegu pokazuje jeden rzut.

Semcore był w 14 z 18 odpowiedzi w teście redakcji. U nas jest w 26 z 90. Takiego wyniku nie dało żadne z 20 000 losowań w naszych sześciu modelach. Oba pomiary pytały w innych warunkach: redakcja aplikacje czatu, my modele przez API.

Model z wyszukiwaniem czyta rankingi agencji publikowane na stronach samych agencji. Każda ze 180 odpowiedzi Perplexity cytuje co najmniej jeden taki ranking. Eactive pojawia się tam w 72% odpowiedzi, a w pięciu modelach bez wyszukiwania w 2%. DevaGroup ma odwrotny wynik: 52% bez wyszukiwania i zero w Perplexity.

Modele nie mają wspólnej listy. Gemini wymienia Delante w każdej ze 180 odpowiedzi, Mistral w czterech. U Mistrala prowadzi DevaGroup, obecna w 178 odpowiedziach. Claude w 120 ze 180 odpowiedzi nie podał nazwy żadnej agencji. Klient, który pyta jednego asystenta, dostaje listę tego asystenta.

Obecność na liście i pierwsze miejsce to dwie osobne miary. Widoczni pojawia się w 54,5% odpowiedzi i otwiera listę w 6,6%. Artefakt, SEO4.net i Performance Media są w 12-14% odpowiedzi i ani razu na pierwszym miejscu.

Marketerowi, który sprawdza swoją markę w AI, radzę cztery rzeczy. Zadać to samo pytanie wiele razy. Zapytać kilka modeli. Zapisać model, datę i to, czy model szukał w sieci. Liczyć osobno obecność na liście i pierwsze miejsce.