Domyślny raport Skuteczność pokazuje listę zapytań posortowaną według kliknięć i niewiele poza tym. Dopóki nie włączysz filtra wyrażeń regularnych, nie odpowiesz na pytania, które naprawdę mają znaczenie: ile ruchu dają zapytania pytające, jaka część wyświetleń jest brandowa, czy długi ogon rośnie, czy się kurczy. Ten tutorial pokazuje, gdzie filtr siedzi, jak zachowuje się jego składnia i daje 12 wzorców gotowych do skopiowania. Jeśli dopiero zaczynasz pracę z narzędziem, przejrzyj najpierw przewodnik po raportach Search Console, a potem wróć tutaj po część analityczną.
Gdzie w Search Console włączyć filtr regex
Filtr regex nie ma własnego przycisku. Siedzi w tym samym miejscu co zwykłe filtry: w raporcie Skuteczność klikasz pole + Nowy nad wykresem, wybierasz Zapytanie albo Stronę, a następnie w okienku rozwijasz listę trybów dopasowania. Ostatnia pozycja to Niestandardowe (wyrażenie regularne). Dopiero wtedy pojawia się druga lista, z dwiema opcjami: Pasuje do wyrażenia regularnego oraz Nie pasuje do wyrażenia regularnego.
Ta druga opcja jest ważniejsza, niż się wydaje. Większość sensownych analiz polega na odjęciu czegoś od całości (ruchu brandowego, zapytań nawigacyjnych, jednej gałęzi katalogów), a nie na wyciąganiu wąskiego wycinka. Filtr negatywny robi to jednym kliknięciem, bez eksportu do arkusza i bez formuł.
Filtry działają w interfejsie, w eksporcie i w połączeniu Search Console z Looker Studio, ale nie zapisują się jako nazwane widoki. Za każdym razem wklejasz wzorzec od nowa, więc własna biblioteczka w notatniku zwraca się po tygodniu.
Składnia RE2 i czego w niej brakuje
Search Console korzysta z biblioteki RE2, tej samej, która obsługuje funkcje regex w BigQuery i w Google Analytics. RE2 celowo rezygnuje z konstrukcji, które potrafią wykładniczo spowolnić dopasowanie, więc kilku rzeczy znanych z PCRE po prostu nie znajdziesz. Pełna lista obsługiwanych elementów jest w dokumentacji składni RE2.
Brakuje trzech rzeczy: lookahead (?=...), lookbehind (?<=...) i backreferencji 1. W praktyce oznacza to, że klasycznego „dopasuj wszystko oprócz” nie zapiszesz wewnątrz wzorca. Zamiast tego przełączasz tryb na Nie pasuje do wyrażenia regularnego, co i tak jest wygodniejsze, bo wzorzec zostaje czytelny.
Działa za to wszystko, czego potrzebujesz na co dzień: alternatywa |, klasy znaków [a-z], kwantyfikatory *, + i {2,4}, kotwice ^ oraz $, grupy nieprzechwytujące (?:...) i flaga (?i). Tę ostatnią wstawiaj nawykowo na początku wzorca, bo dopasowanie jest domyślnie wrażliwe na wielkość liter, a zapytania w raporcie przychodzą małymi literami tylko w większości przypadków.
Druga pułapka to polskie znaki. w w RE2 odpowiada [0-9A-Za-z_] i nie obejmuje liter ą, ć, ę, ł, ń, ó, ś, ź ani ż. Jeśli zależy ci na słowach z ogonkami, wypisz je jawnie w klasie znaków albo sięgnij po klasę unikodową p{L}.
Wzorce na zapytania pytające i długi ogon
Zapytania pytające to najprostszy sposób, żeby oszacować, ile ruchu wpada na treści poradnikowe, a nie na strony ofertowe. Długość zapytania liczona słowami jest z kolei najtańszym przybliżeniem długiego ogona, bo nie wymaga żadnego zewnętrznego narzędzia.
| Wzorzec | Co wyciąga |
|---|---|
(?i)^(jak|co|czy|gdzie|kiedy|dlaczego|ile|jaki|jaka|które)s | zapytania pytające, czyli intencja informacyjna |
^(S+s+){3,}S+$ | długi ogon: cztery słowa i więcej |
^S+(s+S+)?$ | krótki ogon: jedno lub dwa słowa |
(2025|2026) | zapytania z rocznikiem, kandydaci do aktualizacji treści |
Najciekawsze jest porównanie dwóch środkowych wzorców w tym samym oknie czasowym. Jeśli krótki ogon rośnie, a długi stoi w miejscu, serwis zyskuje widoczność na frazach ogólnych, ale przestał odpowiadać na konkretne pytania. To zwykle znak, że publikacja nowych tematów wyhamowała.
Wzorce na ruch brandowy kontra niebrandowy
Rozdzielenie brandu od reszty jest pierwszą rzeczą, jaką trzeba zrobić, zanim ktokolwiek zacznie wyciągać wnioski o wzroście. Ruch brandowy odpowiada na kampanie i rozpoznawalność, niebrandowy na pracę SEO, a zsumowane razem potrafią pokazać trend, którego nie ma.
| Wzorzec | Co wyciąga |
|---|---|
(?i)(sems?tools|semtols|semtoolsy|semtools.pl) | brand razem z typowymi literówkami i wariantem z kropką |
(?i)semtools.*(logowanie|cennik|kontakt|opinie) | brandowe zapytania nawigacyjne i transakcyjne |
(?i)(cena|cennik|ile kosztuje|koszt|oferta) | intencja komercyjna poza brandem |
(?i)(opinie|recenzja|ranking|najlepsz|porównani|vs) | intencja porównawcza, zwykle dolny lejek |
Przy budowaniu wzorca brandowego warto raz przejrzeć surową listę zapytań posortowaną po wyświetleniach i wypisać realne literówki, zamiast zgadywać. Dwie albo trzy formy zapisane z błędem potrafią odpowiadać za kilka procent wyświetleń, a w domyślnym wzorcu zwykle ich nie ma, więc lądują po stronie niebrandowej i sztucznie zawyżają efekt pracy SEO.
Pierwszy wzorzec wklejony w tryb Nie pasuje daje czysty ruch niebrandowy. Ten sam wzorzec w trybie Pasuje daje udział brandu. Dwa odczyty, jeden wzorzec, zero eksportów.
Filtrowanie po ścieżkach URL i katalogach
Filtr Strona przyjmuje te same wyrażenia, tyle że dopasowuje je do pełnego adresu z protokołem i domeną. Dlatego kropkę w domenie trzeba uciec, a kotwicę ^ ustawia się przed https, nie przed pierwszym katalogiem.
| Wzorzec | Co wyciąga |
|---|---|
^https://semtools.pl/poradniki-i-zasoby/ | całą gałąź jednej kategorii nadrzędnej |
/(page|tag|strona)/ | paginację i archiwa, zwykle w trybie Nie pasuje |
^https://semtools.pl/[^/]+/[^/]+$ | dokładnie drugi poziom zagnieżdżenia |
.(pdf|xlsx|docx)$ | pliki do pobrania indeksowane obok artykułów |
Trzeci wzorzec jest przydatniejszy, niż wygląda. Pozwala policzyć, ile wyświetleń zbierają same strony kategorii w stosunku do artykułów, bez ręcznego wyklikiwania listy adresów.
Łączenie filtrów strony i zapytania
Dwa filtry regex w jednym widoku (jeden na Stronę, drugi na Zapytanie) działają jak koniunkcja: zostają tylko wiersze spełniające oba warunki. To najszybsza diagnostyka kanibalizacji, bo ustawiasz filtr zapytania na jedną frazę i patrzysz, ile różnych adresów ją obsługuje. Szerszy opis metody opisaliśmy przy okazji tekstu o tym, jak wygląda wykrywanie kanibalizacji w Search Console.
Jest jeden haczyk, o którym łatwo zapomnieć. Po nałożeniu filtra zapytania wiersze w zakładce Strony przestają pokazywać ruch strony, a zaczynają pokazywać ruch strony z tego konkretnego zapytania. Suma w nagłówku zmienia się razem z nimi, więc porównywanie jej z liczbą sprzed filtra nie ma sensu.
Przy łączeniu filtrów przydaje się jeszcze jedna rutyna: zanim zapiszesz odczyt, sprawdź go na dwóch sąsiednich zakresach dat. Pojedynczy tydzień bywa zdominowany przez jedną publikację albo jeden skok sezonowy, a wzorzec, który wtedy wygląda na przełomowy, po miesiącu nie pokazuje już nic.
Limity, na które trafisz przy dużych serwisach
Pierwszy limit jest twardy: interfejs pokazuje maksymalnie 1000 wierszy, a eksport z poziomu przeglądarki tego nie obchodzi. Przy serwisie z kilkoma tysiącami fraz filtr regex nie jest obejściem, tylko sposobem na zmieszczenie się w limicie, bo odcina to, czego akurat nie analizujesz.
Drugi dotyczy samych wzorców. Bardzo długie alternatywy (kilkadziesiąt wariantów brandu wpisanych jednym ciągiem) bywają odrzucane komunikatem o nieprawidłowym wyrażeniu, bez wskazania, który fragment zawinił. Rozbij je wtedy na dwa osobne odczyty zamiast szukać błędu znak po znaku.
Trzeci jest najbardziej podstępny: część zapytań Google anonimizuje, więc wiersze widoczne w tabeli nigdy nie zsumują się do liczby z wykresu. Udziały procentowe liczone na przefiltrowanych wierszach są więc wiarygodne tylko względem siebie, nie względem całości ruchu. Kiedy ta różnica zaczyna przeszkadzać, czas na pipeline na API Search Console i na przeniesienie stałych odczytów do dashboardów w Looker Studio, gdzie wzorzec zapisuje się raz i odświeża sam.
Czwarty limit to horyzont danych. Raport Skuteczność sięga 16 miesięcy wstecz, więc rok do roku porównasz, ale dwa lata do dwóch już nie. Jeśli potrzebujesz dłuższej historii, archiwum trzeba budować samodzielnie, najlepiej od razu przy wdrożeniu eksportu.
FAQ
Czy filtr regex w Search Console rozróżnia wielkość liter?
Tak, domyślnie dopasowanie jest wrażliwe na wielkość liter. Żeby to wyłączyć, wstaw flagę (?i) na samym początku wzorca.
Dlaczego mój wzorzec z lookahead nie działa?
RE2 nie obsługuje lookahead ani lookbehind. Zamiast negacji wewnątrz wzorca użyj trybu Nie pasuje do wyrażenia regularnego, dostępnego na drugiej liście w oknie filtra.
Jak dopasować polskie znaki diakrytyczne?
Skrót w obejmuje wyłącznie znaki ASCII. Wypisz litery z ogonkami jawnie w klasie znaków albo użyj klasy unikodowej p{L}.
Czy filtr regex zwiększa limit 1000 wierszy?
Nie, limit zostaje. Filtr pozwala jedynie tak zawęzić zbiór, żeby interesujące cię wiersze zmieściły się poniżej tego progu. Powyżej tej skali potrzebny jest eksport przez API.
Czy mogę nałożyć jednocześnie filtr regex na zapytanie i na stronę?
Tak, oba filtry łączą się koniunkcją. Pamiętaj tylko, że po nałożeniu filtra zapytania metryki w zakładce Strony dotyczą już wyłącznie tego zapytania.
