Scaled content abuse: gdzie Google stawia granicę między skalą a spamem

4 października, 2026

Google od marca 2024 trzyma w swoich wytycznych antyspamowych zapis o „scaled content abuse”. Nazwa sugeruje, że problemem jest skala, i to nieporozumienie kosztowało już wielu wydawców sporo czasu. Polityka nie mówi nic o liczbie publikacji miesięcznie, nie zakazuje używania modeli językowych i nie wyznacza progu, powyżej którego serwis staje się podejrzany. Mówi o czymś innym: o tworzeniu treści na dużą skalę bez wartości dodanej dla czytelnika. Ta różnica jest operacyjna, nie filozoficzna, i da się ją przełożyć na konkretne decyzje redakcyjne.

Co mówi polityka i czego w niej nie ma

Oryginalny zapis w wytycznych antyspamowych Google Search definiuje nadużycie jako generowanie wielu stron, których głównym celem jest manipulowanie pozycjami w wynikach wyszukiwania, a nie pomoc użytkownikom. Google wymienia przy tym metody: automatyczne generowanie, parafrazowanie cudzych tekstów, tłumaczenie maszynowe bez weryfikacji, sklejanie fragmentów z różnych źródeł, zasypywanie serwisu wariantami tego samego artykułu pod lekko różne frazy.

Czego w tej polityce nie ma? Nie ma słowa „AI” jako przesłanki negatywnej. Nie ma limitu publikacji. Nie ma wymogu, by autor był człowiekiem. W marcu 2024 Google wprost potwierdził, że sposób wytworzenia treści jest nieistotny, liczy się rezultat. Tekst napisany przez model i zredagowany przez specjalistę, który dodał dane, kontekst rynkowy i własne wnioski, nie łamie niczego. Tysiąc tekstów wyprodukowanych z jednego szablonu przez podmianę nazwy miasta łamie, nawet gdyby każdy napisał człowiek.

Ilość kontra wartość dodana: jak to rozumieć praktycznie

Najpraktyczniejszy test brzmi: co traci czytelnik, jeśli ta strona zniknie? Jeśli odpowiedź jest „nic, bo te same informacje są w trzech innych naszych artykułach i w pierwszych pięciu wynikach Google”, strona jest kandydatem do usunięcia bez względu na to, jak powstała. Jeśli odpowiedź to „traci nasze dane cenowe z polskiego rynku”, „traci wynik testu, który sami przeprowadziliśmy” albo „traci zestawienie, którego nikt dotąd nie zrobił”, wartość dodana istnieje.

Warto zapisać sobie listę rzeczy, które realnie tę wartość tworzą: własne liczby i pomiary, doświadczenie z konkretnych wdrożeń, lokalny kontekst prawny lub rynkowy, wypowiedzi praktyków, uporządkowanie rozproszonej wiedzy w formie, której nigdzie nie ma. Jeśli artykuł nie ma żadnego z tych elementów, jego publikacja jest ryzykiem bez nagrody, niezależnie od wolumenu.

Sygnały, które zdradzają masówkę

Z perspektywy wykrywania nie liczy się intencja, lecz wzorce statystyczne. Kilka z nich jest szczególnie łatwe do zauważenia:

  • Powtarzalna struktura: identyczna liczba nagłówków, te same sformułowania otwierające i zamykające, ta sama długość sekcji w setkach tekstów.
  • Szablon z podmienioną zmienną: te same zdania z inną nazwą miasta, modelu, branży lub roku.
  • Nagły skok publikacji: przejście z dwóch tekstów miesięcznie na dwieście, bez zmiany w zespole i bez zmiany jakości.
  • Zerowe sygnały zaangażowania: brak wejść, brak linków, brak czasu na stronie przy dużym katalogu URL-i.
  • Autorzy bez śladu istnienia: nazwiska bez dorobku, bez profili, bez historii. Google zaostrzył właśnie wytyczne w tej sprawie, a ręczny fact-check treści i weryfikacja autorstwa wprost pojawiły się w jego wytycznych.
  • Brak jakiejkolwiek unikalnej informacji: cały tekst da się odtworzyć z pierwszej strony wyników na dane zapytanie.

Istotne jest to, że te sygnały działają kumulatywnie. Jeden z nich to nic. Cztery naraz na katalogu kilkuset stron to profil, który systemy antyspamowe wyłapują coraz skuteczniej. Google opisywał niedawno podejście, w którym zamiast oceniać pojedynczy adres bada się całe siatki publikacyjne, co pokazaliśmy w materiale o detektorze spamu AI o nazwie SAFE.

Ręczne działanie a algorytm: co się dzieje po kolei

Konsekwencje mają dwa tory i łatwo je pomylić. Tor algorytmiczny działa cicho: ruch spada, zwykle po aktualizacji rdzenia lub aktualizacji antyspamowej, w Search Console nie pojawia się żaden komunikat. Spadek dotyczy najczęściej wybranych sekcji serwisu, nie całości, i bywa rozłożony na tygodnie.

Tor ręczny jest widoczny: w Search Console w raporcie „Ręczne działania” pojawia się wpis, zwykle z zakresem (cały serwis albo wybrane adresy). Przy scaled content abuse zakres sitewide oznacza praktycznie zerową widoczność. Ten tor wymaga wniosku o ponowne rozpatrzenie i realnego wykazania zmian.

CechaSpadek algorytmicznyRęczne działanie
Komunikat w Search Consolebrakjest, z zakresem i typem
Typowy przebiegstopniowy, wokół aktualizacjinagły, z dnia na dzień
Droga wyjściapoprawa jakości i czekanie na przeliczeniepoprawa plus wniosek o ponowne rozpatrzenie
Czas powrotuod kilku tygodni do kilku miesięcyod kilku dni do kilku tygodni po akceptacji wniosku

Jak audytować własny katalog treści pod tym kątem

Audyt da się przeprowadzić w jednym arkuszu i nie potrzebuje egzotycznych narzędzi. Potrzebne kolumny: adres, data publikacji, liczba słów, kliknięcia i wyświetlenia z Search Console za 90 dni, liczba linków wewnętrznych, autor, flaga „czy zawiera własne dane”. Do tego podobieństwo tekstowe: nawet proste porównanie zestawów trzygramów wystarczy, by wyłapać rodziny tekstów powstałych z jednego szablonu.

Potem segmentacja. Strony z zerowymi kliknięciami i zerowymi wyświetleniami przez 90 dni, bez własnych danych i z wysokim podobieństwem do innych wpisów, są kandydatami do konsolidacji albo usunięcia. Strony z wyświetleniami, ale bez kliknięć, idą do odświeżenia. Pełny proces decyzyjny rozpisaliśmy w tekście o tym, które artykuły aktualizować, a które usunąć, i ta sama logika obsługuje przypadek masówki.

Jedna uwaga techniczna: usuwanie na masową skalę też jest sygnałem. Lepiej scalać powiązane teksty w mocniejsze całości z przekierowaniem 301 niż zostawiać po sobie setki stron 410. Konsolidacja daje dodatkowo to, czego brakowało: głębię, której pojedyncze cienkie wpisy nie miały.

Bezpieczny model publikacji przy dużym wolumenie

Duży wolumen jest możliwy, pod warunkiem że każda publikacja przechodzi przez bramki, których szablon nie przejdzie. W praktyce wystarczają cztery.

  1. Bramka unikalnego wkładu: tekst nie wchodzi do kolejki bez co najmniej jednego elementu, którego nie ma w innych wynikach (dane, test, wywiad, zestawienie).
  2. Bramka weryfikacji faktów: każda liczba, data i cytat mają źródło. Powtarzalny proces opisaliśmy w materiale o fact-checkingu treści generowanych przez AI.
  3. Bramka redakcyjna z nazwiskiem: ktoś realny akceptuje tekst i bierze za niego odpowiedzialność. Jak to ułożyć w zespole, pokazuje opis procesu akceptacji treści w agencji.
  4. Bramka kanibalizacji: przed publikacją sprawdzenie, czy serwis nie ma już strony na tę intencję. Jeśli ma, powstaje aktualizacja, nie nowy adres.

Przy takim układzie sto tekstów miesięcznie nie jest problemem, bo każdy z nich ma powód istnienia. Problemem jest sto tekstów, które przeszły tylko przez generator i publikator.

Co robić po otrzymaniu ręcznego działania

Kolejność ma znaczenie. Najpierw inwentaryzacja: pełna lista adresów z oznaczeniem, które powstały w ramach masówki. Potem decyzje per adres, czyli usunięcie, scalenie albo przepisanie od zera z realnym wkładem. Potem wdrożenie, czyli faktyczne zniknięcie problematycznych stron z indeksu, a nie samo odstawienie ich do szkicu. Dopiero wtedy wniosek o ponowne rozpatrzenie, w którym opisuje się liczbami: ile adresów usunięto, ile scalono, jaki proces wprowadzono, kto odpowiada za akceptację.

Dwie rzeczy psują ten wniosek najczęściej: kosmetyczne poprawki (przepisane wstępy przy niezmienionej treści) oraz obietnice na przyszłość bez wykonanej pracy. Zespół oceniający widzi serwis w bieżącym stanie, więc wniosek wysyła się po robocie, nie przed nią.

FAQ

Czy Google karze za treści tworzone przez AI?

Nie. Google wielokrotnie potwierdzał, że sposób wytworzenia treści nie jest kryterium. Karane jest publikowanie na dużą skalę stron bez wartości dla czytelnika, niezależnie od tego, czy napisał je model, czy człowiek.

Ile artykułów miesięcznie jest bezpieczne?

Polityka nie podaje liczby i taka liczba nie istnieje. Bezpieczny wolumen to tyle, ile serwis potrafi wypuścić z zachowaniem unikalnego wkładu i weryfikacji faktów. Dla jednego zespołu to dziesięć tekstów, dla innego dwieście.

Czy publikowanie wariantów tego samego tekstu pod różne miasta to scaled content abuse?

Zwykle tak, jeśli jedyną różnicą jest podmieniona nazwa. Strony lokalne są w porządku wtedy, gdy zawierają faktycznie lokalne informacje: ceny, dostępność, dane kontaktowe, lokalne regulacje, realizacje z danego obszaru.

Jak sprawdzić, czy spadek to ręczne działanie, czy algorytm?

Wystarczy raport „Ręczne działania” w Search Console. Jeśli jest pusty, spadek jest algorytmiczny i nie wymaga wniosku o ponowne rozpatrzenie, tylko poprawy jakości i czasu na przeliczenie.

Czy usunięcie tysiąca stron zaszkodzi serwisowi?

Samo usunięcie cienkich stron bez ruchu zwykle nie szkodzi, ale lepszym wyjściem jest konsolidacja: scalenie powiązanych tekstów w mocniejsze materiały z przekierowaniem 301. Zachowuje to wartość linków i poprawia głębię tematyczną.

Ile trwa powrót po ręcznym działaniu?

Po akceptacji wniosku o ponowne rozpatrzenie zwykle od kilku dni do kilku tygodni, przy czym sam przegląd wniosku trwa od kilku dni do dwóch tygodni. Powrót do poprzednich pozycji nie jest gwarantowany, bo widoczność zależy też od jakości tego, co zostało.