Programmatic SEO - co to jest i kiedy ma sens?
Programmatic SEO to strony generowane z danych wg szablonu. Sprawdź, kiedy ma sens, jakie typy stron budować i jakie ryzyka spamowe grożą złej implementacji.
Jako konsultant SEO, Paweł Wołoszyn, przy ocenie pomysłu na programmatic SEO pytam klienta najpierw o dane, nie o szablon: skąd biorą się liczby, opisy i różnice między podstronami, i czy ktoś będzie je aktualizował za pół roku. Najczęstszy błąd, jaki widzę, to budowanie systemu pod setki podstron miasto razy usługa, w którym jedyną różnicą jest nazwa miasta wklejona w gotowy tekst, a cennik i opis realizacji są identyczne wszędzie. Programmatic SEO to dla mnie nie jest trik na szybkie namnożenie adresów URL, tylko sposób na skalowanie treści, która i tak musiałaby powstać, bo dane na nią pozwalają. Zanim ruszę z takim projektem, sprawdzam też, czy wolumen wyszukiwań w ogóle uzasadnia skalę, bo wygenerowanie tysięcy stron pod zapytania, których nikt nie szuka, tylko obciąża indeksację bez żadnego zwrotu. W praktyce pomagam klientom zaprojektować to od strony danych i szablonu jeszcze przed napisaniem pierwszej linijki kodu, tak żeby wynikowe strony przeszły test unikalnej wartości, a nie tylko test techniczny.
Programmatic SEO - co to jest i kiedy ma sens?
Programmatic SEO to generowanie dużej liczby podstron według jednego szablonu wypełnianego różnymi danymi, tak żeby jedna witryna pokryła setki albo tysiące podobnych zapytań naraz. Sam mechanizm jest neutralny: o tym, czy strona ma sens, decyduje jakość danych wypełniających szablon i to, czy każda podstrona daje coś, czego nie dostaniesz na sąsiedniej.
Co to jest programmatic SEO?
W praktyce chodzi o rozdzielenie dwóch warstw: szablonu (layout, nagłówki, sekcje, ewentualnie dane strukturalne) i źródła danych, które ten szablon wypełnia. Źródłem bywa baza produktowa, API pogodowe, rejestr firm, wyniki ankiety, ceny z hurtowni albo dane geograficzne miast i dzielnic. Zamiast pisać ręcznie każdą podstronę, zespół buduje raz logikę renderowania, a potem system generuje kolejne warianty przy każdej aktualizacji danych źródłowych.
Techniczna definicja jest bliska temu, co Wikipedia opisuje jako stronę dynamiczną: konstruowaną w czasie działania aplikacji na podstawie stanu bazy danych, a nie przechowywaną jako gotowy plik. Dokumentacja MDN opisuje ten sam mechanizm jeszcze bardziej dosłownie: strony HTML powstają przez wstawianie danych z bazy do miejsc wyznaczonych w szablonie, co jest wydajniejszym sposobem przechowywania dużej ilości treści niż strona statyczna, czyli dokładnie ten proces, na którym opiera się programmatic SEO. Różnica względem zwykłej strony dynamicznej w CMS-ie jest taka, że tu celem wprost jest pokrycie wyników wyszukiwania wieloma wariantami podobnego zapytania, a nie tylko wyświetlenie treści userowi.
Jak działa programmatic SEO: trzy typowe typy stron
Prawie każdy projekt programmatic SEO da się przypisać do jednego z kilku powtarzalnych wzorców.
Miasto × usługa
Najpopularniejszy wariant: jedna usługa (na przykład „ocieplanie poddaszy” albo „wynajem koparki”) razy lista miast czy dzielnic. Strona „usługa w mieście X” ma sens, jeśli faktycznie różni się między miastami: inny cennik regionalny, inny czas realizacji, inna lista lokalnych realizacji czy partnerów. Jeśli różni się wyłącznie nazwa miasta wstawiona w trzech miejscach tekstu, to formalnie jest to programmatic SEO, ale de facto tworzysz setki niemal identycznych stron.
Porównania: X kontra Y
Strony typu „produkt A vs produkt B” generowane automatycznie z macierzy cech dwóch albo więcej produktów. Mają sens, gdy dane wejściowe, czyli specyfikacje, ceny, dostępność, są aktualne i rzeczywiście różnicujące, a nie skopiowane bez zmian z kart produktowych producenta.
Katalogi i bazy danych
Strony typu „opinie o leku X” albo „specyfikacja modelu Y”, generowane z bazy produktowej albo API. Tu dane strukturalne w formacie schema.org, na przykład typ Product opisujący dowolny oferowany produkt lub usługę, pomagają wyszukiwarce poprawnie zinterpretować, czym jest dana podstrona, ale nie zastępują unikalnej treści.
| Typ strony | Przykładowe zapytanie | Źródło danych | Główne ryzyko |
|---|---|---|---|
| Miasto × usługa | "hydraulik Kraków" | Lokalny cennik, realizacje, dane geograficzne | Doorway pages przy identycznym tekście między miastami |
| Porównania X vs Y | "Shopify czy WooCommerce" | Realne testy, dokumentacja obu produktów | Płytka treść skopiowana z materiałów producenta |
| Katalogi/bazy | "opinie o [produkt]" | API produktowe, dane z rejestrów, recenzje | Scaled content abuse przy masowym scrapingu feedów |
Kiedy programmatic SEO ma sens
Warunek jest jeden i nie ma od niego wyjątku: każda podstrona musi mieć unikalne dane i realną wartość dla kogoś, kto trafi na nią z wyszukiwarki. Google w wytycznych o treściach pisanych z myślą o ludziach pyta wprost, czy treść „unika kopiowania lub przepisywania źródeł, a zamiast tego zapewnia istotną dodatkową wartość i oryginalność”. Praktyczny test wygląda tak: usuń szablon i zostaw same dane wypełniające jedną podstronę. Jeśli tych danych w ogóle nie ma, są identyczne na każdej podstronie albo są tak skąpe, że nie da się z nich złożyć sensownego akapitu, projekt nie przejdzie tego testu, niezależnie od tego, jak ładny jest layout.
Drugi warunek to skala zapytań. Programmatic SEO opłaca się tam, gdzie realnie istnieje długi ogon podobnych, ale odrębnych intencji wyszukiwania, na przykład setki miast czy tysiące par produktów do porównania. Tam, gdzie zapytań jest kilka albo kilkanaście, prościej i bezpieczniej napisać każdą stronę osobno.
Ryzyka wprost z zasad Google dotyczących spamu
Google od marca 2024 roku ma osobną politykę spamową dopisaną wprost pod tego typu praktyki, rozszerzającą wcześniejszą politykę o automatycznie generowanych treściach. Trzy kategorie z oficjalnych https://developers.google.com/search/docs/essentials/spam-policies">zasad Google dotyczących spamu dotyczą programmatic SEO bezpośrednio.
Scaled content abuse. Google definiuje to jako sytuację, w której „wiele stron jest generowanych w głównym celu manipulowania rankingiem wyszukiwania, a nie pomagania użytkownikom”. Zasada wymienia wprost scrapowanie feedów, wyników wyszukiwania czy innych treści w celu wygenerowania wielu stron, także przez automatyczne przekształcenia jak synonimizacja czy tłumaczenie, gdzie treść daje niewielką wartość użytkownikom. To dokładnie opisuje częsty błąd przy katalogach programmatic SEO: pobranie feedu produktowego i wygenerowanie tysięcy podstron bez żadnej warstwy oryginalnej treści.
Doorway abuse. Google opisuje to jako strony tworzone, żeby rankować na konkretne, podobne zapytania wyszukiwania, które „prowadzą użytkowników do stron pośrednich, mniej użytecznych niż strona docelowa”. Wśród przykładów Google wymienia wprost wiele domen lub stron kierowanych na konkretne regiony albo miasta, które kierują użytkowników do jednej strony, czyli klasyczny wzorzec miasto × usługa zrobiony źle.
Thin affiliation. Najbliższy oficjalny odpowiednik potocznego „thin content”: Google opisuje to jako publikowanie treści z linkami afiliacyjnymi, gdzie opisy produktów i recenzje są kopiowane bezpośrednio od sprzedawcy, bez żadnej oryginalnej treści ani dodanej wartości. Google dodaje, że takie strony „często wyglądają jak witryny lub szablony cookie-cutter, z tą samą lub podobną treścią powielaną w obrębie jednej witryny albo w wielu domenach i językach”, co jest niemal dosłownym opisem źle zrobionego programmatic SEO.
Do tego dochodzi ryzyko techniczne: budżet indeksowania. Google radzi dużym serwisom konsolidować duplikaty i blokować mało istotne adresy w robots.txt, bo zapotrzebowanie na crawlowanie zależy między innymi od „postrzeganego inwentarza” strony. Wygenerowanie dziesięciu tysięcy niemal identycznych podstron nie zwiększa tego zapotrzebowania, tylko rozmywa je na treść, której Google i tak nie chce indeksować.
Ryzyko nie ogranicza się do Google. Bing w swoich wytycznych dla webmasterów ma osobną kategorię „Automatically Generated Content at Scale”: treści tworzone na dużą skalę bez nadzoru, kontroli jakości czy redakcji „often lacks usefulness, accuracy, and originality” i mogą zostać wykluczone z indeksowania, czyli praktycznie ten sam mechanizm co scaled content abuse w Google.
Jak mierzyć skuteczność programmatic SEO
Podstawowa metryka to nie liczba wygenerowanych stron, tylko wskaźnik indeksacji: ile z wygenerowanych adresów Google faktycznie zaindeksował. Raport indeksowania stron w Search Console pokazuje to wprost, razem ze statusami typu „zeskanowano, ale niezaindeksowano”, które Google opisuje jako strony zeskanowane, ale na razie celowo pominięte przy indeksowaniu. Niski odsetek zaindeksowanych podstron przy dużej ich liczbie to pierwszy sygnał, że system generuje więcej treści, niż wyszukiwarka uważa za wartą pokazania.
Druga metryka to ruch i konwersje rozbite per typ podstrony, nie zbiorczo dla całego projektu. Jeśli strony „usługa w mieście X” dla dziewięćdziesięciu miast generują ruch głównie z pięciu największych, a reszta stoi bez odsłon miesiącami, to sygnał, że wartość informacyjna tych podstron jest bliska zeru i całą kategorię trzeba przemodelować albo skrócić do miast, które realnie mają unikalne dane.
Trzecia metryka to udział programmatic SEO w budowaniu szerszego pokrycia tematu, widoczny w mapie tematycznej serwisu: czy wygenerowane strony faktycznie domykają luki w topical authority obok treści pisanej ręcznie, czy tylko sztucznie zawyżają liczbę adresów URL bez wpływu na widoczność całej domeny.
Kiedy NIE robić programmatic SEO
Kilka sygnałów, że projekt lepiej zatrzymać na etapie planowania.
- Brak własnego, aktualizowanego źródła danych, tylko jednorazowy eksport, który za pół roku będzie nieaktualny.
- Dane wejściowe są identyczne albo prawie identyczne dla większości wariantów, co prowadzi wprost do ryzyka duplicate content i klasyfikacji jako doorway pages.
- Wolumen wyszukiwań na pojedynczy wariant jest znikomy, a liczba wariantów duża, czyli generujesz kod pod boty, a nie treść pod realne zapytania.
- Zespół nie ma zasobów, żeby monitorować i czyścić wygenerowane strony, które z czasem tracą aktualność: ceny, dostępność, stan prawny.
- Model biznesowy nie potrzebuje faktycznie setek czy tysięcy wariantów, tylko kilkunastu, dla których szybciej i bezpieczniej napisać treść ręcznie albo półautomatycznie z redakcją.
W e-commerce programmatic SEO sprawdza się często przy dużych katalogach z realnymi, różnicującymi danymi produktowymi. Tam, gdzie tych danych brakuje, lepiej ograniczyć skalę projektu, niż ryzykować manualną akcję albo systemowy spadek widoczności po aktualizacji rdzenia algorytmu.
Źródła
- Spam Policies for Google Web Search - Google Search Central – https://developers.google.com/search/docs/essentials/spam-policies
- What web creators should know about our March 2024 core update and new spam policies - Google Search Central Blog – https://developers.google.com/search/blog/2024/03/core-update-spam-policies
- Creating helpful, reliable, people-first content - Google Search Central – https://developers.google.com/search/docs/fundamentals/creating-helpful-content
- Optimize your crawl budget - Google Search Central – https://developers.google.com/search/docs/crawling-indexing/large-site-managing-crawl-budget
- Page indexing report - Search Console Help – https://support.google.com/webmasters/answer/7440203
- Product - Schema.org – https://schema.org/Product
- Dynamic web page - Wikipedia – https://en.wikipedia.org/wiki/Dynamic_web_page
- Introduction to the server side - MDN Web Docs – https://developer.mozilla.org/en-US/docs/Learn/Server-side/First_steps/Introduction
- Bing Webmaster Guidelines - Bing Webmaster Tools – https://www.bing.com/webmasters/help/webmaster-guidelines-30fba23a
Najczęściej zadawane pytania (FAQ)
Czym różni się programmatic SEO od zwykłego pisania podstron?
Różnica jest w skali i procesie, nie w efekcie końcowym. Przy programmatic SEO treść powstaje z połączenia szablonu i bazy danych, a nie z ręcznego pisania każdej podstrony osobno, więc jedna zmiana w danych źródłowych aktualizuje od razu setki albo tysiące stron. Efekt ma wyglądać identycznie jak dobrze napisana strona, różni się tylko sposób jej produkcji.
Ile stron trzeba wygenerować, żeby to nazwać programmatic SEO?
Nie ma sztywnego progu liczbowego, bo to kwestia procesu, a nie liczby URL-i. Kilkanaście podstron zrobionych z jednego szablonu i arkusza danych to już programmatic SEO w małej skali, tysiące stron z dużej bazy produktowej to ta sama technika w dużej skali. Liczy się to, czy treść powstaje automatycznie z danych, a nie ile jej powstało.
Czy Google karze za programmatic SEO?
Google nie karze za sam mechanizm generowania stron z szablonu, tylko za efekt, który łamie zasady spamowe: scaled content abuse, doorway abuse albo thin affiliation. Projekt oparty na unikalnych, aktualnych danych i realnej wartości dla użytkownika nie różni się w ocenie od strony napisanej ręcznie.
Jakich danych potrzebuję, żeby zacząć projekt programmatic SEO?
Potrzebny jest jeden, najlepiej własny i regularnie aktualizowany zbiór danych, który realnie różnicuje kolejne podstrony: ceny, dostępność, dane lokalne, specyfikacje albo wyniki testów. Jeśli jedynym źródłem różnicy między podstronami jest nazwa miasta czy produktu wstawiona w gotowy tekst, dane są za płytkie, żeby zbudować na nich sensowny projekt.
Czy programmatic SEO nadaje się dla małej, lokalnej firmy?
Rzadko, chyba że firma ma realnie odrębne oferty czy dane dla wielu lokalizacji, na przykład różne cenniki albo zespoły w kilku miastach. Przy kilku czy kilkunastu wariantach zwykle szybciej i bezpieczniej napisać każdą podstronę ręcznie, niż budować cały system pod szablon i dane.
Jak sprawdzić, czy moje strony programmatic SEO nie są traktowane jak spam?
Sprawdź raport indeksowania stron w Search Console: jeśli duża część wygenerowanych adresów ma status „zeskanowano, ale niezaindeksowano”, to sygnał ostrzegawczy. Dodatkowo porównaj kilka losowych podstron ze sobą: jeśli po usunięciu szablonu zostaje niemal ten sam tekst ze zmienioną nazwą miasta czy produktu, projekt wpisuje się dokładnie w opis scaled content abuse albo thin affiliation z zasad Google.