Czym jest content pruning i kanibalizacja treści?
Pruning odpowiada na dwa pytania o istniejący serwis: które strony odstają od głównego tematu na tyle, że rozmywają jego profil, i które są tak podobne do siebie, że konkurują o to samo zapytanie.
Kanibalizacja to ta druga sytuacja: dwa własne adresy celujące w tę samą intencję. Pruning jest reakcją na obie sytuacje: rozstrzyga, która strona ma zostać nośnikiem tematu, a które warto usunąć, przekierować albo scalić.
Co dostajesz?
- Tabelę stron odbiegających od tematu serwisu, każda z propozycją działania: usunąć, przekierować albo przebudować.
- Grupy stron konkurujących ze sobą, z wynikiem podobieństwa i propozycją: wskazać stronę główną i ustawić przekierowania, scalić treści albo rozdzielić je na różne zapytania.
- Podsumowanie tematyczne serwisu: temat główny i tematy poboczne wyliczone z treści opublikowanych stron.
- Eksport CSV. Gdy analiza nie znajdzie nic do poprawy, dostajesz o tym komunikat.
Główny temat serwisu: kredyt hipoteczny, zdolność kredytowa, kredyt gotówkowy (161 stron)
Tematy poboczne: podatek od najmu, wynajem mieszkania (14) · koszt budowy domu, poduszka finansowa (10) · nadpłacanie kredytu, harmonogram spłat (7)
To kandydaci do pruningu - strony, których treść tematycznie odbiega od głównego tematu serwisu. Rozważ usunięcie, przekierowanie 301 na pasujący artykuł albo przebudowę treści.
Kanibalizacja
Strony w jednej grupie konkurują o tę samą intencję - wysokie podobieństwo oznacza, że wyszukiwarka nie wie, którą pokazać. Wybierz najmocniejszą, scal pozostałe albo zróżnicuj je na osobne podtematy.
Dlaczego warto uporządkować treści?
Serwisy rosną warstwami: stare wpisy blogowe, akcje sezonowe, teksty pod frazy, których już nikt nie szuka. Każda taka strona rozmywa obraz tego, o czym jest domena - a to obraz, na podstawie którego wyszukiwarki i modele decydują, w czym jesteś wiarygodnym źródłem.
Drugi problem jest gorszy, bo niewidoczny: dwie własne strony celujące w to samo zapytanie. Zamiast jednej mocnej pozycji masz dwie słabsze, a przy odpowiedzi generatywnej model i tak wybierze jedno źródło - albo cudze.
Obu rzeczy nie da się ocenić okiem przy kilkuset adresach. Trzeba porównać każdą stronę z każdą.
Jak działa analiza?
- 1
Wczytanie sitemapy
Wczytujemy sitemapę razem z zagnieżdżonymi plikami i pomijamy grafiki oraz pozostałe media. Dostępność adresów sprawdzamy jeszcze przed startem analizy.
- 2
Pobranie stron
Z każdego adresu pobieramy tytuł, nagłówek H1 i opis meta - to wystarcza do porównania tematycznego i jest szybkie.
- 3
Reprezentacja semantyczna
Każda strona dostaje wektor opisujący jej treść, dzięki czemu porównujemy znaczenie, a nie zbieżność słów.
- 4
Główny temat serwisu
Grupujemy strony i wyliczamy temat główny oraz tematy poboczne na podstawie charakterystycznych fraz dwuwyrazowych.
- 5
Strony odbiegające od tematu
Mierzymy, jak daleko każda strona odchodzi od tematu głównego, i wskazujemy te powyżej ustawionego przez Ciebie progu.
- 6
Grupy kanibalizacji
Porównujemy strony parami i łączymy w grupy te, których podobieństwo przekracza próg.
- 7
Rekomendacje
Model opisuje znalezione przypadki i proponuje działanie dla każdego z nich.
Co ustawiasz przed startem
| Parametr | Zakres i domyślna wartość |
|---|---|
| Percentyl odchylenia | 50–99 (domyślnie 90) - powyżej niego strona trafia na listę odbiegających od tematu |
| Próg kanibalizacji | 0,7–1,0 (domyślnie 0,9) - od jakiego podobieństwa uznajemy strony za konkurujące |
Ile to kosztuje?
- 1 kredyt za jedną analizę, niezależnie od liczby stron w sitemapie.
- Strony, których nie udało się pobrać, są wykluczane z rankingu odchyleń - nie chcemy, żeby błąd sieci wyglądał jak treść nie na temat.
- Zadanie zakończone błędem zwraca kredyt automatycznie.
Najczęstsze pytania
Czy narzędzie skasuje mi strony?
Nie. Analiza jest wyłącznie doradcza - dostajesz listę stron i propozycję działania, a decyzja i wykonanie zostają po Twojej stronie. Nie łączymy się z Twoim CMS-em.
Mam duży serwis - podać jedną sitemapę czy kilka?
Przy rozbudowanym serwisie lepiej podać sitemapy sekcji osobno: blog, kategorie, produkty. Wyniki są wtedy trafniejsze, bo temat główny liczony jest w obrębie jednej sekcji, a nie uśredniany po całej domenie - a to on decyduje, które strony uznamy za odbiegające.
Czym różni się kanibalizacja od zwykłego podobieństwa tematów?
Progiem i konsekwencją. Dwie strony o zbliżonym temacie to normalna sytuacja; kanibalizacja zaczyna się tam, gdzie są na tyle podobne, że wyszukiwarka nie ma powodu wybrać jednej z nich. Ten próg ustawiasz sam przed analizą.