Dlaczego optymalizacja chunków jest ważna dla modeli AI?
Wyszukiwarka generatywna nie wczytuje całej strony do odpowiedzi. Indeksuje ją pociętą na fragmenty - najczęściej pojedyncze sekcje H2 lub H3 - i przy pytaniu użytkownika pobiera te, które wyglądają na najtrafniejsze. Twój fragment trafia do modelu bez tytułu artykułu, bez poprzedniej sekcji i bez wprowadzenia.
Dlatego zdanie „jak wspomniano wyżej, ten parametr jest kluczowy” jest w GEO stratą - poza kontekstem nie znaczy nic i nie da się go zacytować. To samo dotyczy sekcji, która nigdy nie powtarza tematu, o którym mówi, bo posługuje się zaimkiem odsyłającym do nagłówka sprzed dwóch ekranów.
Odwrotnie: sekcja napisana jak samodzielna odpowiedź może zostać zacytowana nawet wtedy, gdy reszta strony jest przeciętna. Chunk jest jednostką konkurowania w AI Search - nie strona.
Co zobaczysz w raporcie?
Dostajesz ocenę autonomiczności sekcja po sekcji, wraz ze wskazaniem tych, które bez kontekstu całości przestają być zrozumiałe.
Do tego dwie metryki uzupełniające, liczone algorytmicznie i pokazywane obok wyniku, ale nie wliczane do oceny. Pierwsza to cytowalność poszczególnych sekcji, czyli szansa, że akurat ta zostanie wybrana jako źródło - składają się na nią dopasowanie nagłówka do intencji, samodzielność pierwszego zdania, udział zdań oznajmujących, pozycja na stronie i zagnieżdżenie nagłówka. Druga to gęstość cytowalnych fragmentów w całym tekście, czyli jaki procent słów mieści się we fragmentach nadających się do zacytowania.
Osobno pokazujemy nagłówki powtarzające się u konkurencji z Top 10, z zaznaczeniem, których nie masz - to gotowa lista sekcji do dopisania.
Przykładowe rekomendacje
Fragmenty raportu z audytu strony kategorii z myszkami gamingowymi w sklepie z elektroniką.
Problem: Sekcja i jej nagłówki H3 mają zerową gęstość cytowalną - do indeksu trafiają puste fragmenty.
### Sprawdź powiązane kategorie ### Szukasz konkretnego producenta? ### Chcesz wiedzieć więcej?
Pod każdym nagłówkiem dopisz 30–50 słów z nazwami kategorii, marek i tytułami poradników.
Problem: Karta produktu nie zawiera nazwy modelu, więc wycięta z listingu przestaje cokolwiek znaczyć.
Typ produktu: mysz. Rolka przewijania: tak. Transmisja: przewodowa. 149,00 zł.
Umieść pełną nazwę handlową na początku karty - fragment ma pozostać zrozumiały bez reszty strony.
Jak liczymy optymalizację chunków?
Model sprawdza każdą sekcję osobno pod kątem czterech kryteriów: czy zaczyna się od odpowiedzi, czy powtarza główny temat co najmniej dwa razy, czy nie odsyła do innych fragmentów („powyżej”, „jak już pisaliśmy”) i czy ma długość adekwatną do typu treści.
Ostatnie kryterium zależy od typu treści: sekcja FAQ ma być krótka, hasło encyklopedyczne może być długie:
Optymalna długość sekcji zależy od typu strony
| Typ treści | Długość sekcji |
|---|---|
| Artykuł | 200–500 słów |
| Hasło encyklopedyczne | 400–1500 słów |
| Porównanie | 150–400 słów |
| Landing, listing, produkt | 80–300 słów |
| Narzędzie, kalkulator | 50–200 słów |
| FAQ | 30–150 słów |
Co podnosi, a co obniża wynik?
Podnosi
- Sekcja otwierana zdaniem oznajmującym, które samo w sobie jest odpowiedzią
- Główny temat nazwany wprost w sekcji, a nie zastąpiony zaimkiem
- Długość dopasowana do typu strony, nie do normy na artykuł
- Nagłówek, który brzmi jak pytanie użytkownika, a nie jak hasło reklamowe
- Fakty i liczby wewnątrz sekcji, nie w osobnym podsumowaniu na końcu strony
Obniża
- Odwołania w rodzaju „powyżej”, „jak już wspominaliśmy”, „w poprzedniej części”
- Sekcja otwarta pytaniem retorycznym albo spójnikiem („Jednak”, „Natomiast”)
- Otwarcie zaimkiem bez wskazania, do czego się odnosi („To oznacza, że...”)
- Ściana tekstu bez podziału na sekcje
- Sekcje po 30 słów w artykule albo po 900 w FAQ
Najczęstsze pytania
Czy muszę dzielić tekst na krótkie sekcje?
Nie, długość ma być dopasowana do typu treści. Hasło encyklopedyczne może mieć sekcje po 1500 słów, odpowiedź w FAQ - 50. Sztuczne cięcie artykułu na kawałki po 100 słów obniża wynik tak samo jak ściana tekstu.
Czy odwołania w rodzaju „jak wspomniano wyżej” naprawdę szkodzą?
Tak, i to poważnie. Sekcja trafia do modelu bez sąsiednich fragmentów, więc odwołanie wskazuje na coś, czego w danym momencie nie ma. Taki fragment przestaje nadawać się do zacytowania, nawet jeśli merytorycznie jest najlepszy na stronie.
Czy cytowalność sekcji wpływa na ocenę wymiaru?
Nie, to metryka uzupełniająca pokazywana obok wyniku. Mówi, które sekcje mają największą szansę zostać wybrane jako źródło, ale nie wchodzi do oceny końcowej.