Query template: autoritet se vezuje i za format upita, ne samo za temu.
Jedan upit može da postoji u hiljadama varijacija. Mapiranje tog obrasca je drugi put do tematskog autoriteta, pored pokrivanja entiteta i njihovih atributa.
Dva puta do tematskog autoriteta
Postoje dva načina da se gradi tematski autoritet. Prvi pokriva sve entitete jedne klase kroz njihove zajedničke atribute. Drugi pokriva sve varijacije jednog obrasca upita. Treći, najjači pristup, kombinuje oba.
Prvi put je onaj koji opisujemo na stranici o tematskom autoritetu: entiteti istog tipa dele isti skup atributa. „Kalorija“ je atribut svakog entiteta u klasi „hrana“, kao što je „simptom“ atribut svakog entiteta u klasi „bolest“. Pokrivanje cele klase kroz zajedničke atribute signalizira potpunost.
Drugi put ne zahteva tematsku povezanost između stranica. Autoritet se vezuje za format upita, ne za temu. Zato jedan izvor može da rangira za međusobno nepovezane teme ako dosledno zadovoljava isti obrazac pitanja.
| Pristup | Šta se pokriva | Gde se vezuje autoritet | Rizik |
|---|---|---|---|
| Entitet–atribut | Svi članovi klase, svi zajednički atributi | Za temu | Dubina bez širine formata |
| Query template | Sve varijacije jednog obrasca upita | Za format upita | Širina bez tematske dubine |
| Hibrid | Sve entitete klase, kroz sve atribute, u svim varijacijama obrasca | Za oba | Zahteva najviše discipline i podataka |
Šta je query template?
Query template je obrazac upita u kojem se jedan ili više delova menja, a struktura ostaje ista. Na primer taxi [grad] cenovnik ili koliko košta [usluga] u [gradu].
Obrazac se obično razlaže na tri pozicije: kontekstualnu imenicu, centralni entitet i sinonim za funkciju ili nameru. Kada se te pozicije popišu, dobija se mapa svih varijacija koje jedan sistem sadržaja može da pokrije.
| Komponenta | Pozicija | Varijacije |
|---|---|---|
| Centralni entitet | Početak upita | taxi, taksi |
| Kontekstualni entitet | Sredina upita | Beograd, Niš, Novi Sad, Kragujevac, Šabac, Subotica… |
| Sinonim namere | Kraj upita | cenovnik, cena, koliko košta, tarifa, kalkulator |
Važno je da predikati koji prate obrazac nisu uvek isti. Uz „cenovnik“ prirodno idu tarifa, start, kilometraža i čekanje. Uz „kako naručiti“ idu telefon, aplikacija i vreme dolaska. Razlika u predikatima je signal da je reč o odvojenim stranicama, a ne o jednoj.
Kada upit zaslužuje sopstvenu stranicu?
Odluka se donosi po četiri metrike: potražnja za upitom, prisustvo drugog entiteta, niska sličnost sa postojećim upitima i postojanje obrasca. Kada su tri od četiri zadovoljene, varijacija zaslužuje sopstveni URL. Kada nisu, pripada kao sekcija na postojećoj stranici.
Ovo je preciznija formulacija pravila „jedan dominantan micro-intent po URL-u“. Pravilo bez praga i bez kriterijuma sličnosti nije operativno — po njemu se svaka nijansa može opravdati kao nova stranica, što je upravo ono što nadima sajt.
| Metrika | Pitanje | Primer iz taksi delatnosti |
|---|---|---|
| Potražnja | Ima li upit dovoljno traženja da opravda održavanje stranice? | „taxi Beograd cenovnik“ ima; „taxi Beograd cenovnik nedeljom“ nema |
| Drugi entitet | Uvodi li varijacija entitet kojeg nema na postojećoj stranici? | Svaki grad je zaseban entitet sa sopstvenim tarifama |
| Niska sličnost | Razlikuje li se dovoljno od upita koje već pokrivaš? | „cenovnik“ i „cena po kilometru“ su previše bliski za dve stranice |
| Obrazac | Postoji li obrazac koji se ponavlja kroz varijacije? | „taxi [grad] cenovnik“ postoji za dvadeset tri grada |
Metrike se ne posmatraju pojedinačno. Varijacija koja zadovolji potražnju ali padne na sličnosti i entitetu ostaje sekcija, bez obzira na to koliko je traže.
| Situacija | Odluka | Obrazloženje |
|---|---|---|
| Različiti predikati, isti entitet | Nova stranica | Namera se razlikuje, sadržaj se ne preklapa |
| Slični predikati, različit entitet | Nova stranica | Podaci su vezani za entitet i ne smeju se mešati |
| Slični predikati, isti entitet | Sekcija na postojećoj | Dve stranice bi se međusobno kanibalizovale |
| Potražnja ispod praga | Rečenica ili stavka u tabeli | Zaseban URL troši crawl i razblažuje interne veze |
Prag nije univerzalan broj. Definiše se po projektu, pre pisanja, i zapisuje se u topical mapu zajedno sa izvorom procene potražnje. Prag koji se određuje posle pisanja nije prag nego opravdanje.
Sličnost upita nije poređenje niza znakova
Dva upita nisu slična zato što dele većinu slova, nego zato što dele termin koji nosi najveću težinu. Sličnost je otežana prema važnosti entiteta i potražnji, ne prema podudaranju stringova.
Istraživanje o težinjenju termina u upitu pokazuje da jezički modeli ne tretiraju sve reči jednako. U upitu „Nike patike za trčanje“ termin „Nike“ nosi veću težinu za relevantnost od „patike“ ili „trčanje“. To ima direktnu posledicu na odluku o stranici.
| Par upita | Najteži termin | Odluka |
|---|---|---|
| taxi Beograd cenovnik / taxi Niš cenovnik | naziv grada | Dve stranice — najteži termin se menja |
| taxi Beograd cenovnik / taxi Beograd cena po km | Beograd | Jedna stranica — najteži termin je isti |
| taxi Beograd / taxi Beograd aerodrom | Beograd, pa aerodrom | Dve stranice — drugi upit uvodi novi entitet visoke težine |
Praktična posledica: pre nego što odlučiš o stranici, utvrdi koji termin u upitu nosi najveću težinu. Ako se taj termin menja između varijacija, verovatno je reč o odvojenim stranicama. Ako ostaje isti a menjaju se samo dopune, verovatno je reč o sekcijama.
Isto važi i za sam dokument. Ako je najteži termin naziv grada, on treba da bude i subjekat tvrdnji na stranici — u naslovu, u prvoj rečenici i u strukturiranim podacima. Stranica čiji najteži termin ne odgovara najtežem terminu upita rešava drugi problem od onog koji korisnik ima.
Ograničenje: Google ne objavljuje kako tačno računa težinu termina niti prag sličnosti. Ovo je model razmišljanja izveden iz objavljenih istraživanja o težinjenju termina i iz patenta o otkrivanju duplikata specifičnih za upit, ne dokumentovan algoritam.
Mikrosemantika: red reči menja relevantnost
Dve rečenice mogu tvrditi istu činjenicu a imati različitu relevantnost za isti upit. Razliku pravi to koji pojam stoji u poziciji subjekta.
Uporedi:
Finansijsku nezavisnost porodice postižu uz pomoć finansijskih savetnika.
Finansijski savetnici pomažu porodicama da postignu finansijsku nezavisnost.
Iste činjenice, isti entiteti. Ali ako je upit „finansijski savetnik“, druga rečenica ima taj pojam kao subjekat i bolje odgovara nameri. Ako je upit „finansijska nezavisnost“, prva radi bolje.
Pravilo koje iz toga sledi: najteži termin upita treba da stoji u poziciji subjekta tvrdnje na stranici. Tvrdnja se posmatra kao trojka subjekat–predikat–objekat, a mikrosemantika je usklađivanje te trojke sa težinom termina u upitu.
| Ciljani upit | Rečenica koja bolje odgovara |
|---|---|
| taxi Beograd cena | „Taxi u Beogradu naplaćuje start od 320 dinara i 105 dinara po kilometru.“ |
| cena po kilometru taxi | „Cena po kilometru u Beogradu iznosi 105 dinara danju i 135 noću.“ |
| koliko košta vožnja do aerodroma | „Vožnja do aerodroma od 18 kilometara košta oko 2.210 dinara.“ |
Na jednoj stranici ovo izgleda kao cepidlačenje. Na obrascu sa tri hiljade varijacija ista sitnica se množi tri hiljade puta i prestaje da bude sitnica.
Jezgro i spoljni sloj mape
Topical mapa ima dva dela. Jezgro je pretežno komercijalno i nosi najvažnije entitete. Spoljni sloj je pretežno informativan i povezuje centralni entitet sa ostatkom mape. Interne veze uvek teku od spoljnog sloja ka jezgru.
Ovo je preciznija podela od hub-and-spoke modela, jer ne govori samo o smeru veza nego i o tome čemu koji deo služi. Svaki klik i prikaz koji spoljni sloj zaradi prenosi signal ka komercijalnim stranicama u jezgru.
| Deo mape | Uloga | Primer |
|---|---|---|
| Jezgro | Komercijalno, prima signale | Gradski cenovnici, gradski hubovi, kalkulator |
| Spoljni sloj | Informativno, šalje signale | Vodiči o tome kako naručiti, šta utiče na cenu, kako se prepoznaje pouzdana služba |
Jedno pravilo pri povezivanju: isti anchor tekst ne ponavljaj više od tri puta u glavnom sadržaju. Raznovrsnost anchor teksta održava kontekstualnu jedinstvenost i sprečava da veze deluju šablonski.
Protivteža: podela na jezgro i spoljni sloj ne znači da mapa mora imati mnogo stranica. Postoje projekti gde cela mapa staje na jedan URL i nadmašuje konkurente koji za isto koriste desetine stranica. Broj stranica je posledica praga, ne cilj.
Cena preuzimanja kao okvir
Cena rangiranja jednog izvora ne sme da pređe cenu njegovog nerangiranja. Ovo je okvir koji povezuje tehnički SEO i semantiku u jedan problem umesto u dva odvojena.
Pretraživač ne bira najbolji mogući odgovor po svaku cenu. On procenjuje odnos kvaliteta i troška obrade. Kada je izvor skup za obradu — spor, nejasno segmentiran, pun URL-ova koji ne donose ništa — a kvalitet ne opravdava taj trošak, jednostavnije je ne rangirati ga.
Praktična posledica je da svaka stranica bez sopstvene namere povećava trošak celog sajta. Zato uklanjanje suvišnih URL-ova nije samo higijena, već povećava količinu signala po preostalom dokumentu.
U toj logici se tematski autoritet može izraziti kao odnos: ((istorijski podaci × pokrivenost teme) ÷ cena preuzimanja) × ispravne vizuelne anotacije, gde je vizuelna semantika množilac, a ne naknadno tumačenje. Formula nije merna jedinica nego način da se vidi zašto pokrivenost sama po sebi ne pomaže ako je cena obrade previsoka, i zašto raspored stranice nije odvojena tema od arhitekture. Kao množilac, pogrešna anotacija poništava sve ostalo: ni najniža cena obrade ni najšira pokrivenost ne pomažu ako glavni sadržaj stranice nije ono što upit traži.
Paul Haahr iz Google-a to je na jednoj konferenciji formulisao otvoreno: ako je rezultat pogrešan za pojedinačni upit, neće ga popravljati; ako taj upit pripada klasteru, hoće. To je najdirektnija potvrda da se rad isplati na nivou obrasca, ne pojedinačne stranice.
Ograničenje: „cena preuzimanja“ je analitički okvir izveden iz javno dostupnih patenata, izjava Google inženjera i industrijske analize. Google ne objavljuje formulu niti potvrđuje ovaj naziv kao svoj ranking sistem. Koristimo ga kao model razmišljanja, ne kao dokumentovanu činjenicu.
Šta pokazuju naša dva projekta
Imamo dva projekta u istoj delatnosti sa istom metodologijom, ali različitim brojem varijacija obrasca. Poređenje je korisno baš zato što rezultat nije isti.
| Projekat | Varijacija obrasca „[grad] cenovnik“ | AI udeo cenovnika | AI udeo celog sajta |
|---|---|---|---|
| taxi.co.rs | 22 cenovnika sa prikazima (od 23 grada) | 30,9% | 14,2% |
| leskovac.taxi | 1 grad | 6,9% | 5,2% |
Na oba sajta stranice sa konkretnom tarifom nadmašuju prosek sopstvenog sajta. Ali odnos prema proseku je 2,2 puta na sajtu sa 22 varijacije, a 1,3 puta na sajtu sa jednom. To je u skladu sa idejom da varijacije istog obrasca uzajamno pojačavaju jedna drugu, ali to nije dokaz — vidi kontrolni slučaj za pun spisak ograničenja, uključujući i drugo objašnjenje koje smatramo jačim od ovog.
Kako se ovo primenjuje
- Popiši pozicije obrasca. Kontekstualni entitet, centralni entitet, sinonim namere. Zapiši sve vrednosti koje stvarno postoje u tvojoj delatnosti.
- Utvrdi prag potražnje pre pisanja i navedi izvor procene.
- Proveri predikate po varijaciji. Ako se predikati razlikuju, to je nova stranica. Ako se poklapaju a entitet je isti, to je sekcija.
- Poveži varijacije internim vezama ka komercijalnom jezgru, tako da informativne stranice prenose signal.
- Ukloni URL-ove koji ne prolaze prag i preusmeri ih na stranicu koja pokriva njihovu nameru.
- Meri po grupi stranica, ne po pojedinačnom URL-u. Obrazac se vidi tek na nivou grupe.
Česta pitanja
Da li query template zamenjuje topical mapu?
Ne. To su dva komplementarna puta. Topical mapa pokriva entitete i atribute jedne teme, a query template pokriva varijacije jednog obrasca upita. Najjači sistem koristi oba istovremeno.
Koliki prag potražnje treba postaviti?
Ne postoji univerzalan broj. Prag zavisi od delatnosti, konkurencije i kapaciteta da se stranica održava. Ključno je da se prag definiše pre pisanja i da se zapiše zajedno sa izvorom procene.
Da li više stranica uvek znači veći autoritet?
Ne. Stranica bez sopstvene namere troši budžet obilaska i razblažuje interne veze, pa smanjuje količinu signala po preostalom dokumentu. Deset potpunih stranica često nadmašuje sto šablonskih.
Da li je „cena preuzimanja“ zvaničan Google pojam?
Nije. To je analitički okvir izveden iz patenata, izjava Google inženjera i industrijske analize. Google ne objavljuje formulu niti koristi taj naziv za neki od svojih sistema.
Koliko metrika mora biti zadovoljeno da bi upit dobio stranicu?
Tri od četiri: potražnja, drugi entitet, niska sličnost i postojanje obrasca. Varijacija koja zadovolji samo potražnju, a padne na sličnosti i entitetu, ostaje sekcija na postojećoj stranici.
Kako se računa sličnost dva upita?
Ne poređenjem niza znakova nego težinom termina. Ako se najteži termin menja između varijacija, verovatno je reč o odvojenim stranicama; ako ostaje isti, verovatno o sekcijama.