Zašto AI neke stranice navodi, a druge zanemaruje

Između dviju stranica s istim znanjem o tome koja će biti navedena ne odlučuje kvaliteta. Odlučuje može li se iz jedne od njih izdvojiti rečenica koja stoji sama za sebe i koja se može provjeriti.

Iz polja istovrsnih slabih oblika svjetlo obuhvaća točno jedan i on istupa naprijed

Najvažnije ukratko

  • Navode se odsječci, a ne stranice – zato raspored odlučuje više od ukupne kvalitete.
  • Šest svojstava navedeni izvori imaju zajedno: odgovor koji se da izdvojiti, provjerljiv podatak, prepoznatljiva odgovornost, aktualnost, tehnička čitljivost i tematska bliskost okoline.
  • Tri razloga isključuju jake stranice: sadržaj nastaje tek uz JavaScript, stranica je zapriječena ili su tvrdnje raspršene samo po tekućem tekstu.
  • Provjerljiv vlastiti podatak najjači je pojedinačni čimbenik – on je razlog zašto model navodi vas umjesto nekog općeg izvora.

Kad sustav gradi odgovor, izvore ne bira po naklonosti ni po ugledu, nego po upotrebljivosti. Pitanje je uvijek isto: daje li ta stranica isječak teksta koji odgovara na postavljeno pitanje, koji je razumljiv sam za sebe i koji se može potkrijepiti?

Šest svojstava

1. Odgovor koji se da izdvojiti

Odsječak koji na pitanje potpuno odgovara u dvije do četiri rečenice, bez upućivanja na okolni tekst. Daleko najvažnije svojstvo – i jedino koje je potpuno u vašim rukama.

2. Provjerljiv vlastiti podatak

Brojka, postupak, razdoblje, iskustvo s područjem primjene. To je razlog zašto model navodi vas umjesto nekog općeg izvora: kažete nešto što drugdje ne piše.

3. Prepoznatljiva odgovornost

Autor s ulogom, tvrtka s adresom, datum zadnje provjere – vidljivo na stranici i u strukturiranim podacima, s istom vrijednošću. Osobito važno kod tema koje dodiruju novac, zdravlje ili pravo.

4. Razumljiva aktualnost

Datum koji je točan i sadržaj koji tom datumu odgovara. Datum izmjene od jučer uz tekst koji opisuje odavno prevladano stanje gori je nego nikakav.

5. Tehnička čitljivost

Sadržaj stoji u isporučenom HTML-u, a ne tek nakon izvođenja JavaScripta. Uredna hijerarhija naslova, bez zapreke u robots.txt za dohvate u trenutku upita.

6. Tematska bliskost okoline

Stranica u polju koje web stranica prepoznatljivo zauzima prije će se vrednovati kao stručan izvor nego pojedinačan članak među dvadeset nepovezanih tema. To je razlog zašto tematske skupine djeluju.

Jeste li znali?

Drugo je svojstvo pravi oslonac za male tvrtke. Kod općeg se znanja natječete s velikim portalima i gubite – ondje ne postoji razlog da se navede baš vas.

Kod provjerljivog vlastitog podatka vi ste izvor. «U praksi čišćenje izrasla popisa kontakata traje jedan do tri dana» nije općepoznata tvrdnja – potječe od nekoga tko je to napravio i upravo je zato podobna za navođenje. Jedna rečenica s vlastitim iskustvom teži više od triju odlomaka sažetka.

Tri razloga zbog kojih jake stranice otpadaju

RazlogPo čemu se prepoznajeTrud za uklanjanje
Sadržaj nastaje tek u preglednikuizvorni kod stranice ne sadrži tekstvelik – pitanje arhitekture
Dohvati u trenutku upita zapriječenirobots.txt priječi ChatGPT-User i sl.minute
Tvrdnje raspršene samo po tekućem tekstunijedan odlomak sam ne odgovara na pitanjesrednji – preradba odlomaka

Drugi je razlog najmučniji jer se uklanja u nekoliko minuta, a ipak se često pojavljuje – najčešće kao nuspojava paušalne zapreke za «sve AI botove».

Iz prakse

Uzorak koji se pokazuje pri analizi navedenih izvora: rijetko su to opsežni pregledni članci. To su kratke stranice koje na točno jedno pitanje odgovaraju potpuno – često one koje se u vlastitoj kući smatraju usputnim proizvodom.

Članak od 900 riječi s jasnom brojkom i imenovanim područjem primjene navodi se češće od vodiča od 2.500 riječi o istoj temi u kojem ista brojka stoji u jedanaestom odlomku. Za planiranje sadržaja to znači: više oštro omeđenih pojedinačnih pitanja, manje sveobuhvatnih vodiča.

Što se konkretno može učiniti

  1. Napraviti test izdvajanja. Prekopirati bilo koji odlomak u prazan dokument: odgovara li on sam na prepoznatljivo pitanje? Kod većine članaka prolaze dva od deset odlomaka.
  2. Dopuniti vlastitim podacima. Za svaki članak barem jedna brojka, postupak ili iskustvo s područjem primjene – iz vlastitog pogona, a ne iz nekog izvora.
  3. Kratak sažetak na vrh. Četiri potpune tvrdnje. Petnaest minuta po članku, bez promjene sadržaja.
  4. Provjeriti dohvate u trenutku upita. Pogledati u robots.txt jesu li ChatGPT-User, Perplexity-User i Claude-User dopušteni.
  5. Analizirati zapisnik poslužitelja. Dohvaćaju li se vaše stranice uopće? Bez pristupa nema navođenja – a to je druga gradilišta od podobnosti za navođenje.
Prompt
Prosudi zašto bi strojevi za odgovaranje ovu stranicu naveli
ili ne bi. Budi strog; nemoj ništa hvaliti; nemoj prepisivati tekst.

Tekst stranice:
[umetnuti tekst]

Dodatni podaci:
- Stoji li sadržaj u isporučenom HTML-u? [da / ne / nepoznato]
- Jesu li autor, uloga i datum provjere vidljivi? [da / ne]
- Koje polje naša web stranica inače zauzima? [teme]

Zadaci:
1. Provjeri šest svojstava pojedinačno – odgovor koji se da izdvojiti,
   provjerljiv vlastiti podatak, prepoznatljiva odgovornost,
   aktualnost, tehnička čitljivost, tematska bliskost
   okoline. Za svako svojstvo navedi ispunjeno/djelomično/nije
   ispunjeno uz obrazloženje na primjeru iz teksta.
2. Navedi tri odlomka koja bi se najprije navela i
   za svaki reci na koje pitanje odgovara.
3. Navedi svaku tvrdnju u tekstu koja bi mogla stajati i na svakoj
   drugoj stranici – dakle ne sadrži ništa vlastito.
4. Sastavi tri pitanja za mene čiji bi odgovori dali provjerljive
   vlastite podatke koji tekstu danas nedostaju.

Ne izmišljaj brojke ni izvore.

Zaključak

Navodi se ono što se da izdvojiti i što kaže nešto što drugdje ne piše. Oboje je pitanje rasporeda i sadržine, a ne ukupne kvalitete članka.

Za male tvrtke oslonac je nedvojbeno u drugom svojstvu: kod općeg znanja nema razloga da se navede vas. Kod vlastite brojke s imenovanim područjem primjene vi ste izvor.

Česta pitanja

Zašto AI neke stranice navodi, a druge ne?

Zato što bira odsječke, a ne stranice. Navodi se ono što se da izdvojiti i ostaje razumljivo samo za sebe, što sadrži provjerljiv podatak, gdje je prepoznatljivo tko stoji iza toga, što je aktualno i tehnički čitljivo – i što stoji u polju koje web stranica prepoznatljivo zauzima.

Koji je najjači pojedinačni čimbenik?

Provjerljiv vlastiti podatak: brojka, postupak, iskustvo s imenovanim područjem primjene. Kod općeg znanja nema razloga da se navede baš malu tvrtku – kod vlastitog podatka ona jest izvor.

Zašto se sadržajno jaka stranica katkad nikada ne navodi?

Iz tri razloga: sadržaj nastaje tek uz JavaScript i ne stoji u isporučenom HTML-u; dohvati u trenutku upita zapriječeni su u robots.txt, često kao nuspojava paušalne zapreke za sve AI botove; ili su tvrdnje raspršene po tekućem tekstu tako da nijedan odlomak sam ne odgovara na pitanje.

Navode li se češće dugi ili kratki članci?

U praksi prije kratki, oštro omeđeni. Članak od oko 900 riječi s jasnom brojkom i imenovanim područjem primjene navodi se češće od opsežnog vodiča u kojem ista brojka stoji u jedanaestom odlomku – jer se kratak članak lakše izdvaja.

Kako se provjerava vlastita podobnost za navođenje?

Testom izdvajanja: prekopirati bilo koji odlomak u prazan dokument i pročitati ga. Odgovara li on sam potpuno na prepoznatljivo pitanje? Kod većine članaka prolaze otprilike dva od deset odlomaka – taj je udio najizražajniji pokazatelj podobnosti za navođenje.

Marketing koji se sam postavlja

Beta verzija Studio Enginea je otvorena. Osigurajte mjesto i sudjelujte od početka.

Pridruži se beti →
← Natrag na pregled