Varför en AI citerar vissa sidor och bortser från andra

Mellan två sidor med samma kunskap är det inte kvaliteten som avgör vilken som citeras. Det avgörande är om det ur den ena går att lösgöra en mening som står för sig själv och går att kontrollera.

Ur ett fält av likartade svaga former fångas exakt en av ljus och träder fram

Det viktigaste

  • Det som citeras är avsnitt, inte sidor – därför avgör dispositionen mer än den samlade kvaliteten.
  • Sex egenskaper har citerade källor gemensamt: lösgörbart svar, kontrollerbar uppgift, synligt ansvar, aktualitet, teknisk läsbarhet och omgivningens ämnesnärhet.
  • Tre skäl utesluter starka sidor: innehållet uppstår först genom JavaScript, sidan är spärrad, eller påståendena står bara utspridda i löptexten.
  • Den kontrollerbara egna uppgiften är den starkaste enskilda faktorn – den är skälet till att en modell nämner er i stället för en allmän källa.

När ett system bygger ett svar väljer det inte källor efter sympati eller auktoritet, utan efter användbarhet. Frågan är alltid densamma: ger den här sidan ett textutsnitt som besvarar den ställda frågan, är begripligt för sig och går att belägga?

De sex egenskaperna

1. Lösgörbart svar

Ett avsnitt som besvarar frågan fullständigt på två till fyra meningar, utan att hänvisa till den omgivande texten. Den överlägset viktigaste egenskapen – och den enda man helt har i egen hand.

2. Kontrollerbar egen uppgift

Ett tal, ett förfarande, en tidsrymd, en erfarenhet med angivet giltighetsområde. Det är skälet till att en modell nämner er i stället för en allmän källa: ni säger något som inte står någon annanstans.

3. Synligt ansvar

Författare med roll, företag med adress, datum för den senaste kontrollen – synligt på sidan och i de strukturerade data, med samma värde. Särskilt viktigt vid ämnen som rör pengar, hälsa eller juridik.

4. Följbar aktualitet

Ett datum som stämmer, och innehåll som passar till det datumet. Ett ändringsdatum från i går på en text som beskriver ett sedan länge överspelat läge är sämre än inget alls.

5. Teknisk läsbarhet

Innehållet står i den levererade HTML-koden, inte först efter att JavaScript har körts. Ren rubrikhierarki, ingen spärr i robots.txt för hämtningar i stunden.

6. Omgivningens ämnesnärhet

En sida i ett fält som webbplatsen synbart besätter räknas snarare som en fackkälla än ett enstaka inlägg mellan tjugo obesläktade ämnen. Det är skälet till att ämnescluster verkar.

Visste du att…?

Egenskap två är den egentliga hävstången för små företag. Vid allmän kunskap konkurrerar ni med stora portaler och förlorar – där finns inget skäl att nämna just er.

Vid en kontrollerbar egen uppgift är ni källan. «I praktiken tar rensningen av en framvuxen kontaktlista en till tre dagar» är inget allmänt känt påstående – det kommer från någon som har gjort det, och just därför är det citerbart. En mening med egen erfarenhet väger mer än tre stycken sammanfattning.

Tre skäl som gör att starka sidor faller bort

SkälHur man känner igen detInsats för att åtgärda
Innehållet uppstår först i webbläsarensidkällan innehåller inte textenhög – arkitekturfråga
Hämtningar i stunden spärraderobots.txt spärrar ChatGPT-User & co.minuter
Påståenden bara utspridda i löptexteninget stycke besvarar ensamt en frågamedel – ombyggnad av styckena

Det andra skälet är det mest förargliga, eftersom det är åtgärdat på minuter och ändå förekommer ofta – oftast som bieffekt av en schablonmässig spärr av «alla AI-robotar».

Från praktiken

Ett mönster som visar sig vid utvärdering av citerade källor: det är sällan de omfångsrika översiktsinläggen. Det är korta sidor som besvarar exakt en fråga fullständigt – ofta sådana som i det egna huset räknas som en biprodukt.

Ett inlägg på 900 ord med ett tydligt tal och ett angivet giltighetsområde citeras oftare än en handbok på 2 500 ord om samma ämne, där samma tal står i stycke elva. För innehållsplaneringen betyder det: fler skarpt avgränsade enskilda frågor, färre allomfattande handböcker.

Vad man konkret kan göra

  1. Gör lösgöringstestet. Kopiera ett godtyckligt stycke till ett tomt dokument: besvarar det ensamt en igenkännbar fråga? Hos de flesta inlägg klarar två av tio stycken det.
  2. Komplettera med egna uppgifter. För varje inlägg minst ett tal, ett förfarande eller en erfarenhet med giltighetsområde – ur den egna verksamheten, inte ur en källa.
  3. Kort sammanfattning överst. Fyra fullständiga påståenden. Femton minuter per inlägg, utan ändring i innehållet.
  4. Pröva hämtningarna i stunden. Se efter i robots.txt om ChatGPT-User, Perplexity-User och Claude-User är tillåtna.
  5. Utvärdera serverloggen. Hämtas era sidor över huvud taget? Utan åtkomst ingen citering – och det är en annan byggarbetsplats än citerbarheten.
Prompt
Bedöm varför den här sidan skulle citeras av svarsmaskiner
eller inte. Var sträng; beröm ingenting; skriv inte om texten.

Sidtext:
[Infoga text]

Tilläggsuppgifter:
- Står innehållet i den levererade HTML-koden? [ja / nej / okänt]
- Är författare, roll och kontrolldatum synliga? [ja / nej]
- Vilket fält besätter vår webbplats i övrigt? [Ämnen]

Uppgifter:
1. Pröva de sex egenskaperna var för sig – lösgörbart svar,
   kontrollerbar egen uppgift, synligt ansvar,
   aktualitet, teknisk läsbarhet, omgivningens
   ämnesnärhet. Ange per egenskap uppfylld/delvis/inte uppfylld
   med motivering utifrån textexemplet.
2. Nämn de tre stycken som helst skulle citeras, och
   säg för vart och ett vilken fråga det besvarar.
3. Nämn varje påstående i texten som lika gärna kunde stå på
   vilken annan sida som helst – alltså inte innehåller något eget.
4. Formulera tre frågor till mig vars svar skulle ge kontrollerbara
   egna uppgifter som texten saknar i dag.

Hitta inte på tal och inga källor.

Slutsats

Det som citeras är det som går att lösgöra och som säger något som inte står någon annanstans. Båda delarna är en fråga om disposition och substans, inte om ett inläggs samlade kvalitet.

För små företag ligger hävstången entydigt vid egenskap två: vid allmän kunskap finns inget skäl att nämna er. Vid ett eget tal med angivet giltighetsområde är ni källan.

Vanliga frågor

Varför citerar en AI vissa sidor och andra inte?

För att den väljer avsnitt, inte sidor. Det som citeras är det som går att lösgöra och förblir begripligt för sig, som innehåller en kontrollerbar uppgift, där det syns vem som står bakom, som är aktuellt och tekniskt läsbart – och som står i ett fält som webbplatsen synbart besätter.

Vad är den starkaste enskilda faktorn?

En kontrollerbar egen uppgift: ett tal, ett förfarande, en erfarenhet med angivet giltighetsområde. Vid allmän kunskap finns inget skäl att nämna just ett litet företag – vid en egen uppgift är det källan.

Varför blir en innehållsligt stark sida ibland aldrig citerad?

Av tre skäl: innehållet uppstår först genom JavaScript och står inte i den levererade HTML-koden; hämtningarna i stunden är spärrade i robots.txt, ofta som bieffekt av en schablonmässig spärr av alla AI-robotar; eller påståendena är utspridda över löptexten, så att inget stycke ensamt besvarar en fråga.

Citeras långa eller korta inlägg oftare?

I praktiken snarare korta, skarpt avgränsade. Ett inlägg på runt 900 ord med ett tydligt tal och angivet giltighetsområde citeras oftare än en omfångsrik handbok där samma tal står i stycke elva – eftersom det korta inlägget är lättare att lösgöra.

Hur prövar man sin egen citerbarhet?

Med lösgöringstestet: kopiera ett godtyckligt stycke till ett tomt dokument och läs. Besvarar det ensamt en igenkännbar fråga fullständigt? Hos de flesta inlägg klarar ungefär två av tio stycken det – den andelen är det mest talande nyckeltalet för citerbarhet.

Marknadsföring som sätter upp sig själv

Betan för Studio Engine är öppen. Säkra din plats och var med och forma den från början.

Delta i betan →
← Tillbaka till översikten