duplicate content

Duplicate Content: Sådan undgår du den skjulte SEO-fælde, der kvæler dine placeringer

Vi har alle prøvet det. Du har brugt timer på at skrive produktbeskrivelser, kategoritekster eller landingssider, og alligevel stagnerer dine placeringer på Google. Trafikken vil ikke rigtig rykke sig, selvom indholdet er solidt og teknisk sæt fornuftigt opbygget. Én af de hyppigste, men mest oversete, syndere i de tilfælde er duplicate content. Og det kedelige ved det er, at du måske ikke engang ved, at problemet eksisterer på dit website.

I dette indlæg får du en grundig gennemgang af, hvad duplicate content reelt er, hvorfor det skader dine SEO-resultater, og ikke mindst hvad du konkret kan gøre for at rydde op og komme videre. Ingen teoretisk snak, kun det der rent faktisk virker.

Hvad er duplicate content egentlig?

Duplicate content handler om indhold, der optræder på flere forskellige URL’er, enten på dit eget site eller på tværs af forskellige domæner. Google er ikke særligt glad for det, fordi søgemaskinen er nødt til at beslutte, hvilken version af indholdet der skal vises i søgeresultaterne. Og den beslutning tager Google selv, hvis du ikke guider den i den rigtige retning.

Der er to overordnede typer, du skal kende til:

  • Internt duplicate content: Det samme indhold vises på flere URL’er inden for dit eget domæne. Det sker oftere end du tror, og som regel utilsigtet.
  • Eksternt duplicate content: Dit indhold dukker op på andre domæner, enten fordi nogen har kopieret det, eller fordi du selv har genbrugt det på tværs af sites.

Det interne duplicate content er typisk det, der er nemmest at gøre noget ved, og det er også der, du finder de største gevinster i praksis.

Typiske årsager til internt duplicate content

Kender du også det, når man opdager, at ens webshop har hundredvis af næsten identiske URL’er, fordi filterfunktionen genererer en ny URL for hver eneste kombination af farve, størrelse og sortering? Det er klassisk. Her er de mest almindelige årsager:

  • URL-parametre: Filtrering, sortering og sporingsparametre som ?sort=pris&color=rød skaber nye URL’er med identisk indhold.
  • HTTP vs. HTTPS og www vs. non-www: Hvis begge versioner er tilgængelige og ikke redirectes korrekt, har du straks duplikerede sider.
  • Sideinddeling (pagination): Side 1, side 2 og side 3 af en kategori kan opfattes som delvist duplikeret, hvis indholdet ikke adskiller sig tydeligt nok.
  • Printer-venlige versioner: Mange ældre CMS-systemer genererer automatisk en separat printervenlig version af hver side.
  • Session-ID’er i URL’er: Gamle e-handelsplatforme tilføjer stadig session-ID’er til URL’er, hvilket skaber enorme mængder unikke URL’er med identisk indhold.
  • Produktvarianter: Produkter der sælges i forskellige størrelser eller farver, men som deler den samme beskrivelse og lander på tæt beslægtede URL’er.

Hvorfor Google hader det (og hvad der reelt sker)

Det er vigtigt at slå fast: Google straffer som udgangspunkt ikke duplicate content med en manuel penalisering. Det er en udbredt misforståelse. Det, der faktisk sker, er mere subtilt og på mange måder mere skadeligt på lang sigt.

Når Googlebot crawles dit site og støder på det samme indhold på fem forskellige URL’er, opstår der det, man kalder crawl budget-spild. Google bruger kun en begrænset mængde ressourcer på at crawle dit site. Hvis botten bruger tid på at gennemgå hundredvis af duplikerede eller tynde URL’er, er der færre ressourcer tilbage til at crawle og indeksere dit vigtige indhold. Det er særligt kritisk for store sites med mange sider.

Derudover sker der en link equity-fortynding. Hvis tre URL’er med identisk indhold hver modtager eksterne links, fordeles den samlede linkværdi på tre sider i stedet for at samles ét sted. Du mister altså konkurrencekraft på de placeringer, der reelt betyder noget for din forretning.

Og så er der det mest håndgribelige problem: Google vælger selv, hvilken URL der vises. Og den vælger ikke nødvendigvis den, du ville have valgt.

Sådan finder du duplicate content på dit site

Før du kan løse problemet, skal du kortlægge det. Her er de værktøjer og metoder, der giver dig det mest præcise billede:

Screaming Frog SEO Spider

Kør en fuld crawl af dit site og filtrer på duplikerede sidetitler, meta-beskrivelser og H1-tags. Det giver dig hurtigt et overblik over de mest oplagte problemer. Gå derefter ind under “Exact Duplicates” og “Near Duplicates” for at se, hvilke sider der deler identisk eller næsten identisk indhold.

Google Search Console

Under “Sider” i Index-sektionen kan du se sider, Google har valgt ikke at indeksere. Kig særligt efter statussen “Duplikat, Google valgte en anden kanonisk side end brugeren.” Det er et direkte signal om, at du har et kanonisk rod, som du skal have styr på.

Siteliner og Copyscape

Siteliner er gratis og god til at identificere internt duplikeret indhold med en procentvis overlap-score. Copyscape er din bedste ven, når det gælder om at finde eksternt indhold, der er kopieret fra dig eller omvendt.

De tre mest effektive løsninger

Nu til det, du er her for. Her er de løsninger, der rent faktisk løser problemet, rangeret efter hyppighed og effekt.

1. Canonical tags (rel=”canonical”)

Canonical-tagget er din primære løsning på næsten alle former for internt duplicate content. Du placerer et rel=”canonical” tag i head-sektionen på de duplikerede sider og peger det mod den foretrukne, kanoniske version. Det fortæller Google utvetydigt, hvilken side der er “originalen”, og at al linkværdi skal konsolideres der.

Typisk eksempel: Alle dine filterbaserede URL’er som /sko?farve=sort&størrelse=42 bør have et canonical-tag, der peger tilbage på den rene kategoriside /sko/. Husk at self-canonicals på alle sider er god praksis, uanset om du tror, der er et problem eller ej.

2. 301 Redirects

Hvis du har URL’er, der simpelthen ikke bør eksistere selvstændigt, er en permanent 301-redirect den rene løsning. Det gælder særligt HTTP til HTTPS, www til non-www og forældede URL-strukturer. En 301-redirect sender brugeren og den fulde linkværdi videre til den korrekte side. Det er den stærkeste signal, du kan sende til Google om, at en side er erstattet.

3. Noindex-tagget

For sider, der skal være tilgængelige for brugerne, men som du ikke ønsker indekseret af Google, er meta name=”robots” content=”noindex” din løsning. Det er relevant for interne søgeresultatssider, printervenlige versioner og visse paginerede sider. Vær dog præcis her: noindex fjerner siden fra indekset, men den kan stadig crawles og bruge af dit crawl budget.

Håndtering af URL-parametre i Google Search Console

Selvom dette værktøj efterhånden er nedprioriteret af Google, kan du i den gamle Search Console angive, hvordan specifikke URL-parametre skal håndteres. Det er dog bedst kombineret med et korrekt canonical-setup frem for at stå alene.

Duplicate content på tværs af domæner: Hvad gør du?

Vi har alle prøvet at se vores eget indhold dukke op på et fremmed site. Hvad enten det er en konkurrent, der har kopieret dine produktbeskrivelser, eller et affiliatenetværk, der genbruger dit indhold uden at modificere det, er der konkrete handlinger at tage.

  • Publicér tidligt og konsekvent: Google vurderer, hvem der publicerede indholdet først. Brug XML-sitemaps og ping Google ved ny publicering for at sikre hurtig indeksering af dit originale indhold.
  • Bed om fjernelse: Kontakt domænets ejer og anmod om fjernelse. Mange reagerer faktisk på en venlig henvendelse.
  • Send en DMCA-klage: Hvis den pågældende ikke reagerer, kan du indgive en DMCA-anmeldelse til Google, som kan resultere i fjernelse fra søgeresultaterne.
  • Vurder syndikering med omtanke: Hvis du selv syndikererer dit indhold til medier eller partnere, bør du altid kræve, at de bruger et canonical-tag, der peger tilbage på dit originale indhold.

Kører du en større e-handelsløsning med leverandørernes standardbeskrivelser på dine produkter? Så deler du med stor sandsynlighed indhold med alle andre forhandlere af de samme produkter. Den eneste virkelige løsning her er at skrive unikke beskrivelser, men det ved du godt. Start med dine topsælgere og arbejd dig ned ad listen.

Kom i gang i dag, ikke næste kvartal

Duplicate content er en af de der SEO-udfordringer, der er nemme at udskyde, fordi konsekvenserne ikke er synlige fra den ene dag til den anden. Men over tid t

Skriv en kommentar

Din e-mailadresse vil ikke blive publiceret. Krævede felter er markeret med *

Scroll to Top