Duplicate content

:
ons maj 14, 2008 8:07
af Jan
Så lærte jeg et nyt ord i dag. Jeg hørte om det her:
http://www.blog.concept-i.dk/
Desværre har jeg fået rodet mig ud i det. Jeg har åbenbart to sider med identisk indhold, rent fysisk har jeg kun en. Det drejer sig om janns.dk/ og janss.dk/indeks.html. Hvordan har jeg fået rodet mig ud i det, og hvad gør jeg for at rette det?

:
ons maj 14, 2008 8:36
af Jan
Jeg har fundet ud af det. Fjolset, altså mig, havde linket internt til index.html, på linkene til Forside.
Derfor har Google opfattet det som om jeg havde de to sider. Det er rettet nu, så er spørgmålet bare hvordan jeg får det slettet i Google.

:
ons maj 14, 2008 14:54
af Kim Ludvigsen
Jeg vil tro, at Google automatisk fjerner det ene link igen på et eller andet tidspunkt - medmindre andre laver et link direkte til filnavnet.
De to sider er for øvrigt ikke en fejl, det er en funktion. Når du angiver et domæne uden at angive et filnavn, så leder webserveren automatisk efter nogle bestemte filnavne [1]. Dermed behøver den besøgende ikke at skulle indtaste filnavnet til en hjemmesides forside. Den rigtige adresse er altså den med index.html. Den anden virker kun pga. funktionen i webserveren.
[1] Min webserver leder fx først efter filen index.html. Findes den ikke, leder serveren efter index.htm og derefter efter index.php.