Duplicate Content

Duplicate Content? Kein Problem. In diesem Beitrag erklären wir, was Duplicate Content eigentlich ist, warum er vermieden werden sollte und welche Tools dafür zur Verfügung stehen.

Was versteht man unter Duplicate Content?

Duplicate Content ist gleicher oder nahezu gleicher Inhalt auf unterschiedlichen Seiten. Dabei wird zwischen externem und internem DC unterschieden. Externer Duplicate Content liegt vor, wenn es sich um mehrere Domains handelt, interner DC, wenn die Inhalte innerhalb einer Domain dupliziert werden. Doch nicht jeder Duplicate Content entsteht aus Absicht. Deshalb unterscheidet Google zwischen böswillig und nicht böswillig dupliziertem Inhalt. Absichtlich erstellter Duplicate Content entsteht, um schnell Klicks und Traffic zu generieren, ohne die nötige Arbeit in den Text zu stecken. Oft wird einfach bei der Konkurrenz geklaut. Nicht böswillig duplizierter Inhalt kommt dagegen häufig vor, ohne dass der Betreiber der Website es überhaupt merkt. Zum Beispiel nämlich dann, wenn es verschiedene Versionen einer Website gibt (Desktopversion, mobile Version, Druckversion).

Erkennt die Suchmaschine Duplicate Content als betrügerische Maßnahme, kann das für das Ranking der jeweiligen Website ernsthafte Konsequenzen haben. Denn Google selbst kommuniziert in einem Artikel zur Vermeidung von Duplicate Content klar, dass die Suchmaschine DC nicht duldet, wenn dieser erstellt wurde, um Suchergebnisse zu manipulieren. In schlimmen Fällen von duplizierten Inhalten kann es dazu kommen, dass die betroffenen Seiten Ranking einbüßen. Der Grund: Nutzerfreundlichkeit. Wenn der gleiche Inhalt auf verschiedenen Seiten zu sehen ist und diese bei der jeweiligen Suchanfrage nacheinander aufgelistet werden, sieht der User immer nur den gleichen Content, ohne einen Mehrwert an Informationen zu erhalten.

Wie lässt sich Duplicate Content vermeiden?

Um Duplicate Content zu vermeiden, ist es wichtig, sich darüber bewusst zu werden, wo DC überall vorkommen kann. Duplizierter Content wird häufig generiert durch:

  1. automatisch erzeugte Websites
  2. identische Internetseiten, die über verschiedene URLs zugänglich sind
  3. verschiedene Versionen einer Seite wie bsp. die Druckversion
  4. sich kaum voneinander unterscheidende Unterseiten zu einem Thema oder einem Produkt, z. B. Produktdetailseiten

Unique Content generieren

Damit Duplicate Content gar nicht erst entsteht, benötigt man möglichst viel "Unique Content", der nur auf der jeweiligen Website zu finden ist. Das bedeutet nicht, dass man nicht die gleichen Informationen wie andere Seiten haben darf, sondern lediglich, dass man übernommenes Wissen als solches kennzeichnet und dieses so umschreibt, dass es in dieser Form nur auf der eigenen Website zu finden ist.

Duplizierte URLs vermeiden

Die oberste Regel, um DC zu vermeiden, lautet: Jede Landing Page ist nur durch eine unique URL (die perfekte SEO-URL) erreichbar. Bei unterschiedlichen URLs, die alle zu einer Seite führen oder auch bei mehreren Versionen einer Website sucht sich Google nämlich eine URL als kanonisch aus, welche dann die Haupt-URL ist. Diese wird von der Suchmaschine dann gecrawlt, wohingegen die anderen URLs kaum noch relevant sind. Deshalb sollte man lieber von Anfang an selbst festlegen, welche URL kanonisch sein soll.

Nützliche Maßnahmen gegen Duplicate Content

Außerdem ist es wichtig,

  1. auf Einheitlichkeit zu achten, indem man nicht auf interne Linkvariationen zurückgreift, sondern immer die gleichen Links nutzt.
  2. Top-Level-Domains für landesspezifischen Content zu gebrauchen; bsp. ".de" statt ".com" für Deutschland.
  3. möglichst keine "Platzhalter" zu veröffentlichen, also Seiten, die noch keinen richtigen Content haben.
  4. ähnliche Inhalte und sich wiederholende Textbausteine ganz zu vermeiden oder zu reduzieren: Bei vielen Seiten mit ähnlichen Inhalten empfiehlt es sich, diese entweder zu einer einzelnen Seite zusammenzuführen oder so weit auszubauen, dass die Unterschiede deutlich werden und sich der Content nicht mehr überschneidet.
  5. bei gleichem Inhalt auf verschiedenen Websites die Originalseite festzulegen und mit der 301-Weiterleitung darauf zu leiten. Hier hilft ein Blick in die Google Search Console, um die Seite festzulegen, die Google als relevanter ansieht.

Content auf Duplikate überprüfen

Auf Nummer sicher gehen und den eigenen Content überprüfen? Das geht ganz einfach mit verschiedenen Tools:

Mit der "Google Search Console" kann man schnell & unkompliziert Duplicate Content ausfindig machen. Dafür geht man einfach auf den Reiter "Index", dann auf "Abdeckungen" und wählt im Diagramm den Filter "Ausgeschlossen". Innerhalb der Tabelle kann man sich dann etwaige Duplikate anzeigen lassen, ebenso wie die dazugehörigen URLs. Ist hier eine URL aufgelistet, die eigentlich für ein bestimmtes Keyword-Set ranken soll? Dann lohnt sich die Überprüfung der als Original angenommenen Landing Page.

Dieses Bild hat ein leeres Alt-Attribut. Der Dateiname ist googlesearchSEOBLOG1-1024x464.png
Google Search Console
Dieses Bild hat ein leeres Alt-Attribut. Der Dateiname ist googlesearhseoblog3.png
Google Search Console

Eine weitere Möglichkeit zur Content-Überprüfung ist das Tool "Siteliner". Die Anwendung überprüft die gesamte Domain und gibt einen Report zu möglichem Duplicate Content aus. Die kritischen Seiten können dann einzeln angesehen und überprüft werden. Das Tool färbt kritische Textteile ein und zeigt die URLs, die denselben Inhalt tragen - sowohl auf der eigenen wie auch auf fremden Domains.

Dieses Bild hat ein leeres Alt-Attribut. Der Dateiname ist siteliner.png
Siteliner

Alternativ dazu kann man Inhalte auch manuell prüfen, indem man einzelne Phrasen und Textbausteine googelt. Optimalerweise erscheint dann nur die eigene Seite. Wenn der jeweilige Textbaustein noch auf anderen Seiten zu finden ist, sollten diese genau unter die Lupe genommen werden:

Dieses Bild hat ein leeres Alt-Attribut. Der Dateiname ist ManuellerDup.png
Manuelle Überprüfung

Darüber hinaus gibt es zur Überprüfung von Duplicate Content noch zahlreiche weitere Tools, die teilweise kostenpflichtig sind.

Schutz vor DC durch andere Websites

Duplicate Content entsteht aber nicht nur durch eigenes Verschulden. Andere Domains bedienen sich häufig an guten Inhalten, indem sie diese einfach kopieren. Manchmal ranken dann die Websites, die den Inhalt von anderen geklaut haben, sogar höher als die originalen. Um seinen Unique Content auch als solchen zu erhalten, sollte man seine Inhalte also regelmäßig überprüfen oder den Alarm mancher Tools nutzen, der einen bei gleichem oder stark ähnelndem Content benachrichtigt. Des Weiteren ist es wichtig, von Anfang an kanonische URLs zu setzen und somit die eigene Seite als Original festzulegen.

Fazit zu Duplicate Content

Was auf den ersten Blick nach viel Aufwand aussieht, ist eigentlich gar nicht so kompliziert. Wir halten fest:

Duplicate Content kann das Ranking der eigenen Seite negativ beeinflussen. Setzt man sich jedoch früh mit dem Thema DC auseinander, kann man sich vor fremden Übergriffen schützen und die eigene Seite unique halten. Wir empfehlen die regelmäßige Prüfung auf duplizierte Inhalte sowie den sinnvollen Einsatz von kanonischen URLs.

Bei weiteren Fragen zu Duplicate Content sowie zu anderen Themen aus den Bereichen Suchmaschinenoptimierung oder SEO-Content steht das seowerk-Team gerne mit einer persönlichen Beratung zur Verfügung.

  |    |  
Google AI Overviews zeigen Quellen nicht mehr nur in separaten Quellenkarten an. Laut Peec AI enthielten am 20. September über alle erfassten Märkte hinweg 26,19 Prozent der Antworten externe Links direkt im Text. In Deutschland lag der Anteil mit 14,5 Prozent deutlich niedriger.
Weiterlesen
  |    |  
Wer in der klassischen Google-Suche gut rankt, hat auch in den AI Overviews bessere Karten. Zu diesem Schluss kommt eine Umfrage unter 131 Suchmaschinenexperten, die untersucht, welche Faktoren die Sichtbarkeit in Googles KI-Antworten beeinflussen. Die Ergebnisse zeigen deutliche Parallelen zwischen klassischer Suchmaschinenoptimierung (SEO) und der Sichtbarkeit in KI-Ergebnissen (GEO).
Weiterlesen
  |    |  
Google verändert seine Suchergebnisse in der EU, um den Anforderungen der EU-Kartellbehörden gerecht zu werden. Das Unternehmen selbst warnt vor den Folgen: Die Nutzererfahrung werde sich verschlechtern, und Unternehmen müssten mit höheren Kosten rechnen. Nach eigener Aussage handelt es sich dabei um den größten Qualitätsverlust in der 29-jährigen Geschichte der Google-Suche.
Weiterlesen
  |    |  
OpenAI betreibt einen eigenen Suchindex. Eine aktuelle Analyse von RESONEO zeigt, dass der interne Index mit dem Codenamen labrador bereits den Großteil der Suchergebnisse in der kostenlosen Version von ChatGPT liefert. In den Bezahlversionen stützt sich das Unternehmen zwar nach wie vor stark auf gescrapte Google-Ergebnisse, doch die Gewichte verschieben sich. Für Website-Betreiber ändern sich damit die Regeln für Sichtbarkeit.
Weiterlesen
  |    |  
Ein einzelner Modellwechsel verändert, welche Inhalte in KI-Antworten auftauchen. Nach dem Rollout von GPT-5.6 sank der Anteil von Listicles in den ChatGPT-Citations um die Hälfte, der Anteil von Vergleichsseiten um knapp ein Drittel. Gleichzeitig zitiert das Modell Marken häufiger direkt von deren eigenen Websites.
Weiterlesen
  |    |  
Google verändert den Aufbau der AI Overviews. Bei einzelnen Suchanfragen entfällt der gewohnte „Mehr anzeigen“-Button, stattdessen erscheint die vollständige KI-Antwort mit einem Eingabefeld für den AI Mode. Google hat das Vorgehen bestätigt und erklärt, dass es bei bestimmten Suchanfragen sinnvoller sei als das bisherige Setup. Die organischen Suchergebnisse rutschen dadurch weiter nach unten.
Weiterlesen
  |    |  
Die Google Search Console schließt eine Lücke, die viele Content-Ersteller lange beschäftigt hat: Wie schneiden Beiträge auf Plattformen wie Instagram, TikTok, X oder YouTube eigentlich in der Google-Suche ab? Mit dem neuen Property-Typ Platform Properties lässt sich das ab sofort direkt in der Search Console nachvollziehen. Wer bislang auf plattforminterne Statistiken angewiesen war, erhält damit erstmals eine Sicht auf die Suchperformance seiner Social- und Videoinhalte.
Weiterlesen
  |    |  
ChatGPT griff lange Zeit vor allem auf Google zurück, um seine Antworten mit aktuellen Informationen anzureichern. Ein neues Datenfeld in der Kommunikation zwischen ChatGPT und dem Browser deutet nun darauf hin, dass sich das ändert. Das Feld heißt „result_source“ und weist dort in bestimmten Fällen den Wert „bing“ auf, ein Verweis auf die Suchmaschine von Microsoft als Quelle. Wer die Entwicklertools im Browser öffnet, kann diesen Hinweis selbst nachvollziehen.
Weiterlesen
  |    |  
Was in der klassischen Google-Suche längst etabliert ist, setzt sich nun auch bei KI-Antworten durch: die Bewertung von Quellen nach Vertrauenswürdigkeit. Perplexity führt dafür vier Vertrauensstufen ein, die von keiner Auszeichnung bis zur Bestnote „Authoritative“ reichen. Fachspezifische Blogs und Nischen-Websites können sich als „Trusted“ qualifizieren, während anerkannte Autoritäten wie Google-Inhalte die höchste Stufe erreichen. Die Einordnung zeigt, dass EEAT-Signale auch für generative KI-Suchsysteme zunehmend an Bedeutung gewinnen.
Weiterlesen
  |    |  
Die Anforderungen an die Suchmaschinenoptimierung (SEO) für Blogs und Content-Plattformen haben sich mit der Verbreitung KI-basierter Suchfunktionen (wie Google AI Overviews und AI Mode) grundlegend verändert. Die rein mechanischen SEO-Taktiken der Vergangenheit, wie das sture Anstreben einer hohen Wortzahl, das Anhäufen von Schlüsselwörtern oder die künstliche Aktualisierung von Daten („Fake Freshness“), verlieren zunehmend an Wirksamkeit.
Weiterlesen
  |    |  
Im Rahmen der Veröffentlichung der Quartalsergebnisse (Q2 2026) gab Alphabet bekannt, dass die Werbefunktion AI Max für Suchkampagnen offiziell die Beta-Phase verlassen hat. Laut Philipp Schindler, Senior Vice President und Chief Commercial Officer bei Google, nutzen bereits über 500.000 Werbetreibende diese Technologie. Das System ermöglicht es Google, Anzeigen für äußerst komplexe und lange Suchanfragen zu schalten, die bisher durch die herkömmliche Ausrichtung auf Suchbegriffe nicht effizient abgedeckt werden konnten.
Weiterlesen
  |    |  
Große Sprachmodelle (LLMs) wie ChatGPT, Gemini oder Perplexity stützen sich bei der Generierung von Antworten auf ein strukturiertes Verständnis von Entitäten. Daher reicht es im Zeitalter der KI für Unternehmen nicht mehr aus, sich nur anhand von Schlüsselwörtern zu positionieren – was wirklich zählt, ist, wie genau KI-Systeme die eigene Marke, die Produkte und die Kernkompetenzen als eigenständige Entität erfassen und klassifizieren.
Weiterlesen
Kontakt
Leichte Sprache
crossmenu linkedin facebook pinterest youtube rss twitter instagram facebook-blank rss-blank linkedin-blank pinterest youtube twitter instagram