Noindex in WordPress richtig einsetzen: So sorgen Sie dafür, dass Google und KI-Systeme Ihre Seiten sehen

TL;DR noindex ist ein Suchmaschinen-Signal, kein KI-Signal. Wirkungskette: robots.txt (Crawl) → noindex (Index) → nosnippet/max-snippet (Darstellung und KI-Input). Häufigster Fehler: Disallow und noindex gleichzeitig. Dann wird das noindex nie gelesen. Der WordPress-Core-Haken (blog_public = 0) setzt noindex, nofollow und Disallow: /. Das ist der Holzhammer. KI-Crawler wie GPTBot, ClaudeBot und PerplexityBot steuern Sie über robots.txt. User-Fetcher ignorieren sie teils. Verifikation läuft über Search Console, URL-Prüfung und Logfiles mit Bot-Trennung. Semly prüft robots.txt, llms.txt und schema.org und misst, ob Ihre Marke in KI-Antworten auftaucht.

Noindex in WordPress richtig einsetzen: Was das Signal tut – und was nicht

noindex sagt einer Suchmaschine: Nimm diese Seite nicht in den Index auf. Mehr nicht. Es ist kein Verstecken-Knopf und kein Schutz vor KI-Systemen.

Wichtig ist die Reihenfolge. Erst muss ein Bot die Seite crawlen dürfen. Dann liest er das noindex. Erst danach entscheidet er über Index und Darstellung. Blockieren Sie den Crawl, kommt das noindex nie an.

Und KI? ChatGPT, Gemini und Co. nutzen andere Wege. Trainings- und Such-Bots von OpenAI, Anthropic und Perplexity richten sich nach der robots.txt. Ein noindex im HTML interessiert sie in der Regel nicht. Bei Google ist es anders: AI Overviews und der AI Mode zitieren nur Seiten, die indexiert und snippet-fähig sind. Ein noindex schließt Sie dort also aus.

Direktive Wirkung Zielsystem
noindex Seite kommt nicht in den Index Suchmaschinen
nofollow Links auf der Seite werden nicht verfolgt Suchmaschinen
nosnippet / max-snippet Kein Textauszug, kein KI-Input Google, AI Overviews
Disallow (robots.txt) Bot darf nicht crawlen Alle Bots, die robots.txt beachten
X-Robots-Tag Wie noindex, aber per HTTP-Header Suchmaschinen

Kurz gesagt: noindex steuert den Index. robots.txt steuert den Zugang. Snippets steuern, was als Text sichtbar wird.

Vorbereitung: Was Sie vor dem ersten Klick brauchen

Wer blind Haken setzt, sperrt schnell die ganze Seite aus. Legen Sie vorher fest, was Sie überhaupt ausschließen wollen.

Typische Kandidaten für noindex: Wartungsseiten, Danke- und Bestätigungsseiten, Checkout- und Warenkorbseiten, interne Suchergebnisse, dünne Tag- und Archivseiten, Mediathek-Anhänge.

Checkliste "Vorher bereitstellen":

  • Zugang zum WordPress-Admin
  • FTP- oder Serverzugang für den X-Robots-Tag
  • Zugang zur Google Search Console
  • Zugriff auf Server-Logfiles
  • Eine Liste der Seiten, die NICHT indexiert werden sollen
  • Eine Liste der Schlüsselseiten, die auf jeden Fall sichtbar bleiben müssen

Ohne diese Liste prüfen Sie später ins Leere. Sie wissen dann nicht, ob ein Ergebnis gewollt oder ein Fehler ist.

Schritt 1: Core-Haken prüfen (Einstellungen → Lesen)

Gehen Sie zuerst auf Einstellungen → Lesen. Dort steht der Haken "Suchmaschinen davon abhalten, diese Website zu indexieren".

Ist er aktiv, setzt WordPress blog_public = 0. Das bedeutet: noindex und nofollow im Head plus Disallow: / in der robots.txt. Die ganze Seite ist raus.

Das Symptom ist eindeutig. In einer dokumentierten Fallstudie fiel eine Website von 135 Keywords auf 2 und von 13 rankenden URLs auf 1. Der Absturz zog sich über rund zwölf Wochen. Die Erholung dauerte Wochen, nicht Tage.

Prüfpfad: Einstellungen → Lesen → Haken bei "Suchmaschinen davon abhalten..." muss leer sein. Danach im Quelltext der Startseite nach <meta name="robots" suchen. Dort darf kein noindex stehen.

Schritt 2: Plugin-Ebene prüfen (Yoast, Rank Math, SEOPress)

Der Core-Haken kann sauber sein, während ein SEO-Plugin pro Beitragstyp, pro Archiv oder pro Mediathek-Anhang noindex setzt. Prüfen Sie beide Ebenen.

  • Yoast: Beitrag bearbeiten → Yoast-Bereich → Erweitert → "Suchmaschinen sollen diese Seite anzeigen?" auf Nein. Global unter Yoast → Einstellungen → Inhaltstypen.
  • Rank Math: Beitrag bearbeiten → Rank Math → Erweitert → Robots Meta → noindex. Global unter Rank Math → Titel & Meta.
  • SEOPress: Beitrag bearbeiten → SEO → Erweitert → "Noindex this page". Global unter SEOPress → Titel & Metas.

Konflikte entstehen, wenn Theme, Plugin und Core unterschiedliche Tags setzen. Google sagt dazu nur: "the more restrictive rule applies". Die strengere Regel gewinnt.

Ebene Setzt Gewinnt bei Konflikt
Semly (Messung) Kein Tag, nur Prüfung und Monitoring Nicht zutreffend
Core (blog_public) noindex, nofollow, Disallow: / Ja, sehr restriktiv
SEO-Plugin noindex pro Seite/Typ Ja, wenn restriktiver
Theme-Header Eigenes Meta-Tag Ja, wenn restriktiver

Semly setzt hier bewusst kein Tag. Die Plattform prüft, was tatsächlich ausgeliefert wird, und misst, ob Ihre Seiten in KI-Antworten auftauchen.

Schritt 3: robots.txt und noindex richtig kombinieren

Das ist der häufigste Fehler. Disallow und noindex zusammen klingen logisch, sind aber ein Widerspruch.

Wenn die robots.txt den Crawl verbietet, sieht der Bot die Seite nie. Er liest also auch das noindex nie. Die Seite bleibt im Index, oft mit einem alten Snippet. Genau das Gegenteil von dem, was Sie wollten.

Merken Sie sich: robots.txt blockiert den Crawl, nicht den Index. Backlinks von anderen Seiten können eine disallowierte URL trotzdem in den Index bringen.

Do:

  • noindex im HTML oder als X-Robots-Tag setzen, wenn eine Seite aus dem Index soll.
  • robots.txt nutzen, um Crawl-Budget zu lenken oder Bots ganz auszusperren.
  • Beide Signale nur dann kombinieren, wenn Sie die Seite wirklich komplett ausschließen wollen.

Don't:

  • Disallow und noindex gleichzeitig setzen, wenn Sie nur deindexieren wollen.
  • robots.txt als Ersatz für noindex verwenden.
  • noindex auf Seiten setzen, die Sie in KI-Antworten sehen wollen.

Schritt 4: KI-Crawler steuern (GPTBot, ClaudeBot, PerplexityBot)

KI-Anbieter trennen ihre Bots nach Zweck. Das ist der Schlüssel für saubere Steuerung.

Bot Zweck Steuerung
GPTBot (OpenAI) Training robots.txt
OAI-SearchBot (OpenAI) Suche in ChatGPT robots.txt
ChatGPT-User Nutzer ruft Seite live ab robots.txt greift teils nicht
ClaudeBot (Anthropic) Training robots.txt
Claude-SearchBot Suche robots.txt
Claude-User Nutzerabruf robots.txt
PerplexityBot Suche robots.txt
Perplexity-User Nutzerabruf ignoriert robots.txt oft

Änderungen in der robots.txt greifen bei OpenAI und Perplexity meist innerhalb von rund 24 Stunden. Anthropic sagt, alle drei Claude-Bots beachten die robots.txt.

Aber Vorsicht: User-Fetcher halten sich nicht immer daran. Cloudflare hat dokumentiert, dass Perplexity nicht deklarierte Crawler einsetzt, die sich als Browser ausgeben und wechselnde IP-Adressen nutzen. Wenn Sie wirklich kontrollieren wollen, geht das nur auf Server-Ebene über WAF oder CDN.

Für Google gilt: noindex schließt die Zitierung in AI Overviews und im AI Mode aus. Wollen Sie dort sichtbar sein, lassen Sie die Seite indexiert und erlauben Snippets.

Schritt 5: Verifizieren mit Search Console, URL-Prüfung und Logfiles

Prüfen statt vermuten. So belegen Sie die Wirkung.

Verifikations-Checkliste:

  • Search Console → Seiten → "Durch noindex-Tag ausgeschlossen" prüfen
  • URL-Prüfung für einzelne Seiten starten und den gerenderten HTML-Code ansehen
  • Logfiles auswerten und Bots trennen: Googlebot, GPTBot, ClaudeBot, PerplexityBot
  • Nach robots.txt-Änderungen 30 bis 90 Tage beobachten
  • Sitemap mit den indexierbaren Seiten abgleichen

Google braucht je nach Wichtigkeit der Seite Tage bis Monate, um eine Seite erneut zu besuchen. Rechnen Sie also nicht mit sofortigen Ergebnissen.

Schritt 6: Noindex entfernen und Seiten reindexieren

Der Rückweg ist wichtig, falls Sie zu viel gesperrt haben.

Reihenfolge:

  1. noindex-Tag oder Haken entfernen.
  2. Cache und gegebenenfalls CDN leeren.
  3. Sitemap neu einreichen.
  4. URL-Prüfung für Schlüsselseiten starten und Indexierung anfordern.
  5. In der Search Console beobachten, bis die Seiten wieder auftauchen.

Zeitrahmen: Reindexierung dauert länger als Deindexierung. Schlüsselseiten kommen oft in Tagen zurück, die Breite braucht Wochen.

Das URL-Entfernungstool ist kein Ersatz für noindex. Es blendet eine URL nur vorübergehend aus, meist für rund sechs Monate. Danach kann sie wieder auftauchen.

Häufigste Fehler und wie Sie sie beheben

  • Disallow plus noindex: noindex wird nie gelesen. Fix: Disallow entfernen, nur noindex setzen.
  • Core-Haken übersehen: ganze Seite ist raus. Fix: Einstellungen → Lesen prüfen.
  • canonical plus noindex: widersprüchlich. Canonical sagt "indexiere die andere URL", noindex sagt "indexiere diese nicht". Fix: eines von beiden wählen.
  • Plugin-Tag gegen Theme-Header: zwei Signale, strengere Regel gewinnt. Fix: eine Quelle festlegen und die andere entfernen.
  • Kein Monitoring: niemand merkt den Fehler. Fix: Search Console und Logfiles regelmäßig prüfen.

Was danach kommt: Monitoring und AI-Sichtbarkeit

Ein einzelner Haken löst kein Problem. Sichtbarkeit entsteht durch ein System, nicht durch eine Einzelmaßnahme.

Prüfen Sie technische Signale als Paket: robots.txt, llms.txt, schema.org, Meta-Titel und interne Verlinkung. Diese Signale entscheiden mit, ob KI-Systeme Ihre Inhalte finden und empfehlen können.

Genau hier setzt Semly an. Die Plattform für Generative Engine Optimization prüft robots.txt, llms.txt und schema.org und misst, wie Ihre Marke in KI-Antworten erscheint. Sie sehen Sichtbarkeit, Position, Sentiment, Share of Voice und die zitierten URLs in ChatGPT, Gemini, Claude, Grok und Google AI. Die Anbindung an WooCommerce und WordPress läuft per API-Schlüssel.

So verbinden Sie die technische Frage "Ist meine Seite indexierbar?" mit der eigentlichen Frage: "Werde ich in KI-Antworten überhaupt genannt?"

FAQ

Was macht noindex genau? Es sagt Suchmaschinen, dass eine Seite nicht in den Index soll. Es wirkt nur, wenn die Seite crawlbar bleibt.

Blockiert noindex ChatGPT? Nein. KI-Crawler steuern Sie über die robots.txt. noindex ist ein Suchmaschinen-Signal.

Ersetzt robots.txt noindex? Nein. robots.txt blockiert den Crawl, nicht den Index. Für Deindexierung brauchen Sie noindex.

Was passiert bei Disallow und noindex gleichzeitig? Der Bot crawlt nicht, liest das noindex nicht, und die Seite bleibt im Index. Der häufigste Fehler.

Wie lange dauert es, bis noindex greift? Tage bis Monate. Google besucht Seiten je nach Wichtigkeit unterschiedlich oft erneut.

Wie prüfe ich noindex in WordPress? Über die Search Console unter "Durch noindex-Tag ausgeschlossen", die URL-Prüfung und die Logfiles.

Quellen

Überprüfen Sie, ob Ihre Marke sieht

Geben Sie Ihre Website ein und erhalten Sie einen kostenlosen AI-Sichtbarkeitsbericht