WordPress-Inhalte hinter dem Login: Was du für Google und KI-Suche wie ChatGPT öffentlich zugänglich machen solltest (inkl. Checkliste)

TL;DR Was hinter dem Login liegt, können Googlebot und KI-Crawler nicht lesen. Kein Zugriff heißt: keine Indexierung, keine Zitate. Google bietet mit Flexible Sampling und dem isAccessibleForFree-Markup einen regelkonformen Weg, Teile von Paywall-Inhalten freizugeben. KI-Crawler sind nicht Googlebot: OAI-SearchBot, PerplexityBot, Claude-SearchBot und Bingbot musst du separat erlauben, in robots.txt und in der WAF. robots.txt ist kein Schutzmechanismus. Für echten Schutz brauchst du noindex oder einen Passwortschutz. Empfehlung: entscheidungsrelevante Inhalte wie Preise, FAQ, Produktdaten und Case Studies öffentlich machen, der Rest bleibt hinter dem Login. Am Ende findest du eine Checkliste zum Abarbeiten. Semly unterstützt dich bei der Umsetzung, Leon prüft robots.txt, llms.txt und Schema.

WordPress Inhalte hinter dem Login – warum sie für Google und KI unsichtbar bleiben

Crawler lesen nur, was sie ohne Session erreichen. Sobald eine Seite einen Login verlangt, bekommt der Bot eine Weiterleitung oder eine leere Antwort. Er sieht keinen Text, keine Preise, keine FAQ. Also gibt es nichts zu indexieren und nichts zu zitieren.

Genau hier entsteht die typische Frage: "Warum rankt meine Seite nicht?" oder "Warum nennt ChatGPT meinen Shop nicht?" Die Antwort ist meistens unspektakulär. Der Inhalt ist gut, aber er liegt hinter einer Tür, die kein Crawler öffnen kann.

Wie groß der Unterschied ist, zeigt eine Auswertung von Everything-PR × 5W aus dem Jahr 2026: Hard- und Metered-Paywalls kamen in der untersuchten Stichprobe auf 0 % der KI-Zitierungen, Freemium-Modelle auf 8,7 % und offen zugängliche Inhalte auf 91,3 %. Öffentlich heißt zitierbar, Login heißt unsichtbar.

Was Crawler sehen vs. was Nutzer sehen

  • Crawler sehen: die Login-Seite, eine Weiterleitung oder einen Fehlercode.
  • Nutzer sehen: den vollen Inhalt nach der Anmeldung.
  • Ergebnis: Der Inhalt existiert für Menschen, aber nicht für Such- und KI-Systeme.

Wichtig für die Einordnung: Login-Content, Paywall und Gated Content sind keine Fehler. Sie sind eine bewusste Entscheidung. Die Frage ist nur, welche Teile du wirklich schützen musst und welche Teile dir Sichtbarkeit bringen.

Googlebot ≠ KI-Crawler – wer darf rein, wer nicht?

Viele Betreiber erlauben Googlebot und wundern sich, dass ChatGPT und Perplexity die Seite trotzdem nicht nennen. Der Grund: Es sind unterschiedliche Bots mit unterschiedlichen Aufgaben. Googlebot sorgt für die Indexierung in der Google-Suche. KI-Suchbots holen Inhalte für Antworten in ChatGPT, Perplexity oder Claude. Trainings-Bots sammeln Material für Modelle.

Du steuerst sie alle über robots.txt, aber jeder Bot reagiert anders. Und: Nach einer Änderung an der robots.txt dauert es bei OpenAI und Perplexity rund 24 Stunden, bis sie greift.

Bot Zweck robots.txt-konform? Wirkung bei Blockade
Googlebot Indexierung in der Google-Suche Ja Seite wird nicht indexiert, keine Sichtbarkeit in Google und AI Overviews
Google-Extended Training und Grounding in Google-Systemen Ja Inhalte werden nicht fürs Modell-Training genutzt
OAI-SearchBot Suche in ChatGPT Ja Keine Anzeige in ChatGPT-Suchantworten
GPTBot Training von OpenAI-Modellen Ja Inhalte fließen nicht ins Training
ChatGPT-User Nutzerinitiierter Abruf Laut OpenAI "may not apply" Bot kann trotzdem abrufen, wenn ein Nutzer ihn auslöst
PerplexityBot Suche in Perplexity Ja Keine Zitate in Perplexity-Antworten
Perplexity-User Nutzerinitiierter Abruf Ignoriert robots.txt laut Anbieter Abruf trotz Blockade möglich
ClaudeBot Training von Anthropic Ja Kein Training mit deinen Inhalten
Claude-SearchBot Suche in Claude Ja Geringere Sichtbarkeit in Claude-Suchergebnissen
Bingbot Indexierung in Bing und Basis für viele KI-Feeds Ja Keine Indexierung in Bing, weniger KI-Sichtbarkeit

Zwei Punkte sind hier entscheidend. Erstens: Reicht Googlebot? Nein. Wenn du in KI-Antworten auftauchen willst, musst du die Such-Bots der KI-Anbieter separat erlauben. Zweitens: Was passiert, wenn du OAI-SearchBot blockst? Dann erscheint deine Seite nicht in den Suchantworten von ChatGPT. Der Bot darf dann zwar noch Navigationslinks liefern, aber keine Inhalte aus deinen Seiten.

Was du öffentlich machen solltest – und was hinter dem Login bleiben darf

Die Faustregel: Alles, was eine Kauf- oder Kontaktentscheidung beeinflusst, gehört nach draußen. Alles, was nur für bestehende Kunden relevant ist, darf hinter dem Login bleiben.

Öffentlich / teil-öffentlich (Teaser) / Login

  • Öffentlich: Preise, Liefer- und Rückgabebedingungen, Produktdaten inklusive GTIN, FAQ, Case Studies, Vergleiche, Ansprechpartner.
  • Teil-öffentlich: längere Guides, Datenblätter, Reports. Die ersten Absätze sichtbar, der Rest hinter dem Login.
  • Login: Kundenbereich, Tools, individuelle Daten, Projektdateien, persönliche Auswertungen.

Die häufige Sorge: "Verliere ich Kunden, wenn Preise öffentlich sind?" In der Praxis ist das Gegenteil wahrscheinlicher. Wer den Preis nicht findet, sucht weiter. Und landet dann beim Wettbewerber, der ihn zeigt. Der kleinste sinnvolle Teaser ist ein Lead-in: die ersten Sätze plus eine klare Überschrift, die sagt, worum es geht. Das reicht Crawlern oft schon, um die Seite einzuordnen.

Schritt für Schritt: Login-Inhalte für Google und KI öffnen

Schritt 1 – Bestandsaufnahme: Welche Inhalte liegen hinter Login?

Ziel: Du weißt genau, welche URLs geschützt sind. Werkzeug: dein Membership- oder Paywall-Plugin plus eine Liste der gated URLs. Prüfpunkt: Jede geschützte URL ist erfasst und einer Kategorie zugeordnet (öffentlich, Teaser, Login). Typisches Fehlerbild: Einzelne Seiten sind über ein Plugin geschützt, aber niemand hat sie dokumentiert.

Schritt 2 – robots.txt für Such-Bots konfigurieren

Ziel: Such-Bots dürfen rein, Trainings-Bots entscheidest du bewusst. Werkzeug: robots.txt im WordPress-Root oder über dein SEO-Plugin. Erlaube Googlebot, OAI-SearchBot, PerplexityBot, Claude-SearchBot und Bingbot. Trainings-Bots wie GPTBot, Google-Extended und ClaudeBot steuerst du separat. Prüfpunkt: Die Datei ist erreichbar und enthält keine pauschale Sperre für alle Bots. Typisches Fehlerbild: Ein Disallow: / aus alten Zeiten blockiert alles.

Schritt 3 – WAF/CDN-Whitelisting

Ziel: Deine Firewall lässt verifizierte Bots durch. Werkzeug: Cloudflare oder AWS. Verifiziere Bots über die offiziellen IP-Endpunkte der Anbieter, nicht über den User-Agent-String. Der lässt sich leicht fälschen. Prüfpunkt: Ein Testabruf mit der offiziellen Bot-IP kommt durch. Typisches Fehlerbild: robots.txt erlaubt den Bot, die WAF blockt ihn trotzdem.

Schritt 4 – Paywall-Markup setzen (nur bei Teil-Gating)

Ziel: Google versteht, dass ein Teil des Inhalts kostenpflichtig ist. Werkzeug: JSON-LD mit isAccessibleForFree: false und hasPart inklusive cssSelector. Nutze nur .class-Selektoren, keine Verschachtelung. Unterstützt wird das unter anderem für Article, NewsArticle, Blog, HowTo und WebPage. Prüfpunkt: Der Rich-Results-Test erkennt das Markup fehlerfrei. Typisches Fehlerbild: Markup fehlt, obwohl Teile gesperrt sind. Dann droht die Einstufung als Cloaking, weil Googlebot mehr sieht als Nutzer.

Schritt 5 – Teaser & Struktur

Ziel: Der sichtbare Teil ist sofort verständlich. Werkzeug: dein Editor plus Schema-Plugin. Setze ein Lead-in mit den ersten Sätzen, antworte zuerst und erkläre danach, nutze klare H2/H3 und FAQ-Blöcke. Ergänze JSON-LD mit FAQPage, Product und Offer. Prüfpunkt: Die ersten Sätze beantworten die Kernfrage ohne Scrollen. Typisches Fehlerbild: Der Teaser ist reine Werbung ohne Information.

Schritt 6 – llms.txt & sitemap.xml

Ziel: KI-Systeme finden deine wichtigsten Ressourcen schnell. Werkzeug: Yoast SEO oder AIOSEO, beide generieren eine llms.txt für WordPress. Die llms.txt ist eine kuratierte Ressourcenkarte mit H1, Blockquote und absoluten URLs, unter 100 KB und in UTF-8. Prüfpunkt: llms.txt und sitemap.xml sind erreichbar und aktuell. Typisches Fehlerbild: Die sitemap.xml enthält veraltete oder geschützte URLs.

Checkliste: Login-Inhalte für Google und KI prüfen

  • robots.txt erlaubt Googlebot, OAI-SearchBot, PerplexityBot, Claude-SearchBot und Bingbot. Prüfen: Datei im Browser aufrufen.
  • Keine pauschale Disallow: /-Sperre vorhanden. Prüfen: robots.txt durchlesen.
  • WAF/CDN lässt verifizierte Bots über IP-Endpunkte durch. Prüfen: Testabruf mit offizieller Bot-IP.
  • Paywall-Markup mit isAccessibleForFree: false gesetzt. Prüfen: Rich-Results-Test.
  • hasPart nutzt nur .class-Selektoren ohne Verschachtelung. Prüfen: JSON-LD kontrollieren.
  • Teaser enthält die ersten Sätze sichtbar. Prüfen: Seite im Inkognito-Fenster öffnen.
  • FAQ-Blöcke und JSON-LD (FAQPage, Product, Offer) vorhanden. Prüfen: Rich-Results-Test.
  • llms.txt existiert und ist aktuell. Prüfen: URL direkt aufrufen.
  • sitemap.xml enthält nur indexierbare URLs. Prüfen: Sitemap mit der gated-Liste abgleichen.
  • Aktualisierungsdatum ist auf den Seiten sichtbar. Prüfen: Seitenkopf kontrollieren.
  • GA4-Segment für AI-Traffic ist eingerichtet. Prüfen: GA4-Explorer.
  • Server-Logs werden auf AI-Bots ausgewertet. Prüfen: Log-Analyse oder Server-Tool.

Häufige Fehler und wie du sie behebst

Fehler Symptom Fix
robots.txt als Schutz missverstanden Geschützte Inhalte tauchen trotzdem in Suchergebnissen auf noindex oder Passwortschutz nutzen, robots.txt nur zur Steuerung
Nur Googlebot erlaubt Seite rankt in Google, wird aber von ChatGPT und Perplexity nicht genannt OAI-SearchBot, PerplexityBot, Claude-SearchBot und Bingbot ergänzen
WAF blockt KI-Bots trotz robots.txt Bot wird erlaubt, kommt aber nicht durch Bot über offizielle IP-Endpunkte whitelisten
Markup fehlt bei Teil-Gating Googlebot sieht mehr als Nutzer, Risiko Cloaking isAccessibleForFree und hasPart nachtragen
Alles öffentlich gemacht Kundenbereich und interne Daten sind auffindbar Inhalte nach Entscheidungsrelevanz neu sortieren
Veraltete Inhalte Seite wird selten oder gar nicht zitiert Aktualisierungsdatum pflegen und Inhalte regelmäßig überarbeiten

So messen und iterieren – Sichtbarkeit nach der Freigabe

Nach der Freigabe willst du wissen, ob es wirkt. Der einfachste Einstieg: GA4-Segmente für chatgpt.com, perplexity.ai und gemini.google.com. So siehst du, welcher Traffic aus KI-Antworten kommt. Ergänzend lohnt ein Blick in die Server-Logs, um zu prüfen, ob die AI-Bots tatsächlich crawlen.

Als Baseline hilft ein Sichtbarkeitsbericht. Semly liefert dafür konkrete Referenzwerte aus dem E-Commerce-Bericht 2026: Die Sichtbarkeit stieg im Schnitt von 11,8 % auf 22,6 %, die Zitationsrate von 2,7 % auf 6,8 %. Das sind keine Garantien für jede Marke, aber eine realistische Orientierung, was nach konsequenter Umsetzung möglich ist.

Und die häufigste Frage: "Wie sehe ich, ob ChatGPT mich zitiert?" Prüfe regelmäßig typische Nutzerfragen in den KI-Systemen und schau, ob deine Marke genannt wird. Genau diese Prüfung automatisiert Semly mit Leon, der Marke, Wettbewerber und Quellen in ChatGPT, Gemini, Claude und Google AI beobachtet.

Co dalej – nächste Schritte und Alternativen

Du hast drei Varianten. Voll öffentlich passt, wenn der Inhalt Vertrauen aufbauen soll und kein Wettbewerbsnachteil entsteht. Teaser passt, wenn der Inhalt wertvoll ist, aber ein Anreiz zur Anmeldung bleiben soll. Login passt, wenn es um individuelle Daten, Tools oder Kundenbereiche geht.

Wann reicht ein Teaser? Wenn die Kernaussage in den ersten Sätzen steht und der Rest echtes Zusatzwissen ist. Wann lohnt ein Monitoring-Tool? Sobald du wissen willst, ob deine Freigaben wirken und wo Wettbewerber genannt werden.

Die nächsten Schritte in der Praxis: Schema ausbauen, llms.txt regelmäßig pflegen und die Sichtbarkeit laufend beobachten. Semly begleitet dich dabei als Umsetzungspartner mit WordPress- und WooCommerce-Bezug. Leon prüft robots.txt, llms.txt und Schema und zeigt dir, welche Inhalte noch hinter dem Login liegen, obwohl sie dir Sichtbarkeit bringen könnten.

FAQ

Indexiert Google Login-Inhalte? Nur, wenn Googlebot sie crawlen kann und die Seite per isAccessibleForFree-Markup als teilweise gesperrt gekennzeichnet ist. Google empfiehlt dafür Flexible Sampling mit einem sichtbaren Lead-in. Ohne Zugriff gibt es keine Indexierung.

Respektieren KI-Crawler robots.txt? Die Such-Bots von OpenAI, Perplexity und Anthropic respektieren robots.txt. Nutzerinitiierte Agents wie ChatGPT-User oder Perplexity-User ignorieren die Regeln laut Anbieterdokumentation teilweise. Verlass dich deshalb nicht allein auf robots.txt.

Was ist llms.txt? Eine kuratierte Ressourcenkarte für KI-Systeme. Sie enthält eine H1, eine kurze Beschreibung als Blockquote und absolute URLs zu deinen wichtigsten Seiten. Yoast SEO und AIOSEO generieren sie für WordPress automatisch.

Ist eine Paywall schlecht für SEO? Nicht automatisch. Eine Paywall ist eine legitime Entscheidung. Schlecht wird sie nur, wenn du sie nicht kennzeichnest oder wenn du Inhalte sperrst, die dir Sichtbarkeit bringen würden. Teaser und Markup lösen das.

Quellen

Überprüfen Sie, ob Ihre Marke sieht

Geben Sie Ihre Website ein und erhalten Sie einen kostenlosen AI-Sichtbarkeitsbericht