Du hast eine schöne Infografik gebaut, alles Wichtige steht im Bild, und jetzt fragst du dich: Reicht das? Liest Google den Text da drin überhaupt? Und sehen ChatGPT, Gemini oder Google AI meine Zahlen und Aussagen?
Die kurze Antwort: teilweise. Die praktische Antwort: Verlass dich nicht darauf. In diesem Leitfaden zeige ich dir, was Google und KI-Systeme wirklich aus Bildern lesen, warum Text im Bild kein verlässlicher Kanal ist und wie du Infografiken in WordPress Schritt für Schritt so aufsetzt, dass sie für Suchmaschinen und KI-Systeme funktionieren.
TL;DR Google und multimodale KI-Modelle können Text in Bildern grundsätzlich lesen (OCR), aber die Extraktion ist fehleranfällig und das inhaltliche Verständnis textreicher Bilder ist schwach. Kein getestetes Modell überschritt 50 % Genauigkeit beim OCR-Reasoning, das beste erreichte 46,8 % (arXiv, 2025). Reine Texterkennung (DocVQA) liegt dagegen bei bis zu 96,7 %. Text im Bild ist deshalb kein verlässlicher SEO- oder GEO-Kanal. Robust sind Signale im Code: Alt-Text, Dateiname, umgebender Text, Schema.org und Bild-Sitemap. Dazu kommt Performance: LCP unter 2,5 Sekunden, moderne Formate, kein Lazy-Loading des LCP-Bilds. Der Leitfaden führt dich durch sechs Schritte in WordPress, zeigt Kontrollpunkte, typische Fehler und was du danach tun kannst.
Können Google und KI Text in Bildern lesen? — die kurze Antwort
Ja, technisch geht das. OCR (Optical Character Recognition) bedeutet: Ein System erkennt Buchstaben und Zahlen in einem Bild und wandelt sie in maschinenlesbaren Text um. Das funktioniert bei klaren, gut aufgelösten Bildern zuverlässig.
Der Haken liegt woanders. Zwischen Extraktion und Verständnis liegt ein großer Unterschied. Ein Modell kann deine Infografik fehlerfrei „abtippen" und trotzdem nicht verstehen, was die Zahlen bedeuten, wie sie zusammenhängen oder warum sie für den Nutzer relevant sind.
Genau das zeigt die Forschung. Beim OCR-Reasoning, also dem Schlussfolgern über erkannten Text, überschritt kein getestetes multimodales Modell die 50-Prozent-Marke. Das beste geschlossene Modell kam auf 46,8 %, das beste offene auf 37,5 % (arXiv, 2025). Bei reiner Texterkennung (DocVQA) erreichen Modelle dagegen bis zu 96,7 %. Erkennen ist also leicht, Verstehen ist schwer.
Für deine Infografik heißt das: Wenn die Kernaussage nur im Bild steckt, ist sie für Maschinen ein Glücksspiel.
Was Google liest vs. was KI liest
Google und KI-Systeme arbeiten unterschiedlich. Das ist wichtig, weil du beide bedienen willst.
Google:
- Kombiniert Alt-Text mit Computer Vision, um Bilder zu verstehen.
- Nutzt Dateinamen, umgebenden Text und Bildunterschriften als Kontext.
- Wählt über
primaryImageOfPageundImageObjectein Hauptbild. - Braucht Performance, damit Bilder überhaupt gut ranken.
KI-Systeme:
- Zitieren Quellen und Kontext, nicht einzelne Pixel.
- Bevorzugen Text, der klar im HTML steht und zitierbar ist.
- Ziehen oft andere Quellen heran als Google: 53 % der von AI Overview zitierten Websites lagen außerhalb der Google Top-10 (Ruhr-Universität Bochum/MPI-SWS, 2025).
- Verstehen strukturierte Daten als Abkürzung zu den wichtigsten Fakten.
Kurz gesagt: Google liest Bilder stärker mit, KI liest Text und Struktur. Wer beides will, liefert beides.
Warum Text-in-Bild kein verlässlicher SEO- und GEO-Kanal ist
Es gibt vier gute Gründe, warum du dich nicht auf Text im Bild verlassen solltest.
1. Fehleranfällige Extraktion. OCR scheitert schnell bei kleinen Schriften, schlechtem Kontrast, ungewöhnlichen Fonts oder gemischten Sprachen. Was für dich lesbar ist, muss es für die Maschine nicht sein.
2. Schwaches Reasoning. Selbst wenn der Text erkannt wird, versteht das Modell den Zusammenhang oft nicht. Aus einer Tabelle mit fünf Zahlen wird keine Aussage.
3. Fehlende Zitierbarkeit. KI-Systeme zitieren Textpassagen und Quellen. Ein Bild lässt sich schlecht als Belegstelle anführen. Semly weist genau darauf hin: Wenn Daten nur in Grafiken oder PDFs erscheinen, ist es für LLMs weniger wahrscheinlich, sie richtig zu interpretieren.
4. Barrierefreiheit. Screenreader brauchen Alt-Text. Ohne ihn ist deine Infografik für einen Teil deiner Nutzer unsichtbar. Das ist kein SEO-Nebeneffekt, sondern ein Qualitätsmerkmal.
Die Konsequenz ist einfach: Behandle das Bild als visuelles Extra, nicht als Datenträger. Die Information gehört zusätzlich in den Code.
Schritt für Schritt: Infografiken in WordPress für SEO und AI optimieren
Jetzt wird es praktisch. Diese sechs Schritte setzt du in deiner WordPress-Installation um. Du brauchst Zugriff auf die Media Library und die Möglichkeit, Theme oder Plugins anzupassen.
Schritt 1 — Text zusätzlich als HTML bereitstellen
Ziel: Die Kernaussagen deiner Infografik stehen als echter Text im HTML.
Schreibe die wichtigsten Zahlen und Aussagen als kurze Absätze oder Liste direkt unter oder über das Bild. Nicht als Bildunterschrift versteckt, sondern als normaler Inhalt. So kann Google den Text indexieren und KI-Systeme können ihn zitieren.
Typischer Fehler: Die ganze Aussage steckt nur im Bild, im Fließtext steht nur „siehe Grafik".
Schritt 2 — Dateiname und Alt-Text richtig setzen
Ziel: Bild und Inhalt werden eindeutig beschrieben.
Der Dateiname sollte sprechend sein, etwa infografik-ladezeit-vergleich.webp statt IMG_2043.png. Der Alt-Text beschreibt knapp, was zu sehen ist, in einem Satz. Kein Keyword-Stuffing, keine Wiederholung des Titels.
Typischer Fehler: Leerer Alt-Text oder eine lange Kette von Keywords.
Schritt 3 — Umgebenden Text und Bildunterschrift nutzen
Ziel: Kontext liefern, den Maschinen auswerten können.
Der Text rund um das Bild erklärt, warum die Grafik relevant ist. Die Bildunterschrift fasst die Kernaussage in einem Satz zusammen. Beides zusammen gibt Google und KI mehr Anhaltspunkte als das Bild allein.
Typischer Fehler: Das Bild steht isoliert zwischen zwei themenfremden Absätzen.
Schritt 4 — Strukturierte Daten ergänzen
Ziel: Suchmaschinen und KI-Systemen klar sagen, welches Bild das Hauptbild ist.
Nutze JSON-LD mit ImageObject und primaryImageOfPage. Ergänze og:image für Social Sharing. Wichtig: Verwende kein textlastiges Bild als Hauptbild, weil es in Vorschauen und Zitaten schlecht funktioniert.
Typischer Fehler: Keine strukturierten Daten oder ein Bild mit viel Text als Hauptbild.
Schritt 5 — Bild-Sitemap und Formate
Ziel: Bilder werden entdeckt und schnell geladen.
Eine Bild-Sitemap hilft besonders bei Bildern, die per JavaScript geladen werden. Beachte: <image:caption> und <image:title> sind inzwischen veraltet (Google, 2025). Setze stattdessen auf moderne Formate.
| Format | Wann passend | Hinweis |
|---|---|---|
| WebP | Standard für die meisten Bilder | Rund 99 % Browser-Support, 25 bis 35 % kleiner als JPEG |
| AVIF | Wenn maximale Kompression zählt | 94,7 % Support, über 50 % kleiner, aber noch selten genutzt |
| JPEG | Fotos ohne Transparenz | Bewährt, aber größer |
| PNG | Grafiken mit Transparenz | Verlustfrei, aber schwer |
| SVG | Logos, einfache Diagramme | Skaliert verlustfrei, Text bleibt echter Text |
Typischer Fehler: Riesige PNG-Dateien für Fotos oder veraltete Formate ohne Fallback.
Schritt 6 — Performance und LCP
Ziel: Das Bild lädt schnell, damit es überhaupt wahrgenommen wird.
Bilder sind auf 85 % der Desktop- und 76 % der Mobile-Seiten das LCP-Element (2025 Web Almanac). Dein Ziel: LCP unter 2,5 Sekunden. Lade das LCP-Bild nicht lazy, sondern setze fetchpriority="high". Komprimiere die Datei und liefere sie in passenden Größen über srcset.
Typischer Fehler: Das LCP-Bild wird per Lazy-Loading verzögert. 16 % der Seiten machen genau das.
Woran du erkennst, dass es funktioniert — Kontrollpunkte
Nach dem Umbau gehst du diese Liste durch:
- Alt-Text ist vorhanden und beschreibt das Bild sinnvoll.
- Die Kernaussage steht als Text im HTML, nicht nur im Bild.
- Dateiname ist sprechend und ohne Keyword-Stuffing.
- Strukturierte Daten sind valide (JSON-LD prüfen).
-
og:imageist gesetzt und zeigt ein passendes Bild. - LCP liegt unter 2,5 Sekunden und ist grün.
- Das LCP-Bild wird nicht lazy geladen.
- Die Bild-Sitemap enthält deine Bilder.
- Moderne Formate (WebP oder AVIF) sind im Einsatz.
Häufigste Fehler und wie du sie behebst
| Fehler | Symptom | Fix |
|---|---|---|
| Text nur im Bild | KI zitiert die Aussage nicht | Kernaussagen als HTML-Text ergänzen |
| Leerer Alt-Text | Bild wird nicht verstanden | Kurzen, beschreibenden Alt-Text setzen |
| Keyword-Stuffing im Alt-Text | Wirkt spammy, kein Mehrwert | Natürliche Beschreibung in einem Satz |
| LCP-Bild lazy geladen | LCP über 2,5 s | Lazy-Loading entfernen, fetchpriority="high" setzen |
| Fehlende Schema-Daten | Kein klares Hauptbild | ImageObject und primaryImageOfPage ergänzen |
| Falsches Hauptbild | Textlastiges Bild in Vorschau | Neutrales Bild als Hauptbild wählen |
Was du als Nächstes tun kannst
Wenn die erste Infografik sitzt, erweiterst du das Prinzip auf die ganze Media Library. Prüfe systematisch Alt-Texte, Dateinamen und Formate. Ergänze eine llms.txt, damit KI-Systeme deine wichtigsten Inhalte schneller finden. Und miss, ob es wirkt: Beobachte, ob deine Marke in KI-Antworten genannt und zitiert wird.
Genau hier setzt Semly an. Die Plattform für Generative Engine Optimization und AI-Sichtbarkeit analysiert, welche Prompts und Quellen KI-Systeme nutzen, und zeigt dir, wo deine Marke in KI-Antworten auftaucht. Mit der WordPress- und WooCommerce-Integration verbindet Semly klassisches Bild-SEO mit deiner Sichtbarkeit in ChatGPT, Gemini und Google AI. So siehst du nicht nur, dass deine Bilder technisch sauber sind, sondern auch, ob sie in KI-Antworten tatsächlich eine Rolle spielen.
Sinnvoll ist der nächste Schritt, wenn du regelmäßig Inhalte mit Grafiken veröffentlichst und wissen willst, ob KI-Systeme dich überhaupt wahrnehmen. Weniger relevant ist er, wenn du nur gelegentlich ein Bild einbindest und keine Ambitionen in Richtung AI-Sichtbarkeit hast.
FAQ
Liest Google Text in Bildern? Google kann Text in Bildern per OCR erkennen und kombiniert das mit Computer Vision. Verlässlich ist das aber nicht, deshalb solltest du wichtige Inhalte immer zusätzlich als HTML-Text bereitstellen.
Ist Alt-Text ein Rankingfaktor? Alt-Text ist kein direkter Rankingfaktor, aber ein wichtiges Signal für das Bildverständnis und für die Barrierefreiheit. Google nutzt ihn zusammen mit anderen Signalen, um Bilder einzuordnen.
Welches Bildformat für SEO? WebP ist für die meisten Bilder die beste Wahl: breite Unterstützung und deutlich kleiner als JPEG. AVIF komprimiert noch stärker, wird aber seltener genutzt. Für Logos und einfache Diagramme eignet sich SVG.
Werden Infografiken von KI zitiert? Selten direkt. KI-Systeme zitieren Text und Quellen, nicht einzelne Bildinhalte. Wenn deine Kernaussagen auch als Text im HTML stehen, haben sie eine echte Chance, in KI-Antworten aufzutauchen.