Insights · Praxis

Bestehende Seiten mit Schema.org und JSON-LD ergänzen

So holt das Rankmio Content Studio eine bestehende Webseite in den Editor und erzeugt daraus strukturierte Daten.

Wenn du eine Webseite liest, verstehst du sofort, was du vor dir hast. Du siehst eine Überschrift, darunter einen Namen und ein Datum, weiter unten eine Reihe von Fragen mit Antworten. Ohne nachzudenken weißt du: Das ist ein Artikel, den jemand geschrieben hat, und unten steht ein Frage-Antwort-Teil.

Ein Computerprogramm weiß das nicht. Es bekommt denselben Text, aber ohne dein Vorwissen. Für ein Programm ist eine Überschrift erst einmal nur eine Zeile, die größer dargestellt wird. Ob darin der Titel eines Artikels steht oder der Name einer Werbeanzeige, geht aus der Größe nicht hervor.

Für Suchmaschinen und für Systeme wie ChatGPT ist das kein unüberwindbares Hindernis. Der sichtbare Text liefert bereits viele Informationen, und die Systeme werten ihn auch aus. Strukturierte Daten ergänzen diese Informationen um maschinenlesbare Angaben und machen bestimmte Zusammenhänge ausdrücklich: dass diese Zeile die Überschrift eines Artikels ist, dass jene Person ihn geschrieben hat, dass weiter unten sechs Fragen mit den dazugehörigen Antworten stehen.

Was strukturierte Daten sind

Für diese zusätzlichen Angaben gibt es ein eingeführtes Verfahren, und es ist älter als die KI-Systeme. Vereinfacht gesagt sind strukturierte Daten ein maschinenlesbarer Beipackzettel für eine Webseite: Sie stehen nicht sichtbar auf der Seite, sondern in ihrem Quelltext, und sie beschreiben in einer festen Form, was der Besucher sieht.

Zwei Begriffe gehören dazu, und sie meinen nicht dasselbe. Schema.org ist das Vokabular, mit dem Inhalte und ihre Eigenschaften beschrieben werden — es legt fest, dass es einen Typ Article gibt und dass dieser eine headline, einen author und ein datePublished haben kann. JSON-LD ist eine der technischen Formen, in der sich diese Angaben in eine Seite einbinden lassen; sie steht als eigener Block im Quelltext. Das Vokabular sagt also, was beschrieben wird, die Einbindungsform, wie es dort hineinkommt.

Ein solcher Block sagt zum Beispiel: Dies ist ein Artikel. Seine Überschrift lautet so. Geschrieben hat ihn diese Person, veröffentlicht wurde er an diesem Tag. Und weiter unten: Hier folgen sechs Fragen, und das sind die dazugehörigen Antworten.

Bei vielen Seiten fehlt das. Sie sind gut geschrieben und stehen seit Jahren online, aber im Quelltext steht dazu nichts. Unten stehen zehn Fragen mit Antworten, und keine dieser Angaben ist ausdrücklich als solche gekennzeichnet.

Eines sollte man dabei nicht erwarten: Strukturierte Daten sind kein automatischer Rankingfaktor und garantieren keine bessere Position in den Suchergebnissen. Sie können Suchmaschinen aber dabei helfen, Inhalte und Zusammenhänge einzuordnen, und bei einigen Datentypen zusätzliche Darstellungen in den Ergebnissen ermöglichen.

Warum man die Seite dafür nicht neu schreiben muss

Der naheliegende Gedanke wäre, den Beitrag im Content Studio noch einmal zu verfassen und diesmal alles richtig zu machen. Das wäre viel Arbeit für ein kleines Ziel, denn der Text selbst ist ja in Ordnung.

Es geht einfacher. Du gibst die Adresse der bestehenden Seite an, und das Studio holt sie sich. Du bekommst den Inhalt im Editor angezeigt, kannst ihn dort bearbeiten, und beim Speichern entstehen die strukturierten Daten, die bisher fehlten.

Was beim Holen der Seite passiert

Eine Webseite besteht nicht nur aus Text. In ihrem Quelltext stehen auch Anweisungen, wie sie aussehen soll, und kleine Programme, die im Browser des Besuchers laufen. Ein Menü gehört dazu, eine Fußzeile, oft auch Werbung.

Davon kommt nur der Inhalt im Editor an: Überschriften, Absätze, Listen, Tabellen, Bilder und Links. Alles andere wird vorher entfernt.

Das ist keine Bequemlichkeit, sondern eine Sicherheitsfrage. Der Editor übernimmt den redaktionellen Inhalt einer fremden Seite, nicht ihren ausführbaren Teil. Käme ein Programm mit, liefe es in deinem Browser, und du hättest keine Möglichkeit zu prüfen, was es tut.

Der Ablauf sieht deshalb so aus: Das HTML der Seite wird eingelesen, die redaktionellen Elemente werden herausgelöst, Skripte und Stile bleiben zurück, und was übrig bleibt, lässt sich im Editor weiterverarbeiten.

Eine Ausnahme gibt es, und sie hat einen Grund. Wenn auf der Seite ein Quiz steht, also Fragen zum Anklicken, dann steckt dessen Logik nicht im sichtbaren Text, sondern in unsichtbaren Zusatzangaben: welche der drei Antworten die richtige ist, welche Auswahlmöglichkeiten zu welcher Frage gehören, welche Erklärung nach dem Klick erscheint. Würde man diese Angaben mit dem Rest entfernen, bliebe vom Quiz nur eine Liste zusammenhangloser Sätze übrig. Sie werden deshalb übernommen — aber nur sie. Alles, was ein Programm starten könnte, fällt auch hier weg.

Warum vorhandenes Markup nicht übernommen wird

Manche Seiten bringen bereits eine Auszeichnung mit. Man könnte annehmen, dass das Studio sie einfach übernimmt. Es tut es nicht, und der Grund ist wichtiger, als er zuerst klingt.

Vorhandenes Markup beschreibt einen bestimmten Stand der Seite. Sobald du im Editor etwas änderst, stimmt diese Beschreibung nicht mehr. Du streichst eine Frage, und die Auszeichnung behauptet weiter, es seien zehn. Du formulierst die Überschrift um, und sie nennt noch die alte.

Eine Beschreibung, die etwas anderes sagt als die Seite, ist schlechter als gar keine. Passen strukturierte Daten nicht zum sichtbaren Inhalt, können sie für Suchdarstellungen unbrauchbar werden; bei Verstößen gegen die Richtlinien kann Google außerdem manuelle Maßnahmen ergreifen.

Das Studio liest das vorhandene Markup deshalb nur und legt es als Befund ab. Der Befund sagt dir, was auf der Quellseite steht: wie viele Blöcke es gibt, welche Typen darin vorkommen, welche Fragen ausgezeichnet sind, wer als Autor genannt wird. Das ist nützlich zu wissen — aber es wandert nicht in deinen Entwurf.

Das Content Studio übernimmt also kein vorhandenes Markup, sondern wertet den aktuellen Inhalt der Seite aus und erzeugt daraus eine passende strukturierte Beschreibung. So beschreibt das Markup den Stand, den der bearbeitete Beitrag tatsächlich hat, und nicht einen möglicherweise veralteten Stand der ursprünglichen Webseite.

Der Ablauf von Anfang bis Ende: bestehende Seite einlesen, Inhalt auswerten, vorhandenes Markup als Befund prüfen, Inhalt im Editor bearbeiten, strukturierte Daten neu erzeugen, als HTML-Datei oder nach WordPress ausgeben.

Was beim Speichern entsteht

Sobald du speicherst, sieht sich das Studio deinen Text an und stellt die strukturierten Daten selbst zusammen. Drei Teile können dabei entstehen.

Der erste ist der Rahmen für den Artikel. Er nennt die Überschrift, eine kurze Beschreibung, den Autor und den Herausgeber, das Vorschaubild, das Datum der Veröffentlichung und der letzten Änderung, die Sprache und die Länge des Textes. Diese Angaben stehen alle schon irgendwo — sie werden nur zusammengetragen.

Der zweite Teil ist der Frage-Antwort-Bereich. Steht in deinem Text eine Überschrift wie „Häufige Fragen", werden die Fragen darunter eingelesen und als solche ausgezeichnet. Nur die darunter, wohlgemerkt: Manche Artikel führen auch ihre Kapitel als Fragen, und die zählen nicht mit. Wer unter dieser Überschrift nachsieht, erwartet eine bestimmte Handvoll, und die Auszeichnung soll abbilden, was die Seite verspricht.

Zwei Dinge sind beim Frage-Antwort-Teil wichtig zu wissen. Erstens beschreibt FAQPage-Markup die Fragen und Antworten maschinenlesbar, es führt aber nicht zwangsläufig zu einer erweiterten Darstellung in den Google-Ergebnissen: Diese zeigt Google heute nur noch für bestimmte, besonders autoritative Websites an. Sinnvoll bleibt die Auszeichnung trotzdem, weil sie Fragen und Antworten ausdrücklich als solche kennzeichnet und damit zusätzliche maschinenlesbare Informationen liefert — auch für Systeme jenseits der klassischen Suche.

Zweitens gibt es zwei verwandte Typen, die leicht verwechselt werden. FAQPage steht für redaktionell erstellte Fragen und Antworten, wie sie eine Redaktion unter einen Beitrag setzt. QAPage beschreibt dagegen eine Seite, auf der Nutzer selbst Fragen stellen und Antworten einreichen können, also ein Forum. Für redaktionelle Inhalte ist FAQPage der richtige Typ, und nur den erzeugt das Studio.

Der dritte Teil ist das Quiz, falls eines im Text steht. Dabei werden die Frage, die richtige Antwort und die Erklärung übernommen.

Die drei Teile werden zu einem zusammengefasst, und der Artikel steht darin oben. Hast du an einem Teil selbst gearbeitet, bleibt er unangetastet — ergänzt wird nur, was noch fehlt. Ein zweites Speichern ändert deshalb nichts mehr.

Bezahlen musst du dafür nichts. Es läuft kein Sprachmodell mit, es wird nichts geschätzt und nichts vorhergesagt. Der Text wird gelesen, und was darin steht, wird eingetragen.

Was dabei nicht passiert

Erfunden wird nichts. Wenn eine Angabe fehlt, bleibt das Feld leer, statt mit einem Platzhalter gefüllt zu werden. Es gibt kein Ersatzbild, keinen ausgedachten Autor und kein geschätztes Datum. Eine Lücke ist ehrlicher als eine Angabe, die niemand geprüft hat.

Ausgelassen wird außerdem, was wie eine Frage aussieht, aber keine ist. Am Ende vieler Seiten steht eine Einladung im Frageformat, etwa „Bereit, loszulegen?", und darunter ein Knopf. Das ist formal ein Frage-Antwort-Paar, inhaltlich aber Werbung. In einem Frage-Antwort-Bereich hat sie nichts verloren; Google schließt Werbliches dort ausdrücklich aus.

Wie der fertige Beitrag wieder herauskommt

Zwei Wege führen aus dem Editor heraus, und beide nehmen dieselbe Auszeichnung mit.

Der eine legt eine HTML-Datei an, die du herunterlädst. Darin steht oben der unsichtbare Teil mit Titel, Beschreibung, Autor und dem JSON-LD-Block, darunter der Text. Diese Datei lässt sich in jedes System einfügen.

Der andere Weg schiebt den Beitrag samt Auszeichnung direkt in eine WordPress-Installation.

Beide prüfen vorher, ob das, was sie mitgeben, überhaupt Markup ist. Bis zum September 2026 schickte der Download den Befund über die Quellseite mit — also die Notiz darüber, was auf der fremden Seite gefunden wurde. Diese Notiz ist technisch gesehen sauber aufgebaut, aber sie beschreibt nichts, was mit deinem Beitrag zu tun hat, und sie stand ohne die nötige Verpackung im Quelltext. Zehn Kilobyte Diagnose zwischen den Angaben zum Beitrag. Heute laufen beide Wege durch dieselbe Prüfung, und was kein gültiges JSON-LD ist, wird nicht ausgegeben.

Wo die Grenzen liegen

Geholt wird der Inhalt, nicht das Aussehen. Schriften, Farben und die besonderen Bausteine der Quellseite bleiben zurück. Das ist so gewollt, denn im Editor arbeitest du am Text und nicht an der Gestaltung.

Manche Seiten bauen ihren Inhalt erst im Browser des Besuchers zusammen, während er die Seite betrachtet. Von solchen Seiten kommt nur an, was schon vorher feststand.

Und das Markup kann nur beschreiben, was tatsächlich da ist. Wo keine Frage im Text steht, entsteht kein Frage-Antwort-Bereich. Wer einen haben möchte, muss Fragen schreiben — das Studio trägt ein, was es findet, und denkt sich nichts dazu.

Wann sich der Weg lohnt

Er lohnt sich bei einer Seite, die inhaltlich in Ordnung ist und der nur die Beschreibung fehlt. Er lohnt sich bei einem älteren Beitrag, den du ohnehin überarbeiten wolltest. Und er lohnt sich, wenn du bei mehreren Seiten erst einmal wissen möchtest, ob überhaupt eine Auszeichnung vorhanden ist — dafür reicht der Befund, ohne dass du etwas änderst.

Nicht lohnt er sich, wenn ein Beitrag ohnehin neu geschrieben gehört. Dann fängst du besser mit einem Briefing an, statt den alten Text zu retten.

Häufige Fragen

Kann ich jede beliebige Seite holen?

Alle Seiten, die öffentlich im Netz stehen, auch fremde. Nicht möglich sind Adressen aus internen Netzen und Seiten, die erst nach einer Anmeldung erscheinen. Der Abruf verhält sich dabei wie ein gewöhnlicher Besucher und nimmt das, was die Seite ihm zeigt.

Verändere ich damit die ursprüngliche Seite?

Nein. Sie wird nur gelesen, so wie ein Besucher sie liest. Was im Studio entsteht, gehört zu deinem Entwurf und verlässt ihn erst, wenn du die Datei herunterlädst oder den Beitrag veröffentlichst.

Was kostet das?

Nichts. Der Artikelrahmen, der Frage-Antwort-Bereich und das Quiz entstehen allein aus deinem Text, ohne dass ein Sprachmodell mitrechnet. Credits kostet nur die andere Variante, bei der eine KI einen Vorschlag erstellt — für diesen Weg brauchst du sie nicht.

Warum stehen in meinem Frage-Antwort-Bereich weniger Fragen als im Text?

Weil nur die Fragen unterhalb der Überschrift „Häufige Fragen" aufgenommen werden. Führt dein Beitrag auch seine Kapitel als Fragen, bleiben diese außen vor. Fehlt eine solche Überschrift ganz, wird stattdessen der gesamte Text ausgewertet.

Kann ich die strukturierten Daten hinterher noch ändern?

Ja. Er steht im Editor sichtbar da und lässt sich kopieren oder von Hand bearbeiten. Was du geändert hast, bleibt beim nächsten Speichern erhalten, denn ergänzt wird nur, was noch fehlt.

Was wird aus einem Quiz der Quellseite?

Der Aufbau wird übernommen, das zugehörige Programm nicht. Beim Herunterladen und beim Veröffentlichen fügt das Studio ein eigenes hinzu. So gelangt kein fremder Programmcode in den Editor, und das Quiz funktioniert trotzdem.

Verwandte Glossar-Begriffe

Schema.org-Markup JSON-LD FAQPage-Schema Schema.org sameAs Rankmio Content Studio

Kostenloser SEO- & GEO-Check

SEO-Score, KI-Sichtbarkeit und Zitierbarkeit deiner Website in 30 Sekunden — ohne Registrierung.

Jetzt kostenlos prüfen

Bereit, deine Website zu optimieren?

Kostenlos registrieren, 10 Credits erhalten und direkt loslegen.

Jetzt registrieren

Verwandte Glossar-Begriffe

Schema.org-Markup JSON-LD FAQPage-Schema Schema.org sameAs Rankmio Content Studio