Solange du KI-Antworten nur selbst liest, reicht freier Fließtext. Sobald aber ein Programm die Ausgabe weiterverarbeiten soll – sie in eine Datenbank schreibt, eine Tabelle füllt oder eine Entscheidung daraus ableitet –, brauchst du verlässliche Struktur. Eine KI, die mal JSON, mal Prosa, mal eine Liste liefert, ist für Automatisierung unbrauchbar. Dieser Artikel zeigt, wie du Sprachmodelle dazu bringst, in einem festen, maschinenlesbaren Format zu antworten.
Warum strukturierter Output schwierig ist
Sprachmodelle sind darauf trainiert, natürliche Sprache zu erzeugen, nicht streng formales Datenformat. Ihre Neigung ist, hilfreich zu sein – und das heißt für sie oft, eine Erklärung dazuzuschreiben. Genau diese Hilfsbereitschaft zerstört strukturierten Output: Wenn vor dem JSON ein "Gerne, hier ist deine Antwort:" steht, scheitert der Parser. Der Kern des strukturierten Promptings ist deshalb, diese Erzähllust gezielt zu unterdrücken.
Das gewünschte Schema vorgeben
Beschreibe nicht nur, dass du JSON willst, sondern zeige das genaue Schema. Gib die Feldnamen, die Datentypen und idealerweise ein vollständiges Beispiel vor:
- "Antworte ausschließlich mit gültigem JSON nach diesem Schema: {"name": string, "preis": number, "verfuegbar": boolean}"
- "Gib kein einleitendes oder abschließendes Wort aus. Beginne deine Antwort mit der öffnenden geschweiften Klammer."
- "Wenn ein Wert unbekannt ist, setze null, niemals eine Erklärung."
Die letzte Regel ist entscheidend: Du musst dem Modell sagen, was es bei fehlenden Werten tun soll, sonst schreibt es eine Entschuldigung ins Feld und zerstört die Struktur.
Die wirksamsten Tricks gegen Formatfehler
- Beispiel zeigen: Ein einziges Beispiel der gewünschten Ausgabe wirkt stärker als jede Beschreibung. Few-Shot ist beim Format dein bester Freund.
- Erzähltext verbieten: Formuliere ausdrücklich "ohne Einleitung, ohne Kommentar, ohne Markdown-Codeblock".
- Antwort vorstrukturieren: Wenn deine Schnittstelle es erlaubt, beginne die Modellantwort selbst mit der öffnenden Klammer. So bleibt dem Modell nichts anderes übrig, als fortzusetzen.
- Validieren und nachfragen: Prüfe das Ergebnis programmatisch. Wenn es ungültig ist, schicke es mit der Fehlermeldung zurück und bitte um Korrektur.
Native Strukturfunktionen nutzen
2026 bieten die großen Anbieter eigene Mechanismen für verlässlichen strukturierten Output. Über einen sogenannten JSON-Modus oder die Vorgabe eines festen Schemas lässt sich auf API-Ebene erzwingen, dass die Ausgabe gültiges JSON nach deinem Schema ist. Das ist deutlich robuster, als allein über den Prompt zu hoffen. Wer eine Anwendung baut, sollte diese nativen Funktionen bevorzugen und den Prompt nur als zusätzliche Absicherung verstehen. Tool-Calling, bei dem das Modell strukturierte Argumente für eine Funktion erzeugt, ist eine verwandte und besonders zuverlässige Variante.
Tabellen und andere Formate
JSON ist nicht das einzige strukturierte Format. Für menschliche Leser eignen sich Markdown-Tabellen, für Tabellenkalkulationen CSV, für Konfigurationen manchmal YAML. Auch hier gilt: Zeige das exakte Format und nenne die Spalten oder Schlüssel. Bei CSV ist es wichtig, das Trennzeichen festzulegen und zu klären, wie mit Kommas innerhalb von Werten umgegangen wird – sonst zerbricht die Struktur an einem einzigen Feld. Je strenger das Zielformat, desto präziser muss deine Vorgabe sein.
Konsistenz über viele Anfragen
In Automatisierungen läuft derselbe Prompt tausendfach mit wechselnden Eingaben. Hier zählt nicht, dass das Format einmal stimmt, sondern dass es immer stimmt. Eine niedrige Temperatur erhöht die Berechenbarkeit, ein klares Schema und ein Beispiel reduzieren Ausreißer. Plane trotzdem immer eine Validierungsschicht ein, die ungültige Ausgaben abfängt – selbst die besten Modelle produzieren bei Massenbetrieb gelegentlich einen Fehlschlag. Wer die Kosten solcher Massenläufe und der zusätzlichen Korrekturanfragen kalkulieren will, kann das mit dem LLM-API-Kosten-Rechner tun. Den Tokenverbrauch eines Schemas prüfst du vorab mit dem Token-Schätzer.
Weniger Erklärung, mehr Disziplin
Zusammengefasst: Strukturierter Output gelingt, wenn du dem Modell die Freiheit zum Plaudern nimmst, ihm das exakte Zielformat zeigst und die Ausgabe maschinell prüfst. Verlasse dich bei produktiven Anwendungen nie allein auf die Prompt-Vorgabe, sondern kombiniere sie mit nativen Strukturfunktionen und einer Validierung. Weitere Automatisierungs- und Prompt-Themen findest du laufend im News-Bereich und in den Webtools.
Aufzählungen, Schlüssel-Werte und gemischte Formate
Nicht jede Struktur muss komplex sein. Für viele Alltagsfälle reichen einfache, klar definierte Formate: eine nummerierte Liste mit genau drei Punkten, eine Tabelle mit festen Spalten oder ein Schlüssel-Wert-Block ("Titel: ... / Datum: ... / Status: ..."). Auch hier gilt, dass du das Format zeigen und die Anzahl der Elemente festlegen solltest. "Gib mir Stichpunkte" liefert mal drei, mal zwölf; "Gib mir genau fünf Stichpunkte, jeder unter zehn Wörtern" ist berechenbar.
Manchmal brauchst du sowohl maschinenlesbare Daten als auch eine menschliche Erklärung. Dann trennst du beide sauber: erst ein klar markierter Datenblock, danach ein optionaler Erklärtext in einem eigenen Abschnitt. So kann ein Programm den Datenteil zuverlässig herauslösen, während ein Mensch die Erläuterung lesen kann. Vermische beides niemals im selben Feld, sonst verlierst du genau die Maschinenlesbarkeit, derentwegen du strukturiert promptest.
Häufige Fragen
Warum schreibt die KI trotz Anweisung Text vor das JSON?
Weil Hilfsbereitschaft tief eintrainiert ist. Verbiete einleitende Worte ausdrücklich, zeige ein Beispiel ohne Vorrede und nutze, wenn möglich, den nativen JSON-Modus deiner API statt nur des Prompts.
Ist JSON oder CSV besser für meine Automatisierung?
JSON eignet sich für verschachtelte Daten und ist robuster zu parsen. CSV ist einfacher für flache Tabellen und den Import in Kalkulationsprogramme. Wähle nach Zielsystem und Datenstruktur.
Wie verhindere ich ungültiges JSON in Massenbetrieb?
Mit drei Schichten: nativer Strukturmodus oder Tool-Calling, niedrige Temperatur und eine programmatische Validierung, die fehlerhafte Antworten erkennt und gezielt neu anfragt. Kein einzelner Trick genügt allein.
Kostet strukturierter Output mehr Tokens?
Das Schema im Prompt und ein Beispiel kosten zusätzliche Tokens, oft aber spart die wegfallende Erklärung beim Output etwas ein. Unterm Strich ist der Mehraufwand gering und durch die Verarbeitbarkeit mehr als gerechtfertigt.