TOON ist eine kompakte, verlustfreie Kodierung des JSON-Datenmodells, die für LLM-Prompts konzipiert ist. Es verwendet YAML-artige Einrückung für verschachtelte Objekte und ein CSV-artiges tabellarisches Layout für einheitliche Arrays — bis zu 60 % weniger Tokens als JSON.
Der größte Vorteil von TOON: Arrays einheitlicher Objekte werden zu einer Header-Zeile [N,]{fields}: zusammengefasst, gefolgt von durch Kommas getrennten Datenzeilen — genau wie CSV, aber mit expliziter Struktur.
Strings werden nur bei Bedarf in Anführungszeichen gesetzt — wenn sie wie eine Zahl, ein Boolean oder null aussehen, das Trennzeichen enthalten, führenden/nachfolgenden Leerraum haben oder leer sind. Alles andere wird ohne Anführungszeichen geschrieben.
TOON erreicht in Datenabruf-Benchmarks eine LLM-Genauigkeit von 76 % gegenüber 75 % bei JSON und verwendet dabei ~40 % weniger Tokens. Am besten als Übersetzungsschicht einsetzen: JSON für APIs beibehalten, TOON an LLMs senden.
Verschachtelte Objekte verwenden Einrückung anstelle von geschweiften Klammern. Jedes Schlüssel-Wert-Paar wird als key: value geschrieben, und verschachtelte Objekte fügen eine Einrückungsebene hinzu (standardmäßig 2 Leerzeichen).
Wenn alle Objekte in einem Array dieselben Felder mit primitiven Werten teilen, schreibt TOON einen Header [N,]{f1,f2,f3}:, gefolgt von einer durch Kommas getrennten Zeile pro Objekt. Dies ist die größte Quelle für Token-Einsparungen.
Ja. TOON kodiert dieselben Objekte, Arrays und Primitive wie JSON. Sie können einen Umlauf JSON → TOON → JSON ohne Datenverlust durchführen. Typen bleiben durch die Quoting-Regeln von TOON erhalten.
Verwenden Sie TOON, wenn Sie strukturierte Daten als Kontext oder Eingabe an ein LLM senden. Die Token-Einsparungen senken direkt die API-Kosten und ermöglichen, mehr Daten in das Kontextfenster zu packen. Behalten Sie JSON für programmatische APIs, Datenbanken und überall dort, wo strikte Interoperabilität erforderlich ist.