TOON은 LLM 프롬프트를 위해 설계된, JSON 데이터 모델의 간결하고 무손실인 인코딩입니다. 중첩 객체에는 YAML 스타일 들여쓰기를, 균일한 배열에는 CSV 스타일 표 레이아웃을 사용하여 JSON보다 최대 60% 적은 토큰을 사용합니다.
TOON의 가장 큰 장점: 균일한 객체 배열이 헤더 행 [N,]{fields}:과 그 뒤의 쉼표로 구분된 데이터 행으로 축약됩니다 — CSV와 똑같지만 명시적인 구조를 갖습니다.
문자열은 필요할 때만 인용됩니다 — 숫자, 불리언, null처럼 보이거나, 구분자를 포함하거나, 앞뒤 공백이 있거나, 비어 있을 때입니다. 그 외의 모든 것은 인용 없이 그대로 작성됩니다.
TOON은 데이터 검색 벤치마크에서 JSON의 75% 대비 76%의 LLM 정확도를 달성하면서 약 40% 적은 토큰을 사용합니다. 변환 계층으로 사용하는 것이 가장 좋습니다: API에는 JSON을 유지하고, LLM에는 TOON을 보내세요.
중첩 객체는 중괄호 대신 들여쓰기를 사용합니다. 각 키-값 쌍은 key: value 형태로 작성되며, 중첩 객체는 한 단계 들여쓰기(기본값 2칸)를 추가합니다.
배열의 모든 객체가 동일한 원시 값 필드를 공유하는 경우, TOON은 헤더 [N,]{f1,f2,f3}:를 작성한 뒤 객체마다 쉼표로 구분된 행 하나를 씁니다. 이것이 토큰 절약의 가장 큰 원천입니다.
예. TOON은 JSON과 동일한 객체, 배열, 원시 값을 인코딩합니다. 데이터 손실 없이 JSON → TOON → JSON 왕복 변환이 가능합니다. 타입은 TOON의 인용 규칙을 통해 보존됩니다.
구조화 데이터를 LLM에 컨텍스트나 입력으로 보낼 때 TOON을 사용하세요. 토큰 절약은 API 비용을 직접 줄이고 더 많은 데이터를 컨텍스트 창에 담을 수 있게 합니다. 프로그래밍 방식의 API, 데이터베이스, 엄격한 상호 운용성이 필요한 곳에는 JSON을 유지하세요.