
Paritok ist eine Kompressionsschicht für KI-Codierungssessions, die zwischen Agent und LLM sitzt und Tools, Dateien sowie Verlauf nicht-destruktiv verkleinert. So ermöglicht sie längere Workflows und senkt die Kosten – ohne Verlust an Kontext.
Paritok ist eine Kompressionsschicht, die sich zwischen deinen KI-Coding-Agenten und das vorgelagerte LLM schaltet. Sie reduziert Tools, Dateien und Verlauf in Echtzeit, ohne Daten zu verlieren – so kannst du längere Sessions laufen lassen und kleinere Rechnungen bezahlen. Das Tool schreibt neu, was dein Agent sendet – Tool-Schemas, Dateilesevorgänge, Verlauf – und markiert alles, was es anfasst, während Antworten unverändert zurückkommen und Referenzen bei Bedarf expandiert werden. Es funktioniert mit Claude Code, Cursor, Codex, OpenHands und jedem OpenAI-kompatiblen Upstream.
Langlaufende Coding-Sessions
Agents über längere Zeiträume arbeiten lassen, ohne Context-Limits zu sprengen.
Kostensensible KI-Workflows
Token-Verbrauch pro Turn reduzieren – das summiert sich über eine Session zu erheblichen Einsparungen.
Erkundung großer Repositories
Dateilesevorgänge und Tool-Ausgaben komprimieren, damit Agents große Codebasen durchsuchen können, ohne den Context zu überfluten.
Multi-Tool-Agent-Setups
Die massiven JSON-Payloads von 70+ Tool-Schemas reduzieren, die bei jeder Anfrage mitgesendet werden.
Self-hosted Umgebungen
Paritok lokal und kostenlos betreiben, ohne externe Abhängigkeiten außerhalb der eigenen Infrastruktur.
Compliance-bewusste Teams
Original-Bytes bleiben wiederherstellbar – nichts wird verworfen, nur auf der Leitung komprimiert.
Nicht-destruktive Kompression
Paritok schreibt Tool-Schemas, Dateilesevorgänge und Verlauf on-the-fly um und filtert sie, aber die Originaldaten bleiben über Referenzen wiederherstellbar.
Tool-Schema-Optimierung
Nur relevante Tool-Schemas bleiben erhalten, der Rest wird gestubbt – ein typischer 29K-Token-Block schrumpft auf etwa 8K pro Turn.
Dateilese- und Ausgabekomprimierung
Ein integriertes 4B-Modell unterscheidet Funktionssignaturen von Debug-Zeilen, erhält Bezeichner, Pfade und Fehler und reduziert Dateilesevorgänge und Tool-Ergebnisse auf etwa 26 % ihrer ursprünglichen Größe.
Zusammenfassung veralteter Verläufe
Sobald dein Context-Budget voll ist, werden ältere Turns einmalig zusammengefasst, während aktuelle Turns unangetastet bleiben – du bestimmst, wann die Kompression greift.
Cache-stabile Blöcke
Der komprimierte Tool-Block bleibt pro Konversation eingefroren, was die Effektivität des Upstream-Cachings unterstützt.
Read_original-Referenzen
Du kannst jedes komprimierte Segment auf Abruf in seine exakten Original-Bytes zurückexpandieren – ohne zusätzlichen Turn.
Einfache Integration
Eine Umgebungsvariable setzen (`ANTHROPIC_BASE_URL=http://127.0.0.1:8080`) und Paritok sitzt zwischen Agent und Anthropic.
Budgetbasierte Steuerung
Die Kompression läuft nach einem von dir festgelegten Budget – nicht erst, wenn dem Modell der Platz ausgeht.
Paritok wurde für Entwickler und Teams entwickelt, die täglich mit KI-Coding-Agenten arbeiten – besonders für jene, die Claude Code, Cursor, Codex oder OpenHands auf großen Codebasen einsetzen. Es passt für Entwickler, die längere autonome Sessions ohne Context-Überläufe wollen, und für Teams, die LLM-Kosten im großen Maßstab kontrollieren müssen. Self-Hosting macht es attraktiv für Organisationen mit strengen Datenverarbeitungsanforderungen.
Hole dir einen API-Key von der Paritok-Website oder hoste es selbst kostenlos. Setze dann eine Umgebungsvariable, um deinen Agent auf Paritok statt direkt auf Anthropic zu zeigen. Dein Agent sendet Tool-Schemas, Verlauf und Dateilesevorgänge unverändert; Paritok schreibt sie um und komprimiert sie, bevor sie das vorgelagerte LLM erreichen. Antworten kommen unverändert zurück, und komprimierte Segmente expandieren bei Bedarf über Referenzen.
Paritok adressiert einen echten Schmerzpunkt: KI-Coding-Agenten verbrennen schnell Tokens, und Context-Fenster füllen sich bei großen Projekten rasch. Die Kompressionshebel – Tool-Schemas, Dateilesevorgänge und veralteter Verlauf – zielen auf die drei größten Token-Fresser in jeder Agent-Session. Das Design „nichts wird verworfen“ ist ein starkes Sicherheitsnetz, da du die exakten Original-Bytes jederzeit wiederherstellen kannst. Die Integration mit nur einer Umgebungsvariable ist erfrischend einfach. Wenn die Kompressionsraten in der Praxis halten, könnte Paritok die Session-Längen für Vielnutzer von Agents spürbar verlängern und Kosten senken.
Paritok ist eine Kompressionsschicht für KI-Codierungssessions, die zwischen Agent und LLM sitzt und Tools, Dateien sowie Verlauf nicht-destruktiv verkleinert. So ermöglicht sie längere Workflows und senkt die Kosten – ohne Verlust an Kontext.
Category:KI-Plugin / Erweiterung
Visit Link:https://www.paritok.com/
Tags:KI-Programmierung、Kontext-Kompression、Token-Reduzierung、LLM-Optimierung、Entwickler-Tools