
Paritok es una capa de compresión para sesiones de codificación con IA que se sitúa entre tu agente y el LLM, reduciendo herramientas, archivos e historial sin perder información. Así logras flujos de trabajo más largos y costos más bajos.
Paritok es una capa de compresión que se sitúa entre tu agente de codificación con IA y el LLM upstream. Comprime de forma no destructiva herramientas, archivos e historial en tiempo real, lo que te permite ejecutar sesiones más largas y pagar facturas más pequeñas. La herramienta reescribe lo que tu agente envía —esquemas de herramientas, lecturas de archivos, historial— y etiqueta todo lo que toca, mientras que las respuestas vuelven intactas y las referencias se expanden bajo demanda. Funciona con Claude Code, Cursor, Codex, OpenHands y cualquier upstream compatible con OpenAI.
Sesiones de codificación de larga duración
Mantén a los agentes trabajando durante períodos prolongados sin superar los límites de contexto.
Flujos de trabajo de IA sensibles al coste
Reduce el consumo de tokens por turno, lo que se acumula en ahorros significativos a lo largo de una sesión.
Exploración de repositorios grandes
Comprime lecturas de archivos y salidas de herramientas para que los agentes puedan navegar por bases de código extensas sin desbordar el contexto.
Configuraciones de agentes con múltiples herramientas
Reduce las enormes cargas JSON de más de 70 esquemas de herramientas enviados en cada solicitud.
Entornos autoalojados
Ejecuta Paritok localmente de forma gratuita, sin dependencias externas más allá de tu propia infraestructura.
Equipos con requisitos de cumplimiento
Mantén los bytes originales recuperables —nada se descarta, solo se comprime en la transmisión.
Compresión no destructiva
Paritok reescribe y filtra esquemas de herramientas, lecturas de archivos e historial sobre la marcha, pero los datos originales permanecen recuperables mediante referencias.
Optimización de esquemas de herramientas
Mantiene solo los esquemas de herramientas relevantes y deja el resto como stubs, reduciendo un bloque típico de 29K tokens a aproximadamente 8K por turno.
Compresión de lecturas de archivos y salidas
Un modelo integrado de 4B distingue firmas de funciones de líneas de depuración, preservando identificadores, rutas y errores mientras reduce las lecturas de archivos y resultados de herramientas a aproximadamente el 26% de su tamaño original.
Resumen de historial obsoleto
Cuando tu presupuesto de contexto se llena, los turnos más antiguos se resumen una vez, mientras que los turnos recientes permanecen intactos —así tú controlas cuándo actúa la compresión.
Bloques estables para caché
El bloque de herramientas comprimido permanece congelado por conversación, lo que ayuda a mantener la eficacia del caché upstream.
Referencias read_original
Puedes expandir cualquier segmento comprimido de vuelta a sus bytes originales exactos bajo demanda, sin turnos adicionales.
Integración sencilla
Establece una variable de entorno (`ANTHROPIC_BASE_URL=http://127.0.0.1:8080`) y Paritok se interpone entre tu agente y Anthropic.
Control basado en presupuesto
La compresión se ejecuta según un presupuesto que tú defines, no cuando el modelo se queda sin espacio.
Paritok está diseñado para desarrolladores y equipos que usan agentes de codificación con IA a diario —especialmente aquellos que utilizan Claude Code, Cursor, Codex u OpenHands en bases de código grandes. Es adecuado para ingenieros que quieren sesiones autónomas más largas sin desbordamientos de contexto, y para equipos que necesitan controlar los costes de LLM a escala. El autoalojamiento lo hace atractivo para organizaciones con requisitos estrictos de manejo de datos.
Obtén una clave API del sitio de Paritok, o autoalójalo de forma gratuita. Luego establece una variable de entorno para apuntar tu agente a Paritok en lugar de directamente a Anthropic. Tu agente envía esquemas de herramientas, historial y lecturas de archivos sin cambios; Paritok los reescribe y comprime antes de que lleguen al LLM upstream. Las respuestas vuelven intactas y los segmentos comprimidos se expanden bajo demanda mediante referencias.
Paritok aborda un problema real: los agentes de codificación con IA consumen tokens rápidamente y las ventanas de contexto se llenan pronto en proyectos grandes. Las palancas de compresión —esquemas de herramientas, lecturas de archivos e historial obsoleto— atacan los tres mayores consumidores de tokens en cualquier sesión de agente. El diseño de "nada se descarta" es una red de seguridad sólida, ya que siempre puedes recuperar los bytes originales exactos. La integración con una sola variable de entorno es refrescantemente simple. Si los ratios de compresión se mantienen en la práctica, Paritok podría extender significativamente la duración de las sesiones y reducir costes para usuarios intensivos de agentes.
Paritok es una capa de compresión para sesiones de codificación con IA que se sitúa entre tu agente y el LLM, reduciendo herramientas, archivos e historial sin perder información. Así logras flujos de trabajo más largos y costos más bajos.
Category:Complemento/Extensión de IA
Visit Link:https://www.paritok.com/
Tags:IA para código、compresión de contexto、reducción de tokens、optimización LLM、herramientas para desarrolladores