TokenMaestro
Para quienes desarrollan con IA

Haz que tu plan de IA para programar rinda más. De la primera solicitud al último token.

TokenMaestro dirige el trabajo entre tú, tu agente de IA y tu equipo: un modelo local estructura tu solicitud, se te pregunta lo que falta antes de que el agente empiece, el trabajo pesado va a herramientas instaladas en tu equipo y cada tarea recibe el modelo y el esfuerzo adecuados. Cada ahorro se mide localmente, nunca se estima.

Primera versión: la Radiografía gratuita, para Claude Code. Después: la orquesta completa, y Codex, Gemini y otros agentes.

Radiografía gratuita · Sin cuenta · Nada sale de tu equipo

Medido, nunca estimadoLos conteos de tokens salen de lo que devolvió la API, combinados correctamente y sin duplicados.
Verificación cruzadaNuestro conteo se compara con los contadores del propio Claude Code, y se muestra la diferencia.
LocalSe ejecuta en tu equipo. Sin cuenta, sin subir nada.

La orquesta: menos tokens desde el principio

La mayoría de las herramientas de tokens comprimen lo que el agente ya gastó. TokenMaestro actúa antes del gasto: en la solicitud, la comprensión, las herramientas y el modelo.

Próximamente

Una solicitud bien armada

Un modelo abierto y pequeño se ejecuta en tu equipo y convierte lo que escribiste en una solicitud clara y estructurada antes de que llegue al agente. No gasta tokens.

Próximamente

Preguntas antes del trabajo

Cuando una solicitud es ambigua, TokenMaestro te pregunta primero, para que el agente no gaste tokens adivinando y rehaciendo.

Próximamente

Herramientas locales para el trabajo pesado

Leer texto en imágenes, convertir documentos, cortar video: lo hacen herramientas instaladas en tu equipo, que TokenMaestro prepara con tu permiso. El agente solo recibe el resultado.

Próximamente

El modelo y el esfuerzo adecuados

Las tareas simples van a un modelo más ligero con esfuerzo bajo; el modelo pesado y el esfuerzo alto, solo cuando la tarea los necesita.

Próximamente

Sesiones ligeras

Compactar o empezar de cero antes de que el contexto se dispare, y antes de que una pausa deje expirar la caché.

Gratis · primera versión

Cada ahorro, medido

La Radiografía muestra adónde fue cada token. Cada corrección se mide sobre tu propio trabajo, activada y desactivada; si no compensa, se desactiva.

Tu agente, tu elección: primero Claude Code; después Codex, Gemini y otros. TokenMaestro dirige; tú eliges los instrumentos.

Gratis

Empieza por la Radiografía: cuánto valió tu plan y adónde se fue

Un solo comando lee meses de registros en segundos y genera un panel en un único archivo: el valor a precios de API por día, modelo, nivel de esfuerzo y proyecto; los días en que llegaste al límite; y una verificación cruzada con los contadores del propio Claude Code.

Panel de TokenMaestro: unos 24 mil dólares de valor equivalente a precios de API en cinco meses, gráfico de valor diario con los días en que se alcanzó el límite del plan y la verificación cruzada con los contadores de Claude Code.
El panel real del fundador: cinco meses con una suscripción de precio fijo, unos US$ 24 mil a precios de API. Hoy el panel está en portugués; los demás idiomas vendrán después.

Lo que encuentra: las fugas, con una etiqueta en cada número

«Medido» significa que los registros lo muestran. «Techo» es lo máximo que una corrección podría recuperar; no es un ahorro. En los registros del fundador:

53 %

Contextos enormes

del valor se fue en turnos con más de 400 mil tokens de contexto. Cada paso vuelve a leer todo lo anterior.

7,5 %

Caché reescrita tras las pausas

La caché expiró 461 veces durante pausas, y todo el contexto se volvió a escribir a precio completo.

~56 mil

Tokens antes de la primera respuesta

Instrucciones, herramientas y memoria con las que empieza cada sesión, que se vuelven a leer en cada turno posterior.

Tarjetas de fugas del panel: contexto de más de 200 mil tokens, caché reescrita tras pausas y sin pausas, peso fijo releído en cada turno, archivos releídos sin cambios, herramientas que faltan en el equipo.

El mapa de peso

Lo que más leyó tu agente, por proyecto y archivo. El área es el volumen que entró en el contexto; el color muestra cuánto de eso se releyó sin que el archivo cambiara.

Lo próximo: el mismo mapa dibujado sobre la estructura de tu código, con el recorrido que hizo tu agente en cada sesión.

Mapa de rectángulos con los archivos que más leyó el agente, agrupados por proyecto.
Los nombres de proyectos y archivos se sustituyeron por etiquetas neutras, algo que la Radiografía permite hacer a cualquiera antes de compartir.

Por qué puedes confiar en los números

La mayoría de las herramientas de tokens informan ahorros que ellas mismas estiman. Mediciones independientes de herramientas populares no encontraron ahorro, y a veces encontraron un gasto mayor. Nosotros empezamos por el otro extremo.

Las trampas de los registros, resueltas

Claude Code escribe varias entradas por mensaje, las primeras con conteos parciales; las sesiones reanudadas repiten mensajes; los subagentes escriben archivos aparte. Cada caso tiene su prueba.

Contrastado con Claude Code

En 8 sesiones comparables, nuestro conteo de lecturas de caché quedó un 4,9 % por debajo de los contadores del propio Claude Code, nunca por encima. Los números son un mínimo.

Ninguna promesa de ahorro sin medir

Ningún porcentaje de ahorro aparece en esta página hasta que se publique una medición pareada, con los datos brutos y una forma de reproducirla.

Descargar

La Radiografía es una pequeña herramienta de línea de comandos. Pega una línea en tu terminal para instalarla, o descarga el archivo.

WindowsmacOSLinux

Se está preparando la primera versión pública. Los enlaces de descarga para Windows, macOS y Linux aparecerán aquí cuando salga.

Precios

Radiografía

Gratis
  • Panel de valor y uso
  • Fugas, con etiquetas de evidencia
  • Mapa de peso
  • Verificación cruzada con los contadores de Claude Code
  • Comprobación de herramientas que faltan

Pro Próximamente

US$ 79 / año

Miembros fundadores: US$ 49 el primer año, para las primeras 500 personas.

  • Solicitudes estructuradas por un modelo local
  • Preguntas antes de que el agente empiece
  • Herramientas locales instaladas y ajustadas
  • El modelo y el esfuerzo adecuados para cada tarea
  • Ahorro medido sobre tu propio trabajo
  • Medidor de límite; Codex, Gemini y otros agentes a medida que lleguen
Comprar Pro

La compra se abrirá con la primera versión pública.

Posponer un solo mes el paso a un plan superior paga un año de Pro.

Preguntas frecuentes

¿Qué lee TokenMaestro?

Los registros de sesión que Claude Code ya escribe en tu equipo (~/.claude/projects): los conteos de tokens que la API devolvió en cada mensaje, y qué herramientas se ejecutaron y cuánto devolvieron. No se envía nada a ninguna parte.

¿El valor en dólares es lo que pagué?

No. Es lo que habría costado tu uso a precios de API. Con una suscripción de precio fijo, muestra cuánto rindió tu plan, no una factura.

Claude Code ya tiene /usage. ¿Para qué esto?

/usage te dice cuánto de tu límite ya se consumió. TokenMaestro te dice adónde fue, cuánto valía y dónde hay fugas.

¿Cuánto voy a ahorrar?

No prometemos una cifra antes de medir. La Radiografía muestra cuánto se pierde en fugas en tu caso. Cuando lleguen las correcciones, cada una se medirá sobre tu propio trabajo.

¿Necesito una cuenta?

No. La Radiografía no requiere cuenta ni correo electrónico. Pro usa una clave de licencia, que se envía por correo al comprar.

¿Funciona con Codex, Cursor o Gemini?

La Radiografía lee primero Claude Code. Codex y Gemini vienen después: tú eliges el agente, TokenMaestro dirige el resto.

¿Windows, macOS, Linux?

Sí. La Radiografía funciona en los tres.

¿Tengo que instalar modelos o herramientas?

No. Cuando una tarea lo requiere, TokenMaestro muestra lo que falta, explica por qué y lo instala con tu permiso. El modelo local es pequeño y abierto; si tu equipo no puede ejecutarlo bien, TokenMaestro funciona sin él. (Pro, próximamente.)

Empieza con la Radiografía gratuita

Descargar la Radiografía gratuita