Caveman
Stack de optimización de costes de IA que automatiza el caché, la compresión y el enrutamiento de tráfico de LLM para reducir los tokens de salida en ~65%
| Qué es | Stack de optimización de costes de IA que automatiza el caché, la compresión y el enrutamiento de tráfico de LLM para reducir los tokens de salida en ~65% |
|---|---|
| Precios | Freemium — de $29/mo |
| Plan gratuito | Sí |
| Plataforma | API |
| API | Sí |
| Ideal para | cutting monthly LLM API costs in production, optimizing token use in AI coding agents |
| Dominio registrado | 2026 |
Datos actualizados 15 de agosto de 2026
¿Qué hace Caveman?
Caveman es una capa de eficiencia para equipos que construyen sobre modelos de lenguaje extensos. Se sitúa entre tu aplicación y los proveedores de IA que utilizas, supervisa el tráfico y aplica optimizaciones de ahorro de costes como el caché, la compresión y el enrutamiento. La promesa principal es que puede reducir aproximadamente el 65% de tus costes de IA al disminuir la cantidad de tokens de salida por los que pagas, para luego mostrarte un desglose de lo ahorrado.
La herramienta está diseñada deliberadamente para que su instalación sea ligera. Hay cuatro formas de ejecutarla: una skill de Claude Code instalada con un comando curl, un paquete global de npm llamado Caveman Code, un paquete llamado Cavemem y una extensión de navegador que funciona con ChatGPT, Claude y Gemini. Esa variedad de puntos de entrada la hace útil dentro de agentes de programación nativos de IA, en servicios de backend y en interfaces de chat cotidianas. El proyecto reporta cerca de 97,9k estrellas en GitHub y fue el número 1 en Hacker News, lo que indica un fuerte interés por parte de los desarrolladores.
¿Quiénes se benefician más? Los equipos de ingeniería que pagan facturas significativas de API de LLM, los desarrolladores que crean agentes de IA y las empresas que quieren bajar los costes de infraestructura sin tener que reescribir su código. Caveman no es un modelo de IA en sí mismo; es una capa de control de costes para las herramientas de IA que ya utilizas. El informe de ahorros verificados es especialmente útil para los equipos que necesitan justificar una herramienta nueva ante la dirección.
Características principales
Qué la hace destacar¿Para quién es Caveman?
Quién saca más provecho de esta herramientaPrecios
Plan gratuito disponible — empieza sin tarjeta de créditoFree
- Local wrap: recoverable compression on your machine (BYOK) — no account required
- MIT skill + extension for Claude Code (30+ agents)
- Inferred savings + Cave Score, computed locally
- Optional free account adds cloud sync and one dashboard seat
Indie
- Local wrap + hosted gateway (BYOK) — 1 seat
- Synced dashboard: inferred headroom + qualifying causal-cache ledger
- 50M optimized tokens / week
- Keep 100% of your savings — no gainshare
Team
- 10 seats included · $29 / extra seat
- Eval-gated rollout with automatic rollback
- Receipt export + Ed25519 verification (automatic signing disabled)
- Projects + metered $0.75 / M beyond plan
Enterprise
- Planned platform floor + gainshare on verified savings only
- OIDC SSO, audit log, RBAC, governance
- On-prem / BYOC deploy + OEM embedding
- Provider-invoice reconciliation (planned)
Confianza y presencia
Galería
Haz clic en cualquier imagen para ampliarlaAlternativas en Herramientas para desarrolladores
Plano de control de IA que audita las llamadas a herramientas de agentes y almacena respuestas de LLM en caché para reducir costes en un 50 %
Proxy integrable que monitorea, optimiza y protege el gasto de tus LLM en aplicaciones y agentes de programación
Una app para la barra de menús de macOS que optimiza los prompts de Claude Code y Codex comprimiendo el ruido para reducir los costes de tokens en ~50%.
Capa de memoria persistente para agentes de programación de IA: captura sesiones, permite el recuerdo y consolida conocimientos sin bases de datos externas.
Ejecuta varios agentes de programación de IA en un mismo repositorio y lienzo compartido, sin conflictos de fusión.
AI Gateway que redirige, comprime y gobierna solicitudes a LLM, reduciendo costes entre un 60 % y un 90 %
Kits de agentes de IA preconfigurados para Claude Code: subagentes especializados que automatizan flujos de trabajo de programación, pruebas y marketing.
Cuenta tokens y estima costes de API para más de 300 modelos de IA, incluidos GPT-5, Claude, Gemini y Llama