IQ Routing
Dirige cada llamada de LLM al modelo más barato que mantenga la calidad: reduce el gasto entre un 40 % y un 80 % con un solo gateway.
| Qué es | Dirige cada llamada de LLM al modelo más barato que mantenga la calidad: reduce el gasto entre un 40 % y un 80 % con un solo gateway. |
|---|---|
| Precios | Freemium — de $70/mo |
| Plan gratuito | Sí |
| Plataforma | Web Application |
| API | Sí |
| Ideal para | Reducing LLM costs in production chatbots and agent pipelines, Tracking and allocating AI spend per team or project |
| Dominio registrado | 2026 |
Datos actualizados 19 de septiembre de 2026
¿Qué hace IQ Routing?
IQ Routing es un gateway que se sitúa entre tu aplicación y proveedores de LLM como OpenAI, Anthropic y Google. En lugar de enviar cada solicitud a tu modelo más caro, evalúa cada llamada y la dirige al modelo más económico que siga cumpliendo tus estándares de calidad. La empresa informa de reducciones de gasto del 40 al 80 por ciento en su propio tráfico. Puedes empezar a usarlo en unos treinta segundos apuntando tu SDK de OpenAI o Anthropic actual a una única URL base.
El núcleo del servicio es un clasificador que analiza la dificultad real de cada solicitud y luego sopesa el coste y la latencia entre proveedores antes de elegir un modelo. También incluye un caché semántico que detecta consultas repetidas y similares, devolviendo respuestas sin cobrarte de nuevo. Para los equipos que utilizan herramientas como Claude Code o Cursor, que te obligan a usar una sola familia de modelos, IQ Routing se mantiene dentro de esa familia mientras sigue dirigiendo cada paso al nivel adecuado. El dashboard muestra flujos de solicitudes en vivo, presupuestos por equipo, registros de auditoría y un desglose de costes por modelo.
Esta herramienta está pensada para equipos de ingeniería que ejecutan chatbots de producción, tuberías de RAG o bucles de agentes y que quieren controlar el aumento de los costes de los LLM sin sacrificar la calidad. También ayuda a los equipos de finanzas y operaciones a rastrear exactamente a dónde va el dinero, con presupuestos por equipo y desgloses de costes detallados. El plan gratuito admite hasta 240 solicitudes por minuto con la modalidad de traer tus propias claves, y los planes de pago añaden alertas, bandas de rutas personalizadas y opciones de despliegue on-prem.
Características principales
Qué la hace destacar¿Para quién es IQ Routing?
Quién saca más provecho de esta herramientaPrecios
Plan gratuito disponible — empieza sin tarjeta de créditoFree
- 1 seats
- 240 requests per min
- Acceso a OpenAI, Anthropic y Google a través de una única URL
- Uso de tus propias claves (BYOK)
- Caché semántica
- Soporte vía email
Team
Todo lo de Free, y además:
- Up to 10 seats
- 600 requests per min
- Todo lo incluido en el plan Free
- Presupuestos gestionados por equipo
- Registro de auditoría (Audit log)
- Alertas configurables por equipo
- Controles de acceso a nivel de organización
- Mapas de ancho de banda personalizados (auto, cheap, frontier)
- Soporte prioritario vía email
Enterprise
Todo lo de Team, y además:
- Unlimited seats
- 6,000 requests per min
- Todo lo incluido en el plan Team
- Despliegue on-prem o en VPC
- Paquete de evidencias SOC2 bajo solicitud
- Integraciones con ERP (en hoja de ruta)
- Ingeniero de soporte dedicado
Confianza y presencia
Galería
Haz clic en cualquier imagen para ampliarlaAlternativas en API de IA
API unificada para acceder a más de 400 LLM y reducir costes mediante el enrutamiento a los modelos más baratos, con analíticas y gestión de equipos.
Pasarela de LLM que redirige cada solicitud al modelo adecuado más barato: una sola clave de API, una sola factura y un ahorro de costes medio del 40 %
AI Gateway de código abierto: un único endpoint que redirige solicitudes entre 236 proveedores de LLM con auto-fallback
Pasarela de API de IA unificada: una clave, una URL base y acceso a más de 200 modelos con control de costes
Un único punto de acceso API para usar más de 100 LLM de más de 10 proveedores con enrutamiento inteligente y precios transparentes
AI Gateway para producción: gestiona, redirige y monitoriza peticiones a más de 400 LLM desde una sola API.
Una sola API para acceder a más de 200 modelos de IA de OpenAI, Anthropic, Google y más, con enrutamiento inteligente y facturación unificada.
AI Gateway que redirige las solicitudes de agentes de programación al modelo adecuado más barato, reduciendo los costes de API en ~40%