Pendra
Ejecuta modelos de IA de código abierto en tus propias GPU o en hardware alojado en el Reino Unido, con una API compatible con OpenAI y cero retención de datos.
| Qué es | Ejecuta modelos de IA de código abierto en tus propias GPU o en hardware alojado en el Reino Unido, con una API compatible con OpenAI y cero retención de datos. |
|---|---|
| Precios | Freemium — de £99/mo |
| Plan gratuito | Sí |
| Plataforma | Web Application |
| API | Sí |
| Ideal para | Clinical document processing (summarise records, extract from discharge notes), Privileged document review in legal firms |
| Dominio registrado | 2026 |
Datos actualizados 15 de agosto de 2026
¿Qué hace Pendra?
Pendra es una plataforma de inferencia gestionada creada para equipos en industrias reguladas que necesitan usar IA sin entregar datos sensibles a un tercero. En lugar de enviar prompts a una nube pública, instalas un pequeño worker en tus propias GPU (o usas los de Pendra alojados en el Reino Unido), descargas en él modelos de pesos abiertos como Qwen, Llama o DeepSeek y los llamas a través de una única API. Todo el sistema está diseñado para que tus datos nunca salgan de tu control: sin retención, sin jurisdicción extranjera y sin exposición.
Características principales
Qué la hace destacar¿Para quién es Pendra?
Quién saca más provecho de esta herramientaPrecios
Plan gratuito disponible — empieza sin tarjeta de créditoFree
- Solo para uso personal
- 1 Pendra Worker autoalojado
- Endpoint de API compatible con OpenAI
- Cero retención de datos
- Jurisdicción soberana
- SDKs de Python y Node.js
- Documentación de la comunidad
Pro
Todo lo de Free, y además:
- Derechos de uso comercial
- Hasta 5 Pendra Workers autoalojados
- Analíticas de uso avanzadas
- Monitoreo de Workers y alertas vía webhook
- DPA estándar incluido
- Soporte prioritario vía email
- Registro de solicitudes (opcional)
- Inferencia privada (cifrado end-to-end)
Enterprise
Todo lo de Pro, y además:
- Infraestructura de GPU gestionada por Pendra
- Workers autoalojados ilimitados
- Enmascaramiento y redacción automática de datos
- Registro de auditoría granular
- Soporte para DPA y DPIA personalizados
- Gestor de cuenta dedicado
- SLA con garantía de tiempo de actividad
- SSO y control de acceso basado en roles
- Soporte de onboarding e integración
Confianza y presencia
Galería
Haz clic en cualquier imagen para ampliarlaAlternativas en Inferencia de IA
Plataforma en la nube que alquila GPUs NVIDIA H100/B200/B300 para entrenar y ejecutar modelos de IA a escala
Plataforma de GPU serverless para desplegar modelos de aprendizaje automático en minutos, con autoescalado y precios de pago por uso.
API para ejecutar LLM de código abierto: hasta un 80 % más barata que la competencia, con alto rendimiento y prioridad en la privacidad.
Motor de inferencia de IA self-host para búsqueda y procesamiento de documentos: despliega modelos en tu propia infraestructura en la nube.
Optimiza modelos de IA de código abierto para producción: compara motores, ajusta la latencia y despliega en cualquier GPU.
Plataforma de GPU en la nube para desarrolladores de IA: despliega, entrena y escala modelos de IA con infraestructura bajo demanda
Motor de inferencia de LLM de alto rendimiento para un servicio de modelos de IA rápido y eficiente en memoria.
El motor de escala de oblea de tercera generación de Cerebras (WSE-3) es el procesador de IA más rápido de la Tierra. Supera a todos los demás procesadores en núcleos optimizados para IA, velocidad de memoria y ancho de banda de la estructura en el chip.