Pendra

Ejecuta modelos de IA de código abierto en tus propias GPU o en hardware alojado en el Reino Unido, con una API compatible con OpenAI y cero retención de datos.

Verificada API disponible Plan gratuito
Datos rápidos
Qué es Ejecuta modelos de IA de código abierto en tus propias GPU o en hardware alojado en el Reino Unido, con una API compatible con OpenAI y cero retención de datos.
Precios Freemium — de £99/mo
Plan gratuito
Plataforma Web Application
API
Ideal para Clinical document processing (summarise records, extract from discharge notes), Privileged document review in legal firms
Dominio registrado 2026

Datos actualizados 15 de agosto de 2026

¿Qué hace Pendra?

Pendra es una plataforma de inferencia gestionada creada para equipos en industrias reguladas que necesitan usar IA sin entregar datos sensibles a un tercero. En lugar de enviar prompts a una nube pública, instalas un pequeño worker en tus propias GPU (o usas los de Pendra alojados en el Reino Unido), descargas en él modelos de pesos abiertos como Qwen, Llama o DeepSeek y los llamas a través de una única API. Todo el sistema está diseñado para que tus datos nunca salgan de tu control: sin retención, sin jurisdicción extranjera y sin exposición.

Características principales

Qué la hace destacar
01
Puedes instalar un worker en tus propias GPUs con un solo comando o, si prefieres no complicarte, usar el hardware gestionado de Pendra en el Reino Unido.
02
Puedes descargar y cambiar entre modelos open-weight (como Qwen, Llama, DeepSeek, Gemma o gpt-oss) directamente desde la consola o la CLI.
03
Si ya usas SDKs de Python o Node.js, esto te va a encantar: ofrece endpoints compatibles con OpenAI y Anthropic. Básicamente, puedes integrar todo sin complicaciones porque tu código actual funciona tal cual.
04
Su arquitectura garantiza que no se retengan datos, y si quieres blindar aún más tus prompts, puedes activar el cifrado end-to-end.
05
Despliegue híbrido: combina tus propios workers self-hosted con las GPUs gestionadas por Pendra, todo bajo una misma API.

¿Para quién es Pendra?

Quién saca más provecho de esta herramienta
Clinical document processing (summarise records, extract from discharge notes)
Privileged document review in legal firms
Citizen data automation for public sector (classification, redaction, response)

Precios

Plan gratuito disponible — empieza sin tarjeta de crédito

Free

Gratis
  • Solo para uso personal
  • 1 Pendra Worker autoalojado
  • Endpoint de API compatible con OpenAI
  • Cero retención de datos
  • Jurisdicción soberana
  • SDKs de Python y Node.js
  • Documentación de la comunidad

Pro

£99,0/mes

Todo lo de Free, y además:

  • Derechos de uso comercial
  • Hasta 5 Pendra Workers autoalojados
  • Analíticas de uso avanzadas
  • Monitoreo de Workers y alertas vía webhook
  • DPA estándar incluido
  • Soporte prioritario vía email
  • Registro de solicitudes (opcional)
  • Inferencia privada (cifrado end-to-end)

Enterprise

Personalizado

Todo lo de Pro, y además:

  • Infraestructura de GPU gestionada por Pendra
  • Workers autoalojados ilimitados
  • Enmascaramiento y redacción automática de datos
  • Registro de auditoría granular
  • Soporte para DPA y DPIA personalizados
  • Gestor de cuenta dedicado
  • SLA con garantía de tiempo de actividad
  • SSO y control de acceso basado en roles
  • Soporte de onboarding e integración

Confianza y presencia

Dominio Dominio registrado en 2026

Galería

Haz clic en cualquier imagen para ampliarla

Alternativas en Inferencia de IA

Lambda Verificada Inferencia de IA

Plataforma en la nube que alquila GPUs NVIDIA H100/B200/B300 para entrenar y ejecutar modelos de IA a escala

Inferless Verificada Inferencia de IA

Plataforma de GPU serverless para desplegar modelos de aprendizaje automático en minutos, con autoescalado y precios de pago por uso.

Entrim AI Verificada Inferencia de IA

API para ejecutar LLM de código abierto: hasta un 80 % más barata que la competencia, con alto rendimiento y prioridad en la privacidad.

Superlinked Verificada Inferencia de IA

Motor de inferencia de IA self-host para búsqueda y procesamiento de documentos: despliega modelos en tu propia infraestructura en la nube.

RunInfra Verificada Inferencia de IA

Optimiza modelos de IA de código abierto para producción: compara motores, ajusta la latencia y despliega en cualquier GPU.

RunPod Verificada Inferencia de IA

Plataforma de GPU en la nube para desarrolladores de IA: despliega, entrena y escala modelos de IA con infraestructura bajo demanda

Sitio Top 100k
vLLM Verificada Inferencia de IA

Motor de inferencia de LLM de alto rendimiento para un servicio de modelos de IA rápido y eficiente en memoria.

Sitio Top 100k
Cerebras Verificada Inferencia de IA

El motor de escala de oblea de tercera generación de Cerebras (WSE-3) es el procesador de IA más rápido de la Tierra. Supera a todos los demás procesadores en núcleos optimizados para IA, velocidad de memoria y ancho de banda de la estructura en el chip.

Sitio Top 100k
Compartir X LinkedIn Telegram
Pendra Visitar