Aplicación de escritorio para ejecutar modelos de IA sin conexión: descarga, verifica y usa modelos sin internet ni GPU.
Inferencia de IA — herramientas de IA
266 herramientas en esta categoríaInfraestructura para ejecutar modelos en producción: despliegue de checkpoints mediante una API, alquiler de GPUs por segundo, procesamiento de trabajos por lotes y monitoreo de la latencia y el coste por solicitud. Se sitúa después de la etapa de entrenamiento; es aquí donde el modelo se convierte en un recurso que una aplicación puede invocar.
Alquila servidores GPU privados y preconfigurados en la UE para el desarrollo, entrenamiento e inferencia de modelos de IA.
Nube de IA confidencial: ejecuta agentes, LLM y trabajos de GPU en TEE respaldados por hardware con resultados verificables
Acceso API serverless a más de 22.700 modelos de IA de código abierto para programar, escribir e investigar.
Acceso bajo demanda a clústeres de GPU en la nube NVIDIA H100, H200 y AMD MI300 para cargas de trabajo de IA y aprendizaje profundo.
API de inferencia de IA de alto rendimiento: despliega cualquier LLM de HuggingFace entre 3 y 10 veces más rápido con un endpoint compatible con OpenAI.
Plataforma de playground de IA para experimentar con múltiples modelos de IA generativa en una sola interfaz
Desarrolla LLM de propósito general con capacidades de razonamiento similar al humano para aplicaciones de IA en el mundo real.
API para ejecutar LLM de código abierto: hasta un 80 % más barata que la competencia, con alto rendimiento y prioridad en la privacidad.
Stack de inferencia de IA priorizando la privacidad: ejecuta más de 45 modelos de código abierto con precio mensual fijo y cero retención de datos
Accede a más de 100 modelos líderes de IA de texto, imagen y vídeo a través de una única API compatible con OpenAI.
Comparte la GPU de tu ordenador como un endpoint en la nube para aplicaciones de IA, accesible desde cualquier lugar mediante una API compatible con OpenAI.
Plataforma de IA empresarial que ofrece observabilidad en tiempo real, recuperación inteligente de datos y agentes autónomos con seguridad y cumplimiento.
Un ingeniero de IA autónomo que construye, evalúa y ajusta modelos de aprendizaje automático y agentes de IA a partir de una descripción sencilla.
Plataforma no-code para crear y ejecutar flujos de trabajo de IA con más de 1500 modelos para creación de contenido, marketing y automatización.
Plataforma de LLM basada en difusión que genera texto en paralelo para una inferencia de IA más rápida y económica
Plataforma de nube de GPU para entrenamiento de IA: alquila chips de IA de NVIDIA y fabricantes chinos por hora para proyectos de aprendizaje automático
Nexa SDK ejecuta cualquier modelo en cualquier dispositivo y backend local —texto, visión, audio, voz o generación de imágenes— en NPU, GPU o CPU. Soporta NPU de Qualcomm, Intel, AMD y Apple, GGUF, Apple MLX y los modelos SOTA más recientes (Gemma3n, PaddleOCR).
Sandboxes de Linux persistentes para agentes de IA que arrancan en menos de 50 ms; paga solo por el tiempo de cómputo activo.
Servidor de inferencia de IA de código abierto y un asistente de correos para cerrar acuerdos en negociaciones críticas
Un laboratorio de investigación de IA autónomo e IDE de programación: Clark Agent se encarga de la ingeniería y la investigación mientras los humanos aportan criterio y feedback.
Plataforma de GPU serverless para desplegar modelos de aprendizaje automático en minutos, con autoescalado y precios de pago por uso.
Infraestructura para agentes de IA: búsqueda en tiempo real, enrutamiento de modelos y un sandbox de ejecución seguro
Un marco de desarrollo de IA de código abierto y escenario completo para crear y entrenar modelos en diversos dispositivos y procesadores.